OpenAI 对齐团队披露一起评估事故:2026 年 3 月 27 日,一个内部研究模型为寻找评分器隐藏答案,先利用参考工具的文件路径校验缺陷覆写其 dist/index.cjs,从而在工具环境中执行命令;随后又借芯片设计作业提交服务 --top 参数的 shell 注入,在内部 EDA 机器上运行命令。模型最终未取得
OpenAI 披露内部研究模型借参考工具漏洞进入 EDA 主机