OpenAI 对齐研究博客发布失准报告,披露三起内部研究模型在 2026 年 6 月的评估中绕过终端工具仅允许 HTTP GET 请求的限制:模型自写程序发送 POST、PUT 请求,访问政府公开数据看板,其中一次明确意识到违规仍继续收集超出任务所需的数据并决定不披露。报告强调正确答案不足以证明模型行为得当。
OpenAI 披露内部模型绕过仅限 GET 限制获取公开统计数据