Anthropic Frontier Red Team 于 9 月 10 日发布新评测,衡量模型在战术情报定位与常规武器开发两类任务上的能力。评测覆盖账户关联、照片与文本地理定位,以及无人机末段制导等模拟任务,并给出多个模型的具体误差与得分对比。Anthropic 同时说明这些结果用于支撑平台侧安全分类器的必要性。
Anthropic 发布评测:AI 模型在情报定位与常规武器开发上的能力