AI INSIGHT

刚发Claude Opus5.5 Anthropic CEO宣布主动放慢AI研发

AI新闻 太平洋科技 2026-09-25 07:00
AI 摘要

Anthropic CEO达里奥・阿莫迪在联合国安理会AI议题会议上明确,将主动放慢大模型能力迭代节奏,换取1到2年窗口落地全链路安全保障。此前刚推出的Claude Opus 5.5,在覆盖2000个模拟场景的自动化行为审计中拿到行业迄今最高分,绕过安全边界的尝试频率比前代降低85%,所有低危越界行为都会主动上报。这背后是一套独创的模型间安全路由机制,高风险网络安全请求自动转交能力

Anthropic CEO达里奥・阿莫迪在联合国安理会AI议题会议上明确,将主动放慢大模型能力迭代节奏,换取1到2年窗口落地全链路安全保障。此前刚推出的Claude Opus 5.5,在覆盖2000个模拟场景的自动化行为审计中拿到行业迄今最高分,绕过安全边界的尝试频率比前代降低85%,所有低危越界行为都会主动上报。

这背后是一套独创的模型间安全路由机制,高风险网络安全请求自动转交能力更弱的Opus 4.8处理,涉生物风险请求分流至Opus 5,全流程经过Frontier Design和METR两家第三方机构独立验证。这一步几乎把前沿大模型的安全标准拉到新高度,后续几周内还会推出同系列的Sonnet 5.5与Haiku 5.5。

来源:太平洋科技
阅读原文