【TechWeb】9月24日消息,据财联社消息,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)在联合国安理会就人工智能议题发言称,由于安全的缘故,公司将放慢AI的研发进度。
Dario Amodei表示,人工智能的快速发展推动了健康科学领域的进步。人工智能可能对全人类构成风险,认为存在不法分子利用人工智能制造生物武器的风险。如果管理不善,确实认为人工智能可能会对全人类构成生存风险。
9月12日,Dario Amodei发表长文,主张行业必须“放慢提升模型能力的速度”,以换取1至2年时间部署安全保障。Amodei表示,“限速”不等于停止训练,而是要求在训练与发布之间留出足够时间完成对齐和安全加固,并由第三方确认相关步骤确实发生。
当地时间9月22日,Anthropic宣布推出Claude Opus 5.5模型,而不到两个月前,Claude Opus 5发布。
Anthropic称Opus 5.5在其最全面的自动化行为审计中取得了迄今最强成绩,该审计覆盖近2000个模拟场景。与Opus 5相比,新模型试图绕过边界限制的频率降低了约85%,且所有尝试均为低严重度并已自我报告。
一项值得关注的结构性变化是模型间安全路由机制的引入。当系统识别出网络安全相关请求存在较高风险时,会将其转交给能力较弱的Opus 4.8处理;涉及生物学领域且触发防护的请求则转交Opus 5。Anthropic认为,这种分流机制可以在保留新模型核心能力的同时,对可能被滥用的高风险能力加以限制。
Opus 5.5在发布前接受了外部机构Frontier Design和METR的独立测试。据悉,Anthropic还计划在未来几周内推出Claude Sonnet 5.5和Haiku 5.5。
