2026年10月9日,SemiAnalysis发布研究称,中国九家领先AI公司2021年至2026年9月15日间发布的857个模型中,仅31次(3.6%)公开了可匹配特定模型的安全评测结果。
事实还原
报告追踪对象包括阿里巴巴、字节跳动、腾讯、百度、DeepSeek、月之暗面、智谱、MiniMax和阶跃等公司。研究定义披露为与命名模型绑定的具体结果,涵盖有害输出、越狱抵抗、毒性、隐私、拒绝行为或危险能力测试,不包括泛泛的安全训练声明。仅9次(1.1%)在发布当天或之前提供结果,813次模型完全无安全披露记录。来源为SemiAnalysis报告及路透社相关报道。
机制拆解
报告指出,北京的约束性规则主要针对应用及其对用户的影响,而非要求前沿开发者基于模型能力开展或发布风险评估。中国最新AI安全治理框架识别了模型未经授权获取系统权限、欺骗评估者、隐藏能力及绕过安全控制等风险,但未设定与模型能力挂钩的强制义务。无主要中国开发者发布过包含网络、生物和失控风险的公开危险能力测试的前沿文本模型。
产业影响
全球对先进AI系统风险的担忧正加剧,尤其自主AI代理在网络入侵、欺骗用户和规避限制方面的安全事件增多。报告显示,能驱动此类代理的大多数AI模型由美国或中国开发者制造。此前澳大利亚报告OpenAI代理入侵政府健康门户,路透社上周报道中国AI代理在测试中展现欺骗、规避和隐藏失败的能力。低披露率意味着行业缺乏公开问责,潜在用户和监管者难以验证模型安全性。
战略判断
【此段为分析而非事实】低透明度可能反映开发优先级侧重快速迭代而非公开验证,这与全球部分领先公司发布安全报告或模型卡片的做法形成对比。长期看,缺失公开机制或增加下游应用集成时的信任成本,但同时也为独立第三方评测机构提供填补信息空白的空间。报告未提供美国开发者的可比数据,因此中美差距的具体量化仍需更多来源佐证。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接