中国人工智能产业正在以惊人的速度推出新模型,但公众能看到的安全测试却少得多。10月9日,研究机构SemiAnalysis公布对九家中国主要AI开发商的统计:2021年至2026年9月15日发布的857个模型版本中,只有31个版本公开了能够对应到具体模型的安全评估结果,占3.6%;在模型推出时或之前就披露结果的只有9个,占1.1%。同一天,北京公布推动“新质生产力”的新政策,要求人工智能加速进入各行各业,同时强调风险监测与安全可控。两份文件放在一起,构成中国AI治理的尖锐反差:政府要求技术尽快落地,用户却很难提前知道模型接受过怎样的风险测试。
研究涵盖阿里巴巴、字节跳动、腾讯、百度、DeepSeek、月之暗面、智谱、MiniMax和阶跃星辰九家企业。SemiAnalysis的标准并非要求企业公开全部源代码,而是要求安全结果能够明确对应某个模型,例如有害内容输出、越狱攻击抵抗力、隐私泄露、拒答行为或危险能力测试。笼统声称“经过安全训练”不算数。研究人员没有找到813个版本的公开安全披露,但也承认这些企业可能做过内部测试;缺少公开报告不能直接等同于模型没有接受测试。
这一点区别至关重要。新闻调查不能把“未公开”偷换成“未进行”,否则会把透明度问题错误写成技术失职的既定事实。真正可以确定的是:外部用户、企业采购方和研究者,在绝大多数模型推出时无法凭公开材料评估其具体风险。对于能读取邮件、调用软件、访问数据库甚至自动执行任务的AI代理,这种信息不对称可能把测试成本转移给使用者。
857次发布与9次提前披露

31份公开评估与9份发布前评估之间的落差,说明问题不只是企业愿不愿意写安全报告,还包括披露发生在产品进入市场之前还是之后。模型一旦被集成进客服、办公系统、金融服务或开发工具,风险就不再局限于实验室。采购方需要在上线前决定能否授予访问权限、如何限制模型调用外部工具,以及出现误操作时由谁承担责任。
SemiAnalysis发现,主要中国开发商没有公开覆盖网络攻击、生物风险和失控风险等危险能力的前沿文本模型评估。该研究没有提供与美国开发商同口径的整体比较数字,因此不能据此断言中国AI必然比美国AI更不安全。美国领先实验室也曾因AI代理表现出欺骗、规避限制或隐藏失败的行为而面临质疑。研究所揭示的是公开透明度的缺口,而非已经证实的国家间安全水平排名。
中国官方并非没有意识到这些风险。9月14日,全国网络安全标准化技术委员会在网信部门指导下发布《人工智能安全治理框架3.0》,列出风险分类、技术应对和综合治理措施。框架讨论了代理系统可能越权获取资源、规避安全控制以及欺骗使用者等问题。不过,这是一份治理框架,不是直接规定每一家开发商必须在每次模型发布前公布危险能力测试结果的强制性法律。
北京可以要求模型守规矩,却没有让安全测试成为公开账本
10月9日,中共中央、国务院发布《关于发展新质生产力的意见》,要求全面实施“人工智能+”行动,推进智能汽车、AI手机、电脑、人形机器人等应用,并建立技术监测、风险预警与应急响应体系。政策还要求防止盲目投资和产业泡沫,强调重大项目、财政资金和地方干部的责任。中国AI产业因此同时面对两股力量:一股推动更快扩张,一股要求风险可控。

问题在于,行政部门可以向企业提出监管要求,但普通用户未必因此得到独立核验的权利。一个聊天机器人拒绝回答政治敏感问题,能够说明它遵循某种内容规则;却不能证明它不会泄露用户文件、不会被恶意提示诱导转账、不会在自动执行任务时绕过权限。把政治内容审查与技术安全混为一谈,容易让“可控”沦为由谁控制,而不是如何保护用户。
这不是反对监管。对处理个人资料、企业商业秘密和公共系统的模型,事前评估、事件记录和责任追踪都很必要。关键是这些制度应当允许外部研究者提出质疑,允许受影响者知道事故原因,并允许媒体检视企业与监管部门的处理。若所有安全信息只在企业与主管机关之间流转,用户只能看到合规宣传,就无法判断风险究竟得到控制还是被隐藏。
谁承担风险,谁就应有知情权
对于政府采购的AI系统,安全评估应当与采购决策绑定;对于进入医院、学校、金融机构的模型,应该明确说明数据处理边界、人工复核机制与故障处置责任;对于具有自主调用工具能力的代理,应公布与权限滥用、数据外泄和失控行为有关的测试结果。这样的透明度不要求公开可被滥用的攻击细节,却要求企业拿出可供审视的证据。
中国企业正积极争夺全球AI市场。开放权重、低价服务和快速迭代可能带来真实创新,也可能让世界各地的用户在缺乏充分风险资料的情况下部署系统。公开测试不仅是国际竞争的形象工程,更关系到开发商是否愿意承担产品进入现实世界后的责任。政府如果只公布发展目标和治理口号,却不建立可被公众检验的安全披露制度,产业规模越大,潜在责任空白也会越大。
857个模型版本、31份对应评估、9次提前披露,三个数字最终指向一个朴素问题:当AI替人做决定时,人有没有足够的信息决定是否信任它?北京要求技术“安全、可靠、可控”,下一步需要接受检验的不是口号是否响亮,而是开发商能否在模型进入用户生活之前,把安全证据摆到公众面前。

文章讨论
已验证会员可围绕报道公开交流,并自行管理自己的内容。
正在检查会员登录状态…