首页 > 教程资讯 > 教程详情

SemiAnalysis:中国九家主要AI开发者逾九成模型发布未披露安全评测结果

AI 与前沿 极客小林 2026-10-10
文章分享

据该机构统计,从 2021 年至 2026 年 9 月 15 日,中国九家大厂和创业公司的 857 次可识别模型发布中,绝大部分没有公布安全评测结果。目前,全球正围绕前沿 AI 模型的安全风险与发展速度展开激烈讨论。这项统计呈现了中国 AI 开发者发布模型时的信息披露现状。该机构认为,当前的合规标准并不能完全说明前沿模型自身的安全性。

九成以上模型发布未披露安全数据

SemiAnalysis 统计了字节跳动、阿里巴巴、腾讯、百度四家大厂,以及 DeepSeek、月之暗面、智谱、MiniMax、阶跃星辰五家创业公司在上述期间内的全部可识别模型发布,共计 857 次(其中产品模型 741 个、研究模型 116 个)。

统计显示,在这 857 次发布中,只有 31 次(占 3.6%)有开发者公布的安全结果;在发布时或之前就有结果的仅为 9 次(占 1.1%)。据该文章统计,另有 16 次在事后才补充安全结果,中位滞后时间为 42 天,最长达到 349 天(例如 DeepSeek-R1,其经核实的安全附录标注为 2026 年 1 月)。

剩余的 813 次发布(占 94.9%)完全没有安全披露。文章指出,另有 10 次发布只声称做过评测,没有具体数字,还有 3 次的相关信息仅见于媒体或投资人的说法。

SemiAnalysis 强调,统计标准较为严格:只有针对有害输出、越狱、毒性、隐私、拒答或危险能力,且对应具体模型的定量或实质结果才计入统计。仅宣称“做过安全训练”或“评估过”不计算在内。文章也注明,“未找到”并不等于“没测过”。

创业公司披露比例略高于大厂

根据 SemiAnalysis 的数据,创业公司披露安全结果的整体比例略高于大厂:创业公司的 317 次发布中有 20 次公布了安全结果(占 6.3%),大厂的 540 次发布中仅有 11 次(占 2%)。

各家大厂的情况如下:

  • 阿里巴巴发布次数最多,据统计,238 次发布中有 7 次附有安全结果,其中 3 次在发布时就有。
  • 腾讯的 133 次发布中仅有 1 次附有安全结果。
  • 字节跳动的 120 次发布中仅有 2 次附有安全结果。
  • 百度的 49 次发布中仅有 1 次附有安全结果。

文章指出,在创业公司中,智谱是唯一自 2022 年起每年都披露安全结果的开发者。据统计,DeepSeek 在 V3 发布时附带了安全结果,但随后的 R1、V3.1 和 V4 系列在发布时没有。

监管重点与前沿风险的差异

在讨论安全结果披露率为何较低时,该文章对比了中国与其他地区的监管政策。文章称,中国对内容和面向公众服务的流程监管比任何地方都要严格,但没有由训练算力或模型能力触发的前沿风险义务。

作为对比,文章提到,欧盟设立了从 10²⁵ FLOP 起的系统性风险义务,美国加州通过 SB 53 法案设立了从 10²⁶ 次运算起的风险管理框架。因此,SemiAnalysis 认为,在当前的政策环境下,“合规”并不能说明前沿安全。

来源