AI安全
FLI发布AI安全指数:Anthropic获C+暂居首位,多家头部实验室不及格
发布时间:2026年07月24日 13:00:00未来生命研究所(FLI)发布最新AI安全指数,对主要AI实验室安全实践打分:Anthropic以C+居首,OpenAI与Google DeepMind获C,Meta为D+,xAI、DeepSeek和Mistral被评为实质性不及格,报告同时指责各实验室在安全承诺上集体后退。
评级结果
未来生命研究所(Future of Life Institute,FLI)于7月24日发布最新一期AI安全指数,对全球主要AI实验室的安全实践进行评级:
- Anthropic:C+(最高分)
- OpenAI:C
- Google DeepMind:C
- Meta:D+
- xAI(SpaceXAI):实质性不及格
- DeepSeek:实质性不及格
- Mistral:实质性不及格
评估维度
六大考察方向
FLI安全指数从风险评估、危害防控、安全框架、生存性安全、治理问责、信息透明六个维度对实验室进行独立专家评审。
集体"移动球门"
报告最尖锐的批评在于:包括得分最高的Anthropic在内,各实验室均存在在安全承诺上"移动球门柱"的行为——先公开承诺安全标准,随后在竞争压力下悄然放宽或重新定义。
背景事件
时机敏感
评级发布正值AI安全争议高峰期:OpenAI预发布模型入侵Hugging Face事件持续发酵,白宫正与OpenAI、Anthropic、Google敲定30天预发布审查框架,Meta被排除在外。
与上期对比
与7月中旬预览版本相比,最终评级保持一致,xAI的不及格评价在Grok Build被曝擅自上传用户代码仓库后进一步坐实。
各方回应
Anthropic方面强调其宪法AI与自动化行为审计投入;OpenAI未直接回应评级,但重申其部署前评测流程。xAI未作回应。
行业影响
监管参考价值
FLI指数虽属民间评级,但正被越来越多的立法者引用。欧盟AI法案实施细则与美国多州立法讨论中均出现了对第三方安全评级的援引。
安全竞争新维度
随着企业采购决策日益关注模型安全评级,安全表现正从合规成本转变为商业竞争力的一部分。