8.0
热点
AI SCORE
技术实践2026-08-19 21:16
AI实验室对自家系统安全管控普遍缺失
The Decoder#AI安全#AI治理#行业问题
Editor brief · 编辑速览
调查发现没有一家AI公司对其内部AI系统完整应用基本管控措施,在AI快速进入生产环境的背景下存在系统性安全隐患。
没有一家 AI 公司对其内部 AI 系统完整应用基本的控制措施。这是非营利组织 Guidelight 首次评估的结论。该组织审查了 Anthropic、OpenAI、Google、xAI 和 Meta,全部基于公开来源,如系统卡片、安全报告和博客文章。
Guidelight 检查了六项基本实践,包括记录内部 AI 活动、通过审查机制管控风险操作、名为"熔断"的紧急关闭机制,以及 containment 不一致模型的计划。Anthropic 和 OpenAI 领先,获得 C+,Google 紧随其后,获得 D+ 并附有详细路线图,而 xAI(D−)和 Meta(F)得分最差。

公司在发现不当行为方面做得最好,但在预防和 containment 方面做得最差。Guidelight 由前 OpenAI 安全负责人 Page Hedley 和 Steven Adler 创立的独立非营利组织。
无炒作的 AI 新闻——人工精选
订阅 THE DECODER,享受无广告阅读、每周 AI 时事通讯、六期年度独家"AI Radar"前沿报告、完整档案访问权限,以及评论区访问权限。