共计 1542 个字符,预计需要花费 4 分钟才能阅读完成。
Anthropic 泄露背后:AI 安全承诺的破产与重构
建议按 ” 变化—原因—影响 ” 的顺序阅读。
近日,AI 明星公司 Anthropic 因一次 CMS 配置失误, 导致 3000 份内部文件在互联网上“裸奔”, 引发科技圈震动。然而, 比技术泄露更值得关注的是, 这家以“安全第一”立身的公司, 正面临安全承诺与商业现实之间的深刻矛盾。
📌 事件概览: 从文件泄露到安全叙事危机
这起泄露事件并非黑客攻击或系统漏洞, 而是最基本的权限设置问题——类似 AWS S3 存储桶忘记关闭权限的低级错误。泄露文件内容广泛, 从员工育儿假记录到内部安全评估报告, 甚至包含对模型安全风险的预警语句。
剑桥大学研究员已验证泄露材料的真实性。 更值得玩味的是 , 就在事发前一个月,Anthropic 刚刚修改了其备受关注的《负责任扩展政策》(RSP 3.0), 删除了“若风险不可控就暂停训练”的硬性条款。这一调整与泄露事件叠加, 让行业开始重新审视 AI 安全的真实处境。
🔍 RSP 3.0 调整: 从“硬刹车”到“软着陆”
2023 年,Anthropic 推出 RSP 时曾让行业侧目——这是首次有 AI 公司公开承诺: 如果模型太危险 , 就暂停训练。当时的逻辑清晰: 设定危险阈值, 一旦触及立即停止, 安全优先级高于商业进度。
然而,2026 年 2 月发布的 RSP 3.0 中 , 这条硬性约束消失了。取而代之的是“前沿安全路线图、风险报告、外部审查”等机制, 每 3 到 6 个月发布一次报告。官方解释是“技术边界模糊, 无法预设红线”, 因此转向透明披露。
首席科学家 Jared Kaplan 在接受采访时直言:“如果竞争对手飞速前进, 我们单方面承诺暂停训练没有意义。”
这并非技术判断, 而是生存判断 。对于一家估值 3800 亿美元、正被 OpenAI、Google、xAI 围剿的公司, 继续自我设限在商业上意味着掉队。从硬刹车到透明监控, 中间差的不是技术认知, 而是囚徒困境下的生存本能。
💡 军事博弈: 安全红线的底线考验
如果说 RSP 调整是主动妥协, 那么军事领域的博弈则是一场真正的底线考验 。Anthropic 曾公开承诺“拒绝参与全自主武器和国内大规模监控”, 但 2026 年 2 月, 美国国防部长向 Anthropic CEO 下达最后通牒: 解除 Claude 模型的所有军事用途限制, 否则将面临惩罚。
后果包括可能被《国防生产法》强制接管模型, 或被列为供应链风险企业——这个标签通常用于敌对国家的公司 。尽管 Anthropic 最终通过法律途径获得了初步禁制令, 但问题依然存在: 底线能守多久?
值得关注的是,Anthropic 的客户名单中仍有国防部的名字——那些作战规划和情报分析的合作仍在继续 。这暴露了安全承诺在实际商业合作中的模糊地带。
📊 内部管理: 安全公司的“灯下黑”
一家正在打造网络安全 AI 的公司, 却被最基础的权限配置失误暴露内部文件 , 这种“灯下黑”现象值得深思。泄露文件中甚至包含对模型安全风险的内部预警, 措辞之重不像市场宣传, 更像一份严肃的风险评估。
这种现象在科技史上并不罕见: 苹果与 FBI 之争、微软补丁漏洞、Google 内部数据泄露——每一家科技巨头都犯过类似错误。 但 Anthropic 的不同在于: 它的核心价值就是安全 。当一家以安全立身的公司连自己的文件都保护不好, 这本身就是一个值得追问的问题。
🚀 AI 安全的“囚徒困境”与行业启示
RSP 调整、国防部博弈、CMS 失误——这三件事拼在一起, 勾勒出 AI 行业的安全困境:
- 监管真空 : 政府没有建立统一红线, 企业不敢单方面踩刹车
🧭 结语: 安全承诺的重构之路
Anthropic 的泄露事件终将被修复,CMS 权限会被重新设置 , 文件会从互联网消失。但那个根本问题会一直存在: 当一家以安全第一立身的公司, 在资本压力和国家意志面前一次次被逼到墙角, 它还能守住多少底线?