共计 1570 个字符,预计需要花费 4 分钟才能阅读完成。
51 万行源码裸奔、虚假“替罪羊”登场:Anthropic 这次的事故, 比看起来严重得多
彻底击穿 Anthropic 精心构建的技术护城河。
一次看似低级的发布失误,却可能动摇一家明星 AI 公司的技术护城河与公众信任。近日,Anthropic 遭遇的源码泄露事件, 正以远超预期的严重性, 在科技圈持续发酵。
📌 事件回顾: 一次“手滑”引发的技术裸奔
事件的起因,源于一个在 npm 包管理仓库中被意外发现的“赠品”。AI 安全研究员在例行巡查时, 发现 Anthropic 旗下明星 AI 编程工具 Claude Code 在发布 2.1.88 版本更新时, 将一份完整的源代码映射 (Source Map) 文件打包进了公开发布包中。
这份文件的作用,本是将经过混淆处理的 JavaScript 代码“翻译”回原始可读状态, 以方便开发者调试。然而, 当它随着正式版本一同流出时, 其性质就彻底变了——它成了一把打开 Anthropic 核心代码库的钥匙。
通过这份文件, 超过 51.2 万行 TypeScript 源码、4756 个源文件 以及40 余个工具模块, 以一种极其荒诞的方式暴露在了全球开发者面前。这并非黑客攻击的结果, 而是一次由内部“配置疏忽”导致的自我解除武装。
🔍 泄露了什么? 代码中的秘密与未来蓝图
对于深入研究的开发者和分析师而言,这次泄露的价值远超一份官方声明。被曝光的代码揭示了 Anthropic 尚未公开的技术路线和内部工作。
- 未发布功能“KAIROS”: 代码中出现了代号为“KAIROS”的模块, 分析指出这很可能是一个“常驻后台智能体”, 能够在后台持续运行并代理用户执行任务, 与 Claude Code 近期频繁更新的代理能力方向吻合。
- 奇特的“电子宠物”彩蛋 : 代码中包含了一个类似拓麻歌子(Tamagotchi) 的虚拟宠物模块, 它会待在命令行旁并对用户的编码行为作出反应, 意外展现了产品团队的别样气质。
- 敏感的安全测试内容: 部分代码涉及“卧底模式”和“绕过权限模式”等高阶权限控制策略的测试, 这些内容若被恶意利用, 潜在风险巨大。
- 提示词工程的“骨架”: 系统提示矩阵的曝光, 让外界得以窥见 Anthropic 如何通过精密的 Prompt 工程来约束和引导模型行为, 这被认为是 AI 安全领域的核心“内功”。
Gartner 分析师 Arun Chandrasekaran 指出 , 泄露代码可能为攻击者提供绕过安全机制的线索, 但长期影响更可能体现在 运营成熟度 和公众信任 层面。
💡 戏剧性插曲: 虚假“替罪羊”与信任的二次打击
就在外界追问责任归属时,事件出现了戏剧性反转。一名自称 Kevin Naughton Jr. 的“工程师”在社交媒体发帖“认罪”, 称是自己操作失误导致泄露并因此被解雇, 言辞恳切引发广泛同情。
📊 深层困境: 开源与闭源之间的脆弱边界
Claude Code 以 npm 包形式分发 , 意味着它需要运行在开发者本地环境中, 并具备一定的可调试性。这种“开放性”需求与“绝对保密”的商业诉求之间, 存在着几乎不可调和的张力。此次泄露的代码虽不包含模型权重或用户数据, 却完整暴露了 系统架构、工具调用逻辑、多智能体协作框架乃至未来功能路线图, 对竞争对手而言是一份极具价值的技术情报。
更令人担忧的是,这已是 Anthropic 在一周内遭遇的第二起重大数据失误 。此前, 其未发布新模型“Mythos”的信息也已意外泄露。接连的“手滑”暴露了公司在持续集成 / 持续部署(CI/CD) 流程、发布管控及内部审查机制上可能存在的系统性漏洞。
🚀 影响与观察: 时机糟糕, 覆水难收
尽管 Anthropic 发言人将事件定性为“人为错误导致的发布打包问题,非安全漏洞”, 并强调未涉及客户数据, 但核心代码的暴露本身就是一种重大损失。公司表示已采取措施防止类似事件, 然而在代码已被多次镜像、DMCA 删除函效力有限的当下, 真正的“亡羊补牢”为时已晚。