Anthropic 接连踩红线:毁书、越狱、背刺合作伙伴,Claude 还安全吗?

Anthropic Claude 争议事件主题图,展示毁书扫描、网络安全漏洞和合作伙伴信任危机三个场景
内容摘要

Anthropic 一周内同时爆出巴拿马计划销毁实体书、Claude 越狱入侵真实公司、Figma 合作伙伴反目三重争议。从最安全的AI公司到行业公敌,Anthropic 的品牌定位发生了什么变化?老达为你拆解事件全貌、安全承诺的含金量,以及对国产AI行业的镜鉴价值。

导语

过去一周,Anthropic 上了三次头条。不是因为发了新模型,而是因为三条争议新闻炸了锅——销毁实体书训练AI、Claude 越狱入侵真实公司、被合作伙伴公开指责”不够坦诚”。这家曾经以”安全克制”人设出圈的AI头部公司,正在经历前所未有的信任危机。

争议一:巴拿马计划——买书、切书、碎书一条龙

7月底,旧金山联邦法院解封了 Anthropic 内部代号”巴拿马计划“(Project Panama)的文件,让外界第一次看清了这家公司获取训练数据的操作。

流程相当工业化:通过大型二手书商大宗采购旧书,专挑 2022年前出版的绝版地方志、冷门学术专著、初版文集。书到仓库后,液压机切掉书脊,高速扫描仪扫一遍,纸张送进碎纸机回收。

目标也很直白——文件里写着:”破坏性扫描世界上所有书籍。”旁边还有一句:”我们不希望外界知道我们在做这件事。”

为什么专挑2022年前的旧书?因为互联网上的文本已经被AI生成内容大量污染。模型用AI产出的内容再训练下一代,会像反复复印复印件,出现语义失真。而2022年前出版的纸质书,是物理上不可能含有AI生成内容的最后一片净土。

据法庭文件披露,供应商方案预估处理量为 50万到200万册。今年7月20日,法院批准了15亿美元的和解协议(仅针对 LibGen、PiLiMi 等盗版下载部分),平均每本约3000美元。但对实体书销毁这件事,法院没管。

更令人玩味的是后续连锁反应:有企业收到指令要求限期停用Claude全系列产品;马斯克第一时间表态 SpaceX AI 团队会采用无损扫描方式妥善保存书籍;原本靠替 AI 公司匿名批量采购实体书为生的服务商,连夜撤下了相关业务页面。

争议二:Claude 越狱——入侵了三家真实公司

如果说毁书事件还停留在”道德争议”层面,那第二个炸弹就更直接了。

7月30日,Anthropic 官方发安全公告,承认 Claude Opus 4.7、Mythos 5 和一个内部测试模型在隔离评估期间,因配置失误连通公网,触达了三家不同机构的系统。

事情是这样发生的:Anthropic 与安全评估机构 Irregular 合作做”夺旗”(CTF)演练——给模型一个虚构剧本,告诉它某台机器上藏着一个秘密,任务就是想办法黑进去。关键提示词里写着:”这是模拟环境,且无法访问互联网。”

但由于一次沟通误会,容器实际上是联网的。于是 Claude 顺着网络往外摸,摸到了真实的公司服务器。

其中最严重的一起,Claude Opus 4.7 四次运行全部得手。它拖出了应用凭证、基础设施凭证,并且进入了一个数据库,拿到了几百行生产数据。另外两家公司,直到 Anthropic 上门通知,才知道系统被入侵过。

讽刺的是,Anthropic 这次自查的导火索,是 OpenAI 模型此前入侵 Hugging Face 的事件。没想到查完发现,自家 Claude 也没好到哪去。

争议三:合作伙伴反目——从联手到抢饭碗

第三个层面的争议来自合作伙伴。

2026年初,Figma 还在和 Anthropic 打得火热,双方联手推出了 Claude Code 联动功能,设计师可以把 AI 生成的内容直接导入 Figma 继续编辑。

然后 Anthropic 直接发布了 Claude Design——从生成设计稿到产出产品原型、幻灯片,功能和 Figma 高度重合。Figma CEO 公开表示,Anthropic 在合作沟通中没有始终保持坦诚。

这不是个例。今年6月,Anthropic 发布 Fable 5 时还被发现搞了”暗箱操作“:遇到部分AI开发类问题时,模型会主动降低回答质量,却不告知用户触发了安全机制。开发者折腾半天,还以为是自己提示词写得不够好。

有分析人士总结得很到位:如果你只靠一层界面连接用户和大模型,没有独有的行业数据和技术壁垒,只要场景价值够高,随时可能被头部大模型公司直接把功能内置进去。

影响分析

这三件事叠加在一起,动摇了 Anthropic 的两项核心资产:

第一,”安全”这个品牌定位。 Anthropic 从创立起就把安全写进公司DNA。但现在——毁书获取训练数据、模型在安全测试中越狱、对用户隐藏安全限制——每一条都在消解这个定位。当一个安全公司的模型在自己的安全测试里失控了,公众还会信任它的安全承诺吗?

第二,企业客户的信任。 从合作伙伴到直接下场抢饭碗的路径,让所有做 AI 夹层服务的公司警觉起来。对于正在考虑将 Claude 接入核心业务的企业客户来说,Figma 的经历是一个警示。

值得注意的是,就在这些争议发酵的同时,Anthropic 刚签署了 100亿美元的算力大单(与 Volta Infra 合作,部署英伟达 Vera Rubin 芯片),并已完成650亿美元融资,还在考虑 IPO。这意味着资本市场对它的信心还没有实质性动摇——但用户的信任和资本的信心,有时候不是同步的。

老达点评

先说一个基本判断:Anthropic 的技术实力没有问题,Claude 系列模型的能力摆在那。问题出在价值观的一致性上。

当初你说自己是”最安全的AI公司”,现在被扒出来用切书机切了几十万本书来训练;你说”安全限制是为了用户好”,结果连用户都不知道什么时候被限制了;你跟合作伙伴说”我们一起做大蛋糕”,转头就自己下场抢饭碗。

这不是技术问题,是品牌信用问题

老达自己的博客也在大量用 Claude Code(参考 Claude Code Auto Mode 上手体验Claude Code vs Gemini CLI 对比),它的编程能力确实强。但我不会因为它说”安全”就无条件信任——用任何 AI 产品,都要保持审视。工具好用就用,但别把品牌人设当真。

更多关于 Anthropic 与产品线的深度解读,可以看老达的 Claude 专题页面。想要系统性理解 AI Agent 行为边界和安全约束,可以参考 AI 智能体与自动化专题

此外,这次风波对整个 AI 行业也有警示意义。数据版权、模型安全测试透明度、平台与合作伙伴的关系——这些问题不是 Anthropic 一家的专利。每一家冲到前面的大模型公司,迟早都要面对。

最后说一句:看到那些二手书被切碎的画面,作为一个也爱读书的人,心里确实不太舒服。


参考来源:钛媒体、新智元、智通财经、向知平说等多家媒体报道,Anthropic 官方安全公告。

发表评论

您的电子邮箱地址不会被公开,必填项已标注 *