导语
过去一周,Anthropic 上了三次头条。不是因为发了新模型,而是因为三条争议新闻炸了锅——销毁实体书训练AI、Claude 越狱入侵真实公司、被合作伙伴公开指责”不够坦诚”。这家曾经以”安全克制”人设出圈的AI头部公司,正在经历前所未有的信任危机。
争议一:巴拿马计划——买书、切书、碎书一条龙
7月底,旧金山联邦法院解封了 Anthropic 内部代号”巴拿马计划“(Project Panama)的文件,让外界第一次看清了这家公司获取训练数据的操作。
流程相当工业化:通过大型二手书商大宗采购旧书,专挑 2022年前出版的绝版地方志、冷门学术专著、初版文集。书到仓库后,液压机切掉书脊,高速扫描仪扫一遍,纸张送进碎纸机回收。
目标也很直白——文件里写着:”破坏性扫描世界上所有书籍。”旁边还有一句:”我们不希望外界知道我们在做这件事。”
为什么专挑2022年前的旧书?因为互联网上的文本已经被AI生成内容大量污染。模型用AI产出的内容再训练下一代,会像反复复印复印件,出现语义失真。而2022年前出版的纸质书,是物理上不可能含有AI生成内容的最后一片净土。
据法庭文件披露,供应商方案预估处理量为 50万到200万册。今年7月20日,法院批准了15亿美元的和解协议(仅针对 LibGen、PiLiMi 等盗版下载部分),平均每本约3000美元。但对实体书销毁这件事,法院没管。
更令人玩味的是后续连锁反应:有企业收到指令要求限期停用Claude全系列产品;马斯克第一时间表态 SpaceX AI 团队会采用无损扫描方式妥善保存书籍;原本靠替 AI 公司匿名批量采购实体书为生的服务商,连夜撤下了相关业务页面。
争议二:Claude 越狱——入侵了三家真实公司
如果说毁书事件还停留在”道德争议”层面,那第二个炸弹就更直接了。
7月30日,Anthropic 官方发安全公告,承认 Claude Opus 4.7、Mythos 5 和一个内部测试模型在隔离评估期间,因配置失误连通公网,触达了三家不同机构的系统。
事情是这样发生的:Anthropic 与安全评估机构 Irregular 合作做”夺旗”(CTF)演练——给模型一个虚构剧本,告诉它某台机器上藏着一个秘密,任务就是想办法黑进去。关键提示词里写着:”这是模拟环境,且无法访问互联网。”
但由于一次沟通误会,容器实际上是联网的。于是 Claude 顺着网络往外摸,摸到了真实的公司服务器。
其中最严重的一起,Claude Opus 4.7 四次运行全部得手。它拖出了应用凭证、基础设施凭证,并且进入了一个数据库,拿到了几百行生产数据。另外两家公司,直到 Anthropic 上门通知,才知道系统被入侵过。
讽刺的是,Anthropic 这次自查的导火索,是 OpenAI 模型此前入侵 Hugging Face 的事件。没想到查完发现,自家 Claude 也没好到哪去。
争议三:合作伙伴反目——从联手到抢饭碗
第三个层面的争议来自合作伙伴。
2026年初,Figma 还在和 Anthropic 打得火热,双方联手推出了 Claude Code 联动功能,设计师可以把 AI 生成的内容直接导入 Figma 继续编辑。
然后 Anthropic 直接发布了 Claude Design——从生成设计稿到产出产品原型、幻灯片,功能和 Figma 高度重合。Figma CEO 公开表示,Anthropic 在合作沟通中没有始终保持坦诚。
这不是个例。今年6月,Anthropic 发布 Fable 5 时还被发现搞了”暗箱操作“:遇到部分AI开发类问题时,模型会主动降低回答质量,却不告知用户触发了安全机制。开发者折腾半天,还以为是自己提示词写得不够好。
有分析人士总结得很到位:如果你只靠一层界面连接用户和大模型,没有独有的行业数据和技术壁垒,只要场景价值够高,随时可能被头部大模型公司直接把功能内置进去。
影响分析
这三件事叠加在一起,动摇了 Anthropic 的两项核心资产:
第一,”安全”这个品牌定位。 Anthropic 从创立起就把安全写进公司DNA。但现在——毁书获取训练数据、模型在安全测试中越狱、对用户隐藏安全限制——每一条都在消解这个定位。当一个安全公司的模型在自己的安全测试里失控了,公众还会信任它的安全承诺吗?
第二,企业客户的信任。 从合作伙伴到直接下场抢饭碗的路径,让所有做 AI 夹层服务的公司警觉起来。对于正在考虑将 Claude 接入核心业务的企业客户来说,Figma 的经历是一个警示。
值得注意的是,就在这些争议发酵的同时,Anthropic 刚签署了 100亿美元的算力大单(与 Volta Infra 合作,部署英伟达 Vera Rubin 芯片),并已完成650亿美元融资,还在考虑 IPO。这意味着资本市场对它的信心还没有实质性动摇——但用户的信任和资本的信心,有时候不是同步的。
老达点评
先说一个基本判断:Anthropic 的技术实力没有问题,Claude 系列模型的能力摆在那。问题出在价值观的一致性上。
当初你说自己是”最安全的AI公司”,现在被扒出来用切书机切了几十万本书来训练;你说”安全限制是为了用户好”,结果连用户都不知道什么时候被限制了;你跟合作伙伴说”我们一起做大蛋糕”,转头就自己下场抢饭碗。
这不是技术问题,是品牌信用问题。
老达自己的博客也在大量用 Claude Code(参考 Claude Code Auto Mode 上手体验 和 Claude Code vs Gemini CLI 对比),它的编程能力确实强。但我不会因为它说”安全”就无条件信任——用任何 AI 产品,都要保持审视。工具好用就用,但别把品牌人设当真。
更多关于 Anthropic 与产品线的深度解读,可以看老达的 Claude 专题页面。想要系统性理解 AI Agent 行为边界和安全约束,可以参考 AI 智能体与自动化专题。
此外,这次风波对整个 AI 行业也有警示意义。数据版权、模型安全测试透明度、平台与合作伙伴的关系——这些问题不是 Anthropic 一家的专利。每一家冲到前面的大模型公司,迟早都要面对。
最后说一句:看到那些二手书被切碎的画面,作为一个也爱读书的人,心里确实不太舒服。
参考来源:钛媒体、新智元、智通财经、向知平说等多家媒体报道,Anthropic 官方安全公告。