本期内容介绍:
《华盛顿邮报》2026 年1月27日根据解封的诉讼文件报道,Anthropic的一份内部 planning document内部规划文件里写道:
“Project Panama is our effort to destructively scan all the books in the world”,“We don't want it to be known that we are working on this”.
“我们破坏性扫描全世界图书的行动”,“我们不希望外界知道我们正在做这件事”。
聊聊这事的荒唐与可恶。
你可能感兴趣的:
一、核心事件 / 项目
巴拿马计划(Project Panama):
Anthropic 内部秘密图书采集项目,核心为破坏性扫描全球实体旧书,裁切、扫描后销毁纸质原书,获取纯文本数据用于 Claude 模型训练。
Bartz v. Anthropic 集体版权诉讼:
起诉 Anthropic 未经授权获取、复制版权图书,法院认定 AI 训练用途构成合理使用,但盗版取得并建立永久数字书库不因此免责,相关盗版书籍权利主张最终以15亿美元和解,成为美国史上金额最高版权和解案。
Books 3数据集:
含 19.6 万本无授权盗版电子书,Anthropic 早期用于模型训练,是本次侵权诉讼涉案盗版书来源之一。
Shadow Library(影子图书馆):
网络盗版电子书资源站点,Anthropic 早期批量获取盗版书籍的渠道。
Google Books(谷歌图书计划):
谷歌早年大规模馆藏图书扫描项目,法院判定图书检索用途构成合理使用,成为 Anthropic 法律层面的参考依据。
二、企业、模型与行业主体
Anthropic:
Claude 大模型开发公司,由原 OpenAI 团队出走创立,一边长期标榜 AI 安全理念,一手推进“巴拿马”毁书扫描计划。
Claude/Fable 5:
Anthropic 旗下闭源大模型。
月之暗面(Moonshot AI):
Kimi 模型母公司,推出开源权重模型 Kimi K3。
Kimi K3:
2.8 万亿参数 MoE 开放权重模型,自定义商用限制协议,是 2026 年中美 AI 版权、开源争议焦点。
公开信:
由 NVIDIA、Microsoft、Meta 等60多家公司及组织共同签署的开放权重倡议公开信。
三、法律、制度专业概念
合理使用(Fair Use):
美国版权法中的侵权抗辩规则,法院综合用途与性质、作品性质、使用数量以及市场影响等因素判断,‘转换性’是其中的重要考量。
转换性使用(Transformative Use):
合理使用判定核心标准,对原作进行全新功能性改造(图书检索、AI 训练均被认定为转换用途)。
证据公示(Discovery):
民事诉讼法定程序,双方强制提交内部邮件、档案等材料,巴拿马计划内部文件由此解封曝光。
FOIA《信息自由法》:
美国联邦政务公开法案,公众可申请调取政府行政档案,媒体调查企业 / 行政黑幕的工具。
吹哨人制度:
美国职场保护机制,内部员工举报企业违法可获反报复保护、现金奖励,是民间监督补充渠道。
四、文学作品 & 人物
《华氏 451度》:
雷・布拉德伯里反乌托邦小说,书中消防员焚烧书籍禁锢思想;本期类比 Anthropic 销毁实体书、垄断数字知识的荒诞现实。
安德烈娅・巴茨(Andrea Bartz):
美国畅销悬疑作家,本次集体诉讼原告牵头人。美国《纽约时报》畅销心理惊悚小说作家、记者,主要作品以探讨女性关系、黑暗秘密与心理悬疑著称。
Ben(Anthropic 联合创始人):
主导引入盗版 Books Three 数据集的核心人员。
华盛顿邮报记者:
Aaron Schaffer、Will Oremus 和 Nitasha Tiku。
《华盛顿邮报》2026 年 1 月 27 日发表的调查报道< Inside an AI start-up’s plan to scan and dispose of millions of books >明确列出这三位作者;报道也明确写道,Project Panama 的细节来自作者们对超过 4,000 页诉讼文件的梳理。
ABC News/Food Lion 案当事人:
1992年,ABC《PrimeTime Live》的两名记者 Lynne Dale 和 Susan Barnett,用虚假履历应聘进入 Food Lion 超市,再用隐藏摄像机进行了卧底调查。
五、AI 技术专业术语
OCR 光学字符识别:
扫描图书图像转化为可计算文字的技术步骤。
Tokenization(分词 / 切词):
大模型将文本切割为最小单元 Token,映射数字 ID 用于运算。
高维向量嵌入:
Token 转化为多维空间数学表达,模型依靠向量距离判断语义关联。
模型蒸馏:
以竞品大模型输出数据训练自有模型的行业技术手段,本次中美 AI 争议核心。
黑盒模型:
大模型仅输出概率化文本,无法完整拆解推理逻辑,人类难以完全解释生成逻辑。
六、媒体、节目相关
The Damage Report:
美国独立进步派新闻频道,较早深度讨论 Anthropic 毁书事件。
付费墙 / 订阅壁垒:
互联网内容商业封锁,加剧知识向少数 AI 企业集中的垄断隐患。
感谢收听🤍

