DC娱乐网

硅谷那帮AI公司,最近干了件特别魔幻的事——派人在日本旧书店扫荡式收书,历史、地

硅谷那帮AI公司,最近干了件特别魔幻的事——派人在日本旧书店扫荡式收书,历史、地方志、老政论册子,只要带字就要。一年运走50吨,折合10万册,全发往同一个物流中转站。互联网文本早被吃秃了,还净是AI生成的垃圾,再吃下去就“近亲繁殖”。于是几十年没数字化过的纸质老书,成了硅谷眼里的高蛋白饲料。Anthropic论吨收书、切书脊、工业扫描——几万亿估值的公司,最后靠收破烂续命?这背后的逻辑,细思极恐。

事情要从一家叫Anthropic的公司说起。它做的AI叫Claude,估值几万亿,是OpenAI最强的对手之一。创始人是从OpenAI出来的一对兄妹,主打一个“安全可信”。

就是这家公司,被法庭文件掀开了底裤。2026年1月,《华盛顿邮报》根据悬疑作家巴茨等人集体诉讼案解封的四千多页文件,曝光了一个代号“巴拿马计划”的秘密行动。

内容很直白:Anthropic从2024年初开始,砸了几千万美元,批量买进几百万本二手书。从图书馆、在线二手书店、像纽约斯特兰德那样的实体旧书店收,单次订单从一千本到一百万本不等。

收来干嘛?不是收藏。是用液压切割机把书脊一刀切了,行内人管这机器叫“书籍断头台”。然后上高速生产级扫描仪,一页一页扫成机器能读的文本。

扫完呢?原书直接销毁,拉去回收公司处理。一本接一本,流水线作业,跟屠宰场没什么两样。
法院文件里对这个项目的定义,听着都瘆人:“我们以破坏性方式扫描全世界所有书籍的努力。”

全世界的书,扫完就毁。这哪是收书,这是焚书。而且是打着技术进步旗号的工业化焚书。

为什么要这么干?因为AI大模型是吃文字长大的,喂的数据越多越好。可互联网上能爬的文本,早被这几家巨头吃了十几年,吃得一干二净。

更糟的是,网上现在泛滥的,越来越多是AI自己生成的内容。模型拿AI写的东西再去训练下一代模型,等于近亲繁殖,越养越傻、越养越歪,业内叫它“模型崩溃”。

干净、没被污染的人类文本,成了稀缺资源。那些几十年没数字化过的纸质老书,地方志、老政论、小说、回忆录,就成了高蛋白饲料。

日本旧书店是重灾区。东京神保町那条街,绝版老书成堆,又保存得好,价格还便宜。硅谷的人扫荡式收,历史、地方志、老册子,只要带字就要,一年运走50吨,折合十万册,全发往同一个物流中转点集中处理。

这事还不是Anthropic一家。媒体404 Media后来追着一枚藏进约一千本书订单里的AirTag追踪,定位最后停在亚马逊拉斯维加斯一个园区。里头一个小组专门负责收书、扫ISBN、切书、扫描。员工说,我们做的全部工作就是扫描书。亚马逊事后也承认,确实在通过商业渠道买书开发技术。

几万亿美金估值的公司,最后派小弟满世界收破烂一样收旧书。这画面魔幻,却透着没办法。

代价也来了。作家们不干了,集体起诉。2026年7月,联邦法官正式批准了和解,Anthropic赔了1.5亿美元,折合人民币上百亿。可这钱对它来说,跟数据的稀缺比起来,又是另一本账。

细思极恐的地方在这儿。当AI的智能全靠人类写过的字喂出来,而人类写的字越来越少、越来越杂,这些巨头就只能回头去啃老本。

这事在书业圈里炸了锅。国内出版社听说后,连夜在库房门口贴符一样贴上“禁止扫描”的条子。一家把版税和作者权益看得比命还重的生意,转眼成了AI巨头的免费口粮。

讽刺的是,Anthropic嘴上最讲究“安全”和“伦理”,干的却是切书毁版的事。规矩立了一堆,真到了缺数据这一步,原书说毁就毁。

我们这个时代攒下的数字垃圾,正在把未来的AI喂成一个空壳。真正值钱的,反而是那些被人遗忘在旧书店角落、落满灰的纸质记忆。人类几百年攒下的文字,正被论吨切割、论斤扫描,变成机器嘴里的饲料。