AI公司买书扫描后销毁,竟被要求FTC调查
AI训练数据的争议,正在从“版权问题”变成一个更大的问题:
会不会影响市场竞争?
8月21日,美国十余家民间团体联名致信美国联邦贸易委员会(FTC),要求调查AI公司大量购买实体书、扫描后再销毁的行为。
他们认为,这种做法可能把大量训练素材从市场上“拿走”,甚至让一些珍本永久消失。
信件点名了Anthropic。
据报道,Anthropic此前曾花费数百万美元购买实体书,并通过切除书脊、扫描页面等方式获取数字内容,用于AI模型训练。
更值得注意的是,这些团体并不是要求禁止AI训练。
他们担心的是另一件事:
如果一家AI公司把大量关键训练素材买走并销毁,竞争对手以后是不是要付出更高成本才能获得类似数据?
如果成立,那么问题就不再只是:
“这本书能不能拿来训练AI?”
而可能变成:
“AI公司能不能通过囤积训练数据,建立竞争壁垒?”
这也是AI行业正在出现的新矛盾。
过去大家争的是模型参数、GPU和人才。
现在越来越明显:
高质量数据本身,也可能成为AI公司的核心资产。
而当数据开始影响市场竞争,美国监管机构未来面对的可能就不只是版权诉讼,还包括反垄断和不正当竞争问题。
AI训练数据的争夺,可能才刚刚进入下一阶段。


