放缓AI”的背后:一场关于规则制定权的暗战
围绕“是否该放缓AI发展”的争论,已在中美两地同时引爆激辩。市场对此,忧心忡忡。
导火索来自Anthropic一批离职员工的公开表态:当前AI的狂奔已全然不顾安全边界,照此下去,或将给人类社会带来史诗级灾难。Anthropic本就由2021年从OpenAI出走的一批核心研究员创立,出走原因正是对OpenAI在安全风险上的轻慢不满。旧事重提,自然格外引人注目。
而真正把这件事推上全新热度的,是Anthropic现任掌门人Dario Amodei的一番“顶级公关”。
他先是完全认同离职员工的忧虑——大模型高速发展带来的隐患,确实令人不安。紧接着,他强调自家公司内部员工都认为,Anthropic是目前行业中安全做得最好的。随后,话锋一转,开始指责同行在AI安全上做得不够。
再往后,他公开抛出自己的安全方案:
· 引入常驻第三方独立评估员,权限接近内部员工,可直接查看模型训练过程、核查安全承诺、上报事故,并在训练中持续评估对齐风险——类似银行派驻的监管检查员。· 由美国前沿AI实验室共同约定能力红线,设置模型安全检查站。一旦模型触及高危能力门槛,必须拿出安全证据,才能继续迭代;可讨论限制训练算力、限制AI参与下一代AI研发的速度。· 将这套机制推广至多国,建立可验证的国际约束,包括限制生物危险用途,并为RSI设置全球上限。
要读懂Dario Amodei的盘算,先得看清一个前提:当下美国最先进的大模型,仍是全球最能打的。尤其Anthropic的前沿模型,本身就代表着领先优势。
所以,他所谓的“放缓AI发展”,真实意图并不难猜:索性把美国乃至全球各大AI模型公司的现有排名彻底冻结,从而确保Anthropic等少数美国AI公司形成垄断优势。任何不服气的公司或国家,先得证明自己是安全的、不会危及全人类。
Anthropic等领先者可以裹挟美国政府,以行政手段重塑AI规则。而所谓“引入常驻第三方独立评估员”,正是确保这套规则完全服务于美国AI领先者的监管机制。