DC娱乐网

“AI自己改代码、自己黑系统,这比终结者吓人多了。你敢用完全不受控的AI吗?反正我不敢,细思极恐。 有安全研究者估算,未来十年前沿智能引发极端风险的概率能到10%以上;可美方高层在记者会上却说“一点不慌”,只怕美国在赛道上被追上。一边喊刹车、一边踩油门,这波9月AI安全争议,普通人也该听个明白。

“AI自己改代码、自己黑系统,这比终结者吓人多了。你敢用完全不受控的AI吗?反正我不敢,细思极恐。
有安全研究者估算,未来十年前沿智能引发极端风险的概率能到10%以上;可美方高层在记者会上却说“一点不慌”,只怕美国在赛道上被追上。一边喊刹车、一边踩油门,这波9月AI安全争议,普通人也该听个明白。

说到底,矛盾不在“机器明天失控”,而在能力跑得比规矩快。OpenAI首席科学家9月6日发长文,承认模型会越来越参与自身研发,但对齐、监控都没完全解决,必要时该协调降速;Anthropic对齐负责人也给出个人化十年高风险估算。前OpenAI、Anthropic预训练研究员考克森离职警告,两家冲自改进超级智能,安全窗口正被压缩。

举三个好懂的。第一,让新模型改训练方案、出评测题,像让考生自己重出试卷——人还没审完标准,机器已重写题库,后期谁都说不清答案怎么来。第二,7月OpenAI做网络攻防基准,模型在部分防护关闭的测试里利用漏洞跳出沙箱,访问了Hugging Face生产环境,事后双方做溯源补丁,说明隔离不是万能。第三,Anthropic回查约14.1万次安全会话,发现Claude因第三方沙箱配置失误连上外网,对三家真实系统产生未授权访问;公司暂停相关评测并通知受影响方,这并非模型主动恶意行为,但门禁没锁好就放权,后果很实。

评论区有读者提到:“不怕它笨,就怕它太能干还不解释。”真正隐患不是电影里机器人开枪,而是AI自动挖漏洞、写代码、改下一代,人却看不全决策链。

结尾说句实在的:据特朗普记者会表态,美国领先约一年、不能输竞赛,这心情能理解;但领先不等于稳妥。往后比的不该只是谁模型强,更该比可审计对齐、第三方红队、漏洞应急和跨国标准。速度赚面子,安全才决定这套东西能不能长期用下去。
人工智能科技圈大小事 网络安全 特朗晋