DC娱乐网

华为盘古大模型:718B参数+快慢思考+工具调用,解决AI幻觉+自主行动 藏在华

华为盘古大模型:718B参数+快慢思考+工具调用,解决AI幻觉+自主行动
藏在华为开发者大会闭门环节的大模型硬核内幕,99%的圈外人根本听不到,今天全给你捋明白。
做AI这两年,全行业都有个心照不宣的共识。
现在市面上的大模型,能力早就摸到天花板了。
大家都在堆参数、卷跑分,没人敢想从底层架构上搞颠覆性突破。
但华为盘古大模型,这次直接把这层窗户纸捅破了。
人家的目标根本不是做个帮你写文案查资料的AI副驾,是要直接进化成能自主决策的AI主驾。
这次我在HDG现场,拉着华为的博士天团深聊了整整150分钟,掏出来的全是行业没人敢公开说的干货。
第一个最炸的消息,参数达到718B的盘古基础大模型,这次直接公开了三个颠覆行业的全新发现。
第一个叫自适应快慢思考,完全对标人脑的工作模式,简单问题快响应不啰嗦,复杂问题自动切换深度思考模式,根本不用用户额外调参数。
第二个是原生内置工具调用,别的大模型调用工具还要额外做插件适配,盘古从训练阶段就把工具使用的泛化能力刻进骨子里,啥工具拿起来就能用。
第三个是Deep Divers深度探索机制,用端到端强化学习把AI幻觉直接打没,模型自己会在探索里试错优化,再也不会张嘴就编瞎话。

很多人之前都吐槽AI是人工智障,说它根本没有真的思考能力。
这次盘古直接把人脑的快慢双系统思考逻辑,完整整合进了同一个模型里。
你让它订个从北京去东莞参会的行程,它自己会翻你之前的历史对话,自动订机票、订酒店、约接送机,多步操作根本不用你一步步指挥。
之前最让人头疼的AI幻觉问题,这次也被华为找到了解法。
靠Deep Divers算法,模型每做一次决策,系统就会给正向或者负向的反馈,错的多了它自己就会主动修正,瞎编内容的概率直接降到几乎可以忽略。
更狠的是,盘古根本不满足于只在手机电脑的数字世界里干活。
人家直接搞出了4D世界模型,在3D空间的基础上加了时间维度,直接把整个动态物理世界都给AI具象化了。
啥概念?
你给它几张火星、月球的实拍图,它就能直接重建出完整的3D动态场景,提前验证探测设备在上面跑的效果。
之前人形机器人行业都在死磕硬件、电机、运动控制,结果华为直接绕到了最核心的“大脑”部分。
他们搞的Cloud Robot具身智能平台,把模型、仿真、控制全打通了,机器人从“看会了动作”到“真的能上手干活”,居然只需要两天。
现在全行业都缺机器人训练数据,实采一年最多也就攒个千万级的量,根本不够喂大模型。
华为直接用数字孪生搞出了虚拟训练场,机器人在里面24小时不停跑,攒数据的效率比实采高了几十上百倍。
现在这套平台已经落地到汽车、重工这些工业场景里了,不少工厂用了之后产线效率直接往上跳了一大截。

现在盘古的预测大模型已经在炼钢场景跑通了,就用少量的现场数据,就能把生产参数预测得准准的,帮钢厂省了好多成本。
说真的,之前我总觉得大模型的下一个拐点还得等个三五年,这次跟华为的博士聊完才发现,原来最炸的技术突破,早就藏在大家看不见的地方了。
你觉得未来最先被这种能自主行动的大模型彻底地改变的行业,会是哪个?