Grok编程模型的相关内容,来智搜看看。马斯克旗下SpaceXAI于8月12日发布Grok 4.6编程大模型,在多项评测中追平甚至反超OpenAI的GPT-5.6,却以仅为对手约五分之一的价格主打极致性价比,直接冲击AI编程市场格局。一、性能跃升:编程与知识工作能力全面逼近第一梯队综合智能:Grok 4.6在Artificial Analysis Intelligence Index中获61分,与GPT-5.6 Sol Max持平,仅次于Claude Fable 5的62分。编程实测:CursorBench v3.2得分69.9%,超越GPT-5.6的67.2%;FrontierCode v1.1得61.3%,同样压过GPT-5.6的60.6%。知识工作:在GDPVal-AA v2中获1753 Elo,超过Claude Fable 5的1741和GPT-5.6的1728;专业法律任务Harvey LAB中达15.8%,远超Fable 5的11.3%与GPT-5.6的2.5%。二、定价策略:以约五分之一成本冲击市场API价格:每百万输入Token 2美元、输出Token 6美元,约为GPT-5.6 Sol Max的1/5、Claude Fable 5的1/8。单任务成本:在真实世界智能体知识工作评测中,Grok 4.6完成一项任务的平均成本仅0.49美元,比排行榜上排它前面的模型便宜近九成。Token效率:同等软件工程任务下,Grok 4.6平均消耗15954个token,而Claude Opus 4.8需67020个,效率高出4倍多。三、技术底座:600亿美元Cursor收购催生的"工程大脑"联合训练:Grok 4.6与编程工具Cursor联合训练,注入数万亿Token真实开发者交互数据,让模型学会多仓库工程协作而非仅语法生成。基座升级:基于1.5万亿参数V9基础模型,从Grok 4.3的0.5万亿参数跃升三倍;采用MoE混合专家架构,推理速度达80Token/秒。强化学习:覆盖数十万真实软件工程任务,采用"自动化评估+模型自评"双轨评分机制,提升多步骤、多跳逻辑的编程能力。 Grok编程模型
马斯克旗下SpaceXAI于8月12日发布Grok 4.6编程大模型,在多项评测中追平甚至反超OpenAI的GPT-5.6,却以仅为对手约五分之一的价格主打极致性价比,直接冲击AI编程市场格局。 一、
阅读:0
点赞:0