全国产算力打磨!讯飞星火X2.5‑293B登场,云端+端侧双线同时发力
9月7日,科大讯飞正式推出星火X2.5‑293B通用大模型,这款293B参数的云端旗舰基座,全部依托全国产算力完成训练。一边是云端大旗舰,一边是已经开源的轻量化端侧版本,一大一小双向布局,国产大模型的落地思路正在发生明显变化。
很多人看大模型,只盯着参数数字比拼,而讯飞这次的重点,放在云端与终端协同落地上面。这款X2.5‑293B采用293B MoE混合专家稀疏架构,推理性能对比上一代X1.5直接提升50%,运行效率得到大幅优化。能力层面重点强化两大方向:代码生成能力大幅度迭代,同时深度打磨Agent智能体协同,让大模型可以自主完成多步骤复杂任务,向实际业务场景进一步靠拢。
值得注意的是,这场发布并不是孤立动作。早在9月1日,科大讯飞就已经开源星火X2.5‑4B、1.7B两款端侧模型。两款轻量化模型原生支持1M超长上下文,瞄准车载设备、各类智能硬件场景。也就是说,短短一周时间,讯飞完成端侧开源、云端旗舰正式发布。终端负责本地低延迟运行,云端提供最强算力底座,形成“端云搭配”的完整产品矩阵。
过去国内不少大模型产品,把重心全部押在云端,所有计算都依赖服务器。但现实中车载、智能家居、物联网设备,会面临网络不稳定、数据隐私、响应时延等现实难题。端侧模型把能力放到设备本地运行,不用全程依赖网络;云端大模型负责处理高复杂度 heavy 任务,两者互补,才能够覆盖更多真实使用场景。全部基于全国产算力训练,也代表底层算力供应链不再受制于外部条件,对于国产AI产业而言意义重大。
科大讯飞还放出后续信号,今年1024开发者节,还会亮相另一套全国产算力训练的全新主力通用大模型,后续还有更多值得期待的更新。
放眼整个行业,国产大模型已经走过单纯比拼跑分、比拼参数的阶段。现在比拼的是谁可以把大模型真正装到硬件上,打通云端、终端,兼顾性能、成本、隐私安全。星火X2.5系列端云同步布局,正是国产AI从实验室走向产业落地的一个缩影。大模型好不好用,不只看纸面测评,更要看能不能实实在在跑在千千万万设备当中。
科大讯飞 星火大模型 AI大模型 国产AI
全国产算力打磨!讯飞星火X2.5‑293B登场,云端+端侧双线同时发力 9月
阅读:0
点赞:0