Arm发布C2-Ultra架构:AI性能翻倍,定义2027旗舰标准
移动AI的讨论长期聚焦于NPU、TPU等专用加速器,但Arm正试图证明通用CPU同样能担此重任。Arm最新发布的C2-Ultra架构,有望成为2027年旗舰智能手机的新基准,覆盖从联发科、三星到谷歌未来Tensor芯片组的广泛生态。
这一战略转变标志着Arm从单纯追求时钟频率和流水线宽度,转向加速特定专业用例。尽管市场对峰值通用性能的需求尚存变数,但在移动设备与PC场景融合的背景下,这一调整颇具深意。
C2-Ultra:能效与架构的双重进化
作为去年C1-Ultra的继任者,C2-Ultra预计将搭载于2027年初推出的下一代三星Exynos和联发科Dimensity芯片中,并可能出现在谷歌Tensor G7芯片组里。
在性能方面,C2-Ultra峰值性能较前代提升15%。其中,时钟频率提升至4.45GHz贡献了8%的增幅,其余7%源于架构改进。更关键的是,得益于2纳米制程工艺,C2-Ultra在维持同等性能水平时,功耗降低了38%。此外,其L2缓存容量上限增至3MB,为以面积换性能的处理器设计提供了更大空间。
值得注意的是,C2-Ultra的流水线宽度保持不变,性能提升并非依赖单周期处理量的增加,而是通过将执行窗口扩大30%(从2000条指令增至约2600条),并增强乱序执行机制来实现。这种更智能的推测执行和数据依赖检测,减少了等待数据的时间,从而在提升执行效率的同时降低功耗。
相比之下,C2-Premium、C2-Pro和C2-Nano核心架构未作大幅改动,主要针对2纳米生产线进行了面积、效率和功耗优化。
CPU加速AI:性能提升高达1.7倍
AI加速是C2系列的核心亮点。Arm宣称,通过加速低精度数学运算并利用查找表指令(LUTi)降低内存带宽需求,新一代CPU配置可使AI模型性能提升高达1.7倍。
这一提升通过在共享CPU集群中部署两个可扩展矩阵扩展(SME2)单元实现,而去年仅支持一个。虽然小米XRING O3已在C1架构上支持双SME2,但Arm此次将其作为参考标准推广。SME2作为常规CPU指令管道的一部分执行,无需开发人员额外适配即可享受加速红利。此外,SME2单元的时钟频率从2GHz提升至3GHz,进一步释放AI算力。
实际应用场景中,Arm基准测试显示:语音转文本延迟减少40%,实现近乎即时的识别;内存检索搜索速度提升41%,加快用户偏好回忆;首个令牌生成时间缩短25%,显著提升端侧大模型的响应速度。
终端落地:联发科或首发12核配置
Arm仅提供核心IP,最终配置由芯片合作伙伴决定。参考设计显示,旗舰方案可能采用2个C2-Ultra核心(峰值4.45GHz)搭配6个C2-Pro核心(3.6GHz),而入门级设备则可能使用2个C2-Pro和4个C2-Nano组合。
借鉴过往产品节奏,2025至2026年的高端芯片将普遍采用“超大核+大核”的组合策略,并在超高端型号中配备双SME2单元以强化AI性能。Arm透露,预计今年晚些时候将有合作伙伴推出10至12核的CPU配置,业界猜测这很可能指向联发科Dimensity 9600。随着2027年临近,更多厂商的跟进计划值得密切关注。
【星途科讯 图文丨王宇洲 首发于ZAKER科技,转载请注明出处】