RL后训练稳定收敛再升级!昇腾正式支持RL训推一致性
华为计算宣布,昇腾基于 Ascend C 编程语言提供完整训推一致算子集,在 Qwen3-30B MoE 模型上的测试实现 Logdiff 为 0,并通过昇腾亲和的 FA 算子优化,在 Eager 模式下获得 20%-60% 性能收益,为开发者提供高效可靠的强化学习训练方案。









RL后训练稳定收敛再升级!昇腾正式支持RL训推一致性
华为计算宣布,昇腾基于 Ascend C 编程语言提供完整训推一致算子集,在 Qwen3-30B MoE 模型上的测试实现 Logdiff 为 0,并通过昇腾亲和的 FA 算子优化,在 Eager 模式下获得 20%-60% 性能收益,为开发者提供高效可靠的强化学习训练方案。








