IT之家 8 月 6 日消息,强化学习已成为大模型训练主流范式,推动模型技术向行业核心场景工程化落地。其中,训推一致至关重要,因推理与训练过程耦合,基础设施差异易放大不确定性。 华为计算官方 8 月 5 日宣布,昇腾基于 Ascend C 编程语言提供完整训推一致算子集,在 Qwen3-30B MoE 模型上的测试实现 Logdiff 为 0,并通过昇腾亲和的 FA 算子优化, 在 Eager ...