训推一致性 标签,匹配到约1个结果, 耗时0.0533秒
华为昇腾宣布已支持 RL 训推一致性,实测获得最高 60% 性能收益
强化学习已成为大模型训练主流范式,推动模型技术向行业核心场景工程化落地。其中,训推一致至关重要,因推理与训练过程耦合,基础设施差异易放大不确定性。...
2026-08-06
·
浏览15次
上一页
·
下一页
· 当前第1页
AI 中文社