在 Grok 4.5 发布时,张鼎怀曾专门提到,团队这次将 RL Scaling 推到了新规模,该模型实现了顶级智能体编程表现。这也是为什么,像张鼎怀这样长期研究 RL Scaling 和训练稳定性的研究…...