模型在训练和实际推理时都遵循相同顺序,这条 CoT 才会真正参与未来视频的生成。它试图把原本隐藏在模型内部的物理变化显式化:将光流、深度、三维几何等变量组织成有顺序的 Causal CoT,让模型沿着 Mo…...