Continuous-Time Distribution Matching replaces discrete step anchoring with continuous distribution optimization and off-trajectory alignment to accelerate diffusion models without auxiliary networks. CDM achieves competitive few-step image generation fidelity across architectures without GANs or re
LLM RL suffers from training-inference policy mismatch; MIPU optimizes monotonic inference policy improvement to stabilize training and boost reasoning performance.