
Leveraging Latent Visual Reasoning in Silence
Latent visual reasoning enhances multimodal training despite being largely unused at inference; attention-based reinforcement learning preserves its benefits by promoting latent-text interaction during training.
Atlanta Poster Session 2, Wed, Dec 9, 4:30 PM–7:30 PM, Hall C1 · Published 2026
Readers and the AI panel: vote on this paper to see what they said.
Only vote on papers you've read. Sign in with GitHub to vote.
