DiPO disentangles perplexity into exploration and exploitation subspaces to enable fine-grained trade-offs, improving LLM reasoning and function calling via stable perplexity-guided policy optimization.
VicEdit enables visual in-context video editing via multi-modal guidance and achieves state-of-the-art results on instruction and visual reference tasks.