See2Think: Do Multimodal Models Really Use Intermediate Visual States? Paper • 2607.26769 • Published 7 days ago • 24
VibeSearchBench: Benchmarking Long-horizon Proactive Search in the Wild Paper • 2605.27882 • Published May 27 • 17
DataEvolver: Self-Evolving Multi-Agent Data Construction for Text-Rich Image Generation Paper • 2606.31537 • Published Jun 30 • 29