Progress Reward Modeling for Robotic Learning: A Comprehensive Survey Paper • 2607.21655 • Published 20 days ago • 193
NVIDIA-labs OO Agents: Native Python Object-Oriented Agents Paper • 2607.20709 • Published 20 days ago • 34
HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone Paper • 2607.25895 • Published 14 days ago • 156
Diagnosing and Calibrating Tool-Call Boundary Drift in Multi-Teacher On-Policy Distillation Paper • 2607.07050 • Published 27 days ago • 5