Progress Reward Modeling for Robotic Learning: A Comprehensive Survey Paper • 2607.21655 • Published 17 days ago • 193
NVIDIA-labs OO Agents: Native Python Object-Oriented Agents Paper • 2607.20709 • Published 17 days ago • 33
HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone Paper • 2607.25895 • Published 11 days ago • 156
Diagnosing and Calibrating Tool-Call Boundary Drift in Multi-Teacher On-Policy Distillation Paper • 2607.07050 • Published 24 days ago • 4