arxiv:2608.05987
Jinyang Wu
Jinyang23
AI & ML interests
large language models, reasoning, agentic rl
Recent Activity
authored a paper about 14 hours ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning upvoted a paper about 20 hours ago
EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning upvoted a paper about 20 hours ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement LearningOrganizations
None yet