arxiv:2405.14129
Junjie Guo
TealOrange
AI & ML interests
None yet
Recent Activity
upvoted a paper about 22 hours ago
Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning upvoted a paper 12 months ago
Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning liked a model over 1 year ago
zhibinlan/LLaVE-7BOrganizations
None yet