Zhihe Yang
zhyang2226
AI & ML interests
Trustworthy RL & Offline RL
Recent Activity
liked a model about 12 hours ago
dots-studio/dots3-note-prev liked a model 12 days ago
MiniMaxAI/MiniMax-H3 upvoted a paper 6 months ago
Exploratory Memory-Augmented LLM Agent via Hybrid On- and Off-Policy Optimization