arxiv:2607.14614
ZHANG HAO
26hzhang
AI & ML interests
Multimodal LLM, Financial Learning and Reasoning
Recent Activity
authored a paper about 1 month ago
Beyond Entropy: Correctness-Aware Advantage Shaping via Contrastive Policy Optimization upvoted a paper about 1 month ago
Beyond Entropy: Correctness-Aware Advantage Shaping via Contrastive Policy Optimization