Reasoning models trained on synthetic data using reinforcement learning.
Yichao 'Peak' Ji PRO
peakji
AI & ML interests
Agents, Small Language Models, Retrieval-Augmented Generation, Information Extraction
Recent Activity
liked a model 1 day ago
Qwen/Qwen3.8-Flash-Next liked a model 1 day ago
zai-org/GLM-5.3-Flash liked a model 18 days ago
meta-models/Muse-Glimmer-30B