Jinyang Wu
Jinyang23
AI & ML interests
large language models, reasoning, agentic rl
Recent Activity
published a model about 15 hours ago
Jinyang23/SEED-ALFWorld-3B-SFT authored a paper 5 days ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement LearningOrganizations
None yet