arxiv:2608.05987
Jinyang Wu
Jinyang23
AI & ML interests
large language models, reasoning, agentic rl
Recent Activity
published a model 1 day ago
Jinyang23/SEED-ALFWorld-3B-SFT authored a paper 6 days ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement LearningOrganizations
None yet