arxiv:2607.14777
Jinyang Wu
Jinyang23
AI & ML interests
large language models, reasoning, agentic rl
Recent Activity
authored a paper about 5 hours ago
SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning authored a paper about 6 hours ago
From Imitation to Discrimination: Toward A Generalized Curriculum Advantage Mechanism Enhancing Cross-Domain Reasoning Tasks liked a model 3 days ago
Jinyang23/Seed-AlfWorld-3BOrganizations
None yet