arxiv:2607.02980
Xiang Hu
AI & ML interests
None yet
Recent Activity
upvoted a paper 4 days ago
SAS: Simple Attention Sparsification via End-to-End Optimization of Context Ranking upvoted a paper 7 days ago
T1: Terminal Agent Reinforcement Learning for Long-Horizon Tasks upvoted a paper 10 days ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience