DriveZero: End-to-End Driving Beyond Human Demonstrations Paper • 2609.06055 • Published 19 days ago • 57
Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization Paper • 2608.20281 • Published Aug 20 • 14
Wnuan: Staged Post-Training for Question Answering over Proprietary Enterprise Knowledge Paper • 2608.01862 • Published Aug 3 • 6
Rethinking Supervised Fine-Tuning: Emphasizing Key Answer Tokens for Improved LLM Accuracy Paper • 2512.21017 • Published Dec 24, 2025 • 1
RAFT: Data Refinement and Adaptive Distillation for Domain Fine-Tuning with Alleviated Forgetting Paper • 2606.00147 • Published May 29 • 2
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing Understanding Paper • 2605.30794 • Published May 29 • 5
SPAR: Scholar Paper Retrieval with LLM-based Agents for Enhanced Academic Search Paper • 2507.15245 • Published Jul 21, 2025 • 11
SciSage: A Multi-Agent Framework for High-Quality Scientific Survey Generation Paper • 2506.12689 • Published Jun 15, 2025 • 2
SkillOpt: Executive Strategy for Self-Evolving Agent Skills Paper • 2605.23904 • Published May 22 • 264
ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement Paper • 2604.01591 • Published Apr 2 • 40