Foundation Models
updated
GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models
Paper
• 2508.06471
• Published • 214
Cognitive Kernel-Pro: A Framework for Deep Research Agents and Agent
Foundation Models Training
Paper
• 2508.00414
• Published • 96
Continuous Autoregressive Language Models
Paper
• 2510.27688
• Published • 75
MiMo-Embodied: X-Embodied Foundation Model Technical Report
Paper
• 2511.16518
• Published • 26
Kling-Omni Technical Report
Paper
• 2512.16776
• Published • 173
mHC: Manifold-Constrained Hyper-Connections
Paper
• 2512.24880
• Published • 335
VAR RL Done Right: Tackling Asynchronous Policy Conflicts in Visual Autoregressive Generation
Paper
• 2601.02256
• Published • 33
NitroGen: An Open Foundation Model for Generalist Gaming Agents
Paper
• 2601.02427
• Published • 46
MiMo-V2-Flash Technical Report
Paper
• 2601.02780
• Published • 40
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
Paper
• 2601.04720
• Published • 59
Can We Predict Before Executing Machine Learning Agents?
Paper
• 2601.05930
• Published • 29
STEP3-VL-10B Technical Report
Paper
• 2601.09668
• Published • 196
LongCat-Flash-Thinking-2601 Technical Report
Paper
• 2601.16725
• Published • 185
A Pragmatic VLA Foundation Model
Paper
• 2601.18692
• Published • 50
Qwen3-Coder-Next Technical Report
Paper
• 2603.00729
• Published • 66
MARS: Enabling Autoregressive Models Multi-Token Generation
Paper
• 2604.07023
• Published • 38
EXAONE 4.5 Technical Report
Paper
• 2604.08644
• Published • 75
Qwen3.5-Omni Technical Report
Paper
• 2604.15804
• Published • 61
Context Unrolling in Omni Models
Paper
• 2604.21921
• Published • 14
Heterogeneous Scientific Foundation Model Collaboration
Paper
• 2604.27351
• Published • 224
MolmoAct2: Action Reasoning Models for Real-world Deployment
Paper
• 2605.02881
• Published • 357
Qwen-Image-2.0 Technical Report
Paper
• 2605.10730
• Published • 119
Qwen-Image-VAE-2.0 Technical Report
Paper
• 2605.13565
• Published • 63
StepAudio 2.5 Technical Report
Paper
• 2605.23463
• Published • 50
The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence
Paper
• 2605.26494
• Published • 42
Kwai Keye-VL-2.0 Technical Report
Paper
• 2606.10651
• Published • 196
JoyAI-VL-Interaction: Real-Time Vision-Language Interaction Intelligence
Paper
• 2606.14777
• Published • 217
Ling and Ring 2.6 Technical Report: Efficient and Instant Agentic Intelligence at Trillion-Parameter Scale
Paper
• 2606.15079
• Published • 88
Orca: The World is in Your Mind
Paper
• 2606.30534
• Published • 507
Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget
Paper
• 2607.13125
• Published • 141
WanSong v1.0 Technical Report
Paper
• 2607.14749
• Published • 19
Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents
Paper
• 2607.28227
• Published • 311
Motif 3: Technical Report
Paper
• 2608.09119
• Published • 47
DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data
Paper
• 2608.13517
• Published • 33
Paper
• 2608.15045
• Published • 51
On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability
Paper
• 2608.30320
• Published • 51