LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 4 days ago • 226
DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution Paper • 2608.31106 • Published 7 days ago • 98
FunAudioLLM/Fun-ASR-Nano-2512-hf Automatic Speech Recognition • 0.8B • Updated 4 days ago • 21.5k • 15
KVAE: Family of Tokenizers for Multimodal Generative Models Paper • 2608.05798 • Published Aug 6 • 29