FunAudioLLM/Fun-ASR-Nano-2512-hf Automatic Speech Recognition • 0.8B • Updated 11 days ago • 17.6k • 13
KVAE: Family of Tokenizers for Multimodal Generative Models Paper • 2608.05798 • Published 17 days ago • 29
Kandinsky WM 1.0 Collection Image-to-Video models for Physical AI: autonomous driving, robotics, general physics. • 3 items • Updated 18 days ago • 4