OpenMOSS-Team/MOSS-Music-8B-Thinking
Audio-Text-to-Text ⢠9B ⢠Updated ⢠351 ⢠39
LLM
WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning
OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation