deepseek-ai/DeepSeek-V4-Flash-Vision-Exp Image-Text-to-Text • 305B • Updated about 5 hours ago • 17.9k • 428
Running on Zero MCP Featured 27 MiDashengLM-Gen 🎵 27 Unified audio scene generation from text descriptions
Running on Zero MCP Featured 34 SpotSound Temporal Grounding 🔍 34 Find when a described sound happens in a recording