deepseek-ai/DeepSeek-V4-Flash-Vision-Exp Image-Text-to-Text • 305B • Updated 11 days ago • 444k • • 873
Running on Zero MCP Featured 29 MiDashengLM-Gen 🎵 29 Unified audio scene generation from text descriptions
Articulated Object Reconstruction from Rest-State Observation Paper • 2607.27749 • Published Jul 30 • 51
Running on Zero MCP Featured 35 SpotSound Temporal Grounding 🔍 35 Find when a described sound happens in a recording