2025-07-09 14:43:16
209人关注
阿里通义开源支持链式推理的音频生成模型ThinkSound
近日,阿里语音AI团队宣布开源全球首个支持链式推理的音频生成模型ThinkSound,该模型通过引入思维链(Chain-of-Thought)技术,突破传统视频转音频技术对画面动态捕捉的局限,实现高保真、强同步的空间音频生成。这一突破标志着AI音频技术从“看图配音”向“结构化理解画面”的跨越式发展。
阿里语音AI
ThinkSound模型
链式推理音频生成
AI音频技术
空间音频生成
思维链技术