上云资讯 - 来上云吧，企业上云一站式服务

阿里云云原生阿里云开发者腾讯云开发者火山引擎开发者社区魔搭ModelScope社区微软科技 Azure云科技 Zilliz OpenAI Anthropic Gemini LangChain Hugging Face Mistral

2025-07-11 08:31:41 472人关注

阿里开源ThinkSound：AI自动为视频加音效，影视与游戏创作迎来大变革！

2025年7月，阿里巴巴通义实验室正式开源其首款音频生成模型ThinkSound，为视频内容创作带来革命性突破。这款多模态AI模型能够基于视频、文本或音频输入，生成高保真的音效与音景，完美适配画面内容，为影视制作、游戏开发及多媒体创作注入全新活力。AIbase结合最新信息，深入剖析ThinkSound的独特优势与行业影响，带您一探AI音效生成的新前沿。

阿里巴巴通义实验室 ThinkSound开源音频生成模型 AI音效生成多模态AI模型视频内容创作革命

2025-07-10 09:39:21 551人关注

AI日报：阿里通义开源音频生成模型ThinkSound；谷歌Veo3支态图片生成视频；昆仑万维发布 Skywork-R1V 3.0

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南，每天我们为你呈现AI领域的热点内容，聚焦开发者，助你洞悉技术趋势、了解创新AI产品应用。

AI日报人工智能热点 AI技术趋势 AI开发者指南创新AI产品应用 AI领域动态

2025-07-09 14:43:16 417人关注

阿里通义开源支持链式推理的音频生成模型ThinkSound

近日，阿里语音AI团队宣布开源全球首个支持链式推理的音频生成模型ThinkSound，该模型通过引入思维链（Chain-of-Thought）技术，突破传统视频转音频技术对画面动态捕捉的局限，实现高保真、强同步的空间音频生成。这一突破标志着AI音频技术从“看图配音”向“结构化理解画面”的跨越式发展。

阿里语音AI ThinkSound模型链式推理音频生成 AI音频技术空间音频生成思维链技术

2025-01-16 00:35:39 302人关注

Stability AI开源音频生成模型Stable Audio Open:可生成47秒的立体声音频

最近，Stability AI 团队推出了一款全新的开源音频生成模型，名为 Stable Audio Open。这款模型的特别之处在于，它能够从文本提示生成时长可达47秒的立体声音频，采样率高达44.1kHz。

Stability AI Stable Audio AI音频生成 AI音频技术 Stability AI新闻音频模型开源

- 上云资讯 -

阿里开源ThinkSound：AI自动为视频加音效，影视与游戏创作迎来大变革！

AI日报：阿里通义开源音频生成模型ThinkSound；谷歌Veo3支态图片生成视频；昆仑万维发布 Skywork-R1V 3.0

阿里通义开源支持链式推理的音频生成模型ThinkSound

Stability AI开源音频生成模型Stable Audio Open:可生成47秒的立体声音频

推荐阅读

上云服务