LetsClouds-Logo
AI对话 上云服务 上云资讯 解决方案 关于我们
售前咨询 021-50583875
微信二维码

微信扫码

添加专属顾问

- 上云资讯 -

阿里云云原生 阿里云开发者 腾讯云开发者 火山引擎开发者社区 魔搭ModelScope社区 微软科技 Azure云科技 Zilliz OpenAI Anthropic Gemini LangChain Hugging Face Mistral

2025-07-11 08:31:41 132人关注

阿里开源ThinkSound:AI自动为视频加音效,影视与游戏创作迎来大变革!

2025年7月,阿里巴巴通义实验室正式开源其首款音频生成模型ThinkSound,为视频内容创作带来革命性突破。这款多模态AI模型能够基于视频、文本或音频输入,生成高保真的音效与音景,完美适配画面内容,为影视制作、游戏开发及多媒体创作注入全新活力。AIbase结合最新信息,深入剖析ThinkSound的独特优势与行业影响,带您一探AI音效生成的新前沿。

阿里巴巴通义实验室 ThinkSound开源 音频生成模型 AI音效生成 多模态AI模型 视频内容创作革命

2025-07-10 09:39:21 106人关注

AI日报:阿里通义开源音频生成模型ThinkSound;谷歌Veo3支态图片生成视频;昆仑万维发布 Skywork-R1V 3.0

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

AI日报 人工智能热点 AI技术趋势 AI开发者指南 创新AI产品应用 AI领域动态

2025-07-09 14:43:16 209人关注

阿里通义开源支持链式推理的音频生成模型ThinkSound

近日,阿里语音AI团队宣布开源全球首个支持链式推理的音频生成模型ThinkSound,该模型通过引入思维链(Chain-of-Thought)技术,突破传统视频转音频技术对画面动态捕捉的局限,实现高保真、强同步的空间音频生成。这一突破标志着AI音频技术从“看图配音”向“结构化理解画面”的跨越式发展。

阿里语音AI ThinkSound模型 链式推理音频生成 AI音频技术 空间音频生成 思维链技术

2025-01-16 00:35:39 120人关注

Stability AI开源音频生成模型Stable Audio Open:可生成47秒的立体声音频

最近,Stability AI 团队推出了一款全新的开源音频生成模型,名为 Stable Audio Open。这款模型的特别之处在于,它能够从文本提示生成时长可达47秒的立体声音频,采样率高达44.1kHz。

Stability AI Stable Audio AI音频生成 AI音频技术 Stability AI新闻 音频模型开源

推荐阅读

加载中...

上云服务

沪ICP备14033669号-10