LetsClouds-Logo
AI对话 上云服务 上云资讯 解决方案 关于我们
售前咨询 021-50583875
微信二维码

微信扫码

添加专属顾问

- 上云资讯 -

阿里云云原生 阿里云开发者 腾讯云开发者 火山引擎开发者社区 魔搭ModelScope社区 微软科技 Azure云科技 Zilliz OpenAI Anthropic Gemini LangChain Hugging Face Mistral

2025-07-08 10:40:16 77人关注

Stream-Omni:同时支持各种模态组合交互,开启文本、视觉、语音结合

在人工智能技术飞速发展的今天,中国科学院计算技术研究所自然语言处理团队推出了一款名为 Stream-Omni 的文本 - 视觉 - 语音多模态大模型。这一模型的核心亮点在于它能够同时支持多种模态的交互方式,为用户带来更加灵活和丰富的体验。

多模态大模型 Stream-Omni 模型特点 文本视觉语音多模态交互 中国科学院计算技术研究所AI成果 多模态大模型应用场景

推荐阅读

加载中...

上云服务

沪ICP备14033669号-10