上云资讯 - 来上云吧，企业上云一站式服务

2025-07-08 10:40:16 358人关注

Stream-Omni：同时支持各种模态组合交互,开启文本、视觉、语音结合

在人工智能技术飞速发展的今天，中国科学院计算技术研究所自然语言处理团队推出了一款名为 Stream-Omni 的文本 - 视觉 - 语音多模态大模型。这一模型的核心亮点在于它能够同时支持多种模态的交互方式，为用户带来更加灵活和丰富的体验。