- 上云资讯 -
2025-04-18 14:41:38 87人关注
微软开源 OmniParser V2:让大语言模型“看懂”并操作 GUI
微软近日推出了其 Windows 操作大模型 OmniParser 的升级版本——OmniParser-v2.0。该模型能够识别桌面和窗口元素,并与之进行交互,标志着 AI Agent 技术在实现完全自动使用电脑的方向上又迈进了一步。
Microsoft OmniParser V2 GUI语言模型 语言模型技术 OmniParser V2新特性 Microsoft AI工具
2025-04-16 16:32:40 116人关注
微软发布 OmniParser V2.0:把屏幕截图转化成LLM可处理的结构化格式
微软近日发布了 OmniParser V2.0,这是一个旨在将用户界面(UI)截图转换为结构化格式的全新解析工具。OmniParser 能够提高基于大型语言模型(LLM)的 UI 代理的性能,帮助用户更好地理解和操作屏幕上的信息。
Microsoft OmniParser V2 截图结构化格式 Microsoft OmniParser 应用 结构化数据提取 OmniParser V2 功能