微软公布多模态模型MM-Navigator，基于GPT-4V研发

AIGC行业资讯1年前 (2023)发布管理员

751 0 9

据 Arxiv 页面显示，微软近日联手加州大学等高校，共同发布一款多模态大模型产品 MM-Navigator。

MM-Navigator基于 GPT-4V打造，可用于零镜头智能手机 GUI 导航任务。通过使用 MM-Navigator，智能手机屏幕可以像人类用户一样进行交互，并确定后续行动以完成给定的指示。

研究发现，多模态大模型在零镜头 GUI 导航方面表现出色，尤其是 GPT-4V，它具有先进的屏幕解释、行动推理和精确行动定位能力。

# AIGC行业资讯 # GPT # 大模型 # 微软

© 版权声明

本文转载自互联网、仅供学习交流，内容版权归原作者所有，如涉作品、版权或其它疑问请联系AIGC工具导航或点击删除。

相关文章

工信部中国电子技术标准化研究院：国家大模型标准测试结果公布：百度、腾讯、阿里、360通过

ai绘画赚钱图文(怎么用ai绘画来赚钱 )

2024首届人工智能先进技术成果供需对接大会举行

ppt灵感设计怎么用不了(powerpoint的设计灵感只有第一页有吗 )

Meta硬刚OpenAI，国产“小模型”官宣开源，“百模大战”走向何方？

微软AI Day现场展示Copilot如何提升生产力——1分钟内完成报销核对