微软OmniParser最新版本可将DeepSeek等模型转化为计算机智能体

2月17日,根据微软官网,微软日前发布视觉Agent解析框架OmniParser最新版本V2,可将OpenAI(4o/o1/o3-mini)、DeepSeek(R1)、Qwen(2.5VL)、Anthropic(Sonnet)等大模型,转化为“计算机使用智能体”(Computer Use Agent)。相比前代版本,OmniParser V2在检测更微小可交互元素时精度更高、推理速度更快。具体而言,V2通过使用更大规模的交互元素检测数据集和图标功能描述数据进行训练,并通过缩小图标描述模型的输入图像尺寸,推理延迟较前代降低60%。

未经正式授权严禁转载本文,侵权必究。

微软

4.2k
  • 微软计划周五发布全新智能体AI模型
  • AI早报 | 小米回应“进军AI教育”:人才招聘被误读,实为强化产品服务;夸克AI眼镜二手溢价飙到5000元

OpenAI

  • OpenAI据悉考虑在ChatGPT内投放广告
  • OpenAI与美能源部签署协议,寻求在AI与先进计算领域扩大合作

评论

暂无评论哦,快来评价一下吧!