微软开源多模态AI Agent基础模型Magma

当地时间2月25日,微软在官网开源多模态AI Agent基础模型Magma。据介绍,与传统Agent相比,Magma具备跨数字、物理世界的多模态能力,能自动处理图像、视频、文本等不同类型数据,此外,Magma还能内置了心理预测功能,增强了对未来视频帧中时空动态的理解能力,能够准确推测视频中人物或物体的意图和未来行为。

未经正式授权严禁转载本文,侵权必究。

微软

4.7k
  • 寻找AI算力的“第二出口”:高额Token时代下的端侧解法
  • 微软总裁回应美毕业生疑虑:AI会增强而不是取代人,个人应重点培养这些能力

评论

暂无评论哦,快来评价一下吧!