2025-02-26 08:00
热度 0

微软开源多模态AI Agent—Magma

摘要
神经日报 2月26日消息,今天凌晨3点,微软在官网开源了多模态AI Agent基础模型——Magma。与传统Agent相比,Magma具备跨数字、物理世界的多模态能力,能自动处理图像、视频、文本等不同类型数据,例如,你可以用Magma来自动下电商订单、查询天气;也可以自动操作实体机器人,或者下真实象棋时获得帮助。此外,Magma还能内置了心理预测功能,增强了对未来视频帧中时空动态的理解能力,能够准

神经日报 2月26日消息,今天凌晨3点,微软在官网开源了多模态AI Agent基础模型——MaGMa。与传统Agent相比,MaGMA具备跨数字、物理世界的多模态能力,能自动处理图像、视频、文本等不同类型数据,例如,你可以用Magma来自动下电商订单、查询天气;也可以自动操作实体机器人,或者下真实象棋时获得帮助。此外,Magma还能内置了心理预测功能,增强了对未来视频帧中时空动态的理解能力,能够准确推测视频中人物或物体的意图和未来行为。

声明:文章不代表神经日报观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!当前页面地址:https://www.nervedaily.com/kuaixun/87824.html
回顶部