2026年1月8日,阿里云官方账号发布消息,在阿里云通义智能硬件展上,阿里云全新发布多模态交互开发套件。
2026年1月8日,阿里云官方账号发布消息,在阿里云通义智能硬件展上,阿里云全新发布多模态交互开发套件。

据了解,该套件集成了千问、万相、百聆三款通义基础大模型,并预置十多款生活休闲、工作效率等领域的Agent和MCP工具,不仅能听、会看,还能思考并且与物理世界交互,可应用于AI眼镜、学习机、陪伴玩具、智能机器人等硬件设备。
同时,该套件还接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过 A2A协议兼容三方Agent,极大程度地扩展了应用的能力边界,帮助企业灵活搭建业务场景。

值得注意的是,在AI眼镜领域,基于千问VL、百聆CosyVoice等模型,阿里云打造了感知层、规划层、执行层以及长期记忆的完整交互链路。