阿里云发布多模态交互开发套件,AI硬件设备新突破
创始人
2026-01-08 12:51:57
0

今日,阿里云在通义智能硬件展上发布了全新的多模态交互开发套件,该套件集成了千问、万相、百聆三款通义基础大模型,并预置了十多款Agent和MCP工具,覆盖生活休闲、工作效率等领域。这些工具不仅能够听和看,还能思考并与物理世界交互,适用于AI眼镜、学习机、陪伴玩具、智能机器人等多种硬件设备。阿里云宣称,该开发套件为硬件企业和解决方案商提供了一个低开发门槛、响应速度快、场景丰富的平台。

在芯片层面,该套件适配了30多款主流ARM、RISC-V和MIPS架构终端芯片平台,满足市面上绝大多数硬件设备的快速接入需求。未来,通义大模型将与玄铁RISC-V实现软硬全链路的协同优化,以提高在RISC-V架构上的部署和推理性能。在模型优化层面,阿里云针对多模态交互场景推出了专有模型,全面支持全双工语音、视频、图文等交互方式,端到端语音交互时延低至1秒,视频交互时延低至1.5秒。

此外,该套件预置了MCP工具与Agent,接入了阿里云百炼平台生态,用户可以添加其他开发者提供的MCP和Agent模板,并通过A2A协议兼容三方Agent,扩展应用的能力边界。阿里云还展示了面向智能穿戴设备、陪伴机器人、具身智能等领域的解决方案,如基于千问VL、百聆CosyVoice等模型的AI眼镜,实现了同声传译、拍照翻译、多模态备忘录、录音转写等功能。在家庭陪伴机器人场景中,解决方案能够实时监测异常状况并推送告警信息,同时支持基于关键词的视频查找、定位和对话交互。

相关内容

热门资讯

小鹏汽车开放智造基地,启动AI... 1月9日,小鹏汽车宣布启动“小鹏AI科技智造之旅”项目,首次对外开放其全球总部及广州、肇庆智造基地,...
清华大学AI技术突破:Drug... 1月9日,清华大学智能产业研究院(AIR)兰艳艳教授联合生命学院、化学系团队宣布,他们创新研发了AI...
千树万树“李”花开!广州从化桂... 清晨的桂峰山还笼罩在薄雾中,流溪河源头的山谷里,千亩李树已然白遍山野。微风拂过,花瓣簌簌飘落,宛如冬...
以下是一些改写“回应民生关切”... 回应民生关切是政府工作的重要使命。通过加强政策调研,精准把握民众需求,制定切实可行的举措。在教育方面...
鸿蒙智行智界V9:1250km... 1月9日,鸿蒙智行宣布旗下首款MPV车型智界V9即将亮相。这款新车定位为“旗舰大作”,在空间、安全和...
华为加持!智界V9超长续航MP... 1月9日,鸿蒙智行旗下智界汽车发布了其首款MPV车型智界V9的关键配置与设计信息。智界V9搭载华为雪...
“腾势Z9GT新车型曝光:激光... 近日,工信部最新一期申报图中曝光了新款腾势Z9GT车型。新车在外观上延续了现款的设计风格,同时引入了...
北京奔驰全新纯电GLCL曝光:... 近日,工信部最新一期新车申报名单中出现了北京奔驰汽车有限公司国产的全新纯电GLCL。这款新车采用了双...
迈腾PHEV亮相工信部:1.5... 日前,迈腾PHEV正式亮相工信部申报目录,由一汽-大众汽车有限公司生产申报。在外观设计上,迈腾PHE...
本田中国2025年销量骤降24... 1月9日,本田中国公布了2025年在中国市场的终端汽车销量数据。数据显示,2025年本田在中国的终端...