
【大河财立方 记者 陈薇】1月8日,在阿里云通义智能硬件展上,阿里云全新发布多模态交互开发套件。该套件集成了千问、万相、百聆三款通义基础大模型千里马配资,并预置十多款生活休闲、工作效率等领域的Agent和MCP工具,不仅能听、会看,还能思考并且与物理世界交互,可应用于AI眼镜、学习机、陪伴玩具、智能机器人等硬件设备。

在芯片层面,该套件适配30多款主流ARM、RISC-V和MIPS架构终端芯片平台,满足市面上绝大多数硬件设备的快速接入需求。
在模型优化层面,除通义模型家族外,阿里云还针对大量多模态交互场景进行分析,推出适合AI硬件交互的专有模型千里马配资,支持语音、视频、图文等交互方式,端到端语音交互时延低至1秒,视频交互时延低至1.5秒。
此外,该套件预置十多款MCP工具和Agent,覆盖生活、工作、娱乐、教育等多个场景。
阿里云还在现场展示了面向智能穿戴设备、陪伴机器人、具身智能等领域的解决方案。
例如在 AI 眼镜领域,基于千问 VL、百聆 CosyVoice 等模型,阿里云打造了感知层、规划层、执行层以及长期记忆的完整交互链路,可一站式实现同声传译、拍照翻译、多模态备忘录、录音转写功能。
面向家庭陪伴机器人场景,基于千问模型和多模态交互套件,阿里云推出的解决方案不仅可实时监测异常状况,并及时告警信息推送,用户还能基于关键词查找、定位视频,与机器人进行对话交互和控制设备等。
责编:刘安琪 | 审校:李金雨 | 审核:李震 | 监审:古筝千里马配资
博星优配提示:文章来自网络,不代表本站观点。