大旗号
科技 汽车 财经 数码 时尚 旅游 美文 美食 其它

阿里云发布多模态交互开发套件,让硬件能听、会看、会交互

ITBEAR科技资讯 2026-01-11

1月8日,在阿里云通义智能硬件展上,阿里云发布多模态交互开发套件,该套件集成了千问、万相、百聆三款通义基础大模型,并预置十多款生活休闲、工作效率等领域的Agent和MCP工具,不仅能听、会看,还能思考并且与物理世界交互,可应用于AI眼镜、学习机、陪伴玩具、智能机器人等硬件设备。


随着多模态大模型的发展,大模型已开始具备理解、感知以及和物理世界交互的能力,越来越多的硬件和终端设备厂商开始通过接入大模型来提升交互体验。然而,仅靠基础大模型仍无法同时满足硬件设备对低成本、低时延、功能丰富和高质量效果的需求。

阿里云多模态交互开发套件为硬件企业和解决方案商提供了低开发门槛、响应速度快、场景丰富的平台。在芯片层面,该套件适配了30多款主流ARM、RISC-V和MIPS架构终端芯片平台,满足市面上绝大多数硬件设备的快速接入需求。未来,通义大模型还将与玄铁RISC-V实现软硬全链路的协同优化,实现通义大模型家族在RISC-V架构上的极致高效部署和推理性能。

在模型优化层面,除通义模型家族外,阿里云还针对大量多模态交互场景进行分析,推出适合AI硬件交互的专有模型,全面支持全双工语音、视频、图文等交互方式,端到端语音交互时延低至1秒,视频交互时延低至1.5秒。

此外,该套件预置十多款MCP工具和Agent,覆盖生活、工作、娱乐、教育等多个场景,例如,基于预置的出行规划Agent,用户可直接调用路线规划、旅行攻略、吃喝玩乐探索等能力。该套件还接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过 A2A协议兼容三方Agent,极大程度地扩展了应用的能力边界,帮助企业灵活搭建业务场景。


现场,阿里云还展示了面向智能穿戴设备、陪伴机器人、具身智能等领域的解决方案。例如,在AI眼镜领域,基于千问VL、百聆CosyVoice等模型,阿里云打造了感知层、规划层、执行层以及长期记忆的完整交互链路,可一站式实现同声传译、拍照翻译、多模态备忘录、录音转写功能,有效解决交互不自然、回答准确率低的难题。面向家庭陪伴机器人场景,基于千问模型和多模态交互套件,阿里云推出的解决方案不仅可实时监测异常状况,并及时告警信息推送,用户还能基于关键词查找、定位视频,与机器人进行对话交互和控制设备等。

根据国际权威市场研究机构Gartner发布的GenAI(生成式AI)技术创新指南系列报告,阿里云在GenAI云基础设施、GenAI工程、GenAI模型以及AI知识管理应用四大维度均位于新兴领导者象限,为入选全部四项新兴领导者象限的唯一亚太厂商,并比肩谷歌、OpenAI。

与蔡明同台的机器人:因时机器人获数亿融资
今年春晚舞台上,“含机器人量”成为全民热议的新焦点,其中小品《奶奶的最爱》中亮相的“孙辈”机器人,凭借倒水、递药、变魔术等流畅自然的动作圈粉无数,现场掌声不断。鲜为人知的是,这双赋予机器人精准操作能力的“灵巧手”,源自国产企业因时机器人,这

2026-02-28

蔚来芯片子公司获超22亿元融资,投后估值逼近百亿
2月26日,蔚来发布公告称,其芯片子公司安徽神玑技术有限公司(以下简称“神玑公司”)已完成首轮股权融资协议签署,融资金额超过22亿元,投后估值接近百亿元。这意味着蔚来在芯片自研赛道上的布局,正式进入资本化运作阶段。本轮投资方阵容颇为豪华,既包括合

2026-02-28

再携手!清华陈建宇×斯坦福Chelsea团队发布VLAW,世界模型×VLA协同进化
整个具身智能领域都在探索世界模型的实用化路径。这个被寄予厚望的「数字模拟器」,本应成为机器人训练的核心工具,却因物理保真度低等问题成为「空中楼阁」。去年年中,谷歌发布了 Genie-3 世界模型,让「可交互的世界模型」第一次以极具冲击力的方式走进大

2026-02-28

OpenClaw爆火,连“财神赵公明”都成了数字员工
2026年,我们应该如何定义数字员工?

2026-02-28

正式进军AI硬件 阿里千问将发布AI眼镜
继春节期间AI购物功能爆火后,阿里巴巴旗下个人AI助手“千问”正式进军AI硬件领域,计划今年面向全球市场推出多款不同形态的AI终端产品。据悉,千问将在西班牙巴塞罗那举行的世界移动通信大会(MWC2026)上发布首款同名AI眼镜,并于3月2日开启线上线下全渠道预

2026-02-28

阿里内测“妙呀AI”入局潮玩赛道
据报道,阿里近期已悄然开启潮玩AI平台“妙呀AI”的保密内测。这款产品主打“轻松捏娃潮玩妙呀”,聚焦AI捏娃玩法,目前仍处于小范围测试阶段。从内测界面来看,“妙呀AI”采用手机号验证码登录,同时支持支付宝第三方登录,整体操作入口简洁直观。产品的核心

2026-02-27

百度四季度AI业务收入占比43% 超预期
2月26日,百度发布2025年第四季度及全年财报,显示2025年总营收达1291亿元,AI业务营收达400亿元;四季度,百度总营收327亿元,AI业务收入占百度一般性业务收入的43%,超出市场预期。“2025年是AI成为百度新核心的关键一年。AI云势头强劲,我们凭借差异化的全

2026-02-27