从儿童拍学机到人形机器人,千问已成为物理AI的操作系统

电商派
2026-06-30 19:22

人工智能已经正式迈入全新阶段,从理解语言进化到接管物理世界。作为全球AI竞争的主要玩家,中美都在积极布局物理AI。

中国制造看华南,而物理AI则离不开深圳。从赛格电子市场到华强北的元器件柜台,从代工厂、模组商到品牌方,一颗芯片、一块PCB、一套模组,AI硬件可以在几公里之内完成从立项到出货的全部链路。数据显示,截至2026年5月初,华强北AI产品销量占比已从2023年的12%跃升至41%。

华强北是风向标,物理AI浪潮正席卷全国并走向全球。《2026中国AI硬件产业全景洞察与趋势报告》预测,不含手机和汽车的AI硬件市场规模将突破1.27万亿元,覆盖AI眼镜、AI手机、AI拍学机、机器人、车载终端、智能穿戴等。AI的发展正从“处理数字信息”向“理解并介入现实物理世界”发生根本性转变,物理AI将是下一轮产业革命的核心。

毫无疑问,在AI硬件中,模型是“大脑”,决定了产品的智能上限和办事能力。当前,超15万家智能硬件厂商已接入千问大模型,包括国内头部具身智能企业和全球TOP10手机厂商。此外,千问大模型还服务了100%的主流车企、智能家电等。千问大模型事实上已成为物理AI的操作系统。

为什么是千问?走进深圳实地调研,截然不同的AI硬件都给出了同一个答案。

1、月均5000万次拍照的AI拍学机

儿童AI终端品牌噜咔博士最近宣布,旗下AI拍学机已全面接入千问大模型。截至目前,该产品累计用户规模突破25万,月均拍照识别量超过5000万次,预计覆盖全球20多个国家和地区。

噜咔博士把AI拍学机定义为“儿童多模态AI陪伴终端”。接入千问后,AI拍学机实现了图像理解、视觉推理、OCR识别和实时交互等功能,并在多项评测中达到SOTA水平,端到端延迟控制在1至2秒内。产品还集成了万相Wan2.7以及ASR/TTS,实现万物识别、双语启蒙、AI讲故事等功能。

此外,噜咔博士的Agent架构记忆中心基于向量数据库打造可存储的长期记忆,实现个性化成长轨迹追踪;阿里云的内容安全中心通过多层内容审核与过滤,配合儿童专属安全策略引擎,确保交互内容合规。阿里云还为噜咔博士的出海提供全球基础设施。

2、“端到端闭环”的人形机器人

近日,逐际动力发布最新一代人形机器人LimX Luna,该产品基于阿里云全栈AI打造,并接入千问Omni模型。具身智能的“大脑”VLA(视觉-语言-动作)模型与运控"小脑"模型的训练需要海量多模态数据,对训练吞吐和存储有极高要求。目前,逐际动力的训练数据规模已达1.5PB,训练高峰瞬时吞吐可达上百TB。基于阿里云PAI平台和CPFS并行存储,逐际动力构建了模型训练平台;依托阿里云ACK容器服务和边缘计算能力,多类强化学习环境被统一封装为云上仿真平台。这套方案把过去以周为单位的环境调试,压缩至小时级。

机器人本体侧,LimX Luna等机器人接入千问Omni后获得了全模态实时互动能力。机器人不仅能"看懂、听懂、说出来",还能根据现场场景调用外部工具完成任务。

此外,逐际动力自研的具身智能标准化训练框架FluxVLA也已上架阿里云PAI平台。

3、千问支持不同品类的物理AI载体

噜咔博士意味着消费级AI硬件已进化为新物种,逐际动力则代表了工业级AI硬件对大模型和智能算力的极致要求。AI正在从硬件的"附加功能"变成用户最在意的“核心体验”,谁先完成与AI的深度融合,谁就能率先接入物理世界。

在深圳实地走访,可以发现,除了学习机和人形机器人,AI手机、AI眼镜、家居机器人,无人机、车载终端、智能穿戴等品类背后都有千问大模型。

在AI手机领域,OPPO正在基于PAI平台对千问进行后训练,以支持不同AI场景;荣耀联合阿里云打造的视觉问答(Visual-Question-Answering,VQA)端到端方案,将图像细分场景识别率提升近40%,延迟降低30%。

在AI眼镜领域,基于千问定制的"云+端"多模态架构,雷鸟 V3 AI 拍摄眼镜已通过摄像头与麦克风传感器,实现视觉理解、实时问答与低延迟多模态交互。

在家居场景,科沃斯扫地机器人接入千问,采用"端侧小模型识别意图+云端大模型承接复杂对话"的架构,服务全球 3800 万家庭。

在无人机领域,影石科技的影翎 A1 基于千问系列模型,打造智能影像拼接、深度主体追踪、一键智能运镜等能力,实现 “先飞行后构图” ,小白也能轻松出片。

在AI玩具场景,小智AI是基于千问语言、语音等模型打造的开源项目,在Github拥有超2.7万Star。全球依托小智AI打造的硬件超200万,畅销东南亚等地。

阿里云智能集团公共云事业部南区解决方案总经理陈立伟表示,超15万家智能硬件厂商已接入千问大模型,国内头部具身智能企业和全球TOP10手机厂商都已接入千问。此外,千问还覆盖消费级、工业级、出行、家居、安防等几乎全部场景。支撑这些物理AI载体持续升级的是阿里云全栈AI技术。

模型层面,千问是业内率先实现"全模态、全尺寸、全面开源"的大模型,覆盖文本、视觉、语音、视频的全模态能力,提供从0.5B到480B等十多档参数的全尺寸版本,并已累计开源400多款模型。这让不同物理AI载体在对应的场景中都能找到适配的模型。

算力层面,阿里云领先的计算、存储、网络、数据库、安全引擎等,再加上遍布全球的基础设施,构成了物理AI的地基。AI企业尤其是初创企业,不必重复造轮子,可以直接将训练、推理、出海等业务跑在阿里云上。

目前,阿里云通过端云协同、多模态互动、多智能体架构,推动AI硬件与物理世界深度融合。

1、该内容为作者独立观点,不代表电商派观点或立场,文章为作者本人上传,版权归原作者所有,未经允许不得转载。
2、电商号平台仅提供信息存储服务,如发现文章、图片等侵权行为,侵权责任由作者本人承担。
3、如对本稿件有异议或投诉,请联系:info@dsb.cn
相关阅读
7月17日消息,2026年世界人工智能大会首日,宣布将AI眼镜升级为智能体眼镜。升级后,眼镜可通过智能体强化服务与决策能力,并能按需调用第三方Skill和Agent。同时,还推出全双工语音、眼动追踪、体征监测等新硬件技术,以增强智能体眼镜对物理世界的感知与交互能力。上述硬件技术将在年内应用于AI智能体眼镜;已发售的AI眼镜S1、G1也将通过OTA引入Agent能力 。
3月26日消息,阿里AI助手被接入红旗汽车智能座舱,加速进入物理世界。这是继AI眼镜之后,进一步拓展至更高复杂度的车载场景,迈向全场景AI助手。据悉,即将首发搭载于红旗HS6 PHEV。很快,红旗汽车用户只需一句话即可完成多目标任务。例如,“你好,先去北京大学,中午找一家沿途方便又好吃的烤鸭店,下午5点我要到T3航站楼”,系统可同时理解导航、用餐与时间约束等多重需求,并结合实时路况、天气、商户营业状态等信息,生成完整行程方案。后续红旗汽车智能座舱还将接入即时零售、票务预订、出行服务等更多阿里生态的“办事能力”,逐步扩展车内服务边界。
8月12日消息,技术负责人林俊旸宣布已在上海创办了一家新公司语用科技,研究方向为横跨数字世界和物理世界的下一代智能体。他同时透露,高榕创投和HSG(红杉中国)共同领投本轮融资,腾讯和上海未来产业基金提供支持。从知情人士处获悉,林俊旸所称的“本轮融资”为语用科技天使轮融资,估值为20亿美元。
近日,逐际动力与阿里云联合打造的具身智能标准化工程底座 FluxVLA Engine 正式上架阿里云 PAI 平台,并以开源方式向全球开发者开放。此外,逐际动力的多款机器人基于阿里云全栈AI打造,也已接入 Omni 模型,实现物理世界的全模态实时交互。
7月1日消息,逐际动力与阿里云联合打造的具身智能标准化工程底座FluxVLA Engine正式上架阿里云PAI平台,并以开源方式向全球开发者开放。此外,逐际动力的多款机器人基于阿里云全栈AI打造,也已接入Omni模型,实现物理世界的全模态实时交互。
高德接入阿里App
12月18日消息,阿里App开始接入第一个阿里生态场景——高德,开始具备物理世界理解与行动能力。通过系统级对接,App不再只是生成一段文字建议,而是能够调用高德地图、扫街榜等底层服务,即时生成包含推荐餐厅、酒店、地理位置及出行方案的可视化决策卡片。未来阿里旗下的消费、支付等核心业务场景将陆续接入,加速构建现实世界服务履约网络。
8月25日消息,APP与PC端上线阿里云Token Plan接入功能,支持绑定API Key后使用Token Plan额度处理复杂任务。
用户在淘宝闪购智能体里说出送花需求,将个性化推荐合适花束,下单后闪购到家。