作者|拂晓子
来源 | 具身之家Robots(ID:zscy006)
8月19日,小米新一代人形机器人亮相 2026 世界机器人博览会,登陆「具身花园」展台。
2022年CyberOne“铁大”第一次站上雷军的发布会时,它更像一张面向未来的技术名片;四年后的今天,小米机器人最重要的身份已经不是舞台上的明星,而是汽车工厂里的“实习生”。
这四年间,小米没有停在本体迭代上,而是在同时补齐工厂场景、具身模型、世界模型、灵巧手和人机交互。
小米为什么选择在产业进入落地期时再次高调出牌?它准备把机器人做成一门怎样的生意?
不秀肌肉,先拿工牌
图|小米新一代人形机器人将扮演“花艺师”,可抓取香片撒花并递送给现场观众
今年3月,雷军首次透露“小米机器人在工厂实习”,已经可以稳定运行约3小时。
到了7月,小米2026年二季度业绩公告明确披露,在小米汽车工厂,自攻螺母上件工站双侧作业成功率已从90.2%提高到98%;同时,机器人进入总装车间物流区两个新工站——中控台侧盖板排序和料箱折叠回收,两项任务成功率均达到90%。
实验室演示追求“做出来”,产线追求的是“每一次都做对”。
动作再漂亮,只要随机失败,就无法嵌入稳定节拍;机器人真正进入工厂,考核指标会迅速从自由度、速度和动作数量,变成成功率、平均无故障时间、节拍、维护成本和ROI。
很多机器人创业公司需要四处寻找试点工位、争取客户开放生产数据;小米自己就拥有高自动化水平的汽车工厂,既是机器人研发方,也是第一批用户。
机器人可以在真实工站里暴露问题,失败样本又反过来成为模型和控制策略继续迭代的数据。
雷军也表示,未来5年会有“大批量”人形机器人进入小米工厂工作。
这个表态并不意味着小米已经跨过量产门槛,但至少把路线说得很清楚:先不急着讲家庭万能机器人,先在自己的制造体系里,把一名“实习生”训练到能长期、稳定、可计算地创造价值。
雷军开始“拼人”
图|小米机器人近期人才与能力拼图。制图:具身之家
如果只盯着机器人本体,很容易低估小米过去一年的变化。
真正密集的动作发生在人事和组织层面:它正在把具身基座模型、人机交互、灵巧手和通用大模型几条能力线,逐渐拼成一张更完整的图。
第一块拼图是孔涛。
据36氪等媒体报道,原字节跳动机器人团队负责人孔涛已于2025年夏天加入小米,负责机器人基座模型相关研发;小米内部新设“具身智能与应用部”,由孔涛负责,并整合VLA等研发力量。
第二块拼图是王刚。
小爱同学业务发生组织调整,长期负责小爱同学研发的王刚已调任机器人业务线。这个调动的意义并不只是换岗。机器人如果最终从工厂走向门店和家庭,必须解决“人怎么跟它说、它怎么理解、怎么规划、最后怎么行动”的完整链条。
小爱同学积累的是语音、意图理解和跨设备交互,机器人需要的则是把这些数字世界里的理解,继续映射到物理动作。
第三块拼图是“手”。
2025年11月,前特斯拉Optimus灵巧手团队成员卢泽宇加入小米机器人团队,担任灵巧手负责人,对于工业人形机器人而言,走路只是进入工位的前提,真正决定能不能干活的往往是末端执行能力。
第四块拼图来自小米更大的AI体系。
2025年11月,95后AI研究员罗福莉确认加入Xiaomi MiMo,并在公开表态中写道:“智能终将从语言迈向物理世界。”
她并不直接等同于机器人业务负责人,但MiMo所代表的语言、推理、Agent和基础模型能力,正是小米希望把AI从屏幕推向物理世界的另一条底座。
小米开始尝试把“大模型—交互—具身模型—灵巧操作—真实场景”连成一条研发链。
机器人业务正在从一个前沿实验项目,逐渐长成一个需要跨部门协同的系统工程。
“大脑”连发三招
图|小米集团在2026Q2业绩简报中将 Xiaomi-Robotics-U0 与 Xiaomi-Robotics-1 列为具身智能核心模型进展
2026年,小米机器人连续发布三套关键模型,节奏也明显加快。
第一步是2月发布并开源的Xiaomi-Robotics-0。它是一套视觉—语言—动作模型,也就是VLA:输入视觉和语言指令,直接生成机器人动作。
第二步是7月发布的Xiaomi-Robotics-U0。它不是直接控制机器人的动作模型,而是一套380亿参数的世界基础模型,尝试把图像生成、场景编辑、多视角具身场景生成、具身迁移和具身视频生成放到同一个框架中。
第三步是7月16日发布的Xiaomi-Robotics-1。官方页面显示,它在预训练阶段使用了超过10万小时的真实世界操作轨迹,覆盖1700多个家庭、商业、工业和户外场景;后训练阶段还使用了超过7200小时的小米自采真实机器人数据。
这条路线很像大语言模型过去几年的Scaling思路:先用更大规模的数据学习通用能力,再用少量高质量真实机器人数据完成对齐。
过去造机器人,大家首先比的是电机、减速器、关节和运动控制;接下来,竞争变量正在增加一层——谁能获得更丰富的真实世界数据,谁能把这些数据转化为可迁移的通用模型。
不只是一台机器人
图|小米具备形成“数据—模型—场景”闭环的潜在条件。制图:具身之家
当“大脑”“手”和工厂逐渐接起来,小米最终要回答的问题就不再是“能不能造出一台机器人”,而是“机器人在小米整个商业版图里到底是什么位置?”。
卢伟冰在财报沟通会中给出的答案很明确:小米不会孤立地做机器人,而会和“人车家全生态”协同,应用场景包括智能工厂、智能出行以及家庭。
工厂是最容易形成商业闭环的场景。任务边界清晰、环境相对可控,机器人能否替代某一段人工,可以用节拍、成功率和成本直接评估。
家庭则完全是另一个难度。工厂要求稳定重复,家庭要求开放环境中的通用智能。今天机器人能把一个螺母稳定放进固定工装,不代表明天就能在陌生厨房收拾餐具、在客厅绕过孩子和宠物、听懂含糊指令后自己决定先做哪件事。
这也是为什么小米同时推进全尺寸本体、具身模型、世界模型、灵巧手和人机交互——家庭机器人需要的不是某一个单点能力,而是一整套系统能力。
从财务投入看,小米也在为这张长期船票付费。
2026年二季度,小米集团收入1089.2亿元;研发开支92.3亿元,同比增长18.9%。其中,智能电动汽车、AI及其他新业务收入248.96亿元,同比增长17.1%,但该分部经营亏损仍为26亿元。
机器人尚未形成独立的财务贡献,但已经被小米在二季度业绩公告中与AI基础模型、汽车工厂验证一并重点披露。
对于一家已经拥有手机、汽车、IoT设备、操作系统和制造工厂的公司来说,人形机器人最大的想象力,也许不是再增加一个硬件品类,而是成为一类能在现实空间中移动、感知、操作,并调用整个生态能力的新终端。
此次,在世界机器人大会上的公开亮相或许只是一次“重新出场”,小米机器人真正重要的“首秀”,仍然发生在那些没有聚光灯的工位上。
当它不再被叫作“实习生”,才是小米机器人真正进入下一阶段的关键时刻。
热门跟贴