清华大学机器人学助理教授、千寻智能联合创始人兼首席科学家高阳给出了一个时间点:最快从明年开始,人形机器人就能听懂口头指令,并完成大多数通用任务。但他同时泼了盆冷水——真正进入家庭、承担实用工作,仍需时日。
这个判断来自路透社9月18日的报道。高阳把话说得很具体:机器人“听懂人话”和机器人“帮人做事”,中间隔着一段不短的距离。
硬件跑得快,软件拖后腿
中国人形机器人的硬件能力近年提升很快。冲刺、跳舞,甚至按指令完成后空翻,都已经不成问题。机器人企业的竞争重心随之转向软件,目标是提高机器人的智能水平,让它能承担更多具备实际经济价值的任务。这一领域通常被称为具身智能。
高阳点出了短板所在:“大脑”是整个机器人技术栈中最薄弱的一环。他给出的路线图是:预计到2027年年中达到“GPT-3.0”级的里程碑。届时,你可以直接用自然语言与机器人交流,它会执行一系列合理的物理动作,尝试完成任务。
行业在等自己的“ChatGPT时刻”
整个机器人行业都在等待属于自己的“ChatGPT时刻”——足以把前沿技术变成面向广大客户的实用产品的软件突破。OpenAI在2022年推出ChatGPT后,生成式AI迅速进入大众市场,同时证明了商业化潜力。这个参照系,现在被套用在了机器人身上。
为了训练机器人,千寻智能在全国安排了约1000名合同人员收集真实世界数据。目前,其机器人在结构化客厅环境中完成简单任务的成功率达到90%。
高阳预计:“未来一两年将是工业应用的初始窗口。两年后,我们会看到机器人进入商业服务场景,执行较简单的任务。相比工业和商业服务场景,进入家庭要困难得多。”
他对比了前后的变化:“我们成立时,机器人只能做好倒水、叠一件衣服这类单独任务。今天,机器人可以在大范围空间内行动,并连续完成复杂的工作流程。”
但难题依然摆在面前:旋开瓶盖等精细动作,以及处理此前没有遇到过的任务,仍是机器人需要攻克的关卡。
热门跟贴