千寻高阳:人形机器人明年能听懂人话

https://mylogs.cn/wp-content/uploads/2026/09/ithome327_header.webp

据路透社 9 月 18 日晚间报道,清华大学机器人学助理教授、千寻智能联合创始人兼首席科学家高阳预计,最快从明年开始,人形机器人就能听懂口头指令并完成大多数通用任务,但真正进入家庭、承担实用工作仍需更长时间。这番表态把人形机器人「何时能干活」的时间表,又一次推到了公众视野中央。

行业等待自己的「ChatGPT 时刻」

高阳指出,中国人形机器人的硬件能力近年快速提升,冲刺、跳舞甚至按指令完成后空翻都已不成问题,竞争重心随之转向软件,目标是提高机器人的智能水平,让其承担更多具备实际经济价值的任务。这一领域通常被称为具身智能。

整个机器人行业都在等待属于自己的「ChatGPT 时刻」——足以把前沿技术变成面向广大客户的实用产品的软件突破。OpenAI 在 2022 年推出 ChatGPT 后,生成式人工智能迅速进入大众市场,同时也证明了商业化的潜力。

在高阳看来,「大脑」是整个机器人技术栈中最薄弱的一环。他预计,到 2027 年年中,千寻智能有望达到「GPT-3.0」级的里程碑。「届时,你可以直接用自然语言与机器人交流,它会执行一系列合理的物理动作,尝试完成任务。」

从倒水叠衣到连续工作流

报道显示,为了训练机器人,千寻智能在全国安排了约 1000 名合同人员收集真实世界数据。目前,该公司的机器人在结构化客厅环境中完成简单任务的成功率已达到 90%。

高阳回忆,公司成立之初,机器人只能做好倒水、叠一件衣服这类单独任务;如今,机器人已经可以在大范围空间内行动,并连续完成复杂的工作流程。不过,旋开瓶盖等精细动作,以及处理此前没有遇到过的任务,依然是机器人需要攻克的难题。

关于落地节奏,高阳给出了分阶段判断:未来一两年将是工业应用的初始窗口;两年后,会看到机器人进入商业服务场景,执行较简单的任务;相比工业和商业服务,进入家庭要困难得多。

清华背景的年轻团队

千寻智能(Spirit AI)成立于 2024 年,是一家聚焦具身智能的创业公司。高阳现任清华大学交叉信息研究院助理教授、清华大学具身视觉与机器人实验室主任,本科毕业于清华大学计算机系,博士就读于加州大学伯克利分校。在其带领下,千寻智能组建了一支平均年龄不到 30 岁的团队,并先后完成多轮融资,其中 2025 年 3 月的 5.28 亿元 Pre-A 轮由阿美风险投资旗下 Prosperity7 Ventures 领投。

该公司自研的 Spirit v1 系列具身基座模型,已在国内首次攻克柔性物体长程操作难题,机器人可顺畅完成叠衣服等连续复杂任务;首款商用级人形机器人 Moz1 也已进入宁德时代、京东 MALL 等真实场景开展试点。

对具身智能赛道而言,高阳的判断既是乐观预期,也是清醒提醒:听懂人话只是起点,真正把机器人送进千家万户,还有一段不短的路要走。