豆包发布了一款汽车座舱助手,把豆包模型和汽车车机整合到了一起。演示里,它不只是听懂一句话那么简单——空调、车窗、导航路线规划这些车内设备,都能通过多模态交互来控制。

更值得看的是任务拆解能力。这款助手能结合车机应用生态,完成复杂的意图调用。也就是说,用户抛出一个需求,它要自己判断该动哪些设备、调哪些应用,再一步步执行下去。车载助手正在从单点语音指令,走向跨应用的 Agent 式执行。

模态控车,不只是动嘴

语音之外,这款座舱助手还支持多模态方式控制车内设备。空调、车窗、导航这些高频操作,都被纳入了它的控制范围。对车主来说,这意味着不用再在屏幕上翻菜单找按钮,一句话或者一个动作就能把事办了。

配套的那块车载小屏,是交互形态上的补充。纯语音交互有个天然短板:用户不知道系统听懂了没有、执行到哪一步了。一块可互动的小屏,保留了可视化反馈通道,让整个交互过程有地方落脚。

从语音指令到跨应用执行

把大模型能力下沉到汽车座舱,核心变化在于任务拆解。过去的车载语音助手,大多停留在"打开空调""导航到某地"这种单点指令上,跨应用的复杂需求基本接不住。

豆包这款助手结合车机应用生态后,能处理复杂的意图调用。用户说一句话,背后可能涉及多个应用、多个设备的协同,系统要自己拆解、自己调度。这是车载助手从工具向 Agent 演进的关键一步。

看过演示的人给出的反馈是效果不错。座舱这个场景,正在成为大模型落地的新战场。