想要一个桌面小伙伴,有复古游戏角色的手感,能陪你聊天、帮你盯着桌上的计时器、在你卡bug时陪你捋一遍思路,但又不希望有个摄像头整天盯着你?
这个问题催生了 DinoDesk AI,也就是我们的乐高恐龙AI伴侣机器人。我和同事 Shama 一起动手,做了一台智能、低功耗的桌面机器人:把8位音画的怀旧感和乐高机械组的结构感,跟一套现代混合大模型切换架构(本地↔云端)拼在一起。
打开网易新闻 查看精彩图片
做法是在桌面上放一台树莓派,在本地PC上跑一个网关,网关里同时挂着 Gemma 4 和 Gemini Flash。这样一来,它做到了三件事:100%视觉隐私(没有摄像头)、零成本的本地即时聊天、以及按需调用的云端深度推理。
下面是 DinoDesk AI 从设计、接线到编程的完整幕后故事。
混合大脑:本地 Gemma 4 ↔ 云端 Gemini
做AI硬件伴侣,最先要回答的问题是:脑子长在哪儿。如果全放云端,每一句随口的"现在几点了"都要消耗API额度、增加网络延迟,还要把你的语音数据送出家门。可如果严格只用设备上的小模型,一旦你让它在一个庞大的代码库里加个新功能,或者解释一个复杂话题,它立刻就吃力了。
所以我们决定做一套混合大模型架构,在用户的主力PC上托管一个统一的模型网关(路由器)。桌面上的树莓派只管通过Wi-Fi发出统一的、兼容OpenAI格式的请求,至于背后是哪个引擎在干活,它不需要知道。
整个链路是这样分层的:
热门跟贴