编辑|山辉
ChatGPT 语音功能上线有段时间了,不知道大家的使用体验如何。
在「像不像真人」这件事上,已经见到了不少惊人的案例。
但更出人意料的是,一位博主分享了自己边徒步、边用语音工作的经历:他在北加州的红杉树森林里徒步了 4 个小时,全程戴着 AirPods,通过 ChatGPT 语音模式与大模型一路交流,结果「这 4 个小时干的活,比在办公室 8 个小时还要多」。
按照他的描述,返程时乘坐自动驾驶汽车的 45 分钟,可以继续和 ChatGPT 讨论副业;在咖啡馆的 20 分钟也足以口述一批想法。等回到家时,电脑上已经出现了未来一个月的 Newsletter 草稿。
这听上去有点恐怖。
全新的工作模式
在这位博主的设想中,用户可以选择一台设备作为「总部」,所有主要工作都在这台设备上完成。
手机、平板和笔记本则成为分布在不同地点的「节点」。借助远程功能,无论身处何地,用户都可以打开语音模式,让模型汇报项目进展、指导下一步行动,或者创建新的任务线程。
这条帖子很快得到了 Sam Altman 的转发,并留言「同意,感觉这很重要。我想要一种全新的计算机」。
一些用户也在评论区表示,自己此前并不知道可以这样控制电脑,这种工作方式带来的效率提升「改变了一切」。
语音的优势就在于此:它几乎可以与任何活动同时进行。
相比屏幕与键盘,语音解放了双手,也减少了视觉注意力的占用。
也正因为如此,语音更容易渗入生活的各个角落,逐渐侵入那些过去与工作无关的时刻。
「在徒步中还要用 ChatGPT 语音工作,
活该被困在荒野里。」
但「在红衫林里办公」这件事,听上去确实很容易让人恼火。
一名网友表示,在这样的环境中,他更愿意完整地感受天空、鸟鸣和空气,因为这些体验构成了「作为一个人的持久快乐」。
还有网友提醒人们保持警惕,这种「如朋友一般迎合」的声音,可能会让人逐渐丧失自己的判断力。
不可否认,大模型的交互和使用方式,正在经历一场持续而深刻的变化。
模糊的边界
前不久,Karpathy 分享了一则使用经验:与大模型合作的一种有效方式,可能是进行一段长时间的闲聊。
有时脑中已经有了大致目标,却懒得把背景和思路逐字整理出来。Karpathy 会打开语音模式,连续说上大约十分钟,把混乱、跳跃甚至尚未成形的想法全部讲给模型。
Karpathy 发现,大语言模型很擅长从这些冗长、缺乏结构的表达中重新识别目标。模型复述出来的内容,往往比最初那团纠缠在一起的想法更加清晰,也能减少后续合作中反复纠正方向的次数。
Altman 刚刚分享的另一个案例,也采用了类似的方式。
他从手机向 ChatGPT 发出了很长的指令:结合自己的所有聊天记录,为 9 个人策划一次长周末旅行。
这两个案例都展示出同一种变化:用户不再需要先把想法整理成结构清晰的指令,可以从一段闲聊开始,让模型逐步还原意图,并接手后续执行。
这个过程可以展现语音的价值,也带来一些思考:模型是在帮助人弄清自己的想法,还是正在承担越来越多原本属于人的思考工作?
输入电脑的内容,正在从严谨的命令扩展到闲聊、抱怨和其他意识流信息。
当「办公」混入「徒步」,当「闲聊」变成「工作」,新的交互和使用方式正在进一步模糊工作与生活的边界。
看完不知道该说是「adhd(注意缺陷多动障碍)福音」还是「adhd 量产工具」。
毕竟谁不想在徒步的同时来一场酣畅淋漓的工作呢?
热门跟贴