5分钟的语音指令,换来12小时的自主工作。Donald用Claude Opus 5.5做了一支音乐视频《Claude Pop》,整个过程他只负责开口,剩下的全交给模型。
据AI Will(@FinanceYF5)分享的案例,Donald输入语音Prompt后,Claude Opus 5.5自主完成了角色设定、场景构建、动画制作以及歌词动效等全套流程,累计耗时12小时,全程没有人工干预。
它到底自己做了哪些事
拆开来看,这支MV的生产链条被模型完整包揽:
- 角色设定:确定出镜形象
- 场景构建:搭出画面环境
- 动画制作:让画面动起来
- 歌词动效:把歌词和节奏对上
这四步原本分属不同工种,现在由同一个模型在一条时间线上连续跑完。输入端的成本被压到极低——5分钟说话,输出端是一支成片。
12小时背后是长程任务能力
这个案例真正值得注意的地方,是模型在长时间跨度内保持了目标一致性。它没有跑着跑着忘了要做什么,而是把复杂的创意任务自主分解,再一步步执行下去。
长程自主代理(Agent)能力因此被拿出来讨论:当模型能连续工作12小时不掉线,人在这条链路里的位置就往后挪了一格——从执行者变成下指令的人。
热门跟贴