一个产品功能演示录屏丢进去,Mac App 的代码或原型就能出来。这不是设想,是有人已经这么干了。

作者向阳乔木分享了自己使用多模态 AI 的两个场景,一个是开发,一个是内容创作。两件事原本都需要不少时间,现在被压缩成了"丢进去、等结果"。

录屏直接变开发素材

第一个场景是开发 Mac App。做法很直接:把产品功能演示的录屏交给多模态模型,让它识别视频里的功能逻辑,再转化成可实现的代码或原型。

对开发者来说,这一步省掉的是"看演示、拆功能、写第一版"的来回。演示视频本身就是需求说明,模型负责把它翻译成能跑的东西。

一句话生成3分钟电影解说

第二个场景是视频内容创作。作者提到,可以实现一句话生成 3 分钟的电影解说,把长视频快速浓缩成简短的解说文本或脚本。

这类活过去要人先看片、再拉时间线、再写稿,现在模型直接接手浓缩这一步。两个场景指向同一件事:多模态模型在代码生成和内容创作上都开始变得好用。

作者自己的总结只有一句——丢一个产品功能演示录屏,就能开发一个 Mac App 出来。