我写很多文档,内容大多是截图。我试过的每一个工具都要求注册账号,把我的截图上传到别人的存储桶,然后还要付费才能把结果导出成链接以外的任何格式。所以我自己做了 Lens,一个 Chrome 和 Edge 扩展(Manifest V3,Chrome 137+),整个工作都在浏览器里完成。

没有账号,没有服务器,没有上传。所有功能都免费可用。付费许可只去掉三样东西——偶尔出现的提醒、一个 Ko-fi 链接,以及保存图片上的水印,仅此而已。

打开网易新闻 查看精彩图片

三个快捷键,可以在 chrome://extensions/shortcuts 里重新绑定:

区域选择框可以拖动,尺寸读数按 Retina 精度显示,所以你量出来是 800x600,存下来就是 800x600。

画笔、文字、方框、圆形、箭头和模糊,另外还有裁剪、颜色调整、旋转,以及一个精确到像素的缩放,文件名和备注就摆在旁边。

标注保持可编辑,而不是直接画进像素里。你可以移动一个标记,重新输入标签,删掉中间那一个,撤销任何一步。在你按下保存之前,什么都不会写到磁盘上。

模糊是例外,因为模糊本身就是在重写像素。这是刻意的,而这一点直接关系到下一个功能。

在截图保存之前,Lens 会读取选区下方的 DOM,标出密码、API 密钥、token、JWT、私钥、邮箱地址,以及通过 Luhn 校验的卡号。规则就是普通的 DOM 规则。没有模型,没有网络请求。

它会提示把发现的东西模糊掉,但永远不会替你模糊。因为模糊是破坏性的,所以这一步必须由你亲手点。

用 ⌘⇧E 录制一段操作流程,每一次点击都会变成一个步骤:点击瞬间截一张图,裁剪到你点的那个控件,加上外框和编号。背后没有视频,也没有时长限制。

步骤文字来自屏幕阅读器会为该控件播报的无障碍名称,所以“点击保存更改”是从按钮自己的标签生成的,不是让大模型猜出来的。整个指南捕获过程不涉及 AI。

指南会在独立标签页里以文档形式打开。格式化之下是 Markdown,如果你更想打字而不是点鼠标,一个开关就能切进去。你可以重排步骤、改标题、把一个动画步骤拆回成单次点击,替换或重新编辑任何一张截图。

导入功能支持从文件或链接还原一个打包。导入是复制,磁盘上已有的东西不会被覆盖。还有一个“在磁盘上查找指南”的扫描,会列出那些文件夹还在、但元数据条目已经丢失的指南——这是用来修复丢失的 project_metadata.json 的办法。

一个项目保有自己的截图和指南,所以完全不关联文件夹也能用。关联文件夹之后,每张截图还会通过 File System Access API 写进去,旁边放一个 project_metadata.json 记录时间线。

这里有个挺有意思的失败场景:文件夹授权。Chrome 会在扩展没有任何东西运行时收回这个权限,以前这意味着早上关联的文件夹,午饭前就得重新连一次。现在授权失效只代表磁盘上的副本落后了。截图照常保存,待写入的操作被记下来,等文件夹重新可达时再刷进去——要么你重新连接,要么你重开浏览器。项目卡片会告诉你还有多少写入在排队。

把一个文件夹关联到一个已经跑了几个月的项目,Lens 会提议把整段历史复制过去,先告诉你涉及多少文件和多少磁盘空间,然后跳过文件夹里已经有的文件。

有一个可选的助手。你可以配置任意多个模型,包括浏览器内置的那个、跑在自己机器上的模型、Claude、Gemini、OpenAI 或任何兼容端点,并且可以逐条消息切换。每个模型只有在通过一次真正连通的测试之后才能使用。

助手只发送你附加到消息里的内容,别的什么都不发。密钥存在独立的存储键里,由 service worker 读取,绝不交给与页面共享进程的 content script。

所有这些在你打开它之前都是关闭的,而且每一段 AI 写出的文字背后都有一个非 AI 的兜底方案。

Lens 由 Vectored 发布在 Chrome Web Store 上。Edge Add-ons 上是同一个包。

当前版本是 1.22.0。如果你靠截图为生,我想知道你的工作流里还有哪一部分它没有覆盖到。