行车记录仪录了一整天的视频,几十个文件堆在硬盘里,突然想找回某个画面,比如那辆闯红灯的黄色卡车。

通常你只能打开播放器,拖进度条,一帧一帧地翻。翻到眼睛发酸,翻到怀疑人生,最后可能还是没找到。

这是因为视频不像文字,你没法按 Ctrl+F 搜索。一段三小时的录像,想找其中三十秒的画面,跟大海捞针没区别。

今天介绍一个超好用的AI视频搜索引擎sentrysearch,用自然语言可以在几秒内就能从一大堆视频素材中,精准找到你想要的片段。

打开网易新闻 查看精彩图片

开源地址:https://github.com/ssrajadh/sentrysearch

其实SentrySearch 的核心思路非常巧妙,先把你的视频切成一小段一小段,默认每段三十秒,段与段之间还有五秒的重叠,防止刚好卡在边界上的事件被漏掉。

然后把每一小段视频丢给一个多模态大模型,让它把画面内容转化成一串数字向量。你可以把这些向量想象成每段视频的指纹,画面内容越相似的视频,指纹就越接近。

这些指纹全部存进一个本地的向量数据库里。等你想搜索的时候,你输入的那句话也会被转化成同一空间里的向量。

然后系统拿这个向量和所有视频指纹做比对,找出最相似的那几段。找到之后自动裁剪,直接给你输出一个短视频文件。

整个过程没有语音转文字,没有逐帧截图打标签,就是视频和文字在同一个数学空间里直接比较。这也是为什么这个工具能做到又快又准。

用自然语言搜索视频

你不需要记住文件名,不需要记住大概几点几分,甚至不需要描述得特别精确。你直接说,有个人从车后面横穿马路,AI就能理解你在找什么,然后把最匹配的片段给你裁剪出来。

打开网易新闻 查看精彩图片

搜索结果还会按照相似度打分排序,最高分的那个就是最可能的答案。如果最高分低于一个置信阈值,系统会先问你一句要不要继续,不会闷头就给你剪一个不相关的片段。

用图片搜索视频

这个功能特别实用。假设你手里有一张截图,比如某辆车的照片,或者从别的视频里截的一帧画面,你想在自己所有的录像里找到类似的场景。直接拿这张图去搜就行。

打开网易新闻 查看精彩图片

系统会把图片也转化成向量,然后和视频片段做匹配。虽然不能说百分百找到同一辆车,但找到视觉上非常相似的片段是完全没问题的。

对于那些用文字很难描述清楚的画面,图片搜索真的是救星。

自动发现异常片段

有时候你其实不知道该搜什么。比如你刚下载了一堆行车记录仪的视频,想看看有没有什么值得注意的事情,但你又不可能全部看完。

这时候用 highlights 命令就行。系统会自动分析所有视频片段的向量分布,找出那些和其他片段差异最大的,也就是最异常的片段,然后自动裁剪出来给你。

这就像是你请了一个不知疲倦的助手,帮你把几百个小时的录像里最不对劲的那几段挑出来。当然,统计上的异常不一定有用,但配合去重和过滤选项,效果还是相当不错的。

完全本地运行

如果你不想用云端接口,或者你对隐私比较敏感,SentrySearch 也提供了纯本地方案。

基于 Qwen3-VL 模型,所有计算都在你自己的电脑上完成,不需要任何接口密钥,不需要联网,数据也不会离开你的硬盘。

打开网易新闻 查看精彩图片

系统会自动检测你的硬件配置,选择合适的模型大小。如果你有苹果芯片的 Mac 且内存够大,或者有一块显存充足的英伟达显卡,可以直接跑八亿参数的大模型,效果接近云端方案。

如果硬件一般,也有两亿参数的小模型兜底。

我觉得这个开源对于车主或有很多视频素材的自媒体博主来说挺有用的,不用你辛苦切片来简历索引目录了,直接让AI把你快速搜索可以节省大量时间。

AI 实操交流群找一群同路小伙伴一起进步

企业、高校及渠道合作

打开网易新闻 查看精彩图片