本地视频语义检索工具 VideoSeek:以图搜视频、文本搜视频、硬字幕检索与本地索引
直接安装:https://www.lv17.top/ · GitHub:https://github.com/6v17/VideoSeek · 图文教程:教程
它是什么
VideoSeek 是一款 Windows 为主 的本地桌面应用:把电脑里视频做成可检索的素材库,用 文字描述 或 截图 / 参考图 找到相似画面的时间点,预览后导出片段。
- 索引与检索在本机完成(ONNX + Lance + FFmpeg 等),不上传你的视频文件
- 永久免费、开源(AGPL-3.0)
- 安装包用户与源码用户共用同一套 UI
适合:素材很多、记不清文件名、剪辑前要粗定位的人。
核心能力(当前)
画面检索(主路径)
| 能力 | 说明 |
|---|---|
| 本地视频库 | 添加文件夹;勾选后 同步选中视频(抽帧 + 向量化) |
| 文字搜索 | 用中文/英文描述看得见的画面(人物、动作、场景) |
| 图片 / 截图搜索 | 参考图或裁剪截图找类似镜头(含定位、精搜等选项) |
| 搜索范围 | 全库、指定库、指定视频;可保存搜索预设 |
| frame / chunk | 按帧命中,或按语义 chunk 聚合 |
| 预览与导出 | 时间轴预览,导出 MP4 片段 |
硬字幕检索(可选)
- 独立 字幕库(与 CLIP 画面库拆分,不互相绑架)
- 对片中硬字幕做 OCR,再按关键词搜时间点
- 支持精确 / 模糊匹配,结果可高亮对照原文
- 需要时另导入 OCR 资源包;不做字幕可只用画面检索
其它可选
- 视频理解:按 chunk 生成画面描述与整片总结(需配置描述服务)
- 本机 Agent API:
127.0.0.1HTTP,供 Cursor 等调用搜索 / 读库 / 导出(见仓库docs/for-agents.md) - 手机局域网搜索:与桌面能力对齐的一部分能力(含图搜、字幕等)
最小上手步骤
-
导入运行资源
首次若提示未就绪:在应用内打开导入入口,准备好 画面模型 zip(三选一)、ffmpeg.exe;要做字幕再加 OCR 包。
可从应用内「前往下载」、 GitHub Releases — models 获取,再 拖入并「导入并解析」。
资源文件事先在本地时,可以离线完成导入——「不用配 Python」和「模型是否已下载到本机」是两件事。 -
添加视频库
侧边栏 视频库 → 视频库 Tab → 添加本地文件夹。 -
同步选中视频
勾选要处理的文件 → 同步选中视频,等待抽帧与向量化(长视频会久一些,属正常)。 -
搜索
侧边栏 搜索 → 文搜或图搜;需要台词则走 字幕库 提取后再搜字幕 Tab。
更细的图文说明见:使用教程。
画面模型怎么选(三选一)
| 模型 | 更适合 | 备注 |
|---|---|---|
| Chinese-CLIP | 主要用中文搜画面 | 多数中文用户优先 |
| SigLIP2 | 要更高细节、多语言 | 体积更大、更吃配置 |
| OpenAI CLIP | 机器偏弱、英文为主 | 中文文搜相对弱 |
换模型后,该模型下的库需要重新同步才能按新空间搜索。
关于安装包体积与「首次联网」——对齐常见误解
早期为控制安装包体积,采用了 安装程序与运行资源分离(模型、FFmpeg 等不全部打进 exe)。这一点现在依然如此。
容易过时的说法是:
「第一次打开只能点软件里的下载按钮在线拉模型,断网就无法初始化。」
更准确的说法是:
- 软件不要求你先装 Python、自己配环境;
- 但必须有一份可用的运行资源(模型 + FFmpeg 等);
- 获取方式可以是:应用引导下载,或你自行下载 zip / exe 后 导入;
- 文件已在本地时,导入过程可以离线。
国内直连大文件若不稳定:用网盘 / GitHub Releases 下好再导入即可.
杀毒软件对自打包、未签名安装包的启发式误报也较常见,以GitHub发布渠道为准。
合理预期
- 建索引耗时和占用主要跟「视频总时长 × 抽帧密度 × 向量维度」有关,不是跟「源文件占多少 TB」简单成正比。大库请分库、必要时降低抽帧密度。
- 这是单机桌面工具,不是分布式媒资系统。
- 文搜尽量写具体画面,少写抽象剧情句。
许可证与获取
软件免费开源:
-
许可证:AGPL-3.0