[开源自荐] HushSnap,一款把 OCR 当作一等公民的截图工具

HushSnap

围绕着OCR构建的截图软件,本地运行,UIUX经过打磨

按下 Alt+Q(可自定义),框选区域即可截图并复制到剪贴板,右下角弹出缩略图:

  • 左击 → 查看 OCR 识别结果(可编辑、排版清晰不挤字)
  • 左击按钮 → 编辑图片 / 钉在桌面
  • 拖拽 → 拖入任意窗口即可存图
  • 右键 → 更多功能菜单

横排中文识别

0

竖排日文识别

1

截图拖拽保存

2

内置编辑器

3

特性

  • 纯本地运行,不上传截图或识别内容
  • OCR 识别出的文字会整理成更易读的排版
  • 支持多屏混合分辨率
  • 免登录免注册,无依赖
  • 常驻托盘,空闲自动释放内存
  • 快捷键可自定义(右键托盘图标进入设置)

语言支持

简体中文 / 繁体中文 / 英文 / 日文(界面 + 识别,效果良好,中日文支持竖排识别);其他语言效果不保证。

开源

GPL-3.0,github.com/tcita/HushSnap

下载

Microsoft Store(或商店搜索 hushsnap

新版本feature:缩略图角花

【HushSnap,一款把 OCR 当作一等公民的截图工具。V1.5.0 更新:缩略图角花】

3 个赞

放 b 站视频时,请去除 URL 中的跟踪参数:

2 个赞

两个问题 第一个纯本地运行是如何保证ocr识别的准确率的呢

第二个问题 我记得钉钉企业微信应该带的截图都支持ocr了吧 你这个产品比他们的优势在哪里呢

Q: 纯本地运行如何保证 OCR 识别准确率?

A: 底层引擎是 PP-OCRv6 small + RapidOCR,具体指标可查阅 PPOCR 官方文档。本地小模型不等于精度必然打折——预处理策略、fallback 逻辑、DB 检测框稳定性处理、排版聚合算法、中日文横竖排判断等调参和实验细节,都在 GitHub 仓库里,欢迎交流。

Q: 相对于微信自带 OCR 的优势?

A: 抱歉可能没说清楚——这里对标的其实不是聊天软件

自带截图,而是 Snipping Tool / ShareX 这类无需联网、无需注册、纯本地运行的截图工具。不过你提到微信也确实是个现实场景:开机自启、常驻后台,很多人(包括我在内)图省事就顺手用了它自带的截图 OCR。但这背后有两层问题:一是需要联网登录,隐私不够透明,且截图 OCR 依附于整个微信客户端运行,资源占用不小;二是具体交互体验上也有打磨空间——比如截图后要先点一个会抢焦点的工具栏(很多专门的截图软件已经换成不打扰人的通知栏缩略图了),还得在工具栏里找到 OCR 按钮再点一下;识别出的文字也不支持直接编辑、没有排版容易挤成一团、也没法单独调整识别窗口的文字大小等等优化空间。这些正是 HushSnap 想做好的地方。"围绕着 OCR 构建"具体是什么体验,欢迎下载感受一下。

可惜了,只能通过微软商店下载。。

没有有处理过多屏多缩放比例环境下的截图问题 :grinning_face_with_smiling_eyes: ,比如有两个屏幕,一个缩放是100%,另一个缩放是150%

有做多屏适配,我自己有用双屏,主屏幕缩放是150%,副屏是175%,分辨率都是2560 × 1600,表现正常

假如有遇到其他多屏适配问题欢迎反馈,谢谢 :grinning_face: