软件名称:Saymore
应用平台:Windows 10 / 11(x64)
推荐类型:【开发者自荐】
一句简介:离线运行的中文语音输入,说完自动去掉口头禅、整理成书面语或邮件,免费开源。
应用简介:
我平时给 AI 编程助手描述需求、回工作消息都要打很多字,试过几个语音输入:在线的识别准, 但录音要上传;离线的大多只转文字,一段话里的“嗯、那个、就是说”和说到一半的改口都原样 留着,还得回头手改。所以自己做了 Saymore,想解决的就是“说完就能直接用”。
用起来是这样:Saymore 常驻托盘,把光标放进任意输入框(微信、浏览器、Word、VS Code 都行), 说唤醒词“小咪”(可以改成别的)开始录音。说的话先进一个暂存小窗,停下来后自动整理, 满意了说“发送”,文字就填进输入框;想改可以双击暂存窗手动修改,说“回退”删上一句。 全程不用按快捷键。
整理有四种方式,在暂存窗右键切换:
- 轻度整理:只去口头禅和重复词、补标点、改错字,保留你自己的说话习惯;
- 深度整理:把口语改写成书面表达,适合写文档;
- 邮件:按称呼、正文、结尾整理成一封邮件草稿;
- 00 后:换成轻松的网络聊天语气,好玩为主。
识别用的是 Qwen3-ASR 1.7B 的 4bit 量化版,整理用同一个模型加我自己训练的 LoRA,两者都在本机 运行,录音和文字不离开电脑。另外可以自己填一份专业术语表,程序也会从常用的历史输入和当前窗口 里提取词汇,人名、产品名、行业词会越用越准。
硬件方面,普通 CPU 就能跑:一句话识别约 1–2 秒,一整段整理约 5 秒;有 4GB 显存、支持 Vulkan 的独显时,识别约 0.5 秒、整理约 2 秒。
需要提前说明的几点:
- 首次启动要联网下载约 1.5GB 的识别模型,程序会自动在 HuggingFace 和 ModelScope 之间选能连上 的源,国内不用额外设置;下载完成后不再需要联网。
- 安装包没有代码签名,Windows Defender 或 360 可能拦截,需要手动允许。代码完全开源,可以自行审查 或从源码运行。
- 目前只有 Windows 版;自动整理出的正式邮件,发送前建议再看一眼。
官方网站: