分享一个能学习个人词库的本地听写工具
通用语音识别最让人崩溃的就是认不出专业术语,比如项目代号、库名或者同事的名字,每次识别完都要手动改半天。Mumble Dictation 解决这个问题的思路比较硬核:它在本地构建个人词典,通过学习用户的输入记录和屏幕内容,在解码阶段对这些“热词”进行权重提升。简单来说,像 Supabase 这种词,它能直接认出来,而不是给你个发音相近的错词。
价格是买断制,没有订阅制的焦虑。
这东西最关键的是全链路本地化,ASR(自动语音识别)和转写清理都在设备上跑,音频不传云端,对隐私要求高的人很友好。
几个实操层面的亮点:
- 自定义转写工作流:支持把识别后的文本直接转成精简模式、列表形式,或者通过自定义提示词进行处理。
- LLM 灵活切换:如果对自带的清理效果不满意,可以配置自己的 API Key(支持 OpenAI, Anthropic 或本地 Ollama)。
- 语音快捷指令:可以直接通过语音触发特定操作,比如直接跳转到某个页面并填充搜索词。
价格是买断制,没有订阅制的焦虑。
安装和下载路径:
https://heymumble.com/dictation演示视频:
https://youtu.be/Bma59TrR62c?si=DM-LyjZY5GZ9-f64 事件追踪 · 相关报道
GPU成本不只是算力中心的电费和硬件开销
2小时前
谷歌账号这次把人脸识别(Selfie)塞进登录流程了
10小时前
孩子把LLM当成“真人”这件事,其实比我们想象中要深刻得多。
11小时前
AI能跑多快,电网能撑多久?
11小时前
微软现在的产品逻辑就是把付费用户当成免费的Beta测试员。
12小时前
谷歌这次为了AI砸钱砸到现金流转负,这在财报里挺罕见的。
12小时前