
OpenWhispr自定义词典完全指南教会模型准确转录专有名词与行业术语【免费下载链接】openwhisprVoice-to-text dictation app with local (Nvidia Parakeet/Whisper) and cloud models (BYOK). Privacy-first and available cross-platform.项目地址: https://gitcode.com/GitHub_Trending/op/openwhisprOpenWhispr 是一款隐私优先、跨平台的语音转文字Voice-to-text输入法支持本地模型Nvidia Parakeet / Whisper和云端模型BYOK 自带 API Key。它的自定义词典功能是教会转录模型准确识别公司名、人名、产品代号和行业术语的关键设置——只需把词语加入词典OpenWhispr 就会在每次语音转文字时把这些词喂给模型让 Kubernetes 不再变成 Kubernates让 Supabase 不再被听成两个普通单词。一、为什么需要自定义词典语音模型见过海量通用词汇但从没见过你公司的内部代号、团队里的昵称或小众技术名词。典型翻车场景 公司/产品名OpenWhispr、Qdrant被拆成拼错的普通词 人名John Snow被合并成一个陌生单词 行业术语ARR、SLA、AUC被按发音拼成别的词️ 内部代号项目北极星这类组合词完全无法预测自定义词典的作用就是在转写请求里追加一段提示词告诉模型接下来这段音频里大概率会出现这些词。模型有了预期命中率会显著提升。二、如何打开自定义词典页面打开 OpenWhispr 主面板在侧边导航中找到词典Dictionary入口。该视图的完整实现在 DictionaryView.tsx界面上包含以下核心功能功能说明添加单词输入框支持逗号分隔一次输入多个词批量导入粘贴大段文本按逗号或换行自动拆分编辑 / 删除单条修正拼写、移除错误词条清空词典一键重置不可撤销需谨慎导出词典将词条列表导出为文件方便备份片段Snippets与词典同页的第二个标签页见第五节输入框的官方占位示例就是最佳实践本身Add words separated by commas — OpenWhispr, Supabase, John Snow, ARR见 translation.json。三、批量导入最快配置方法如果你手里有一份几十上百个术语的名单比如从 Excel 或团队文档复制不要一个个手敲。点击导入单词按钮打开批量导入框粘贴文本——支持三种格式随便混用每行一个词英文逗号分隔两者混合界面会实时显示N words ready确认后点击导入导入解析逻辑在 dictionaryImport.js规则简单粗暴按逗号或换行切分去掉首尾空格过滤空行。另外系统会自动去重——重复词不区分大小写只保留一个你不用担心粘贴两份名单。四、词典如何影响转录模型重要机制这是新手最该理解的一点不同模型读取词典的方式不同列表不是越长越好。OpenWhispr 按模型类型自动适配词典预算规则集中在 dictionaryPromptCap.js模型类型词典上限特点Whisper 家族本地 whisper.cpp、whisper-1 等900 字符解码器只读取最后约 550 字符超长前段会被静默忽略Groq 云端890 字符超过 896 字符会被整个拒绝需留余量OpenAI gpt-4o-transcribe 系列8000 字符LLM 架构能读完超长词典gpt-transcribe独立机制词典不走提示词改以关键词字段逐条发送见 dictionaryKeywords.js实操建议✂️ 词典保持在550 字符以内所有模型通吃界面超过阈值会显示黄色提醒最关键的术语放在列表末尾——Whisper 解码器只保留长提示词的尾部 定期清理不用的词宁短勿长词条中避免、和换行符部分云端 API 会直接拒绝这类请求五、自动学习改一次记一辈子OpenWhispr 最省心的功能是自动学习Auto-learn当你在目标应用Word、浏览器、微信……里修正了某段转录文字correctionLearner.js 会对比原文与你的修改用编辑距离算法找出你替换掉的那个词并自动加入词典。举个例子你说出 Kubernates模型也转录成 Kubernates你在输入框里手动改成 KubernetesOpenWhispr 后台识别出这是一次词汇纠错而非内容改写静默把 Kubernetes 记入词典下次再听模型直接命中正确拼写同时它足够聪明把 为什么 改成 怎么办 这种内容级改写不会被学进去避免词典被日常用词污染correctionLearner.js 内置了常见词黑名单。也就是说你平时正常打字改错词典就在变强几乎零维护成本。六、片段Snippets说一个词输出一整句词典解决词怎么说片段解决词太长了懒得说。它与词典同处一个标签页实现见 SnippetsView.tsx设置触发词如 cal link和替换文本如你的完整日历链接、公司地址、常用签名说触发词输出完整文本片段触发词也会并入提示词一起发给模型因此片段越多同样要注意总长度。七、词典同步与备份云同步登录后手动添加的词条会通过 DictionaryService.ts 批量上传跨设备共享同一份词典本地导出点导出词典即可把当前词条保存为文件迁移电脑或团队共享时直接可用智能体名称自动占位你给 AI 助起的名字会自动作为词条无需手动添加八、常见问题速查Q加了词典还是不识别把该词移到列表末尾确认拼写与你发音最接近本地 Whisper 用户检查模型是否足够大small 及以上更好。Q词典可以放整句吗不建议。词典按词/短语生效超长句子会快速吃掉字符预算还会挤占模型读音频的上下文。Q中文词能加吗可以。中文场景下 OpenWhispr 还会额外附加约 21 个字符的中文书写偏向注意整体预算。Qgpt-4o 模型有 8000 字符上限能全堆满吗能读不代表好用——8000 字符的提示词会和音频争抢模型的上下文空间日常使用 500 字符左右的精选词表体验最佳。总结OpenWhispr 自定义词典的正确打开方式是——精选 30~50 个高频专有名词 打开自动学习 用片段处理长文本。三招配合几天之内你的转录准确率就会明显超过同事。【免费下载链接】openwhisprVoice-to-text dictation app with local (Nvidia Parakeet/Whisper) and cloud models (BYOK). Privacy-first and available cross-platform.项目地址: https://gitcode.com/GitHub_Trending/op/openwhispr创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考