
零门槛实测TMSpeechWindows离线语音转文字工具5分钟上手会议实时字幕【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech今天这篇是我的 Windows 离线语音转文字工具 TMSpeech 亲测记录——从下载解压到把一场线上会议变成可复制的文字稿全程没有任何代码。如果你也开小差被抓过包往下看。一个开小差救回我的下午周二下午的周会我盯着窗外发呆突然被点名这部分你来补充下那一瞬间之前聊了什么脑子里一片空白。会后同事推给我一个叫 TMSpeech 的开源小工具——它的中文名梗很直白腾讯会议摸鱼工具。原理说穿了不复杂它用 WASAPI 回环捕获电脑正在播放的所有声音哪怕系统音量静音也能抓到再把语音实时转成字幕浮在屏幕上。下一次再走神扫一眼字幕就全补回来了。开箱初体验比想象中更轻没有安装向导、没有注册登录解压 release 包直接双击TMSpeech.exe就启动。主界面是一条细长的浅蓝字幕条右上角几个按钮红色圆点控制开始/停止旁边是录音计时还有历史记录、隐私锁和设置齿轮。第一次上手只需要记住四步双击TMSpeech.exe启动程序点齿轮进设置把音频源选为系统音频在资源页点一下安装中文语言模型一次性下载之后全程离线回主界面按红色圆点开始识别能力逐个过我替你验证了四件事验证一系统静音了字幕照样出我想验证的是完全关闭电脑声音也能用。做法把系统音量拉到 0播放一段网课。结果字幕一行行正常跳出来。因为它抓的是声卡内部数据不经过扬声器所以聋子听哑巴的问题不存在。验证二拔网线也能识别装上中文模型后我直接断网测试。识别照常运行声音数据一步都没有离开本机。在 AMD 5800u 的笔记本上CPU 占用不到 5%边开视频会议边挂着几乎感觉不到它的存在。验证三三种识别引擎随意换在语音识别设置里可以切换命令行识别器、Sherpa-Ncnn 离线识别器可调 GPU和 Sherpa-Onnx 离线识别器纯 CPU 优化。普通用户选 Onnx 最省心爱折腾的可以选命令行识别器仓库的external_recognizer/目录里就带了基于 SenseVoice 的 Python 示例脚本一行配置即可接入自己的识别流程。验证四会议刚结束纪要初稿已在手边识别完成的每句话都会自动写入我的文档/TMSpeechLogs按日期归档成文件点时钟图标打开历史窗口右键即可复制任意一段。会开完把记录整理一下就是一份像样的纪要。模型方面资源页提供了中文、英文、中英双语三种模型中英双语适合跟读外文视频的场合点一下安装就能用。调优与避坑我的踩坑清单抓不到系统声音确认设置里音频源选的是系统音频而非麦克风个别电脑需要先到 Windows 声音设置里允许应用访问录音设备。识别不太准换引擎或换模型往往比调参数更有效模型路径可以在识别器配置里手动指定嘈杂环境和口音影响最大。命令行识别器路径带空格用双引号包住整个路径用.bat脚本时开头加隐藏回显结尾别写pause否则程序无法判断进程退出。CPU 偏高切到 Sherpa-Onnx CPU 引擎再配轻量模型日常负载立刻降下来。日志找不到检查我的文档/TMSpeechLogs目录是否存在、是否有写入权限必要时以管理员身份运行。配置改乱了跑一下仓库自带的重置配置脚本秒回出厂状态不用重装。适合谁 现在就去试试如果你属于下面任何一类都值得花五分钟试一次天天开会想要留底稿的职场人上网课、看技术视频恨不得把每一句话都记下来的学生担心隐私、不想把对话上传云端的人以及想折腾插件的开发者——项目是插件化架构核心接口都在src/TMSpeech.Core/Plugins/下加音频源、换识别器都不动主程序。想直接用下载 release 解压即跑想看看代码一行命令就能拿到全部源码git clone https://gitcode.com/gh_mirrors/tm/TMSpeech下一次会议走神的时候让字幕帮你兜底。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考