
Buzz 离线语音转文字完整指南转写、字幕、翻译都能跑通【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz整理一期 40 分钟的播客我想给它配一版中文、一版英文字幕。素材是客户的口述我不想传到任何云端手动听写又来不及。后来我用了Buzz——一个把 Whisper 模型装进你电脑的语音转文字工具识别运算全在本机跑不联网、不收费转成文字、译成英文、导出字幕都能自己搞定。本地转写比云端多了什么先说清楚它和常见云端转写的差别这决定了值不值得为它花安装时间。Whisper 是 OpenAI 开源的语音识别模型Buzz 把它下载到你本地识别在你自己的硬件上完成。由此带来三个实打实的好处文件不出本机。客户访谈、未发布的播客原始音频全程不上传隐私不用再权衡。断网照样跑。飞机上、没网的工作室只要机器能动一整期就能转完。转写不限量。云端按分钟或按次计费Buzz 只消耗你的电转一整晚不产生费用。说白了Buzz 把选择权交还给你模型大小、识别后端、导出格式都能自己定而不是被锁死在某家 API 里。装好 Buzz四个平台各一条命令Buzz 支持 Mac、Windows、Linux也能用 Python 直接装。选一条你平台的命令跑通就行。Windows从项目发布页下载安装文件双击运行。安装包没做数字签名首次启动会弹提示点「更多信息 → 仍要运行」即可继续。macOSbrew install --cask buzz注意新版只支持 Apple SiliconIntel 的 Mac 停在 1.4.5。Linuxsudo snap install buzzPyPI先装好 ffmpeg再用 Python 3.12 环境安装pip install buzz-captions python -m buzz有 N 卡想开 GPU 加速的README 里有对应的 CUDA 安装步骤。把文件丢进队列三步跑完出第一份字幕任务表格里每个文件占一行模型、任务、状态一目了然打开后是一张清爽的任务表格我按这个顺序走导入。点工具栏「」或 File → Import Media File选本地音视频也可以粘贴 YouTube 链接。定任务和模型。任务选Transcribe保留原语言或Translate to English译成英文模型下拉里挑一个第一次用 tiny 或 base 最稳。点 Run。这一行的状态会走完「排队 → 处理中 → 完成」多文件自动排队依次跑。模型不用一开始就纠结按用途挑就行tiny / base → 出草稿首选最快small / medium → 日常主力快慢和准确率都均衡large → 准确率最高正式字幕再上模型偏好页能直接下载、切换不同大小和来源的 Whisper 模型还能贴自定义链接打开查看器边放边改字幕直接导出转写完双击任务行进入查看器这里补齐了「能交付」的最后一公里。每条文字带精确起止时间可边播放边校对每条文字都带起止时间底部播放器边放边对发现错字直接改自动保存。长稿找关键点按 CtrlF 打开搜索回车逐个跳到下一处不用从头拖进度条。改完点导出TXT、SRT、VTT 都能出字幕文件可直接拖进剪辑软件。播放控制里开「跟随音频」文字会跟着播放位置自动滚动翻长稿不用手动来回找。字幕断句太乱用 Resize 重新切分多数转写工具停在把话说对Resize专治字幕怎么排好看这是我做视频最看重的一点。做法在查看器点 Resize设一个目标长度过长的字幕会被自动拆成多条。它的拆分 / 合并选项很实用按标点拆 → 在句号、逗号处断开断句更贴阅读习惯按最大长度拆 → 配合字符上限保证单条不超一行按间隙合并 → 音频停顿超过设定值时把相邻短句并成一条前提是转写时勾了Word-Level Timings词级时间戳即每个字带独立时间点。开了它Resize 还会分析音频里的静音段来优化每条字幕边界。更多选项见官方文档。实时录音、文件夹监控与任意语言翻译Buzz 还能把「转写」这件重复的事自动化我常用下面两种。实时录音转写接上麦克风选语言和质量点 Record你说话的同时文字实时上屏还带一个适合投屏的大字窗口。直播、录访谈时人还没说完稿子已在出来。实时模式比较吃资源优先 Whisper.cpp 后端加小模型。文件夹监控在偏好里指定一个目录之后丢进去的任何新音频都会自动转。团队协作、每周批量整理时这条基本就是全自动流水线。偏好里可配置监控目录、导出格式与翻译设置命令行党还能用 CLI 把整批文件脚本化一条命令把整个文件夹转成 SRT 放进指定目录buzz add --srt --output-directory ./subtitles recordings/*.mp4完整参数见CLI 文档。翻译走的是另一条路接一个 OpenAI 兼容 API把文字稿翻成任意语言而这个 API 也能指向本地跑的 Ollama 或 LM Studio翻译同样不离开机器。设置里填好 Base URL 和 Key写一句「把英文逐句翻成西班牙文、不加注释」的指令就能批量跑。多人录音还能在查看器点「Identify speakers」Buzz 会自动给每个说话人打标签可试听 10 秒再改成真名实现见说话人识别源码。现在动手导入、选模型、点 Run装好 Buzz打开它把第一份音频导进去任务选 Transcribe点 Run。几分钟后同目录会多出第一份 SRT 字幕——离线转写这件事从这一刻起不用再求人。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考