十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz 完整指南:从音频到字幕的 5 步操作,免费离线转录你的录音

Buzz 完整指南:从音频到字幕的 5 步操作,免费离线转录你的录音 Buzz 完整指南从音频到字幕的 5 步操作免费离线转录你的录音【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz我最近用 Buzz 整理会议录音和课程视频它在本地运行 OpenAI 的 Whisper 模型离线完成转录与翻译直接导出 TXT、SRT、VTT音频文件全程不离开你的电脑。本文按安装 → 跑通第一个任务 → 深挖功能 → 两个工作流的顺序带你把这套免费工具用到实处。一句话定位本地离线转录替代云端 API 大多数在线转录服务要把音频上传到别人的服务器按分钟计费断网就停摆。Buzz 把整条流水线放进你自己的电脑免费、离线、支持中文在内的数十种语言还能在 Whisper.cpp、Faster Whisper、Hugging Face 模型库等多个后端之间切换。如果手头已有 OpenAI 兼容 API也可以把它作为其中一个后端接入本地和云端并存。安装与准备三种平台的最短路径普通用户预编译版macOS下载 .dmg 安装Windows安装包未签名安装时若弹出警告选 More info → Run anyway 即可Linuxflatpak install flathub io.github.chidiwilliams.Buzz开发者PyPI 源安装需要 Python 3.12 环境并先装好 ffmpegpip install buzz-captions python -m buzzLinux 从 PyPI 安装时可能缺少系统依赖发行版文档里给出了对应的 apt 依赖清单照装一遍即可。第一次上手4 步从音频文件到文字稿顶部菜单选择 Import Media File或按 Ctrl/Cmd O选中一个音频或视频文件在导入表单里选择任务Transcribe 转录 / Translate to English 翻译手动勾选源语言选好后端和模型大小点 Run任务队列显示 Completed 后双击该行打开转录查看器播放音频逐句核对最后导出 TXT、SRT 或 VTT。主界面的任务队列一眼可见每个文件的模型与状态可以同时导入多个文件排队处理。第一次运行会下载模型文件建议首跑用 tiny 或 base几分钟内就能走通全流程。核心能力深挖 ⚙️1. 多后端按硬件选方案Buzz 封装了 5 种后端代码都在 buzz/transcriber/ 目录下OpenAI Whisper、Whisper.cpp、Faster Whisper、Hugging Face 模型库、OpenAI 兼容 API。Nvidia 显卡走 CUDA 加速Mac 有 Apple Silicon 支持Whisper.cpp 还支持 Vulkan集显也能加速。8GB 内存的机器选 Whisper.cpp small 比较稳有独显则优先 Faster Whisper。2. 实时录音转录选好语言、质量和麦克风点 Record 就开始实时出字。文字累积有三种模式追加在下方、追加在上方以及精度更高但更吃算力的追加并纠错。录音界面还能打开独立的 Presentation Window把实时文字投到大屏适合现场活动和直播字幕。Buzz 也可以把实时转录持续写入 txt 文件供 OBS 等软件消费配置项见 docs/docs/preferences.md 的 Live transcript exports 一节。3. 转录查看器改稿、说话人识别、字幕重排双击任务进入查看器后可以直接改文字、拖动调整时间戳。开启说话人识别后Intel 版 macOS 不支持Buzz 会把每句话标注到对应说话人你可以把自动标签改成本人姓名并勾选合并同一说话人的连续句段——访谈录音里谁说了什么一步到位。点 Resize 按钮还能对字幕重新切分转录时勾选了 word-level timings 的话可按每行最大长度合并、按标点断句、给每条字幕延长展示时间这是 SRT 字幕交付前的最后一步。4. 插件系统1.4.5 起在菜单 Help → Plugins 里可以启用/停用、拖拽排序和配置插件还能用 Add by URL 添加社区插件。内置 6 个日常最常用DeepFilterNet 降噪转录前先用模型去背景噪音嘈杂录音受益最大AI Summary用 OpenAI 兼容 API 给全文生成摘要存入备注或相邻 txtSkip Already Transcribed已出过结果的导入文件直接跳过重复导入文件夹时不重复跑模型Export to DOCX把结果导出成 Word可选带时间戳。插件源码结构见 buzz/plugins/也可以照葫芦画瓢自己写。进阶用法两个角色场景 内容创作者每周批量出字幕导入视频 → 勾选 word-level timings用 small 模型转录 → 查看器里 Resize 按标点切成 8~15 字的行 → 导出 SRT 导入剪辑软件。把 Resize Transcript 插件打开后字幕重排这步在转录完成时自动执行人只负责最后核对。研究者访谈录音批处理把几十个访谈文件放进同一个目录 → 在偏好设置的 Watch Folder 中指向该目录新文件放入即自动转录 → 开启 Skip Already Transcribed 防止重跑 → 用 large 模型保术语准确率 → 完成后再做说话人识别并标注姓名。一批录音过夜就能跑完不需要人值守。常见坑与选型建议 ⚠️自动语言检测翻车语言已知时一定手动勾选自动检测靠前几秒音频判断混合语境下经常选错实时录音卡顿、队列堆积换 Whisper.cpp 后端 base/small 模型并调大 Advanced 里的 transcription step显存不够跑大模型在 OpenAI API 设置里开 Reduce GPU RAM对 HF/Faster Whisper/Whisper.cpp 用 8bit 量化或降级模型Windows 安装报未签名属正常现象More info → Run anyway 继续模型反复下载或想换盘存放在设置Ctrl/Cmd ,的 Models 页提前下载好各尺寸模型或用 BUZZ_MODEL_ROOT 环境变量把模型目录指到目标磁盘。模型大小参考tiny/base 快速初稿small 是实时录音的甜点medium/large 留给术语和准确率敏感的场合。Buzz 把录音—转录—校对—导出整条链路从云端搬回你自己的电脑文件导入到字幕成品一站式完成。如果你手上有不方便上传的音频或者不想再按分钟付费今天花十分钟装一个丢一段一分钟的录音试试全流程跑通之后基本就离不开它了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表