十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz 离线语音转文字:免费完成本地音频转录的完整指南

Buzz 离线语音转文字:免费完成本地音频转录的完整指南 Buzz 离线语音转文字免费完成本地音频转录的完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz有一段 90 分钟的客户访谈录音要整理按分钟计费的云端服务报价不低而音频里的内容又不太方便上传到别人服务器。Buzz 就是为这种情况做的它调用 Whisper 语音模型在本地完成识别和翻译音频全程不出本机MIT 协议开源免费覆盖 99 种语言适合经常整理会议、访谈和讲座录音的人。从安装到第一条转录 按系统选一条安装路径macOS下载 .dmg 后拖入应用程序文件夹。Windows安装包未签名提示时选更多信息→仍要运行。Linux从 Flathub 装 Flatpak 包或用 Snap 安装。Python 用户需要 Python 3.12 并提前装好 ffmpeg。pip install buzz-captions python -m buzzflatpak install flathub io.github.chidiwilliams.Buzz跑通第一次转录菜单文件 → 导入媒体文件Ctrl/CmdO或直接把文件拖进窗口。选择任务Transcribe 或翻译为英文、语言和模型。点 Run状态变为 Completed 后双击该行打开查看器。在查看器里导出 TXT、SRT 或 VTT。两种典型工作流 会议与演讲的实时字幕选好录音任务、语言和麦克风后点 Record文字随讲话实时滚动投屏场景可打开 Presentation window大字号适合会议和讲座。录音模式有两种实时模式边说边出文字追加校正模式先追加再统一修正转录步长越短延迟越低、系统负载越高。要录电脑播放的声音先装一个虚拟声卡macOS 用 BlackHoleWindows 用 VB CABLE再把虚拟设备选为输入源。多人对话与字幕整理转录完成后在查看器点Identify speakers自动给每位说话人打标签试听 10 秒样例确认后可改成真名保存时还能把同一人的连续句子合并成段。做字幕时点 Resize开启词级时间戳的任务可以按标点断行、限定每行字数、按静音间隔拆合句子还能统一延长每行字幕的显示时长。模型选择与调参建议 ⚙️按硬件选模型和后端Tiny / Base / Small速度快适合低配机器和实时转录。Medium速度与准确度的平衡点。Large-V3多数语言准确率最高偶有编造词现象Turbo 版是两者的折中。后端上Whisper.cpp 兼容任意 GPU 和纯 CPU无独显或 Mac 优先选它NVIDIA 显卡显存 6GB 以上时改用Faster Whisper速度提升明显。四个提高准确率的设置手动指定语言比自动检测更稳把专有名词写进Initial prompt能减少拼写错误嘈杂音频勾选Extract speech先分离人声再识别录音场景调高静音阈值低于阈值的片段直接跳过。批量处理与自动化 ⚡在偏好中设置监视文件夹放入的新音频会自动排队转录启用Skip Already Transcribed插件后重复导入的文件会自动跳过。1.4.5 起内置插件系统可开启 AI 摘要兼容 Ollama 等本地接口、DOCX 导出、DeepFilterNet 降噪、语言自动检测说明见 插件文档。脚本化场景直接用 CLI一条命令完成转录并导出 SRTbuzz add --task transcribe --model-type whispercpp --model-size small --srt audio.mp3和云端转录怎么选 维度Buzz 本地云端服务隐私音频不出本机需上传到对方服务器网络完全离线可用依赖稳定网络费用免费多按分钟或字数计费速度取决于本机硬件取决于服务器负载自定义模型、后端、插件均可更换可选项有限敏感内容和大批量文件用 Buzz 更稳妥偶尔处理一两个小文件、又不想装环境时云端更省事。Buzz 也支持 OpenAI API 后端需要时可以把个别任务交给远端跑。常见问题 ❓模型存在哪Linux 在~/.cache/BuzzmacOS 在~/Library/Caches/BuzzWindows 在%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache也可在 帮助 → 偏好 → 模型 里点 Show file location 直接打开。完全无网的机器能用吗能。先在联网机器下载好模型把模型文件夹拷到相同路径或用 scripts/download-models.py 预下载。老电脑跑不动CPU 需支持 AVX2速度太慢就换更小的模型显存够 6GB 时换 Faster Whisper。报 PaErrorCode-9999多为麦克风权限问题到系统隐私设置中给 Buzz 授权更多条目见 FAQ。现在就开始 按系统选一条安装命令装好并启动 Buzz。拖入一段音频用 tiny 模型把第一条转录跑通。按硬件换模型配置文件夹监视进入批量处理。从跑通第一个文件开始把每段录音变成可搜索的文字。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表