十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz本地转录:Whisper离线跑的3个场景

Buzz本地转录:Whisper离线跑的3个场景 Buzz本地转录Whisper离线跑的3个场景【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz已经把会议录音转写完毕带时间戳的文件正静静躺在桌面。它直接在你的个人电脑上运行OpenAI Whisper模型音频不离开机器断网状态下Buzz的本地转录与翻译照常工作。Buzz是什么离线音频转录与翻译工具Buzz要解决的问题只有一个云端转录服务带来的隐私风险与网络依赖。它把Whisper语音识别模型完整搬到本地转录、翻译全程离线完成。与同类工具相比它的差异在于既有图形界面也有命令行覆盖从单文件到批量监听的完整链路。它最核心的能力音频视频文件离线转录麦克风实时录音转录99种语言识别与翻译TXT/SRT/VTT多格式导出文件夹监控自动处理装好之后第一件事是跑通一条最小流程导入文件、选模型、出结果。安装Buzz并完成第一次转录macOS下用安装包装Buzz到项目发布页下载.dmg文件拖入应用程序文件夹即可。Windows下用安装程序装Buzz下载.exe安装文件并运行。程序未签名首次安装会弹出警告选择“更多信息”→“仍要运行”。Linux下用Flatpak或Snap装Buzzflatpak install flathub io.github.chidiwilliams.BuzzPython源码方式安装Buzz先安装ffmpeg然后pip install buzz-captions python -m buzz安装完成后启动Buzz按Ctrl/Cmd O导入一段音频语言选“自动检测”、模型选 tiny点 Run。状态变成 Completed 后双击该行就能看到你的第一份逐字稿。整个闭环不超过5分钟。跑通基本流程后再看三个真实使用场景。批量转写已有的会议录音手头有一整周的访谈录音要出稿时批量导入是最快路径。Ctrl/Cmd O选入多个音频或视频文件逐个设置任务转录/翻译为英文、语言、模型点 Run任务自动排队执行完成后双击任务行打开转录结果技巧专有名词容易被转错。点“高级”按钮在初始提示里列出人名、术语如“心肌梗死、心电图”识别准确率会明显提升。完整的语言与模型选项定义在 buzz/transcriber/transcriber.py。用麦克风实时转写一场会议讲座、访谈进行中就需要文字时开启录音转录。切换到“录音转录”页面选择任务、语言与麦克风设备点红色 Record 开始随时可暂停或停止结束后双击任务行查看完整逐字稿注意默认Whisper模型计算量大实时场景建议换用 Whisper.cpp 后端加小模型延迟会更低。做现场演讲时还能打开演示窗口把实时字幕投到大屏上。修正文字并一键导出字幕机器转写总有错字Buzz的查看器把修改成本压到最低。双击转录记录打开查看器直接编辑文字、拖动调整时间戳点 Resize 把词级时间戳合并成字幕行导出为 TXT、SRT 或 VTT技巧转录时勾选“词级时间戳”后续合并字幕时可按静音间隔重新断句效果远好于按固定字数切分。如果你要处理上百个文件界面操作就不够用了直接上命令行。用命令行和文件夹监控批量自动化CLI适合脚本化场景一条命令完成转录与导出buzz add --model-size small --srt meeting.mp3所有参数说明见 docs/cli.md。更省事的是文件夹监控在首选项里配置监控目录后新音频落盘即自动转录由 buzz/widgets/transcription_task_folder_watcher.py 实现。注意重复导入同一批文件时可启用 Skip Already Transcribed 插件见 buzz/plugins/已出结果的会被直接跳过不重复消耗算力。流程跑顺了再花30秒看懂它内部在做什么。原理速览一段音频如何变成文字Buzz像一个听写间音频先经 ffmpeg 解码采样进入“听写台”Whisper模型逐句听写并标好时间位置结果逐条存入本地数据库你想导出成什么格式就随时再加工。模型文件由 buzz/model_loader.py 负责下载与缓存首次用某个模型时需要联网下载一次之后完全离线可用。参数怎么配最划算看这张表就够了。选模型与参数一张表配好Buzz选项推荐值适用场景模型大小tiny / base低配电脑、快速初稿模型大小small日常平衡之选模型大小large关键内容、嘈杂音频模型类型Whisper.cpp实时录音、集显、Mac模型类型Faster Whisper6GB以上显存的N卡语言手动指定已知语言明显更准词级时间戳开启需要导出精细字幕初始提示填入术语表医学、法律等专业内容拿不准时选 Whisper.cpp small 手动指定语言这是速度和稳定性的平衡点。遇到异常时先对照这张表找原因。常见问题症状对照表症状可能原因解法转录速度慢得多模型过大换 tiny 或 base 模型点录音没反应麦克风权限被禁系统设置开启隐私权限转写到一半崩溃模型文件不完整删除模型重新下载术语拼写错误多缺少上下文提示初始提示填入专业词汇字幕太密读不了未生成词级时间戳开启后重新转录启动直接报错退出CPU不支持AVX2更换较新的处理器Buzz把Whisper变成你电脑里的离线转写工具音频不出机器字幕随取随用。想参与开发看 CONTRIBUTING.md。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表