十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Buzz:本地把音视频变成可搜索文字,免费离线转录

Buzz:本地把音视频变成可搜索文字,免费离线转录 Buzz本地把音视频变成可搜索文字免费离线转录【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz你盯着两小时的访谈录音在线转写又跳出付费弹窗传到云端又不放心。Buzz 是一款本地离线音频转文字工具基于 OpenAI 的 Whisper 打造不联网就能在自己的电脑上完成转录和翻译。下面都是可落地的操作路径照着走即可。 三个事实先看清离线与隐私事实 1数据全程留在你自己的电脑上。音频不经过任何服务器隐私风险从源头被掐断这是在线服务没法承诺的第一点。事实 2开源免费长期可用。采用 MIT 协议不按时长计费、没有订阅制社区迭代快遇到的问题常在后续更新中修复。事实 3三大系统全覆盖。Windows、macOS、Linux 都有安装方式且支持 NVIDIA CUDA 与 Apple Silicon 优化没有独立显卡的机器也能跑只是慢一些。从下载到出字本地音频转文字的最短路径步骤 ①→②→③→④整体路径很短转录时间另算。步骤 ① 安装。从官方渠道下载对应系统的安装文件Windows 双击走安装向导出现未签名提示时点“更多信息 → 仍要运行”macOS 挂载磁盘镜像拖入应用Linux 可用 Flatpak 或 Snap 一条命令装好。步骤 ② 导入。点工具栏“”或直接把文件拖进来MP3、WAV、MP4 等主流格式都支持也可以粘贴 YouTube 链接它会自动抓取音频进入流程省去先手动下载。步骤 ③ 参数。第一次只需决定模型大小模型越小越快越大越准其余项目保持默认之后随时可改。步骤 ④ 运行。点“运行”后任务进入队列多个文件依次处理进度在主界面随时可查。输入 → 处理 → 输出字幕生成的数据流输入三种来源本地文件导入即入队适合已有录音和视频素材。URL粘贴链接自动抓取音频无需单独下载。麦克风实时转录边说话边出字还能投到演示窗口放大展示。处理模型档位与两个开关模型从 Tiny 到 Large 分档大致像“草稿到定稿”小的快而糙大的慢而准。设置页里能看到哪些模型已下载缺的一键下载。两个可选开关说话人识别给多人对话自动标注发言人谁说了什么一目了然语言检测自动判断语种事先知道时手动指定更稳。还有个隐藏项高级设置里可以填初始提示词把音频里的人名、地名、专业术语写进去识别率明显提升技术讲座和医学讨论尤其受益。输出三种产物TXT纯文字稿适合存档与全文检索。SRT带时间戳字幕视频字幕生成最常用的格式。VTT网页字幕格式适合在线视频播放。可多选格式一次处理出多份产物。完成后结果窗口按时间轴逐句展示支持搜索全文、调节播放速度直接在这里完成导出。⚡ 三个任务流从访谈到实时转录以下三条覆盖最常见的离线转录需求操作都集中在主界面内完成。两小时访谈 → 结构化文字稿导入音频选转录与中文选 Medium 模型开说话人识别导出 TXT按发言人核对≈ 15 分钟MediumGPU 加速。说话人标签会自动区分发言者文字稿贴进文档后能直接分段。课程视频 → SRT 字幕导入视频输出勾选 SRT选 Small 模型语言自动检测用 Resize 调好行宽后导出≈ 8 分钟。线上会议 → 实时纪要开启麦克风录音打开演示窗口查看实时字幕会后导出 TXT 留存实时进行无需等待。效果不佳时离线转录决策表别急着换大模型先按代价从低到高的顺序查表。症状先试什么还不行再试什么错字连篇、识别混乱手动指定语言别用自动检测换 Large 模型重跑转录速度慢换 Small 或 Base 模型开启 CUDA/Vulkan 加速实时转录有延迟换 Small 或 Base 模型确认已启用 GPU 加速背景噪音干扰大转录前勾选提取语音收音靠近声源、降低环境噪音字幕行太长读不完用 Resize 按标点重新分行手动调整最大长度参数术语、专名识别错在高级设置填初始提示词换 Large 模型重跑嘈杂录音先勾提取语音。NVIDIA 用户开启 CUDA速度提升数倍。Apple Silicon 直接用优化版。自动化与扩展免费批量转录文件夹监控设一个监控目录新音频自动转录全程不碰鼠标适合定期更新的播客或批量堆积的课程录音配合“跳过已转录文件”插件重复的文件不会被二次处理。插件系统AI 摘要、跳过已转录文件、导出 DOCX 等按需开启实现见 plugins/。监控目录、导出格式等都在设置界面里配置命令行适合批量任务与定时脚本。下面是最常用的单文件转录示例buzz add --task transcribe --model-size medium --txt audio.mp3完整参数见 CLI 文档。你大概会问关于离线与速度Q必须联网吗A不需要。所有处理在本机完成只有选用 OpenAI API 时才需要网络。Q支持多少语言A90 种以上覆盖中、英、日等主流语言转录和翻译都支持。Q速度怎么样A取决于硬件和模型大小GPU 加速下通常明显快于纯 CPU。Q音频有长度上限吗A没有硬性限制几秒到几小时都能处理。Buzz 把音频转文字从付费、上传、排队等待的服务变成了你本地可支配的能力。打开它把手边最长的那段录音拖进去点运行。屏幕上的字就是答案。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表