ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Buzz 音频转录工具使用指南:如何在电脑上离线转出第一条结果

Buzz 音频转录工具使用指南:如何在电脑上离线转出第一条结果 Buzz 音频转录工具使用指南如何在电脑上离线转出第一条结果【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的本地音频转录工具能在你的个人电脑上离线完成音频、视频的转录与翻译无需把文件上传到云端。它适合需要整理会议记录、给视频配字幕、做采访稿的人尤其是希望音频不出本地的场景。本文按你的实际操作顺序带你从安装到导出字幕文件走通一遍。首次跑通安装、下模型、转出第一段文字按下面的顺序做第一次启动大约需要十分钟主要耗在模型下载上。安装程序。Mac 和 Windows 用户下载安装包即可Linux 用户可直接装 Flatpakflatpak install flathub io.github.chidiwilliams.BuzzWindows 安装包未签名提示警告时选More info再Run anyway。也可以改用 Snapsudo snap install buzz或pip install buzz-captions任选其一即可。下载模型。首次使用 Buzz 会提示下载模型也可以在Help → Preferences快捷键 Ctrl/Cmd ,的 Models 面板里管理。第一次建议选 small 或更小模型越小速度越快大模型更准但更吃硬件之后可随时补下更大的模型。导入文件跑一次。点工具栏的或 File 菜单的 Import Media File快捷键 Ctrl/Cmd O选一个音频或视频文件任务选 Transcribe语言建议手动指定自动检测可能误判点 Run。看到结果。任务状态变为 Completed 后双击该行即可打开转录结果。核心场景实操把一个本地音视频文件转成文字步骤Ctrl/Cmd O 导入文件 → 在表单里选任务Transcribe 按原语言转、Translate to English 转成英文、语言、模型 → 点 Run。你会看到什么任务列表里出现一行进度推进直到显示 Completed双击这行进入转录查看器左侧是带时间戳的文字段上方有播放条可以边听边对照。对着麦克风实时转会议讲话步骤在录音任务里选好语言、质量和麦克风设备点 Record。实时转录比较吃性能建议用较小模型或选 Whisper.cpp 后端官方说明即使只有核显也能跑实时转录。你会看到什么边说边出文字最新句子持续追加在下方界面上有 Queue队列指标如果队列持续变大说明机器跟不上可以调大Transcription step降低负载。录音中还会多出 Presentation window 选项可把实时文字投到第二块屏幕上。把 YouTube 链接直接转成文字步骤Buzz 支持导入 YouTube 链接在 File 菜单选择 URL 导入项粘贴视频链接按同样方式选语言、模型后运行Buzz 会自动下载音频并处理。你会看到什么与文件转录一样队列中新增一条任务完成后双击打开文字稿导出 SRT/VTT 后就是现成的字幕文件。把结果加工成成品打开转录查看器后以下操作可以把初稿变成能用的成品改错与对时间直接在表格里编辑文字用快捷键 Ctrl/Cmd ←/→ 按 0.5 秒微调片段的开始/结束时间长音频可以勾选 Follow Audio 让文字跟随播放滚动用 0.5x–2.0x 变速播放核对Ctrl/Cmd F 可搜索定位。识别说话人点 Identify speakers 按钮Buzz 会把每句话标上说话人标签你可以试听 10 秒随机片段、把标签改成真实姓名保存时勾选 Merge speaker sentences 可把同一人的连续句子合并成一段。把字幕切到合适长度先确认转录时开启了 Word-Level Timings再点 Resize设置每条字幕的最大长度建议每行 40–50 字符、是否按标点拆分、按静音间隙合并还能给每条字幕统一延长显示秒数。导出通过导出菜单输出 TXT、SRT、VTT、JSON 等格式如果装了 内置插件 里的 Export to DOCX还可以导出 Word 文档。高频问题速查转得太慢、该选什么模型小模型快但错得多大模型准但慢。N 卡显存 ≥6GB 可用 Faster Whisper没有 N 卡含 Mac选 Whisper.cpp。具体取舍可对照官方 FAQ里的模型说明。Large-V3 和 Turbo 选哪个Large-V3 准确率通常最高但偶尔会幻听出音频里没有的词Turbo 在速度和准确率之间取平衡。最稳妥的办法是拿自己的语言实际各测一次。语言总被识别错别用Detect Language手动指定语言官方文档明确建议这样做。完全离线能用吗可以。在有网电脑上把模型下好再到 Help → Preferences → Models 点 Show file location 找到缓存目录Linux 是~/.cache/Buzz把模型文件夹拷到离线机器的同一位置即可。启动崩溃多半是模型下载不完整在 Models 面板删除对应模型重新下载另外 Buzz 要求 CPU 支持 AVX2过老的机器无法运行。Buzz 的能力边界很清楚本地离线转录、实时录音、YouTube 链接转写、字幕后处理和导出翻译到英文以外的语言则需额外配置 OpenAI 兼容的 API。建议你先按上面的步骤转出一个 SRT 文件再按需启用插件如 AI 摘要、导出 DOCX和命令行模式逐步扩展到你自己的工作流里。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进