ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Buzz离线语音转文字指南:免费、99种语言

Buzz离线语音转文字指南:免费、99种语言 Buzz离线语音转文字指南免费、99种语言【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz是一款离线语音转文字软件基于OpenAI Whisper在你电脑上本地完成转录音频不出设备。免费开源支持99种以上语言适合处理会议录音、采访素材等敏感内容的个人和团队。处理敏感录音先把它留在本机整理一场涉及客户信息的会议录音多数云端转录服务都要先把文件传上去风险自己掂量。Buzz把整条转录链路放在本地导入、识别、编辑、导出全程不联网音频文件始终留在你的磁盘上——这就是免费离线转录工具存在的核心理由。打开应用后左侧是转录任务列表把文件拖进去就能开始处理。更多说明见官方文档。从下载到第一条转录结果按平台选一条路。Windows下载安装包双击运行应用未签名会弹警告点更多信息→仍要运行。macOS和Linux可以直接用包管理器brew install --cask buzzflatpak install flathub io.github.chidiwilliams.Buzz sudo snap install buzzPython开发者装完依赖后这样启动pip install buzz-captions python -m buzz装好后拖入一个MP3或MP4在模型下拉框选tiny指定语言点运行。任务跑完后双击它打开查看器就能编辑转录文本、调整时间轴并导出为TXT、SRT、VTT、JSON。能力清单它能帮你做什么五项能力对应五种工作流按需启用即可不用全开。实时录音有两种模式边录边出的实时显示和录完统一跑的追加校正偏好设置里可切换。没有N卡也不影响CPU跑tiny或base模型足够日常用单人内容主要靠文件夹监视多人对话才需要说话人识别。能力它能帮你做什么实时录音转录边说边出字实时显示、追加校正两种模式会议采访全程留字文件夹监视指定目录后新音频自动排队转录批量处理不用人盯说话人识别多人对话自动分配说话人标签访谈记录不再混成一锅粥多Whisper模型tiny速度最快large准确率最高按需切换平衡速度与精度GPU加速NVIDIA用CUDAAMD/Intel用Vulkan转录速度数倍提升典型用法三个场景怎么落地记者采访遇到采访录音量大事后整理耗时。操作开启实时录音转录采访过程中同步出文字稿雏形。技巧安静环境录制选medium以上模型准确率更稳。视频字幕遇到给视频上字幕逐句对齐费时。操作导入视频Buzz自动提取音频生成字幕用调整大小功能控制单条长度导出SRT。技巧长句先在查看器里手动拆段再导出字幕文件。批量会议遇到每周多场会议录音都要处理。操作配置文件夹监视录音文件放进目录即自动转录。技巧不同语言的文件手动指定语言别交给自动检测。踩坑记录症状与对策转录慢得没法等换tiny或base小模型有NVIDIA显卡就开CUDA加速关掉抢资源的后台程序。识别总带口音错误手动选对语言把专业术语写进初始提示环境能安静就安静。一批文件要处理多文件直接拖入主界面排队或交给文件夹监视自动跑。文件不识别Buzz支持MP3、WAV、FLAC、M4A、OGG等音频和MP4、AVI、MOV、MKV等视频其他格式先用ffmpeg转码。进阶设置快捷键、模型与导出模板三项都在偏好设置里完成快捷键开始/停止录音、导入文件、导出转录、播放控制全可自定义改完保存立即生效。模型管理在模型标签页下载新Whisper模型、删除不用的、设置默认模型。导出模板文件命名支持{filename}、{date}、{time}、{language}变量批量导出不再互相覆盖。入口在buzz/settings/对应的设置模块界面长这样横向对比与取舍维度Buzz云端转录服务隐私完全离线音频不出设备需上传云端网络无需联网依赖稳定网络费用免费通常按量收费速度取决于本地硬件取决于服务器负载自定义模型、导出、插件均可配选项有限维度Buzz其他离线工具界面图形界面拖拽即用多为命令行实时录音支持带演示窗口通常只处理文件语言99种以上支持有限模型多档Whisper可选通常单一模型更新持续迭代更新较慢什么情况下不建议用它机器很旧又要处理大量长音频本地转录明显比云端慢不介意上传、只求最高准确率成熟云服务更划算纯写脚本、不需要图形界面时直接用Whisper的命令行生态更轻。Buzz的价值在隐私可控不在速度无限。代码地图buzz/ ├── transcriber/ 转录核心文件/录音/whisper.cpp ├── widgets/ 界面组件主窗口/查看器/偏好设置 ├── db/ 数据库entity/dao/service └── settings/ 配置管理关键入口界面组件之外的两块最值得先读文件转录file_transcriber.py录音转录recording_transcriber.py主界面main_window.pyBuzz适合所有不想把音频交给第三方的场景完全免费、本地跑完、支持99种以上语言。作为本地语音识别软件今晚就能做三件事装好它选平台对应的安装方式想读源码就git clone https://gitcode.com/GitHub_Trending/buz/buzz拖入一段音频用tiny模型跑出第一条转录打开偏好设置把默认模型和导出模板定下来想改功能再贡献代码仓库结构不复杂从transcriber/或widgets/入手即可。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进