Buzz:用本地 Whisper 免费高效离线转写音频的完整指南
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
刚结束一场三个小时的访谈,如果还要回去逐字听录音打稿,成本几乎让人崩溃。Buzz 是一款免费开源的离线音频转录工具:它把 OpenAI 的 Whisper 模型跑在你自己的电脑上,把音频直接变成文字。全程不依赖网络,录音文件也不会离开你的设备,天然适合在意隐私的场景。
Buzz 主界面:把多个音频文件加入离线转文字队列,实时查看转录进度
📦 核心能力速览
| 项目 | 说明 |
|---|---|
| 输入支持 | MP3、WAV、MP4 等音视频文件,另支持 YouTube 链接导入 |
| 模型后端 | Whisper、Whisper.cpp、Faster Whisper 等多后端,支持 GPU 加速 |
| 实时转录 | 麦克风实时转文字,附演示模式窗口 |
| 进阶能力 | 转录前语音分离、说话人识别 |
| 导出格式 | TXT、SRT、VTT 等 |
| 自动化 | 监听文件夹、命令行接口、插件系统 |
一句话理解:它是本地 Whisper 上加了一层图形界面和任务队列。你不需要自己管理模型权重、写脚本,第一次转录完成后就能直接导出。
👣 三步跑通 Buzz
不同系统安装方式略有差异,但每步最多一条命令:
- Windows / macOS:到官方发布页下载对应平台的安装包,按提示安装即可。Windows 版未签名,安装时如弹出警告,选择"仍然运行"。
- Linux:Flatpak 环境下一行命令:
flatpak install flathub io.github.chidiwilliams.Buzz;Snap 用户也可用等价的单行命令安装。 - Python 用户:需先准备 Python 3.12 与 ffmpeg,然后
pip install buzz-captions,再运行python -m buzz启动。
首次启动后,点工具栏的"+"号添加音频文件,在任务列表里选一个模型,点开始,Buzz 就会按顺序排队处理。完成后双击任务,即可打开转录结果。
🔍 功能深挖:从选模型到字幕精修
切换模型的速度差。在设置页可以在 Whisper、Whisper.cpp、Faster Whisper 等后端之间切换,模型尺寸覆盖 tiny 到 large。录音清晰时 small 级别通常就够快;有背景噪音、多人对话时值得升到 medium 或 large。Mac 的 Apple Silicon 可以本地流畅运行,NVIDIA 显卡还能走 CUDA 或 Vulkan 加速。后端实现可以看 buzz/transcriber/ 目录下的源码。
Buzz 模型设置:在转录速度与准确性之间,自由切换后端与模型大小
转录查看器:边听边改。打开任务后,查看器分三段:带时间戳的段落表、音频播放器、当前行显示。支持按关键词搜索跳转、0.5 倍到 2 倍变速播放,还能对单个段落设置循环播放。发现错字可以当场改文本或调时间戳,改完重新导出即可,细节见转录查看器文档。
Buzz 转录查看器:逐段核对离线转写结果,边听音频边编辑文本
字幕时长精修:想拆就拆、想并就并。导出 SRT 或 VTT 字幕时,经常遇到断行太长或太碎的问题。Buzz 提供专门的"resize"功能,按每行最大字数或时间间隙自动拆分、合并段落,一次调好就能导出能直接用的字幕文件。长会议多人发言,还可以启用说话人识别,标出"谁在什么时候说了什么"。
Buzz 字幕调整:自动调节段落长度与切分点,让导出的字幕更易读
🎧 谁适合用 Buzz
- 记者与研究者:访谈录音快速成文,文件不出本地,无上传顾虑。
- 视频创作者:导出 SRT 字幕直接进剪辑流程。
- 学生:课堂录音转文字做笔记,再用查看器按关键词回听复习。
- 会议组织者:麦克风实时转录,演示窗口把文字投屏展示。
🧰 几条能立刻落地的技巧
- 提前指定语言:录音语言明确时,手动设置比自动检测更准、更快。
- 善用监听文件夹:把指定目录作为中转站,新丢进去的文件自动转录,适合批量处理一整天的录音。
- 命令行做脚本化:
buzz add支持指定模型、语言与导出格式,可配合定时任务做全自动离线转文字。 - 干净录音用小模型:优先 small 或 base 提速;环境嘈杂时再升级大模型保准确率。
- 记住几个快捷键:Ctrl+F 搜长文、Ctrl+G 跳到当前播放位置,完整清单在偏好设置文档里。
💬 常见问题
问:需要联网吗?答:不需要。转录全在本地完成,断网也能用。
问:支持导出哪些格式?答:TXT、SRT、VTT 等,查看器里一键导出。
问:能转视频文件吗?答:可以,MP4、AVI 等格式会自动提取音轨。
问:对电脑配置要求高吗?答:不高。小模型 CPU 即可跑,GPU 只是加速大模型。
问:支持中文吗?答:支持,中文及多种语言均可,也可留空自动检测。
Buzz 把复杂的本地转写流程压成了几次点击,录音始终留在你自己的电脑里。手头有积压的音频要转文字的话,先装一个试试,第一次跑选小模型就行。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考