Buzz 离线语音转文字快速上手指南:从安装到第一条转录结果
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
Buzz 是一款开源的离线语音转文字工具,基于 Whisper(OpenAI 的开源语音识别模型),音频全程在本机处理、不上传服务器。适合整理会议纪要、给视频配字幕,也适合对隐私敏感的录音场景。免费使用,无需注册账号。
为什么选 Buzz:数据、成本与上手难度一次说清
- 数据不出本机:转录、翻译全部在你电脑上跑,断网也能用,录音文件永远不会离开硬盘。
- 零成本:MIT 协议开源,模型按需下载,没有按量计费。
- 两条路都能走:图形界面点点鼠标就出结果,也内置命令行,方便写脚本和批量自动化。
| 对比项 | Buzz | 云端转录服务 | 纯命令行工具 |
|---|---|---|---|
| 数据隐私 | 全程本地处理 | 需上传服务器 | 全程本地处理 |
| 联网要求 | 可完全离线 | 必须联网 | 可完全离线 |
| 费用 | 免费开源 | 按量收费 | 免费 |
| 实时录音 | 支持 | 支持 | 不支持 |
| 交互方式 | 图形界面+命令行 | 网页端 | 仅命令行 |
从零到第一条转录结果 🚀
按你的系统装一个
- Windows:下载官方安装包运行。应用未签名,弹窗点更多信息,再点仍要运行。
- macOS:下载.dmg文件,把图标拖进"应用程序"文件夹即可(需 Apple 芯片)。
- Linux:Flatpak 和 Snap 二选一:
flatpak install flathub io.github.chidiwilliams.Buzz sudo snap install buzz- Python 环境:先装好 ffmpeg,建议 Python 3.12,然后
pip install buzz-captions,用python -m buzz启动;想试最新功能可克隆源码:git clone https://gitcode.com/GitHub_Trending/buz/buzz。
首次运行:六步出第一条结果
- 打开文件菜单点导入媒体文件(或工具栏的"+"图标),选一个音频文件。
- 任务列选转录。
- 手动指定语言,比自动检测更稳。
- 选一个模型大小,小的快、大的准。
- 点运行,状态列开始刷新进度。
- 状态变为已完成后双击该行打开查看器,边播放边核对,导出TXT、SRT或VTT(后两者是常见字幕格式)。
三个真实任务实操
会议录音出文字
一场会录下来一小时,你要的是一份能直接分享的纪要。
- 导入录音,任务选转录,指定好语言。
- 环境嘈杂时,在高级选项里打开语音提取,先把人声从底噪里分离出来。
- 点运行,等状态变成已完成。
- 双击打开查看器,用搜索功能快速定位关键词核对。
结果获取:在查看器里直接导出TXT,整份纪要就落在音频同目录下。
三步给视频配字幕
把讲座、课程视频变成带字幕的版本,字幕文件可直接挂进播放器或剪辑软件。
- 导入MP4、MKV等视频文件,Buzz 会自动提取音轨。
- 高级设置里打开词级时间戳(给每个词单独打时间标记)。
- 转录完成后在查看器点调整大小,按静音间隔和标点把词合并成字幕长度。
- 导出SRT或VTT即可使用。
文件夹自动批量转录
录音每天往固定目录归档,希望丢进去就自动跑,不用守着界面。
- 在设置里配置文件夹监视,指定一个监视目录。
- 打开帮助→插件,启用跳过已转录文件,重复导入时直接复用旧结果。
- 新音频一放进目录,就自动建任务、跑模型、落结果文件。
喜欢命令行的话,一条命令也能完成批量:buzz add --model-type whispercpp --model-size small --srt --vtt audio.mp3,参数详见 命令行参数说明。
更快更准:调优与避坑清单 ⚡
A. 调优清单
- 后端切 Whisper.cpp,N 卡走 CUDA,其余显卡走 Vulkan(一种跨平台的显卡计算接口)。
- 显存紧张:选量化模型,或开降低 GPU 内存占用走 8 位量化。
- 实时录音用 small 级小模型,能跟得上语速。
- 已知语言手动指定,别依赖只扫开头几秒的自动检测。
- 初始提示里填人名、产品名,纠正专有名词拼写。
- 嘈杂录音开语音提取,准确率更稳。
B. 常见坑
- 转录慢 → 换更小模型,或设环境变量BUZZ_WHISPERCPP_N_THREADS调 CPU 线程数。
- 模型下载慢 → 设HF_ENDPOINT指向 hf-mirror.com 镜像。
- 旧显卡比 CPU 还慢 → 设BUZZ_FORCE_CPU=true强制走 CPU。
Buzz 把语音识别整个搬到了你自己的电脑上:音频不出机器,结果可导出为TXT、SRT、VTT,图形界面与命令行两套用法都齐。装好之后导入一个文件,几分钟内就能看到第一条转录结果。
资源链接
- 官方文档
- 转录核心模块源码
- 插件系统源码
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考