Buzz 离线语音转文字快速上手指南:从安装到第一条转录结果
2026/9/18 18:45:46 网站建设 项目流程

Buzz 离线语音转文字快速上手指南:从安装到第一条转录结果

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

Buzz 是一款开源的离线语音转文字工具,基于 Whisper(OpenAI 的开源语音识别模型),音频全程在本机处理、不上传服务器。适合整理会议纪要、给视频配字幕,也适合对隐私敏感的录音场景。免费使用,无需注册账号。

为什么选 Buzz:数据、成本与上手难度一次说清

  • 数据不出本机:转录、翻译全部在你电脑上跑,断网也能用,录音文件永远不会离开硬盘。
  • 零成本:MIT 协议开源,模型按需下载,没有按量计费。
  • 两条路都能走:图形界面点点鼠标就出结果,也内置命令行,方便写脚本和批量自动化。
对比项Buzz云端转录服务纯命令行工具
数据隐私全程本地处理需上传服务器全程本地处理
联网要求可完全离线必须联网可完全离线
费用免费开源按量收费免费
实时录音支持支持不支持
交互方式图形界面+命令行网页端仅命令行

从零到第一条转录结果 🚀

按你的系统装一个

  • Windows:下载官方安装包运行。应用未签名,弹窗点更多信息,再点仍要运行
  • macOS:下载.dmg文件,把图标拖进"应用程序"文件夹即可(需 Apple 芯片)。
  • Linux:Flatpak 和 Snap 二选一:
flatpak install flathub io.github.chidiwilliams.Buzz sudo snap install buzz
  • Python 环境:先装好 ffmpeg,建议 Python 3.12,然后pip install buzz-captions,用python -m buzz启动;想试最新功能可克隆源码:git clone https://gitcode.com/GitHub_Trending/buz/buzz

首次运行:六步出第一条结果

  1. 打开文件菜单点导入媒体文件(或工具栏的"+"图标),选一个音频文件。
  2. 任务列选转录
  3. 手动指定语言,比自动检测更稳。
  4. 选一个模型大小,小的快、大的准。
  5. 运行,状态列开始刷新进度。
  6. 状态变为已完成后双击该行打开查看器,边播放边核对,导出TXTSRTVTT(后两者是常见字幕格式)。

三个真实任务实操

会议录音出文字

一场会录下来一小时,你要的是一份能直接分享的纪要。

  1. 导入录音,任务选转录,指定好语言。
  2. 环境嘈杂时,在高级选项里打开语音提取,先把人声从底噪里分离出来。
  3. 运行,等状态变成已完成
  4. 双击打开查看器,用搜索功能快速定位关键词核对。

结果获取:在查看器里直接导出TXT,整份纪要就落在音频同目录下。

三步给视频配字幕

把讲座、课程视频变成带字幕的版本,字幕文件可直接挂进播放器或剪辑软件。

  1. 导入MP4MKV等视频文件,Buzz 会自动提取音轨。
  2. 高级设置里打开词级时间戳(给每个词单独打时间标记)。
  3. 转录完成后在查看器点调整大小,按静音间隔和标点把词合并成字幕长度。
  4. 导出SRTVTT即可使用。

文件夹自动批量转录

录音每天往固定目录归档,希望丢进去就自动跑,不用守着界面。

  1. 设置里配置文件夹监视,指定一个监视目录。
  2. 打开帮助插件,启用跳过已转录文件,重复导入时直接复用旧结果。
  3. 新音频一放进目录,就自动建任务、跑模型、落结果文件。

喜欢命令行的话,一条命令也能完成批量:buzz add --model-type whispercpp --model-size small --srt --vtt audio.mp3,参数详见 命令行参数说明。

更快更准:调优与避坑清单 ⚡

A. 调优清单

  • 后端切 Whisper.cpp,N 卡走 CUDA,其余显卡走 Vulkan(一种跨平台的显卡计算接口)。
  • 显存紧张:选量化模型,或开降低 GPU 内存占用走 8 位量化。
  • 实时录音用 small 级小模型,能跟得上语速。
  • 已知语言手动指定,别依赖只扫开头几秒的自动检测。
  • 初始提示里填人名、产品名,纠正专有名词拼写。
  • 嘈杂录音开语音提取,准确率更稳。

B. 常见坑

  • 转录慢 → 换更小模型,或设环境变量BUZZ_WHISPERCPP_N_THREADS调 CPU 线程数。
  • 模型下载慢 → 设HF_ENDPOINT指向 hf-mirror.com 镜像。
  • 旧显卡比 CPU 还慢 → 设BUZZ_FORCE_CPU=true强制走 CPU。

Buzz 把语音识别整个搬到了你自己的电脑上:音频不出机器,结果可导出为TXTSRTVTT,图形界面与命令行两套用法都齐。装好之后导入一个文件,几分钟内就能看到第一条转录结果。

资源链接

  • 官方文档
  • 转录核心模块源码
  • 插件系统源码

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询