Buzz 语音转录:5 步跑通本地语音转文字,外加 4 个新手必踩的坑
2026/9/6 21:09:38 网站建设 项目流程

Buzz 语音转录:5 步跑通本地语音转文字,外加 4 个新手必踩的坑

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

Buzz 语音转录是一款完全免费的开源工具:它在你的电脑上离线完成音频转文字和翻译,由 OpenAI 的 Whisper 模型驱动,不依赖云端、不上传录音,适合做会议记录、课程整理和字幕制作的新手与普通用户。这篇上手手册不堆术语,只回答三件事——它能干什么、怎么最快跑起来、哪里最容易翻车。

第一次打开 Buzz:它到底能干哪些事

刚装上别急着录音。先花 30 秒认清它的四个主战场,免得功能用错地方:

你的场景Buzz 对应的能力一个提示
手里有一段录音/视频导入文件,转出文字或翻译成另一语言也支持直接粘贴在线视频链接
正在开会、讲课麦克风实时转录,边说边出字有专门的"演示窗口",适合投屏
环境嘈杂、多人对话转录前做语音分离 / 说话人识别能帮你分清谁说了哪句
想批量、自动化监听文件夹 + 命令行界面新文件丢进去自动转

它不是"单一功能的转写器",而是一套把语音变文字、再整理导出的流水线。主界面长这样,左边导入、右边是任务队列:

安装 Buzz:按你的系统只挑一条路

不同系统装法不同,但你只需要下面其中一行,别贪多:

系统装法说明
macOS下载官方.dmg双击安装Intel 和 Apple 芯片都支持
Windows下载.exe安装应用未签名,弹出警告选"仍要运行"
Linuxsudo snap install buzz或 Flatpak:flatpak install flathub io.github.chidiwilliams.Buzz
想折腾pip install buzz-captions需 Python 3.12,再python -m buzz

⚠️ 两个新手第一关:Windows 上没签名是正常现象,不是中毒;Linux 用 Snap 前最好先把音频依赖装全,否则录音会报错。更多细节见 docs/docs/。

日常使用选哪个模型

Buzz 里"模型"其实有两层:用哪种实现(后端)用多大规格(尺寸)。先想清楚你的硬件,再往下选:

  • N 卡且显存 ≥ 6GB→ 用Faster Whisper,明显更快、更省内存。
  • 只有 CPU / 集成显卡 / Mac → 用Whisper.cpp,它是 C++ 优化版,老机器和笔记本也能实时转,Mac 首选它
  • 想要特定语言的定制模型→ 用HuggingFace后端,可挂上千种语言模型。

尺寸上遵循"小=快但糙,大=准但慢":

尺寸适合谁经验参考值(以你的机器为准)
tiny / base低配、先试水快,错得多
small / medium日常主力平衡速度与准确率
large / large-v3求高精度慢,个别语言偶尔会"脑补"

模型下载不用自己找路径,全在设置里点:帮助 → 偏好设置 → 模型,下完点"显示文件位置"就能定位。

把文件变成文字:日常三步

这是你会用 90% 时间的流程,记住三个动作就够:

  1. 导入:拖入音频/视频,或贴一个在线视频链接。
  2. 挑任务transcribe(转成原语言文字)还是translate(转成另一语言),再定语言、选上面那个模型。
  3. 看结果:转录完进查看器,能搜、能拖播放进度、能调倍速,点击某句自动跳到音频对应位置。

导出支持TXT / SRT / VTT,做字幕直接出 SRT 就能用。

实时录音:会议和演讲怎么用

点工具栏的"录音",选设备、定语言就能边说边出字。关键在转录模式,三种差别很大:

  • 下方追加:新句排在旧句下面,最直观。
  • 上方追加:新句置顶,方便盯最新内容。
  • 追加并修正:会回头改前面没听准的句子,效果最好但最吃算力,老机器慎选。

想把文字同步给 OBS 做直播字幕?在偏好里打开实时转录导出,Buzz 会把文字实时写进一个文本文件,OBS 读它即可;翻译版会另存一份.translated.txt

深度定制:环境变量、命令行和插件

界面藏起来的调优项,官方用环境变量提供(启动前设好)。最常用的两个:

变量作用什么时候设
BUZZ_WHISPERCPP_N_THREADSWhisper.cpp 线程数(默认约为 CPU 核心的一半)官方实测 16 线程机器设成 8 可提速约 15%,再往上反而变慢
BUZZ_FORCE_CPU强制用 CPU 不用 GPU老显卡比 CPU 还慢时救场
BUZZ_MODEL_ROOT改模型存放目录想把模型挪到别的盘

不想开界面?命令行一条命令就能转:

buzz add -m whispercpp -s small -l zh --txt 会议录音.mp3

需要"转完自动做点别的",就看 buzz/plugins/ 里的插件系统,官方自带AI 摘要转写自动整理等,装上即用。

避坑清单:装不上、跑得慢、连不上网

遇到下面这四类,先照清单自查,基本不用再折腾:

  • Windows 录音报错(麦克风 PaErrorCode-9999)→ 去系统设置里确认 Buzz 有麦克风权限。
  • 转录慢→ 先把模型调小一档;有 N 卡换 Faster Whisper,没有就用 Whisper.cpp;别指望大模型在弱机器上飞快。
  • 想离线用→ 在联网机器下好模型,整个模型文件夹拷到离线机器的对应目录(偏好 → 模型 → 显示文件位置可定位),重启即认。
  • 启动就崩→ 多半是模型下载不完整,删掉重下;再不行看帮助 → 关于里的日志反馈。注意 Buzz 需要 CPU 支持 AVX2,太老的机器跑不动。

下一步建议(照着做即可):① 先装好并拖一小段中文音频,用whispercpp + small跑通转录;② 听一遍查看器里的定位是否准;③ 再决定要不要上 GPU 后端、要不要开实时录音导出。跑通这三步,才算真正把 Buzz 用顺手。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询