Buzz 语音转录:5 步跑通本地语音转文字,外加 4 个新手必踩的坑
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
Buzz 语音转录是一款完全免费的开源工具:它在你的电脑上离线完成音频转文字和翻译,由 OpenAI 的 Whisper 模型驱动,不依赖云端、不上传录音,适合做会议记录、课程整理和字幕制作的新手与普通用户。这篇上手手册不堆术语,只回答三件事——它能干什么、怎么最快跑起来、哪里最容易翻车。
第一次打开 Buzz:它到底能干哪些事
刚装上别急着录音。先花 30 秒认清它的四个主战场,免得功能用错地方:
| 你的场景 | Buzz 对应的能力 | 一个提示 |
|---|---|---|
| 手里有一段录音/视频 | 导入文件,转出文字或翻译成另一语言 | 也支持直接粘贴在线视频链接 |
| 正在开会、讲课 | 麦克风实时转录,边说边出字 | 有专门的"演示窗口",适合投屏 |
| 环境嘈杂、多人对话 | 转录前做语音分离 / 说话人识别 | 能帮你分清谁说了哪句 |
| 想批量、自动化 | 监听文件夹 + 命令行界面 | 新文件丢进去自动转 |
它不是"单一功能的转写器",而是一套把语音变文字、再整理导出的流水线。主界面长这样,左边导入、右边是任务队列:
安装 Buzz:按你的系统只挑一条路
不同系统装法不同,但你只需要下面其中一行,别贪多:
| 系统 | 装法 | 说明 |
|---|---|---|
| macOS | 下载官方.dmg双击安装 | Intel 和 Apple 芯片都支持 |
| Windows | 下载.exe安装 | 应用未签名,弹出警告选"仍要运行" |
| Linux | sudo snap install buzz | 或 Flatpak:flatpak install flathub io.github.chidiwilliams.Buzz |
| 想折腾 | pip install buzz-captions | 需 Python 3.12,再python -m buzz |
⚠️ 两个新手第一关:Windows 上没签名是正常现象,不是中毒;Linux 用 Snap 前最好先把音频依赖装全,否则录音会报错。更多细节见 docs/docs/。
日常使用选哪个模型
Buzz 里"模型"其实有两层:用哪种实现(后端)和用多大规格(尺寸)。先想清楚你的硬件,再往下选:
- 有N 卡且显存 ≥ 6GB→ 用Faster Whisper,明显更快、更省内存。
- 只有 CPU / 集成显卡 / Mac → 用Whisper.cpp,它是 C++ 优化版,老机器和笔记本也能实时转,Mac 首选它。
- 想要特定语言的定制模型→ 用HuggingFace后端,可挂上千种语言模型。
尺寸上遵循"小=快但糙,大=准但慢":
| 尺寸 | 适合谁 | 经验参考值(以你的机器为准) |
|---|---|---|
| tiny / base | 低配、先试水 | 快,错得多 |
| small / medium | 日常主力 | 平衡速度与准确率 |
| large / large-v3 | 求高精度 | 慢,个别语言偶尔会"脑补" |
模型下载不用自己找路径,全在设置里点:帮助 → 偏好设置 → 模型,下完点"显示文件位置"就能定位。
把文件变成文字:日常三步
这是你会用 90% 时间的流程,记住三个动作就够:
- 导入:拖入音频/视频,或贴一个在线视频链接。
- 挑任务:
transcribe(转成原语言文字)还是translate(转成另一语言),再定语言、选上面那个模型。 - 看结果:转录完进查看器,能搜、能拖播放进度、能调倍速,点击某句自动跳到音频对应位置。
导出支持TXT / SRT / VTT,做字幕直接出 SRT 就能用。
实时录音:会议和演讲怎么用
点工具栏的"录音",选设备、定语言就能边说边出字。关键在转录模式,三种差别很大:
- 下方追加:新句排在旧句下面,最直观。
- 上方追加:新句置顶,方便盯最新内容。
- 追加并修正:会回头改前面没听准的句子,效果最好但最吃算力,老机器慎选。
想把文字同步给 OBS 做直播字幕?在偏好里打开实时转录导出,Buzz 会把文字实时写进一个文本文件,OBS 读它即可;翻译版会另存一份.translated.txt。
深度定制:环境变量、命令行和插件
界面藏起来的调优项,官方用环境变量提供(启动前设好)。最常用的两个:
| 变量 | 作用 | 什么时候设 |
|---|---|---|
BUZZ_WHISPERCPP_N_THREADS | Whisper.cpp 线程数(默认约为 CPU 核心的一半) | 官方实测 16 线程机器设成 8 可提速约 15%,再往上反而变慢 |
BUZZ_FORCE_CPU | 强制用 CPU 不用 GPU | 老显卡比 CPU 还慢时救场 |
BUZZ_MODEL_ROOT | 改模型存放目录 | 想把模型挪到别的盘 |
不想开界面?命令行一条命令就能转:
buzz add -m whispercpp -s small -l zh --txt 会议录音.mp3需要"转完自动做点别的",就看 buzz/plugins/ 里的插件系统,官方自带AI 摘要、转写自动整理等,装上即用。
避坑清单:装不上、跑得慢、连不上网
遇到下面这四类,先照清单自查,基本不用再折腾:
- Windows 录音报错(麦克风 PaErrorCode-9999)→ 去系统设置里确认 Buzz 有麦克风权限。
- 转录慢→ 先把模型调小一档;有 N 卡换 Faster Whisper,没有就用 Whisper.cpp;别指望大模型在弱机器上飞快。
- 想离线用→ 在联网机器下好模型,整个模型文件夹拷到离线机器的对应目录(
偏好 → 模型 → 显示文件位置可定位),重启即认。 - 启动就崩→ 多半是模型下载不完整,删掉重下;再不行看
帮助 → 关于里的日志反馈。注意 Buzz 需要 CPU 支持 AVX2,太老的机器跑不动。
下一步建议(照着做即可):① 先装好并拖一小段中文音频,用whispercpp + small跑通转录;② 听一遍查看器里的定位是否准;③ 再决定要不要上 GPU 后端、要不要开实时录音导出。跑通这三步,才算真正把 Buzz 用顺手。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考