☰
Buzz Whisper 本地转写教程:免费离线转写,把会议录音变成 SRT 字幕
2026/10/11 1:26:04 网站建设 项目流程

Buzz Whisper 本地转写教程:免费离线转写,把会议录音变成 SRT 字幕

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

会议录了两个钟头躺在硬盘里。你想把里面的话变成能搜索、能引用的文字,又不愿意把音频传上任何云。Buzz 是把 OpenAI Whisper 语音识别模型直接跑在你电脑上的离线转写工具,音频全程不离开本机。读完这篇,你能装好 Buzz、跑完第一次转写,并拿到一份能直接套用的 SRT 免费字幕文件。

🔒 离线转写为什么值得跑在本地

隐私:音频不离开这台机器。 断网:拔掉网线照样能转。 费用:软件和模型都免费,零花费。

⚡ 三分钟装好 Buzz

Windows:从官方发布页下载安装包,双击运行。程序未做数字签名,安装时会弹系统警告——点“更多信息”再选“仍要运行”即可继续。

macOS:下载 .dmg,把图标拖进“应用程序”文件夹。注意新版只支持 Apple 芯片的 Mac,Intel 机型请停留在 1.4.5。

Linux / Python:三种方式,三选一:

Flatpak:

flatpak install flathub io.github.chidiwilliams.Buzz

Snap:

sudo snap install buzz

Python:

pip install buzz-captions python -m buzz

Buzz 靠 ffmpeg 解码音频,缺失时部分格式打不开。先用系统包管理器把 ffmpeg 装上再开始。更多平台细节见 docs/docs/installation.md。

第一次转写,四步出文字

  1. 加文件:点工具栏的加号按钮,选中一段 MP3 或 MP4,文件进入任务列表,状态显示 Queued。
  2. 选模型:保持默认模型不改动;首次运行会自动下载模型,等下载完再发起任务。
  3. 看进度:任务自动开始,状态列实时滚动出百分比进度。
  4. 看结果:双击状态变为 Completed 的那一行,弹出独立结果窗口,每行文字都带开始和结束时间戳。

拖动结果窗口底部的播放进度条,高亮行跟着音频位置走,可以边听边核对。

✍️ 校对并导出 SRT 字幕

第一步改错字:点中某个文字行直接修改,或拖动进度条回到原声位置逐行核对。

第二步选导出格式:从结果窗口的 Export 菜单挑 SRT、VTT 或 TXT,三种格式都支持。

第三步重排字幕:发现行太长、播放器显示不全时,点 Resize 按钮,设目标长度 42 字符,勾选按标点拆行,点 Merge。过长的行被合并、切分,产出可直接套用的标准字幕。

模型怎么选:按硬件对号入座

Buzz 把 Whisper 模型拉到你机器上跑本地语音转文字,音频不上传,断网也能用。它内置 Whisper.cpp、Faster Whisper、Hugging Face 三种推理引擎,调用代码在 buzz/transcriber/,任务和结果数据由 buzz/db/ 管理。

同一台电脑上跑,小模型明显更快,Large 只留给含糊人声或专业内容。按硬件对号入座:

硬件情况推荐模型适用场景
普通 CPU,无显卡Small / Medium日常会议与一般内容,速度优先
含糊人声、专业术语内容Large精度优先,能啃下难听清的段落
Nvidia 显卡Small / Medium,可开 CUDAGPU 加速推理,处理长音频更省力

在偏好窗口的 Models 页选 Small / Medium / Large 等模型,点 Download 下完再跑任务。带 Nvidia 显卡的机器可开 CUDA 加速;whisper.cpp 引擎本身不依赖 CUDA,纯 CPU 也照样跑。

🚧 动手前看一眼:避坑清单

  • Large 配纯 CPU:在没有显卡的机器上,Large 慢到没法用。普通电脑就选 Small / Medium。
  • 模型没下完就开转:whisper.cpp 首次使用要联网下模型。等下载完成再发起任务。
  • 部分格式打不开:多半是 ffmpeg 没装好。先用系统包管理器装上,再试。
  • Intel Mac 装新版:新版 Buzz 只支持 Apple 芯片。Intel 机型停留在 1.4.5。
  • 中文转写不准:纯中文录音在任务行把语言指定为中文,跳过自动检测的试错,准确率更稳。
  • 担心转写要联网:不需要,推理全程在本地完成,断网可用,音频不上传;只有首次下载模型需要联网。

找一段 10 分钟内的会议录音,现在导入 Buzz 跑一遍,顺手导出一次 SRT,你就知道这台机器的真实速度了。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询