Buzz 离线语音转文字完整指南从安装到字幕导出新手 10 分钟跑通【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款免费的开源离线语音转文字工具基于 OpenAI 的 Whisper 模型在你自己的电脑上完成音频转录和翻译录音、会议音频、播客文件都不用上传到任何服务器。适合需要处理语音内容、又在意数据隐私的普通用户和开发者导入音频、点一下按钮就能得到带时间轴的文字稿和 SRT 字幕。Buzz 安装步骤三个平台各一条推荐路径平台推荐方式说明Windows下载官方安装程序.exe应用未签名安装时点更多信息→仍要运行macOS下载 .dmg 镜像挂载后把 Buzz 拖进应用程序文件夹即可LinuxFlatpak 或 Snap见下方命令Linux 两条备选命令flatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz不想用打包安装也可以用 Python 装需 Python 3.12 环境并先装好 ffmpegpip install buzz-captions python -m buzz首次体验5 分钟拿到第一段文字稿启动 Buzz点左上角的或按 Ctrl/Cmd O。选一个音频或视频文件MP3、WAV、MP4 都行。任务选Transcribe转录语言选你确认的语言模型先用默认的 tiny。点 Run等状态变成 Completed双击这一行。文字稿打开了点导出默认 TXT也可以直接选 SRT 存成字幕。到这里你就走通了导入 → 转录 → 查看 → 导出的完整链路。后面所有功能都是在这条链路上加料。Buzz 工作原理你的电脑就是转录服务器一句话说清Buzz 把音频切成一格格送进 Whisper 模型模型输出文字和时间戳全程在你的硬件上跑不联网也能用。打个比方它像一台装在本地的听写员Whisper 是听写员本人的能力Buzz 负责把音频递过去、把稿子排版好。值得知道的一点Buzz 内置了多个 Whisper 后端——Whisper原版、Faster WhisperNvidia 显卡优化版、Whisper.cppC 实现CPU、集显、Mac 芯片都能跑等。后端不同同一台机器上的速度差别可以很大这是后文调优的核心。按场景操作Buzz 文件转录与实时录音场景一转录已有文件最高频导入时真正需要做的选择只有三个任务Transcribe 按原语言转成文字Translate to English 直接转成英文翻译场景用它。语言强烈建议手动选。自动检测靠开头几秒猜猜错整段质量都会掉。模型默认 tiny 够用追求准确再换更大的。另外两个实用选项在 Advanced 里填 Initial prompt把容易听错的专有名词、术语写进去能明显减少错字勾选 Word-Level Timings 生成单词级时间戳后面做字幕更好用。场景二麦克风实时录音转录会议、讲座、采访直接对着麦克风录选任务、语言、麦克风点 Record。开录后会多出一个演示窗口选项可以把实时文字投到大屏上。实时转录推荐用 Whisper.cpp 后端加小模型——官方文档也这么提醒原版 Whisper 实时转写很吃资源。三种模式按需选Append below新句加在下方、Append above新句置顶、Append and correct追加并回改前句效果最好但最吃配置。两个进阶玩法给直播上字幕偏好设置里开启 Live transcript exports文字会边生成边写入 txt 文件OBS 读这个文件就能当字幕用。录电脑里播放的声音Buzz 录不了系统音频要先装一个虚拟声卡macOS 用 BlackHoleWindows 用 VB CABLELinux 用 PulseAudio 重定向把系统声音送进虚拟设备再在 Buzz 里选它当麦克风。场景三改字幕、导出成品转录完双击那行记录进入查看器支持全文搜索、拖动播放、调播放速度边听边校对很方便。点 Resize 可以重新切分字幕行设最大字数、按标点断行如果当时开了单词级时间戳还能分析音频里的静音来校准断点也可以给每条字幕统一延长显示时间避免一闪而过。改完导出 SRT/VTT/TXT直接能丢进视频剪辑软件。Buzz 模型选择speed 和准确度的平衡模型越大越准也越慢按硬件选模型速度准确度适合tiny / base快一般实时转录、低配电脑small / medium中好日常文件转录的主力large / large-v3慢最好重要内容离线跑选哪个 Whisper 类型按硬件对号入座有 6GB 以上显存的 Nvidia 显卡 →Faster Whisper快且省显存。Mac 或没有独显 →Whisper.cpp能吃 Vulkan 加速集显也能实时。想用特定语言优化模型 →Hugging Face类型支持 1000 语言的 MMS 系列等。注意两点名字带.En的模型只支持英文Whisper.cpp 可以下 q5 这类量化版省内存不损失太多精度。在 偏好设置 → Models 里管理下载和删除点Show file location能直接打开模型存放目录。进阶调优Buzz 命令行、环境变量与自动化用 CLI 跑批量任务Buzz 本身有命令行模式把 GUI 里的操作写成一行# 转录视频用 Whisper.cpp small 模型直接导出 SRT 和 VTT buzz add --model-type whispercpp --model-size small --language zh --srt --vtt 会议.mp4# 一次性丢多个文件隐藏主窗口后台跑 buzz add --task translate --language fr --model-type openaiapi --hide-gui a.mp3 b.mp3buzz add --help能看到全部参数任务、模型类型、初始提示、词级时间戳等适合塞进脚本做定期批处理。用环境变量微调高级选项不在设置界面里走环境变量启动前设置即可变量作用BUZZ_WHISPERCPP_N_THREADSWhisper.cpp 线程数默认半核16 线程机器设 8 常更快BUZZ_FORCE_CPU强制用 CPU老 GPU 反而慢时用它BUZZ_REDUCE_GPU_MEMORY8bit 量化省显存BUZZ_MODEL_ROOT模型存放目录可换到空间大的盘HF_ENDPOINT国内下载慢时设为镜像地址提速文件夹监控新文件自动转录在偏好设置的 Folder Watch 选项卡里加一个监控目录以后拷进去的音视频会自动进队列转录。配合跳过已转录文件插件plugins/skip_already_transcribed/重跑也不会重复劳动。项目还带 AI 摘要、自动整理字幕等插件见 plugins/ 目录和偏好设置里的插件管理按需开启。快捷键也可以全局改偏好设置 → Shortcuts把常用的导入/录音绑到顺手的位置。踩坑与排错真实问题对照表现象常见原因解决办法转录特别慢模型太大或没吃到 GPU换小一档模型或后端切 Whisper.cpp / Faster Whisper装完 Windows 一直弹安全警告应用未签名更多信息→仍要运行属正常现象录音报PaErrorCode-9999系统或安全软件拦了麦克风权限Windows 查设置→隐私→麦克风临时关杀毒软件测试启动时崩溃模型下载不完整或损坏偏好设置 → Models 里删掉该模型重新下载老电脑装不上/启动失败CPU 不支持 AVX2 指令集Buzz 依赖 AVX2太老的硬件无法运行Nvidia 显卡没加速驱动/CUDA 版本不够更新显卡驱动PyPI 安装需单独装 CUDA 版 torchFlatpak 版系统主题不生效Flatpak 沙箱读不到系统主题把主题拷到~/.themes并给 Flatpak 授权该目录完全离线的环境也能用 Buzz先在联网机器上把模型下好整个模型目录拷到离线机器同位置Linux 是~/.cache/BuzzmacOS 是~/Library/Caches/BuzzWindows 在用户目录的AppData\Local\Buzz\Buzz\Cache下之后转录、导出都不需要网络。下一步三件马上能做的事下载 small 模型拿同一段音频和 tiny 各跑一次对比错字率——这是选模型最靠谱的方法别人说 large 最好不如自己听一遍。配置 Folder Watch 监控一个目录把拷文件进去变成日常批量转录工作流。写一条buzz add --srt命令存成脚本把长视频一键变成带时间轴的字幕接到你现有的剪辑流程里。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考