资讯动态

Buzz 离线转写:从音频文件到 SRT 字幕的 3 步路径

发布时间:2026/9/7 5:23:23 来源:尧图企业网站定制
Buzz 离线转写从音频文件到 SRT 字幕的 3 步路径【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz手上有会议录音、播客文件想转成文字和字幕时Buzz 是一个免费、离线的桌面转写工具它在你的电脑上本地运行 Whisper 模型完成转写和翻译。适合需要批量处理本地音视频、需要会议实时字幕的人不适合期望云端 SaaS 或服务器端 API 的团队。它替你省掉的是把音频上传给第三方、自己拼转写管线模型下载、格式转换、SRT 导出的整套活。先别装30 秒判断它适不适合你适合别用本地音视频批量转写要集成服务端 API会议、讲座实时字幕只要一两分钟音频的快文本断网、隐私敏感环境依赖云端大模型出结果如果两边都命中优先看本地处理是不是硬需求不是的话云端方案更省事。最小路径跑起来第 1 步装解码依赖。Buzz 用 ffmpeg 读取音视频先用你系统的包管理器装上它。sudo apt-get install -y ffmpeg # Debian/Ubuntu预期结果ffmpeg -version能输出版本号。第 2 步安装并启动。需要 Python 3.12 环境macOS 和 Windows 也可以直接下官方安装包不走这一步。pip install buzz-captions python -m buzz预期结果打开带任务列表的主窗口界面左侧是转写队列右侧是导入和录音入口。第 3 步用一条命令转一个文件。仓库自带测试音频可以直接拿来验证。buzz add --model-type whispercpp --model-size small --srt testdata/audio-long.mp3预期结果任务跑完并在音频旁生成字幕文件。完整参数见 CLI 参考。看到什么算成功音频旁边出现audio-long.srt打开是带序号的时间轴字幕行就算跑通了。功能逐个拆模型后端怎么切换Buzz 内置多个本地推理后端。Whisper.cpp 是 C 优化版实现没有独立显卡的机器选它Faster Whisper 在带 6GB 以上显存的 Nvidia 显卡上更快。后端、模型尺寸、目标语言可以按任务切换。buzz add -m whispercpp -s small testdata/whisper-french.mp3实际效果普通笔记本用 small 或 base 模型就能做接近实时的转写。模型从偏好设置的模型页下载和管理位置也能改。实时转写与演示窗口在实时录音面板选好转写任务、语言和麦克风点 Record边说话边出文字录音进行中再打开演示窗口会弹出一个只有大字字幕的独立窗口可以投到活动大屏。关键配置没有命令行入口都在面板里实时模式追加/修正、静音阈值在高级偏好里调。实时转写吃资源优先用 Whisper.cpp 后端配小尺寸模型。实际效果会议结束直接拿到全文演示窗口专给投影用正文窗口保持干净。结果导出与插件后处理转写结果可导出 TXT、SRT、VTT 三种格式1.4.5 版本起有插件系统内置 DOCX 导出、AI 摘要、降噪等插件转写存完自动执行。关键配置Help → Plugins里开关和拖拽排序Add by URL粘贴一个 zip 链接可装社区插件内置插件源码可以直接当模板看。实际效果批量转完直接出一批字幕文件或让插件顺手把 Word 讲稿也生成出来。定制边界配置能改的 vs 必须动代码的能做到GUI 里改模型后端、尺寸、语言、初始提示词、导出格式用环境变量改线程数、强制 CPU、降低 GPU 显存占用不用改代码从 .zip 装社区插件启停和排序都持久保存做不到重排 PyQt6 主窗口布局或换视觉风格直接新增导出格式途径是写插件属于动代码改本地数据库结构改配置即生效的最小示例调 Whisper.cpp 线程数后重启export BUZZ_WHISPERCPP_N_THREADS8 python -m buzz碰了可能踩坑的文件buzz/plugins/base.py插件契约改动会影响所有插件和buzz/db/db.py本地数据库初始化。卡点速查现象原因解法转写太慢模型相对硬件太大buzz add -m whispercpp -s small 文件麦克风报PaErrorCode-9999系统拦截了应用访问麦克风系统隐私设置里给 Buzz 开麦克风权限启动或下载模型后崩溃模型文件下载不完整在Help → Preferences → Models删掉重下模型下载失败或极慢网络访问 Hugging Face 受限export HF_ENDPOINThttps://hf-mirror.com延伸入口CLI 命令参考偏好与环境变量清单插件开发指南如果你的诉求是音频不出内网或者要一场不用手写脚本的现场字幕Buzz 两头都能覆盖起步成本就是上面 3 条命令。只想先出字幕的话从最小路径跑起来第 1 步开始即可。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价