资讯动态

Buzz 完整离线音频转录与翻译指南

发布时间:2026/9/7 3:57:11 来源:尧图企业网站定制
Buzz 完整离线音频转录与翻译指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz把会议录音传到在线转录服务担心数据泄露、网络断线——这是常见的困扰。Buzz 离线转录工具基于 OpenAI 的 Whisper 模型把识别过程全部放在你自己的电脑上完成和云端做法的区别在于不需要联网、不按字数计费音频数据不离开磁盘。为什么用 Buzz 而不是云端转录服务 全程本地处理音频文件和转写结果都留在本机磁盘适合有隐私或合规要求的录音。免费无限量没有 API 调用费、没有订阅、没有时长上限十分钟的片段和十小时的录音处理方式一样。多模型后端可选Whisper、Faster Whisper、Whisper.cpp支持 Vulkan GPU 加速等按设备配置组合。多语言覆盖支持 99 种以上语言的转录并能把任意语言直接翻译成英文文本。对比维度云端转录服务Buzz数据存放上传到对方服务器不离开本机磁盘网络要求必须联网大文件上传慢离线可用费用按分钟或字数计费免费模型选择限定对方提供的多后端多型号自由组合输出格式取决于对方支持TXT / SRT / VTT 本地导出五分钟装好 Buzz第 1 步选安装通道。Windows 用户从发布页下载安装包应用未签名安全警告出现时点更多信息 → 仍要运行macOS 下载 .dmg 双击安装Linux 用 Flatpak 或 Snap。开发者走 Python 渠道pip install buzz-captions python -m buzz第 2 步首次运行后在偏好设置面板的 Models 标签页选择模型。模型首次使用会按需下载Base 体积小、速度快Medium 兼顾准确度。第 3 步点工具栏 按钮或按 Ctrl/CmdO选择音频或视频文件设置任务、语言、模型点 Run。第 4 步状态列显示 Completed 后双击该行打开转录结果。Buzz 核心功能怎么用Buzz 模型怎么选能做什么在速度、显存占用和准确率之间做取舍——模型越小跑得越快精度越低。怎么操作偏好设置的 Models 页签分已下载和可下载两组从 Tiny 到 Large 全型号可选支持自定义模型地址。适合场景日常会议选 Base 或 Medium实时转录用 Tiny需要高精度存档才上 Large。实时录音转录能做什么把麦克风里的话实时转成文字并可打开演示窗口把转录投到大屏上适合演讲和会议同传展示。怎么操作选好任务转录或翻译成英文、语言、麦克风点 Record 即可。适合场景会议记录、讲座笔记、活动字幕。注意实时场景对机器压力较大官方文档建议搭配 Whisper.cpp 后端并使用小模型细节可查 FAQ。Buzz 字幕导出实操能做什么双击转录结果进入查看窗口每段文字都带开始和结束时间可对照音频逐段校对再导出 TXT、SRT 或 VTT。怎么操作点顶部 Export 按钮选格式。适合场景视频字幕制作、访谈记录存档、质性研究文本整理。若在导入时勾选了词级时间戳还能用 Resize 功能把逐词时间重新合并成字幕行控制最长行宽并按标点断句。Resize 对话框里还能按静音间隙合并Merge by gap、给每段延长结束时间让字幕在屏幕上停留更久完整说明见编辑与重排文档。说话人识别能做什么自动把转录里的句子按说话人打标签每段可试听对应 10 秒音频标签可改成真名。怎么操作转录完成后点Identify speakers保存时可选合并同一人的连续句子。适合场景访谈纪要、多方会议记录。注意 macOS 的 Intel 芯片版本暂不支持该功能。进阶工作流从一段访谈录音到成品 SRT导入访谈文件勾选Extract speech语音分离先把人声从噪音里拆到独立音轨再识别嘈杂录音的准确率会明显提高模型选 Medium 级别跑完转录状态列出现 Completed点Identify speakers区分不同发言者试听确认后把标签改成真实姓名进入结果窗口校对文字专有名词容易拼错的可写进高级设置里的 Initial prompt让模型少拼错打开 Resize设最长行宽 42、勾选按标点断句点 Merge 合并后再导出 SRT即可直接拖进剪辑软件。整条流程从原始音频到可交付字幕全程在本机完成不需要把文件交给任何第三方。避坑指南容易忽略的四个点选了自动检测语言Whisper 只靠前几秒判断语言混合语速或带口音的音频容易判错结果从开头就偏。做法只要知道语言就手动指定。实时转录选了大模型Large 级别计算慢语音越说越多、转录队列越积越长。做法实时场景换 Tiny 或 Base后端选 Whisper.cpp。直接转写低质量录音背景噪音和远距离收音会明显拉低准确率。做法勾选语音分离再识别录音条件允许时尽量安静、靠近麦克风。拿到第一版结果就直接用默认转录是整段长句不适合当字幕。做法导入时开启词级时间戳再用 Resize 按目标平台行宽重新合并。适用人群播客与节目制作者批量转写整季节目Resize 后导出 SRT 进剪辑软件。研究人员访谈录音与文字稿全部留在本地TXT 导出后直接做质性分析。会议记录员实时录音加演示窗口生成初稿说话人识别负责归属每条发言。字幕翻译用翻译成英文任务把外语音频直接转成英文文本再人工润色。Buzz 是一款把音频数据留在自己手里的离线转录工具免费、不限时长、支持多种字幕格式导出。现在就选一个手头音频文件跑一遍流程——从导入到导出 SRT第一次完整走下来通常只需几分钟。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价