资讯动态

Buzz 上手指南:本地离线转录,免费把录音转成文字和字幕

发布时间:2026/9/10 7:32:32 来源:尧图企业网站定制
Buzz 上手指南本地离线转录免费把录音转成文字和字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 模型的本地离线转录工具开源免费音频处理全程不离开你的电脑Windows、macOS、Linux 三个平台都有官方安装包。它做的事情很简单——把录音和视频变成文字稿与字幕文件不需要账号也不需要一直连着网。谁适合用谁可以不用Buzz 是一台免费的音频转文字工具适合它的人通常有这四种特征学生和老师课程录音、讲座转成带时间戳的文字笔记复习时按时间点直接跳转到对应内容国际课程的多语言素材也能直接转。视频创作者给视频自动生成字幕导出 SRT 后拖进剪辑软件即可省掉逐句打轴的手工活。职场人会议、访谈边录边转敏感内容不用出公司数据全程留在本机。研究者十几小时的访谈录音批量转写再配合说话人识别区分不同受访者导出文本后直接进入分析环节。反过来如果你只偶尔转一两段短音频又愿意把文件传到云端服务那没必要专门装一套本地工具。Buzz 的价值集中在批量、离线和隐私这三件事上。从装好到跑通离线 Whisper 工具怎么上手整个过程不用写代码装好就能用。安装。Windows 和 macOS 从官方发布渠道下载对应系统的安装包按向导装完即可Linux 提供 Flatpak 和 Snap 两种方式。Windows 安装器未签名提示不安全时选更多信息再仍要运行。首次使用时按提示下载一个 Whisper 模型之后缓存在本机不重复下载。导入文件。把文件拖进窗口或点工具栏的按钮手动选择MP3、WAV、FLAC、MP4、AVI 这些常见格式都支持。附注快捷键 CtrlOmacOS 为 CmdO与按钮等效粘贴 YouTube 链接也能直接导入Buzz 会自动抓取音轨。选参数、点运行。给任务选好任务类型、语言、模型档位和导出格式按运行文件就进入队列开始处理。任务进队列后主界面的状态列实时更新多个文件排队依次处理不用一直守着。看结果。状态变成完成后双击该行打开转录窗口。逐句带时间戳的文字可以直接查看和复制也可以按之前勾选的格式导出文件。跟做一次真实任务90 分钟访谈变成带字幕的稿子拿一份 90 分钟的中文访谈录音走一遍完整流程四个核心参数都在这一步里。导入文件后任务类型选转录输出与录音同语言的原文。如果选翻译Buzz 会把非英语内容直接转成英文文本。这次要保留原话所以选转录。语言建议手动指定成中文而不是自动检测。自动检测靠开头几秒猜语言口音重或混音时容易跑偏官方文档也明确推荐在已知语言时手动选择。模型档位从 Tiny 到 Large 分五档越大越准也越慢。90 分钟的访谈算重要素材有独立显卡就选 small 或 medium只有核显的话small 配 Whisper.cpp 后端更稳。导出格式勾选 TXT 和 SRT 两项TXT 留纯文字稿SRT 用来挂字幕。顺手把词级时间戳打开后面的字幕整形功能才能解锁全部选项。按运行等进度条走完双击任务行逐句带时间戳的稿子就出来了SRT 字幕文件也一并生成可以直接导入剪辑软件。结果窗口自带搜索、播放控制和倍速功能长稿校对比对着原始文件逐句听要省劲。三种进阶能力自动生成字幕与实时转写字幕整形Resize。长录音导出的字幕行长短不一有的观众看不完有的跳得太碎这时打开结果窗口点Resize设定每行最大长度再选按标点拆分、按静音间隔合并或强制分块。得到的是一套行长统一的 SRT适配不同平台的字幕规范基本只是改几个数字。麦克风实时转录。会议、课堂、直播这类边说边要出字的场景选录音任务、语言和麦克风点录制即可。说话的同时文字实时出现在屏幕上还能打开演示窗口把内容投到大屏展示。停录之后文稿可以导出保存。说话人识别。多人对话的录音需要分清谁说了什么时打开结果窗口点识别说话人。Buzz 自动给每位发言者的句子打标签你可以试听 10 秒样本、把自动标签改成真实姓名还能把同一人的连续发言合并成整段。把重复劳动交给程序按自动化程度从低到高分三级。一级文件夹监控。在偏好设置里指定一个监控文件夹之后新音频丢进去就自动开始转录全程不用动手。定期更新的播客、成批堆积的课程录音最适合这个模式程序在后台默默干活。二级插件。在帮助 → 插件里按需开关AI 摘要自动提炼内容、Resize Transcript 转完自动做字幕整形、跳过已转录避免重复计算、增强语言检测提升多语混排准确率、导出 DOCX 直接出 Word 文档完整列表见插件说明。涉及外部 API 的插件要填 key其余都是纯本地运行插件还能拖拽排序按自己的流水线拼装。三级命令行。批量任务和定时脚本走 CLI一条命令把参数定死完整参数可查CLI 文档buzz add --task transcribe --language zh --model-type whispercpp --model-size small --srt interview.mp3挂到系统计划任务里每天的新录音转完自己导出字幕人不用盯着。模型和硬件怎么选作为一台 Whisper 本地工具Buzz 的档位逻辑很简单硬件决定上限场景决定档位。硬件环境推荐档位理由NVIDIA 显卡显存 6GB 以上medium 或 large配 CUDA 加速精度上限最高长音频也扛得住Apple Silicon 或核显small用 Whisper.cpp 后端优化到位普通笔记本也能实时转写纯 CPU 老机器tiny 或 base先保速度重要文件换大模型再重跑档位和后端在每个任务上都能单独改不必全局锁定。两个附带建议录音里有人名、地名或专业术语时把它们填进高级设置的初始提示词这些词的识别率会明显上升音源嘈杂就先勾提取语音让人声先被分离出来再转准确度好一截。快速答疑问完全断网的环境能用吗能。模型首次使用需要联网下载一次之后的转录全部在本机完成。电脑本身不能上网的话在另一台机器上下好模型把模型文件夹拷过去就行。问中文之外的语言效果如何Whisper 原生支持 99 种以上语言中英日德法都在列转录和翻译都覆盖。多语混排的素材建议手动指定语言比自动检测稳。问一小时录音要转多久取决于模型大小和硬件带 GPU 的机器上通常能达到实时甚至更快。觉得慢就降一档模型或换 Whisper.cpp 后端再试。问特别长的音频能处理吗没有硬性上限几小时的录音直接丢进去就行。文件特别长时建议开词级时间戳配合字幕整形后续更好改。问能转电脑正在播放的声音吗可以。装一个虚拟音频设备macOS 用 BlackHole、Windows 用 VB Cable把系统声音指过去再在 Buzz 里选它当录制源。去官方发布渠道下载对应系统的安装包导入你手边第一段录音。进度条走完、字幕文件生成的那一刻录音转文字这件事就在你机器上跑通了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价