资讯动态

Buzz 本地离线语音转文字:给会议录音和播客自动出字幕

发布时间:2026/9/7 23:43:49 来源:尧图企业网站定制
Buzz 本地离线语音转文字给会议录音和播客自动出字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款完全在本地运行的离线语音转文字工具基于 OpenAI 的 Whisper 模型音频不上传、不联网也能转写把会议录音、播客、访谈变成可搜索、可编辑的文字和字幕。 能力速览Buzz 能替你做什么能力一句话场景文件转录导入 MP3、WAV、MP4 等媒体转录成带时间戳的文字实时录音麦克风进、字幕出说话的同时逐行生成文字翻译任意语言一键出英文稿或接 LLM 翻到指定语言批量 CLIbuzz add一次处理一文件夹适合挂机跑批多格式导出TXT、SRT、VTTDOCX 由导出插件提供把它想象成一台搬回家的录音厨房食材音频从进门到出锅都不离开你的房子。数据不出你的电脑没有上传环节也就没有泄露、排队和按分钟计费的焦虑。 5 分钟跑通第一条转录三个平台都有一行命令的安装方式系统途径命令Windowswingetwinget install ChidiWilliams.BuzzmacOSHomebrewbrew install --cask buzzLinuxFlatpak / Snapflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz⚠️ 注意Windows 安装包未做代码签名首次安装时系统会弹出安全警告。点更多信息再仍要运行即可项目开源源码可查。想体验未发布的改动也可以克隆仓库按 README 装依赖git clone https://gitcode.com/GitHub_Trending/buz/buzz。装好后打开软件主界面是一张任务队列。按CtrlO或点工具栏的导入一段会议 MP3弹出的表单里只有三个选项值得看Task 默认就是 Transcribe同语言转录Language 如果你知道是中文直接选zh别指望自动检测Model 先选base够用。点 Run任务进队列进度条走完状态变成 Completed。双击这一行你落在转录查看器里带时间戳的文字一段段排在眼前——第一份转录稿诞生了。接下来是校对。在时间戳表格里双击文本单元格就能直接改改动自动保存CtrlP播放/暂停对应位置的音频Ctrl←/→微调片段起点、CtrlShift←/→调终点边听边修。 三个真实工作流会议现场出稿切到 Live Recording 标签页选好麦克风、语言和模型点红色 Record 按钮话音未落文字已经一行行排出来。实时转录对硬件胃口不小务必选 Whisper.cpp 后端配tiny或base否则文字追不上语速。录制模式有两种默认 Append below 只往末尾追加在偏好设置里改成 Append and correct它会回头重查刚生成的句子、边说边修正代价是更吃硬件。录的同时可以打开演示窗口Live Transcript Presentation把实时字幕投到外接屏——演讲同传、远程会议看稿都靠它。偏好设置里还能把实时转录导出到文本文件OBS 就能把它当直播字幕源读。把播客剪成可上传的字幕视频同样是普通食材MP4、MOV、MKV 直接导入Buzz 用内置的 FFmpeg 解码。要做字幕转录前有个开关别漏——词级时间戳word-level timestamps。没勾它查看器里那把断句刀就使不出来。转录完成后点查看器工具栏的 Resize设一个字幕行最大长度按标点分割、按静音间隙合并一句被拦腰砍断的长台词会重新归位。然后从导出菜单选 SRT 或 VTT直接拖进剪辑软件留档用 TXT要 Word 文档则启用导出插件拿 DOCX。想转的是播客、在线课程这类系统声音装个虚拟声卡把声音改道给 Buzz 即可Windows 装 VB-CABLE把系统输出设到 CABLE InputBuzz 里麦克风选 CABLE OutputmacOS 用brew install blackhole-2ch在音频 MIDI 设置里把扬声器和 BlackHole 组进多输出设备Linux 用pavucontrol在录制标签里把指定应用的音频重定向过去。电脑上能出声的内容从此都能变成可搜索的文字。批量与自动化让电脑夜里干活文件一多GUI 逐个点就慢了。buzz add支持一次吃进多个文件buzz add --task transcribe --model-type whispercpp --model-size small --language zh --prompt 访谈录音人名张伟、李娜 --srt --vtt 访谈.mp3 会议录音.wav--prompt是初始提示词把常错的专有名词写进去错字会明显减少--output-directory指定产出位置--hide-gui可以静默运行。把它挂进系统的定时任务任务计划程序或 cron睡前丢一个文件夹进去早上收字幕。翻译也在这条流水线上。任务类型选 Translate to English任何语言直接给你英文稿这是 Whisper 自带能力离线可用。想翻到别的语言比如英译西在偏好设置里填一个 OpenAI 兼容的 API 地址和密钥本地用 Ollama 或 LM Studio 跑模型也完全接得上再到查看器点 Translate给 AI 一句指令例如只翻译不添加解释就是一条全离线翻译管线。 模型怎么选、速度怎么调模型适用场景tiny/base低配机器、实时录音、先出个大意small日常文件转录速度与精度的平衡点medium/large术语密集、口音复杂的录音建议配 GPUlarge-v3-turbo质量接近 large速度更快GPU 友好模型管理在偏好设置的 Models 标签页左边已下载、右边待下载勾选后点 Download也支持粘贴自定义模型的下载地址。想省内存选 Whisper.cpp 后端并挑量化版本如q_5用一点点精度换显存和速度。遇到卡顿问自己三个问题有 NVIDIA 显卡吗有就在设置里启用 CUDAlarge 的转录能从小时级压到分钟级确认 GPU 没生效吗设BUZZ_FORCE_CPUtrue强制纯 CPU 跑一遍对比速度就能定位内存紧张吗退回 Whisper.cpp 量化模型或换小一号的模型。❓ 踩过的坑一次说清中文没指定语言转录质量差自动检测偶尔会判断失误中文音频手动选zh最稳。实时转录总跟不上语速默认模型太大。切 Whisper.cpp 后端加tiny或base立刻跟手。Resize 重组功能为什么用不了转录时没勾词级时间戳。勾选后重新转一次即可。明明有显卡为什么还是 CPU 在跑先确认驱动装好、设置里 CUDA 已启用也可以BUZZ_FORCE_CPUtrue强制 CPU 排除变量。国内网络下模型下载慢设置环境变量HF_ENDPOINThttps://hf-mirror.com走镜像速度立竿见影。下一步今晚挑一段十分钟的录音从导入跑到导出 SRT。跑得顺就去项目仓库点个 Star卡住了就把现象丢给社区。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价