资讯动态

Buzz 音频转录:99+ 种语言离线转写,五步出稿

发布时间:2026/9/10 12:34:26 来源:尧图企业网站定制
Buzz 音频转录99 种语言离线转写五步出稿【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz硬盘里堆着几十段录音和视频想查一句话却翻不到Buzz 音频转录基于 OpenAI Whisper 模型在你自己的电脑上把音频离线转成文字和字幕支持 99 种以上语言全程不联网、不上传、不收费。它适合什么、不适合什么Buzz 的边界很清楚先对号入座再决定装不装。能转写 MP3、WAV、FLAC、MP4、AVI 等主流音视频文件还能直接粘贴 YouTube 链接拉取音频能麦克风实时转录边说边出字支持投到演示窗口能导出 TXT、SRT、VTT 三种格式多人对话可做说话人识别不能处理速度取决于你本机硬件没有服务器帮你加速不能默认纯离线只有你主动选用 OpenAI API 后端时才走网络一句话本地算力换隐私和免费这是它唯一的代价。从安装到第一次出结果第一次使用只需五步全程不超过 10 分钟。安装。Windows 从官网下载安装包双击后如提示未签名点更多信息 → 仍要运行macOS 装 .dmgLinux 执行flatpak install flathub io.github.chidiwilliams.Buzz或安装 snap 包。导入文件。点工具栏按钮或按 CtrlOmacOS 为 CmdO也可以直接把文件拖进窗口。选参数。在导入行上选择任务Transcribe 或 Translate to English、语言和模型不确定语言就先保持Detect Language。点运行。任务进入队列多文件会自动排队主界面随时能看到进度。看结果。状态变为 Completed 后双击该行打开转录窗口逐句查看、搜索、复制或导出。三个高频场景照着做会议边开边记目标开会不用人肉记笔记。选 Transcribe 任务、指定会议语言比如中文、模型用 tiny 或 base 保实时速度点 Record 开始录音文字即说即出。若需要大屏展示直接打开演示窗口。散会后得到的是一份带时间戳的逐句纪要多人会议可再开启说话人识别区分发言人。给视频配字幕目标把 40 分钟的 MP4 变成可直接导入剪辑软件的 SRT。导入文件时把 Export As 勾上 SRT同时开启 Word-Level Timings模型选 small 或 medium。转完后打开转录窗口点 Resize设定单条字幕最大长度让 Buzz 按标点重新断句。导出后行宽统一直接拖进剪辑工具。整理访谈素材目标批量处理十几小时访谈录音。把文件导入后在高级设置Advanced…的 Initial prompt 里填上人名、术语识别准确率肉眼可见地提升多人访谈开启说话人识别他说她说变成受访者/主持人。导出 TXT 后就能直接进内容分析环节不用再对着录音逐段回听。参数速查与调优核心参数就四个记住这张表基本够用参数建议取值适用情况一句话理由任务类型Transcribe / Translate to English母语材料 / 外语转英文翻译任务会把非英语内容统一转成英语文本语言手动指定已知语言知道说的是什么语言时自动检测靠前几秒猜测手动指定更稳模型small / medium日常转录甜点档速度与精度的平衡点Tiny 求快、Large 求准输出格式TXT SRT 多选既要看稿又要配字幕一次处理多份产出三条经验NVIDIA 显卡记得用 CUDA 加速版本速度差数倍Apple Silicon 直接装优化版杂音环境勾上 Extract speech 先把人声提出来再转。批量与自动化三个工具帮你把重复劳动交出去。文件夹监控设好一个目录新音频落进去就自动开始转录适合每天更新播客的固定工作流。插件系统Help → Plugins 里按需开关内置 AI 摘要、字幕整形、跳过已转录、增强语言检测、导出 DOCX、降噪等其中跳过已转录能让你重复导入整个文件夹也不浪费算力。命令行给脚本党留了完整的 CLI 入口比如# 转录并一次导出 SRT/VTT buzz add --task transcribe --model-type whispercpp --model-size small --srt --vtt interview.mp3 # 指定语言批量翻译 buzz add --task translate --language zh --model-type whispercpp *.mp3常见问题必须联网吗不用。所有推理都在本机完成只有选用 OpenAI API 后端时才需要网络。支持多少种语言99 种以上中、英、日、法、德等主流语言全覆盖识别与翻译都支持。速度多快取决于音频时长、模型大小和硬件。带 GPU 的机器配 small 及以上模型通常能到实时甚至更快。能转多长的音频没有硬性上限几秒到几小时的录音都能处理。结果保存在哪与源音频同目录扩展名由你勾选的格式决定另可在 Buzz 数据库中随时回看。现在就可以开始打开安装向导装好 Buzz把第一段录音拖进窗口五步之后你就会拿到一份可搜索、可导出的文字稿——比现在花十分钟打几百字搜索关键词划算得多。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价