资讯动态

免费给Audacity装上AI音频处理插件:3分钟上手音乐分离、降噪与语音转文字

发布时间:2026/8/16 17:45:54 来源:尧图企业网站定制
免费给Audacity装上AI音频处理插件3分钟上手音乐分离、降噪与语音转文字【免费下载链接】openvino-plugins-ai-audacityA set of AI-enabled effects, generators, and analyzers for Audacity®.项目地址: https://gitcode.com/gh_mirrors/op/openvino-plugins-ai-audacity上周末我把旅行视频剪好了却发现最想用的那首歌只有带人声的版本——伴奏版要付费网上找的免费资源又全是广告。正发愁时朋友丢给我一个开源项目OpenVINO AI音频插件一套免费装进Audacity的AI音频处理插件集合。它能把歌曲里的伴奏拆出来能给录音降噪、把语音转成文字、甚至用一句话生成背景音乐而且所有处理都在本地完成不联网、不上传任何音频。我试了一晚上决定把完整心得写下来分享给你。认识一下这个插件到底什么来头它是一组专为 Audacity 设计的 AI 效果器、生成器和分析器模块全部基于 OpenVINO 推理引擎驱动能自动利用你电脑上的 CPU、GPU 甚至 NPU 加速。整个插件集成了五种能力音乐分离、噪音抑制、语音转文字、音乐生成与续写以及音频超分辨率增强。听起来很唬人其实装好之后它们只是 Audacity 菜单里多出来的几个选项点开就能用。所有功能代码都集中在项目的mod-openvino/目录下逻辑清晰想深挖实现细节也很方便。三步完成OpenVINO插件安装安装这条路径比想象中省事跟着做基本不会出错。第一步把插件文件放进 Plug-Ins 目录先拉取项目代码git clone https://gitcode.com/gh_mirrors/op/openvino-plugins-ai-audacityWindows 用户最省事的做法是找到 Audacity 安装目录默认是C:\Program Files\Audacity\Plug-Ins\把mod-openvino.dll复制进去。如果你使用的是官方发布的安装包解压后同样是把 dll 丢进去即可完全不需要自己编译源码。第二步在偏好设置里点亮模块启动 Audacity依次进入编辑 → 偏好设置 → 模块找到mod-openvino把它从新改成已启用然后关闭并重新打开 Audacity。第三步装模型做一次热身插件本身不携带 AI 模型。首次使用某个功能时它会先把模型加载并编译到指定设备CPU/GPU/NPU通常要等 1030 秒编译结果会缓存到磁盘之后再用就快多了。Linux 用户用 Snap 一步到位sudo snap install audacity sudo audacity.fetch-models --batch四个拿来就能用的实战玩法给视频剪一支干净的伴奏这是我最常用的功能。框选歌曲中要处理的段落打开效果 → OpenVINO AI Effects → OpenVINO Music Separation在对话框里设置参数分离模式选2-Stem得到人声伴奏两条轨道做卡拉OK伴奏够用了选4-Stem则拆成鼓、贝斯、人声、其他乐器四轨适合精细混音。推理设备有独立显卡就选 GPU速度能快不少。点击应用后稍等片刻工作区里就会多出几条新轨道名字后缀带-Drums、-Bass、-Vocals一眼就能分清小技巧Shifts 参数调高一点分离质量通常更好但处理时间也会按比例变长自己权衡即可。一键清理录音里的杂音录播客、配音时总有空调声、键盘声混进来。打开效果 → OpenVINO AI Effects → OpenVINO Noise Suppression它会直接对选中的轨道做降噪处理。插件内置三种模型DeepFilterNet3效果最好适合对音质要求高的场合DeepFilterNet2效果与速度均衡日常够用DenseUNet兼容性好仅作兼容保留。推荐日常就用 DeepFilterNet2先把一段有噪音的录音放进去听对比不满意再换模型重试。把会议录音变成文字稿这是文字工作者的福音。选中一段人声音频打开分析 → OpenVINO Whisper Transcription选好模型后点击应用下方会自动生成一条带时间戳的标签轨文字和波形严格对齐检索定位非常方便。模型选base处理最快small/medium更准large精度最高非英文语音建议用大模型。支持转写和翻译两种模式翻译模式会把结果统一输出为英文源语言还能设为自动检测中文录音直接可用。用一句话生成背景音乐做视频缺 BGM打开生成 → OpenVINO Music Generation在 Prompt 里写一句描述比如轻快的钢琴曲适合旅行Vlog再设好时长点击生成即可。想延续某段已有的旋律就选中这段音频再生成它会自动开启音频续写模式顺着你的素材往下写。实验阶段建议把时长设短一些比如 5 秒快速试出满意效果后再固定 Seed 重新生成更长版本Guidance Scale保持在 24 之间能在贴合提示词和音质之间取得平衡。让AI跑得更快更顺的几条小经验善用 GPU/NPU 加速首次在某设备上运行功能时需要编译模型约半分钟左右之后会缓存不用担心每次都慢。小片段先行先处理 510 秒的片段验证效果和参数再全量处理省时省力。固定 Seed 复现结果喜欢某次生成的音乐却忘了保存生成参数含 Seed会标注在轨道上照着重来一遍即可。用完卸载模型释放内存音乐生成、超分辨率等对话框里有Unload Models按钮不用时点一下把占用的内存还给系统。老录音可以修复超分辨率功能能把模糊的旧音频增强到 24kHz 带宽、48kHz 采样率人声选 Speech 模型、音乐和环境音选通用模型效果更佳。你可能遇到的问题打开Audacity菜单里压根没有OpenVINO相关选项先回偏好设置的模块页确认mod-openvino已被设为已启用并重启过再检查 dll 文件是否真的放在了 Plug-Ins 目录里。第一次处理为什么卡了快一分钟那是模型在下载和针对你的设备编译属于正常现象。编译结果会缓存在磁盘第二次再跑就明显变快。长音频处理到一半提示内存不足把音频拆成 510 分钟的片段分别处理处理前顺手关掉浏览器等吃内存的程序。分离出来的伴奏总有淡淡的人声残影源文件尽量用 WAV 等无损格式适当提高 Shifts 值多试几次找到适合这首歌的参数。更多资料与交流渠道安装与构建文档doc/build_doc/windows/README.md、doc/build_doc/linux/README.md功能文档doc/feature_doc/ 下按功能分目录包含参数说明和演示视频AI功能源码mod-openvino/遇到问题或想提建议可以在项目 Issues 区反馈也欢迎提交 PR 参与贡献写在最后免费、本地运行、上手简单这是 OpenVINO AI音频插件最打动我的三点。它把专业级 AI 音频处理搬进了人人都会用的 Audacity无论是给视频配乐、清理录音杂音还是把会议变成文字稿都能自己动手搞定。今晚就挑一首你喜欢的歌用 2-Stem 模式把伴奏拆出来给朋友的婚礼视频配一段卡拉OK版再把一段采访录音转成文字稿看看中文识别的准确度如何。试完你会发现音频处理真的没有想象中那么难。【免费下载链接】openvino-plugins-ai-audacityA set of AI-enabled effects, generators, and analyzers for Audacity®.项目地址: https://gitcode.com/gh_mirrors/op/openvino-plugins-ai-audacity创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价