资讯动态

如何用FunClip把长视频自动剪出精华片段:本地AI视频剪辑实战入门

发布时间:2026/9/24 16:22:39 来源:尧图企业网站定制
如何用FunClip把长视频自动剪出精华片段本地AI视频剪辑实战入门【免费下载链接】FunClipFunASR-powered video transcription, subtitle generation, and LLM-assisted clipping tool with a local Gradio UI.项目地址: https://gitcode.com/GitHub_Trending/fu/FunClip一场两小时的会议或访谈结束后最耗时的往往不是剪辑本身而是找到值得保留的片段翻时间轴、记时间点再回剪辑软件里逐段裁切。FunClip把这条链路压缩成一次点击它是一款完全开源、本地部署的自动化视频剪辑工具先用FunASR Paraformer系列模型把整段视频转写成文字并标注每句时间戳你只需从识别结果里复制需要的文字点一下按钮就能拿到对应的视频片段和SRT字幕。安装依赖并启动本地服务FunClip的基础功能只依赖一个Python环境安装一共三条命令git clone https://gitcode.com/GitHub_Trending/fu/FunClip cd FunClip pip install -r requirements.txt首次启动时会单独下载模型权重第一次比之后慢建议在稳定网络下先跑一遍。服务启动参数按素材语言选python funclip/launch.py # 默认中文Paraformer python funclip/launch.py -m fun-asr-nano # 高精度转写支持普通话、英语、日语、7类方言、26种口音 python funclip/launch.py -m sensevoice # 多语种识别输出情绪与音频事件标签 python funclip/launch.py -l en # 英文视频Paraformer-Large是当前识别效果最好的开源中文ASR模型之一Modelscope下载量超过1300万次并支持一体化时间戳预测。注意需要精确按文本裁剪时请保留默认的Paraformer因为发布的Fun-ASR-Nano checkpoint不提供可靠的字符级时间戳。在网页界面完成第一次视频剪辑进入界面后从上传到出片共6步上传视频文件视频与音频识别在同一页面完成可选填写热词专有名词、技术术语、人名都可以填识别时会被优先命中点击「识别」开始语音识别多人出镜时点「识别区分说话人」每句会带上说话人ID把需要的文本段复制到「待裁剪文本」多段用#连接或直接填spk0、spk0#spk3按说话人提取可选调参数开始/结束位置偏移范围 -500 到 1000 毫秒用于在目标段落前后多留或裁掉一点字幕字体大小 10 到 100默认 32颜色四选一点「裁剪」或「裁剪字幕」得到结果除了裁剪出的视频或音频页面还会自动输出两份SRT全视频字幕和目标段落字幕不需要再单独对齐时间轴。三种剪辑方式怎么按素材选文本片段裁剪适合网课、讲座里提取某一段讲法最常用专有名词多时建议配合热词识别准了复制才准。说话人裁剪适合访谈、圆桌底层是CAM说话人识别模型按ID直接抽走某位发言人的全部段落。LLM智能裁剪不知道精彩点在哪时让大模型读完整份SRT再推荐段落适合把长视频做成短视频精华包。前两种在「文本/说话人裁剪」标签页完成第三种在「LLM智能裁剪」标签页。实战场景三类素材的剪法多人访谈只剪一位发言人的部分勾选「识别区分说话人」后识别结果每句带说话人ID。输入spk1就剪出这个人的全部段落输入spk0#spk2则合并两个人的内容。一小时圆桌里某位嘉宾的发言不用逐帧翻找就能单独成片。让大模型帮你挑精彩片段v2.0.0加入LLM剪辑识别完成后在下拉框选模型内置 deepseek-chat、qwen-plus、gpt-3.5-turbo、gpt-4-turbo 等填入apikey点「LLM推理」FunClip会自动把prompt与视频SRT拼接提交再点「AI Clip」按大模型输出的时间戳直接裁剪。默认prompt要求输出不超过4条「1. [开始时间-结束时间] 文本」格式的片段可按你的需求改写。界面提供三种调用方式阿里云百炼qwen系列、OpenAI官方api以及通过g4f集成的免费通道。g4f可能不稳定或返回很慢追求稳定建议自备key。另外内置的pegasus1.5选项走TwelveLabs Pegasus它直接对视频画面音频做理解推理在字幕信息不够动作、场景切换时也能挑出片段使用前需pip install twelvelabs并配置其apikey。命令行调用把裁剪接进批处理不想开浏览器时funclip/videoclipper.py支持两步命令行python funclip/videoclipper.py --stage 1 --file video.mp4 --output_dir ./output python funclip/videoclipper.py --stage 2 --file video.mp4 --output_dir ./output \ --dest_text 要提取的句子 --output_file ./output/res.mp4stage 1 完成识别结果与全量SRT落在./output/stage 2 按文本裁剪还可传--start_ost、--end_ost控制起止偏移。常见报错排查服务起不来或识别结果异常老版本用户先执行pip install -U funasr1.3.29该版本修复了SenseVoice路径下空时间线和短尾语音的问题。视频上传很慢或卡死同一端口的界面开了多个关闭多余窗口只保留一个。裁剪位置与文字对不上复制的文本要和识别结果逐字一致含标点专有名词、人名识别错的加上热词重新识别。字幕烧录不出画面「裁剪字幕」属于可选功能需要系统装好ffmpeg和imagemagick仓库已带字体文件font/STHeitiMedium.ttc。g4f模型无响应或超时该通道本身不稳定换用已填key的qwen或OpenAI系列模型。功能边界与后续可关注的内容先把边界说清楚适合本地私有素材、多段自由剪辑、需要同时产出SRT字幕的场景不适合纯CPU或边缘设备的离线转写FunASR社区另有GGUF运行时、用Fun-ASR-Nano做精确文本裁剪请换Paraformer。后续可以关注仓库施工中清单里有反向时间段选择给出要留的段落、自动选出其余部分和静音段落移除两项未完成功能。v2.1.02026/07/24是项目首个带版本号的发布打包为带SHA-256校验的源码归档发布说明见 docs/releases/v2.1.0.md。源码采用MIT许可模型权重单独下载遵循各模型页面条款。【免费下载链接】FunClipFunASR-powered video transcription, subtitle generation, and LLM-assisted clipping tool with a local Gradio UI.项目地址: https://gitcode.com/GitHub_Trending/fu/FunClip创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价