Pixelle-Video 实操指南4 步把一个主题变成一条成品短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video做一条短视频有多费劲脚本要自己写配图要一张张找配音要自己录最后还要在剪辑软件里对齐字幕、卡上背景音乐。Pixelle-Video 做的事就是把这些环节全部接进一条流水线你输入一个主题它依次完成 AI 文案、配图或配视频、语音合成、背景音乐、最终合成产出一个可以直接发布的视频文件。全程不需要剪辑经验你要做的只有选参数、点生成、等结果。它替你省掉了哪几件事把整条链路拆开看Pixelle-Video 自动执行的是 5 个步骤写文案根据主题生成结构完整的解说词不需要你写稿规划分镜把文案按段落、行或句子拆成多个分镜每段对应一个画面逐帧制作为每个分镜生成 AI 配图或 AI 视频片段同时合成语音铺设 BGM叠加内置或自定义的背景音乐合成成片按所选模板排版文字与画面输出视频文件到output/目录其中每个环节都能换引擎文案用哪个大模型、配图用哪套工作流、语音用哪种 TTS都是独立选项后面会展开。3 分钟跑起来分两种情况Windows 用户下载官方整合包解压后双击启动脚本整合包内含start.bat无需安装 Python、uv 或 ffmpeg。Linux / macOS 用户需要先装好uvPython 包管理器和ffmpeg然后克隆仓库并启动git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video ./start_web.sh启动脚本内部执行的是uv run streamlit run web/app.py依赖会自动安装。浏览器打开http://localhost:8501后第一次使用要展开「系统配置」面板选一个 LLM 预设通义千问、GPT、DeepSeek、Ollama 都行填上 API Key如果打算用工作流生图再填 ComfyUI 地址或 RunningHub 密钥。点「保存配置」就可以开始生成。一次完整生成是怎么走的点下「生成视频」之后右侧栏会实时显示当前步骤例如分镜 3/5 - 生成插图。背后走的是固定四步文案生成 → 配图规划 → 逐帧处理 → 视频合成。生成完自动播放预览并显示时长、文件大小和分镜数。而点击生成之前Web 界面的三栏就是你要调的全部参数左侧·内容输入两种生成模式——AI 生成内容只给主题AI 写稿或固定文案内容贴入现成文案跳过创作。BGM 三选一无、内置曲目、或把 MP3/WAV 放进bgm/文件夹当自定义音乐都能先试听再决定中间·语音与视觉TTS 工作流下拉列表会自动扫描workflows/目录Edge-TTS、Index-TTS 等支持上传参考音频做声音克隆并试听图像部分选工作流本地 ComfyUI、RunningHub 云端、或直连 API 模型、设尺寸默认 1024x1024、写提示词前缀统一风格模板下拉按竖屏/横屏/方形分组可点预览看效果右侧·生成与输出进度、预览、成片信息都在这里不同场景怎么选选择逻辑其实就两条线按目标平台定尺寸按内容形态定模板类型。模板文件都放在templates/目录按1080x1920竖屏、1920x1080横屏、1080x1080方形三个分辨率子目录管理命名即类型场景建议尺寸模板类型说明抖音/快手知识科普1080x1920image_*每句配一张 AI 图最常用B 站/YouTube 解说1920x1080image_*或video_*想要动态画面就选视频模板配 Wan、Kling、Seedance 等 API 视频模型Instagram 等社交卡片1080x1080image_*方形构图适合图文感内容纯文字金句、书单类任意static_*不生成任何 AI 媒体只做排版出片最快自己已有照片/视频任意自定义素材模式上传素材AI 分析内容后反推脚本另有几个扩展流水线值得知道数字人口播、图生视频、动作迁移分别对应真人出镜一张图动起来给图片换动作三类需求。要一次做一批视频则用批量模式逐行输入主题配合历史记录页面管理任务。值得知道的几处配置所有配置项以config.example.yaml为模板复制为config.yaml使用或在 Web 界面里改重点看四处llm: api_key: # 密钥 base_url: # 服务商地址 model: # 模型名如 qwen-maxcomfyui段二选一——本地自部署填comfyui_url默认http://127.0.0.1:8188或走云端填runninghub_api_key。两条路决定你的生图/生视频/TTS 算力从哪来api_providers段不用 ComfyUI 时的直连方案支持 openai、dashscope、ark、kling 四个供应商各自填 Key、Base URL 和代理开关template.default_template默认模板例如1080x1920/image_default.html不指定时按它出片图像prompt_prefix英文风格前缀是统一配图画风的关键如统一指定黑白简笔画风格成本方面有个明确的零元组合LLM 用本地 Ollama 图像走本地 ComfyUI 工作流整条链路不花钱有显卡就按这个走没有则 LLM 用通义千问这类低价方案。踩坑记录现象 → 原因 → 解决现象文案啰嗦、跑题、不够口语化原因LLM 预设偏弱或主题写得太宽泛。 解决换更强的模型预设把主题从工作效率改成5 个提升工作效率的实用技巧这类具体问题——输入越具体输出越能用。现象语音听着机械、不像人话原因默认 TTS 工作流的音色不适合该文案。 解决下拉换 Edge-TTS 的其他音色若选 Index-TTS 工作流可上传一段参考音频做声音克隆先用「预览语音」试听再跑全流程。现象每张配图风格都不一样拼起来很乱原因没有统一的风格约束每句提示词各自发挥。 解决在图像设置里填英文提示词前缀锁定画风点「预览风格」确认效果后再正式生成。现象生成到某一步报错失败原因API 密钥失效、网络不通或工作流未配置。 解决回「系统配置」核对 Key 与 Base URL确认对应工作流本地 ComfyUI 是否启动、RunningHub 密钥是否有效看运行日志定位卡在哪一步必要时重启服务。小结Pixelle-Video 的价值在于把写稿、配图、配音、剪辑四段人工劳动压成了选参数、点生成一个动作且每一步的模型都可替换从全本地免费到全云端调用都有对应路径。现在就可以挑一个你最想做的主题跑通你的第一条视频。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考