资讯动态

Pixelle-Video:输入一句话主题,自动配图文和配音的AI短视频成片自己跑出来

发布时间:2026/10/7 2:40:05 来源:尧图企业网站定制
Pixelle-Video输入一句话主题自动配图文和配音的AI短视频成片自己跑出来【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video在「内容输入」框敲下「为什么要养成阅读习惯」点「生成视频」转身去倒杯咖啡。回来时文案、配图、解说、合成四段进度条已依次走完output/目录里躺着一支竖屏成片水墨山峦做画面沉稳的嗓音在念稿底下压着一段轻 BGM。这就是Pixelle-Video一个 AI 全自动短视频生成引擎的日常使用画面。先把最劝退的环境问题交代清楚。没装过开发环境三行命令跑起AI短视频引擎Windows 用户最省事下载官方整合包解压后双击start.bat浏览器会自动打开http://localhost:8501Python、uv、ffmpeg全都打包在里面不用手动装任何依赖。macOS 或 Linux 用户先装好uv和ffmpeg然后在终端执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video uv sync uv run streamlit run web/app.py首次运行时展开「⚙️ 系统配置」面板你只需要填一个 LLM 密钥——通义千问、GPT、DeepSeek、Ollama 都认选预设会自动填好模型地址。图像生成用默认的 RunningHub 云端即可不需要本地显卡。你只负责「填密钥」和「敲主题」两件事剩下它自己跑。从一句话到分镜AI自动生成短视频脚本主题交出去之后大模型产出的不只是一段解说词它顺手把分镜切好了——每个分镜对应一段画面后面的配图和配音都由这份脚本驱动。做知识科普类内容这里藏了个小技巧把 LLM 的temperature调低一些输出会更克制、更有条理适合需要严谨结构的选题。已经有成稿的话直接走「固定文案」模式整段贴进去分割方式支持按段落、按行、按句子三种选按句子切每一句配一张图画面切换更密集短视频的节奏感一下就上来了。 固定文案模式下一句话就是一张图。想让解说不断句就把句子写短一点。画面交给模板从静态配图到动态短片系统会给每个分镜自动生成一张 AI 插画风格完全跟着你选的模板走。templates/目录按分辨率分了三档竖屏 1080x1920、横屏 1920x1080、方形 1080x1080Web 界面里有模板预览先看效果再决定不用凭文件名盲猜。image_book.html的书卷气质压得住知识科普image_film.html的黑底横版则更像正片。说白了模板就是一套 HTML 布局文件文字位置、背景、排版都由它决定想调整风格改改样式就行。如果静态图还不够带感把图像生成切换到 WAN 2.1 这类视频模型每个分镜的画面就真正动起来图文视频升级成动态短片。配音与BGM一次配齐还能克隆你自己的声音TTS 环节内置了 Edge-TTS、Index-TTS 等主流方案下拉选一个旁白就自动配好了点「预览语音」还能先试听。想要更有辨识度上传一段10-30 秒的清晰人声做参考音频选支持克隆的工作流如 Index-TTSEdge-TTS 不支持系统就能克隆这个音色——做系列内容时每条视频都带着同一个个人声音。BGM 同样不操心内置音乐直接选也可以把自己的音频文件放进bgm/文件夹界面上就会出现可选项点「试听 BGM」确认一下再开始生成。一晚跑完十条批量模式的点菜清单批量模式是这台引擎真正的效率放大器。勾选「批量生成模式」每行写一个主题最多 100 个所有视频共用同一套配置开跑前页面会先给出预估总耗时。照着抄就能跑的一份清单模式AI 生成内容 批量模式主题10 行每行一个比如「居家训练」系列十条LLM通义千问图像RunningHub 云端按量付费TTSEdge-TTS模板竖屏image_modern.html1080x1920适配抖音和视频号BGM内置音乐算笔账十条视频手动拍摄剪辑工作量通常是几天起批量模式下一个晚上排完队就能收工。成本上云端图像按张计费加上每条视频几次 LLM 调用总花费远低于一天的人工。批量生成期间保持页面打开跑完的成片会统一进「 历史记录」页方形模板image_minimal_framed.html这类 1080x1080 规格也适合需要多平台铺开的场景。没有独立显卡挑一条适合自己的路两条路径按机器选。只有一台普通笔记本文案走 API图像走 RunningHub 云端按调用付费配音用 Edge-TTS——全程不占本地显卡照样出片。数据默认存在本地output/目录只有调用云端 API 时才发送必要内容。手里有 NVIDIA 显卡LLM 切到本地 Ollama图像生成指向本地 ComfyUI默认http://127.0.0.1:8188语音用 Edge-TTS。整套流程 API 费用为零数据全部留在本机连数据出境的顾虑都省了。几个大家都会犹豫的问题完全没剪辑经验能上手吗能。整个流程被抽象成「输主题—选模板—点生成」全部操作在浏览器里完成不接触任何剪辑软件和代码。生成一支视频要等多久常见耗时几分钟主要取决于 LLM 响应速度、图像生成的排队情况和网络状况批量任务会依次排队开跑前还会显示预估总耗时。数据会被上传到第三方吗数据默认保存在本地output/目录只有调用云端 API 时才会发送必要数据走本地 Ollama ComfyUI 路线可以做到数据完全不出本机。能商用吗项目采用 Apache License 2.0 协议可以自由使用与二次开发个人创作者和中小团队都能直接搬进自己的内容生产线。视频制作里最硬的那块环节被拆掉了剩下选题、表达和对画面的判断这些是你的主场。你第一个要生成的主题想好了吗【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价 →
↑