Pixelle-Video 完整指南如何 3 步从一个主题生成 AI 短视频成片【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video你想出一条短视频的选题坐下来却卡住了文案不会写、配图要会提示词、剪辑还得学软件Pixelle-Video 是一个开源的 AI 全自动短视频引擎输入一个主题它自动完成文案、配图、配音、合成四道工序几分钟内产出一条能直接发布的成片。本文按「快速上手 → 风格定制 → 踩坑与花费」三部分带你从装好环境到调出自己想要的画面。它是什么Pixelle-Video 的定位是一台输入主题、输出成片的短视频生成引擎。你只需要给一句话选题它背后会走完四道工序文案生成LLM 把主题扩写成 3~5 个分镜的解说词配图规划每个分镜调用图像模型生成一张对应插图音频合成TTS 把解说词转成语音可再叠一段 BGM 背景音乐视频合成按你选的模板把图、字、音拼成最终成片它的设计思路是模块化解耦四道工序每一环都是可单独替换的模块——文案用通义千问、GPT 还是本地 Ollama 都行配图走本地 ComfyUI、RunningHub 云端或直连 DashScope、OpenAI 等供应商 API语音在 Edge-TTS、Index-TTS 之间切换。换掉任何一环其他环节不受影响。第一部分快速上手安装路径整合包与源码两条Windows 用户走整合包到 Release 页下载 Windows 整合包解压后双击start.bat浏览器会自动打开 http://localhost:8501。包内已带全部依赖不用装 Python、uv 和 ffmpeg首次使用只需在界面里填密钥。macOS / Linux 用户走源码先装好uvPython 包管理器和ffmpeg视频处理工具然后执行 3 行命令git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器弹出 Web 界面说明装好了。首次配置清单打开界面展开⚙️ 系统配置面板按顺序填三处LLM 配置从下拉菜单选一个模型预设通义千问、GPT-4o、DeepSeek、本地 Ollama预设会自动填好 base_url 和模型名你只补API Key。没有显卡建议选通义千问性价比最高有显卡直接选 Ollama走 0 元路线。图像生成想跑本地就填 ComfyUI 地址默认http://127.0.0.1:8188点测试连接验证通过再保存想省事就在「API 媒体模型配置」里填 RunningHub 或 DashScope、OpenAI、Seedream、Kling 的密钥直连云端模型。点保存配置第一步就绪。生成第一条 AI 短视频左侧栏内容输入选「AI 生成内容」输入一个具体主题——越具体越好为什么要养成阅读习惯比读书更容易出好文案。中间栏依次选 TTS 工作流默认 Edge-TTS 即可、图像生成工作流、视频模板新手推荐竖屏 1080×1920。右侧点生成视频按钮。5 分镜的视频大约 2~5 分钟出片界面会实时报进度比如分镜 3/5 - 生成插图。完成后视频自动播放文件存在output/目录。第二部分让它变成你的风格模板怎么选三种尺寸与命名前缀模板决定画面版式全部放在 templates/ 目录按尺寸分三组竖屏 1080×192025 套适配抖音、快手、小红书横屏 1920×10805 套适配 YouTube、B 站方形 1080×1080适配朋友圈、Instagram文件名前缀告诉你它走哪道工序static_*是纯文字静态模板不跑 AI 生图出片最快、零成本新手可以先从这类起步image_*用 AI 生成的图片当背景video_*直接用 AI 生成的视频当背景。每套模板都能在界面里预览并传自定义参数试效果。方形版式紧凑发朋友圈正合适四种替换画风、音色、工作流、模板Pixelle-Video 把能力拆成原子模块每种替换都有明确的操作入口换配图画风图像生成换一套工作流ComfyUI 工作流或api/...直连模型再在提示词前缀里填一段画风描述用英文如 minimalist black-and-white matchstick figure style点预览风格先试再生成全片配图风格随之统一。换音色TTS 工作流在 Edge-TTS、Index-TTS 之间切换选支持声音克隆的引擎后上传一段 MP3/WAV 参考音频AI 短视频就会用你自己的声音说话。换工作流在 ComfyUI 里搭好工作流、导出 JSON丢进 workflows/ 目录界面下拉框里立即可选不用改一行代码。预置工作流分selfhost/本地跑和runninghub/云端跑两套详见 工作流定制文档。换模板复制一个现有 HTML 模板改样式存到对应尺寸目录。模板支持{{ title }}、{{ text }}、{{ image }}三个变量改起来比写代码快。第三部分踩坑与花费排障清单四类故障按现象对号出问题时先定位卡在哪道工序再按表排查故障排查文档 有完整清单现象常见原因处理办法连不上 ComfyUI服务没启动 / 地址填错 / 防火墙拦截确认服务在跑、地址是默认的http://127.0.0.0.1:8188还是你自己改过的界面里点测试连接直接验证LLM 调用失败API Key 错 / 网络不通 / 余额不足按 Key、网络、余额三件事依次核对错误提示通常会直接说明原因出图失败模型没下全 / 磁盘空间不足 / 工作流文件损坏先在 ComfyUI 里手动跑一遍同样工作流跑通再回来看环境TTS 语音失败工作流选错 / 参考音频格式不支持检查 TTS 工作流选择用声音克隆时确认参考音频是 MP3/WAV/FLAC效果不好但不报错就依次拉四个杠杆换 LLM 模型管文案风格→ 调提示词前缀和图像尺寸管画风→ 换 TTS 工作流管音色→ 换模板管版式。成本算账三档方案对比方案成本适合人群Ollama 本地 LLM 本地 ComfyUI0 元有本地显卡的用户通义千问 本地 ComfyUI约 0.01~0.05 元/条大多数用户OpenAI RunningHub 云端较高按调用量计不想维护本地环境有显卡直接走全免费档没有的话通义千问性价比最高一条 3 分镜的 AI 短视频花费不到一瓶水。批量生成前先出一条样本确认效果再跑量能省掉返工烧掉的 API 费用。现在就可以展开系统配置、填好密钥挑一套竖屏模板输入你第一个主题几分钟内拿到一条能直接发出去的成片。更多细节看 官方文档 与 配置示例 config.example.yaml。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考