2026/9/30 2:22:25

Pixelle-Video:AI短视频引擎安装、核心功能与进阶调优

Pixelle-Video:AI短视频引擎安装、核心功能与进阶调优 Pixelle-VideoAI短视频引擎安装、核心功能与进阶调优【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个开源的 AI 短视频生成引擎输入一个主题它自动完成文案撰写、AI 配图、语音合成和视频合成全程不需要剪辑软件或设计经验。本文从安装、首次出片讲起再拆解流水线、模板、工作流三个核心模块最后覆盖进阶用法、调优参数与落地场景目标是让你看完能跑起来、能看懂核心逻辑。 快速上手前置需要uvPython 包管理器和ffmpeg音视频合成用macOS 用 brew 安装、Debian 系用 apt 安装然后克隆项目并启动 Web 界面git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py启动后浏览器打开 http://localhost:8501界面是三栏布局左栏内容输入主题/固定脚本/BGM中栏语音与视觉设置右栏生成按钮和预览区。首次使用要展开「系统配置」面板填两类信息LLM 的 API Key负责文案生成以及媒体生成服务本地 ComfyUI 地址、RunningHub API Key、或直连模型供应商三选一。也可以把仓库根目录的config.example.yaml复制为config.yaml直接填好文件里对 base_url 和模型名都有预置注释照抄即可。第一次完整体验只需 4 步内容输入区选「AI 生成内容」输入主题如「为什么要养成阅读习惯」默认 5 个分镜语音设置选默认 Edge-TTS视觉设置选默认图像工作流和竖屏1080x1920/image_default.html模板点「生成视频」右侧实时显示「生成文案 → 逐分镜配图 → 合成语音 → 合成视频」四段进度2~5 分钟后视频自动播放文件保存在output/目录。 核心能力拆解两种生成流水线从零创作与自定义素材核心逻辑在pixelle_video/pipelines/目录两条主流水线标准流水线standard.py适合从主题出发创作。LLM 先把主题拆成 5 个可配置短解说为每条解说生成配图提示词再逐分镜并行生成 TTS 音频和 AI 配图用 HTML 模板合成帧最后 ffmpeg 拼接并混入 BGM。也支持「固定文案」模式粘贴现成脚本按段落/行/句子自动分镜跳过 AI 写稿环节。自定义素材流水线asset_based.py适合已有素材。上传自己的照片或视频AI 分析内容后按素材写脚本、把每个场景匹配到对应素材再配上解说合成视频。想用自己的产品图、店铺照片出片就走这条线。两条流水线共用基类linear.py的模板方法各阶段文案、配图规划、素材生成、合成都可单独覆写扩展新流水线只需重写对应步骤。模板系统三种尺寸与三种类型视频的视觉形态由templates/目录的 HTML 模板决定命名前缀对应三种能力static_*.html纯文字版式、不生成配图速度最快成本最低image_*.html用 AI 图做背景video_*.html用 AI 生成视频做背景。按尺寸分三组尺寸模板数适用平台1080x1920 竖屏25抖音、TikTok、Instagram Reels1920x1080 横屏5YouTube、B站、视频号1080x1080 方形1Instagram、小红书Web 界面按尺寸分组选择模板选中前可预览效果。配图的提示词前缀控制整体画风默认是黑白火柴人简笔画风格换成卡通、胶片等英文风格描述即可改变全部配图观感。会写 HTML 的话往templates/对应尺寸目录放新模板文件即可被自动识别。工作流与模型层ComfyUI、RunningHub 与直连 API媒体生成能力统一抽象为「工作流」workflows/目录的 JSON 文件分两套runninghub/云端工作流只需配 API Key无需显卡覆盖 Flux、Qwen、SDXL 生图和 Wan 2.2 生视频selfhost/本地工作流需要自部署 ComfyUI默认 http://127.0.0.1:8188。还可以绕开 ComfyUI 直连厂商 APIconfig.example.yaml的api_providers段覆盖 OpenAI、DashScope、火山 ARKSeedream/Seedance、可灵每家可单独开关本地代理适合必须走代理的环境。语音层同理默认selfhost/tts_edge.jsonEdge-TTS免费在线可换 Index-TTS本地部署支持声音克隆。⚙️ 进阶用法与调优数字人口播在 Web 界面切换到数字人流水线上传人物图后系统生成该人物口播脚本的视频适合课程介绍、品牌宣传。对应工作流在workflows/runninghub/digital_*.json。图生视频与动作迁移图生视频流水线web/pipelines/i2v.py把静态图变成视频片段动作迁移流水线web/pipelines/action_transfer.py上传参考视频和图片把视频里的动作如舞蹈迁移到新角色上适合做趣味和宠物内容。声音克隆与多语言语音设置里上传参考音频MP3/WAV/FLAC支持克隆的工作流如 Index-TTS会用该音色配音Edge-TTS 自带 10 余种语言音色做韩语、英语口播直接选对应音色即可。批量生成与历史History 页面web/pages/支持连续创建多个视频任务任务的元数据和分镜会持久化到磁盘方便回看参数和复跑。常用调优参数参数推荐区间说明n_scenes 分镜数4~8默认 5分镜越多视频越长、调用成本越高tts_speed 语速1.0~1.5默认 1.2解说仓促时调低runninghub_concurrent_limit1~10RunningHub 分镜并发数默认 1有配额可上调常见问题生成慢或超时 → 多为图像生成或 LLM API 响应慢 → 换响应更快的直连 API 工作流或减少分镜数先确认网络与代理正常。配图与内容不符 → 提示词前缀风格干扰 → 把前缀改成更具体的英文风格描述或换更强的生图模型。语音机械、读错字 → Edge-TTS 默认音色不合适 → 换音色或用参考音频走 Index-TTS 克隆。选不到某个模板 → 文件命名不符合规范 → 文件名须以static_/image_/video_开头并放入对应尺寸目录。拼接视频报错 → 缺少 ffmpeg → 按平台安装后用ffmpeg -version验证。 落地参考个人博主需要日更一个固定主题账号。用 AI 生成模式输入选题竖屏image_default.html模板 3 分钟出 5 分镜成片直接发抖音或视频号想固定口吻就切固定脚本模式复用同一套模板参数。电商运营需要把产品图库变成推广短视频。走自定义素材流水线上传 5~10 张产品图AI 写脚本并自动匹配素材产出口播式推广视频换模板即可做 A/B 测试。教育机构新课上线需要课程介绍和数字人口播。标准模式生成课程脚本后切数字人流水线用讲师形象出讲解视频产出公众号或小程序用的课程介绍片。制作环节传统方式Pixelle-Video文案2~4 小时LLM 数秒生成配图/素材1~2 小时AI 逐分镜生成配音录制1 小时TTS 自动合成剪辑合成3~5 小时自动拼接混音合计7~12 小时2~5 分钟 资源索引README.md项目总览、功能清单、快速开始与 Web 界面完整使用说明config.example.yaml完整配置模板LLM、直连 API 供应商、ComfyUI/RunningHub 都有预置项复制改名即可docs/zh/中文文档getting-started 下有安装、配置、快速上手user-guide 下有模板与 API 指南templates/按尺寸分组的全部视频模板配套效果图在docs/images/workflows/RunningHub 与自托管的 ComfyUI 工作流 JSON含生图、生视频、TTS、素材分析四类bgm/把自定义背景音乐文件放这里即可在 Web 界面选择output/目录生成视频与任务中间文件的默认保存位置首次生成后自动创建个人博主建议从 Edge-TTS 加 RunningHub 生图工作流起步零本地环境即可出片本地有显卡可上 ComfyUI 自托管实现全流程免费想扩展功能的开发者先读pixelle_video/pipelines/linear.py弄清各阶段的覆写方式再动手。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考