Pixelle-Video 零基础教程:5 分钟做出第一条全自动 AI 短视频
2026/9/4 12:43:21 网站建设 项目流程

Pixelle-Video 零基础教程:5 分钟做出第一条全自动 AI 短视频

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

输入一个主题,约 5 分钟后得到一条带解说、配图、背景音乐的完整短视频——不写稿、不找素材、不剪辑。这就是开源 AI 全自动短视频引擎 Pixelle-Video 的常态。本教程按安装、首跑、配置、进阶的顺序讲清楚。

是什么,给谁用

Pixelle-Video 是一个开源 AI 短视频生成工具:你给一个主题,它自动完成文案、AI 配图、解说、BGM 与合成,默认产出 1080x1920 竖屏成片,也支持横屏与方形尺寸。以下三类人可以直接上手:

  • 知识博主与自媒体运营:不用写脚本、不用剪辑,按主题批量产出视频;
  • 电商与企业用户:快速生成产品介绍、知识讲解类视频;
  • 技术新手:不写代码,通过浏览器界面跑通一条 AI 视频流水线。

成片从哪来:五步流水线

生成过程是一条五步串行流水线,界面里的进度条按同样顺序走。

1. 文案——LLM(大语言模型)把你的主题拆成带画面感的分镜脚本,每句话对应一帧。已有现成稿子时,切到「固定文案内容」模式直接粘贴,跳过这一步。

2. 配图——系统为每个分镜生成一张插图,再套进 HTML 画面模板合成画面。templates/ 按竖屏、横屏、方形分类存放了 30 多套模板,例如书籍风画面适合读书类内容:

3. 配音——TTS(文字转语音)逐镜合成解说,支持 Edge-TTS(免费)与 Index-TTS(可声音克隆)等方案,全部可选音色见 pixelle_video/tts_voices.py。

4. BGM——选内置音乐,或把自己的 MP3/WAV 放进 bgm/ 文件夹即可在界面直接选用。

5. 合成——画面、语音、音乐合成最终视频,自动保存到 output/ 文件夹,完成后界面可直接预览时长、大小与分镜数。横屏电影风模板的成片画面如下:

最快跑通路径

路线 A:Windows 一键整合包

  1. 从项目 Releases 页面下载最新 Windows 一键整合包并解压,Python、ffmpeg 等依赖全部内置;
  2. 双击start.bat,浏览器自动打开 http://localhost:8501;
  3. 在界面展开「⚙️ 系统配置」,选一个 LLM 预设(如通义千问),填入 API Key 后保存;
  4. 在左侧输入框敲一个主题,点「🎬 生成视频」。

预期结果:进度条依次走完文案、配图、语音、合成,5 分镜视频通常 2-5 分钟,成片保存在 output/ 文件夹。

路线 B:源码运行(macOS / Linux)

先安装 uv 与 ffmpeg,然后执行:

git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py

浏览器会打开 http://localhost:8501,后续配置与生成步骤和路线 A 相同。首次运行 uv 会自动安装依赖,可能多花几分钟。

三种部署方案怎么选

方案适合谁关键配置大致成本一句话点评
完全免费有本地显卡Ollama 本地 LLM + 本地 ComfyUI0 元数据不出本机,显卡是唯一门槛
云端经济无显卡、预算有限通义千问 + RunningHub 云端工作流每条约几毛钱以内不用搭环境,性价比最高
专业混合追求画质与效率GPT 类 LLM + 直连 API 图像/视频模型按量付费最灵活,要配多家供应商密钥

两个高频配错点:

  • 只填了 api_key,忘了 base_url——现象:LLM 一直报错,文案生成起不来。正确做法:把 config.example.yaml 复制为 config.yaml 时,base_url、api_key、model 三项都填齐;或在界面直接选预设,字段会自动填充。
  • 工作流前缀混用——workflows/runninghub/ 下的工作流要填 RunningHub API Key,workflows/selfhost/ 下的工作流要能连上本地 ComfyUI(默认 http://127.0.0.1:8188)。混用会一直卡在「生成配图」这一步。

用熟之后的三个技巧

克隆自己的声音。目标:把通用 AI 音换成自己的声线。做法:在语音设置上传一段短参考音频(MP3/WAV/FLAC),选支持克隆的 TTS 工作流,如 Index-TTS。效果:所有解说用「你」的声音产出,账号辨识度明显提升。

用提示词前缀锁死全片画风。目标:避免各分镜配图风格漂移。做法:在配置的 image.prompt_prefix 里填英文风格描述,例如 "Minimalist black-and-white matchstick figure style illustration, clean lines",它会自动拼在每次生图提示词前。效果:整条视频像出自同一位设计师之手。

把静态素材变成动态镜头。目标:让照片、产品图出现在动态画面里。做法:使用「图生视频」「动作迁移」扩展工作流,提供参考视频与一张图片。效果:单个镜头立刻有动感,适合历史素材与产品展示。

资源入口

  • docs/zh/:中文官方文档,覆盖安装、配置、快速开始、自定义风格、声音克隆
  • templates/:按 1080x1920、1920x1080、1080x1080 分类的画面模板,改 HTML 即可定制品牌风格
  • workflows/runninghub:云端 ComfyUI 工作流(图片、视频、TTS 全套)
  • workflows/selfhost:本地 ComfyUI 工作流
  • pixelle_video/tts_voices.py:全部支持的音色清单
  • config.example.yaml:配置文件样例,复制为 config.yaml 填入密钥即可

现在就启动

如果你的处境是「内容很多、时间很少」,Pixelle-Video 是最低门槛的 AI 短视频批量生产入口:不需要剪辑技能,第一条视频约 5 分钟。打开终端执行uv run streamlit run web/app.py,输入一个你早就想讲的主题,你的第一条 AI 短视频只差一次点击。

【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询