Pixelle-Video:3步零基础AI视频生成
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
Pixelle-Video 是一款 AI 全自动短视频引擎,输入一个主题,它会自动完成文案创作、AI 配图、语音合成和视频合成。这篇零基础 AI 视频制作教程会带你装好环境、跑通第一条 AI 短视频,并讲清楚模板和工作流怎么自定义。
它到底能干什么
先说说 Pixelle-Video 最实在的几个能力:
- 一句话出成片:只输入主题,AI 自动写文案、配画面、配音,全程不用碰剪辑软件。
- 多种视觉模板:内置竖屏、横屏、方形三种尺寸的 30 多套 HTML 模板,风格从简约到卡通都有。
- 多模型支持:文案可用通义千问、GPT、DeepSeek,本地 Ollama 也支持,按预算选。
- 能力可替换:生图、TTS、视频生成都走 ComfyUI 工作流或直连 API,哪块不满意换哪块。
- 尺寸自由:竖屏 1080x1920、横屏 1920x1080、方形 1080x1080,适配不同平台。
装好并跑起来
准备环境
这一步装两个前置工具:Python 包管理器uv和视频处理工具ffmpeg。
# macOS brew install ffmpeg # Ubuntu / Debian sudo apt install ffmpeguv按官方文档安装即可,装完跑uv --version确认。
安装项目
克隆仓库进目录,后面所有命令都在项目根目录执行。
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-VideoWindows 用户也可以直接下载整合包,双击start.bat启动,跳过后面两步。
最小配置
复制示例配置为config.yaml,至少填好 LLM 三个字段就能生成文案。
cp config.example.yaml config.yamlllm: api_key: "你的API密钥" # 通义千问/DeepSeek/GPT 任选一个 base_url: "https://dashscope.aliyuncs.com/compatible-mode/v1" # 通义千问 model: "qwen-max"配图环节默认走 ComfyUI,如果还没部署,可在 Web 界面里把图像工作流切到runninghub/云端方案。
启动 Web 界面
uv run会自动装好项目依赖,无需手动pip install。
uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501。看到左侧内容输入、中间语音视觉设置、右侧生成按钮的三栏界面,就说明装好了。
第一次使用:跟着做完一个完整流程
我做了一个知识科普短视频,整个过程 5 分钟,步骤如下:
- 展开「系统配置」面板,确认 LLM 和图像生成服务都配好了,点「保存配置」。
- 左侧「内容输入」选「AI 生成内容」,输入主题:「为什么要养成阅读习惯」。
- 中间栏确认 TTS 工作流(默认 Edge-TTS 即可),点「预览语音」先听一段试听效果。
- 视觉设置里保持默认图像工作流,模板选方形的
image_minimal_framed,适合发图文平台。 - 点右侧「生成视频」,看进度条走完:生成文案 → 生成配图 → 合成语音 → 合成视频。
等 2 到 5 分钟,右侧会直接播放成片,视频文件同时保存在output/目录。你得到的是一条带解说和背景音乐的完整短视频,拿去发平台前改个标题就行。
换几个场景试试
知识科普:配书籍风格模板
推荐横屏1920x1080/image_book.html模板,主题越具体越好。
主题示例:"光合作用的过程与意义"。
小技巧:文案生成后可切「固定文案内容」模式,把改好的稿子贴回去重新生成。
产品营销:用科技感横版
推荐1920x1080/image_wide_darktech.html,深色科技感突出卖点。
主题示例:"智能手表的十大实用功能"。
小技巧:在图像设置的提示词前缀里加英文风格描述,可以统一整条视频的配图色调。
情感生活号:方形卡片走量
推荐1080x1080/image_minimal_framed.html,极简排版适合金句类内容。
主题示例:"保持积极心态的五个实用方法"。
小技巧:同一主题换 2、3 套模板各生成一条,发布时直接做 A/B 测试。
想改点东西?看这里
换个视频模板
改模板就能换掉视频的版式和配色,不用动代码。模板按尺寸分目录存放:templates/1080x1920/、templates/1920x1080/、templates/1080x1080/。做法是从现有模板复制一份,改 HTML 和 CSS 里的字体、背景,命名规则保持一致:static_开头纯文字、image_开头用 AI 配图、video_开头用 AI 视频。
换生图或 TTS 工作流
想换配图风格或语音方案,改工作流就行。ComfyUI 工作流 JSON 放在 workflows/selfhost/(本地)和 workflows/runninghub/(云端),在 Web 界面下拉框里直接选新的即可,比如换 TTS 工作流文件就能换语音引擎。
加自己的背景音乐
把 MP3 丢进 bgm/ 目录,左侧内容输入区就能看到,点「试听 BGM」确认效果后选中。
踩过的坑帮你填好了
现象:生成时报「ComfyUI 连接失败」→ 原因:本地 ComfyUI 没启动,或comfyui_url地址不对。 → 解法:启动本地 ComfyUI,检查config.yaml里comfyui.comfyui_url是否为http://127.0.0.1:8188;没有本地环境就把图像工作流切到runninghub/目录下的方案。
现象:生成的视频没有声音→ 原因:TTS 工作流没选对,语音环节实际没执行。 → 解法:中间栏重新选 TTS 工作流(默认selfhost/tts_edge.json),先点「预览语音」,有声音再生成。
现象:卡在「生成文案」一步不动→ 原因:LLM 的 API Key 填错或余额不足。 → 解法:核对config.yaml的llm段三个字段,在系统配置面板点「获取 API Key」链接确认可用性。
现象:画面版式和模板预览对不上→ 原因:选的模板和输出尺寸不是一个分组。 → 解法:重新选模板时注意分组标签,竖屏、横屏、方形各是一组,别混用。
💡 排查时先看两处:项目根目录的api_server.log日志,和output/目录里的任务产物。
省钱与提速
| 方案 | 成本 | 适合谁 |
|---|---|---|
| 免费方案 | 0 元 | 有本地 GPU:Ollama + 本地 ComfyUI |
| 性价比方案 | 低 | 多数用户:通义千问 API + 本地 ComfyUI |
| 云端方案 | 中高 | 不想本地部署:OpenAI + RunningHub |
- 配图优先本地 ComfyUI,比云端快
- 分镜数量调小,直接缩短生成时间
- 批量生成前先试一条样片确认效果
现在就可以克隆仓库,跑通uv run streamlit run web/app.py,然后输入你的第一个主题。
✅ 输入一个主题就能拿到带文案、配音的完整短视频 ✅ 最小配置只填 LLM 三字段,其余保持默认 ✅ 模板、工作流、BGM 都能独立替换 ✅ 本地 GPU 用户可实现 0 元运行
打开终端,试试吧
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考