只输一句话,3分钟出片:Pixelle-Video AI短视频生成工具上手实录
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
Pixelle-Video 是一款 AI 短视频生成工具:你只丢给它一个主题,它自动写文案、配 AI 插图、合成配音、加上 BGM 并渲染成片。这篇面向零剪辑基础的你,记录从克隆仓库到产出第一条视频的全过程,顺带讲清三个真正跑通的用法和踩坑点。
做一条 60 秒视频,为什么要花一整晚
先看一个很常见的处境:
- 文案要自己憋,憋到晚上十点还是不顺口
- 配图要去图库翻,翻出来的素材总差点意思
- 最后还要卡在剪辑时间轴上,对字幕、调音量,一晚上就没了
问题不在你不够用心,而在于"写、找、剪、配"这几件事被塞进了同一条流水线。Pixelle-Video 干的就是把这条流水线拆开、每段交给一个模型自动完成。你只负责定主题和挑风格,剩下的它自己走。
下面用我的真实操作记录给你走一遍。
从克隆到出片:我的第一次生成实录
我按下面三步走的,全程命令不超过 3 行:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py白话就是:把仓库拉下来、进目录、用uv起 Streamlit。跑起来后浏览器会自动打开http://localhost:8501,左边是配置和输入区,右边是预览区。
第一次生成我做了这几步,预期反馈如下:
- 展开「系统配置」,选一个 LLM 预设(我选了通义千问),填好 API Key,点保存。
- 在「内容输入」里选「AI 生成内容」,主题填「为什么要养成阅读习惯」,分镜保持默认 5 个。
- 语音用默认 Edge-TTS,模板选竖屏
image_default.html。 - 点「生成视频」,右侧进度条依次走过"文案 → 配图 → 配音 → 合成"。
5 个分镜的视频我这边 3 分多钟出片,一条约 40 秒的竖屏片子,成品落在output/目录。
⚠️ 我踩的一个真实坑:uv run这行依赖本机已装uv。我第一台机器没装,脚本直接报command not found,卡了十几分钟才反应过来。解决办法是先装好uv(它会自动建虚拟环境并装依赖),再跑上面那行命令。装好之后这一步就很顺。
3 个我真正跑通的用法
下面是我实际生成过、效果能直接发出去的三类,按"输入什么 → 产出什么 → 适合发到哪"来说:
用法一:读书号日更竖屏
- 输入:主题「为什么要养成阅读习惯」,默认 5 分镜,竖屏
image_default模板。 - 产出:一条约 40 秒竖屏视频,每句话配一张水墨风插图,配音节奏平稳。
- 适合发到:抖音、小红书,做日更素材,每天换一个书主题就能稳定产出一条。
用法二:金句卡片,不配图也能出片
- 输入:一段你写好的固定文案(按行分隔),选
static_开头的纯文本模板。 - 产出:纯文字卡片视频,没有 AI 配图这一步,所以生成更快、也不依赖任何图像服务。
- 适合发到:朋友圈、公众号头图,做金句、提醒类内容,新手跑通全流程最稳的选项。
用法三:产品介绍横屏
- 输入:主题「我的机械键盘体验」,选横屏模板,分镜数拉到 4 个左右。
- 产出:一条横屏介绍片,画面走深色科技风,重点落在产品卖点。
- 适合发到:B站、YouTube,做产品开箱或功能讲解的开场片。
改两处,就能换掉视频长相
不用改代码,最常动的就这两处:
1. 模板外观(改 HTML 里的 CSS)所有模板都在 templates/ 下,按分辨率分文件夹:1080x1920/竖屏、1920x1080/横屏、1080x1080/方形。想调文字颜色、字号、位置,直接打开对应.html改里面的 CSS 即可。比如把横屏image_film.html的背景换成品牌色,整条片子的气质就变了。模板开发细节可看 docs/zh/user-guide/templates.md。
2. 生成风格(改提示词前缀和分镜数)在 config.example.yaml 里,comfyui.image.prompt_prefix控制每张配图的统一画风(默认是一段"火柴人简笔画"风格描述),template.default_template定默认模板。分镜数量则在界面里调,分镜越多片子越长。改完点「保存配置」,下次生成即生效。
花钱方案怎么选:本地 / 云端 / 混合
三条路线各给一句明确建议:
| 方案 | 组合 | 单条成本 | 适合谁 |
|---|---|---|---|
| 本地免费 | Ollama + 本地 ComfyUI + Edge-TTS | 0 元 | 有 6GB 以上显存的显卡,想长期白嫖 |
| 云端付费 | 通义千问 + RunningHub 图像/视频 | 按需计费 | 没有本地显卡,不想维护环境 |
| 混合搭配 | 日常走本地、重要内容走云端 | 介于两者之间 | 既要省钱又要保证关键片子的质量 |
一句话建议:有显卡就先上全本地,跑通再谈升级;没显卡直接云端起步,别在装环境上耗时间。
翻车自救:4 个高频问题的排查顺序
生成直接失败
- 先看进度条停在哪一步,是文案、配图还是合成。
- 停文案 → 查 LLM 的 API Key 和网络;停配图 → 查图像服务配置。
- 在「系统配置」里点「测试连接」,确认服务真的通。
- 都不通时,重跑一次,偶发的 API 抖动经常就过去了。
画面质量不行
- 先换更高质量的图像工作流(workflows/ 下有多个可选)。
- 在提示词前缀里补上质量词,比如"4k, high detail, professional"。
- 仍不满意再调采样步数、CFG 这类参数,别一上来就猛调。
配音听着假
- 换个 TTS 工作流试,音色差别很大。
- 语速调到 0.8–1.2 之间,通常更自然。
- 想要专属声音,上传参考音频做克隆,见 docs/zh/getting-started/quick-start.md 的下一步链接。
ComfyUI 连不上
- 确认 ComfyUI 进程还在跑。
- 核对地址,本机默认
http://127.0.0.1:8188。 - 点「测试连接」验证;Docker 里跑的话,地址要换成
host.docker.internal:8188。
把第一片跑出来
Pixelle-Video 把"写、找、剪、配"这条流水线拆开交给模型,你只管定主题和挑风格。下一步不用想太多:先拿「我的书桌改造」当测试题,用默认竖屏模板跑一条,全程不超过 5 分钟,跑通之后再谈调风格和上批量。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考