Pixelle-Video:输入主题自动出片的短视频引擎
Pixelle-Video 是阿里开源的 AI 全自动短视频引擎:输入主题自动写文案、配图、配音并合成成片,Apache-2.0 可商用。
项目资料
GitHub Ecosystem- 许可证
- Apache-2.0
- 主语言
- Python
- 星标
- 28,572
- 核查时间
- 2026-10-02
以上快照资料以核查当日为准,可能随版本或运营策略变化。
做知识口播、产品介绍这类短视频,写文案、找图、配音、剪辑是一条流水线,手工跑一遍半天就没了。阿里巴巴 AIDC-AI 团队开源的 Pixelle-Video 把这条流水线压成一个输入框:给一个主题,比如「为什么要养成阅读习惯」,它自动写脚本、逐分镜生成配图或视频片段、合成解说音,再拼上字幕和背景音乐直接输出成片,全程零剪辑经验要求。视频号「赛博煎蛋」9 月 26 日推荐的「开源 AI 全自动视频剪辑」就是它,截至 2026-10-02 仓库有 28,572 星。
![]()
核心功能
- 主题直出成片:流程是文案生成 → 配图规划 → 逐帧处理 → 视频合成,README 的界面截图里一条 10 分镜、1080×1920 的成片生成耗时 234 秒;手里有现成文案就切「固定文案」模式,跳过 AI 写稿。
- 画面全部 AI 生成:默认走本地 ComfyUI 的 FLUX 工作流出图,也能直连 DashScope、OpenAI、Seedream、Seedance、Kling 这些图像或视频 API;风格靠提示词前缀统一。不像同类工具 MoneyPrinterTurbo 那样抓网络素材,画面没有素材版权问题。
- 语音与克隆:Edge-TTS 免费开箱即用;Index-TTS 支持上传参考音频做声音克隆;TTS 同样是可替换的 ComfyUI 工作流。
- 模板即布局:static、image、video 三类 HTML 模板决定画面排版,覆盖竖屏、横屏、方形三种尺寸;模板就是普通 HTML 文件,懂前端可以自己写。
- 扩展流水线:数字人口播、图生视频、动作迁移三个扩展模块,上传参考视频和图片即可做动作迁移。
整条流水线是这样的:
![]()
典型使用场景
- 个人创作者批量做知识口播、营销号:不出镜、不学剪辑,主题丢进去等成片,一天能铺多条。
- 有文案和自有素材的运营:固定文案加「自定义素材」流水线,上传自己的照片和视频,AI 分析素材生成脚本再合成。
- 开发者搭自动化内容管线:图像、视频、TTS、VLM 都是可替换的原子能力,工作流和模板都是文件夹里的文件,能版本化、能换供应商。
快速上手
Windows 用户直接从 Releases 下载一键整合包,解压运行,不用装 Python、uv 和 ffmpeg,首次使用在「系统配置」里填好 API Key 即可。macOS 和 Linux 走源码,先装 uv 和 ffmpeg:
git clone https://github.com/ATH-MaaS/Pixelle-Video.git
cd Pixelle-Video
uv run streamlit run web/app.py
浏览器打开 WebUI,在「系统配置」里选 LLM(通义千问、GPT、DeepSeek、本地 Ollama 都行)并配置生图服务(本地 ComfyUI 或直连 API),输入主题点「生成视频」。README 给的完全免费方案是 Ollama 加本地 ComfyUI,一分钱不花。
小结
想批量产出短视频、能接受 AI 插画质感的创作者和运营,可以把它当默认选项试一试:比它更早的 Story-Flicks 只有 AI 配图一条路,Pixelle-Video 的画面能扩展到视频片段、数字人和动作迁移。手里已有成片、只想自动剪高光的,去看 AutoClip。
三个注意:本地免费档要 NVIDIA 显卡跑 ComfyUI,没卡就得走通义千问加云端的付费路线;上游节奏放缓,最后一次代码提交在 2026-06-14,最近的 release 还是 2026 年 1 月的 v0.1.15 整合包,GitHub 组织也已从 AIDC-AI 更名为 ATH-MaaS(旧链接自动跳转);知乎的评测提醒过,AI 插画风格容易同质化,纯 AI 内容在部分平台可能被限流。Apache-2.0,Python。