尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

Pixelle-Video 快速上手指南:只输入一个主题,5 分钟生成完整 AI 短视频

发布时间:2026/9/30 1:51:36

资讯中心
01
ARTICLE

Pixelle-Video 快速上手指南:只输入一个主题,5 分钟生成完整 AI 短视频

Pixelle-Video 快速上手指南:只输入一个主题,5 分钟生成完整 AI 短视频
Pixelle-Video 快速上手指南只输入一个主题5 分钟生成完整 AI 短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一款开源的 AI 全自动短视频引擎输入一个主题它会自动完成文案撰写、AI 配图、语音合成、背景音乐和最终视频合成全程不需要剪辑软件。适合想批量生产口播、科普、书单类短视频但没有剪辑经验的个人创作者和小团队也适合想接入 API 做自动化内容流水线的开发者。5 分钟跑通安装、配置、启动启动前只需准备两个依赖Python 包管理器uv和视频处理工具ffmpegmacOS 用brew install ffmpegUbuntu 用sudo apt install ffmpeg。git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501。Windows 用户可以直接下载 Releases 里的一键整合包解压后双击start.bat即可无需安装 Python 和 ffmpeg。首次使用要展开「⚙️ 系统配置」面板填三组信息LLM 配置选预设通义千问、GPT-4o、DeepSeek、Ollama 本地模型会自动填充base_url和model再填 API KeyComfyUI / RunningHub 配置本地部署填 ComfyUI 地址默认http://127.0.0.1:8188云端则填 RunningHub API KeyAPI 媒体模型配置不依赖 ComfyUI 时直连 OpenAI、DashScope、火山 ARKSeedream/Seedance、可灵等供应商的图像/视频服务配置也可写在 config.example.yaml复制为config.yaml填写。保存后即可开始生成。跟着走一遍核心流程从「主题」到成片整条流水线是「文案生成 → 配图规划 → 逐帧处理 → 视频合成」以生成一个主题为「为什么要养成阅读习惯」的视频为例内容输入左侧栏选「AI 生成内容」模式输入主题默认生成 5 个分镜数量可调语音设置中间栏TTS 工作流默认 Edge-TTS 即可无需任何配置视觉设置中间栏图像工作流默认image_flux.json图像尺寸默认 1024x1024视频模板选1080x1920/image_default.html竖屏点「 生成视频」右侧栏实时显示进度如「分镜 3/5 - 生成插图」5 分镜视频通常 2-5 分钟出片预览与导出成片自动播放并显示时长、文件大小、分镜数视频文件保存在output/文件夹如果对文案不满意可以改用「固定文案内容」模式直接粘贴自己的稿子跳过 AI 创作环节固定脚本支持按段落、行、句子三种方式分割成分镜。核心能力拆解文案生成两种模式AI 生成内容LLM 根据主题写完整解说词支持所有 OpenAI 兼容接口的模型。换不同模型文案风格会有明显差异固定文案内容跳过创作直接用自己的稿子适合已有成熟脚本的账号图像与视频生成工作流 直连 API 双通道原子能力可以按需替换。图像生成走 ComfyUI 工作流workflows/ 下分runninghub/云端和selfhost/本地两套或api/...直连供应商两种方式内置 Flux、SDXL、Qwen、Seedream 等方案视频生成内置 Wan 2.1/2.2 工作流如video_wan2.1_fusionx.json也支持直连 DashScope、可灵、Seedance。图像风格靠「提示词前缀」控制英文描述如Minimalist black-and-white matchstick figure style illustration点「预览风格」可先试一张图再全量生成。语音合成Edge-TTS 起步支持克隆音色TTS 工作流自动扫描 workflows/ 目录内置 Edge-TTS免费、无需部署和 Index-TTS 等。选中支持克隆的工作流后上传一段 MP3/WAV 参考音频上传后可直接试听预览再做最终合成。多语言 TTS 音色开箱可用。模板系统30 个内置模板按尺寸分组模板用 HTML 定义画面位于 templates/ 目录按前缀区分三类前缀是否消耗 AI 算力适用场景static_*.html否纯文字渲染金句卡、公告生成极快image_*.html每分镜生成 1 张图图文口播、书单、科普video_*.html每分镜生成 1 段视频动态画面表现力最强数量上竖屏 1080x1920 有 24 个模板抖音、快手、小红书横屏 1920x1080 有 5 个B 站、YouTube方形 1080x1080 有 1 个。模板支持{{ title }}、{{ text }}、{{ image }}三个 Jinja2 变量会一点 HTML 就能复制现有模板改出自己的样式。背景音乐把 MP3/WAV 丢进bgm/文件夹即可被选中支持试听。进阶玩法数字人口播生成虚拟人物讲解视频支持多语言项目演示中有韩语数字人案例适合课程推广动作迁移上传参考视频和图片把参考视频中的动作迁移到新角色上如跳舞小猫案例图生视频选video_*模板或动态工作流用 Wan 2.1 等模型把静态画面变成动态片段自定义素材上传自己的照片和视频AI 智能分析素材后生成匹配脚本API 视频片段会尽量按旁白时长对齐批量与历史侧边栏历史记录页支持批量创建视频任务RunningHub 并发数可在runninghub_concurrent_limit里调到 1-10REST APIapi/ 目录下提供完整的 FastAPI 服务api/app.py涵盖内容、图像、TTS、视频、任务等路由方便第三方系统集成Docker 部署仓库提供 Dockerfile 和 docker-compose.yml常见问题FAQQ必须要部署 ComfyUI 吗不一定。纯文字模板static_*完全不需要要 AI 配图但不想本地部署可用 RunningHub 云端或直连 API 供应商本地有显卡才建议自托管 ComfyUI。Q跑一次要花多少钱有三档方案Ollama本地 LLM 本地 ComfyUI 0 元通义千问 本地 ComfyUI 约 0.01-0.05 元/视频性价比最高OpenAI RunningHub 全云端最省事但费用最高。Q生成慢、卡在哪一步看右侧进度条定位文案慢多半是 LLM 响应配图慢看图像工作流的网络和算力合成阶段检查本机 ffmpeg 是否正常。5 分镜参考耗时 2-5 分钟。QComfyUI 连接失败怎么办先确认本地 ComfyUI 服务已启动再核对 URL默认http://127.0.0.1:8188Docker 环境下 Mac/Windows 要用host.docker.internal:8188最后在 Web 界面点「测试连接」验证。Q成片效果不满意怎么调按顺序试换 LLM 模型改文案风格 → 改提示词前缀和图像尺寸换配图 → 换 TTS 工作流或传参考音频换声音 → 换模板和画幅。四个环节互相独立改哪个都不影响其他设置。小结与资源导航Pixelle-Video 把「文案、配图、配音、合成」四件事拆成可替换的模块你只需要在 Web 界面上选预设、填 Key、点生成。上手路径建议先用 Edge-TTS 云端图像服务跑通第一条竖屏视频再逐步替换成自己偏好的模型和模板。关键入口使用文档与教程docs/zh/含 快速开始、配置说明、FAQ配置示例config.example.yaml模板目录与效果图templates/、docs/zh/user-guide/templates.mdAI 工作流RunningHub / 自托管workflows/REST API 入口api/app.py社区与反馈README 中的微信群 / Discord 二维码或直接向仓库提交 Issue【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

◈

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

◐

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

▲

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。