ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Pixelle-Video AI短视频生成:从一句主题到成片只需3条命令

Pixelle-Video AI短视频生成:从一句主题到成片只需3条命令 Pixelle-Video AI短视频生成从一句主题到成片只需3条命令【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video你想每天发布一条竖屏口播短视频但不会写稿、不会剪辑、也不会配音。Pixelle-Video 是一个开源的 AI 全自动短视频生成引擎你只输入一个主题它自动完成写文案、生成 AI 配图、合成语音解说最后合成完整视频。整套流程 3 条命令跑通一条 5 分镜的视频大约 2-5 分钟出片。 快速上手从克隆到看到结果的最短路径这节回答我要装什么、跑什么命令才能看到第一个视频。前置依赖只有两个Python 包管理器uv和视频合成工具ffmpegUbuntu 用sudo apt install ffmpegmacOS 用brew install ffmpeg。然后执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501的 Web 界面。首次使用展开「⚙️ 系统配置」面板填一个 LLM 的 API Key推荐通义千问预设会自动填好 base_url 和模型名图像生成选默认的 RunningHub 云端工作流并填 API Key点击「保存配置」即可。Windows 用户可以直接下载官方一键整合包解压后双击start.bat省去装 Python 和 ffmpeg 的步骤。 核心能力按使用场景看它能做什么这节回答它具体能帮我完成哪几类活产出是什么。场景一只有主题要一条完整成片。解决没有脚本能力也不想剪辑的问题。在左侧栏选「AI 生成内容」模式输入主题如为什么要养成阅读习惯设好分镜数默认 5 个。系统依次生成标题、分镜文案、每句配图的提示词再逐帧合成语音、生成配图、套模板渲染、拼接成视频。产出是一个保存在output/目录的 MP4右侧栏直接预览5 分镜大约 2-5 分钟。场景二已有自己的照片和视频素材。解决素材和文案不匹配的问题。选「自定义素材」流水线上传你的照片或视频AI 先分析素材内容再生成与之匹配的脚本和解说产出的是围绕你的素材的定制视频而不是凭空想象的配图。场景三想用自己的声音。解决AI 配音太机械的问题。选择支持声音克隆的 TTS 工作流如 Index-TTS上传一段参考音频系统用你的音色朗读整个文案生成前可以用「预览语音」试听。场景四一鱼多吃多平台尺寸分发。解决不同平台要求不同画幅的问题。模板按尺寸分组竖屏 1080x1920 有 20 套抖音、小红书横屏 1920x1080 有 5 套B站、YouTube方形 1080x1080 用于朋友圈、Instagram。同一份文案换尺寸重新生成即可。⚙️ 工作原理一条主题如何变成视频这节回答数据在代码里怎么走哪些模块管哪段。系统分四层Streamlit Web 层web/负责交互核心服务层pixelle_video/services/封装 LLM、图像、TTS、视频能力流水线层pixelle_video/pipelines/编排完整流程最底层接 ComfyUI 工作流workflows/selfhost/或直连 API 供应商DashScope、OpenAI、ARK、Kling配置在 pixelle_video/services/api_services/。标准流水线的数据流是单向的主题 → LLM 生成标题和分镜文案 → 为每句生成图像提示词 → 逐帧处理TTS 生成音频 图像生成 HTML 模板渲染成画面→ 各分镜片段拼接 → 混入 BGM → 输出到output/其中模板系统是画面风格的载体位于 templates/按尺寸分目录命名即类型static_*.html纯文字不生成媒体、image_*.html用 AI 图做背景、video_*.html用 AI 视频做背景。模板只暴露title、text、image三个变量所见即所得。 实战技巧来自文档和配置的真实经验这节回答哪些坑文档里已经踩过你可以直接抄答案。没有本地显卡就别折腾 ComfyUI。config.example.yaml 默认图像工作流就是runninghub/image_flux.json云端只填 RunningHub API Key 就能跑通生成大尺寸视频片段时选 48GB 显存实例更稳。新手第一支视频用static_静态模板。它不生成任何媒体速度最快适合先验证流程再换image_模板加配图。配图风格靠提示词前缀统一。config.example.yaml里的prompt_prefix必须是英文默认是黑白火柴人简笔画风格所有分镜共用这一个前缀改它比改模板省事。自定义 BGM 就是往文件夹里扔文件。把你的 MP3/WAV 放到bgm/目录界面 BGM 选项里直接选还能试听。成本控制Ollama本地 LLM 本地 ComfyUI 组合可以做到 0 元跑全流程通义千问 本地 ComfyUI 的口径是每条约 0.01-0.05 元。另外 RunningHub 并发默认 1runninghub_concurrent_limit会员等级允许时可调到 10 并行出图。⚖️ 适合谁不适合谁这节回答什么情况下别用这个项目。适合要批量生产竖屏知识、生活、科普类短视频的创作者没有本地 GPU、想纯云端跑图的人想用零成本方案Ollama 本地 ComfyUI先跑通流程的人想通过 Python APIPixelleVideoCore把它集成进自己系统里的开发者。不适合需要逐帧精确控制剪辑节奏的人——模板只暴露标题、文本、图片三个变量做不了复杂转场和画中画追求电影级画面质感的人——AI 配图的观感上限取决于你选的图像模型既没有 API Key 又没有本地 ComfyUI 的人——文案和语音能生成但配图和视频素材无从产生成不了片。如果目标是剪辑已有素材而非从零生成传统剪辑软件更合适。 继续深入这节给出按使用深度排列的入口。快速上手docs/zh/getting-started/quick-start.md配置说明docs/zh/getting-started/configuration.md模板开发含全部模板预览docs/zh/user-guide/templates.mdComfyUI 工作流定制docs/zh/user-guide/workflows.mdPython API 集成docs/zh/user-guide/api.md声音克隆教程docs/zh/tutorials/voice-cloning.md自定义视觉风格docs/zh/tutorials/custom-style.md常见问题与故障排查docs/zh/faq.md、docs/zh/troubleshooting.md完整配置样例config.example.yaml注意文件头部警告config.yaml含 API Key不要提交到 GitPixelle-Video 把主题到成片的链路收敛成了可替换的几段LLM、图像、TTS、模板各自独立哪段不满意换哪段。下一步很简单装好依赖用默认模板生成一条你最熟悉主题的 5 分镜视频先确认流程跑通再逐个换模板和音色。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表