一句话AI视频生成:Pixelle-Video约4分钟产出完整短视频

📅 发布时间:2026/9/4 12:32:05
一句话AI视频生成:Pixelle-Video约4分钟产出完整短视频
一句话AI视频生成Pixelle-Video约4分钟产出完整短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video周四产品评审会前30分钟运营需要一条60秒的新功能介绍视频。Pixelle-Video 是一套AI视频生成引擎输入一句话主题它会自动产出文案、配图、旁白与背景音乐齐全的成品短视频。官方口径默认5个分镜的生成耗时约2至5分钟中位数落在4分钟左右全程不需要拖时间轴或对帧。 拆能力链路从输入到成片这条AI视频生成流水线可以压缩成一句话一个主题进一条成片出。逐环节拆开看内容环节LLM把主题拆成标题加每分镜一句旁白写稿环节不再靠手视觉环节每个分镜由图像生成模型ComfyUI工作流或直连API产出对应配图语音环节Edge-TTS直接合成旁白音频也可切到ComfyUI的TTS工作流支持声音克隆封装环节HTML模板把图、字、音频排好版再经 ffmpeg 拼接、叠BGM导出成片各环节能力可独立替换换模型、换工作流、换模板链路骨架不变。这是它能被深度定制的原因。 跑通第一条成片最简安装步骤3条命令前置环境需要两样Python包管理器 uv 和视频工具 ffmpeg。装好后执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video ./start_web.sh浏览器会自动打开 http://localhost:8501。Windows 用户直接解压官方整合包、双击 start.bat 即可跳过以上命令。只填两项必填配置首次运行展开「⚙️ 系统配置」面板只有两处必填LLM 配置预设下拉选一个模型通义千问、GPT、DeepSeek、Ollama 等填入对应api_key图像生成配置本地 ComfyUI 填comfyui_url默认 http://127.0.0.1:8188用 RunningHub 则填runninghub_api_key填完点「保存配置」。注意 LLM 的api_key、base_url、model三个字段任何一个为空配置校验都不会通过生成无法启动——这是首次跑不起来最常见的原因。走一遍工作流四环节内容生成用分镜滑杆定长短分镜滑杆范围3至30默认5。一个分镜对应一句旁白加一张配图直接决定成片时长与总耗时。60秒左右的成片5到6个分镜通常够用拉得过大多出来的是等图生成的时间。视觉合成提示词前缀定整体调性prompt_prefix是拼在每张配图生成提示词前面的英文风格前缀默认值是黑白火柴人风格。改成 cinematic lighting, film still 之类整片调性随之切换无需逐句改提示词。图像尺寸默认1024x1024在视觉设置栏可调宽高不同模型对尺寸上限限制不同。语音合成TTS音色与语速怎么调本地模式用 Edge-TTS走在线服务无需密钥。默认音色为男声zh-CN-YunjianNeuralspeed取值0.5至2.0默认1.2。觉得播音偏快降到1.0再试听设置栏提供「预览语音」按钮先测试再正式生成。成片封装模板与背景音乐模板都在 templates 目录 下按1080x1920竖屏、1920x1080横屏、1080x1080方形分组。命名前缀即类型static_纯文字不出图image_配图video_动态视频。BGM 默认关闭换自有曲目需把文件放进 bgm/ 文件夹。成片落在 output/ 目录右侧栏可直接播放。️ 调优三层参数第一次跑通之后所有改进都可以归到三层每层改动互不影响返工成本低。文案层换 LLM 预设千问与 GPT 的文风差异明显、分镜滑杆从5拉到8、手动指定标题字段。已有现成稿时把内容输入切到「固定文案」模式一行一个分镜还可选按段落、行或句子切分。视觉层整体风格靠prompt_prefix换图像尺寸微调清晰度平台按尺寸选模板——竖屏1080x1920、横屏1920x1080。模板预览按钮可以先调参数看效果再正式生成试错代价低。语音层换音色晓晓、云健、云希等完整列表见 pixelle_video/tts_voices.py、微调speed或切 ComfyUI 模式用 Index-TTS 工作流上传一段参考音频克隆自己的声音。踩坑实录三份笔记以下三个问题都是实测中真实遇到的各自花了几轮才解决。坑一成片差一口气。当时以为是模型能力问题实际是分镜默认5个。每句旁白约5至20字总时长由分镜数决定。滑杆拉到8片长约多出30秒反过来做30秒短片拉到3即可。坑二连续三个分镜的配图画风漂移一个水墨、一个3D、一个照片。原因是单句提示词只承载场景描述模型只能自由发挥。解法用prompt_prefix锁死风格后重新生成同时核对所选图像工作流是否一致config.yaml 中 image 下的default_workflow。坑三播音偏赶句尾吞字。speed1.2 对资讯类播报确实偏快降到1.0并换成女声后试听过关。若 TTS 服务偶发无返回直接重启服务项目已锁定 edge-tts 版本修复过这类不稳定。方形成片适合信息流投放同一份文案把模板换成1080x1080重新生成即可 算月成本账三种方案组合如下数字为估算区间实际以 API 调用量与图、视频生成条数为准方案月均成本适用场景本地全免费Ollama 本地ComfyUI Edge-TTS约0元电费除外有本地显卡、日常高频生成云端按需通义千问 RunningHub Edge-TTS约20至80元/月随条数浮动无本地显卡、每周中等产量混合平日本地、高峰与高质量走云端约0至40元/月预算紧、产量弹性大RunningHub 排队久是并发限制在起作用config.yaml 里runninghub_concurrent_limit可设1至10默认1调高可提升批量任务的实际吞吐。找延伸入口官方文档中文总入口安装、配置参考、FAQ 都在这里界面行为与预期不符时先查这里模板手册自建模板与预览方法配合格式说明逐项过一遍workflows 目录runninghub/ 与 selfhost/ 子目录内置图像、视频、TTS 工作流自己导出的 ComfyUI JSON 放进去即可出现在下拉列表今晚就能做的第一件事启动服务输入一个15字以内的主题分镜滑杆保持5模板选默认点生成。泡一杯咖啡的时间output/ 里会躺着一条60秒左右的成片明天再按三层调优法各动一个参数对比差异。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考