ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Pixelle-Video AI短视频生成引擎:零代码、免费本地部署的完整上手指南

Pixelle-Video AI短视频生成引擎:零代码、免费本地部署的完整上手指南 Pixelle-Video AI短视频生成引擎零代码、免费本地部署的完整上手指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video想做一条短视频往往卡在三件事上脚本写不出来、素材找不到、配音没人做一条几分钟的片子折腾一整天。Pixelle-Video 是一个开源的 AI 短视频生成引擎把这件事简化成一句话——输入一个主题它自动写解说词、逐句生成配图、合成语音、加上背景音乐直接输出成片。项目免费开源可以完全本地部署不需要会剪辑也不需要写代码配好 API 之后几分钟就能产出第一条作品。一分钟看懂它能做什么项目说明一句话定位输入主题自动生成文案、配图、配音和成片的开源 AI 短视频引擎核心能力AI 写文案、逐分镜生成配图/视频、多方案 TTS 配音、背景音乐、多尺寸模板、自定义素材、数字人口播、动作迁移适用人群短视频创作者、教育工作者、企业营销人员、个人博主以及完全零代码的新手成本项目开源免费用 Ollama 本地模型 本地 ComfyUI 可零 API 费用跑通全流程也可选云端 API硬件要求走云端服务的话一台普通电脑即可本地跑图像生成建议用支持 CUDA 的 NVIDIA 显卡5分钟跑起来 第 1 步准备环境做什么 → 看到什么Windows 用户项目提供一键整合包无需安装 Python、uv 或 ffmpeg解压后双击start.bat浏览器自动打开http://localhost:8501。macOS / Linux 用户先装好uvPython 包管理器和ffmpeg视频处理工具然后克隆仓库git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video第 2 步启动 Web 界面uv run streamlit run web/app.py看到这行命令跑起来、浏览器弹出http://localhost:8501的界面就说明启动成功了。第 3 步首次配置只做一次展开界面里的「⚙️ 系统配置」面板LLM 配置下拉选一个预设模型通义千问、GPT、DeepSeek、Ollama 本地模型等填入 API Key。图像生成二选一——本地 ComfyUI 填服务地址默认http://127.0.0.1:8188或云端 RunningHub 填 API Key也可以直连 DashScope、OpenAI、Volcengine ARK、Kling 等模型 API。点「保存配置」即可配置项的完整字段可参考 config.example.yaml。第 4 步生成第一条视频在左侧「内容输入」选「AI 生成内容」输入一个主题比如为什么要养成阅读习惯语音选默认的 Edge-TTS模板选竖屏的image_default然后点「 生成视频」。界面会实时显示生成文案 → 生成配图 → 合成语音 → 合成视频的进度完成后右侧自动播放成片文件保存在output/文件夹。5 分镜的视频大约需要 2-5 分钟具体看模型响应速度和网络。一条视频是怎么做出来的 整条生产链路是主题 → 文案 → 配图 → 配音 → 成片每一步都可以换不同的模型主题支持「AI 生成内容」只给主题AI 写稿和「固定文案内容」已有现成文案直接跳过写稿两种模式。文案由 LLM 完成支持通义千问、GPT-4o、DeepSeek、Ollama本地 llama3.2等预设任何兼容 OpenAI 接口的模型都能接。文案会被切分成若干分镜默认 5 个还可以按段落/行/句子分割。配图每个分镜单独生成一张插图默认 1024x1024。生成方式有三档本地 ComfyUI 工作流、RunningHub 云端工作流默认image_flux.json或直连 DashScope、OpenAI GPT Image、Seedream 等图像 API。还能用英文提示词前缀统一控制整体画风比如固定成火柴人简笔画风格。配音TTS 工作流自动从 workflows/ 目录扫描内置 Edge-TTS默认、Index-TTS 等方案支持多语言音色上传一段参考音频MP3/WAV/FLAC还能做声音克隆先试听再正式生成。成片FFmpeg 把插图、语音和背景音乐合成视频。背景音乐可以选内置曲目或把自己的 MP3/WAV 放进bgm/文件夹使用。视觉风格与模板怎么选 模板是 HTML 文件决定画面的布局和设计按尺寸分成三组下拉菜单里也会按组显示尺寸用途代表模板竖屏 1080x1920抖音、快手、小红书等短视频平台image_default、image_modern、image_cartoon、image_life_insights、video_healing横屏 1920x1080YouTube、B站等image_film、image_book、image_full、image_wide_darktech方形 1080x1080信息流/社交卡片image_minimal_framed模板的命名规则很直白看前缀就知道它需要什么素材static_*.html静态模板纯文字样式不需要AI 生成任何媒体出片最快image_*.html图片模板用 AI 生成的图片做背景video_*.html视频模板用 AI 生成的动态视频做背景视觉冲击最强。选模板时可以点「预览模板」先试效果还能自定义参数测试会一点 HTML 的话可以在 templates/ 目录放自己的模板。全部模板的效果图整理在 模板文档。不止自动生成除了给主题出片这条主线Pixelle-Video 还内置了几个进阶流水线见 web/pipelines/自定义素材上传自己的照片和视频AI 会分析素材内容自动生成匹配的脚本和解说还能按旁白时长生成 API 视频片段适合把已有素材变成成片。数字人口播生成数字人形象来讲解视频适合教育培训、产品演示这类需要出镜的场景。动作迁移上传参考视频和图片把动作迁移到目标素材上做出独特的动态效果。图生视频把静态图片变成动态片段让画面不再呆板。多语言与批量TTS 支持多语言音色历史记录页还支持批量创建视频任务一次面向多个语言/版本受众出片。它是怎么搭起来的Pixelle-Video 采用分层架构最上面是 Streamlit Web 层web/负责界面和交互中间是服务层pixelle_video/services/核心类PixelleVideoCore协调 LLM 服务、图像服务、TTS 服务、视频生成器这四个子服务底下是 ComfyUI 层负责实际的图像、视频和语音推理。它的关键设计是原子能力可替换图像、视频、TTS、素材分析VLM每一项都可以独立选择来源——本地 ComfyUI、RunningHub 云端或直连模型供应商 API通过 workflows/ 里的 JSON 工作流文件声明selfhost/放本地工作流runninghub/放云端工作流。生成流程本身由 pixelle_video/pipelines/ 里的标准管道、素材驱动管道和自定义管道组织。配置统一用 YAML 管理技术栈是 Python 3.10 加 AsyncIO。更多细节可看 架构文档。场景选型手册场景推荐模板语音/音乐建议科普讲解竖屏image_default或psychology_card心理学卡片风清晰专业的音色语速适中加轻快 BGM 增强学习氛围产品营销image_modern竖屏或image_full横屏全屏展示自信有力的音色音乐节奏偏明快音量压低不抢人声个人 Vlog / 生活感悟image_life_insights、video_healing治愈系动态背景温暖亲切的音色舒缓 BGM可用声音克隆保持个人风格影视解说 / 深度内容横屏image_film、image_book低沉沉稳的音色音乐克制突出旁白高频问题 ❓Q生成一条视频要多久5 个分镜的视频大约 2-5 分钟取决于 LLM 响应速度、图像生成方式和网络状况。分镜越多、用动态视频模板时间越长。Q使用要花钱吗项目本身开源免费。完全免费方案Ollama 本地跑 LLM 本地 ComfyUI 生图全程 0 元预算有限的折中方案是通义千问调用成本很低 本地 ComfyUI全云端方案OpenAI RunningHub费用最高但不用折腾本地环境。Q需要什么硬件走云端 API 的话普通电脑即可。本地跑 ComfyUI 生图建议有支持 CUDA 的 NVIDIA 显卡显存越大出图越快。Q输出什么格式能发哪些平台支持竖屏 1080x1920、横屏 1920x1080、方形 1080x1080 三种尺寸分别对应抖音/快手/小红书、YouTube/B站、信息流卡片等平台成片保存在output/文件夹。Q效果不满意怎么调按四个旋钮排查换 LLM 模型改文案风格 → 调图像尺寸和提示词前缀改配图画风 → 换 TTS 工作流或上传参考音频改声音 → 换模板和尺寸改画面布局。Q固定文案能用吗可以。选「固定文案内容」模式直接贴入现成脚本跳过 AI 写稿环节按段落/行/句子切分成分镜。开始动手装好环境Windows 用整合包其他系统装 uv ffmpeg 并克隆仓库启动 Web 界面在系统配置里填好 LLM 和图像生成的密钥输入一个你真正想讲的主题选一个竖屏模板点「生成视频」对不满意的环节按文案 → 配图 → 声音 → 模板的顺序逐项微调之后尝试自定义素材、数字人或批量任务把工具箱用满。主题只是起点剩下的交给 Pixelle-Video——现在就去生成你的第一条 AI 短视频吧。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表