ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

一句话做出完整短视频:Pixelle-Video 全自动视频生成从入门到出片指南

一句话做出完整短视频:Pixelle-Video 全自动视频生成从入门到出片指南 一句话做出完整短视频Pixelle-Video 全自动视频生成从入门到出片指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个 AI 全自动短视频引擎你只输入一句主题比如为什么建议每天读书 20 分钟它会自动写解说词、为每个分镜生成配图、合成语音、铺上背景音乐最后剪出一条可以直接发布的成片。整个过程不需要剪辑软件也不需要任何剪辑经验跑在本地浏览器里几分钟就能出片。先跑起来从零启动 Pixelle-Video 的最快路径前置准备源码启动只需要两个工具uvPython 包管理器负责自动安装项目依赖ffmpeg视频合成必需macOS 用brew install ffmpegUbuntu/Debian 用apt install ffmpeg装完后用下面命令拉取项目git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video两种启动方式Windows 一键整合包从项目 Releases 下载整合包并解压双击start_web.bat依赖全部内置不用装 Python 和 ffmpeg。macOS / Linux 源码启动在项目根目录执行./start_web.sh它会自动装好依赖并启动 Web 服务。浏览器会自动打开http://localhost:8501这就是全部操作界面。界面是经典的三栏结构左侧输入内容、中间配置语音和画面、右侧看进度和成片。首次必做在系统配置面板填两件事第一次使用时展开顶部的「⚙️ 系统配置」面板只需要配齐两块内容大语言模型LLM负责写文案。面板里内置了通义千问、GPT-4o、DeepSeek、Ollama 等预设选中后会自动填好地址和模型名你只需粘贴 API Key。没有 API Key 也没关系选 Ollama 走本地模型即可。画面生成来源三选一——本地已部署 ComfyUI填地址默认http://127.0.0.1:8188点「测试连接」确认可用用云端 RunningHub只填 API Key无需自己的显卡直连模型 APIDashScope、OpenAI、可灵等在「API 媒体模型」里填对应供应商的密钥。填完点「保存配置」配置会写入根目录的config.yaml可参照 config.example.yaml 的结构。它凭什么一句话就能出片一条可替换的生成链路整个生成过程被拆成一段清晰的生产线文案生成 → 配图规划 → 逐帧处理 → 视频合成。每个环节背后都是一个独立的原子能力可以单独更换文案换 LLM 模型配图换图像工作流配音换 TTS 工作流互不牵连。你在界面上能看到实时进度例如分镜 3/5 - 生成插图成片自动保存到output/目录。按官方文档的口径一个 3-5 个分镜的视频大约需要 2-5 分钟主要看分镜数量和网络情况。选对模板画面就成功了一半模板是 HTML 文件按分辨率放在 templates/ 目录下文件名前缀直接说明画面类型static_*.html纯文字静态模板不需要任何图像服务适合快速起步或低成本场景image_*.html用 AI 生成的图片做背景最常用的类型video_*.html用 AI 生成的动态视频做背景表现力更强。三种尺寸对应不同平台竖屏 1080x1920抖音、快手、小红书、横屏 1920x1080B站、YouTube、方形 1080x1080Instagram、朋友圈。几个典型选题和模板的对应关系可以直接抄内容方向建议尺寸建议模板书籍解读、知识科普横屏 1920x1080image_book.html电影感叙事、副业/商业话题横屏 1920x1080image_film.html书单号、全屏展示横屏 1920x1080image_full.html治愈、情感、心灵成长竖屏 1080x1920image_healing.html极简金句、社交平台分享方形 1080x1080image_minimal_framed.html除了选模板还有两个直接控制观感的旋钮提示词前缀Prompt Prefix一段英文风格描述统一控制所有配图的画风比如指定极简线条、胶片质感改这一句就能整体换风格。声音克隆在语音设置里上传一段参考音频MP3/WAV/FLAC配合支持克隆的 TTS 工作流如 Index-TTS成片就能用接近你本人的音色来旁白支持的音色清单在 pixelle_video/tts_voices.py 里。另外别忘了 BGM可选无背景音乐、内置预置曲目或把自己的 MP3/WAV 丢进 bgm/ 目录供选择。把成片调成自己的风格改模板和换工作流改模板每个模板就是一个带 CSS 的 HTML 文件支持{{ title }}、{{ text }}、{{ image }}三个变量。从templates/里挑一个最接近的复制一份改字体、配色、版式存回对应尺寸目录就能在 Web 界面的下拉框里直接选到。完整的开发规范见 docs/zh/user-guide/templates.md。换生成工作流图像、视频、TTS 的每一种能力都对应 workflows/ 下的一个 JSON 文件分selfhost/本地 ComfyUI和runninghub/云端两组另有api/直连供应商的选项。在 ComfyUI 里调好流程、导出 JSON、放进这个目录界面就会自动扫描出来供你选用——这意味着哪一环不满意就只换哪一环。生成成本怎么控制从 0 元到按次计费三档方案按预算任选也可以混搭完全免费LLM 用本地 Ollama 图像用本地 ComfyUI 语音用免费的 Edge-TTS全程 0 元代价是需要一张能跑得动的显卡。按次计费LLM 用通义千问文档给出的量级是单个 3 段视频约 0.01-0.05 元 图像走 RunningHub 云端适合没有显卡的机器。混合日常选题用免费方案跑量重要的片子换更强的模型和云端服务。一个省成本的小技巧先用static_纯文字模板把选题和文案跑通确认脚本质量没问题再切到image_模板生成配图——文字模板不消耗任何图像算力也不依赖 ComfyUI。遇到问题时按这个顺序排查ComfyUI 连不上确认服务已启动 → 核对地址 → 在配置面板点「测试连接」。LLM 调用失败先查 API Key 是否正确再看网络界面会显示具体报错。生成失败重启服务能解决一部分偶发问题仍不行就翻终端日志错误信息里通常能定位到卡在哪个环节。成片效果不满意四个变量按顺序试——换 LLM 模型文案风格不同、改提示词前缀配图画风不同、换 TTS 工作流或上传参考音频音色不同、换模板版式不同。更完整的问答在 docs/zh/faq.md 和 docs/zh/troubleshooting.md。新手路线建议如果你只想花十分钟体验一次最短路径是本地装好 Ollama → 启动 Web 界面 → 填 LLM 配置 → 内容输入选「AI 生成内容」填一个主题 → 模板挑一个static_纯文字款 → 点「生成视频」。先零成本拿到一条成片再逐步升级图像、声音和模板每一步升级解决一个你不满意的点比一开始就配齐全家桶更容易坚持下来。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表