尧图精选

Pixelle-Video 实战指南:从一句主题到成片短视频,最短路径怎么走

🕒 发布时间:2026/9/4 9:43:10 📁 来源:尧图网络
Pixelle-Video 实战指南从一句主题到成片短视频最短路径怎么走【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个 AI 全自动短视频引擎你输入一句主题或一整段文案它自动写解说词、逐镜头生成配图或视频、合成语音并叠加背景音乐最后输出一条可直接发布的 MP4。无需剪辑软件也不要求你有视频制作经验。项目速览它解决的核心问题是把写稿、找图、配音、剪辑四件事压缩成一次参数配置。适合需要批量产出口播类内容的人——自媒体运营、课程制作、企业内部培训。AI 写稿主题进、分镜文案出每镜头字数可控固定文案直用已有稿件可跳过 AI 创作按段落、行或句子切分媒体可换引擎本地 ComfyUI、RunningHub 云端、DashScope/OpenAI/Kling 等直连 API 三种来源任选模板决定版式竖屏、横屏、方形三套尺寸20 余个 HTML 模板开箱即用声音两条腿Edge-TTS、Index-TTS 等工作流支持参考音频克隆音色双入口Streamlit 网页界面外加一套 FastAPI 服务供程序调用快速上手三条部署路径装好 ffmpeg 和 uv 后源码部署只需一条命令。以下三条路径按省事程度排列选其一即可。路径一Web 界面日常使用git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开 http://localhost:8501。首次使用展开系统配置面板填入 LLM 的 API Key 和图像服务配置保存即可。路径二API 服务程序集成uv run python api/app.py --port 8000启动后访问 http://localhost:8000/docs 可看到全部接口的交互式文档健康检查走GET /health。路径三Windows 整合包Releases 页面提供打包好的压缩包解压后双击start.bat不装 Python 也能跑适合不想碰命令行的人。三种方式共用的配置文件是config.example.yaml复制为config.yaml后填入密钥。LLM 支持任何 OpenAI 兼容接口官方示例里列了通义千问、GPT、DeepSeek 和本地 Ollama 四种 preset 的地址与模型名照抄即可。核心能力拆解主题直出视频generate 模式适用场景你只有一个想法没有成稿。怎么用在界面选择AI 生成内容写进主题用分镜数量滑杆控制长度Web 端 3 到 30 个API 端 1 到 20 个解说词每句的字数上下限、配图提示词长度都可单独设。得到什么一段按分镜切好的完整视频每一镜都有独立的文案和配图。固定文案成片fixed 模式适用场景稿件已经写好AI 改词反而会破坏原意。怎么用选择固定文案内容并粘贴全文再指定切分方式——按段落、按行或按句子。注意分镜数参数在该模式下不生效镜头数由切分结果决定。得到什么文案逐字保留的视频镜头数随文本自然浮动。模板与尺寸版式即 API 参数适用场景同一批内容要分发到不同平台需要竖屏、方形或横屏三种画幅。怎么用模板按尺寸分目录存放命名前缀直接表达用途——static_纯文字画面不生成媒体最省成本、image_用 AI 图作背景、video_用 AI 视频片段作背景。视频尺寸由模板内嵌的元数据自动推导请求里不需要手填分辨率。得到什么选定模板即锁定画幅与布局还能通过template_params传入强调色、背景图等细节做差异化。媒体与声音引擎同一位置可互换适用场景本地没有显卡或不想为不同任务部署不同环境。怎么用图像和视频生成有三个来源——本地 ComfyUI填服务地址、RunningHub 云端填 API Key、直连模型 APIDashScope、OpenAI、ARK、Kling 等配置里可给每个供应商单独挂本地代理。TTS 同理workflows/目录下自带 edge、index2 等工作流Index-TTS 路线还支持上传参考音频克隆音色。得到什么整条流水线里任何一环都能单独替换不必动其他环节。场景实战一本书评做成 30 秒竖屏视频假设你要为读书笔记账号产出一条竖屏视频流程如下输入主题例如为什么要养成阅读习惯选 generate 模式分镜数拉到 5模板选1080x1920/image_book.html配音工作流选 Edge-TTSBGM 留空或用内置曲目点击生成界面按生成文案 → 生成配图 → 合成语音 → 合成视频逐段显示进度完成后自动播放预览文件落在output/目录直接上传平台即可。整个过程你不需要打开任何剪辑软件。换一条内容只需要改主题其余参数保持不动。批量生产走异步 API需要一次产出多条时比如一个系列课程同步接口不适合——它会阻塞到成片完成官方建议只在 30 秒以内的短片上使用。异步接口提交后立即返回 task_id之后轮询状态即可import requests resp requests.post( http://localhost:8000/api/video/generate/async, json{text: 深度工作法如何提高工作效率, mode: generate, n_scenes: 8, frame_template: 1080x1920/image_default.html}, ) task_id resp.json()[task_id] # 轮询GET /api/tasks/{task_id}status 为 completed 时从 result 取 video_url多个任务可以并行提交但并发上限受你所用媒体服务制约见下节。避坑与调优提示长片必走异步同步接口对超过 30 秒的视频可能直接超时这是接口文档里明确写着的边界不是偶发故障。RunningHub 默认限并发为 1config.yaml里的runninghub_concurrent_limit取值 1–10普通成员账号保持在 1盲目调高只会触发限流。提示词前缀用英文prompt_prefix决定配图整体画风写成中文模型大概率不认改完可在界面预览风格先测一张图。零成本组合是存在的Ollama 本地模型 本地 ComfyUI Edge-TTS一分钱不花折中方案是用通义千问 API 跑文案成本很低。Docker 环境连本地 ComfyUI 要改地址容器内访问宿主机请用host.docker.internal:8188macOS/Windows或宿主机 IPLinux127.0.0.1在容器里指向容器自身。config.yaml里全是密钥别提交进 Git示例文件自己也标注了这一点。适用边界与下一步Pixelle-Video 适合旁白 画面形态的内容口播、读书、课程导学、知识卡片。它不替代非线性剪辑——如果你需要逐帧控制、多轨混音或电影级画面质感还是应该进剪映或 DaVinci。另外它的效果上限绑定在你接入的 LLM 和生图模型上密钥质量直接决定成片质量。建议的下一步先用零成本组合跑一条 5 分镜的测试片确认文案风格和配图像质符合预期再决定要不要升级模型。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联 返回资讯列表 →