主題到一條 AI 短視頻成片)
Pixelle-Video 快速指南3 分鐘從一個(gè)主題到一條 AI 短視頻成片【免費(fèi)下載鏈接】Pixelle-Video AI 全自動(dòng)短視頻引擎 | AI Fully Automated Short Video Engine項(xiàng)目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video假設(shè)你手頭有一段文案想把它變成帶配音、帶畫面的成片。Pixelle-Video 做的就是這種 AI 短視頻生成的完整閉環(huán)輸入一個(gè)主題或一段文字它自動(dòng)完成寫文案、AI 配圖、語音解說、背景音樂和合成最后給你一條能直接發(fā)布的短視頻。不需要你會(huì)剪輯也不需要你自己部署模型。 三分鐘跑起來安裝與啟動(dòng)步驟Windows 用戶只要兩步Mac/Linux 用戶四條命令就夠了前置環(huán)境只需要 Python 3.10 和 uv 包管理器。git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv sync uv run streamlit run web/app.pyWindows 用戶跳過這四行從項(xiàng)目 releases 頁下載整合包解壓后雙擊 start.bat瀏覽器會(huì)自動(dòng)打開 http://localhost:8501 。打開界面后在「系統(tǒng)配置」里填好 LLM 的 API Key 和圖像生成服務(wù)任何 OpenAI 兼容接口的模型都行再輸入主題點(diǎn)「生成視頻」等 2-5 分鐘就拿到第一條成片。 一條從文字到成片的流水線四步是怎么跑的點(diǎn)下「生成」之后后臺(tái)跑的是「文案 → 畫面 → 配音 → 合成」這四步。先由 LLM 根據(jù)主題寫出解說文案拆成若干分鏡默認(rèn) 5 個(gè)接著每個(gè)分鏡生成一張圖或一段視頻用純文字模板則跳過這步然后 TTS 把文案讀成語音最后畫面、配音、BGM 拼成成片在 Web 界面自動(dòng)播放文件存在 output/ 目錄里。每一步用的模型都能單獨(dú)換整個(gè)過程有實(shí)時(shí)進(jìn)度你能看到當(dāng)前卡在哪一步。 功能速覽尺寸、模板、模型一張表看清下面這張表把支持的尺寸、模板類型、模型和部署方式逐項(xiàng)列出來了。能力支持內(nèi)容視頻尺寸1080x1920 豎屏、1920x1080 橫屏、1080x1080 方形三種規(guī)格模板類型static_* 純文字、image_* AI 配圖、video_* AI 視頻背景預(yù)置 20 余種TTS 方案Edge-TTS、Index-TTS、Spark-TTS支持上傳參考音頻做聲音克隆圖像模型FLUX、SDXL、Qwen、Z-Image、SD 3.5、Nano Banana 等視頻模型WAN 2.1/2.2、FusionX、Qwen-WAN、Seedance、Kling 等LLM任何 OpenAI 兼容接口通義千問、GPT、DeepSeek、本地 Ollama部署方式Windows 整合包、源碼安裝uv 或 pip、Docker 三個(gè)真實(shí)用例科普、產(chǎn)品宣傳、社媒日更能直接落地嗎這三個(gè)用例你現(xiàn)在就能照著做。我想做一條科普短視頻。輸入「為什么植物需要光合作用」這類主題AI 自動(dòng)寫解說詞并拆成 5 個(gè)分鏡得到的是一條帶配音、每個(gè)分鏡配插圖的豎屏科普視頻。畫面風(fēng)格不滿意換一個(gè)模板重跑就行。我想做一條產(chǎn)品宣傳。把產(chǎn)品賣點(diǎn)文案貼進(jìn)固定腳本模式選 1920x1080 橫屏模板得到的是一條可以直接放電商詳情頁或 YouTube 的宣傳視頻。想統(tǒng)一品牌色通過 template_params 參數(shù)調(diào)主題色即可。我想做社媒日更。輸入當(dāng)天選題把 n_scenes 設(shè)成 3 讓成片更短選 1080x1080 方形模板適配信息流。歷史頁面支持批量創(chuàng)建任務(wù)一天幾更可以一次排完。 進(jìn)階定制模板、音色、工作流想深入定制嗎只需要?jiǎng)尤齻€(gè)地方的文件不用啃源碼。自定義模板在哪里改把新的 HTML 文件放進(jìn) templates/ 目錄按尺寸1080x1920 等分文件夾存放Web 界面就能直接選。命名約定是 static_* / image_* / video_*static 開頭意味著不需要 AI 生圖。換 TTS 音色在哪里改Edge-TTS 的音色列表預(yù)置在 pixelle_video/tts_voices.py在 Web 界面選 TTS 工作流時(shí)切換即可。想用自己的聲音上傳一段參考音頻走聲音克隆不用額外部署。怎么掛 ComfyUI 工作流在 ComfyUI 里把工作流導(dǎo)出為 JSON放進(jìn) workflows/ 目錄再在配置里填 comfyui_url 和默認(rèn)工作流路徑。不想本地部署的話填一個(gè) RunningHub API Key 就能用云端 ComfyUI。不想開 Web 界面也可以用 Python API 直接調(diào)本質(zhì)就是一次 AI 文字轉(zhuǎn)視頻import asyncio from pixelle_video.service import PixelleVideoCore async def main(): p PixelleVideoCore() await p.initialize() r await p.generate_video(text為什么要養(yǎng)成閱讀習(xí)慣, modegenerate, n_scenes5) print(r.video_path) asyncio.run(main())常見問題生成慢怎么調(diào)、平臺(tái)尺寸、換模型生成太慢怎么調(diào)5 個(gè)分鏡的成片通常需要 2-5 分鐘耗時(shí)主要在 LLM 和圖像生成上。減少分鏡數(shù)、換純文字靜態(tài)模板不跑生圖、或選更快的圖像工作流都能明顯提速。支持哪些平臺(tái)尺寸1080x1920 對(duì)應(yīng)抖音、快手豎屏1920x1080 對(duì)應(yīng) YouTube、B 站橫屏1080x1080 對(duì)應(yīng)信息流方形三種規(guī)格都有現(xiàn)成模板。能換自己的模型嗎LLM 支持任何 OpenAI 兼容接口包括本地 Ollama圖像和視頻可以走自部署 ComfyUI、RunningHub 云端或直連 DashScope、OpenAI、Kling 等 API。必須部署 ComfyUI 嗎不一定。純文字靜態(tài)模板完全不需要生圖想要 AI 配圖也可以選 RunningHub 云端或直連 API 方案本地零部署。如果你不想碰剪輯、只希望從主題和文案批量出成片Pixelle-Video 是目前短視頻自動(dòng)化里上手成本很低的工具但如果你要復(fù)雜轉(zhuǎn)場(chǎng)、角色動(dòng)畫或逐幀精修它替代不了正經(jīng)的剪輯流程。具體功能差異和參數(shù)細(xì)節(jié)以倉(cāng)庫最新文檔為準(zhǔn)?!久赓M(fèi)下載鏈接】Pixelle-Video AI 全自動(dòng)短視頻引擎 | AI Fully Automated Short Video Engine項(xiàng)目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考