
一句話主題自動成片Pixelle-Video 生成 AI 短視頻的完整上手【免費下載鏈接】Pixelle-Video AI 全自動短視頻引擎 | AI Fully Automated Short Video Engine項目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video如果你需要批量產(chǎn)出 AI 短視頻又不想碰剪輯軟件Pixelle-Video 是條現(xiàn)成的路它是一個全自動短視頻引擎輸入一個主題就能自動完成寫文案、生成配圖、合成語音和混入背景音樂最后直接輸出成片 MP4。它面向的是需要持續(xù)發(fā)布視頻內(nèi)容、卻沒有剪輯經(jīng)驗的人。照這篇的步驟做下來你的機器上會跑起本地 Web 服務并產(chǎn)出第一條成片視頻。 先看它產(chǎn)出什么成片是一段帶旁白和背景音樂的 MP4若干分鏡分鏡 把一條視頻拆成的若干鏡頭段落逐幀播放每幀由背景畫面 疊加文字構(gòu)成畫面上疊 AI 配音和 BGM。默認生成 5 個分鏡時長和節(jié)奏隨分鏡數(shù)變化。畫面比例由模板決定倉庫里按三檔組織豎屏 1080x1920、橫屏 1920x1080、方形 1080x1080。模板文件名即類型static_*是純文字卡、image_*用 AI 圖做背景、video_*用 AI 視頻做背景全部放在 templates/ 目錄。所有成片的輸出位置都是根目錄下的output/文件夾。圖注1920x1080 的「Film」模板預覽幀電影質(zhì)感適合橫屏解說類內(nèi)容 準備工作依賴要求說明ffmpeg已安裝視頻合成必需用ffmpeg -version確認有輸出Python3.11 及以上低于該版本啟動會失敗uv已安裝快速 Python 包管理器自動建虛擬環(huán)境裝全部依賴macOS 用 brew、Linux 用 apt 裝 ffmpeg 即可Windows 用戶不用敲命令直接執(zhí)行倉庫里的start_web.bat或官方 Windows 整合包就能跳過手動安裝。 跑通第一條視頻克隆倉庫并啟動。uv run會自動創(chuàng)建虛擬環(huán)境并安裝全部依賴git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py等瀏覽器自動打開http://localhost:8501沒跳轉(zhuǎn)就手動輸入該地址。展開左側(cè)「?? 系統(tǒng)配置」在 LLM大語言模型負責寫文案配置里選一個預設(shè)模型粘貼 API Key保存。內(nèi)容輸入?yún)^(qū)選「AI 生成內(nèi)容」模式輸入主題比如「為什么要養(yǎng)成閱讀習慣」——具體主題比大詞效果好。中間欄全部保持默認TTS語音合成默認 Edge-TTS圖像默認runninghub/image_flux.json工作流挑一個豎屏模板右側(cè)點「生成視頻」。2-5 分鐘后右側(cè)自動播放成片output/里能看到文件歷史頁面也能回看。? 控制成片質(zhì)量整條流水線上真正值得你動的其實只有三個杠桿。說什么文案與模型想改口播內(nèi)容就動「內(nèi)容輸入」模式。默認走 LLM 按主題寫稿已有現(xiàn)成稿件時切到「固定文案內(nèi)容」還能指定按段落、按行或按句子拆分。想換寫作風格就動配置里的llm字段它兼容任何 OpenAI SDK 格式的接口通義千問、GPT、DeepSeek 乃至本地 Ollama 都能接。想改視頻長短就動分鏡數(shù)默認值 5。長什么樣配圖路線與模板想改畫面就動「圖像生成」下拉菜單里的路線三選一本地 ComfyUI開源擴散模型工作流引擎選workflows/selfhost/下的工作流最快且免費前提是本地服務已啟動云端 RunningHub默認值runninghub/image_flux.json本地零部署需在配置面板填 RunningHub API Key直連供應商 API選api/...工作流在配置的api_providers段填 DashScope、OpenAI、Kling 等的密鑰。默認出圖尺寸 1024x1024整體畫風由配置里的提示詞前綴統(tǒng)一控制。想加自定義模板就動 templates/每個模板就是一個 HTML 文件用 Jinja2 變量{{ title }}、{{ text }}、{{ image }}注入文字和圖片復制一個現(xiàn)有文件改完樣式丟進對應尺寸目錄它會自動出現(xiàn)在下拉列表里。唯一要守住的規(guī)矩是body尺寸必須和所在目錄一致——豎屏目錄里就寫 1080px × 1920px否則文字會溢出版面。圖注1080x1080 的「Minimal Framed」方形模板預覽幀適合信息流平臺的正方形封面位聽起來如何解說與 BGM想換聲音就動 TTS 工作流默認selfhost/tts_edge.json提供一套固定音色免費夠用想要自己的聲音切到 Index-TTS 并上傳一段清晰人聲 MP3 做參考——聲音克隆只在這種支持的工作流下生效選了 Edge-TTS 時上傳音頻不產(chǎn)生任何效果。正式生成前先用「預覽語音」試聽這是驗證音色成本最低的方式。想換 BGM就把 MP3/WAV 手動放進根目錄bgm/文件夾它會出現(xiàn)在選擇列表里該目錄已有內(nèi)置曲目。 出問題自查Web 界面起不來或依賴報錯→ 先跑ffmpeg -version確認有輸出、確認 Python ≥ 3.11依賴裝不上就uv cache clean后重新uv sync。卡在「生成配圖」不動→ 選 selfhost 路線的確認本地 ComfyUI 已啟動瀏覽器能打開http://127.0.0.1:8188且模型文件已下載選 runninghub 的回配置面板核對 API Key。文案生成不出來→ 核對系統(tǒng)配置面板里的 LLM Key 是否完整、余額是否充足用本地 Ollama 時確認服務已啟動且模型已拉取。配圖風格和模板不搭→ 提示詞前綴改用英文畫風詞如 minimal sketch style 這類描述并把寬高調(diào)到模型支持的范圍內(nèi)。收尾說明Pixelle-Video 把寫稿、配圖、配音、混音到合成這整條鏈路交給了機器但主題選什么、模型與路線怎么配、模板風格定哪個仍然決定了成片的上限。生成后值得人工過一遍聽一遍旁白是否拗口抽幾幀看文字有沒有溢出。接下來想深入自定義視覺風格或聲音克隆直接翻倉庫里的 docs/zh/ 中文文檔里面有分場景的教程?!久赓M下載鏈接】Pixelle-Video AI 全自動短視頻引擎 | AI Fully Automated Short Video Engine項目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考