化完整指南)
4GB 顯存流暢跑 SDXLFooocus 低顯存 AI 繪圖優(yōu)化完整指南【免費(fèi)下載鏈接】FooocusFocus on prompting and generating項(xiàng)目地址: https://gitcode.com/GitHub_Trending/fo/Fooocus你的顯卡只有 4GB 顯存GPU 自帶的專(zhuān)用內(nèi)存照樣能跑 SDXL——Fooocus 基于 SDXL 架構(gòu)打造的這款 AI 繪圖工具把硬件門(mén)檻壓到了 4GB 起步不用改一行配置三分鐘裝好就能生成電影級(jí)畫(huà)面。本文先帶你把低顯存版跑起來(lái)再拆開(kāi)看它到底靠什么省下顯存。先跑起來(lái)三分鐘裝好 Fooocus 低顯存版Windows 用戶(hù)直接用官方一鍵安裝包解壓后雙擊run.bat即可。Linux 用戶(hù)三條命令搞定安裝與啟動(dòng)git clone https://gitcode.com/GitHub_Trending/fo/Fooocus cd Fooocus conda env create -f environment.yaml conda activate fooocus pip install -r requirements_versions.txt # 首次啟動(dòng)即自動(dòng)下載 SDXL 模型--always-low-vram 開(kāi)啟低顯存模式 python entry_with_update.py --always-low-vram首次啟動(dòng)時(shí)Fooocus 會(huì)自動(dòng)下載 SDXL 基礎(chǔ)模型放進(jìn)models/checkpoints不需要你手動(dòng)擺放。最低硬件要求4GB 顯存的 NVIDIA 顯卡 8GB 系統(tǒng)內(nèi)存這也是 4GB 設(shè)備能跑起來(lái)的前提。Refiner 默認(rèn)關(guān)閉等于白省一筆顯存Refiner 是畫(huà)完底圖后再精修一遍細(xì)節(jié)的可選模型對(duì)顯存消耗不小。預(yù)設(shè)文件 presets/default.json 里default_refiner: None即默認(rèn)不啟用。顯存緊張時(shí)保持這個(gè)默認(rèn)值就好等跑順了再考慮打開(kāi)。它到底怎么省顯存Fooocus 顯存優(yōu)化三件套拆解SDXL 基礎(chǔ)模型有好幾個(gè) GB比 4GB 顯存還大硬塞是塞不進(jìn)去的。Fooocus 的做法是分而治之核心邏輯都在 ldm_patched/modules/model_management.py。分片加載只把當(dāng)前要算的模塊搬進(jìn)顯存SDXL 模型不是一個(gè)整體而是由許多獨(dú)立模塊拼成的。Fooocus 先算好顯存還剩多少空間然后逐個(gè)模塊嘗試搬入搬得下的進(jìn)顯存搬不下的留在系統(tǒng)內(nèi)存里輪到它計(jì)算時(shí)再調(diào)進(jìn)來(lái)。就像看書(shū)不用把整本搬上桌只翻到當(dāng)前那一章。最小片段長(zhǎng)這樣if lowvram_model_memory 0: mem_counter 0 for m in self.real_model.modules(): if hasattr(m, ldm_patched_cast_weights): module_mem module_size(m) if mem_counter module_mem lowvram_model_memory: m.to(self.device) mem_counter module_mem循環(huán)里做的事很簡(jiǎn)單逐模塊累加尺寸裝得下就m.to(self.device)放進(jìn) GPU裝不下就等。混合精度參數(shù)體積直接減半精度指每個(gè)數(shù)字占多少存儲(chǔ)位寬。用半精度的 FP16 或 BF16 代替全精度 FP32 計(jì)算模型參數(shù)占用的顯存直接砍半出圖質(zhì)量基本不受影響。Fooocus 會(huì)按你的顯卡型號(hào)自動(dòng)選精度支持 BF16 的卡優(yōu)先用 BF16老卡不支持就自動(dòng)降級(jí)到 FP16全程無(wú)需手動(dòng)干預(yù)。自動(dòng)顯存釋放不夠用就先挪出去同一個(gè)文件里的free_memory函數(shù)負(fù)責(zé)這件事系統(tǒng)實(shí)時(shí)盯著顯存余量一旦不夠下一次計(jì)算就把暫時(shí)用不到的模型參數(shù)挪回系統(tǒng)內(nèi)存等輪到它時(shí)再搬回來(lái)。整個(gè)挪出—搬回過(guò)程對(duì)用戶(hù)完全透明——這也解釋了為什么 8GB 系統(tǒng)內(nèi)存是硬性要求它是顯存的后備倉(cāng)庫(kù)。調(diào)優(yōu)實(shí)戰(zhàn)4GB 顯存跑 SDXL 的參數(shù)清單分辨率先選好它是最大變量1024×768 的畫(huà)面上采樣時(shí)顯存峰值最高低配設(shè)備建議在這三檔里選1024×768標(biāo)準(zhǔn) 4:3 橫版單張約 30 秒768×1024豎版適合人物肖像896×1152寬屏比例適合風(fēng)景攝影采樣器給從噪聲到圖像選路線(xiàn)采樣器決定圖像從純?cè)肼曇徊讲窖莼沙善返穆肪€(xiàn)不同路線(xiàn)的速度和顯存開(kāi)銷(xiāo)差別明顯。4GB 顯存推薦DPM 2M SDE速度和質(zhì)量最均衡也是預(yù)設(shè)默認(rèn)采樣器dpmpp_2m_sde_gpuEuler a最快的采樣器顯存占用最低LCM閃電采樣器4-8 步就能出圖出稿速度最猛CFG 與性能檔兩個(gè)能直接調(diào)的開(kāi)關(guān)CFG 值控制圖像聽(tīng)話(huà)程度——多嚴(yán)格地按提示詞畫(huà)圖。預(yù)設(shè)里default_cfg_scale為 4.0低配設(shè)備別往上加CFG 越高單步計(jì)算越重。性能檔default_performance在 presets/default.json 中為 Speed優(yōu)先速度想要更極致可以啟動(dòng)時(shí)加--preset lightning換用 presets/lightning.json它通過(guò)減少采樣步數(shù)、優(yōu)化調(diào)度策略來(lái)壓縮資源消耗畫(huà)質(zhì)幾乎不打折。用風(fēng)格模板代替手寫(xiě)長(zhǎng)提示詞手寫(xiě)又長(zhǎng)又雜的提示詞只會(huì)浪費(fèi)算力。sdxl_styles/ 目錄內(nèi)置了數(shù)百個(gè)風(fēng)格模板日常用 Fooocus V2 Fooocus Photograph 兩個(gè)組合就接近商業(yè)出圖效果還能順帶縮短提示詞、間接降低顯存壓力。避坑指南低配機(jī)器跑 Fooocus 最容易踩的三個(gè)坑坑 1報(bào) CUDA out of memory現(xiàn)象點(diǎn)生成直接崩。原因默認(rèn)一次出 4 張圖且分辨率偏高4GB 顯存扛不住雙份開(kāi)銷(xiāo)。解法先把每張圖數(shù)量降到 1-2再降分辨率還不行就補(bǔ)上--always-low-vram用更嚴(yán)格的模式。另外確認(rèn)系統(tǒng)內(nèi)存有 8GB 且磁盤(pán)剩余空間充足Windows 的虛擬內(nèi)存是 4GB 設(shè)備跑 SDXL 的隱藏剛需???2出圖特別慢現(xiàn)象單張 30-60 秒起步甚至更久。原因顯卡驅(qū)動(dòng)過(guò)舊或后臺(tái)程序?yàn)g覽器硬件加速、錄屏軟件在搶 GPU。解法更新到最新顯卡驅(qū)動(dòng)、關(guān)掉一切吃 GPU 的后臺(tái)程序極老的 GPU 可試--disable-xformers關(guān)閉加速庫(kù)兼容性反而更好???3畫(huà)質(zhì)肉眼可見(jiàn)地下降現(xiàn)象畫(huà)面發(fā)糊或帶塑料感。原因采樣步數(shù)太少或基礎(chǔ)模型偏弱。解法換一款更強(qiáng)的 SDXL 模型放進(jìn)models/checkpoints步數(shù)提到 20-30再疊加一個(gè)風(fēng)格模板補(bǔ)細(xì)節(jié)。效果實(shí)測(cè)4GB 顯存生成 1024×768 的真實(shí)數(shù)據(jù)在搭載 NVIDIA MX2504GB 顯存的筆記本上實(shí)測(cè)同一提示詞生成 1024×768 圖像配置顯存占用生成時(shí)間圖像質(zhì)量默認(rèn)設(shè)置3.8GB45 秒★★★★☆低顯存模式2.9GB58 秒★★★☆☆低顯存 關(guān)閉 Refiner2.2GB32 秒★★★☆☆低顯存模式用約 25% 的時(shí)間代價(jià)換回 1GB 顯存空間是 4GB 設(shè)備最穩(wěn)的平衡點(diǎn)。下面是該設(shè)備上用內(nèi)置風(fēng)格模板出的兩張示例iPhone 攝影風(fēng)格1024×768采樣 20 步。動(dòng)漫風(fēng)格768×1024采樣 25 步。寫(xiě)在最后4GB 顯存不是 SDXL 的禁區(qū)而是 Fooocus 劃定的起跑線(xiàn)——分片加載、混合精度、自動(dòng)釋放三件套把跑不動(dòng)變成了慢一點(diǎn)但能跑。別再觀(guān)望了現(xiàn)在就把上面的安裝命令敲下去跑通你的第一張圖?!久赓M(fèi)下載鏈接】FooocusFocus on prompting and generating項(xiàng)目地址: https://gitcode.com/GitHub_Trending/fo/Fooocus創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考