上手 Fooocus 文生圖:從下載到出圖的完整實戰(zhàn)指南)
如何零基礎(chǔ)上手 Fooocus 文生圖從下載到出圖的完整實戰(zhàn)指南【免費下載鏈接】FooocusFocus on prompting and generating項目地址: https://gitcode.com/GitHub_Trending/fo/FooocusFooocus 是一款離線開源的文生圖軟件核心賣點就一句話你只管輸入提示詞它負(fù)責(zé)把圖畫好。它基于 Stable Diffusion XL 架構(gòu)內(nèi)置離線 GPT-2 提示詞處理引擎和一套精心調(diào)過的采樣策略所以哪怕提示詞只有house in garden這么短出圖質(zhì)量也很穩(wěn)定。適合不想折騰參數(shù)、只想要穩(wěn)定出圖效果的人。零門檻上手從下載到第一次出圖先確認(rèn)你的硬件夠不夠Fooocus 只追求高質(zhì)量出圖不打算為低配機器妥協(xié)。最低要求大致是N 卡 4GB 顯存 8GB 內(nèi)存。下面是各平臺的實際情況心里有個數(shù)再裝| 平臺 / 顯卡 | 顯存要求 | 速度參考 | | - | - | - | | Windows/Linux N 卡 30/40 系 | 4GB 起 | 最快官方主力支持 | | Windows AMD 顯卡DirectML | 8GB 起 | 約為 N 卡 30 系的 1/3beta 支持 | | Linux AMD 顯卡ROCm | 8GB 起 | 約為 N 卡 30 系的 1/2beta 支持 | | Mac M1/M2MPS 加速 | 共享內(nèi)存 | 約為 N 卡 30 系的 1/9實驗性支持 | | 純 CPU | 無需顯存但要 32GB 內(nèi)存 | 約為 N 卡的 1/17僅作體驗 |按系統(tǒng)選一條路走通Windows最簡單從官方發(fā)布頁下載整合包解壓后直接運行run.bat。從點下載到出第一張圖官方保證點擊次數(shù)嚴(yán)格小于 3 次。首次啟動會自動下載 SDXL 默認(rèn)模型約幾個 GB網(wǎng)絡(luò)差的時候這一步就是純等待別慌不是卡死。Linux需要 Python 3.10用 conda 或 venv 都行核心動作是克隆倉庫后安裝依賴再跑啟動腳本git clone https://gitcode.com/GitHub_Trending/fo/Fooocus cd Fooocus pip install -r requirements_versions.txt python entry_with_update.pyAMD 顯卡的機器需要把 torch 換成 ROCm 版本再啟動官方明確說 AMD 支持是 beta 狀態(tài)。macOSM1/M2裝好 conda 和帶 MPS 支持的 PyTorch 后同樣克隆倉庫、建環(huán)境、裝依賴、啟動。有 M2 用戶需要加--disable-offload-from-vram參數(shù)來加快模型加載。官方對 Mac 的定位是非官方指南跑得慢屬于正常。第一次啟動你會看到什么終端里滾動下載進(jìn)度 → 模型下載完 → 瀏覽器自動打開一個 Gradio 網(wǎng)頁界面。界面上就是提示詞輸入框 生成按鈕往輸入框里敲一句話點生成幾十秒到幾分鐘看顯卡后得到第一張圖。核心能力拆解文生圖短提示詞也是好圖能做什么不用寫長提示詞、不用調(diào)參數(shù)輸出質(zhì)量接近在線繪圖服務(wù)。怎么觸發(fā)直接在輸入框輸入比如 a house in garden。效果如何內(nèi)置的 GPT-2 離線引擎會先對提示詞做一輪擴寫處理加上負(fù)向 ADM 引導(dǎo)、自注意力銳化等采樣修正短提示詞也能避免塑料感和過度平滑。圖生圖放大、變化、局部重繪能做什么上傳一張參考圖做三種事——Upscale放大 1.5x/2x、Variation輕微/強烈變化、Inpaint/Outpaint局部重繪或向上/下/左/右擴圖。怎么觸發(fā)界面上 Input Image 面板選擇對應(yīng)模式。效果如何Fooocus 用的是自己訓(xùn)練的 inpaint 模型首次用到時會自動下載約 1.28GB 的inpaint_v26.fooocus.patch官方說法是比基于標(biāo)準(zhǔn) SDXL 重繪方案的軟件更自然。Image Prompt拿圖當(dāng)風(fēng)格參考能做什么用一張圖控制生成結(jié)果的構(gòu)圖、風(fēng)格甚至人物臉。怎么觸發(fā)Input Image 面板選 Image Prompt高級選項里還能開 FaceSwap 換臉。效果如何Fooocus 自己實現(xiàn)了一套圖像提示算法官方對比標(biāo)準(zhǔn) IP-Adapter 類方法認(rèn)為結(jié)果質(zhì)量和提示詞理解都更好。風(fēng)格與預(yù)設(shè)一鍵切換畫風(fēng)能做什么不用自己寫長模板選個風(fēng)格模板就行。怎么觸發(fā)Advanced 面板的 Style 下拉框內(nèi)置了幾百個 SDXL 風(fēng)格樣本圖就在 sdxl_styles/samples/ 目錄里風(fēng)格名和圖片一一對應(yīng)。效果如何換畫風(fēng)零成本。2.3.0 之后甚至可以直接在瀏覽器界面里切換預(yù)設(shè)不切也可以啟動時指定--preset anime動漫、--preset realistic寫實對應(yīng)配置在 presets/default.json 等預(yù)設(shè)文件里。提示詞小技巧權(quán)重、通配符、數(shù)組能做什么權(quán)重語法I am (happy:1.5)用的是 A1111 的重加權(quán)算法從 Civitai 直接抄提示詞也能正常發(fā)揮通配符提示詞里寫__color__ flower會自動從 wildcards/color.txt 里按種子隨機挑一個顏色數(shù)組[[red, green, blue]] flower會按數(shù)組元素各生成一張圖配合 Image Number 設(shè)成 3 即可。怎么觸發(fā)直接在提示詞里寫無需額外開關(guān)。效果如何批量試不同變體不用改來改去適合探索階段。進(jìn)階玩法與調(diào)優(yōu)調(diào)出自己想要的默認(rèn)狀態(tài)跑過一次之后程序會生成config.txt這是你自定義默認(rèn)行為的入口——默認(rèn)模型、默認(rèn) LoRA、默認(rèn)采樣器、負(fù)向提示詞、默認(rèn)風(fēng)格組合都能改{ default_model: realisticStockPhoto_v10.safetensors, default_cfg_scale: 3.0, default_sampler: dpmpp_2m, default_styles: [Fooocus V2, Fooocus Photograph, Fooocus Negative] }改崩了怎么辦刪掉config.txt就恢復(fù)默認(rèn)官方教程文件config_modification_tutorial.txt里列了完整的鍵值格式。高級面板里值得動的幾個旋鈕Guidance對應(yīng) --stylize控制風(fēng)格化程度數(shù)值越高清爽但越偏離提示詞本意Sampling Sharpness / Contrast直接微調(diào)銳度和對比度比后處理省事Aspect Ratio官方建議就用界面給的固定分辨率因為 SDXL 的位置編碼對訓(xùn)練時沒見過的任意分辨率處理不好固定檔位的出圖質(zhì)量更穩(wěn)Negative Prompt對應(yīng) Midjourney 的--no寫 low quality 之類的反向約束。啟動參數(shù)速查日常用不到但排障和部署時會遇到幾個高頻的| 參數(shù) | 作用 | | - | - | |--listen/--port 8888| 開放局域網(wǎng)訪問配合auth.json加賬號密碼 | |--share| 生成遠(yuǎn)程 API 端點 | |--language cn| 加載language/cn.json翻譯界面需要自己提供翻譯文件 | |--disable-preset-selection| 鎖定瀏覽器里的預(yù)設(shè)切換 |完整參數(shù)表可以直接跑python entry_with_update.py -h查看。避坑指南現(xiàn)象生成很慢 / 卡在 adm 2816 / 控制臺閃退 / 報RuntimeError: CPUAllocator/ Segmentation Fault。原因系統(tǒng)交換空間Swap不足以上報錯本質(zhì)都是同一個問題。解法保證每個盤至少 40GB 空閑空間Win10/11 會自動建 SwapSwap 盡量放 SSD改完重啟。細(xì)節(jié)都在 troubleshoot.md 里?,F(xiàn)象報MetadataIncompleteBuffer或PytorchStreamReader。原因模型文件下載損壞。解法刪掉損壞文件重新下載網(wǎng)絡(luò)好的話 Fooocus 會自動重下?,F(xiàn)象subprocess-exited-with-error。原因Python 版本不對官方要求 3.10或照著網(wǎng)上野教程裝了依賴。解法嚴(yán)格按官方安裝流程走Windows 直接跑run.bat最省事?,F(xiàn)象SSL: CERTIFICATE_VERIFY_FAILED。原因網(wǎng)絡(luò)環(huán)境導(dǎo)致模型下載鏈路證書校驗失敗國內(nèi)用戶常見。解法檢查網(wǎng)絡(luò)代理或手動下載模型放到models/checkpoints對應(yīng)目錄。現(xiàn)象CUDA kernel errors might be asynchronously reported。原因少數(shù)設(shè)備的驅(qū)動或 CUDA 兼容問題。解法先升級 N 卡驅(qū)動到最新版仍不行就按官方流程換附帶的舊版 xformers 環(huán)境包備份并替換python_embeded文件夾。現(xiàn)象明明沒動過什么突然變得很慢。原因多半是后臺還跑著第二個 Fooocus 實例或者 N 卡驅(qū)動升到 532 以上后出現(xiàn)約 10 倍降速的已知問題。解法關(guān)掉多余實例驅(qū)動問題可回退到 531 版本驅(qū)動試試。現(xiàn)象Found no NVIDIA driver/Torch not compiled with CUDA enabled。原因驅(qū)動缺失或安裝方式不對。解法升級驅(qū)動AMD 用戶確認(rèn)是否按--directmlWindows或 ROCmLinux流程安裝?,F(xiàn)象自己加了--lowvram、--gpu-only、--bf16之類的參數(shù)后更卡更不穩(wěn)。原因這些參數(shù)大多出自不靠譜的教程Fooocus 的顯存管理是自動的手動干預(yù)反而更糟。解法去掉這些參數(shù)回到默認(rèn)。延伸與資源項目目前處于LTS 狀態(tài)只修 bug不加新功能不會遷移到 Flux 等新架構(gòu)。想玩新模型的話官方推薦同門的 WebUI Forge 或 ComfyUI 類平臺社區(qū)也有不少功能更豐富的 Fooocus 分支fork可以折騰。幾個常用入口官方排障文檔troubleshoot.md風(fēng)格庫與樣本圖sdxl_styles/samples/幾百種 SDXL 風(fēng)格文件名即風(fēng)格名預(yù)設(shè)配置presets/default / anime / realistic / lcm / lightning 等通配符詞庫wildcards/顏色、花卉、動物、國籍等隨機詞表項目源碼起源于 Stable Diffusion WebUI 和 ComfyUI 代碼庫的混合核心采樣改進(jìn)都寫在 readme 的 Hidden Tricks 一節(jié)里想深挖原理可以從那里開始。具體版本差異請以官方文檔為準(zhǔn)?!久赓M下載鏈接】FooocusFocus on prompting and generating項目地址: https://gitcode.com/GitHub_Trending/fo/Fooocus創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考