指南 / 本地图像生成入门
本地图像生成入门
面向想在自己电脑上出图的人:先分清哪些能本地跑、哪些只是在线试用,再看授权;显存资料几乎都缺,本站不替你猜。
编辑推荐
先分清本地运行和在线体验:「官方体验」链接只说明能在线试,不代表你的机器装得下;部分配置需额外底模或配套工具,以对应运行说明为准。再看「商用」一栏,FLUX、Krea、Ideogram 系列多为非商业或社区许可,标「需自查」的商用前读条款。下面四个推荐各有侧重,展开「查看运行方式」可复制命令;全部图像模型见 /guide/image/。
- 画质与生态最成熟;仅限非商业 FLUX.1-dev (BFL)
资料写 12B、非商业许可,「商用」标需自查,社区反馈也明确只限非商业研究和开发。有官方 Space 可在线试;本地走 diffusers 或 ComfyUI,卡片有命令。显存本站暂无估算;社区反馈 FP16 几乎吃满 24GB,12GB 显卡要用 NF4 量化版。
- 4 步快速出图;许可证 MIT,但资料另注不建议商用 Lens-Turbo (Microsoft)
资料写 3.8B、4 步蒸馏、许可证 MIT,「商用」标可商用,但资料另有一处写不建议用于商业产品或服务,商用前以仓库许可证原文为准。没有在线 Demo,本地要 clone 官方仓库跑示例,卡片有命令。显存本站暂无估算;社区反馈文本编码器有 20B,加载门槛不低。
- 动漫风格;Apache-2.0 可商用 Z-Anime (SeeSee21)
资料写基于 Z-Image 全量微调、Apache-2.0 可商用,提供 GGUF / AIO / Diffusers 多种格式并附 ComfyUI 工作流;没有在线 Demo。显存本站暂无估算:资料同时出现 fp8 和 bf16 两种格式,本站不挑一个算。社区反馈两极,更多人觉得 Anima 综合更好;先小批量试再决定。
- Apple Silicon 超轻量;Apache-2.0 可商用 Bonsai-Image-4B (Prism ML)
资料写权重 1.21GB(来源自述,非本站估算)、Apache-2.0 可商用;MLX 权重只在 Apple Silicon 上跑,有 Space 可在线试,本地按仓库说明装,卡片有命令。显存本站暂无估算。资料写不适合精细文字、严格构图和细节要求高的场景。
全部候选对比
当前运行配置
black-forest-labs/FLUX.1-dev- 显存
- 暂无估算
查看详情查看运行方式
diffusers: FluxPipeline.from_pretrained('black-forest-labs/FLUX.1-dev')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- 非商业许可
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
krea/Krea-2-Turbo- 显存
- 暂无估算
查看详情查看运行方式(还有 1 种)
python -c "from diffusers import Krea2Pipeline; import torch; pipe = Krea2Pipeline.from_pretrained('krea/Krea-2-Turbo', torch_dtype=torch.bfloat16).to('cuda'); pipe('a fox in the snow', num_inference_steps=8, guidance_scale=0.0).images[0].save('out.png')"其它 1 种运行方式见详情页。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Krea-2-Community-License
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
RunDiffusion/Juggernaut-Z-Image- 显存
- 暂无估算
查看详情查看运行方式
diffusers: from_pretrained('RunDiffusion/Juggernaut-Z-Image')- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- cc-by-nc-4.0
- 国内可达
- 需代理
当前运行配置
AlperKTS/Krea2_FP8- 显存
- 暂无估算
查看详情查看运行方式
huggingface-cli download AlperKTS/Krea2_FP8 --local-dir ./krea2_fp8- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- krea-2-license
- 国内可达
- 需代理
当前运行配置
ideogram-ai/ideogram-4-fp8- 显存
- 暂无估算
查看详情查看运行方式
diffusers: from_pretrained('ideogram-ai/ideogram-4-fp8')- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- other
- 国内可达
- 需代理
当前运行配置
Lakonik/AsymFLUX.2-klein-9B- 显存
- 暂无估算
查看详情查看运行方式
Python: pip install lakonlab 后用 PixelFlux2KleinPipeline 加载适配器- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- flux-non-commercial-license
- 国内可达
- 需代理
当前运行配置
mgwr/M87- 显存
- 暂无估算
查看详情查看运行方式
python -c "from diffusers import DiffusionPipeline; pipe = DiffusionPipeline.from_pretrained('krea/Krea-2-Turbo'); pipe.load_lora_weights('mgwr/M87'); pipe('a cat --preview').images[0].save('out.png')"- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
ostris/krea2_turbo_style_reference- 显存
- 暂无估算
查看详情查看运行方式
pipe = DiffusionPipeline.from_pretrained("krea/Krea-2-Turbo", custom_pipeline="ostris/Krea2OstrisEdit", torch_dtype=torch.bfloat16); pipe.enable_model_cpu_offload(); pipe.load_lora_weights("ostris/krea2_turbo_style_reference")- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- krea-2-community-license
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
microsoft/Mage-Flow-Turbo- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
inclusionAI/LLaDA-Image- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 魔搭可用
当前运行配置
nvidia/Qwen-Image-Flash- 显存
- 暂无估算
查看详情查看运行方式
sglang generate --model-path nvidia/Qwen-Image-Flash --prompt "A red fox in a snowy pine forest at golden hour, photorealistic, sharp focus, soft bokeh" --width 1024 --height 1024 --num-inference-steps 4 --guidance-scale 1.0 --true-cfg-scale 1.0 --seed 42 --save-output --output-file-path qwen-image-flash-sglang.png- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA Open Model Agreement
- 国内可达
- 需代理
当前运行配置
microsoft/Mage-Flow-Edit-Turbo- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
krea/Krea-2-Raw- 显存
- 暂无估算
查看详情查看运行方式(还有 1 种)
pip install diffusers && python -c 'from diffusers import Krea2Pipeline; pipe = Krea2Pipeline.from_pretrained("krea/Krea-2-Raw", torch_dtype=torch.bfloat16).to("cuda"); pipe("a fox in the snow", num_inference_steps=52, guidance_scale=3.5).images[0].save("out.png")'其它 1 种运行方式见详情页。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- krea-2-community-license
- 国内可达
- 需代理
当前运行配置
Alissonerdx/CharacterSheet- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- Civitai 模型许可
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
Gazingstars123/Anima-2.9B- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- CircleStone Labs Non-Commercial License
- 国内可达
- 需代理
当前运行配置
Patil/Krea-2-depth-controlnet- 显存
- 暂无估算
查看详情查看运行方式
git clone https://github.com/Tanmaypatil123/Krea-2-controlnet && cd Krea-2-controlnet && pip install -q -r requirements.txt && hf download Patil/Krea-2-depth-controlnet depth-control-lora.safetensors --local-dir . && python inference.py input.jpg -p "prompt" --lora depth-control-lora.safetensors- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- krea-2-community-license
- 国内可达
- 需代理
当前运行配置
PoopMan333/H3_Character_Sheet_Generator- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- minimax-h3-community-license (EU/UK/韩国/美国除外)
- 国内可达
- 需代理
当前运行配置
eric-venti-seeds/Sun-Direction-Lora-Flux2Klein9B- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
lodestones/Kroma- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
microsoft/Mage-Flow- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
prism-ml/bonsai-image-binary-4B-mlx-1bit- 显存
- ~0.6GB 1-bit(估算)
查看详情查看运行方式
MLX Python: BONSAI_VARIANT=binary ./scripts/generate.sh --prompt "..."- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
prism-ml/bonsai-image-ternary-4B-gemlite-2bit- 显存
- 暂无估算
当前运行配置
prism-ml/bonsai-image-ternary-4B-mlx-2bit- 显存
- 暂无估算
查看详情查看运行方式
macOS: git clone https://github.com/PrismML-Eng/Bonsai-Image-Demo && cd Bonsai-Image-Demo && ./setup.sh && ./scripts/download_model.sh && ./scripts/generate.sh- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 上下文
- 不适用
- 国内可达
- 需代理
常见坑
- GGUF Q8 模型的效果优于 FP8 量化版 —— AlperKTS/Krea2_FP8
- FP8 是显存不足时的折中方案,非最优画质选择 —— AlperKTS/Krea2_FP8
- FP16下几乎占用RTX 3090/5090全部24GB显存 —— black-forest-labs/FLUX.1-dev
- 需NF4量化才能在12GB显存上舒适运行 —— black-forest-labs/FLUX.1-dev
- 持续生成时功耗达440W,散热不佳的机箱热点温度可超85°C —— black-forest-labs/FLUX.1-dev
- 安全过滤器比SDXL更严格,会误拦合法的医学或艺术史类prompt —— black-forest-labs/FLUX.1-dev
- 仅限非商业研究和开发用途 —— black-forest-labs/FLUX.1-dev
- 部分社区用户认为效果差,不如SD1.5配合loras/controlnet/adetailer —— black-forest-labs/FLUX.1-dev
- 相比SDXL缺少抽象关键词触发意外好结果的创造性和混沌感 —— black-forest-labs/FLUX.1-dev
- 生成速度极慢,单张图可能耗时13分钟 —— ideogram-ai/ideogram-4-fp8
- FP8量化在3090等显卡上文字质量下降明显 —— ideogram-ai/ideogram-4-fp8
- 学习曲线陡峭,几乎必须依赖第三方工具和区域提示才能出好图 —— ideogram-ai/ideogram-4-fp8
- 首发ComfyUI工作流有误,社区初体验差 —— ideogram-ai/ideogram-4-fp8
- 若不需文字渲染或区域提示,有更快的替代方案 —— ideogram-ai/ideogram-4-fp8
- NF4 量化版在低于 24GB 显存的 GPU 上仍可能 OOM —— ideogram-ai/ideogram-4-nf4
- JSON 结构化提示词学习曲线高,手写几乎不可行,依赖工具链 —— ideogram-ai/ideogram-4-nf4
- 发布时 ComfyUI 模板存在多处错误,上手体验不佳 —— ideogram-ai/ideogram-4-nf4
- 对简单肖像/风景图的生成效率不如 ZIT、Anima 等工具 —— ideogram-ai/ideogram-4-nf4
- 在小细节上容易出错,精细度不足 —— krea/Krea-2-Raw
- 缺乏后训练对齐和 RLHF,开箱即用的提示词生图效果不佳 —— krea/Krea-2-Raw
- bfloat16 推理需 16GB 以上显存,低显存需用量化版 —— krea/Krea-2-Turbo
- 许可证限制使用场景,不得用于移除安全措施、水印等 —— krea/Krea-2-Turbo
- 对提示词措辞和采样参数非常敏感,需要反复调试 —— Lakonik/AsymFLUX.2-klein-9B
- 不同设置下出图风格差异大,可复现性偏弱 —— Lakonik/AsymFLUX.2-klein-9B
- 20B 文本编码器体量偏大,部署门槛不低 —— microsoft/Lens-Turbo
- 不支持图像编辑能力 —— microsoft/Lens-Turbo
- 非 Turbo 版在 4090 上 50 步约需 40 秒,速度仍偏慢 —— microsoft/Lens-Turbo
- 细节偶尔与 prompt 偏离——食物摄影示例中部分细节未按提示生成 —— microsoft/Lens-Turbo
- 非 Turbo 版在 4090 上仅约 1.2it/s,对硬件要求高 —— microsoft/Lens-Turbo
- 已从应用商店下架,不再提供下载 —— microsoft/Lens
- 官方引导用户迁移至OneDrive/OneNote扫描,工作流变复杂 —— microsoft/Lens
- 本地直接保存功能随应用下架不可用 —— microsoft/Lens
- 结构化文本(信息图、图表)在所有变体上均失败 —— microsoft/Mage-Flow-Turbo
- 微软已从HuggingFace下架模型,社区获取困难 —— microsoft/Mage-Flow-Turbo
- 编辑推理比生成慢,Base/RL编辑在RTX 4090上约12秒 —— microsoft/Mage-Flow-Turbo
- 仍需约17-18.5GB VRAM,需中高端显卡才能运行 —— microsoft/Mage-Flow-Turbo
- 局部编辑细节(如衣物纹理)可能不够精细 —— microsoft/Mage-Flow-Turbo
- 本地部署需要 128GB+ 显存,单张 H100 80GB 都无法运行,本地部署基本不可行 —— nvidia/Cosmos3-Super-Text2Image
- NVIDIA 官方 API 仍在推进中,尚未正式上线 —— nvidia/Cosmos3-Super-Text2Image
- 容易破坏小细节,尤其在图像细节丰富的区域 —— nvidia/PiD
- 使用 Euler 采样器时会产生粗糙断边和噪点背景 —— nvidia/PiD
- 官方推荐使用 SDE 采样器加噪声注入和固定 sigma 曲线,对采样参数要求严格 —— nvidia/PiD
- 社区对 PiD 与已有方案的区别存在混淆 —— nvidia/PiD
- 降低步数存在画质取舍,证据中未完整描述具体损失 —— ostris/ideogram_4_turbotime_lora
- 1 兆像素图像在 8GB VRAM 上生成耗时约 185 秒,速度较慢 —— ostris/krea2_turbo_style_reference
- Identity Edit LoRA 是社区非官方微调,非 Krea 官方产品 —— ostris/krea2_turbo_style_reference
- 使用 Turbo 时需将 CFG 设为 1,与常规用法不同 —— ostris/krea2_turbo_style_reference
- 社区曾对其是否已发布/可用存在疑问 —— Patil/Krea-2-depth-controlnet
- 压缩技术/编码效率是核心创新,模型本身并非全新架构 [3] —— prism-ml/bonsai-image-binary-4B-mlx-1bit
- 被社区指出只是 FLUX.2 Klein 4B 的量压缩(经后训练恢复性能),而非全新模型。 —— prism-ml/bonsai-image-ternary-4B-gemlite-2bit
- 官方未在 Prism-ML 的 HF Web demo 页、HF 模型页与 GitHub 上提及 FLUX 团队或原始模型,招致批评。 —— prism-ml/bonsai-image-ternary-4B-gemlite-2bit
- 底层模型是 Qwen,模型本身并非自研架构 —— prism-ml/bonsai-image-ternary-4B-mlx-2bit
- Juggernaut X 在部分用户的批量测试中表现逊于 v9 —— RunDiffusion/Juggernaut-Z-Image
- 基于 Juggernaut Z 制作的 LoRA 与 Base Z Image 的兼容性不确定 —— RunDiffusion/Juggernaut-Z-Image
- 模型自 V6 起合并了闭源的 RunDiffusion Photo Model —— RunDiffusion/Juggernaut-Z-Image
- 标签式(tags)提示词效果不如 Anima —— SeeSee21/Z-Anime
- 有用户认为 Anima 综合表现远优于 Z-Anime —— SeeSee21/Z-Anime
- 已有更轻量的动漫专用模型抢先发布 —— SeeSee21/Z-Anime
- 本页显存一栏几乎都是「暂无估算」,原因是图像模型多部件、多格式,本站不挑一个猜;这不代表跑不动。下载前看详情页里的社区反馈和官方仓库的硬件说明,以实际运行为准。
- 有在线 Demo 不等于能本地跑,能本地跑也不等于你的机器装得下;部分配置(如 LoRA、ControlNet、量化重打包)需额外底模或配套工具,以对应运行说明为准。
- 「商用」一栏按许可证归类:FLUX / Krea / Ideogram 一类多是非商业或社区许可,标「需自查」的自己读条款;本站记录可能滞后于仓库当前许可证。
常见问题
- 为什么大部分模型没有显存数据?
- 图像模型通常由文本编码器、扩散主干、VAE 多个部件组成,权重又常有 fp8 / bf16 / GGUF 多档,本站只在能确定单一权重格式时才给估算,不挑一个猜。这是本站资料的缺口,不是模型不能本地跑。下载前看详情页的社区反馈和官方仓库的硬件说明。
- 想生成动漫风格用哪个?
- 本页里专做动漫风格且 Apache-2.0 可商用的是 Z-Anime;社区反馈里更多人认为 Anima 综合更好,本站也收录了 Anima-2.9B,但它是非商业许可。两者都先小批量试再定。
- 只想先试试效果,不想装环境?
- 看详情页有没有「官方体验」链接:推荐里 FLUX.1-dev 和 Bonsai-Image 有官方 Space,Lens-Turbo 和 Z-Anime 没有。在线能出图不代表本地装得下,这两件事分开判断。