最近两个月,如果你在玩本地图像生成,大概率绕不开 Krea-2 这个名字。6 月底,Krea 团队发布并开源了 Krea 2,一个面向"创意探索"的基础图像生成模型系列,12B 稠密 DiT 骨架,base(Raw)和 Turbo 两个版本加上九款官方风格 LoRA 一次放全。知乎之前大家更熟悉的是它家闭源的在线工具,这次权重、代码、技术报告直接端上 GitHub,摆明了是冲着本地生态来的。出图水平到底什么样,先看一张社区实测样张。

ComfyUI 的跟进也很快,到 8 月中旬,B 站教程已经卷到"图像编辑流 + 397 种风格扩展",单条视频播放超过 4 万。哔哩哔哩开源两个月热度不降反升,这在本地生图圈不多见。
能打的地方,很明显
社区测了两个月,共识比较集中:审美在线,风格跨度大。ComfyUI 官方的说法是,“使用相同指令在 Krea 2 里可生成风格更加多元,质感更加独特的画面,兼顾艺术性与独特性”。微博有小红书博主做了 10 个场景的语义边界实测,人物、动物、风景、建筑、食物、毛发、微距、多主体、氛围感全部能画,红狐雪地一项打到 9.5/10,“这级别不输商业图库”。小红书

但坑和吐槽,也一样真实
中文渲染基本崩。开源当天就有人提醒"中文支持就别想了,不会太好,甚至可能都不支持"。微博知乎用户实测后说得更直接:“krea的中文崩坏严重,几乎没法使用”。知乎手部特写也是雷区,实测只有 6/10,“远观没问题,特写指节糊、像香肠”。小红书
还有两个容易被低估的点。一是 LoRA 微调偏迟钝:“微调一下lora就崩坏,krea2对lora比较迟钝,可能需要加大力度”。知乎二是一个有点反直觉的吐槽:“因为太听话了,所以感觉抽卡的每张图差异不是很大,还是希望差异性大一点”。小红书太听话也是一种烦恼,追求抽卡惊喜感的话,它可能会让你失望。
评论区还有一桩长期争议:有人说秒出图,有人说比 Z-Image 慢得多。其实两边都对,因为跑的不是同一个东西。Turbo 官方"8 步内可输出原生 2K 图像"。知乎有人拿 8GB 显卡实测,1024×1024、8 步大约 71 秒出图;而 base 版全精度再叠加双采、三采,完全是另一个时间量级。所以快慢之争的答案是:你选的是版本 × 量化 × 步数的组合,不是模型的绝对速度。
显卡要多大?按档位选
你的显存 | 建议方案 | 大概什么体验 |
|---|---|---|
8GB | Turbo + mmgp 内存卸载 | 1024×1024 8 步约 71s,峰值 9.17GB(借系统内存兜底);4 步约 40s 已可用 |
12GB | Turbo fp8/int8 量化 | 轻松跑,余量充足 |
24GB | BF16X 无损压缩权重 | 26.28GB→20.61GB,4090 可装下,逐位无损 |
不想折腾 | 魔搭 AIGC 专区网页版 | 无需本地 GPU,网页端直接出图、训 LoRA |
24GB 那行也不用慌,社区已经把压缩做好了:BF16X 无损压缩权重"压缩:26.28GB→20.61GB(1.28),100%逐位无损(bit-identical)推理",不牺牲画质。知乎
再补两个实操提醒。第一是冷启动:“每次 python 重启后首次 generate 第 1 步要 29–328 秒(kernel 编译缓存没命中),之后才回到 8–9 秒/步”,所以干活让进程常驻,别反复重启。小红书第二,显存实在紧张的话,知乎用户给过一条思路:“用模型分块加载”,用生成时间换更低显存门槛。知乎
生态,才是它值得蹲的原因
两个月下来,Krea-2 的第三方生态有点爆炸。最实用的是解决人脸一致性,有人"找到了 lbouaraba/comfyui-krea2edit 这个项目,提供一个 Identity Edit LoRA,可以让 Krea 2 锁定人物身份特征",还有 r128(0.91GB)、r64(0.46GB)两个低显存版,质量损失很小。小红书局部重绘也补上了:krea2-anypaint 是"一个挺让人惊喜的图像 inpaint/outpaint LoRA",配合 SAM 3.1 自动选区,动动指令就能擦除图中物体。知乎
不想本地部署的话,krea.ai 官网本身就是一条路:实时画布、实时编辑已经全量上线,“每天都有一些免费额度”。微博平台版 5 月 12 日上线,“他们不再在别人家的模型上面包界面了,而是从头训练了自己的基础模型”,这次开源等于把自家底座直接交给了社区。微博

室内设计这类渲染场景,是 Krea 2 很拿手的一类:风格克制、光影自然,出图能直接拿给客户看。

顺带说一个认真对待本地部署的理由:算力在变贵。Krea 自己想扩容时,云厂商的销售都不接电话了,“最终他们以每小时3.70美元签了一年期合约,涨幅32%”。微博算力在自己卡上,才是真的在自己手里。
结论:谁适合入,谁适合等
给 ComfyUI 玩家几句直接结论。要艺术感、插画感、氛围图、二次元构图,值得入,社区共识是先试 Turbo 版,8 步出图,门槛很低。要照片级写实、中文文字渲染,Z-Image 依然更稳,现在主流玩法是按场景切换:“备选 → Z-Image,需要照片级真实感时切换”。小红书
避坑清单收好:中文文字绕开,手部特写绕开,冷启动后保持进程常驻,LoRA 微调记得加大力度,商用前看清模型仓库附带的授权条款。
后续盯三个信号:官方风格 LoRA 的迭代速度(首发已有九款)、Identity Edit 这类第三方工作流的进化节奏、授权条款是否放宽。这三个任何一个变化,"值不值得入"的答案都会跟着变。