这几天,本地AI创作圈被MiniMax H3点爆了。7月31日发布、8月3日开源,资本市场在H3发布后把MiniMax股价推高78%。知乎本地部署更是狂热:B站一条本地部署教程视频几天就播了5.7万,评论区清一色在问"我的显卡能不能跑"。哔哩哔哩就在这股热潮里,英特尔也在开源当天于官方新闻室挂出了一篇《为MiniMax H3提供Day 0支持》的软文。
这个"Day-0支持"到底是什么?原文写得很清楚:它是一套8张锐炫Pro B70的企业级部署方案——Encoder 8卡张量并行、DiT 8卡USP结合Layer-wise Offloading、VAE解码也落在B70上。英特尔新闻室按宣传口径单卡万元以内计算,8张卡光显卡就接近8万,而且方案代码与配置并未公开,普通用户能摸到的只有"支持"两个字。社区的总结更扎心:英特尔为我们提供了除支持以外的一切支持。哔哩哔哩

那I卡到底能不能跑H3?有玩家已经自救实测:A770 16G能跑,但前提是放弃int4、int8量化,改走bf16、gguf格式。哔哩哔哩而ComfyUI官方H3整合包里最主流的加速路径恰恰是int8和NVFP4量化——放弃它们,速度和显存效率直接掉一档。同一波讨论里,B570的反馈是"在comfyui成功跑通了,就是慢到流口水",B580用户则有人卡在VAE报错,全靠第三方插件摸着石头过河。哔哩哔哩
对照N卡这边:3060 12G挂INT4加速包,5秒片段3分钟出片。哔哩哔哩社区已验证的跑通下限是12GB显存+32GB内存+NVMe,RTX 4070有完整跑通记录。知乎说句公道话,I卡不是不会做AI视频生成:今年4月ComfyUI就出了英特尔显卡官方版,B580当时已跑通LTX 2.3图生视频。哔哩哔哩缺的正是这次对H3的官方兑现。

决定买卡跑H3之前,还有一笔账要看明白。第一,开源的只是H3-Base,本地原生生成上限是1344×768,官网宣传的2K效果依赖未开源的In-Context Regeneration模块,你本地跑出来的是"草稿机",不是官网那个效果。知乎
第二,真正卡住消费卡的不是DiT主干而是文本编码器:量化后的DiT只有19.5GB,而文本/视觉编码器Qwen3-VL-32B的bf16权重高达48GB,比量化版DiT还大一倍多。知乎系统内存不到32GB的更要谨慎,offload落盘的速度会让你怀疑人生。
第三,生成耗时超线性增长:12GB卡实测5秒4.7分钟、10秒16分钟,正确姿势是永远先用5秒迭代提示词,满意后再拉长。知乎这三条,是教程最不爱告诉你的成本。

账算完,决策就简单了。只想尝鲜、一天出不了二十条片段的:别买卡。H3 API官方价约0.3元每秒,第三方接入更便宜,一天二十条一个月也就千元上下,比任何显卡都划算,还不用折腾环境。知乎已经手持I卡的:可以玩,但把预期设在"能跑"而不是"好用",放弃int4/int8、盯紧ComfyUI-MiniMax-H3-Turbo、H3-Multishot和4步加速lora这几个社区插件,等英特尔的下一个动作。专门买卡跑H3的:现阶段别选I卡——这波热潮已经把16G显存的N卡带飞了。知乎再叠加眼下内存、显存涨价潮把整卡行情推高,先租云卡跑通自己的工作流、验证出片率,再决定买不买卡,是最稳的路线。
最后留几个观察信号:英特尔是否会放出单卡B70方案或公开8卡配置代码;ComfyUI官方英特尔版会不会跟进H3(LTX已经验证过这条路);以及GDDR涨价潮是否缓和。这三件事不动,"为H3别买I卡"这个判断短期内就不会变。英特尔该着急的不是软文措辞,而是预算党们的信任,正在被一次次的"Day-0"慢慢磨掉。