8月27日上午9点接受预购、9月22日发售。MacMiniM6、标配16G+256G=6999元·运行内存标配16G/↑1500元=24G/↑3000元=32G。发布当天,#Macmini性价比神机没了# 和 #苹果发布全球首款量产2nm芯片# 一起挂上了榜。但对本地大模型玩家来说,这可能是2026下半年最容易看走眼的一条产品叙事——官方口径"AI性能暴涨4倍",而评论区记住的是:去年M4价格最低的时候3000以内,现在直接翻倍还不止。这篇文章不讲2nm的工艺情怀,只把三笔账算清:营销的4倍到底测的是什么、16G标配的带宽到底给没给到、聊天和Agent之间隔着几道墙。看完你就知道这6999元是给谁的、不是给谁的。新浪微博新浪微博新浪微博
"4.8倍"测的是提示词,没测你的每秒出词
先把苹果的数字拆开看。M6的12核GPU每个核心内置神经加速器,AI峰值算力较M5提高近30%。官方宣传里和本地模型最沾边的话术是:提示词处理速度比M4快4.8倍,比M1更是快了13.5倍。注意被测量的对象:提示词处理是 prefill,把整段输入一口气并行算完,算力主导,神经加速器升级吃得最饱的就是这一段;而你日常用本地模型等出来的每秒一个词,是 decode——逐 token 生成,每生成一个几乎要把全部权重读一遍,天花板是内存带宽。社区的吐槽点破得最直接:我靠,论小字还得是苹果啊,4.8倍和4倍是测的AI能力。换句话说,"4倍"在它自己的口径里成立,但和你等token的时间几乎没有直接关系。新浪微博知乎新浪微博
16G标配,给的是和M5同档的带宽
更关键的一处在带宽上。全网都在转的"最高170GB/s"藏着配置级差异:内存方面,M5的内存带宽是153GB/s,M6的16GB版本也是153GB/s,24GB和32GB版则是170GB/s。也就是说,6999元的入门款首发页,带宽并不是营销图里那个170,而是与上一代M5同档的153——170要加1500元上24GB才开始生效。知乎
把Mac阵营的带宽阶梯摆全才看得清位置:有跑过大模型的用户提醒,如果你要跑大模型,M2Ultra是800GB/s,M5Max是614GB/s。真正"暴涨4倍"的是Studio线的M5 Ultra,这次的内存带宽是重点,达到了1200GB/s。而mini线从M4的120GB/s到153/170GB/s,只是27%~40%的提升。按"每秒出词≈带宽÷单token读取字节数"的量级粗算:社区刚用一台16GB入门款M4 Mac mini一键装上27B本地大模型,视频中实测生成速度约10Token/秒,和120GB/s的理论档位对得上;同口径换算,M6标配约13、32GB版约14 tokens/秒。说好的4倍呢?不存在。知乎知乎哔哩哔哩
当然,统一内存阵营有真实的容量诉求:圈内转述DeepSeek V4 Flash已到552B规模、输入激活约8B,对这类超大MoE,模型"装不装得下"是第一道门槛——这也是《统一内存是本地部署大型MoE模型的版本答案?》这条视频能冲到近万播放的原因。哔哩哔哩
但反方同样不是抬杠:模型越大算得越慢 光内存大带宽慢依然不可用。就在那条视频的评论区,有老哥自述M3 Ultra 512G到手就试了本地大模型,评价是"一用一个不吱声,最后捏着鼻子买了5090"。装得下和跑得爽,从头到尾是两件事。哔哩哔哩
"聊天很爽"和"跑Agent"之间隔着三道墙
这台机器上最成体系的实测结论是这样的:聊天模式看起来很不错,但真正拿来跑Agent后,上下文、速度和资源占用完全是另一回事。原因是Agent把Mac的短板按步数放大:一个任务循环十几到三十步,每一步都要重新prefill整个上下文、再decode出几百token的回答——十几token每秒的速度意味着一步等几分钟;KV缓存一层层叠加在本来就不富余的统一内存上;整条链路里唯一被M6"4倍"帮到的,恰好只有prefill那一段。这道墙也不是Mac独有:PC侧同一波热度里,7.2GB的Bonsai227B三进制量化模型,RTX306012G单轮推理非常强,但一放进真实Agent循环就频繁超时。哔哩哔哩哔哩哔哩
而重度用户在评论区留下的问题,没有人能给答案:每秒 10token,我想问我一天烧上亿token,怎么办?更直观的参照来自云端用户:用过 350 速度的 API,回不去 35 速度的了。哔哩哔哩哔哩哔哩
SSD流式这种"低内存奇迹",别算进预算
24G的Mac mini现在有了不用加内存跑35B的玩法:35B模型在Mac上通过SSD运行:Edge0从磁盘流式加载mixture-of-experts,仅需3GB活跃内存。slotstream甚至把125B的MoE塞进了16GB档Mac,官方README的数字诚实得少见:48GB机器热解码约12tok/s,16GB档标注为估计值(约4tok/s)。但源码级核查给这类方案泼了冷水:宣称3GB内存运行35B大模型,实测发现隐藏了页缓存开销与精度阉割真相。这类项目是给折腾党准备的实验室,不是给购机决策准备的承诺——看戏可以,下单预算里别算它。哔哩哔哩哔哩哔哩哔哩哔哩
谁值得买,谁买了是交学费
拿它当Agent、写码、高token生产工具的:别买。标配款直接出局,连视频作者自己都承认:Ollama 装不了27b的,16g也就能玩玩9b。这个战场属于PC的24G显存档或者云端API——8万预算的社区横评里,这期围绕Qwen3.827B+MiniMaxH3,对比四套完全不同的硬件方案:RTXPRO500072GB、双DGXSpark、MacStudioM5Ultra256GB、双RTX409048GB魔改。四套方案,没有一套的主角是mini。哔哩哔哩哔哩哔哩
想要后台常驻小模型做聊天、翻译、离线写作,在乎低功耗静音、24小时常开、数据不出门的:可以考虑,但先别急着上新。有用户按"能做什么、能否后台常驻、怎样用好"三个问题实测过Mac后台常备小模型的方案,日常够用。但拿6999的M6标配去对比3000多块的二手M4,同为16GB,差距只是120→153GB/s、体感10→13 tokens/秒,多花的那两千多块买的主要是首发溢价。真要跑27B,24GB版(8499元)才有完整席位——顺带拿到170GB/s。社区高赞选型经验说得更直白:举个例子m232G的使用体验远高于m416G,同样m432g一定也远高于m616g。对本地模型,内存大小优先于芯片代数。哔哩哔哩知乎
真要当超大MoE的玩家,统一内存的话语权在Max/Ultra线,不在mini。苹果自己给出的另一条叙事是:更狠的是M5Pro版(12999元,64GB内存),苹果官方直接演示了"多台Macmini用雷雳5组集群跑大模型"。1TB带宽的Mac Studio尚且被社区追问:带宽很重要,但如果只知道看带宽,说明你根本不懂大模型。知乎哔哩哔哩
接下来两周值得盯的观测信号:9月22日首批M6标配实测,decode有没有跳出"约13 tokens/秒"的量级估算;二手M4的价格走向——有作者用历史成交更新的数据模型里,Macmini的换代冲击均值是35%。海鲜市场商家的判断却只是"M4或小幅降价"。这组分歧发布会后就见分晓。以及MLX/oMLX这条加速路线的天花板——Mac Studio上本地部署Qwen3.827B,实测50+Tokens/s,会不会把标配带宽档的差距追回来。知乎知乎哔哩哔哩
说到底,M6 mini是一台真升级的"AI PC",但在本地大模型的世界里,这次升级兑换成三个数:153GB/s、27B档位、约13 tokens/秒。多花2500元,买大约3个token每秒的提升——在营销词海里,除法是用户手里最诚实的工具。买不买的答案从来不写在代格里,写在你每天要它跑什么、跑多少里。