昨晚,苹果没开发布会就更新了 Mac mini 和 Mac Studio,但本地大模型圈最嗨的点,是 LM Studio 被直接写进了官网。Mac mini 页面上有"LM Studio 中的首个词元响应速度"的对比表,Mac Studio 页面则写着可以通过 LM Studio Bionic 在本地运行大语言模型。苹果官网 数码博主把它翻译得更直白:“跑大模型工具LMStudio的时候,处理提示词速度,最快能跑到M4的4.8倍,本地跑AI模型会爽快很多”。微博
评论区当晚就分成了两派。有人直接浇冷水:“刚朋友提醒,M4这个4.8倍性能提升是大模型推理能力性能提升,我寻思也没mini做本地大模型的需求啊”。微博 也有人觉得这波涨价骂归骂、东西是真香:“这台小盒子,可能是普通人能买到最便宜的「AI 服务器”。小红书 按官网节奏,8 月 27 日上午 9 点接受预购,9 月 22 日发售。苹果官网 两派说的其实都对,关键看你属于哪一派。下单之前,建议先看完两行小字。

第一行小字:4.8 倍,只快在"前一半"
苹果说的 4.8 倍,指的是 LLM 提示词处理——官方页面叫"LM Studio 中的首个词元响应速度":M6 对 M1 是 13.5 倍,M4 对 M1 是 2.8 倍,两者一除就是 4.8。博主说得更直白:“苹果自己说,处理大模型提示词的速度比 M1 的 Mac mini 快 13.5 倍”。微博 翻译成人话:这是模型"读完"你塞进去的一大段资料、吐出第一个字的速度,吃的是算力,M6 每颗 GPU 核心都塞了神经网络加速器,正好对口。但你平时跟模型对话时逐字往外蹦的速度,主要看内存带宽,而 M6 是 170GB/s。小红书 所以这 4.8 倍的真正受益场景,是长文档、RAG、大上下文智能体这类"喂料"环节,不是日常聊天的 t/s。再补一句:目前这些都是苹果官方口径,9 月 22 日才发货,独立实测还没有。
第二行小字:内存档位,决定你能跑多大的模型
对玩 LM Studio 的人来说,比芯片更关键的是统一内存:模型能不能装下,全看它。而统一内存是封装在芯片里的,容量在下单那刻就定了。先看价格和内存档位。Mac mini M6 版 6999 元起、最高 32GB 统一内存,官方定位就是办公加轻量本地大模型。微博 M5 Pro mini 值得多看一眼:最高 18 核 CPU、20 核 GPU、64GB 内存,带宽 307GB/s。小红书 Mac Studio 两档,M5 Max 版 19999 起,M5 Ultra 版直接 46999 起。微博
机型 | 起售价 | 最高统一内存 | 内存带宽 |
|---|---|---|---|
Mac mini M6 | ¥6,999 | 32GB | 170GB/s |
Mac mini M5 Pro | ¥12,999 | 64GB | 307GB/s |
Mac Studio M5 Max | ¥19,999 | 128GB | 614GB/s |
Mac Studio M5 Ultra | ¥46,999 | 512GB | 1.2TB/s |

内存多大能跑多大模型,社区已经替你算过了
16GB 起步:别指望跑大个的。已经有人把 Qwen3.8 27B 塞进单张 16G 显存里测试部署,但那属于极限操作。小红书
32GB:Qwen3.8-27B 的 Q4 量化约 17GB,“17GB 显存就能本地部署 —— 翻译一下:你不用再给云厂商交 token 税了”,8 月中就有帖子在 Mac mini 上演示过,286 人收藏。小红书 35B 级 MoE 模型只要 6-12GB,32GB 机器上随便跑。小红书
64GB:“对本地大模型来说,内存很关键,64GB 已经能承担不少本地 AI 和开发任务”。小红书
128GB-512GB:这就进入工作站区间了。M5 Max 最高 128GB 统一内存、614GB/s 带宽。苹果官网 M5 Ultra 更狠:四颗 Die 拼成一颗,512GB 统一内存、1.2TB/s 带宽,AI 算力号称是 M3 Ultra 的 4.5 倍,“能在本地跑几千亿参数的大模型”。微博 六月 WWDC 上,LMStudio 与苹果合作,在四台 Mac Studio 组成的集群上跑了一个 1T 参数的模型 Kimi K2.6。微博
明天早上 9 点,谁该按预定键
看完微博、小红书、B站这两天的讨论,我的建议就四条:
手里已有 M4、M5 的机器,想升级换个"本地模型更快"的:缓一缓。这次主要提升的是提示词处理,生成速度受带宽限制,不如等 9 月 22 日发货后的独立实测。
预算 7000 档、想入门本地模型的:M6 mini,而且务必选 32GB 版本,16GB 起步版上手就是瓶颈。注意这代是涨价换代:“Mac mini 国行起售 6999,比上代 4499 一口气涨了 2500”。微博 不想吃首发价,可以盯上代清仓。
想把本地模型当生产力的:接 LM Studio Bionic、给智能体做后端这类需求,M5 Pro mini 64GB 是这代的甜点。Bionic 是 LM Studio 团队刚发布不久的独立应用,“把本地模型、工作流和编程能力整合到一个免费应用里”。哔哩哔哩 64GB 内存,干正经活够了。
预算无上限、冲着千亿参数去的:Mac Studio M5 Ultra,46999 起。不过有人提醒得冷静:“但对普通用户来说,这么强的性能大概率会闲置,日常办公完全用不到这么高的配置”。微博 还是那句话,苹果现在卖的不是电脑,是"本地跑 AI"的入场券。
等发货这几天,有两件事可以先做
第一,等实测。9 月 22 日之后盯三个点:4.8 倍的提示词处理是不是实打实,生成 t/s 到底多少,持续负载下发热如何。2nm 的能效优势在理论上成立,机器到手才算数。
第二,先用现有机器摸底。你的 Mac 只要能装 LM Studio,现在正好去试 MLX 格式的模型,评论区已经有人在喊:“有没有大佬先试试水整个mlx的看看”。小红书 32GB 的机器,可以直接试 Qwen3.8-27B 的 Q4 版。摸清楚自己现在的机器能走多远,再决定这笔钱花不花,就不焦虑了。

你现在的机器在跑什么模型?评论区聊聊——9 月 22 日实测出来,咱们拿它对照。