端侧AI把全屋智能的"大脑"从云上搬回家:签约前,先问这五个问题
9月7日到8日,48小时,端侧AI行业密度罕见地高:华为发布鸿蒙OS7,官宣"全球首发300亿参数的手机内置端侧AI大模型"。新浪微博面壁智能开源MiniCPM5-2B,按其官方口径,这个2B模型在"AA榜单"最新评测里"在全球4B参数规模以下的开源基座模型中综合表现第一"。知乎36氪同日发《端侧AI"小时代"》,开场白是一场Mac mini抢购潮:2026年1月下旬一个以"龙虾"之名为人所知的agent走红后,引发了对一台随时能干活的AI主机的争夺。36氪海尔智家则在9月5日刚在IFA2026做完一轮AI全面迭代。
同一周,知乎的全屋智能问答区被同一个问题刷屏——“断网不瘫痪,才是真正靠谱的全屋智能”。一边是模型厂、手机厂、家电厂同时往"端侧"押注;一边是装修业主最朴素的焦虑:我家这套花了几万块的智能系统,断网了还剩下什么?
这篇内容服务的是:家里正在装修、全屋智能预算已定或方案已出、准备签约但还没落笔的那批人。不重复"全屋智能=手机开灯"的常识,也不教极客怎么部署本地模型——那是B站教程的事。你要带走的是一张把"端侧AI"翻译进报价单的谈判清单。
一、9月这波"端侧"密集上新,到底在卷什么
把这几天的信息按"AI住在哪"排一遍,方向感就出来了:
模型层:面壁MiniCPM5-2B开源,知乎技术讨论里被反复引用的数字是GDPval-AA v2真实工作任务上的831分——它的含义不是"83.1%正确率",而是一个2B级小模型在真实办公任务比较里站到了多个更大模型前面;"距人类基线169分"已经成了独立议题。知乎截至2026年8月,MiniCPM系列开源模型下载量已突破5000万,这个2B新模型已接入主流开发工具链。知乎专栏
手机层:小米的玄戒O100原型机"内置MiMo端侧模型,实测可达每秒295 Tokens",但那台机器取消了影像模块、主板全部重做、加了主动风冷散热——是演示终端,不是商品。新浪微博
盒子层:小米AICube把三颗玄戒芯片装进铝合金方盒、配80GB统一内存,仍是工程原型,没公布价格和开卖时间;苹果M6 Mac mini 6999元起、最高32GB内存,新版Mac Studio拉到128GB/512GB档,9月22日发售;苹果与Google合作的第三代基础模型里包含3B端侧模型和一个稀疏结构20B端侧模型。36氪
家电层:海尔智家在IFA2026的叙事是"AI之眼2.0"+具身、洗护、清洁、陪伴机器人集群首次集中亮相,官方口径里智慧饮食打通"购存管取烹"全链路;国内智家APP月活突破1600万,Agent月活增幅93%。36氪

最值得琢磨的是小米:6月发布的Miloco 2.0把米家摄像头的音视频、MiMo模型与设备控制接在一起,尝试识别家人、记住习惯、再调动家里的设备——听起来正是"家庭本地大脑"。但36氪记者翻它的官方部署文档发现:小米自己推荐的方案,是让用户备一台全天运行的Mac mini。36氪家庭端侧AI,目前还在"借别人电脑住"的阶段。

所以这波变化的准确描述不是"全屋智能突然变聪明了",而是:过去几年行业解决的是"本地执行"(断网也能开灯),这个月行业开始卷"本地理解"(断网也能听懂你、记住你)。前者已经白菜价,后者正在进入报价单的窗口期。
二、把"把AI搬回家"标个价:三档成本模型
参数、内存、钱,三者可以换算。36氪给的粗算:以4比特量化计,70B模型仅权重就约需35GB内存——还没算缓存和系统开销。36氪翻译过来:
路线 | 是什么 | 典型花费 | 代价 |
|---|---|---|---|
A. 中枢自带NPU | 智能主机/中枢网关内置端侧算力,AI随系统升级 | 打进全屋智能报价,不单独花钱 | 天花板看厂商心情,闭源生态锁死 |
B. 家庭AI主机 | 中枢外接一台常开小机器(Mac mini、旧PC、AI盒子)跑本地模型 | 6999元起(M6 Mac mini),或AIBOX类M.2方案 | 自己维护、24小时待命、责任边界模糊 |
C. 纯云端 | 语音理解、场景推荐全在服务器 | 最省,甚至免费 | 断网即变"智障",数据出家门,可能订阅收费 |

知乎那篇高热度回答给的对比量级可以拿来参考:本地控制响应100—300毫秒,云端路径800毫秒到2秒;小米中枢网关三百多块、华为智能主机X2 Pro、Aqara M200网关499元——"本地执行"已经是几百块的事。知乎贵的是"本地理解":要么给中枢加算力的整机溢价,要么你自己造一台B路线的小服务器。
判断给到这里:预算1万以内的后装/租房党,把"本地执行"和传感器买扎实,"本地理解"继续用云端,不值得焦虑;预算3万—10万的前装业主,中枢主机的算力配置第一次值得写进合同谈判——因为全屋智能是不可逆的前装生意,买错系统的代价远大于买错一部手机。
三、签约前,拿这五个问题去问集成商
断网现场给我演示一遍。 拉闸弱电箱,看还剩什么。展会演示能拉闸,你家为什么不能?分清两句话:“自动化能不能本地跑”(执行)和"语音能不能本地懂"(理解)——大多数方案的宣传页混着用。
语音指令在哪解析? 直接问解析时延量级和断网后的完整程度。带中枢的系统能把"开门亮灯"压进200毫秒以内,纯云方案在800毫秒—2秒之间,这不是玄学,是半夜摸黑等不等的问题。知乎
摄像头、扫地机、陪伴机器人的数据在哪处理? 跌倒检测、污渍识别、家人识别,全都要"看"你家。问清哪些在本地、哪些上传、能否关闭上云。
AI能力买完还能不能升? 对方说"支持OTA"就追一句:模型是开放的还是封闭的。MiniCPM5-2B这类2B开源模型已经把"端侧通用Agent"的门槛踹低——官方说法是它"初步实现了端侧通用Agent雏形"——接下去两三年大概率有中枢厂商直接跑开源小模型;你的中枢最好别是2028年的终点站。知乎专栏
中枢是不是孤立盒子,设备用不用标准协议? 知乎落地帖反复吐槽"米家+涂鸦双生态配网冲突、改方案就要换灯"。协议标准(Matter/Zigbee/Thread)决定你五年后的议价权。
四、不同人怎么接这个变化
租房、轻改造党:小红书上"出租屋500元实现智能家居"能收934个收藏,说明这条路的共识早就有了——传感器+基础中枢,别为任何"端侧AI"字样多付钱。你真正会踩的坑是红外PIR传感器识别不了静坐的人,把预算花到毫米波存在传感器上比花到"AI"上值。
正在装修、准备签约党:上面五问就是你的谈判脚本。另外,"灯光模式是不是噱头"这类社区争论提醒了一件事——很多全屋智能的钱浪费在过度设计的场景上,而不是浪费在算力上。先把执行和传感做对,再谈大脑。
看海尔这类家电大厂方案的人:IFA上的海尔讲的是一个"家电自己长AI"的故事——AI之眼2.0、烹饪机器人CR3(四轴自由度、模仿大厨颠勺手法、从投料到涮锅全程不用动手)、面向长辈的陪伴机器人。36氪方向没问题,但营销通稿里的"Agent月活增幅93%"证明的是使用率,不是本地能力;知乎回答提到海尔AWE2026的PLC"有电就有网"方案,也还是厂商口径。知乎看海尔,重点盯两样:国内智家中枢的NPU规格表,和Agent功能是否单独订阅收费。
极客:HomeAssistant+一台能跑的机器+MiniCPM5-2B,今年第一次"家庭AI不依赖任何厂商"变得可及。但这是玩,不是给普通业主的购物建议。
五、泼冷水:哪些数字现在还不能当真
"300亿参数手机内置"是发布会口径,零售机上的真实可用度还没被社区验证;295 tokens/s来自取消影像模块、主板重做、加主动风冷散热的双芯原型机,不能拿来外推明年商用的O100。新浪微博
"超过75%新装方案采用本地控制"出自知乎回答转述的行业联盟数据,无法独立核实,当方向参考。知乎
海尔IFA那篇文章出自自媒体"锦缎"之笔、由36氪经授权发布,份额、专利15连冠、Agent月活增幅93%这些数字都是企业叙事,证明的是使用率与销量故事,不是端侧本地能力。36氪
反向反证同样存在:社区里"AI是不是溢价"的争论(B站有视频直接问"你花大几千买的旗舰手机,AI到底值多少钱")说明相当一部分AI功能用户感知不到。全屋智能也一样——多花的钱如果买不来你每天用得上的那一次"断网不断联",就是噱头。哔哩哔哩

六、接下来盯什么信号
玄戒O100"明年商用"兑现到什么价格——端侧AI加速芯片第一次变成公开报价。
苹果3B/20B端侧模型的国区落地时间表。
米家中枢、华为主机、Aqara们有没有哪家把"可运行2B级开源模型"写进规格页——MiniCPM5-2B开源是引信。
海尔智家IFA那套场景在国内产品线的落地节奏。
这四条线在2027年前后交叉的话,"家里有现场大脑"会从销售话术变成参数表。而在它变成参数表之前签约的业主,能做的最聪明的事就一件:报价单里给中枢算力留冗余,合同里写清楚AI功能的升级义务。
端侧AI这个9月对普通人的意义其实很具体:它把"AI住在你家还是住在别人家数据中心"从哲学题,变成了可以问出口、可以比价、可以写进合同的参数。把它带上谈判桌,比替任何发布会激动都实在。