6月,中文圈都在转同一条推:284B参数的DeepSeek-V4-Flash,被塞进一块树莓派5(8GB)跑通了,全速推理超过1 tok/s,功耗约8W。当事人说花了5天、做了160多次实验,用的是antirez那份未修改的GGUF。微博
9月13日,Ultralytics的YOLO Vision 2026大会在深圳闭幕。知乎
树莓派相关的展台,是另一番景象:上海晶珩带来的演示系统——树莓派5 + Realtek Matrix NPU HAT(20 TOPS),接一台15.6寸工业屏,多个AI场景同时跑。知乎·树莓派开发者
一边是表演,一边是项目。中间隔着的,恰恰是每个被"树莓派+AI"种草的人现在必须回答的问题:以现在的价格和算力,树莓派能跑什么AI?跑到什么程度才算"能用"?
我把6月以来全网的实测、官方基准和行业数据摆成一张账桌。先看完账,再决定掏不掏钱。
一、真正在跑的四件事,一件件摊开
1. 纯CPU跑目标检测:官方实测数据里,n档能用,s档勉强,m以上别想
Ultralytics的树莓派文档在9月7日刚更新过YOLO26官方基准:树莓派5、ONNX导出、640输入,同机同条件跑分(Ultralytics 8.4.14)。五档的成绩单是——Ultralytics官网
YOLO26n:单帧128.42ms,约7.8 FPS,mAP50-95 40.1
YOLO26s:352.84ms,约2.8 FPS,47.8
YOLO26m:993.78ms,一帧一秒出头
YOLO26l:1259.46ms;YOLO26x:2636.26ms

翻译成人话:不带任何加速硬件,只有n档配叫"实时检测",s档只够低帧率的抓拍类项目,m以上拿来就是自取其辱。
好消息是这一代YOLO26就是冲着算力受限设备设计的:端到端、NMS-free,专门砍掉了部署链上最烦人的那段;YOLO26n比上代YOLO11n快了约15%(6.79→7.79 FPS)的同时精度还更高(40.1 vs 39.5)。Ultralytics官方文档
官方还点名:ARM平台上NCNN格式跑得最快。Ultralytics指南页

想做"门口来人了推个通知"、"院子里的猫又跳上花坛了"这种项目,一块手头的Pi 4/5 + 一个USB摄像头就够了,不需要为"AI"两个字买新板子。
2. 加NPU加速HAT:官方线已经卷到40 TOPS,新来的20 TOPS账还算不出来
先说官方货架:树莓派自己的AI加速HAT目前在售两档——AI HAT+有13 TOPS和26 TOPS两个版本,AI HAT+ 2是单档40 TOPS,全部内置Hailo NPU,硬件加速推理本地跑、数据不出门。初代AI Kit(Hailo方案,13 TOPS)已被官方标注停产(no longer in production),文档直接让你转向AI HAT系列。再加一颗带IMX500传感器的AI Camera,神经网络直接跑在摄像头里。这条路线是成熟的:文档全、驱动全、YOLO系官方支持。树莓派官方文档树莓派官方文档·AI Kit页树莓派官方文档·AI Camera页

再看新来的:YV26上上海晶珩同场还展出了两款基于树莓派CM5的工业智能相机,适用于工业自动化和视觉检测场景。配套开源件也有:为树莓派+AX8850做的UNIStream框架,硬解码→前处理→NPU推理→目标跟踪→OSD叠加→硬编码整条流水线打通,改JSON配置不改源码,RTSP一推,VLC里就能看到带标注的结果。知乎专栏知乎
但冷静:Realtek这套刚在展会上露面,量产价格没影,第三方模型转工具链顺不顺也没人先趟。判断标准很简单——问自己一句:"我手上的模型,进它的工具链要多少人工时?"算不出这句话,20 TOPS就只是纸面TOPS。真要用HAT干活,眼下更稳的账其实是:文档驱动都齐的官方40 TOPS,和一块还没报价的新板,后者得便宜到多少才值得等。
3. 离线语音翻译:这才是"能递给爸妈用"的那台树莓派
知乎"树莓派能用来干什么"问题下那条318万浏览的回答(8月,作者云雀AI)给了一个完整实测:树莓派5 8GB + USB摄像头麦 + 蓝牙音箱,跑Google官方gemma-translator项目,按住说中文、松手出英文,语音识别、翻译、合成全部本地,模型gemma-4-E2B-it约2.59GB,支持中、英、阿拉伯、西班牙、日、韩六种语言。模型缓存完就能拔网线——没有任何东西经过云端。知乎·云雀AI
但他踩的三个坑,比安装教程值钱得多:
供电坑:一开始用5V/3A电源,能开机、能SSH,一上外设就"随机"损坏软件包。换源没用、清缓存没用,最后查`get_throttled`才真相大白:0x10000+0x40000,欠压+降频。换5V/5A 27W电源重启,玄学全消。他总结的准则我原样搬过来:多个包随机损坏还伴随I/O错误,别怀疑网络和镜像,先查电源和线材。知乎回答
音频坑:新系统(Bookworm之后)用PipeWire管音频,aplay直接怼ALSA,蓝牙音箱就是不出声,得用pactl/paplay。
下载坑:2.59GB模型在板子上直接下经常断,他改成Windows中转、断点续传+SHA256校验再SCP上去。还有个细节:听到提示音先等0.3~0.5秒再开口,否则句首被截——这是要给不会用命令行的人配成开机自启+kiosk全屏的。
端侧AI的真实价值就长这样:不吃token、不上云、有一个具体的人能用上。
4. 跑大模型对话:1 tok/s是奇观,"派当牛马"才是正确姿势
回到开头那条推:284B塞进8GB,靠的是极限量化,代价是1秒吐一个词——问一句话等半分钟,答案没出来你先失去耐心。这不叫本地大模型,这叫行为艺术。
9月15日知乎另一篇实测文章指了条实在路:把吃灰三年的4GB树莓派4B装了opencode,24小时在线、随时可连的AI助手主机——模型全在云端API,派只负责当机房,手机浏览器连家里局域网4096端口就能随时派活。一句话总结:"树莓派+AI"的多数正确姿势,是不需要在树莓派上跑AI。知乎·小梁快跑
二、掏钱之前,把三本账摆平
价格账:树莓派公司6月上调盈利预期——2026上半年预计出货超400万台,盈利表现"大幅超出市场预期"。调整后EBITDA至少3800万美元,原因说得很直白:AI需求推动销量激增。知乎·嵌入式杂谈微博
Pi 5系列的官方价签,现在从45美元(1GB)一路排到305美元(16GB)。我之前盘涨价那笔账时说过:Pi 5行情涨了近三倍,唯一没被涨价咬到的只有那块15美元小板。也就是说,你现在买树莓派是在一个卖方市场里买"理财产品",板子的溢价不是为AI准备的,是为整个市场准备的。知乎·嵌入式杂谈

供电账:Pi 5的27W官方电源不是可省的外设,USB外设一多(NVMe、摄像头、HAT、音箱),电压一抖,最先坏的是你的文件系统。省电源钱的下场,那篇318万浏览的回答已经替你演过一遍了。
场景账:给自己的需求画条及格线——视觉检测≥5帧算能上岗,对话模型≥15 tok/s算能用,翻译类"完全离线"才算有价值。达不到及格线的参数表演,看个乐就好,别按它下单。
三、对号入座
现在就动手(不用花钱):手头有旧派的,先跑YOLO26n的NCNN导出和gemma-translator,零增购,一晚上见结果——4B当24h AI牛马也是同理,先挖出来再谈买不买5。
值得买:认真要做视觉项目的(门口检测、宠物观察、花园巡检),Pi 5 + 27W官方电源 + 一个像样的摄像头,这套的钱花在哪都看得见。
再等等:冲着"离线大模型对话"来的——1 tok/s不是产品,等量化生态和内存价格回落;想上NPU HAT的——急着用就官方AI HAT+系列(文档驱动都齐),不急的话,等Realtek那条20 TOPS新线的量产价格出来,看它敢不敢打穿官方40 TOPS的存在感。
不建议:买16GB高配去追284B跑分的——那305美元买的是1秒一个词。
接下来盯这几个信号
YV26之后官方还有没有调价或补货动作——溢价回落才是真正的上车窗口;
UNIStream作者承诺的工业质检/人脸/客流定制教程更新,NPU路线的"可复刻性"就看这批。知乎·圈圈虫
Ultralytics会不会把NCNN格式的实测数据补进官方表(现在主表还是ONNX);
gemma-translator的中文场景会不会继续加语言、加离线功能——这决定了它是个玩具还是家里的常驻设备。
这一轮"树莓派+AI"的风是真的:出货400万台的生意里,AI是新的发动机。但它站在7.8帧的检测和2.59GB的离线翻译上,不站在1秒1个词的行为艺术上。给需求花钱,别给奇观花钱。