开源监控平台 Grafana 8 月刚更新到 13.1.3。知乎这边 B 站上 NAS 监控大屏、机箱副屏的教程又火了一轮:绿联给 NAS 加上了监控中心。哔哩哔哩飞牛有无线屏和轻量监控 fnmon。哔哩哔哩
还有人花四块六买个小屏给 NAS 做信息面板。哔哩哔哩看得人心痒——自己的 NAS 是不是也该整一块花花绿绿的仪表盘?先别急。我把这几个平台的教程和评论区都翻了一遍,发现最有意思的不是教程本身,而是评论区吵起来的那几派。今天这篇不教你装,先帮你判断:你到底需不需要装。
评论区的三派争论,比教程本身好看
NAS 监控教程的评论区,基本稳定输出三种声音。
第一派是"太重派"。有人在教程下直接开怼,说家用 NAS 上企业级 Prometheus 加 Grafana 太重了。哔哩哔哩这套东西本来就是给几十上百台服务器的集群设计的,家里一台 N100 小主机,光跑监控全家桶就吃掉一截内存,确实有点杀鸡用牛刀。
第二派是"吃灰派"。有条评论我觉得说得最透:多年前他也用 HomeAssistant 做过类似的可视化,做完之后除了截图发朋友看看,几个月后就彻底吃灰了。他想明白的原因很扎心:系统本就追求稳定,功能逻辑几乎不会变动,可视化几乎用不上;而还在折腾的、不够稳定的需求,可视化框架又跟不上变化。可视化除了展示,并不能解决什么实际问题。哔哩哔哩
第三派是"够用派"。有人说得更绝:NAS 的根本是稳定,无尘机柜里根本不带看的,五六年都不看一眼。哔哩哔哩
另一条高赞补充也到位:对于 NAS 这种硬件架构,搭一个异常推送就足够了——就像装修时你需要盯着施工,但没人会实时监控自家地基沉降。哔哩哔哩
三派吵归吵,其实指向同一个问题:监控的价值,到底在"看",还是在"被通知"?评论区有人一句话总结:不需要监控,但是需要告警通知。哔哩哔哩
Grafana 的真正价值,不是监控,是"统一"
先说清楚 Grafana 是干嘛的:它自己根本不采集数据,而是一个"可视化+告警前端",能把上百种数据源接进来画成仪表盘。知乎GitHub 上它已经拿到 7.4 万 Star,社区里现成的仪表盘模板一抓一大把。知乎
单台设备其实轮不到它。群晖有自己的存储管理器和硬盘健康提醒,飞牛、绿联新机自带监控面板,PVE 后台也能看 CPU 内存。只看一台机器,系统自带的就够了。
Grafana 真正开始值回票价的时刻,是你家设备超过两台、而且五花八门的时候:NAS 上跑着 Docker,PVE 里开着虚拟机,软路由刷了 OpenWrt,角落里还有 Home Assistant 和一台吃灰的矿渣。每个系统一个后台,查一圈要点开五个页面。这时候 Prometheus 把各家指标统一抓上来,Grafana 一块大盘全部展示,才是它的主场。B 站那些高播放的教程,比如"NAS、软路由、智能家居状态监控一套全搞定",本质上卖的都是这个"统一感"。哔哩哔哩小红书上也有人晒自己搭好的监控系统,Prometheus 负责采集、Grafana 负责展示,服务器状态一目了然。小红书

所以第一个判断标准很简单:你家需要被监控的设备,是不是多到"分开看已经嫌烦"了。是,往下读;不是,用系统自带的就行。
吃灰定律:先配告警,再谈大屏
那位"吃灰派"老哥的评论,值得每个想装 Grafana 的人读三遍。他点破了一个很多人装完才想明白的规律:
家里真正需要盯的东西,分两种。一种是"稳定运行、几乎不会变"的——NAS 硬盘、电源、网络,这类东西不需要你天天看曲线,它只需要在出事前给你发一条消息。另一种是"你正在折腾、天天在变"的——新装的容器、刚超频的机器,这类东西变化太快,画好的面板很快就跟不上,看了也没结论。
两种情况,答案都不是"天天盯大屏",而是把告警配好。硬盘 S.M.A.R.T. 报错、容量超过九成、机器掉线、温度异常——这几条推送到手机,比一块常亮的仪表盘实在一百倍。有团队分享过自己的经历:告警从一天两百多条精简到五条,值班的人才真的开始看。知乎家里更是这个道理,告警多了等于没告警。
所以正确的顺序是反过来的:先把告警通道搭起来,再决定要不要为"好看"投入时间做仪表盘。顺序一颠倒,大概率就是三个月后吃灰。
四条路线对号入座
把全网正在用的方案捋一遍,大致是四条路线,按自己的情况选:
路线一:系统自带,零折腾。群晖、威联通、飞牛、绿联的自带监控和健康提醒,把硬盘告警、容量提醒的通知打开就行。适合 NAS 只用来存照片、存文档、做备份的用户。这条路不丢人,评论区那帮"五六年不看一眼"的老哥,用的就是这个。
路线二:轻量展示,十分钟出效果。想要"看得见"但不想装全家桶的,可以看各家的轻量方案。飞牛有无线屏这种现成的 NAS 监控屏。哔哩哔哩也有人用 1Panel 这种带监控页的管理面板。哔哩哔哩还有老玩家直接在机箱上放一块小副屏,AIDA64 数据和 NAS 照片相册一起轮播。哔哩哔哩适合爱看数据、但设备不多的颜值党。
路线三:Grafana 精简三件套。Docker 里起 Prometheus + node_exporter + Grafana,半小时能跑起来。设备两台以上、想统一看的,选这条。面板别自己从零画——社区现成模板直接导入,有人踩坑两年后的经验就是"别自己画,找现成的"。知乎

路线四:全套可观测。Grafana 再挂上 Loki 收日志、Alertmanager 管告警分级。这是给家里跑几十个容器、把 HomeLab 当生产环境折腾的硬核玩家准备的,普通用户到不了这一步。
时间成本上给个参考:路线一十分钟,路线二半小时,路线三从安装到导入面板大约一两个小时(大部分时间花在对齐各台机器的 exporter 上),路线四按天算。
真要装,这几个坑提前知道
最后给决定走路线三、路线四的朋友几个提醒:
一是版本。8 月新装直接用 13.1.3 这一代就好,这个版本在推"可观测性即代码",仪表盘配置可以跟着 Git 走,等于面板也能备份和回滚了,对怕折腾丢配置的人是实打实的利好。知乎
二是上手。装完第一件事是接数据源,Prometheus 这类常用源就摆在连接页首页,点一下就能添加。

语言也不用担心,界面可以切成中文,面板编辑页的选项都有中文说明。

三是数据。Grafana 自己的数据都在本地,磁盘空间会慢慢涨,记得定期备份,迁移机器时直接搬走。知乎
四是预期。装完的第一周你会天天看,第二周开始就不看了——这很正常,不是白装了。它的价值在那几条告警触发的瞬间,平时安静才是它该有的样子。
你家的 NAS 现在跑着什么监控?是系统自带够用派,还是已经整上了全屋大盘?评论区聊聊,看看哪派人最多。