点完更新去洗澡,回来5个存储空间全没了:我读完飞牛近半年的升级翻车案例,整理出这份安全升级清单

源自10位全网作者

11:08

今天早上刷到一条飞牛用户的社区帖,看得我心头一紧。

他的NAS半年多没关机,最近调整家里网络,顺手把系统也更新一下。点完更新去洗澡,回来直接傻眼:5个存储空间全部显示"未挂载",点挂载还报数据库读写错误。小红书

换作大多数人,可能当场以为硬盘炸了、数据全完了。但这位用户的处理值得记下来:没有格式化,没有重建存储空间,也没有直接跑btrfs check --repair这类高危命令,而是SSH进去排查,发现是PostgreSQL数据库服务挂了。顺着日志一路查,根因是系统里的时区文件变成了0字节空文件,故障链随之水落石出:时区文件损坏导致数据库起不来,飞牛后台读写不了,存储空间才集体显示未挂载。小红书硬盘上的数据从头到尾都是完好的,倒下的是系统的"管理层"。最后他重装了同版本的tzdata包、重启数据库,存储空间全部恢复。

这不是个例

点完更新去洗澡,回来5个存储空间全没了:我读完飞牛近半年的升级翻车案例,整理出这份安全升级清单

把时间线拉长看,最近半年各平台上能查到的升级翻车案例,大致可以归成四类。

第一类是存储空间异常。7月底一位在电视盒子上刷第三方固件跑飞牛的用户,点完升级直接报错"存储空间或SSD缓存发生了降级、损坏故障",除系统盘外全部硬盘显示移除,重启5次都救不回来,最后查明是升级后新内核装上了、启动文件却还是旧的,改了设备树配置才恢复。知乎

第二类是网络异常。2月有用户升级到v1.1.19后,有线网卡拿不到IP,设置里明明关着的无线WIFI却自己打开,管理后台怎么都进不去,他直言"之前0day系统漏洞都没想弃坑飞牛,现在实实际际的影响到正常使用了"。知乎

第三类是系统变慢。8月中旬有用户反馈,更新到1.2.0401后所有进程都很慢,CPU占用一直低于5%,但Docker容器页面、应用中心却一直加载失败。小红书

点完更新去洗澡,回来5个存储空间全没了:我读完飞牛近半年的升级翻车案例,整理出这份安全升级清单

第四类是升级卡死。2月初有用户升级1.1.18时界面卡住,几个小时不动,结束任务重进还是老样子。小红书

而飞牛的更新节奏,圈内人都熟悉:几乎每周四例行更新,偶尔周五加更。小红书今年1月底,飞牛又曝出0day漏洞,未登录状态就能访问系统文件。知乎官方随后连续推送紧急安全更新,社区一度讨论"强制升级"是否合理。知乎矛盾就出在这里:更新快是好事,安全补丁和新功能来得勤,但每次更新的爆炸半径也是真实的。飞牛不只跑在官方硬件上,还跑在各种DIY小主机、电视盒子、瘦客户机和第三方固件上,硬件越杂,出幺蛾子的概率越高。"有更新就立刻点"的肌肉记忆,有时候反而是风险来源。

到底要不要升级?分三种人

先说句公道话:每周跟着更新的用户,大多数安然无恙,翻车是少数。但翻一次车的心理冲击太大——你会以为数据全完了,而且自救需要一定的SSH能力。所以别走极端,对号入座即可。

立刻升的,是等安全补丁的人。官方推送安全类更新时不要等,漏洞不等人,晚一天就是多一天裸奔。飞牛安全团队在2月的公告里就明确提示,部分设备在公网环境下存在异常访问风险。知乎升完顺手检查一下公网暴露面:不需要外网访问就关掉公网入口,确实需要的,至少把访问码开起来。

可以等一周的,是机器稳定、没有强需求的人。数据重要、多盘大容量、Docker装了一堆的复杂环境尤其如此。新版本最大的价值通常是新功能,而新功能不急这一周。等社区先替你踩一遍坑,确认没有集中翻车再动手。有用户甚至因为受不了频繁更新重启,主力机继续用黑群晖,只把飞牛当辅助。知乎

要格外小心的,是第三方固件和ARM设备用户。前面几个翻车案例里,刷了第三方固件的盒子、ARM机型占比最高——它们的启动链路被改过,升级最容易踩中兼容性断裂。动手前建议先搜一下同型号、同固件有没有人已经安全通过。

升级前的十分钟清单

决定要升的话,按按钮之前花十分钟做四件事:

  1. 别点完更新就走。今天这位用户就是点完去洗澡,升级过程中出异常只能干等。挑一个你能守在机器前的时间段再动手。

  2. 重要数据做冷备份。照片、文档这类不可替代的内容,至少在另一块盘或另一台机器上留一份。存储空间未挂载还能救回来,慌乱中误格式化就没救了。

  3. 记下当前版本号和硬盘配置。版本号、几块盘、什么RAID模式、什么文件系统,写下来。真出事时,这些信息决定别人能不能快速帮你定位。

  4. 升级过程中别动硬盘和容器。很多问题出在升级完成后的首次启动,让系统把启动流程走完再下判断。

点完更新去洗澡,回来5个存储空间全没了:我读完飞牛近半年的升级翻车案例,整理出这份安全升级清单

真翻车了,记住"三不一要"

三不:不格式化、不轻易重建存储空间、不盲目跑btrfs check --repair这类修复命令。飞牛的很多危险操作在界面上都会用红字提示"数据将被删除",那不是吓唬人。小红书数据本来没丢,是你的恐慌操作把它删掉的。

点完更新去洗澡,回来5个存储空间全没了:我读完飞牛近半年的升级翻车案例,整理出这份安全升级清单

一要:要先排查系统服务,再看硬盘。先确认硬盘还能不能被识别,容量和健康状态是否正常——如果正常,问题大概率在系统层。然后SSH进去跑一下systemctl --failed,看是哪个服务挂了,再对着日志找根因。今天这个案例,最后发现不过是一个损坏的时区文件。

不会SSH也别硬抄命令,把报错截图、版本号、设备型号一起发到社区或官方论坛,等同款病例。盲目照搬别人的修复命令,根因不同只会雪上加霜。

最后说两句

对飞牛应该说句公道话:每周更新的节奏、功能迭代的速度,在国产NAS系统里确实少见,鸿蒙客户端、系统相册联动这些动作也不含糊。快速迭代和绝对稳定本来就难两全,作为用户,正确的姿势不是抱怨,而是把"系统升级"当成一次有风险的操作来管理:备份、在场、不慌。

接下来有两个信号值得盯着:一是官方更新日志会不会标注已知问题和临时解决办法,这是2月那位网络故障用户明确提出的建议。知乎二是1.2.x版本在未来几周会不会再出现集中的翻车反馈。你如果这次升级翻车了,或者安全上岸了,都欢迎在评论区说说版本号和机型,可能就帮下一个人保住硬盘。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章