这几天网工的feed流里,"智能体"三个字出现得有点密。7月30日,新华三联合中国信通院发布《AI赋能数字基础设施:ICT智能体的技术突破与建设指南》。9月9日到17日,新华三官方账号"B站-新华三网络"连发三条Cloudnet网络智能体直播课,第一课标题里就直接发问:智能体到底有什么用。9月21日当天,一篇从能力阶梯、选型维度、产品对比与信创适配给出2026选型框架的《AIOps智能运维平台选型指南》上线知乎。再往前翻,"大模型会取代网管工程师吗"的老问题下,评论区全是睡不着的同行。知乎哔哩哔哩知乎
vendor把"排查从15分钟缩到2分钟""运维效率提升3倍"拍到你脸上时,第一反应通常是:这玩意要是真好用,下一个被优化的就是我。
但把各家数字摆到一起你会发现,真正的麻烦不是AI太猛,而是账没对上——告警压缩70%、告警量降75%、工单时长降50%,这是三本完全不同的账。先别慌,也先别急着立项,我们把口径账、阶梯账、岗位账挨个对完。
第一本账·口径:三个"降七成",降的不是同一个数
先看四组公开口径里都写了什么:
H3C×信通院指南(7月30日发布):某省级运营商数据中心"告警压缩70%以上,故障定位与排查耗时下降超30%“;某汽车厂商园区"故障排查从15分钟缩短至2分钟,运维效率提升3倍”;某省级交通厅安全运营中心"威胁识别准确率较通用模型提升45%"。知乎
快手BianQue(5月起流传的开源项目拆解):电商搜索引擎稳定运行六个多月,“触发告警量下降75%,非actionable告警绝对量下降约95%,根因分析准确率80%,MTTR压缩超过50%”。知乎
无问芯穹(7月24日):自报"工单平均处理时长缩短50%,关键故障处理效率提升约6倍,人效提升5倍以上,综合运维成本下降约30%"。知乎
选型指南文章(9月21日):开头引Gartner预测"到2028年33%的企业软件将内嵌Agentic AI、15%的日常工作决策由智能体自主完成",同一段又自己泼冷水——“多数企业的AIOps仍停留在告警降噪+根因提示阶段”。知乎
四组数字放在一起,反常识的第一条就出来了:BianQue把告警量砍75%,靠的压根不是根因分析变强,而是把"发布拦截+主动巡检"排在了告警响应前面——问题还没变成告警就被掐掉了。换句话说,H3C指南说的"告警压缩70%"是把一屏刷屏合并成几条,BianQue说的"降75%"是让它们压根别触发。同一个告警台,动的不是同一个按钮。知乎

更要注意证据等级:指南里的案例是厂商与权威机构联合发布、单点场景;BianQue和无问芯穹是自报家底。信通院对应的AISHPerf智算运维智能体评测基准7月才开源(基于百亿条真实运维数据筛出十万级有效题),在这套基线被多家厂商跑分之前,你看到的任何"效率×N"都没有横向可比性。所以vendor再报数,先问三句:分子是谁的场景、分母是谁的基线、出处是谁的嘴。知乎

第二本账·阶梯:大部分公司还在L1,别拿L4的焦虑吓自己
指南真正值钱的不是案例,是给了把统一的尺子:L1工具级、L2助手级、L3工程师级、L4群体协同级。把眼前这些"智能体"往上对号,焦虑能少一半——知乎
告警收敛、动态基线、知识库问答:L1到L2,市面上多数AIOps就停在这(选型指南原话:“降噪解决的是看什么,没解决为什么和怎么办”);
输出"根因+因果链+处置建议"、人审核后执行:L3的门槛;
去掉"人工审批"这一环才叫L4。9月21日那篇选型指南给了个可抄的判断:L3→L4的跨越,本质是把人工审批去掉,真正的门槛是执行护栏的成熟度——风险自评、自动回滚、全程审计——而不是模型能力。国标GB/T 43208.2-2025把运维数据治理列为智能运维的前置条件(该文章称其2026年7月1日已实施),翻译成网工的语言:第一道门槛不是AI,是你家CMDB、时间戳、日志结构化理清理没理清。知乎
L3的天花板在哪?无问芯穹讲过一个"幽灵故障":2025年4月一次无规律性能波动,7名资深研发运维连续排查15天、消耗105人天,256台服务器全程空转,最后查到存储预期缓冲机制的设计偏差。跨栈、隐蔽、没有任何现成模式可匹配的故障,目前没有任何智能体接得住。看到PPT写"完全自治、无人值守"的,可以直接翻篇。知乎

第三本账·岗位:不是"取代",是"重新定价"
知乎上那篇《大模型会取代网管工程师吗》,一个干了20年核心网和网管的老兵把岗位拆得很干净,值得转给部门群:先被吃掉的是三类——告警去噪归并、标准问答和固定套路文档、日志报文人肉初筛,共同点是"输入有数据、过程有模式、输出有标准";吃不动的也是三类——签字担责、跨系统带现场上下文的权衡、人和人之间的事。 所以智能体落地,先分化的是岗位内部,不是岗位本身。给你三个具体动作:知乎
如果你日常大头是"逐条点告警、逐条关告警",这部分已经在L1-L2射程内,越早推给系统越好——你在会议室里推动降噪,比在工位上熬夜点确认值钱;
如果你是给自动化"画执行边界"的人(哪些动作允许自动下发、哪些必须人审批),恭喜,L3→L4阶段最缺的就是这种既懂这张网、又敢为护栏背书的人;
如果公司Q4真要立项采购,把vendor数字翻译成验收问题:报的是"压缩比"还是"触发量"?根因准确率是在哪个题集上测的,敢不敢换成你现网的故障回放?自动处置有没有审批开关和回滚审计?

对完账:方向是真的,但证据只到"自报"这一层
指南发了、基准开源了、Cloudnet开讲了、选型文章一天一篇——这波不是纯PPT运动,运维智能化是真在发生。但目前所有"效率数字"都还停在单点案例和自报口径,AISHPerf这类第三方基线刚上线,还没有任何一家在统一题集上交过卷。
所以结论收着说:不用为"被取代"失眠,但也别急着把Q4预算交给"自治"。先在公司里找到自己在阶梯上的位置,再决定是去学智能体,还是先把CMDB的数据治理这堂课补上——很多机房里,后者才是卡住L3的那道门。