10月11日,华为云方面披露,这次登上国际权威时序测评双榜单的,是华为云行业大模型团队、2012 应用场景创新实验室、小巧灵突击队与华东师范大学联合研发的昇腾原生时序预训练模型。IT之家
登顶的模型名叫「七曜」,拿下的是 TIME-leaderboard 与 GIFT-Eval 的 Pretrained 类目 两榜第一,官方称这标志着国内时序基础模型跻身全球第一梯队。 比名次更值得弄清的有两件事:这两张榜各自在考什么,以及「时序预测」会怎样渗进电价、天气、通勤这些日常。东方财富网
一张主流卷,一张新出卷
在时序基础模型圈,GIFT-Eval 与 Timer 是各家晒零样本成绩时最常引用的考场,也是现有规模最大的两个公开基准。 TIME-leaderboard 对应的 TIME 基准则发布于 ICML 2026,出自清华、南洋理工等团队,回应的是「老榜单分数还剩多少信息量」的质疑,TIME 的解法是把考卷全部换掉。知乎·科研不焦虑知乎·时序人
七曜参加的 Pretrained 类目与 TIME 的评测门槛相同:不经逐数据集微调,在没见过的数据上直接出预测成绩。
榜首两三个月就换手,挤进去不容易
TIME 基准刚发布时,总榜第一还是亚马逊的 Chronos-2,TimesFM-2.5、TiRex 紧随其后。 今年 8 月底谷歌发布 TimesFM-3,在三个公开基准的点预测与概率预测上都拿下预训练模型第一。 到 9 月,IBM 的开源新模型又把零样本预测干到 GIFT-Eval 排行榜同许可类别第一。 不到两个月,「七曜」同时接过了这两张榜的榜首——在这条赛道上,登顶意味着拿到第一梯队的入场券,而不是一块永久牌匾。知乎·时序人知乎知乎·有鸣商业
从电价到流感曲线:预测早就在你身边
时序数据是一切随时间记录的数字:电网负荷、降雨气温、车流、设备振动、病例数、价格。时序基础模型像语言大模型一样,先用海量跨行业数据预训练一个通用模型,新场景不再从零建模,喂进历史数据就能直接出预测。华为云给「七曜」列出的能力清单是:模型可直接用于各类零样本时序预测,适配电网负荷研判、工业设备异常检测、金融趋势分析等场景,也支持低成本二次微调。 TIME 基准收录的 50 个数据集则画出了这项技术的日常半径,覆盖自然、能源、交通、医疗、金融等多领域。 从光伏电价到停车路况,从流感住院到油价,都是普通人每天碰得到的变量。东方财富网知乎·时序人
谷歌给过一个更具体的例子:TimesFM-3 把促销日历作为已知信息输入后,学到促销与销量的关系,预测出每个促销日约 20% 的销量提升。 原本要靠运营人工调价的判断,直接进了模型输入。知乎
「昇腾原生」改的是采购名单
官方口径里,这不是先在国外算力上训完再移植的模型,而是华为与华东师大联合团队研发的昇腾原生时序预训练模型。 它基于华为昇腾生态完成训练与推理的深度优化,形成通用时序基模型底座,官方还强调兼顾算力与模型知识产权自主。 电力调度、工业运维这些数据不出厂、算力供给要稳的场景,因此多了一个全栈国产的选项。两家在这条线上的积累也非一朝一夕:此前,华东师范大学和华为诺亚方舟实验室已联手推出了轻量级通用模型 LightGTS。IT之家东方财富网哔哩哔哩
两道坎:分数会通胀,落地还没开始
第一道坎在分数本身。蚂蚁集团开源评测基准 QuitoBench 时,对行业放了一句重话:现有时间序列基础模型评测广泛存在数据泄露,性能被系统性地高估。 TIME 用全新数据重考正是针对这一点,「七曜」在 TIME 上的登顶成色因此更足——但任何榜单成绩仍不等于电网与工厂里的实际效果。知乎·科研不焦虑
第二道坎在信息量:目前围绕这次官宣的公开转述里,还没有出现模型参数量、训练语料规模与具体得分,披露的场景也全部偏产业侧——它重塑的是电价波动、停电预警、台风应对这些间接日常,而不是明天起手机里多一个预测 App。接下来值得盯的是两件事:「七曜」是否开源上线,以及第一批行业客户何时公布。