Codeforces 圈这两天被两条消息连着刷屏。一条是 8 月 12 日正式发布的 DeepSeek V4 Pro,规格表里直接写着"Codeforces评分3206,接近人类顶级程序员水平"。微博另一条更炸:今年 3 月,一个叫 GrandCode 的 AI 系统连打三场 Codeforces 正式比赛,场场第一,Round 1088 那场它的账号 yokeko 排第一,而 tourist——Codeforces 历史最高分保持者——只排第三。知乎

很多人看到这一幕的第一反应是:我辛苦练的 rating 是不是贬值了?先把我替你看过的信息摆齐,再给判断。
先看 AI 到底进化到哪了,这条线比多数人想的快
2023 年:AlphaCode 2 赢过 85% 的参赛者,但那时还"打不过顶尖选手";
2023 年 4 月:GPT-4 的 CF 评分只有 400 左右;
2024 年 9 月:o1 约 1900,进入专家段;
2024 年底:o3 宣称 2700+;
2025 年 9 月:ICPC 世界总决赛金牌级,社区实测 GPT-5-high 12 题做出 9 题;
2026 年 3 月:GrandCode 三连胜,第一次在正式比赛"击败所有人类";
2026 年 8 月 12 日:DeepSeek V4 Pro 宣称 3206。
从"赢过大多数人"到"摸到顶尖",只用了两年多;从"摸到顶尖"到"正式比赛拿第一",只用了不到半年。这个加速度本身,就值得停下来看一眼。
但 3206 是什么概念,这里有文章
3206 落在国际特级大师区间。放到人类世界对照,这个分是什么水平?一个把 CF 分段对应到 OI 水平的回答里,2600~3100 对应“金牌,ZJ 省队希望非常大”,3100+ 直接叫“神的领域”,3206 放这张表里就是人类世界前几百名。知乎确实很强,但注意,这不是天花板,天花板是 tourist 的 3800+。
更要说清楚的是这两个数字的区别:3206 是离线基准评测分,DeepSeek 没公开测试方式,外界无从查证里面有多少水分;而 GrandCode 的三场第一,是和人类选手同场、同题、同规则提交排出来的正式比赛成绩,也是目前唯一可确认的实战成绩。看这件事,优先看实战。
那你的 rating 贬值了吗?我的判断:没有,但价值结构变了
第一,rating 不只是面子,它是训练反馈系统。对还在涨分的人,每一场给你的不是"多了几分",而是"哪类题你判断错了"。这个反馈回路不会因为 AI 强了就贬值——就像计算器的存在没有让算术训练消失。何况 rating 仍然是简历上最直观的信号,2000+ 写上去, recruiter 依然认。
第二,赢 tourist 的不是一个软件,是一整套系统。GrandCode 是主求解器、假设生成器、摘要压缩器、对抗测试用例生成器堆在一起,再配上比赛时在线强化学习的完整工程。论文里还给了一个直观的注脚:Codeforces 有些题目附带几何图形,这些图形的视觉结构很难用纯文字描述清楚。arXiv"读题"这件事本身,还是 AI 正在补的边界——换句话说,你真正在练的判断力,还没被完全翻越。

第三,社区其实已经在收敛这件事。一个 865 赞的回答在一年后推翻了自己原来的结论,大意是算法竞赛的题“在ground truth上定义良好,边界清晰”,一道题有解本身就是重要信息,而现实的工程和各行各业的工作永远不是这样。知乎AI 最擅长的恰恰是这种定义良好的题;而你的 rating 逼你练的,是"把问题定义清楚"的能力——这部分价值没降,反而升了。
按分段说,三种人三种打法
1400 以下:正常练。这个阶段 AI 最好的用法是讲思路,不是代写代码,让它解释"这题该怎么想"比抄它的 AC 代码有用十倍。
1400-1900:把练习重心往问题建模和对拍自检上移。一个高赞回答在“AI Native 时代算法竞赛更考验什么”的问题下说,AI 非常擅长制造“局部进展感”,但不一定擅长估计 global progress,人在里面的作用就是帮助 AI 判断这个方向到底值不值得继续挖。知乎会提高价值问题、会判断 AI 是不是在瞎转,正是这个分段最该练的两件事。
1900+:你争的是人类头部席位和反作弊话语权。人类头部成绩越稀缺,越值钱;同时你的对局记录本身,就是"人类是否可能这么下"的参照系。
公平问题,不回避
社区对现状的情绪不算好,有人把现状一句话总结成“cf 几乎不管作弊,倒是小号管的挺严”,这句吐槽基本就是现在排行榜信任度的体感底色。知乎至于"AI 哥变多",目前确实还是个体体感,没有官方统计,我不编比例。但规则是有的:按 GrandCode 论文所述,Codeforces 官方有禁止 AI 生成内容的政策,疑似使用 AI 的账号会被移除,高排名账号会受到更严格的审查。arXiv遇到疑似 AI 账号,举报是目前唯一有用的动作;同时盯着 CF 反作弊的动向——它直接决定 rating 的含金量。
接下来值得盯的三个信号
Round 1117 刚结束,现在还在空窗期。接下来这段时间,值得盯三件事:
CF 是否更新反作弊与 AI 使用规则——这是 rating 公信力的生命线;
有没有第二个 GrandCode 级系统出现在正式比赛里——个案可以叫实验,常态才叫趋势;
ICPC、CCPC 一类赛事如何界定 AI 辅助——竞赛圈的风向标会跟着这个走。
AI 打到 3206 是它的事,你的 rating 记录的仍然是你自己的成长曲线——就像这条曲线,从灰色的新手区一格一格往上爬,上面的每一分都是你自己挣的。

只是这条曲线上,值得练的东西,从模板变成了判断。