国庆假期第6天,你的信息流里大概率同时躺着三种帖子:B站上那条讲WorkBuddy八大功能(Agent、自定义Skill、提示词工程、文档解析)的保姆级教程,截至今天收藏已经过了100万、播放241.8万。小红书9月28日那条《Prompt玄学》拿了2.6万赞,开头第一句就是"最近自己用AI发现一个问题:每次跟它交互都发现它有点不太聪明,可能是提示词的问题"。知乎上"大家都说要学习AI,作为小白该从哪里下手"这个问题国庆期间被顶到11.7万浏览,同话题的另外两个问题各有5.9万、2.5万浏览。哔哩哔哩小红书
囤教程的和拆台的同屏,恰恰说明一件事:你收藏的很多"技巧",正踩在模型换代的刀口上。9月28日到10月1日这四天,Anthropic发布Claude Sonnet 5.5、Google发布Gemini 4 Argon、Manus更新2.0并发布个人智能体Cue、OpenAI连发布个人助手Dots都现场翻了车——四连发之后,你收藏夹里那批提示词干货,有一部分已经悄悄贬值。双11前把时间和钱交给AI之前,先把这三本账对完。
第一本账·代际:模型换代改写了每类技巧的计价方式
先看两个硬事实。9月28日发布的Sonnet 5.5,名义API价格和上一代持平,但只有Opus 5.5的一半:输入、输出和缓存写入价格均为Opus 5.5的一半,输入每百万Token 2美元、输出10美元,与GPT-6 Sol同价,而Opus 5.5是4美元/20美元,轻量档GPT-6 Luna只要0.1/0.5;官方口径是靠减少冗余推理和工具调用,把单项任务的综合成本最高降30%。36氪
新模型的编程基准提升更直接:在自主智能体编程测试Terminal-Bench 4.0中,Sonnet 5.5得分达到70.6%,上一代Sonnet 5仅为10.3%。36氪

Gemini 4 Argon则把最受关注的变化放在产能上:单次输出的Token上限从此前的6.4万提升到100万,这指的是单次输出上限、和上下文窗口是两个指标,而多数前沿模型的输出上限还停在12.8万左右。这两条信息,直接给三类流传技巧重新定了价。36氪
“让它往死里想"类——贬值。Anthropic自己的基准测试里,Sonnet 5.5在FrontierCode测试中最高算力档位(Max模式)得分46.2%,反而低于次高档位(Xhigh模式)的52.1%,官方解释是Max模式更容易触发频繁的代码审查和子任务拆分,过度思考反而导致任务超时或产生超出范围的代码修改。你教AI"反复审查三遍再答”“把问题拆成十个子步骤"这类咒语,在Agent类任务上越来越可能只是多烧Token。B站评论区那句"谁家token用不完了可以试试”(1099赞)不是玩笑,是成本账。36氪哔哩哔哩

"逼它问到你满意"类——看模型下菜。B站"AI提问焚诀"视频(收藏7.6万)评论区被复制刷屏的那条——请你在回答前向我提问。要求只问一个问题,请根据我的回答继续追问。直到你有 95%的信心,完全理解我的真实需求和目的时,再给出最终方案。顶评468赞,底下跟了四五个99、92、55赞的一字不差复读。哔哩哔哩
但同一评论区马上有人打脸:“然后超过对话窗口了,前面的都忘了”(48赞)、“豆包用两下直接忘了”(44赞)。这条咒语不是玄学也不是万能,它依赖长轮次和上下文记忆:大窗口模型上能用,弱一点的模型上就是自我感动。哔哩哔哩
"固定背景置顶"类——涨价。Anthropic给提示词缓存最高90%的折扣,对反复处理相同上下文或长文档的人,实际支出还能进一步下降。另一边,Argon的缓存输入Token价格比标准输入价格低95%。把你稳定的背景、规则、风格文档放在对话开头反复复用,是这轮变化里最该立刻学会的一招——用得越久越便宜,和"每次开新对话重新粘贴一遍"是两个成本量级。36氪36氪
第二本账·咒语:被跨模型验证活下来的,其实只剩两类
反证也查过了。《Prompt玄学》评论区3089赞的总结是"意思是ai的检索和分类能力大于推理能力",33赞的更直接:现在的AI能力不会受提示词影响,但问不同的问题,回答侧重点肯定不同。换句话说,多数花哨模板的作用被夸大了,但两类朴素句式经得住换模型、换问题。小红书
一是确认式。1395赞顶评:"有一句焚决从22年一直用到现在,百试不爽,加一句’你明白我的疑惑吗?'“楼下热评补了个更硬的版本:描述完需求后加一句"理解后复述我的需求”,常常可以稳定实现和纠偏。不消耗轮次、不依赖超长上下文,任何模型都吃得下。小红书
二是重构式。那条2382赞顶评的主人,把社交烦恼用第三人称讲给AI、删掉情绪细节、让它从社会学/心理学角度分析整件事——本质是重设任务框架,不是背模板。知乎国庆的高赞回答给的是同一组方向:拆分复杂任务,一次只让AI完成一件事;给AI参考范例,输出效果会更贴合预期;学会校验AI给出的信息,重要内容自行核实。知乎
小白最该做的反而是最笨的那步。知乎10月3日那条回答(11.7万浏览的问题下)说得很直白:网上教你用AI的十个有九个在教提示词,可提示词是给已经知道要干什么的人准备的;你的文件夹本身就是提示词。创建一个工作空间,把资料、表格、周报、论文全扔进去不用整理,然后问一句"这是我的XX资料,你看你有什么能帮到我?“——这比再存50条"神级提示词"有用,因为它先解决了"拿AI干啥”。那篇10月6日刚发的《4个小技巧,解锁AI真实实力》总结得更扎心:不是AI不够聪明,是我们不会下指令。知乎知乎

至于玩家层,风向已经从咒语转向Skill:焚诀视频评论区最高赞是2098赞的一条"/grill-with-docs,一个skills搞定",也有人在小红书晒自己做了个skill,专治AI爱造轮子的毛病,让它先去调研有没有可复用的开源项目。你反复验证有效的流程,存成指令或技能,别再截图当焚诀。哔哩哔哩
第三本账·窗口:哪些现在值得用,哪些等双11后再说
Argon先别急着追。 这款10月1日官宣的新模型走分阶段发布,将通过Fairwind Program首批提供给受信任的网络安全防御者;首批公开用户也只包括付费API客户和Google AI Ultra订阅者,彭博社还报道Google内部对Gemini 4在编码等关键任务的表现仍有疑问、员工实际使用时部分编码任务依然难以稳定完成。评测得分和真实工作体验之间,官方自己都说需要更多验证。普通订阅用户没有"现在就得迁移"的理由。36氪
Manus等国再等等。 2.0和个人智能体Cue已在9月29日发布,但创始人肖弘的话很明白:Manus正在积极准备国内版本。国内可用的节点是明确存在的,双11前多半能见分晓。36氪
首发热销别交学费。 OpenAI发布个人助手Dots当天现场翻车、Meta靠Muse股价上涨——首批工具和真实体验的差距,今年已经不止一次了。36氪
账单能算的先算。 按量付费的用户,现在就该把任务分层:需要复杂判断的交给Opus档,大量日常、重复性的任务交给Sonnet 5.5——官方原话是对这类任务,用户并不一定需要Opus级别深度的判断能力。订阅制用户的动作不同:盯双11各家订阅方案有没有跟进这轮"加量不加价",没有的话,降级档位的性价比正在变好。36氪

顺手避个坑:教程和镰刀是同一批人在卖
判断一条技巧帖值不值得学,看它结尾就行。B站那条"纯手搓一部AI漫剧一个月收获3.1万"、评论区炸出1.68万条的教程,要资料的方式是"看置顶评论、回复666"。知乎有帖子"进圈即领全套Skill、持续更新",引流进知识星球;连前面那条11.7万浏览的高赞回答,末尾也缀了一句"欢迎扫码找我咨询"。10月4日"30岁女子靠AI婚庆培训年入200万"的热搜(31.9万浏览),高赞答案一句话拆穿:就是赚你加盟费的。哔哩哔哩知乎
但也别一杆子打死。真靠AI短剧半年赚了5万+的作者(238赞)自己划过线:所有要你先交会费的、号称轻松躺赚的,99%都是割韭菜!跑通的人普遍是"AI提效+原有业务体系"——本来有粉丝基础、有客户、有手艺,AI只是加速。只有清单(AI写作接单、AI绘画卖图、AI做PPT)没有成本数字的帖子,十个有九个是同一份清单,划走。知乎知乎知乎
最后,按人群各留一句话
入门:别再囤提示词。先建工作空间扔资料,让AI告诉你它能干什么,这周就能完成从"围观AI"到"用AI"的切换。
办公提效党:固定背景置顶复用吃缓存折扣,"95%追问法"只在上下文大的模型上用,所有关键数字自己复核一遍。
重度玩家:按任务分层计费,验证过的流程做成Skill,双11前不动大额订阅——Argon开放进度、Manus国内版、订阅方案跟价,这三个信号出来再决策。
假期还剩两天。与其再收藏十个"终极合集",不如把确认式、置顶式、分层式这三招,拿你手头真实的资料试一遍——技巧的价值,从9月28日那天起已经重新计价了。