今天凌晨 3 点 33 分,OpenAI 发布了 GPT-6 Astra。总裁 Greg Brockman 在发布会结尾说了那句在 AI 行业极为罕见的话——「欢迎来到 AGI 时代」。DeepTech深科技
更戏剧的是,发布前几个小时,ChatGPT、Claude、Grok 几乎同时出现大规模服务异常,相关宕机话题在微博上刷了屏。红星新闻宕机和发布撞在一起,今天 AI 圈的热闹程度,超过了过去一个月的总和。
但对做 AI 自媒体的人来说,我建议先把「AGI」这个词放到一边——那是巨头们的叙事。真正影响你饭碗的只有三件事:什么时候能用上、哪些活儿会真的变便宜变快、以及这次升级对谁反而不划算。我翻完了官方信息、几篇深度拆解和各平台的讨论,把账摊开算给你看。
先泼一盆冷水:今天你还用不上
GPT-6 Astra 目前只向少量机构开放。ChatGPT Plus、Pro、Business、Enterprise 用户,以及 API 和 AWS 客户,要在「随后几天」陆续获得访问权限;企业版还需要管理员主动开启,发布初期默认是关闭状态。DeepTech深科技也就是说,哪怕你是 200 美元一个月的 Pro 用户,现在也得排队。AI 博主数字生命卡兹克凌晨直接开吐槽:当年忽悠人买 Pro 会员时说好的「每一次都能最优先体验到新模型」呢?数字生命卡兹克「果然这些大模型公司都是渣男。」
所以第一个避坑点:这几天别为「提前用上 GPT-6」付任何溢价——加价买的镜像站账号、来路不明的「内测渠道」,都别碰。官方分批推送,快则几天,等得起,你的会员费不会白交。
对自媒体工作流真正有用的三个变化
跑分先放一边,Astra 这次的升级针对性很强,翻译成自媒体人的语言是三件事。
一是审美终于补课了,官方甚至给它起了个名字叫「视觉判断力」。
GPT 系列的审美被嘲笑了很多年,做个 PPT 一眼 AI 味。这次 OpenAI 专门强调,Astra 做 PPT 时会更好地处理版式、层级、模板和视觉风格;还能按照参考文档的视觉风格和写作语调来改编文档——保留内容实质,让成品更贴近「品牌原生感」。数字生命卡兹克做商单方案、活动 PPT、图文排版,或者接企业代运营的朋友,这是可以直接兑现的改善。微博上有博主看完官方文档总结得很实在:做 PPT、文档和表格,更能照着给的模板来,排版风格跟得住,还尽量减少没用的话。微博

二是它有了「判断力」:知道什么时候该烦你。
用过 AI 干活的人都懂两种痛:一种是提问机器,「您要 Word 还是 PPT?几个章节?什么字体?」问个不停;另一种是什么都不问,自己脑补两小时,交出来一坨没法用的东西。Astra 官方的定位是中间态:无关紧要的缺失信息自己合理推断补齐,真正会改变结果的决策点,才停下来问你一个聚焦的问题。数字生命卡兹克在 Codex 里它甚至能一边等你回答,一边继续处理不依赖答案的部分。如果你习惯把「帮我把下周的选题会和初稿准备一下」这种活儿整个扔给 AI,返工轮次应该会明显下降。
三是从「你问它答」变成「你交代,它完成」。
这是 Astra 最硬核的部分。OSWorld 2.0 测试——把 AI 扔进一台真实电脑让它自己干活——Astra 的任务完成率是 72.6%,上一代 GPT-5.6 Sol 是 65.7%;完成单项任务的平均耗时从约 75 分钟压到 40 分钟,少了近一半。DeepTech深科技考察它能不能看懂屏幕、精准定位按钮的 ScreenSpot-Pro,从 76.9% 冲到 92.7%。数字生命卡兹克再加上 105 万 token 的上下文窗口、异步工具调用、任务中途可以补充要求且不推倒已完成的部分——理论上,你可以把整个账号的历史内容一次性喂给它做复盘。
早期客户的数据更具体:法律科技公司 Legora 用 Astra 几分钟检查完 41 份财务文件,把预先埋进去的 4 处错误全找了出来;游戏公司 Playco 做原型时,人工修复量减少了 50%。DeepTech深科技

这对做矩阵号、物料量产的人意味着什么?昨天知乎上有个热问题问得很尖锐:大厂 9 月发布季全上 AI 物料,自媒体创作者还能靠什么做出差异化。知乎Astra 就是这个问题的注脚之一——当「调研选题、写初稿、排版、多平台分发」这种十几个步骤的链路可以整段交给模型时,物料的生产成本会再降一截。供给侧卷到这个程度,能拉开差距的只剩你的判断、你的素材库和你的人味儿。
算一笔钱:有人省钱,有人反而更贵
这是这次发布里最容易被算错的部分,两拨人看到的数据完全相反。
Astra 的 API 官方定价是每百万输入 token 10 美元、输出 50 美元,是上一代 GPT-5.6 Sol 的 2.5 倍。DeepTech深科技但 OpenAI 同时给了另一组数:相比 Sol,Astra 单任务成本降低 57%、单任务耗时减少 47%。微博Brockman 的解释是,单纯比较 token 价格意义有限,最终要看完成一项工作花多少钱——因为 Astra 完成任务需要的步骤和输出更少。

两组数据都是真的,关键在于你的活儿属于哪一类:
Agent 型多步骤任务——调研、初稿、排版、分发这种要连续调用工具、反复检查修改的链路:Astra 步骤更少、废输出更少,总成本大概率是降的,57% 说的就是这个场景。
纯文本量产任务——批量生成小红书文案、商品描述、评论区回复,输出量大、单任务步骤浅:token 单价直接命中成本,2.5 倍就是 2.5 倍。这类活儿,国产模型甚至上一代 Sol 仍然更划算,没必要追新。
ChatGPT Plus / Pro 订阅用户:OpenAI 没有宣布订阅价格调整,Astra 推送到位后直接用就行。这轮 API 涨价涨不到你头上,你反而是纯受益方。
所以「该不该换工具链」这个问题,答案不在发布会的跑分里,在你自己工作流的构成里:多步骤、重操作的环节越多,Astra 对你的价值越大;纯靠 token 换产量的环节越多,你越应该按兵不动。
跑分别上头,清醒派的声音也值得听
今天的刷屏数据确实吓人:ARC-AGI-3 拿了 99.9%,FrontierMath Tier 4 拿了 97.6%,漏洞利用测试 ExploitBench 直接满分。微博ARC-AGI-3 值得多说一句:它测的是把 AI 扔进几百个没有说明书、不告诉你规则的交互环境里,能不能自己悟出规律再迁移到更难的关卡——人类平均分 48%,今年 3 月这个测试刚发布时最强模型只有 0.51%,半年前 GPT-5.6 Sol 也才 7.8%。数字生命卡兹克这个进步速度是真实的,Brockman 的底气来自这里。

但两盆冷水也应该听完。
第一,悟性测试考不出爆款文案能力。99.9% 和「你的账号数据变好」之间,还隔着一整段翻译距离。小红书上就有 AIGC 博主直接把标题写成「GPT-6 来了,先别急着喊 AGI」——模型升级和 AGI 实现不是一件事。小红书知乎上也有人吐槽渲染与实际的落差,连「AGI era」这个说法,OpenAI 自己都打着引号。知乎
第二,能力越强,依赖风险越大。Astra 是 OpenAI 历史上第一个达到「Critical」网络安全能力等级的模型——测试期间它自己发现并利用了 2 个此前未知的零日漏洞。DeepTech深科技这事跟自媒体人关系不大(普通版本会拒绝生成高阶攻击代码,工具调用过程也有额外监控),但它说明模型的自主性已经高到 OpenAI 自己要配更重的刹车。而对我们这些把生产线架在别人服务器上的人,昨晚已经提前演练过一次风险了:ChatGPT、Claude、Grok 同时宕机。字母榜如果你的选题、文案、配图、分发全押在海外 AI 工具上,昨晚不是吃瓜,是事故预演。趁 Astra 还没推送的这几天,把核心工作流的国产替代方案备出来——账号、提示词、SOP 各留一套。宕机一夜损失的更新量和商单违约金,可能比你一年的会员费都贵。
这几天,你具体该做什么
一份可以直接抄的行动清单:
别付溢价抢跑。 等 Plus / Pro 分批推送,官方口径是「随后几天」,任何收费内测渠道都是智商税。
备好你的测试题。 把工作流里最耗时的 3 个多步骤任务写出来,做成可以原样扔给模型的测试用例。卡兹克说他提前准备了 20 多个 case 等开放当天实测——你不用 20 个,3 个就够,但一定要在开放前写好,开放当天所有人都在测,早一天出对比结论就早一天吃到信息差。
搭好备用工具链。 昨晚的三家齐宕是提醒:至少给「写初稿」和「做图」两个环节准备国产模型的降级方案。
盯三个信号:Plus / Pro 全量推送的时间点;第一批中文实测有没有覆盖图文和短视频工作流(而不是清一色写代码);以及竞品的动作:Astra 的 API 定价已经和 Claude Fable 5 完全对齐。数字生命卡兹克两家贴身肉搏,接下来大概率有人先降价,等等党永远不亏。
一句话总结:GPT-6 Astra 把「整段工作流交给 AI」这条线往前推了一大步,但它今天还没递到你手上。对 AI 自媒体人来说,这几天的胜负手不是谁先用上,而是谁先备好了测试题和备用方案——等推送到位的那一刻,直接开跑。