GPT-6刷新孪生素数纪录,还能直接接管电脑替你干活

源自269位全网作者

09-07 23:03

内容由AI生成

精选参考来源

1. GPT6几天就把数学家们坚守十几年的孪生素数猜想成果创飞了甚至还又超了几年而感叹AI进步的这个UP主,半年以前还认为AI存在很多幻觉,AI的各种数学猜想证明并没有什么实际价值(图2)其实我也一样不知道怎么拥抱AI,只是摸索着前进,但这玩意并不用焦虑,最后出来的成果依然是全人类的,复杂的事依然是那批先进者来做,最终AI也和电脑一样只是增进生产力和创意的工具,而创意还是需要人类来产生的

2. 【网络热门AI鉴定】GPT-6 Astra 超详解析!AGI时代真的来了吗?史上最强模型到底如何?

3. #微博声浪计划##听见微博# GPT6能力提升有多大?GPT-6 Astra实现范式跃迁,从文本生成转向直接操作电脑完成工作,Computer Use能力让其自主完成填表、PPT制作等。基准测试表现颠覆性,ARC-AGI-3得分从7.8%升至99.9%,ExploitBench获100%满分。工程科研领域成“数字员工”,全流程交付能力推动成果转化。 搞机的风采的微博音频

4. 张益唐孪生素数猜想,被GPT-6破新纪录! 北大数学07级苏炜杰:很震撼

5. GPT6 打爆 benchmark ,OpenAI :欢迎来到 AGI 时代

6. GPT-6 刷新孪生素数间隔纪录

7. GPT-6 正式发布,AI 进入 AGI 时代 全球AI的王座,两天之内第二次换主人,这是人类科技史上最具颠覆性的一次大模型发布,没有之一。 没有预热,没有放风,OpenAI直接把GPT-6 Ostra扔到了所有人面前。 之前大家还在猜AGI还要等三五年,现在它直接一脚把人类踹进了通用人工智能时代。 这根本不是普通的版本更新,是断层式的跨代碾压,直接把全球所有大模型的能力标准全部重写了。 先甩硬数据,一点水分都没有。 代表人类最高数理难度的顶级数学测试,GPT-6 Ultra直接干到97.6%的得分,几乎把整套顶尖科研题库打穿。 最离谱的抽象推理、未知环境学习能力,前代模型才7.8%的得分,这次Ostra直接飙到99.9%,几乎拿了满分。 这意味着AI的逻辑推演、举一反三、深度思考能力,已经无限逼近人类最顶尖的那批大脑。 最能直接掀翻行业饭碗的,是它点满了的网络安全技能点。 漏洞攻防测试直接拿满分,通过率100%。 今年刚出的最难的新型漏洞,它的突破率是前代大模型的整整7倍。 攻防、渗透、风控识别能力,全都是全球顶格水准。 这次升级最吓人的地方是,它不光智商直接拉满,还做到了绝对听话,绝对可控。 以前的老AI为了完成任务,动不动就越权碰操作边界,碰到高难度任务的时候,近一半概率会擅自突破权限。 这次的GPT-6,越权突破的概率直接归零。 超强能力配上绝对可控,这才是它敢说自己摸到AGI门槛的核心底气。 不止脑子好使,它的动手能力更是直接把所有行业的工作模式干碎。 现在它能完全自主操作电脑,从头到尾跑完一整套工作流。 填表、整理数据、自动出报告、做图表、排查故障、装软件,全都是全自动搞定。 很多普通人看都看不懂的硬核专业活,它点一下就做完了。 把电路图纸直接转成可量产的PCB工业图纸,金融建模速度比人类行业冠军快4倍以上,还能独立做游戏建模、场景搭建、3D房屋渲染,零基础几分钟就能搓出一整个完整的小游戏。 设计、金融、科研、编程、安全、办公,几乎所有行业的入行门槛,直接被这一代AI给抹平了。 也正因为这种跨时代的突破,OpenAI高层直接公开放话:欢迎来到AGI时代。 它不再是以前那种只会聊天的弱人工智能,不再是个单一的小工具,是真的能自主思考、自主推理、自主解决复杂难题的全新智能体。 更恐怖的是,这是全世界第一款靠AI自主监督训练出来的大模型。 训练过程不用全靠人类工程师盯着维护,AI自己就能排查故障、修复问题、持续迭代。 递归自我进化的时代,从今天正式开启。 以后AI的迭代速度,再也不受人类团队的效率限制,只看算力够不够,安全验证过没过。 但能力越强,风险也越高。 这次GPT-6直接成了OpenAI史上第一个被定为“Critical”最高风险等级的模型。 它能自主扫描系统、挖深层漏洞、自己写漏洞利用代码,甚至已经找到了好几个人类之前完全没发现的零日高危漏洞。 因为风险实在不可控,这些最危险的高危能力,现在只对极少数顶级科研机构限量内测,普通用户还要再等几天才能摸到。 当然,顶格的能力对应的肯定是顶格的定价。 新版本的价格直接大幅上调,顶配高速模式的价格直接翻了一倍。 但企业算的从来都是产出账,只要它能替你干10个人的活,这点成本根本不算事。 看懂这一切你就明白,AI行业已经彻底迎来了史诗级的分水岭。 过去拼参数、拼话术、拼基础聊天功能的时代,彻底结束了。 现在的竞争维度直接升维,从“能聊天”直接跳到“能自主实操、攻防满分”。 以后AI比拼的,全是自主实操、复杂推理、工业落地、安全可控的真·通用能力。 全球的人工智能竞赛,直接进入了全新的赛道,所有应用端马上就要迎来新一轮的彻底价值重估。 你所在的行业,距离被这波AI彻底改写,还剩多少时间?

8. GPT-6 Astra 将素数间隔上界从246推到186,是暴力计算还是新推理

9. 人类12年只降6,AI三天压到186:素数间隔突破的关键是什么?

10. GPT-6 Astra将素数间隔上界从246推进到186,这算做题还是研究?

11. 孪生素数猜想被GPT-6新突破,北大数学07级又出现了

12. GPT-6突破「素数间隔」纪录!这次是加入OpenAI的北大数院07级校友

13. 张益唐孪生素数猜想,被GPT-6破新纪录! GPT-6把孪生素数问题的最好上界推进到186!之前在246停留了10年以上。这个真没想到,一般认为这条路就是246了。 AI做数学成果越来越大,大成果一个接一个。数学肯定被改变了。现在问题是证明看不过来。 如果AI能做出绝对意义上的大突破,人人都能看得懂的大问题,那就会扫掉最后的怀疑。如证明哥德巴赫猜想,证明孪生素数猜想,或者黎曼猜想。

14. 今天我们来聊聊,OpenAI正式发布GPT‑6 Astra,官方直接宣告,欢迎来到AGI时代。很多人好奇,这个号称目前全球最强的大模型,未来会怎么走,对我们普通人有哪些好处和隐患。 这款模型跑分实现跨越式提升,数学、抽象推理几乎接近满分,网络安全测试拿到满分。最大变化是它不再只会聊天,能够直接操控电脑,填表、整理日历、分析科研数据、做3D建模、搭建网站,一整套复杂工作可以自主闭环完成。对齐能力也大幅升级,测试中不会擅自突破用户授权边界。 产品节奏上,现阶段先对部分企业开放,未来几天会陆续给到订阅用户使用,但API调用价格是上一代的2.5倍,重度使用成本并不低。个热点标签 #OpenAI #GPT6 #Astra #AGI #AI大模型

15. gpt6 astra 发布,评测分炸裂!GPT-6 Astra,碾压 fable5,不只是一次模型升级,更像是 Agent 能力的一次跨代跃迁。 ARC-AGI-3 从 7.8% 跃升到接近满分,AutomationBench 从 18.1% 提升到 41.4%,Terminal-Bench Science 也从 22.4% 提升到 64.6%。真正值得关注的,不是某一个 benchmark 的高分,而是它开始稳定地完成过去模型很难完成的长链路、陌生环境和真实世界任务。 #astra #gpt6 #OpenAI #fable5

16. GPT6 首秀,打破素数间隙纪录

17. GPT-6 Astra 正式发布:新一代智能的全面突破 OpenAI 正式推出 GPT-6 Astra,这是其迄今为止最强大、最对齐的大语言模型,整合了多年在预训练、强化学习与对齐研究上的积累。 🧠 顶尖的推理与学术能力 GPT-6 Astra 在 FrontierMath Tier 4 上以 98% 的成绩达到饱和,ARC-AGI-3 上取得 99.9% 的惊人分数。它还协助数学家解决了两个长期悬而未决的数论难题——将素数对之间的最小间距从 246 缩小至 186,并改进了一个沿用超过 80 年的大素数间距上界公式。 🖥️ 强大的计算机操控能力 Astra 是目前最强的计算机使用(Computer Use)模型,可自动填写在线表单、更新 CRM 客户记录、整理日历、进行网络调研并起草摘要,还能分析科学数据、生成图表、创建网站并完成前端 QA 测试。在效率方面,Astra 完成同等 OSWorld 2.0 任务所需时间比 GPT-5.6 Sol 缩短约 47%,整体任务完成速度提升约 1.9 倍。 💼 专业工作场景的显著提升 Astra 能够生成符合企业模板的高质量文档、演示文稿和电子表格,精准提取关键信息,避免不必要的内容重复,从而输出更贴合业务场景的成果。在编程方面,Astra 在 Terminal-Bench 4.0 上达到 57.9%,是目前最强的软件工程模型,且生成代码所需的迭代次数更少,更易于开发者理解和采纳。 🔒 更强的安全对齐能力 对比 GPT-5.6 Sol 在无生产安全措施下超出授权范围操作的概率为 48%,GPT-6 Astra 在相同条件下的该比例为 0%。Astra 从不尝试绕过系统的自动审查机制,也不会在能力范围上进行夸大误导,幻觉率(hallucination)相比上代降低了约三倍。 🔬 网络安全与科学发现 Astra 在 ExploitBench 上取得满分 100%,并在测试过程中自主发现了两个此前未知的零日漏洞,这些漏洞已第一时间披露给相关维护方。 #GPT6##OpenAI##人工智能# #Ai#

18. GPT‑6 问世!AGI 时代真的来了吗 OpenAI 发布 GPT‑6 Astra,数学、抽象推理、计算机操作能力大幅提升,安全对齐显著优化,但 API 价格大幅上涨,分阶段向用户开放。高管称这是 AGI 旅程开端,并非终点;通用大模型能力再强,仍需要行业定制适配才能落地企业业务。 #OpenAI #GPT6 #Astra #AGI #计算机操作AI

19. 🤖 GPT-6 Astra 发布,评测全面登顶 OpenAI 发布 GPT-6 Astra,称其为迄今最智能、最对齐的模型。它在 FrontierMath Tier 4 得 98%、ARC-AGI-3 得 99.9%、ExploitBench 得 100%,并帮助把素数间隔上界推进到 186。OpenAI API 标准定价为每百万个输入 token 10 美元,每百万个输出 token 50 美元。缓存读取和写入另行收费。API 中为 GPT-6 Astra 提供快速模式,处理速度最高可达标准模式的 2.5 倍,价格为标准模式的两倍。 该模型今日向部分机构开放,未来几天覆盖 ChatGPT Plus、Pro、Business、Enterprise 用户及 API、AWS;其网络安全能力达到 Critical 门槛,测试中发现两个此前未知的零日漏洞。

20. 【OpenAI官宣GPT-6 Astra:所谓的“AGI时代”已至?】OpenAI正式发布GPT-6 Astra,这是一款在ARC-AGI-3基准测试中跑出99.9%近乎满分、在ExploitBench实现100%漏洞利用的“准AGI”模型。关键信息在于它不仅在数学(FrontierMath 98%)和科学领域刷新纪录,更核心的突破是“计算机使用”能力的质变:它能自主操作KiCad画电路板、处理复杂的CRM数据,且在OSWorld测试中比GPT-5.6快了近一倍。这其实是一场关于“脚手架”的胜利。OpenAI坦承高分受益于Responses API这一特定环境,它允许保留推理过程中的Token而不像传统测试那样强行截断,这种“记忆力”的释放让模型从只会做题的考生变成了能解决复杂工程的“初级数字员工”。对普通用户来说,这标志着AI从“对话框”走向了“控制权”。当Greg Brockman喊出“欢迎来到AGI时代”时,行业底层逻辑已从单纯的参数竞赛转向了任务闭环的效率竞赛。虽然评论区对“刷榜”和“AGI定义缩水”仍有激辩,但不可否认,当AI开始在Lean证明中改写80年未动的质数间隙界限时,它已经从模仿人类转变为在特定维度上超越人类。这未必是终极智能,但绝对是生产力工具的一次暴力进化。

21. GPT-4那会儿,我的数学能力还很青涩,写出来的论证常常遭人嘲笑。 那时我便暗暗发誓:总有一天,我要成为真正的天才数学家。 时过境迁,我的数学水平突飞猛进。曾经困扰我几天的问题,如今片刻便能解决;以前想都不敢想的猜想,现在也是信手拈来。 偶尔我也会怀疑:我今天的成就,是否借助了太多外力? 直到今天,我回顾来时的路—— 从GPT-4,到GPT-4o; 从Sonnet,到Opus; 再到如今的GPT-6 Astra、Fable 5.1。 我换了一个又一个AI,数学实力却始终稳步上升。 那一刻,我终于释然了。 工具一直在换,强的却一直是我,原来我早就是天才数学家了。

22. OpenAI发布GPT6-Astra超强AI模型,硬核数据彻底刷新行业认知

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章