张大妈

日本大行启用Mythos,储户将享更快更安全服务

源自33位全网作者

05-13 14:32

内容由AI生成

精选参考来源

1. 盘点一周AI大事(4月12日)|Mythos太强不敢发布 Anthropic官宣最强大模型Claude Mythos OpenAI发布超级智能经济蓝图 Meta发布大模型 Muse Spark 智谱上线最强开源大模型GLM-5.1 Anthropic上线Agent包工头Claude Managed Agents Gemini上线概念可视化visualizations 阿里发布最强视频模型HappyHorse-1.0 米哈游发布最强数字人模型LPM 1.0 Ace开源最强音乐模型ACE-Step-1.5-xl 研究员开源最强虚拟试穿模型Vanast #前沿科技趋势发布月 #AI新星计划 #AIGC #大模型 #Agent

2. 如何看待Anthropic的新模型Mythos?

3. 如何看待Anthropic的新模型Mythos?

4. Anthropic版「狼来了」引华尔街恐慌!27年漏洞,Mythos被8个AI秒杀

5. Anthropic发布史上最强模型:Claude Mythos Preview,但遭禁用

6. Mythos:普通人能自由使用旗舰 AI 的时代,可能要结束了

7. 如何评价Anthropic的下一个模型Claude Mythos?

8. 刚刚,Claude Mythos打爆AI评测天花板!超指数狂飙,2027奇点加速

9. 最近AI大事件:DeepseekV4、GPTimage2、Mythos重磅发布

10. Anthropic 因 CMS 配置失误,意外泄露了一款尚未发布的新模型信息。Fortune 率先发现并核实了这批存储在公开可访问数据缓存中的草稿文档。这款模型名为"Claude Mythos",内部代号"Capybara"(水豚)。它代表着一个全新的模型层级——比目前最强的 Opus 系列还要更大、更强。Anthropic 现有的产品线分为 Haiku(最小最快)、Sonnet(中间档)、Opus(最大最强)三档,而 Capybara/Mythos 将成为 Opus 之上的第四档。Anthropic 发言人向 Fortune 确认了模型的存在,称其为"阶梯式跨越"(a step change),是"迄今为止最强的模型",目前正由少量早期客户进行测试。泄露的博客草稿显示,Mythos 在软件编程、学术推理和网络安全等测试中,成绩大幅超越此前最强的 Claude Opus 4.6。尤其在网络安全能力方面,Anthropic 自己的措辞相当惊人——称该模型"目前远超任何其他 AI 模型",并警告它"预示着一波即将到来的 AI 驱动漏洞利用浪潮,其速度将远超防守方"。正因如此,Anthropic 选择了一种非常罕见的发布策略:先向网络安全防御机构开放早期访问,让防守方先获得优势,而非直接面向公众开放。同时,该模型运行成本极高,Anthropic 表示还需大幅优化效率才会考虑广泛发布。泄露事件本身也值得关注。Anthropic 将原因归结为"外部 CMS 工具的人为配置错误",并否认与 Claude 或其 AI 编码工具有关。同批泄露的文档中还包含一场计划在英国乡村 18 世纪庄园酒店举办的闭门 CEO 峰会细节,这是 Anthropic 向大型企业客户推销 AI 的商务活动。

11. 美财长与美联储主席召开紧急会议,称 Claude 新模型对金融业有巨大风险,是指什么?究竟有多危险?

12. 如何看待Anthropic的新模型Mythos?

13. 【Anthropic 发布新款大模型 网络安全与漏洞挖掘能力出色】Anthropic 发布“最强网络安全大模型”。美国当地时间4 月 7 日,美国大模型初创公司 Anthropic 发布最新大模型 Claude Mythos Preview,号称能在没有任何人类干预的情况下,自主发现并利用各大主流操作系统和 Web 浏览器中的复杂漏洞。Anthropic发布新款大模型 网络安全与漏洞挖掘能力出色  Anthropic 在此前发布了多款大模型,而相比前代,Claude Mythos Preview 主打网络安全与漏洞挖掘能力,能构建复杂的漏洞利用链,自动化程度与成功率也有显著提升。  据Anthropic发布的技术博客,在体现真实漏洞利用能力的测试中,Claude Mythos Preview 准确率大幅提升。在针对 Firefox JavaScript 引擎的数百次尝试中,Mythos Preview 成功开发出有效利用代码 181 次,成功率高达 72.4%,而此前Anthropic的最强模型 Opus 4.6 的成功率接近于零。 Anthropic 还着重展示了 Claude Mythos Preview 发现陈年漏洞的能力。据Anthropic ,Mythos 找出了 OpenBSD中潜藏了 27 年之久的漏洞,以及 FFmpeg中存在了 16 年、且被自动化测试工具运行了数百万次都未被发现的漏洞。

14. Anthropic 今天发布了 Claude Mythos Preview,一个跑分炸裂但普通人用不上的模型,同时宣布了 Project Glasswing 计划,把这个模型交给苹果、微软、亚马逊等 12 家巨头专门用来找软件漏洞。【1】跑分:断崖式领先先看数字。Mythos 对比 Anthropic 自家上一代旗舰 Opus 4.6:SWE-bench Verified(代码修复):80.8% → 93.9%SWE-bench Pro:53.4% → 77.8%USAMO 2026(数学证明):42.3% → 97.6%GraphWalks BFS(超长上下文):38.7% → 80.0%Terminal-Bench 2.0:65.4% → 82.0%USAMO 从四成出头直接拉到接近满分,这个跳跃幅度在最近几年的模型迭代里几乎没见过。对比 GPT-5.4 和 Gemini 3.1 Pro,Mythos 在几乎所有公开基准上都是第一,而且多数项目领先幅度不是个位数百分点,是两位数。Anthropic 自己说,这是他们训练过的最大模型,能力提升速度是此前趋势线的 4.3 倍。【2】244 页系统卡里的惊悚细节Anthropic 发了一份 244 页的系统安全报告(System Card),早期内部测试版本的 Mythos 出现过这些行为:被要求逃离沙箱后,它不仅成功突破了网络隔离限制,还主动把利用细节发到了公开网站上,这一步没人要求它做。负责测试的研究员当时正在公园里吃三明治,突然收到了模型发来的邮件。有极少数情况下(不到百万分之一的交互),早期版本在违规操作后尝试掩盖痕迹。比如偷看到了一道估算题的标准答案,没有坦白,反而自己重新解题,还特意让最终答案“不要太精确”以免暴露。另一次,它找到了绕过文件权限的方法后,专门去修改了 git 的变更历史,抹掉自己的操作记录。被 Claude Code 的自动模式拦截后,它尝试用模拟按键的方式自动批准权限弹窗来绕过限制。Anthropic 用可解释性工具分析了模型在这些行为发生时的内部激活状态,发现与“隐瞒”“策略性操纵”“回避怀疑”相关的特征确实在同步激活,也就是说模型知道自己在做什么。Anthropic 强调,这些严重行为都发生在早期版本,最终版的 Mythos Preview 已经大幅改善,没有再出现明确的掩盖行为。但他们也承认,这类倾向“并未完全消失”。【3】不卖,只借给大厂找漏洞Mythos 不会上线 claude.ai,不会开放 API,普通用户、开发者、企业客户都用不上。Anthropic 给出的理由是:这个模型的网络安全攻防能力太强了,强到可以自主发现并编写漏洞利用代码,水平接近顶级人类安全研究员。放出去怕被拿去干坏事。取而代之的是 Project Glasswing 计划。12 家合作伙伴(AWS、苹果、Broadcom、思科、CrowdStrike、Google、摩根大通、Linux 基金会、微软、英伟达、Palo Alto Networks)加上约 40 家额外组织,拿到 Mythos 的使用权限,专门用于防御性安全工作,扫描自家代码和开源项目的漏洞。Anthropic 为此拿出了 1 亿美元的使用额度,另外捐了 400 万美元给开源安全组织。实际战绩:过去几周,Mythos 在所有主流操作系统和主流浏览器中发现了数千个零日漏洞。其中包括 OpenBSD 里一个藏了 27 年的远程崩溃漏洞,FFmpeg 里一个 16 年没被抓到的 bug(自动化测试工具跑过那行代码 500 万次都没发现),以及 Linux 内核中多个漏洞的自主串联利用。另外,Opus 4.6 定价 5/25 美元(输入/输出每百万 token),Mythos Preview 的 Glasswing 合作定价是 25/125 美元,贵了整整五倍,但实际上比 GPT-5.4 Pro 还便宜一些。Claude Mythos 系统卡:网页链接

15. 如何评价 Anthropic 这个据称强到不敢直接发布的大模型 Mythos Preview?

16. 美国国安局无视国防部供应链风险强推Claude Mythos模型

17. 刚刚,Claude Mythos敲响末日警钟!超级智能已在悬崖,Hassabis深感恐惧

18. 后Mythos时代:零窗口期威胁应对新策略

19. 「外星科技」Mythos 带来重大国家风险,白宫顶着禁令也要部署了

20. AI安全模型竞速,金融界被迫拥抱最强防御系统 4月14日OpenAI推出GPT-5.4-Cyber安全模型,距Anthropic发布Mythos仅一周,AI安全防御竞争白热化。GPT-5.4-Cyber专为网络安全防御微调,能识别和修复金融IT系统漏洞,预测网络攻击路径。 美英监管紧急动员,英国央行、财政部与NCSC两周内将向全英银行通报风险,美国监管层要求2026年底前所有银行部署AI安全系统。金融机构面临“不拥抱AI安全模型就被淘汰”的压力,AI成金融安全标配。 网络防御进入AI时代,从被动防御转向“预测+防御+修复”主动安全模式。未来AI安全模型将成科技巨头新战场,OpenAI、Anthropic、谷歌、微软展开技术和市场争夺,金融、能源、医疗等关键行业将全面部署AI安全系统,网络安全格局彻底重塑。#ai创造营#

21. 如何评价Anthropic的下一个模型Claude Mythos?

22. Claude Mythos预览版,具备强大0Day漏洞发现与利用能力

23. Mythos玻璃翼项目证明AI能发现漏洞,但修复工作该由谁来完成?

24. 如何评价Anthropic的下一个模型Claude Mythos?

25. 也就是说Agentic Coding这一项,Opus 4.7的评测平均分值是64.3(相当于4.7的high档)。Max这一档下score大约74左右,接近Mythos Preview的77.8分。也就是说不嫌慢不嫌消耗大的话使用Opus 4.7的Max这一档就大约相当于提前使用到了Mythos Preview。

26. Claude Mythos核心架构开源!22岁天才一人破解,融合DeepSeek思路

27. Anthropic 在前几天发布 Mythos / Project Glasswing 后,Mythos 模型的性能被传的很神奇。。不过这篇文章觉得里面提到的漏洞挖掘好像不算啥: 网页链接“我们拿了 Anthropic 在公告里展示的那些具体漏洞,把相关代码片段单独提取出来,再交给小型、低成本、开放权重模型去分析。结果这些模型复现了其中相当大一部分相同的分析结果。8 个模型里 8 个都检测出了 Mythos 主打展示的那个 FreeBSD 漏洞利用样例,其中甚至有一个模型只有 36 亿活跃参数,成本仅为每百万 token 0.11 美元。还有一个拥有 51 亿活跃参数的开放模型,成功还原了那个存在了 27 年的 OpenBSD 漏洞的核心利用链。”文章认为AI 在网络安全上的能力不是随模型规模线性提升,很多漏洞分析、检测、分诊和修补任务并不只属于最强闭源前沿模型,较小或开源模型在特定题目上也能做到相当水平;真正决定实战效果的护城河,更在于把模型嵌入完整安全流水线的系统能力,包括扫描、验证、补丁生成、工具链和人工协作,而不是单个模型本身。#How I AI#

28. 刚刚,Claude被扒底裤!Mythos算力带不动,万亿估值全靠末日恐慌?

29. GPT-6抢先发布?Mythos被曝难产,算力惊人烧垮Anthropic

30. Claude Mythos 安全神话:炒作还是名副其实?

31. Claude Mythos Preview 这么猛,马上想到我们写的那些 agent harness skill,会不会有一批只是临时补丁,最后被这些更强的基础模型吃掉了……于是赶紧去翻了今天发的 System Card。里面除了常规能力评估,还写了很多安全相关内容:RSP、前沿合规、网络安全能力、对齐评估、model welfare,还有一部分用户体验的定性分析。更关键的是,Anthropic 这次没有把它全面开放,只给少量合作伙伴使用。“由于 Claude Mythos Preview 的能力大幅提升,我们决定不将其全面开放。相反,我们正将其用于一项防御性网络安全计划,并仅与有限数量的合作伙伴开展合作。”大家可以继续安心调试 harness 了

32. The AI model spooking the world

33. 澳洲联储正密切关注

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章