Anthropic内部Model 2超神话5暂不发布

源自161位全网作者

18:06

内容由AI生成

精选参考来源

1. 刚刚,Anthropic报告泄露Model 2,比Mythos 5更强的内部模型

2. #DeepSeekV4Pro正式版#DeepSeek V4 Pro正式版上线,作为我一直用的AI模型,这次升级确实给力。它在编程、操作电脑等“Agent”任务上进步巨大,跑分直逼甚至部分超越了国外顶尖模型Claude Fable 5。价格虽然比Flash版贵三倍,但输入3元、输出6元/百万token的定价,考虑到性能依然很有性价比。

3. 讲真的,V4 Pro转正最让我服的不是1M上下文,是“权重没动,纯靠后训练把Agent能力拉了一个量级”。DeepSWE从12.8干到62.7,Terminal Bench只差Fable 5零点一分,CyberGym还反超。不搞参数军备竞赛、靠工程吃饭,这才是真东西。价格更离谱,输出6块/百万token,Fable 5要三百多,差快60倍。国产把旗舰性能塞进个位数价格带,这定价权谁还跟着海外锚点走?官方说近期整体涨价“涨幅较大”,且用且珍惜吧#DeepSeekV4Pro正式版#

4. 【#中美大模型价差正在收窄#】#DeepSeekV4Pro与Grok4.6对比#8月12日,DeepSeek与马斯克旗下SpaceXAI同日发布新模型DeepSeek-V4-Pro和Grok 4.6,新一轮大模型竞争再次升温。从最新评测来看,两款模型均进一步逼近全球头部水平。其中,DeepSeek-V4-Pro在多项智能体相关测试中超过Anthropic的Claude Opus 4.8;Grok 4.6则在Artificial Analysis智能指数中追平OpenAI旗舰模型GPT-5.6 Sol。能力差距缩小的同时,中美大模型之间悬殊的价格差距也在发生变化。摩根士丹利最新研报显示,中国大模型API平均价格过去一年明显上涨,而美国闭源模型价格近期持续下降,中美大模型价格差距正在收窄。摩根士丹利指出,中国大模型市场的竞争重点正在从“价格战”转向“智力战”。(每经)

5. #DeepSeek发布V4Pro正式版#深夜,DeepSeek 悄无声息地扔出了一枚重磅炸弹。昨晚,DeepSeek 官网 API 文档悄然上线了 V4 Pro 正式版(版本号 0813)。没有发布会,没有预告,就这么直接“转正”了。性能上,它真的在向国际顶尖闭源模型靠拢。 根据官方流出的评测对比,V4 Pro 正式版在多项测试中已接近 Anthropic Fable 5 的水平。更夸张的是 Agent 能力的跃升——Terminal Bench 2.1 跑到 87.9 分,Cybergym 83.3 分,DeepSWE 62.7 分,相比预览版简直是代际提升。1M 超长上下文加上 384K 的最大输出,处理整部小说或整个代码仓库都不在话下。价格方面,Pro 版是 Flash 的三倍——输入 3 元/百万 tokens,输出 6 元。但缓存命中后输入仅需 0.025 元,性价比依然惊人。作为对比,Claude Opus 4.8 跑一次任务的成本是 DeepSeek V4 Pro 的 44 倍。把接近 Fable 5 的性能,卖成白菜价。 这或许才是 DeepSeek 真正的“大招”。#DeepSeek发布V4Pro正式版##DeepSeek发布V4Pro正式版

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章