GPT豆包聊上班累不累,一个重情绪一个强逻辑

源自28位全网作者

12:04

内容由AI生成

精选参考来源

1. Photoshop「终结者」?指哪改哪、9图合一,超强排版设计能力与一致性,和Image2比,谁强?| Seedream 5.0 Pro 全方位深度测评

2. #DeepSeekV4能超越KimiK3吗#据媒体报道,DeepSeek V4满血版最快今天就发,灰度测试已经悄悄铺开了。性能接近Opus 4.8,编码直追GPT-5.6 Sol,API这回搞了峰谷计费,高峰翻倍、缓存命中却压得极低,等于把Opus级能力做到七分之一的价。另一边7月16日刚发的Kimi K3,2.8万亿参数、100万Token上下文,在Program Bench、FrontierSWE这些编程榜上反超了GPT-5.6 Sol,Terminal Bench 2.1也咬得很紧。说白了,这俩走的不是一条路。DeepSeek主打性价比,用价格把门槛砸下来抢开发者;Kimi K3走的是长上下文加Agent能力,冲的是前沿榜单。一个拼便宜好用,一个拼能力上限。怎么说呢,同一周两台国产大模型正面开打,赢家未必是分数更高那个,是谁能让开发者真的留下来。你看好谁?

3. #DeepSeekV4能超越KimiK3吗#最近国产大模型赛场看点拉满,一边是即将上线的DeepSeek V4满血版,一边是刚发布不久的Kimi K3,两款产品路线完全不同,很难简单分出高下。先说说Kimi K3,7月16日上线直接刷新国产模型上限,2.8万亿超大参数搭配100万Token超长上下文,专攻编程和Agent能力。多款权威编程榜单里,它直接超越GPT-5.6 Sol,前端开发更是登顶全球榜单,能完整读取大型代码仓库、自主完成整套工程项目,程序员、研发团队用它写项目、改代码优势特别明显。而马上发布的DeepSeek V4满血版走性价比路线,综合性能对标Claude Opus 4.8,代码能力紧追GPT-5.6 Sol,最大亮点是定价优势,同级别能力成本仅海外模型七分之一,还创新推出峰谷计费,夜间平峰调用成本更低,很适合预算有限的个人开发者、中小创业团队批量跑任务。两者定位完全错开:重度编程、长期复杂工程需求选Kimi K3;追求低成本、日常高频调用、综合均衡能力,DeepSeek V4会更合适。国产模型两条赛道同时发力,不管谁更出圈,都证明咱们的AI技术已经追上全球第一梯队。川北小哥的微博视频

4. 【#KimiK3切入美科技巨头命脉#】#全球科技股3日蒸发超3万亿# 7月17日凌晨,月之暗面宣布推出迄今为止公司能力最强的大模型Kimi K3。该模型以2.8万亿参数成为全球最大开源模型,并在前端编程权威榜单Frontend Code Arena上以1679分登顶,超过Fable 5(1631分)与GPT-5.6 Sol(1618分)。这是首次有开源模型在权威编程榜单上超越全部海外闭源模型。K3登顶编程榜之所以令美股暴跌,核心在于其切入了美国科技巨头的命脉:代码生成是AI商业化空间最大的赛道之一,直接威胁海外闭源巨头赖以维持高定价的技术护城河。消息发布后,费城半导体指数一周下跌12.5%,跌入技术性熊市;72小时内美股AI板块合计蒸发约4700亿美元(约人民币3.18万亿元)。参考去年DeepSeek R1发布时,英伟达曾单日蒸发5890亿美元市值。市场普遍称之为“DeepSeek时刻2.0”。冲击同样指向中国大模型行业内部:K3发布当日,港股“大模型第一股”智谱暴跌28.49%,MiniMax重挫15.62%。7月20日智谱逼近20CM跌停,截至发稿跌近19%,MiniMax跌超10%。K3发布后的72小时内,美股AI产业链遭遇全面抛售,且压力从算力层向应用层、工具层逐级传导。算力层首当其冲。英伟达下跌5.3%,纳斯达克100指数下跌1.5%,费城半导体指数一周累计下跌12.5%,正式跌入技术性熊市。据统计,已有17家华尔街投行连夜下调AI芯片企业目标价。摩根大通在报告中直言,Kimi K3的发布无疑雪上加霜。一位高盛合伙人亦表示,算力扩张时代或已走到尽头。模型层的科技巨头同样承压。Meta跌超2.4%,谷歌跌超2%。市场解读认为,K3登顶的直接含义在于,闭源模型赖以维持高定价的技术护城河正在被开源填平。要知道,K3的API定价仅为Fable 5的三分之一、GPT-5.6 Sol的60%,而性能已在编程这一AI商业化核心赛道实现反超。跌幅最深的是EDA板块,新思科技收跌7.85%,铿腾电子收跌9.47%。直接导火索是K3展示的一项能力。K3借助开源EDA工具,用48小时独立完成一颗4mm²芯片的设计、优化与验证,集成146万个标准单元。#A股电力煤炭板块集体走强#(21经济)

5. #DeepSeekV4能超越KimiK3吗# DeepSeek V4满血版VS Kimi K3,DeepSeek V4把性能接近Opus 4.8,缓存命中价格极低,把Opus级能力压到七分之一。Kimi K3则表现出来的战斗力是2.8万亿参数、100万Token上下文,在Program Bench、FrontierSWE等编程评测中超越GPT-5.6 Sol,Terminal Bench 2.1得分接近GPT-5.6 Sol。这两都能进入全球前沿模型梯队,两台国产大模型正面对决,你看好谁?

6. 我就喜欢看到这样的对决,两大国产AI大模型的颠峰对决啊!最新消息,DeepSeek V4满血版最快今日发布,灰度测试已悄然铺开。最核心的是性能接近Opus 4.8,编码直追GPT-5.6 Sol,API引入峰谷计费,高峰价格翻倍,缓存命中极低,把Opus级能力压到七分之一。看到这里,我们再次想起刚发布不久的Kimi K3,2.8万亿参数、100万Token上下文,在Program Bench、FrontierSWE等编程评测中超越GPT-5.6 Sol,Terminal Bench 2.1得分接近GPT-5.6 Sol等。这么一对比,你说#DeepSeekV4能超越KimiK3吗# ?我想对说的是,这两个大模型的特点本来就不一样,还得看你的需要点是什么?但可以肯定的一点就是这两个新版大模型都是世界级的水平。#科技先锋官#

7. “Kimi K3”在编程、数学、科学等多个领域,性能已接近Anthropic的“Fable”以及OpenAI的“GPT-5.6”等美国顶级模型。尽管性能出色,但其使用费用却大幅降低,按使用量计算的单价比“Fable”低70%,比Anthropic第二梯队模型“Opus 4.8”低40%。-

8. Kimi K3现在用下来,有一点比Fable 5和GPT 5.6 Sol都要强。就是你让它写代码的时候,如果一边写一边讨论技术方案,Fable 5和GPT 5.6 Sol会根据你的自然语言描述,自己发明一堆很抽象的概念名词,让你反而看不懂它在说什么了。而Kimi K3的语言表达始终很清晰。

9. #DeepSeekV4能超越KimiK3吗#没有谁超越谁,只有谁更合适。 先说Kimi K3,性能上限拉满,2.8万亿超大参数、原生100万Token超长上下文,编程评测成绩已经超过GPT-5.6 Sol,处理大型代码库、超长文档分析的能力属于第一梯队,很适合专业开发团队、科研项目;短板就是调用成本偏高,还要等到7月27日才完整开源,个人高频试用门槛不低。 再看DeepSeek V4,走普惠落地路线,推理成本大幅压缩,Flash版本直接免费开源,还支持本地私有化部署,API新增峰谷计费,能用更低成本拿到接近顶级模型的效果,个人开发者、中小团队做日常开发、小规模测试特别划算;只是硬核编程的上限暂时还追不上Kimi K3。 所以,追求极致代码能力、处理超大体量资料优先选Kimi K3;看重预算、想本地部署、日常高频调用就选DeepSeek V4。#ai创造营#

10. 所有的 AI 模型公司所提供的 coding plan(包括但不限于像 Kimi、OpenAI、Anthropic 这些公司提供的 coding plan)其实有一个共同点,就是大家都是亏钱的。因为它都会提供给你数倍甚至数十倍于你订阅费用的 token 数量。比如说像 ChatGPT Plus 20 刀的那个额度,再加上这段时间 OpenAI 经常会给你 reset,可以理解为它 20 刀的价值远远超过了它本身。那么什么时候会出现售罄呢?其实就是模型的性能超预期。一旦模型的性能远超预期,或者能够达到大模型旗舰的稍弱版本——就比如像 Kimi K3 这种后训练做得非常厉害的模型,已经可以近乎平替 GPT 5.5 系列,或者稍弱于 Anthropic 的 Claude 5 的级别,那么用户的付费意愿就会极大增强。同时,相比于 Kimi 原来的模型,K3 即使在正常运行下,其 3T 的数量级也远超原来模型的数倍,这其实对算力的要求翻了好几倍。加上这段时间铺天盖地的 Kimi 测试和体验,也增强了短期内对 Kimi 的订阅量。模型性能好,又是这个时间段内开源模型接近于大模型标杆的代表,所有这些因素共同造成了短时间之内的算力需求峰值。但是可以预想到,未来的大模型这种 coding plan 应该是会越来越少的。因为 coding plan 卖一个就是赔钱干一个:给用户真实的量,用户不满意;如果给用户超额的量,自己又在亏钱,永远都达不到一个平衡。所以最终肯定还是会出现 pay as you go 这种按量付费的模式。但这套模式只有性能达到一定条件的模型才有资格享受。因为你的模型性能一旦不够,无法超越预期、甚至是远超预期的时候,大家的付费意愿就会极大极大地降低。利好cloud,谷歌说不定躺赢了。

11. GPT-5.6 Sol(Max)深度评测:Agentic 维度领先,成本相对低于前沿模型

12. 400页PPT换模板实测:豆包三轮未完成,Claude基本可用,GPT-5.6成品最好

13. Kimi K3、Claude Fable 5、GPT-5.6 Sol 对比:性能接近,价格相差 3 倍

14. 7.24| AI日记 极简还是热闹?GPT-5.6框架层 vs 豆包框架层

15. GPT-5.6 Sol烧光天价额度!开发者怒晒400亿token账单:OpenAI为追赶Claude,把模型“榨干”了?

16. GPT-5.6 的 Sol、Terra、Luna 有什么不同?一个模型家族的三种分工

17. 刚刚,GPT-5.6 国内免费使用!

1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章