DeepSeek视觉模型V4-Flash开源,MIT协议可商用本地部署省API费
源自332位全网作者
08-31 20:30
精选参考来源
1
梁文峰确实很高明,DeepSeek的相关数据出来了。DeepSeek今年前7个月,营收4.75亿。是去年全年的10倍。大家要知道的是,DeepSeek最赚钱的不是C端订阅,是B端API调用。小米、腾讯、OPPO,一堆大厂都在用。开发者们把它当底座,在它上面搭应用。OpenRouter上单日8万亿Token,全球调用量第一。为什么都选它?便宜,性能还不差。模型能力接近GPT-4o,价格只要几十分之一。创业公司做AI应用,算成本账,DeepSeek就是那个最划算的。所以4.75亿这个数,本质上是B端客户用脚投出来的。不是“用户花钱和AI聊天”,而是“企业愿意把核心业务跑在DeepSeek上”。这事的分量,比数字重多了。为什么偏偏今年爆发?三件事同时发生。第一,模型能力过了商用线。DeepSeek的推理模型,从R1到V4,能力一直在涨。特别是复杂推理和多步任务,已经能进真实业务流了。从“能用”到“好用”,它今年刚好跨过这道门槛。第二,成本降到能算账了。AI落地最怕什么?不是技术不行,是调用一次比雇人还贵。DeepSeek把推理成本压到极低,低到小公司也敢用,大厂愿意批量接。第三,开源开始反哺。DeepSeek一直开源,权重随便下,开发者随便部署。短期看像白送,长期看是在养生态。开发者在本地用顺了手,等需要更大规模算力时,自然就转去用它的API。开源引流,API变现,这条路今年终于转起来了。但得说句实话。4.75亿,离“商业模式跑通”还差得远。英伟达一天赚的可能都比这多,OpenAI一年收入是它几十倍。可它真正的价值,不在规模,在增速和收入质量。10倍增长,说明市场接受度在放大。API为主,说明收入来自真实调用,不是融资撑出来的假象。别人都在学OpenAI,先烧钱做C端,再慢慢找变现。DeepSeek反着来:不碰热闹的C端,专心做模型、做API、做开发者生态。结果收入反而起来了。这说明AI行业最稳的生意,还是卖铲子。不是每个人都得去做刷屏的AI应用。把模型做好,成本降下来,让别家公司用你的模型去赚钱,这条路也能通。4.75亿只是起点。接下来要看的是模型能力能不能继续涨,成本能不能继续压,生态能不能继续扩。但至少有一点已经证明了:中国AI,可以不靠故事,不靠泡沫,就靠把一件事做到极致,也能赚到真金白银。这比什么融资消息都提气。
2
#Easy同学正在独立开发#智谱 Z.ai 今天正式发布 **GLM-5.3-Flash**,这是此前以 Ox Alpha 代号预览的模型,官方确认它完全运行在中国 AI 芯片上。GLM-5.3-Flash 是 **320B-A18B** 的 MoE 架构模型,以 MIT 许可证开源,原生多模态,支持 100 万 token 上下文窗口。权重已上线 Hugging Face,API 同步开放,官方还推出了对应的 Coding Plan 和 ZCode 产品。官方在评论区公布了 API 定价,按每 100 万 token 计算:**输入 $0.15,输出 $0.50,缓存命中的输入 $0.03**。对比 DeepSeek 当前的 V4-Flash 定价,GLM-5.3-Flash 的未缓存输入与输出定价均低于 DeepSeek V4-Flash 的低谷价,但缓存命中输入($0.03)高于 DeepSeek 的 $0.007-$0.014。性能方面,在 Z.ai 自家的 Code Bench 评测中,GLM-5.3-Flash 在各级 effort 设置下均优于 GLM-5.2,官方称与 Claude Opus 4.8 表现相当。发布配图对比了 GPT-5.6 Terra、Gemini 3.7 Flash、DeepSeek-V4-Vision-Exp 等多个模型的基准成绩,GLM-5.3-Flash 在 GDPVal-AA 指标上领先。博客:网页链接(由 流苏ªⁱ 撰写)#GLM-5.3-Flash##智谱AI##DeepSeek##开源模型#
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
已收藏
去我的收藏夹