DeepSeek 原生多模态来了

DeepSeek 闷声上新:多模态视觉模型 V4-Flash-Vision-Exp 上线 API。 三句话讲完👇
🧠 性能:纯文本能力不缩水,视觉 Agent 能力直接逼近 Claude Opus 4.8(ApexBench 26.2→36.5)。
💰 价格:跟文本版一模一样——一张图最多 384 token,输入 1 元/百万、输出 2 元/百万。比同类多模态便宜一大截。
🎯 是真多模态:图像直接进模型,不是先 OCR 转文字。官方案例都是「看懂设计意图再干活」:生成西藏自驾游 PPT、重构官网、做黏土怪物动效。
⚠️ 实验版(-exp),生产环境记得配 fallback。
想试的,API 里把模型名改成 deepseek-v4-flash-vision-exp 就行。
视觉能力对 Agent 是不是刚需?评论区聊聊👇
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
