DeepSeek即将发布V4模型,其原生多模态能力与国产芯片深度适配的战略,不仅是一次技术升级,更可能重塑全球AI算力竞争的格局,带来新的行业变数。
智能速览
DeepSeek V4将是原生多模态模型,支持图片、视频与文本生成。
V4绕过英伟达,优先针对国产AI芯片进行深度优化。
据悉其API调用成本相比主流对手可能便宜50倍。
回顾R1发布曾引发美股巨震,英伟达单日市值蒸发近6000亿美元。
竞争对手Anthropic在发布前发起“模型蒸馏”指控。
精华内容
从R1的悄然颠覆到V4的战略转向,DeepSeek的技术路径揭示了什么?
技术飞跃
DeepSeek V4的核心突破在于其原生多模态能力,补齐了前代在图像与视频生成上的短板。据内测信息,V4 Lite版本已拥有高达100万token的上下文窗口。
在不开启思考模式时,其生成的SVG图像质量已能超越V3.2思考模型,编码性能也被指超越了当前的GPT与Claude。
战略转向
V4最具战略意义的一步,是绕开英伟达,优先与国产芯片厂商深度合作。这打破了顶级模型发布前必与英伟达优化的行业惯例。
虽然英伟达芯片在训练阶段仍占主导,但V4在推理环节的国产芯片适配,标志着商业化落地核心环节的自主化突破,意义深远。
历史回响
DeepSeek的颠覆力在去年R1发布时已得到验证。R1以不到GPT-4十分之一的训练成本,达到了与之相当甚至超越的性能。
此举直接导致英伟达股价单日暴跌17%,市值蒸发约5890亿美元,被称为科技界的“斯普特尼克时刻”,引发了市场对AI基建投资价值的根本性质疑。
舆论交锋
在V4发布前夕,竞争对手Anthropic指控其进行“工业级蒸馏攻击”。然而,紧随其后出现的Claude模型在中文环境下自认“我是DeepSeek V3”的bug,让这场指控充满戏剧性。
舆论普遍认为,这是一场旨在削弱V4发布影响力的FUD营销,意图抢占叙事主导权。
DeepSeek V4的发布,是中国AI从依赖硬件蛮力转向架构创新效率的缩影。这一步若能成功,不仅将挑战现有算力霸权,更可能为全球AI发展探索出一条新的技术路径。