Deepseek要迎来V4?传下周更新将支持图片、视频和文本生成
那R2呢?
金融时报(FT)2 月 28 日发布博文,报道称深度求索(DeepSeek)将于下周发布全新多模态大语言模型 V4,原生支持图片、视频与文本生成功能。
图片这是 DeepSeek 自 2025 年 1 月推出 R1 推理模型以来的首个重大版本更新,有望进一步填补国内低成本、开源模型的市场需求。
博文介绍,在下周发布 V4 时,DeepSeek 计划同步公开一份简短的技术说明,并于约一个月后发布详尽的工程报告。
在硬件适配方面,消息称 DeepSeek 为国产算力提供深度支持,已联合HW和寒武纪优化 V4 模型的硬件适配,预估大幅提振本土半导体需求,并加速 AI 模型“推理”环节靠拢本土芯片。
此前传言,2月前后有部分用户反馈在 App 或网页端抽测到了具备 100万(1M)Token 超长上下文能力的模型,且其知识库已更新至 2025 年 5 月。虽然官方在回应中表现得比较低调(甚至有说法称这只是 V3 的长文本优化版),但从泄露的技术指标和“Engram”内存架构研究来看,这极大概率是 V4 系列的先遣“Lite”版本,专门为了测试长文本处理的稳定性和代码重构能力。
根据目前泄露的 Benchmarks(如 HumanEval 评分接近 90%),V4 的目标显然是全面对标甚至超越 GPT-5(内部代号 Garlic)和 Claude 4.5。不仅仅是参数规模的堆砌(传闻总参数达 1 Trillion,但采用高效的 MoE 架构),更核心的突破在于极致的推理性价比和代码“自主重构”能力,如果正式版能达到预期的 80% 以上的 SWE-bench 解决率,它将从助手进化为真正的工程师。
