Deepseek要迎来V4?传下周更新将支持图片、视频和文本生成

2026-03-01 21:22:50 0点赞 1收藏 0评论

那R2呢?

金融时报(FT)2 月 28 日发布博文,报道称深度求索(DeepSeek)将于下周发布全新多模态大语言模型 V4,原生支持图片、视频与文本生成功能。

图片图片

这是 DeepSeek 自 2025 年 1 月推出 R1 推理模型以来的首个重大版本更新,有望进一步填补国内低成本、开源模型的市场需求。

博文介绍,在下周发布 V4 时,DeepSeek 计划同步公开一份简短的技术说明,并于约一个月后发布详尽的工程报告。

在硬件适配方面,消息称 DeepSeek 为国产算力提供深度支持,已联合HW和寒武纪优化 V4 模型的硬件适配,预估大幅提振本土半导体需求,并加速 AI 模型“推理”环节靠拢本土芯片。

此前传言,2月前后有部分用户反馈在 App 或网页端抽测到了具备 100万(1M)Token 超长上下文能力的模型,且其知识库已更新至 2025 年 5 月。虽然官方在回应中表现得比较低调(甚至有说法称这只是 V3 的长文本优化版),但从泄露的技术指标和“Engram”内存架构研究来看,这极大概率是 V4 系列的先遣“Lite”版本,专门为了测试长文本处理的稳定性和代码重构能力。

根据目前泄露的 Benchmarks(如 HumanEval 评分接近 90%),V4 的目标显然是全面对标甚至超越 GPT-5(内部代号 Garlic)和 Claude 4.5。不仅仅是参数规模的堆砌(传闻总参数达 1 Trillion,但采用高效的 MoE 架构),更核心的突破在于极致的推理性价比和代码“自主重构”能力,如果正式版能达到预期的 80% 以上的 SWE-bench 解决率,它将从助手进化为真正的工程师。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
1
扫一下,分享更方便,购买更轻松