国产多模态大模型为何总被拿来与GPT-4V对比?

源自169位全网作者

05-13 12:57

内容由AI生成

精选参考来源

1. 提速10倍!Mac Mini 本地跑 AI 大模型,OpenClaw + oMLX 加速神器实测效果惊人! | 零度解说

2. 【首发】GPT-5.5重磅上线!能自己搞定复杂任务的AI来了

3. 小米MiMo大模型这波在海外杀疯了,借势#小米大模型负责人谈未来竞争# 热搜,德国一线媒体盛赞其为“openclaw大脑”,海外开发者圈层口碑炸裂,直言能力不输Claude Opus 4.6,成本却低到惊人。 更硬核的是,马斯克转发的大模型无幻觉率榜单中,MiMo-V2-Pro高居第三,仅次于Grok 4.20,专业实力获国际认可。如今OpenCode等专业社区纷纷站台,全球开发者都在用脚投票,MiMo市占率飙升已成定局,中国大模型正在强势走向世界舞台。

4. 市值近600亿,大模型公司上市了! #AI #智谱ai

5. 实测DeepSeek V4,为国产化而生。今天,等了一年的DeepSeek V4,终于发布了。本来每天都很期待,但是发布的这一刻,突然感觉进入到了一种贤者模式。人有点麻了,这一周发了7、8个新模型,最近24小时就发了4个,昨天下午刚开始测MiMo,然后HY3发了,刚写完MiMo,然后GPT-5.5发了,今天刚发完MiMO,然后DeepSeek v4发了。我现在就仿佛鸡排哥,写完你的写你的,写完你的写你的。我也第一时间把DeepSeek V4接到了我的Claude Code里。然后很多朋友问为啥没有R2了,这块我简单的科普一下下,就是在去年这个阶段,推理模型和非推理模型还是分开的,也就是DeepSeek R1是推理模型,DeepSeek V3是非推理模型。然后到了后面,基本Claude和GPT都还开始使用混合模型了,也就是用思考强度去控制模型是否进行推理。所以DeepSeek V3.1的时候,也改成了混合模型的架构,这些V4同样的,也是混合模型。所以R2存在的意义现在就有点不明确了,就像OpenAI o3,就成了OpenAI的最后一代推理模型,被并到了GPT-5里面。再简单说一下DeepSeek V4这次的一些特性。先看跑分。各方面都有明显加强。然后这段时间,模型又太多太杂太乱了,于是我又自己整理了一下,因为大家的数据和口径总是经常不一样,所以这个表能看个大概,但是不能深究。。。先是知识推理类的。没有数据的就是没放这块的跑分。可以看到DeepSeek最强的还是SimpleQA这两个知识类的,逼近Gemini 3.1 Pro,在其他的地方只能说中庸。然后代码类的。可以非常明显的看到走的也是Gemini那一卦的,在竞赛、算法类比较强,但是真实代码工程能力上,只能说从分数上看,也没啥大幅领先,第一梯队水平。代码这块我觉得也可以把Arena最新的评分放出来,目前DeepSeek V4排第三,第一还是GLM-5.1,MiMo没上榜是因为还没开源出来,目前只有API,开源估计下周了。Agent能力这一卦上。这个确实比较强。跑分其实可以看到比较正常,在现在一众诸神混战的年代里,可以给到人上人,但是如果大家是夯爆了的预期的话,可能就会失望了。然后还有一个非常直观的数据,V4-Pro的总参数量是1.6T,也就是1.6万亿。V3.2是671B,也就是6710亿,V4的参数量,翻了将近两倍半。所以其实你可以看到,在如今这个时代,依然还是大就好,大就牛逼,大就是聪明。但是因为大带来的提升,也变向带来了Token的涨价,算力就那么多,模型参数越来越大,Agent推理所用的Token又越来越多,不涨价都不可能了。V4-Pro是输入12元,输出24元每百万token,V4-Flash是输入1元,输出2元。换算成美元的话,输入1.74美元每百万token,输出3.48美元。V4-Flash,输入0.14美元每百万token,输出0.28美元。作为对比,Claude Opus 4.7是输入5美元,输出25美元,GPT-5.5是输入5美元,输出30美元。MimM-V2.5-Pro在0到256k token内,是¥7/¥21每百万token(输入/输出),在256k到1M token内是¥14/¥42每百万token(输入/输出)。平均下来国产模型价格定价都差不多,虽然有点对不起DeepSeek一直以来的价格屠夫的称称号,但还是大概比海外模型平均便宜60%左右。不过这里面有个细节很多人可能没注意到。DeepSeek在定价页面底部有一行小字,大意是说,受限于高端算力,目前Pro的服务吞吐十分有限,预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调。也就是说,V4-Pro现在的价格还不是最终态,等芯片产能跟上了,价格还会往下降,这一点我觉得还是挺重要的。然后这个事,加上DeepSeek V4的报告里,其实能透露出非常多国产化的细节,明显是为了给国产芯片做准备的。有几个小细节,我也不知道我理解的对不对,有大佬可以来拍砖一下。1. V4在后训练和推理体系里引入了MXFP4。虽然训练还是用的英伟达体系,但是在后训练和推理上用这个基本上就意味着,DeepSeek在往开放低精度格式和多硬件适配方向走,可以适配国产卡比如华为昇腾、寒武纪、壁仞等等,会降低对NVIDIA的FP8生态的绑定,特别是推理的时候,那这就是正儿八经的国产生态国产模型了,可惜的就是现在价格还没下来。2. V4的底层内核不再完全靠CUDA写,用了一个叫TileLang的DSL。DeepSeek希望底层算子开发不要完全锁死在CUDA上,而是用更高一层的语言描述计算,再尽量编译到不同硬件上,这个非常牛逼,可以大大降低迁移成本。3. V4专门搞了一个叫MegaMoE的融合内核,设计目标是减少专家并行中的通信等待,目前已经在华为昇腾上跑通。这三条放一起,方向就非常清楚了,V4是完完全全的,为了国产卡而设计的模型。这真的不是啥爱国故事,所有人都知道,未来算力有多缺,算力生产有多慢,但是Agent加速之下,Token带来的消耗有多恐怖。算力被卡脖子,所有人都没有办法,君不见GLM-5.1这么好的模型,有多受限于算力推理吗?算力博弈,很多时候,就是顶层博弈。DeepSeek v4,就是算力博弈逼出来的现实。未来一年,国产大模型跑国产卡这件事,感觉会逐渐成熟了。然后多模态的事,我知道大家很关心。因为现在,多模态几乎是标配了,比如Opus 4.7大幅强化的就是多模态能力,K2.6、MiMo-V2.5-Pro也都标配了多模态,更别提GPT-5.5了。因为没有多模态,你读不了图,你没有视觉能力,审美上也必然差一截,同时什么Computer Use之类的Agent能力,更是想都别想。但是非常非常可惜的是,DeepSeek V4,不是多模态。还是一个纯文本模型,没有多模态能力。一声长叹,其实很早以前就在传V4有多模态了,我也知道他们内部肯定做了多模态的工作,但是最后,还是没有放出来,看来适配国产卡的压力,还是太大太大了。多模态,可能只能等到v4.5或者v5.0了,希望这两个版本,没有了适配国产卡的压力,不要再让我们等一年了。目前V4 Pro我也接到Claude Code里面了。我们在自己紧锣密鼓的测试了3个小时之后,有了一些自己粗糙的结论。我个人感觉,跟Claude Code的适配,是有一些问题的,我现在不知道到底是适配的问题,还是模型的问题。举个最简单的例子,我的本地skill,是有一个直接管理我服务器的skill的。我至今没有见到任何一个模型,在我说出明确带有服务器的词语的时候,不去调用我的服务器skill去服务器查询。GLM-5.1、MiniMax M2.7、Kimi K2.6、MiMo-V2.5-Pro,没有一个有问题,但是,DeepSeek V4,出了问题。我需要把Prompt说的如此明确才可以。非常的奇怪。我们小伙伴也是,之前他做了一个社群运营系统,已经做完了,在桌面留了个PRD,用来测试的,但,理解力也有点问题,虽然是为了测试,在根目录进行启动的,但一般还是会进行全局搜索一下的,而不是直接拒绝。然后开发这块,我自己之前测试Opus 4.7的Case扔给了他,这个需求其实就是给我们开发一个招聘网站,要使用女神异闻录5的风格,同时还要部署到我的服务器上,但是我的需求说的非常的乱,也会比较考验模型需求的理解能力。Opus 4.7当时做出来的效果是这样的。在给DeepSeek V4 Pro开发的时候,速度非常的缓慢。大概花了24分钟做完的。UI其实还好了,但是出了蛮大的问题,就是没有跟我进行任何的确认。因为我的约束给的是非常多的,比如CLAUDE.md里面,还有我的skill里面,最基本的一个问题,就是比如没有遵守skill的描述。任何新项目,部署到服务器上,都是一定要跟用户确认域名是否OK的,但是没有做任何确认,直接自己选了careers.virxact.com干上去了,24分钟结束之后,给了我一个域名,让我确认。这个其实蛮奇怪的,我的约束好像很多也都失效了。而模型的写作能力上,反而是让我觉得比较开心的点。相比于其他模型,几乎不说人话不看写作了,DeepSeek是为数不多的还关注这一块的。第一个是强行调用我的skill,去写一篇关于Token涨价的文章。花了大概8分钟,不知道开了多少个网页,然后写了一篇,在几层检测上,自己完成了。还让他对我昨天GPT-image-2的黑暗森林那篇进行了中段续写的测试。整体效果达不到Opus 4.6那种润物细无声的级别,但是比Opus 4.7要好,如果你用修改度来区分,那大概Opus 4.6直出的我的修改度是30%,Opus 4.7我的修改度是60%,那DeepSeek V4 Pro的修改读大概在45%左右。并且因为上下文增加,在输出长文档上,效果会好的多的多。对DeepSeek V4的测试大概就是这样。有好有坏。我昨天在GPT-5.5的文章里修正过一次推荐,早上我也写过MiMo-V2.5-Pro,说它是我现在觉得搭配Claude Code的最佳模型之一。现在,我再更改一下推荐:1. 如果你更偏好海外模型,且愿意花20~200刀会员订阅费:在内容创作(文章、策划案、脚本等)这种需要创意的场景上,我至今依然推荐使用Claude Code + Claude Opus 4.6。而在通用开发、数据分析、文档处理等所有其他场景下,我更推荐你用Codex + GPT-5.5。2. 如果你更偏好国内模型:在内容创作场景上,我推荐你使用DeepSeek官网,没有必要用Claude Code。而在其他所有场景下,我依然推荐你使用Claude Code + GLM-5.1或MiMo-V2.5-Pro的组合。DeepSeek V4,身上背负的东西太多,承载的东西也太多。大家给的期望也足够的大。虽然非常坦诚的讲,这次的模型,并没有大幅度的领先和巨型的惊艳。但,对于模型的国产化、乃至AI的国产化,都是浓墨重彩的一笔。希望这一次,完成了所有的底层积累,厚积薄发。在V4.5或者V5的时候。让世界,继续听到DeepSeek的声音。#DeepSeekV4发布##how i ai#

6. #deepseekv4和gpt5.5谁更强#DeepSeek V4与GPT-5.5同日登场,路线截然不同、各领风骚。GPT-5.5作为闭源旗舰,通用推理、跨工具Agent、办公工作流全面领先,综合基准屠榜、生态成熟,适合全球通用场景。DeepSeek V4主打开源+百万上下文,中文理解、长文档/代码库处理、低成本私有化部署优势突出,适配国产算力,性价比碾压闭源模型。论全能上限,GPT-5.5更强;论中文、长文本、自研落地,V4更实用。二者不是替代,而是互补,共同推动AI走向普惠与专业并行的新阶段。deepseekv4和gpt5.5谁更强

7. 别问谁更强,GPT-5.5和Opus4.7综合对比

8. 多模态大模型这条赛道,阿里云开始拉速度了

9. 为什么DeepSeek V4这么强?它到底更新了啥?

10. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI

11. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#

12. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌

13. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说

14. 盘点一周AI大事(5月3日)|Google上线AI口语陪练 Google IO即将发布Gemini 4和Veo 4 Gemini上线原生文件生成 Google推出AI衣柜 Google翻译上线AI口语陪练 Claude 接入50多款创作软件,能直接操作Photoshop修图、做海报,接管Blender建模,用Ableton创作音乐 英伟达开源全模态模型Nemotron 3 Nano Omni 研究员训练出复古大模型talkie KAIKAKU发布食品大模型Epicure 研究员开源突破性智能体协作框架Recursive MAS Moonlake上线Blender智能体Moonlake 3D Agent #前沿科技趋势发布月 #AI新星计划 #AI #AIGC #大模型

15. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型

16. 今天,也就是2026年2月14日,字节跳动正式发布了豆包大模型2.0(Doubao-Seed-2.0)系列,官方宣布这标志着豆包全面进入Agent时代。这次更新推出了Pro、Lite、Mini、Code全家桶,Pro版直接对标国际顶尖如GPT-5.2和Gemini 3 Pro,亮点非常多,尤其在真实世界复杂任务执行、多模态理解和性价比上表现出色。🔻主要亮点和技术升级1. 全面进入Agent时代,强化复杂任务执行
豆包2.0不再只是聊天工具,而是针对大规模生产环境系统优化,重点提升高效推理、多模态理解和复杂指令执行能力。能更好地处理多约束、多步骤、长链路任务,已具备支撑高价值真实世界任务的基础。比如长链推理、Agent规划执行等场景更可靠。2. 多模态能力大幅跃升,多数基准达SOTA
视觉与多模态理解更稳健:对复杂文档、表格、图表、图形、视频的解析显著提升,视觉推理、空间理解、运动理解、长视频分析等达到全球顶尖水平。Pro版在大多数视觉基准测试中拿最高分,支持更精准的多模态感知和推理。3. 数学、推理、编程能力顶尖
Pro旗舰版在IMO、CMO数学竞赛和ICPC编程竞赛中取得金牌成绩,在Putnam基准上超越Gemini 3 Pro,数学和推理能力已达世界顶尖。能尝试埃尔德什级数学问题、完成研究级科学编程任务。4. 全家桶灵活适配不同场景 • Pro:深度推理 + 长链路任务,旗舰对标GPT-5.2 / Gemini 3 Pro。 • Lite:性能与成本平衡,综合能力超上一代主力豆包1.8。 • Mini:低时延、高并发、成本敏感场景。 • Code(Doubao-Seed-2.0-Code):专为编程优化,与TRAE(字节AI编程工具)结合效果最佳,支持多模态输入(如代码截图)。5. 超强性价比,token成本降低约一个数量级
Pro版定价(32k以内输入):3.2元/百万tokens,输出16元/百万tokens,远低于Gemini 3 Pro和GPT-5.2。Lite输入仅0.6元/百万tokens。在长链路、大规模推理场景下,成本优势巨大,真正让AI“用得起”。🔻体验入口:豆包App切换“专家”模式即可用Pro对话;Code版已在TRAE接入;开发者可通过火山引擎API调用全系列。🔻简单对比GLM-5和通义千问(Qwen)M2.5等同批更新模型从当前公开信息看(2026年2月数据),豆包2.0 Pro在数学/推理(如IMO金牌、Putnam超Gemini 3 Pro)和多模态视觉理解上特别突出,整体对标国际前沿(如GPT-5.2级别),推理链更长、Agent执行更稳。GLM-5(智谱)和通义千问M2.5(阿里)也在2025-2026密集迭代,强在中文理解、工具调用和生态(如通义千问的图像/视频生成),但字节这次强调真实世界复杂任务+极致性价比,Pro在部分国际基准领先,成本更低一个量级,适合企业级大规模部署。国内模型差距已非常小,各有侧重:字节更偏多模态+Agent执行,阿里/智谱在开源和通用中文生态更成熟。你已经试过豆包2.0了吗?我是用了,确实好。字节真是国产之光。🚀 #豆包大模型2.0发布# #HOW I AI# #过个有AI年#

17. #小米首次登顶全球开源大模型第一#Xiaomi MiMo-V2.5 系列模型正式开启了公测,包含 MiMo-V2.5、V2.5-Pro、V2.5-TTS Series、V2.5-ASR 四款产品。其中: MiMo-V2.5-Pro定位小米迄今最强模型,在通用智能体、复杂软件工程、长程任务等维度,已能与 Claude Opus 4.6、GPT-5.4 等全球顶尖Agent模型正面抗衡。可稳定完成涉及近千轮工具调用的长程任务,超长周期内逻辑一致,指令遵循能力大幅提升。仅用 4.3小时、672次工具调用,就用Rust从零实现了完整的SysY编译器(北大《编译原理》课程项目),在隐藏测试集上取得233/233满分,还在11.5小时内自主开发出具备完整功能的视频编辑器Web应用(代码量8192行,1868次工具调用)。 MiMo-V2.5定位为Agent场景而生的原生全模态大模型,支持同时看、听、读,把理解转化为行动。Agent能力全面超越上一代MiMo-V2-Pro,API成本降低约50%。多模态感知能力超越上一代MiMo-V2-Omni,跨模态推理、视频理解、图表分析能力显著提升,在VideoMME、CharXiv、MMMU-Pro等评测中逼近甚至超越业界顶级开源模型。除此之外,全系列Token效率得到了前所未有的优化。在相同Agent基准(ClawEval)分数下,MiMo-V2.5-Pro相比Kimi K2.6节省42% Token,MiMo-V2.5相比Muse Spark节省50% Token,全球开发者已经对Mimo的Token效率赞不绝口了。 小米还对Credits计费做了简化,取消了按上下文窗口区分倍率,MiMo-V2.5消耗1Token=1Credit,MiMo-V2.5-Pro消耗1Token=2Credits。订阅新增了连续包月(老用户自动续费次月7折、新用户77折)、包年(全年88折)。所有已购买Token Plan的用户,Credits额度将全部重置清零,重新开始计算。

18. 小米这次的Token套餐,确实给行业立了个新标杆。 一次订阅就把全模态模型都包含进来,还直接带上了热度很高的MiMo‑V2‑Pro,计费透明、价格厚道,对养虾和开发者都很友好。#小米MiMo大模型首次推出TokenPlan# MiMo‑V2‑Pro本身就是第一梯队实力,在OpenRouter上连续霸榜,周消耗屡破纪录,是开发者用出来的口碑。这次套餐把全模态能力打包,统一计费、无使用限制,体验相当完整。 好用不贵、诚意拉满,国产大模型套餐终于有了对标国际顶级的标准,未来的路值得期待。

19. DeepSeek V4 预览版本上线并同步开源,哪些亮点值得关注?

20. #雷军回应小米超强钢争议#看完雷军这次新年直播,我感觉小米这波处理挺硬刚的。对“2200MPa小字标注”这事,他没有绕圈子,直接说质疑也看不太懂,干脆请媒体、机构一起来实测、拆车,用数据和结构说话。直播里把YU7拆了四五个小时,把超强钢、A/B柱内嵌防滚架、电池防护都摊开给你看,还拿真实事故案例佐证,这种“你别信我,信实验”的态度我挺认的。当然,话说回来,小字标注这种做法在行业里是惯例,但现在用户对营销话术太敏感了,小米后面在表达上可以更直白一些。技术透明是好事,如果这次能逼着整个行业一起“敢拆、敢测、少点话术”,那这场争议反而值了。

21. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格

22. #雷军公布小米机器人最新进展##小米发布机器人基座模型#就在刚刚,我米技术对外发布开源VLA模型Xiaomi-Robotics-0,该模型有47亿参数,兼具视觉语言理解与高性能实时执行能力,刷新多项SOTA。采用MoT架构,大脑VLM理解人类指令、捕捉空间关系,小脑Action Expert生成平滑动作,训练上采用两阶段法,先跨模态预训练,再后训练,解决真机动作断层等问题。在测试中,在仿真测试和现实真机任务中表现优异,保持了VLM多模态理解能力,将模型开源,有望推动机器人在工业、服务业、家庭等场景的应用,加速具身智能落地,相信很快就会运用在更多的生态产品上。 而Xiaomi-Robotics-0机器人基座模型,Benchmark全面超越OpenVLA和Pi,跻身行业第一梯队,结合近期Mimo等成果,我米AI成长迅猛,且开源VLA与触觉模型,构建完整手脑技术栈,务实推进,为机器人商用铺路。

23. DeepSeek发布了DeepSeekMath-V2(基于 DeepSeek-V3.2-Exp-Base),DeepSeekMath-V2在IMO-ProofBench测试中取得了99.0%(基础)和61.9%(高级)的成绩,没错,这比GPT-5和Gemini都强!DeepSeek训练了一个基于LLM的验证器来获取奖励函数,使用验证器训练这个模型,并要求它自行解决问题。扩展验证器的计算能力以标记更难的证明,然后也改进验证器,弥合生成与验证差距的绝妙方法#ai生活指南##科技先锋官##ai创造营#

24. AI圈最顶级的一次争吵,理解世界还是堆模型? #大咖观察 #红衣聊AI #大模型 #人工智能

25. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型

26. 春节档最狠一刀:旗舰性能+小模型尺寸,大模型价格体系被掀翻了

27. #高德正式布局世界模型# 高德又在悄悄搞大事情了~目前所知道的是,他们正在做一个世界模型,然后打算基于这个模型推新产品。我看斯坦福大学李飞飞团队搞了一个WorldScore评测,在评测里面,高德的世界模型在好几个指标上都拿了第一。这个评测是首个能统一评估多模态世界生成模型的开源基准,我感觉是挺有分量的。再者,据说高德内部已经悄悄成立了具身业务部。大家可以去招聘网站上搜搜,能看到他们在招具身智能产品专家、数据算法工程师这些岗位。同时还有内部的人透露,他们不只是盯着虚拟世界那点事儿,机器人、机器狗这些实体产品都在探索范围内,胃口不小。这么看,未来可期,希望高德的新产品能给我们大众带来更多惊喜。#高德将发布世界模型产品#

28. #小米MiMo大模型首次推出TokenPlan#养虾圈和开发者终于等到重磅福利!小米MiMo大模型正式上线TokenPlan套餐,直接改写国产大模型计费规则。一次订阅就能解锁全模态模型,火爆全网的MiMo-V2-Pro也包含在内,计费透明清晰,彻底告别以往token莫名消耗过快、多模型单独收费的糟心问题。常年霸占OpenRouter榜单,周调用量接连突破三万亿、四万亿量级,专业开发者早已用实力投票。如今亲民定价搭配顶配性能,对标全球顶级Claude系列也毫不逊色,实打实把良心性价比拉满,妥妥是当前养虾、开发首选的刚需套餐!

29. #豆包大模型2.0发布# 刚刚看到了这个更新了,[专家模式] 开始啦! 2.0全面升级了多模态能力,在各类视觉理解任务上均达到世界顶尖水平,视觉推理、感知能力、空间推理与长上下文理解能力表现尤为突出,豆包2.0 Pro 在大多数相关基准测试中取得最高分。 提升长程任务执行能力,需要丰富的真实世界知识。通过加强长尾领域知识,豆包2.0 Pro在SuperGPQA 上分数超过 GPT 5.2,并在 HealthBench 上拿到第一名,在科学领域的整体成绩与 Gemini 3 Pro和 GPT 5.2相当。 更专业、深入的分析与创作能力,帮大家高效解决复杂问题,全面提升学习、工作与创作效卒。 #HOW I AI##过个有AI年#

30. #阿里新一代模型Qwen3.5曝光#中国大模型“疯狂2月”的重要一环阿里新一代大模型Qwen3.5曝光了,看了一下,Qwen3.5采用全新架构,支持原生视觉理解能力,可直接处理图像等多模态输入,并且在逻辑推理、数学计算及代码编写能力上具有显著突破,这波是国产大模型全球竞争力再次迎来强化呀。

31. #DeepSeek新模型能否再次爆火#V4最大的突破之一:应该是是超长的上下文理解能力想象一下这样的场景:你接手了一个遗留系统,代码几十万行,文档缺失,关系复杂传统AI模型要么"看不懂",要么"理解偏了"而V4能够一次性理解整个代码库的逻辑,给出真正有用的分析和建议,这对于企业级开发来说,才是真正的生产力提升呀!DeepSeek#AI##数码科技##DeepSeek#

32. 半夜,小米大模型团队发布小米全模态Agent基座大模型 MiMo-V2-Omni“MiMo-V2-Omni 专为现实世界中复杂的多模态交互与执行场景而生。从底层构建了融合文本、视觉、语音的全模态基座,并以统一架构将“感知”与“行动”深度绑定。这不仅打破了传统模型“重理解、轻执行”的局限,更让模型原生具备了多模态感知、工具调用、函数执行及 GUI 操作能力。”“MiMo-V2-Omni 可无缝接入各种 Agent 框架,实现了从理解到操控的跨越,大幅降低了全模态 Agent 的落地门槛。”“在正式发布之前,我们将一个早期测试版本以「Healer Alpha」为代号匿名上架 OpenRouter,没有任何宣传,纯粹让模型能力说话。结果调用量自然攀升至平台前列,并在 OpenClaw 测评榜单 PinchBench 上拿下均分第一,用户和基准双双给出了同一个答案。” “我们还与金山办公合作,将 MiMo-V2-Omni 接入 WPS Office,探索全模态智能体模型在日常生产力场景中的表现。”

33. 全球大模型第一股,为啥是家中国公司? #智谱 #智谱上市 #智谱IPO #GLM大模型 #全球大模型第一股诞生

34. 盘点一周AI大事(4月19日)|Claude终结设计 Anthropic上线Claude Design,接管整个设计流程 Anthropic上线最强编码模型Claude Opus 4.7 OpenAI内测下一代图像模型GPT-Image-2 OpenAI升级Codex,全面对标Claude Code Heygen开源视频制作技能包HyperFrames Quiver上线最强矢量图模型Arrow 1.1 Adobe发布重新打光图像模型TokenLight 字节开源数字人模型OmniShow 阿里开源开放世界模型Happy Oyster 研究员开源最强3D动画模型AniGen Gemini上线最强语音合成模型Gemini 3.1 Flash TTS Meta研发出神经计算机Neural Computers #前沿科技趋势发布月 #AI新星计划 #AI #AIGC #大模型

35. Seedance 2.0:说中国话的最强AI视频模型!

36. 模型一换 帧率减半!2026年零售机性能大横评【新评科技】

37. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何

38. 盘点一周AI大事(4月5日)|叫AI老公多干活 OpenAI内测下一代生图模型「GPT-Image-2」 OpenAI工匠计划「Project Stagecraft」曝光 Google发布最强开源小模型「Gemma 4」 Anthropic研究发现Claude有170种情绪向量 阿里发布最强开源多模态大模型「Qwen3.5-Omni」 Sakana AI 发布AI战略官「Marlin」 微软发布最强语音识别模型「MAI-Transcribe-1」 研究员开源最强声音克隆模型「LongCat-AudioDiT」 研究员开源最强语音合成模型「OmniVoice」 工程师开源AI同事「同事.skill」爆火 首个一人独角兽公司「Medvi」诞生 #前沿科技趋势发布月 #AI新星计划 #AI #OpenAI #AIGC

39. #小米首次登顶全球开源大模型第一#继发布Xiaomi MiMo-V2-Pro之后短短一个月,小米又开启Xiaomi MiMo-V2.5系列模型公测,各方面能力又提升了一个档次,你只需知道是全球顶尖就行。Xiaomi MiMo-V2.5-Pro综合智能指数已经位列全球开源大模型并列第一,同时Agent指数也是全球开源大模型并列第一。与小米之前的V2-Pro相比,仅MiMo-V2.5的Agent 能力就全面超越 V2-Pro,更强的MiMo-V2.5-Pro 专为长难Agent任务打造。只能说小米这迭代速度太强了。而且还有一个惊喜,Token Plan取消了四倍消耗Credits,MiMo-V2.5是1x消耗,MiMo-V2.5-Pro是2x消耗,也就是降价了,还有夜间专属优惠速率,利好夜猫子。

40. 阿里推出千问AI助手,集成最新Qwen大模型,支持多端使用,终于踏上了自己的“Ch(ina)at GPT”之旅;阿里在开源模型领域已经是世界T1的存在了,这次推出的千问则具备深度研究、多语言翻译等功能,与ChatGPT、豆包对比表现全面,这也标志着标志国产AI正在从“能用”到“好用”,然后开始“引领”。[不愧是你] #Qwen##千问##千问AI# http://t.cn/AX2rDgci

41. 千问 vs ChatGPT:4大功能实测!到是更好用的AI助手!Qwen3能否战胜GPT-5.1?

42. 把手教你用上开源版Claude Code,Windows系统接入保姆级教程!

43. #DeepSeekV4和GPT6谁更值得期待# 全球最受关注的OpenAI和DeepSeek都将在这个月发布新的大模型版本。两家头部AI企业的最新版本GPT-6与DeepSeek V4代表了当前大模型发展的两大技术路径,各自展现出鲜明的优势。GPT-6的核心优势在于其强大的通用推理能力和成熟的生态系统。作为OpenAI的旗舰产品,GPT-6在数学与复杂科学推理方面表现突出,延续了GPT系列在这一领域的领先地位。其200万Token的超长上下文窗口,使其在处理超长文档和复杂多轮对话时具备显著优势。同时,GPT-6拥有成熟的插件生态、API集成和企业级服务支持,多模态能力(文本、图像、音频)也更为完善,适合需要全方位解决方案的企业用户。DeepSeek V4则在工程化应用和成本控制方面表现卓越。该模型完全基于国产算力集群训练,实现了从硬件到软件的全链路自主可控,这在当前国际形势下具有战略意义。在技术层面,V4的编程能力达到全球领先水平,HumanEval得分超过87.6%,特别适合代码生成、调试和整库分析等工程任务。其100万Token的上下文窗口配合Engram长期记忆机制,能有效处理法律合同、代码库等长文本场景。最突出的优势在于其极低的成本,API价格仅为GPT系列的1/10-1/50,同时开源可商用的特性使其在私有化部署方面更具灵活性。总体而言,GPT-6适合对通用推理能力和生态系统有较高要求的用户,而DeepSeek V4则在编程能力、成本控制和国产化部署方面展现出独特优势。

44. #DeepSeekV4发布# DeepSeek V4预览版终于来了!这次更新主要有三大亮点:产品分层:网页端上线了“快速模式”和“专家模式”。日常聊天用快速版,写代码、搞科研等复杂任务就切到专家版,虽然可能要排队,但逻辑和精度强很多。超长上下文:支持100万Token上下文,相当于能一次性吃透75万字的内容,处理整本小说或大型代码库毫无压力。原生多模态:虽然“视觉模式”还在灰度测试,但V4已经具备了原生看图、理解视频的能力,不再只是简单的“看图识字”,跨模态理解能力有了质的飞跃。今年大模型的进步绝对是突飞猛进,AI能力会呈现指数级提升。

45. OpenAI GPT 5.5 前脚刚发布,DeepSeek就亮出了“真家伙”。就在刚刚,DeepSeek-V4的预览版本正式上线并同步开源。据官方介绍,DeepSeek-V4拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先

46. 【#小米深夜官宣4款新模型#】#雷军主讲小米汽车北京车展发布会##小米迄今最强大模型开启公测#刚刚,小米MiMo大模型一口气官宣4款新模型:旗舰推理模型MiMo-V2.5、全模态Agent模型V2.5-Pro开启公测、即将开源;V2.5-TTS Series、V2.5-ASR即将推出。小米MiMo大模型负责人正是原DeepSeek核心成员、被业内称为“天才少女”的罗福莉,这距离上次MiMo-V2系列重磅三连更仅36天。上一代模型发布时,罗福莉曾发文称“未来模型足够稳定后,他们将开源”。与上一代模型类似,MiMo-V2.5全系列同样是为智能体场景打造,MiMo-V2.5-Pro专为长难Agent任务打造,MiMo-V2.5可覆盖绝大多数通用Agent场景。小米还贴心为用户提供了官方使用指南:MiMo-V2.5支持原生全模态Agent能力,涵盖图像、音频与视频,相比Pro版模型平均推理速度更快,更适应对时延敏感的任务。除性能外,此次小米MiMo新模型还有一大升级点是更高的Token效率。根据官方信息,在拿到智能体基准榜单ClawEval相同分数的情况下:MiMo-V2.5-Pro相比Kimi本周发布的开源旗舰多模态智能体模型Kimi K2.6节省了42% Token;MiMo-V2.5相比Meta本月初发布的闭源多模态推理模型Muse Spark节省了50% Token。此外,小米还全面升级了模型订阅计划Token Plan:取消4倍的Credits计费方式、计费不区分256k和1M上下文、夜间享有专属优惠速率、新增自动续费模式。值得一提的是,其Token Plan计划刚发布时,就有不少用户吐槽价格太贵,便宜的套餐Token不够用。有意思的是,今年3月,小米MiMo-V2-Pro曾以匿名模型Hunter Alpha的身份现身OpenRouter平台,一度被开发者误认为是即将发布的DeepSeek V4。如今小米新一代MiMo-V2.5推出,又正值DeepSeek V4被传出将于本周发布。(智东西)

47. 【直播回放】解析谷歌Gemini 3:“AI 全模态”时代与Scaling Law的极致执行

48. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型

49. 阿里系连发两个重磅AI产品,暗藏了一个巨大的机会#灵光 #蚂蚁灵光 #阿里巴巴 #全模态通用AI助手 #AI工具

50. 这次是真6!荣耀Magic V6全能大折体验分享

51. 中国大模型偷了老美的家,原因竟然是电多? #燃起来了大国重器 #春节世界观察 #新年囤点专业货

52. 小米开始秀技术了小米开源首代机器人 VLA 大模型,刷新多项 SOTA!Xiaomi-Robotics-0,拥有 47 亿参数、兼具视觉语言理解与高性能实时执行能力的开源 VLA 模型。它不仅在三大主流的仿真测试中获得优异成绩,更在现实真机任务中实现了物理智能的泛化——动作连贯、反应灵敏,且能在消费级显卡上实现实时推理。仿真标杆: 在 LIBERO、CALVIN 和 SimplerEnv 测试中,模型在所有的 Benchmark、30种模型对比中,均取得了当前最优的结果。真实挑战: 我们在双臂机器人平台上部署了模型并与行业标杆进行了横向对比。在积木拆解和叠毛巾这种长周期、高度挑战的任务中,机器人展现出了极高的手眼协调性。无论是刚性的积木还是柔性的织物,都能处理得游刃有余。多模态能力:模型保留了 VLM 本身的多模态理解能力,尤其是在具身更相关的 benchmark 中表现优异,这是之前的 VLA 模型所不具备的。#汽场全开##小米# 小马甲不小的微博视频

53. DeepSeek V4 + Open WebUI + Hermes = 我帮你搭的私人AI员工!

54. #Seedance2.0是世界最强视频模型吗##过个有AI年##HOW I AI# 结合现有信息,Seedance 2.0在“多模态整合与控制”、“生产效率”方面处于世界顶尖水平,被多位权威人士(比如《黑神话:悟空》制作人冯骥)评价为“最强”,但在某些单项上,仍有其他模型表现相当或更优。Seedance 2.0的优势是多模态控制、导演级精度、音画同步、多镜头叙事,但时长最长15秒,部分场景物理模拟略逊于Sora 2。OpenAI Sora 2的优势是复杂物理模拟、超现实主义、更长时长(20秒)、全面的音频生成,但在多模态输入灵活性和对中文场景理解上可能不如Seedance 2.0。Vidu Q3的优势是单视频时长更长(16秒)、音画同步质量高、分镜控制能力强,但多模态输入支持的丰富性和灵活性未及Seedance 2.0突出。Kling的优势是长视频生成(最长可达数分钟)、物理仿真能力突出(如流体、烟雾),但在多模态控制和多镜头叙事等导演级功能上不及Seedance 2.0。Veo 3.1的优势是照片级真实感、光照渲染出色、生成速度快,缺点是视频时长较短(8秒),缺乏原生多镜头叙事能力。综合来看,如果你需要极其精细的控制、希望高效地“复刻”特定风格或动作,并追求从文字到成片的“一站式”高质量输出,那么Seedance 2.0无疑是目前最强大的选择之一。 但如果你追求极致的物理真实感、更长的单视频时长,或者主要在特定领域(如长视频、动画风格)使用,Sora 2、Vidu Q3和Kling也是顶级选项。#老张聊科技#

55. DeepSeek V4 网页端《原神×我的世界》融合小游戏代码测试:拳打 ChatGPT,脚踢 Gemini,硬刚 Claude

56. DeepSeek-V4和GPT-5.5第一波实测对决,结果出人意料!

57. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】

58. 【硬核教程】教你搭建Mac AI集群!4台M3 Ultra,运行万亿参数大模型!

59. MiniMax是家什么样的公司 #人均95后的大模型公司上了新闻联播 #minimax #人均95后公司MiniMax登上央视

60. 昨天晚上小米MiMo-V2-Flash发布了,小米大模型以MiMo系列7B参数模型为核心代表,在2025年的权威测评中,已跻身开源小参数模型第一梯队,数学/代码/多模态能力突出,端侧部署与推理效率优势明显,整体处于国内第一梯队、全球小参数模型领先水平。试了一下,响应速度非常之快。 #小米新模型媲美DeepSeekV3.2# #小米发布最新MiMo大模型#

61. #DeepSeek开源OCR2新模型#DeepSeek-OCR2这个新模型最近很亮眼,它用了个巧妙的思路:把传统视觉编码换成类似大语言模型的结构,让AI可以像读文字一样“理解”图片里的信息。那这样一来,处理文档、表格的准确率明显提升,识别重复内容更少,对扫描文件和网页的适配也更好了。这背后其实反映出一个趋势:AI和视觉处理技术正在深度融合。未来在手机、工业检测、文档数字化这些领域,能做好“视觉+AI”落地的公司,机会可能会越来越多。

62. #豆包大模型2.0发布##HOW I AI##过个有AI年#字节跳动春节AI攻势又起。今天,字节跳动正式发布豆包大模型2.0系列,在多方面取得突破,全面挑战国际顶尖水平。豆包大模型2.0定位为旗舰级通用模型,专注复杂推理与长任务链执行,比如科研分析、跨模态创作。豆包大模型2.0分为Lite、Mini、code、Pro四个版本。其中Pro版本全面对标OpenAI的GPT5.2,数学竞赛成绩达到人类金牌水平。另外,多模态理解达SOTA水平,视觉推理与编程能力超越Gemini 3 Pro,HLE-text测试全球最高分54.2。另外三个版本也各有特色。Lite版均衡性能与成本,企业级任务处理效率提升,成本低于前代1.8。Mini版低延迟响应,支持256K上下文,适配轻量级应用(如移动端)。Code版深度优化编程场景,无缝接入TRAE等开发工具。#老张聊科技#

63. GPT-5.4:OpenAI做了个Kimi K2.5 +MiniMax M2.5?

64. 盘点一周AI大事(4月26日)|OpenAI王炸两连 OpenAI上线下一代大模型「GPT-5.5」 OpenAI全量上线下一代图像模型「GPT-Image-2」 Kimi发布最强开源大模型「Kimi K2.6」 DeepSeek发布了「DeepSeek V4」 Office三件套(Word PPT Excel)全量上线Copilot智能体 Google发布最强深度研究「Deep Research Max」 研究员开源AI研究员「ASI-Evolve」 Google发布最强图像分割模型「Google Vision Banana」 LTX开源视频转HDR「LTX HDR LoRA」 ODYSSEY发布最强世界模型「Odyssey-2 Max」 字节开源最强3D模型「Seed3D 2.0」 工程师研发出最强乒乓球机器人 #前沿科技趋势发布月 #AI新星计划 #AIGC #AI #OpenAI

65. 梦想照进现实!AI大模型全屋智能居然成了?!

66. #DeepSeek是国产识图最强AI吗# 鑫人觉得谈不上最强,DeepSeek识图开放确实搅动了国产多模态格局。目前国产第一梯队是通义千问Qwen2‑VL、智谱GLM‑4V、DeepSeek V4,各有长板。通义视觉精度强、开源生态全;智谱中文复杂理解深;DeepSeek胜在图文联动推理强,能看图做逻辑推导,不只是描述画面。DeepSeek识图能搞定日常物体、图表、错题解析,但手写体、极端密集场景仍有误差。国产整体水平:中文场景不输国际顶尖,本地化理解招牌、菜单、国潮设计甚至更优;短板在幻觉控制、超高精度识别、复杂3D空间推理。DeepSeek入场后,国产多模态从“拼识别”转向“拼理解+推理”,竞争更激烈,对普通用户来说,实用选择更多了。#人工智能##ai#

67. #海外开发者惊讶小米MiMo新模型表现# 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看!

68. OpenAI 重磅发布 GPT-5.2!效果惊人实测 ,附最新免费使用方法,切勿错过! | 零度解说

69. 盘点一周AI大事(2月15日)|王炸视频模型 字节正式上线最强视频模型「Seedance 2.0」 字节发布最强开源视频模型「Alive」 工程师davidohyun开源龙虾女友「Clawra」爆火 Google升级最强推理模型「Gemini 3 Deep Think」 智谱发布最强开源大模型「GLM-5」 MiniMax发布最强开源编码模型「M2.5」 Google官宣AI互联网协议「WebMCP」 Claude上线Windows版「Cowork」 Google Stitch炸裂升级 千问发布最强开源图像模型「Qwen-Image-2.0」 研究员开源最强语音合成模型「MOSS-TTS」 研究员推出最强开源音乐模型「SoulX-Singer」 研究员开源最强配音模型「Just-Dub-It」 #AI新星计划 #抖音年味新知贺岁 #前沿科技趋势发布月 #AIGC #人工智能

70. #高德正式布局世界模型##高德将发布世界模型产品#已经取得超前成绩,并且还在招才纳士,这个世界模型来势凶猛。WorldScore是由著名华裔人工智能科学家、斯坦福大学教授李飞飞团队提出,是首个支持多模态世界生成模型统一评估的开源基准测试。而看到高德的模型已在空间智能评测基准WorldScore中,并已取得多项指标第一的成绩。这个成绩估计又将引起科技界的大回响,同时在招聘平台上也看到了相关岗位招聘中,包括具身智能产品专家、数据/算法工程师等方向。全面AI化,全方位转向空间智能,这是在全力打造AI智能圈,2026年也有更精彩的呈现。

71. DeepSeek发布多模态论文又连夜删除

72. #微博声浪计划##听见微博# DeepSeek新模型曝光,其新一代旗舰模型V4核心架构MODEL1因GitHub代码更新意外公开。该架构在KV缓存、FP8量化等方面革新,支持百万Token上下文,推理成本仅为GPT-4 Turbo的1/70,预计2026年春节发布,或推动国产大模型效率革命。 铭科技的微博音频

73. Agent时代,为什么多模态数据湖是必选项?

74. #DeepSeekV4 尺度#V4是DeepSeek首个在训练和推理层面与国产芯片(华为昇腾)完成深度适配的旗舰模型。最大的亮点在于,它通过一系列架构创新,率先实现了百万级超长上下文的真正普惠。等下半年华为昇腾950等国产超节点批量上市后,Pro版的高昂算力成本将被大幅摊薄,价格有望进一步大幅下调。比较权威的评测,在第三方Vibe Code Benchmark中,V4以压倒性优势拿下开源权重模型第一;在Arena.ai代码竞技场中位列开源模型第3,性能较前代V3.2跃升约10倍。目前综合性能跻身全球第一梯队,V4在多领域的性能达到了世界前沿水平,与顶级闭源模型的差距缩短至3-6个月。

75. #微博AI创作季##DeepSeekV4和GPT5.5谁更强#追求硬核性能、专业办公、深度推理选 DeepSeek V4;偏向创意写作、全能日常、多元趣味使用,选 GPT5.5。没有绝对强弱,只有场景不同!#AI创造营##一分钟精选视频扶持计划# 种斌Marco的微博视频

76. 美团LongCat-Image:6B参数的图像生成新标杆美团LongCat团队开源的LongCat-Image图像生成模型,以6B(60亿)的紧凑参数规模,在文生图与图像编辑领域实现了性能突破,为中文场景AI创作带来新选择。#科技先锋官##AI生活指南##AI创造营# 种斌Marco的微博视频

77. 再见,白月光 GPT-4o

78. 元戎不止智驾,全面探索物理AI全新赛道。北京车展重磅消息,元戎不但迎来前DeepSeek多模态技术核心大牛阮翀,展示基座模型在智能驾驶领域的最新成果。元戎还跳出单一智驾赛道,在后大模型时代全面布局以基座大模型为内核、多模态感知、舱驾一体驱动等物理AI场景,探索未来出行智能。4月25日北京车展,来一起见证元戎交出的答卷。

79. 今天DeepSeek V4预览版正式上线并开源,带来了百万上下文标配和全面提升的Agent能力;OpenAI也在同期推出GPT-5.5,主打更快、更省Token。那#DeepSeekV4和GPT5.5谁更强# ?我是觉得没有绝对的强者,只有更合适的选择。

80. 多模态预训练,才是大模型的下一条路?Yann LeCun、谢赛宁参与

81. #国产AI超过ChatGPT了吗# 今天国内又有一款基于国产大模型的AI助手APP开始公测,并喊出对标ChatGPT。和国外相比,国内AI应用有更肥沃的落地土壤,比如中文场景、产业落地、数据合规等方面,但这些都是局部的领先,AI未来的发展一定是更加专业化、更加垂直。客观讲,ChatGPT在多模态融合(图像/语音处理)、多语言支持以及创意内容生成方面还是有着自己的优势。#科技先锋官#

82. DeepSeek V4 vs. GPT-4 系列

83. GLM-5V-Turbo来了

84. 阿里放大招!千问 3.6-Plus 发布,多模态大模型变天了

85. GLM4.6V掀起中国AI多模态新浪潮

86. 国产AI炸场!GLM4.6V免费商用,设计图秒转代码,GPT-5.2遇劲敌

87. (Day2)2026年国内外大模型厂商全景对比

88. 科大讯飞星火V4.0超越GPT-4!国产大模型逆袭

89. GPT-6来了,国产大模型又被甩开了吗?

90. 别迷信GPT了,国产AI已经摸到了脚后跟

91. 最近中国大模型在海外火出圈了!像 OpenRouter 这类平台数据显示,2025 到 2026 年,月之暗面、MiniMax、智谱 GLM 这些国产模型,调用量一路猛涨,全球排名都很靠前。

92. 国内大模型 vs GPT 等国外大模型

93. 4月发布12款国产大模型!AI"国潮"来了,谁在领跑?

94. 国产大模型和 GPT / Claude 的差距,现在到底还有多大?

95. 手机能跑大模型了!4B参数比GPT-4V还强,中国团队开源炸场

96. 国产AI模型2026横评

97. 中文视觉大模型洗牌:豆包斩获总榜第一 国内模型全面反超海外

98. 国产医疗大模型登顶权威榜单,核心秘籍

99. 国产训练芯片支持的大模型,性能能达到国际水平吗?

100. DeepSeek V4 震撼发布!1.6T 参数 + 1M 上下文,国产大模型彻底超越 GPT

101. 阿里放大招!千问3.6-Plus能否超越GPT-4V?

102. 中国信息通信研究院发布“方升-多模态”大模型基准测试结果(2025年Q4)

103. GPT-4 开启多模态时代!DMXAPI 免费大模型 API,国产顶配零成本畅用

104. 炸裂!豆包视觉大模型90.66分登顶SuperCLUE-VLM总榜

105. 最强多模态大模型在真实网页搜索中被人类碾压?GPT-5.2 仅获 36% 胜率,北大、华为等联合开源全新深度搜索基准BrowseComp-V3

106. GLM-4.6V大模型深度评测:国产多模态AI新突破,工具使用与实际应用场景全解析!

107. 刚刚,DeepSeek全新多模态技术开源!

108. 视觉原语革命!DeepSeek开源多模态模型,这些公司迎来红利

109. 亮剑在即!小米MiMo-V2.5公测突袭,硬刚GPT-5.4改写国产大模型格局

110. Deepseek v4的多模态的模型

111. 智谱GLM-5V-Turbo发布:国产多模态编程模型能不能打?

112. GPT-6来了,但国产大模型这次真的站起来了

113. 全球首款开源全双工多模态模型来了!国产MiniCPM-o 4.5实测:手机就能跑,性能超越GPT-4o

114. DeepSeek V4来袭:国产大模型的"多模态答卷"

115. DeepSeek V4 重磅发布:国产大模型首次正面硬刚 GPT-5.4,性价比之王再进化

116. 实测对决:Qwen3.5 27B vs Gemma4,开源多模态王者终局已定?

117. 性能反超GPT-5.2 商汤开源多模态模型 重构AI解题逻辑

118. MiniCPM-o - 端侧多模态大模型的突破

119. 重构AI编程体验:GLM-5V-Turbo多模态模型全景评测与指南

120. GPT-4跌下神坛?中国这4个大模型,老外也在偷着用

121. 国产开源模型卷赢Gemini 3 Pro、GPT-5.2,最强多模态推理大模型易主?

122. AAAI 2026 | 跨视频推理基准 CrossVid:给多模态大模型出一道“综合题”

123. 300个AI同时开工!国产大模型开源逆袭,GPT-5的劲敌来了

124. 美团发布原生多模态模型LongCat-Next并全面开源

125. 阿里千问3.6-Max实测:长文本+多模态双升级,国产AI又进化了

126. 多模态大语言模型(MM-LLM)- 模态不是“内容”,而是“表达形式”

127. ICCV 2025 | 顶会成果!R1-Onevision:弥合视觉感知与深度推理鸿沟,多任务泛化能力拉满

128. 多模态AI原生架构重构:从Pipeline到Unified的技术演进

129. GPT-4o之后:2026-2028年AI多模态技术的5个确定性趋势

130. 国产大模型“星火4.0”正式商用,多模态能力大幅提升

131. GPT-5.5免费后,国产大模型怎么选

132. 今日开源(2026-4-28):小米MiMo-V2.5家族开源,1M上下文窗口覆盖多模态感知与智能体工作流,MIT协议释放全模态能力

133. 国产大模型编程能力超越GPT?Qwen3.6-Plus深度评测

134. 跑不动30B大模型?Gemma 4 端侧部署指南,4G显存也能本地玩多模态

135. AI办公工具横评:GPT-5.4 vs Gemini vs 国产大模型,谁更懂打工人?

136. 多模态与视觉大模型开发实战 - 2026必会

137. 国产AI血洗海外榜单

138. 2月多模态视觉测评榜单出炉:Gemini-3.1领跑,字节、千问、Kimi 强势突围!

139. 多模态AI模型最新发展趋势

140. AdaptMMBench:多模态大模型自适应推理新基准,首个解耦评测「推理模式选择」与「推理过程质量」

141. OneThinker:统一多模态通用推理大模型

142. 国产多模态AI再开源!实测截图转网页、搜图购物,价格减半

143. Uni-SafeBench:统一多模态大模型安全基准

144. AI多模态升级:月活超过3亿的阿里千问如何拓展用户场景?

145. 多模态大语言模型指令遵循评估新基准

146. 紫东太初发布通用多模态具身灵巧操作大模型

147. 首个面向多模态深度研究智能体(DRAs)的端到端基准

148. AI大模型 — 多模态大模型介绍

149. 📢 论文分享|AdaptMMBench:多模态大模型自

150. 中国AI大模型全景盘点:多模态与行业专用模型

151. 中国信通院发布“方升-多模态”大模型基准测试结果(2025 Q4)

152. MME-Survey深度精读:南京大学、中科院联合出品,多模态大模型评测的“百科全书”

153. NUS&微软:首个Any-to-Any多模态Benchmark

154. 多模态模型之——文搜图和图搜图

155. 季度模型对决:GPT-4.5、Claude 3.5与国产大模型的多模态实测

156. 给多模态搜索AI找BUG!首个覆盖文本\u002F图像\u002F视频\u002F音频全模态的噪声网页检索推理基准来了 【大模型应用】【多模态检索】

157. AI模型太多不会选?7大国产模型实测对比,选对省下几千元

158. 【AI论文解读】SOTA模型准确率不到50%!全新挑战性视频理解基准PerceptionComp | 暴露多模态大模型推理瓶颈

159. 首个统一多模态模型评测工具箱来了!解决现有评测痛点,揭示训练 trade-off 【多模态大模型】

160. 多模态大模型与世界模型

161. 实测对比:DeepSeek多模态 vs GPT-5.4,差距到底多大?

162. 阿里开源Qwen3.6-35B-A3B模型:主打高效轻量,支持多模态思考

163. 狂揽顶会!多模态技术重塑AI产业格局

164. 论文推荐 |(东北大学于亚新团队)基于大语言模型的双视角多级跨模态推荐

165. 小红书:多模态跨视频推理基准CrossVid

166. 边缘设备也能跑多模态Agent:Qwen3.5小模型的选型、部署与落地指南

167. 多模态数据如何赋能智能意图推理?我院肖帅勇副教授在MIS Quarterly与INFORMS Journal on Computing发表研究成果

168. 80个国产大模型混战,2026年普通人该怎么选?

169. 京东开源多模态基础模型JoyAI-Image-Edit

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章