Gemini-3-pro登顶多模态榜单,Kling-Omni发布|多模态大模型本周大事

源自29位全网作者

01-09 17:26

内容由AI生成

精选参考来源

1. NeurIPS 2025|多模态大模型在第一视角下的动态时空物体认知能力如何?

2. DualityForge反常识视频合成提升多模态理解

3. Kimi最新多模态模型K2-VL提前现身

4. 华为开源7B多模态模型,视觉定位和OCR能力出色,昇腾端侧新甜点

5. Gemini-3-pro霸榜多模态测评:谷歌重回AI赛道头部

6. 革命性解码:视觉-语言模型幻觉终结者

7. Gemini 3 Flash 倒反天罡了:关键性能居然超过了 Pro!

8. 盘点一周AI大事(1月4日)|Google包揽年度最佳模型 LMArena大模型盲选排行榜公布年度冠军 Google推出AI辅助学习系统Learn Your Way 阿里开源最强手机智能体MAI-UI DeepSeek发布新研究mHC IQuest发布最强开源编码模型IQuest-Coder-V1 字节发布动态概念大模型DLCM 腾讯发布最强开源翻译模型HY-MT1.5 阿里更新最强开源图像模型Qwen-Image-2512 Meta开源极速视频生成模型HiStream 研究员开源对象植入模型InsertAnywhere 研究员开源MV智能体AutoMV 腾讯开源3D动作生成模型Hunyuan Motion 1.0 研究员开源高保真3D模型UltraShape 研究员开源世界模型Yume 1.5 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #AIGC

9. 浪潮 YuanLab.ai 正式开源发布多模态基础大模型 Yuan3.0Flash,实现了 "大模型性能 + 轻量级推理" 的平衡

10. 原生多模态新突破:390M 数据超越InternVL3

11. VisRAG 2.0基于观察-取证-推理-作答的RAG框架

12. ICCV 2025 原生多模态模型的缩放定律

13. 掀翻AI视频创作天花板!快手Kling-Omni:一个模型,搞定所有任务

14. 3小时搭建RAG语音Agent:NVIDIA揭秘生产级方案四大核心

15. 全球最大具身智能数据集开源了!包含10000小时数据!100万+任务!存储总量达95TB!

16. ViLoMem:让多模态智能体“记住该看哪、该怎么想”

17. OmniCorpus:100亿级图文数据集碾压主流方案,多模态模型训练迎来“数据革命”

18. MegaRAG:打破 GraphRAG 的文本次元壁,基于多模态知识图谱的 RAG 新范式

19. 北京交通大学与字节跳动人工智能实验室联合研发并正式开源多模态生成大模型 ThinkGen,在图文生成、视觉问答生成多项核心任务中斩获 SOTA

20. 英伟达贡献史上最大规模开源数据集,并推四大开源AI模型

21. 开源模型的“逆袭时刻”:Molmo 2与多模态 AI 的效率提升

22. Google在CES 2026展示基于Gemini的智能新功能,提升Google TV体验

23. ShapeLLM-Omni:一个用于3D生成与理解的原生多模态大语言模型

24. 2026最新推荐,AI大模型API中转站 | GPT/Claude/Gemini/nanobanana 全系API接口服务,国内直连,7*24h技术支持

25. 多模态大模型赋能!苏州银行贷前审核实现“录入即审核”

26. 别让一个开源模型,毁掉你的AI产品!

27. TPAMI 2025|视频生成能成为世界模型吗?三个被长期忽视的评测门槛

28. 2026年最新国内AI大模型api聚合中转平台榜单新鲜出炉 - 哔哩哔哩

29. 【推荐】中国大模型落地应用研究报告2025|附下载

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章