国产大模型长文本实测:宣称百万上下文,真能记住关键信息吗?

源自175位全网作者

04-08 14:20

精选参考来源

1
#DeepSeekV4和GPT6谁更值得期待# 全球最受关注的OpenAI和DeepSeek都将在这个月发布新的大模型版本。两家头部AI企业的最新版本GPT-6与DeepSeek V4代表了当前大模型发展的两大技术路径,各自展现出鲜明的优势。GPT-6的核心优势在于其强大的通用推理能力和成熟的生态系统。作为OpenAI的旗舰产品,GPT-6在数学与复杂科学推理方面表现突出,延续了GPT系列在这一领域的领先地位。其200万Token的超长上下文窗口,使其在处理超长文档和复杂多轮对话时具备显著优势。同时,GPT-6拥有成熟的插件生态、API集成和企业级服务支持,多模态能力(文本、图像、音频)也更为完善,适合需要全方位解决方案的企业用户。DeepSeek V4则在工程化应用和成本控制方面表现卓越。该模型完全基于国产算力集群训练,实现了从硬件到软件的全链路自主可控,这在当前国际形势下具有战略意义。在技术层面,V4的编程能力达到全球领先水平,HumanEval得分超过87.6%,特别适合代码生成、调试和整库分析等工程任务。其100万Token的上下文窗口配合Engram长期记忆机制,能有效处理法律合同、代码库等长文本场景。最突出的优势在于其极低的成本,API价格仅为GPT系列的1/10-1/50,同时开源可商用的特性使其在私有化部署方面更具灵活性。总体而言,GPT-6适合对通用推理能力和生态系统有较高要求的用户,而DeepSeek V4则在编程能力、成本控制和国产化部署方面展现出独特优势。
2
重磅:小米发布并开源最新MiMo-V2-Flash大模型,总参数量3090亿,活跃参数量150亿,基准测试性能媲美DeepSeek-V3.2,延迟仅为几分之一!生成速度达150 tokens/秒(基于首日版本)。刚试了下生成速度超快,等明天罗福莉详细揭秘
全部
来源
内容由AI生成

精选参考来源

1. #DeepSeekV4和GPT6谁更值得期待# 全球最受关注的OpenAI和DeepSeek都将在这个月发布新的大模型版本。两家头部AI企业的最新版本GPT-6与DeepSeek V4代表了当前大模型发展的两大技术路径,各自展现出鲜明的优势。GPT-6的核心优势在于其强大的通用推理能力和成熟的生态系统。作为OpenAI的旗舰产品,GPT-6在数学与复杂科学推理方面表现突出,延续了GPT系列在这一领域的领先地位。其200万Token的超长上下文窗口,使其在处理超长文档和复杂多轮对话时具备显著优势。同时,GPT-6拥有成熟的插件生态、API集成和企业级服务支持,多模态能力(文本、图像、音频)也更为完善,适合需要全方位解决方案的企业用户。DeepSeek V4则在工程化应用和成本控制方面表现卓越。该模型完全基于国产算力集群训练,实现了从硬件到软件的全链路自主可控,这在当前国际形势下具有战略意义。在技术层面,V4的编程能力达到全球领先水平,HumanEval得分超过87.6%,特别适合代码生成、调试和整库分析等工程任务。其100万Token的上下文窗口配合Engram长期记忆机制,能有效处理法律合同、代码库等长文本场景。最突出的优势在于其极低的成本,API价格仅为GPT系列的1/10-1/50,同时开源可商用的特性使其在私有化部署方面更具灵活性。总体而言,GPT-6适合对通用推理能力和生态系统有较高要求的用户,而DeepSeek V4则在编程能力、成本控制和国产化部署方面展现出独特优势。

2. 重磅:小米发布并开源最新MiMo-V2-Flash大模型,总参数量3090亿,活跃参数量150亿,基准测试性能媲美DeepSeek-V3.2,延迟仅为几分之一!生成速度达150 tokens/秒(基于首日版本)。刚试了下生成速度超快,等明天罗福莉详细揭秘

3. 阿里正式发布新一代基模千问3.5

4. #DeepSeekV4要来了吗#DeepSeek V4开启灰度测试,百万Token超长上下文与2025年5月的知识截止日期,让这款国产大模型成为春节档AI圈焦点。从技术来看,V4摒弃参数内卷,依托创新架构实现算力效率跃升,推理成本大幅降低,还深度适配国产芯片,让超长文本处理、代码跨文件分析成为现实,精准契合2026年大模型向高效实用演进的行业趋势。此前DeepSeek凭技术优势收获颇高热度,此次V4的升级,不仅补上了长上下文能力的短板,更让国产大模型在全球竞争中再添筹码。随着灰度测试推进,全量更新或很快落地,其兼具技术突破与国产化适配的双重优势,不仅能复现过往热度,更有望在AI普惠落地中,为国产大模型开辟新的增长空间。#DeepSeekv4要来了吗##HOW I AI##过个有AI年# deepseekv4要来了吗 川北小哥的微博视频

5. 创新Transformer!面壁基于稀疏-线性混合架构SALA训练9B模型,端侧跑通百万上下文

6. DeepSeek团队发布视觉压缩OCR模型,哪些信息和技术亮点值得关注?

7. 开源最强,逼平闭源顶流!DeepSeek发布V3.2系列模型,推理能力追平GPT-5

8. 登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升

9. AI春节档最强杀手锏来了!千问3.5除夕强势亮相,开源SOTA、性价比之王

10. #用声音马住中国年##微博声浪计划# DeepSeek或在春节再扔王炸,测试支持百万Token上下文的V4模型,采用条件记忆机制降低推理成本,编程能力目标突破90%准确率。但发布时间未定,还需应对巨头竞争,若落地将重构AI格局。 闫跃龙的微博音频

11. Manus 的上下文工程

12. #Kimi建议网友先用DeepSeek# Kimi是月之暗面研发的主流大语言模型,自开源Kimi K2.5后,便在OpenRouter聚合平台总榜及多个分榜长期位居第一,用户使用量激增,甚至因算力紧张,平台建议用户暂时使用其他模型,这一“卑微送客”的场景虽显意外,却直观体现出其极高的市场认可度。Kimi的核心优势突出,主打超长上下文理解与处理能力,能高效承载长文本、复杂文档等任务,在信息整合、逻辑推理与实用场景适配中表现亮眼;同时模型开源降低了使用与接入门槛,吸引大量用户与开发者,综合性能与易用性兼具。此次算力不足并非技术短板,而是用户规模快速扩张带来的运营压力,也侧面印证了Kimi在实用体验、功能落地等方面的竞争力,成为当前国产大模型中极具代表性的产品。#Kimi好卑微#中国网看点的微博视频

13. 2025年年度中文大模型基准测评报告发布!

14. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】

15. 盘点一周AI大事(2月1日)|AI乌托邦魔幻开局 Google上线世界模型Project Genie 阿里开源实时世界模型LingBot-World AI乌托邦社区Moltbook爆火 Chrome升级为AI浏览器 月之暗面发布最强开源大模型Kimi K2.5 Gemini 3 Flash升级视觉能力 腾讯发布最强开源图像模型HunyuanImage 3.0-Instruct 阿里开源Z image Base满血版 OpenMOSS发布最强开源视频模型MOVA MIniMax上线顶级音乐模型MiniMax Music 2.5 英伟达开源天气预测模型Earth-2 #AI新星计划 #前沿科技趋势发布月 #抖音知识年终大赏 #AI #AIGC

16. #DeepSeek新模型能否再次爆火#V4最大的突破之一:应该是是超长的上下文理解能力想象一下这样的场景:你接手了一个遗留系统,代码几十万行,文档缺失,关系复杂传统AI模型要么"看不懂",要么"理解偏了"而V4能够一次性理解整个代码库的逻辑,给出真正有用的分析和建议,这对于企业级开发来说,才是真正的生产力提升呀!DeepSeek#AI##数码科技##DeepSeek#

17. #2月DeepSeek还会发新模型吗#AI圈2月模型的发布和迭代处于一个高峰期!头部厂商扎堆上新大模型,DeepSeek的新模型动态目前其新模型已完成灰度测试,技术储备到位,大概率会在2月正式亮相。根据目前媒体的爆料来看,DeepSeek的新模型主要亮点应该在:1M Token超长上下文,可轻松处理完整长篇文档;Engram条件记忆架构,大幅降低推理成本;强化数学与代码能力三个方面。巩固开源领域优势,同时更新知识库,提升多模态文档理解能力。也是DeepSeek稳稳抓住关注的关键。因为“长上下文+低成本”的差异化优势,精准匹配法律、金融等专业场景,开源属性也贴合开发者与企业需求。#过个有AI年# #HOW I AI#

18. DSA背后的基础是原生稀疏注意力(Native Sparse Attention, NSA) 网页链接。NSA的突破在于,它让模型学会“智能分配注意力”。它通过一个可训练的、动态的算法,为当前正在处理的每个词,只从全文中智能筛选出一小部分最关键的词(如相关的、邻近的、包含全局关键词的)进行计算,而非强制与全文每个词交互。这样一来,其计算复杂度从平方级降至近似线性级(O(L)),实现了理论上最高达11倍的解码加速,为模型高效处理书籍、长文档等超长文本铺平了道路。

19. #Kimi建议网友先用DeepSeek# 最近Kimi因太受欢迎导致算力紧张,竟建议网友“先用DeepSeek”,这波操作太圈粉了!作为登顶OpenRouter榜单的模型,Kimi本可强留用户,却为体验着想坦诚分流。DeepSeek擅长复杂逻辑推理,可快速生成初稿、搭建框架,Kimi则精于长文本处理与细节润色。二者配合,效率拉满,这才是AI该有的格局,为Kimi点赞!#Kimi好卑微#

20. 深度求索将于 2 月推出下一代旗舰大模型 deepseek-v4,将如何影响当前市场格局?

21. 【天风海外李泽宇】谷歌Gemini 3.0模型卡提前放出快评——多模态、知识库能力大幅超越GPT与ClaudeGoogle尚未发布新一代大模型 Gemini 3 Pro,但官网已经上线模型卡,并同步披露与 Gemini 2.5 Pro、Claude Sonnet 4.5 与 GPT‑5.1 的对比测试结果。整体看,Gemini 3 Pro 在多模态能力上大幅领先目前其它旗舰模型,并在数学、科学推理及长上下文等核心能力上有较为明显的跨代提升。在涉及图像理解能力的逻辑推理上(Humanity’s Last Exam、ARC‑AGI‑2、AIME 2025、MathArena 等)上,Gemini 3 Pro 大幅超越自家 2.5 Pro,GPT‑5.1、Claude 4.5 。AIME 2025 等高难数学榜单中,Gemini 3 Pro 在“有代码执行”场景下达到满分,显示其在 工具调用+数学推理 组合能力上已经具备行业顶级水准。多模态与视频理解:延续 Google 传统优势,视频场景领先两档档在 MMMU‑Pro、ScreenSpot‑Pro、Video‑MMMU 等多模态基准中,Gemini 3 Pro 相比 Gemini 2.5 Pro 有明显跳升,并普遍高于 GPT‑5.1 与 Claude 4.5。在截图理解上,Gemini 3 Pro达到72.7%,大幅超越其它旗舰模型的36.2%。特别是 Video‑MMMU 维度上,Gemini 3 Pro 在视频信息抽取与知识问答上表现突出,Agent & 代码:综合实力强,部分专项仍与 GPT‑5.1/Claude 形成互有胜负在 LiveCodeBench Pro、SWE‑Bench Verified、t2‑bench、Vending‑Bench 2 等“代码+智能体”基准上,Gemini 3 Pro 的 Elo/成功率普遍高于旧版本,并在多数维度与 GPT‑5.1 非常接近。但在部分单项(如 SWE‑Bench Verified 测试,Claude 4.5 仍保持小幅领先),表明行业在真实软件工程类任务上尚处于“多强并立”格局,尚未出现一骑绝尘的模型。长文本与检索:128k 上下文可用性增强,复杂检索任务能力改善。幻觉极低。在 MRCR V2、FACTS Benchmark Suite 等长上下文与检索基准上,Gemini 3 Pro 相对 2.5 Pro 提升明显,在 128k 长度下仍能保持较高准确率。并且在SimpleQA Verified上,其得分超过72%,大幅领先非Anthropic Sonnect4.5的29%与GPT5.1 的35%。长任务执行能力:整体也胜于GPT 5.1 与Sonnet 4.5我们怎么看未来生态与商业化?我们认为尽管在代码能力上Gemini 3Pro尚未完全超于竞争对手,但在多模态能力、文本Rag能力上3Pro已经大幅超越,叠加 Google 自有搜搜索+Workspace+Android 生态,有望在搜索AI mode商业化、文档问答、企业AI等场景实现市场开拓能力的大幅提升,并且涌现大量多模态新场景。继续看好谷歌与谷歌链的受益者。

22. 综合能力比肩GPT5,万亿参数思考模型Ring-1T来了!#AI #国产大模型 #蚂蚁百灵 #AIGC

23. 2026上半年国内十大AI工具核心特点一览: ​1. 豆包 (字节跳动) 特点:对话交互体验佳 以拟人化对话和语音交互见长,响应速度快,适合日常闲聊、口语练习及轻量级信息查询。 ​2. DeepSeek (深度求索) 特点:逻辑推理与代码金融 在数学推导、代码生成及金融分析领域表现卓越,以高性价比和强逻辑性著称。 ​3. 文心一言 (百度) 特点:中文知识问答权威 依托庞大的知识图谱,在中文语义理解、百科问答及搜索增强方面表现优异。 ​4. 通义千问 (阿里) 特点:办公场景全能助手 深度集成于阿里办公生态,在文档处理、会议纪要及跨格式解析方面表现出色。 ​5. 智谱清言 (智谱AI) 特点:思维链逻辑推理强 擅长复杂问题拆解与逻辑推演,能够展示清晰的思考过程,适合科研与深度分析。 ​6. Kimi (月之暗面) 特点:超长文本处理专家 支持超大上下文窗口,轻松解析百页PDF与长篇文档,是阅读与摘要的利器。 ​7. 元宝 (腾讯) 特点:精准检索与摘要 深度整合微信生态,擅长处理长文档摘要、资料精准检索与复杂指令分析。 ​8. 通义灵码 (阿里) 特点:高效智能编程 基于通义大模型的编码助手,支持行级/函数级实时续写,大幅提升开发效率。 ​9. 天工AI (昆仑万维) 特点:AI音乐创作先锋 在AI音乐生成领域独具特色,支持多种风格的旋律创作与歌曲生成。 ​10. 即梦/可灵 (字节跳动) 特点:多模态内容生成 字节跳动在视频与绘画领域表现突出,其中即梦侧重绘画设计,可灵侧重视频生成,展现了强大的视觉内容创作能力。 (转)

24. 国内目前使用的AI智能问答软件,豆包、通义千问、元宝、kimi、deepseek,哪个好用?

25. 市值近600亿,大模型公司上市了! #AI #智谱ai

26. DeepSeek新模型爆火,硅谷玩疯了 #DeepSeek团队开源新模型 DeepSeek新模型爆火,硅谷玩疯了!把文字变成图像,让AI一目十行读完一本书!这次,它真的在教AI们,怎么省算力、怎么学会“遗忘” #AI #DeepSeek

27. 阿里全家桶全面Agent化!千问“任务助理”全面公测,从此AI不再只是动嘴出主意的狗头军师!

28. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

29. 华人学生立大功!新王Mamba-3直击Transformer死穴,推理效率碾压7倍

30. 使用 Gemini 3 Pro Vibe Coding Flutter 的进展,个人管理软件,添加了时间记录的功能。我说强到没边,不是没有依据的而且哦,我没有用 Agent 工具,只是在 AI Studio 里面,提出要求,LLM 给出实现,我人工搬进代码里,有了运行效果或者 Bug,再跟 LLM 聊,所有 Vibe 部分都在 AI Studio 里面进行。这样做很低效,但是有个好处,就是充分发挥了 Gemini 3 Pro 的超长上下文能力,比起 Agent 工具每次创建一个新的上下文(丢失背景),LLM 能够了解事情的来龙去脉。得益于 Gemini 3 Pro 的 100w Token 上下文,一个对话能聊很久,网页这两天出点 bug,看不到上下文开销了,也不知道实际用多少了。也就是 AI Studio 免费用,要是自己调 API,这么长的上下文,每次往里做增量调用,每次输入都是几万、几十万 token,得花很多钱

31. 阿里发布新一代全模态大模型Qwen3.5-Omni。 采用混合注意力MoE架构,通过1亿小时音视频+文本跨模态预训练 。 原生支持113种语言识别(含毛利语等濒危语种)和36种语音生成。 创新ARIA语音技术实现音色稳定,对话响应延迟降低至人类感知无差别水平。 核心突破: 视听理解:在DailyOmni等215项基准测试中全面超越Gemini 3.1 Pro ,嘈杂环境语音识别错误率下降42%(WenetSpeech基准)视频内容结构化描述准确率达98.1%(RealWorldQA测试) 。 Vibe Coding进化:非预设能力,在百万级多模态指令微调中自然涌现 。 普通用户可前往Qwen Chat免费体验,开发者和企业可通过阿里云百炼平台调用Qwen3.5-Omni模型Plus、Flash、Light三种API。

32. DeepSeek 计划二月中旬发布新模型 DeepSeek-V4,有哪些技术亮点?能第二次震惊世界吗?

33. 怎么看待新加坡政府宣布在东南亚语言大模型项目放弃Meta模型,采用阿里的通义千问(Qwen)开源架构?

34. Seedance 2.0:说中国话的最强AI视频模型!

35. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

36. Gemini 3实现智能水平断层碾压。Artificial Analysis智能指数73分(行业平均42分),在Humanity's Last Exam等基准测试中刷新纪录。核心突破在于生成式UI,可创建交互式界面和微型应用,从"回答问题"跃升至"生成体验"。原生多模态能力无缝处理文本、图像、视频、音频,并集成Nano Banana图像模型;支持100万token超长上下文。智能体能力实现自主规划与多工具协同,代码生成在SWE-bench达76.2%,搭配Antigravity平台构建自动化编码代理。响应速度达128 tokens/秒,但输出成本较高。Gemini 3无疑是当前最强大脑,适合需要顶尖推理和企业保障的场景;Grok 4.1以2M上下文和超低成本称王,适合海量文本处理;ChatGPT 5.1仍是均衡的通用选择,生态最成熟;国内Kimi K2在开源和Agentic方向独具特色,适合定制化部署#Gemini3凭什么被称为最强AI#

37. 千问3.5以小胜大,阿里巴巴的阳谋藏不住了

38. #DeepSeekV4要发布了吗#DeepSeek V4 最新爆出的消息来看,主要的变化就是上下文窗口扩至100 万 token,编程基准 SWE-Bench 达83.7%,原生多模态、创新架构降低显存占用,延续高性价比,API 定价仅为海外竞品的 15%-30%,预计 2 月底至 3 月初正式发布。现在市场比较关注DeepSeek V4 编程与长文本处理能力是否真的跻身全球第一梯队?是否真的能够实现以算法创新打破算力内卷,普惠企业与开发者?DeepSeek作为一款专业大模型覆盖能力是否能够解决开发工具与行业解决方案的生态体系问题。DeepSeek V4会成为2026年的第一炸吗?

39. #千问Qwen3.5大模型发布#真正的卷王出现了,就在刚刚,阿里正式发布全新一代大模型千问Qwen3.5-Plus。这次核心更新在于采用了Mamba混合注意力机制(SSM-Transformer) + 稀疏MoE架构,总参数3970亿但仅激活170亿参数,显存占用降低60%,推理吞吐量最高提升19倍。举个例子,传统大模型就像人工翻整墙档案,你每问一个新问题,都要把前面所有档案重新翻一遍核对关系,内容越长,翻得越慢,越到后面越卡。 纯Mamba机制则像只记档案摘要,翻得极快,但细节容易丢,关键信息可能漏看。 而Qwen3.5-Plus的混合注意力,就是摘要+精准抽查一起上:速度跟得上,细节不丢失,长文本、复杂推理又快又准。 这才是真·技术内卷,大模型体验又要上一个台阶了。#how i ai##过个有ai年# 千问qwen3.5大模型发布

40. 艹 Claude 最近特别的好Claude Opus 4.6 和 Claude Sonnet 4.6,现在全部支持100 万上下文窗口了在 Claude Code 中, Max、Team 和 Enterprise 用户默认模型自动由原来的200k,升级到1M...价格没变,Opus 4.6 还是 $5/$25 per million tokens,Sonnet 4.6 还是 $3/$15。媒体限制扩大 6 倍。 单次请求最多可以塞 600 张图片或 600 页 PDF,之前上限是 100。不需要改代码。 之前用超长上下文要加 beta header,现在直接就能用,旧的 header 也不影响。

41. 【Claude的100万token上下文,是里程碑还是营销的障眼法?】快速导读:Claude把上下文窗口免费升到100万token,但别高兴太早。一线重度用户警告,这根本不是性能天花板,而是一个“烧钱陷阱”。真正的用法,跟你想的完全不一样。---Anthropic刚刚给Claude Opus 4.6用户送上了一份大礼:上下文窗口直接从200k升级到100万token,价格不变。很多人的第一反应是:太棒了,这下可以把整个代码库、几百页的PDF一次性扔进去了。你以为这是一个可以无限填充的超级大脑,但残酷的真相是,它更像一个巨大的、容易混乱的工作台。来自一线开发者和AI重度用户的密集讨论揭示了一个共识:模型的推理能力在上下文超过25万到40万token后,就会开始出现明显衰减甚至断崖式下跌。它不是遗忘了,而是开始“忽略”早期的指令,导致结果质量直线下降。那这100万token的意义何在?答案是“呼吸空间”,而不是一个新的性能上限。把它想象成高速公路上的应急车道。它的价值不在于让你全程在上面飞驰,而是在于当你的复杂任务(比如一个多文件代码重构)快要“撞墙”(触及旧的200k限制)时,能让你平稳地完成,而不会因为被迫压缩上下文(`/compact`)而中途“失忆”。专家们总结的最佳实践是:将大型任务拆解,确保核心推理环节在30万token内完成,然后主动开启新会话。所以,这暴露了一个新的技能鸿沟。天真的用户试图填满整个100万token窗口,结果不仅得到更差的输出,还因为每次交互都带着巨大的上下文,导致token额度以前所未有的速度被烧光。而聪明的用户,则把它看作一个安全气囊,同时利用环境变量手动设置一个更低的自动压缩阈值,实现成本和性能的平衡。当所有大模型厂商都在为上下文窗口的长度大搞军备竞赛时,真正的战场已经悄悄转移了。问题不再是你一次能喂给AI多少东西,而是你懂不懂如何管理它那块昂贵、健忘又极不稳定的“工作内存”。---简评:终于有人把皇帝的新衣戳破了。AI的上下文窗口就像办公桌,桌子再大,你一次也只能处理手边的几份文件。把一屋子文件全堆上来,只会让你找不到北。这标志着AI应用从“大力出奇迹”的蛮荒时代,进入了需要精细化运营的阶段。---ref: www.reddit.com/r/ClaudeAI/comments/1rst3zv/opus_46_now_defaults_to_1m_context_same_pricing#AI创造营##人工智能#

42. DeepSeek V3.2来了,首个会"思考"的Agent模型,首个开源性能打平GPT-5的模型

43. 全球大模型第一股,为啥是家中国公司? #智谱 #智谱上市 #智谱IPO #GLM大模型 #全球大模型第一股诞生

44. 盘点一周AI大事(11月30日)|AI自己剪片子 奥特曼预告下一代大模型Shallotpeat Anthropic发布最强编码模型Claude Opus 4.5 DeepSeek发布最强开源推理模型DeepSeek-Math-V2 微软开源最强行动智能体Fara-7B Black Forest推出最强开源图像模型Flux.2 阿里发布开源版小香蕉平替Z-Image 腾讯发布开源版Veo 3平替Tencent Harmony 字节开源AI剪辑大模型Vidi2 腾讯开源最强OCR模型HunyuanOCR 1B 科学家研发出最强数据分析智能体Edison Analysis RAI研发棒球陪练机器人 港科大训练出首个会打篮球的机器人 工程师开源家用机器人Aloha mini #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

45. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群

46. 这个模型有机会成为世界模型的Deepseek#AI #大模型 #世界模型 #北京人形机器人创新中心 #北京人形WoW具身世界模型

47. 看样子AI圈又要被DeepSeek的更新刷屏咯!#DeepSeekv4要来了吗#全网都在追问,这款承载国产AI野心的新一代大模型,是否即将重磅登场✨ 据多方信源透露,DeepSeek已开启新版本灰度测试,当前推送的更新大概率是V4亮相前的终极铺垫,正式发布窗口锁定春节前后。#HOW I AI##过个有AI年# 我刚刚试试了你的上下文是多少?知识截止到什么时候?它给我回答:上下文长度是1M(约150万字),知识截止到2025年5月。然后我又问下你是什么模型?【我是DeepSeek最新版本模型。具体来说,我是DeepSeek推出的第三代大语言模型,没有单独的“4.0”“5.0”这样的版本号,就是持续迭代的最新版本。核心特点包括:1M超长上下文(可以一次处理三体三部曲体量的书)完全免费(Web端和App端都免费,无任何收费计划)支持文件上传(图片、PDF、Word、Excel、PPT等,读取文字信息处理支持联网搜索(需手动点击开启),语音输入(App端可用)如果需要了解更详细的技术规格,建议查阅深度求索的官方技术文档。还有什么想了解的吗?】不同于常规迭代,DeepSeek V4主打底层架构革新,搭载自研mHC流形约束超连接与Engram条件记忆模块,跳出参数内卷,实现性能与效率双重越级。其百万级Tokens超长上下文、低于GPT-4 Turbo 1/70的推理成本,以及超越主流竞品的编程能力,都让市场充满期待。从技术论文提前披露到GitHub架构更新,从国产算力深度适配到成本革命,种种信号都预示着V4的临近。这场关乎AI编程格局重构的升级,能否让DeepSeek重振市场份额、实现国产突围?一起蹲守,见证国产大模型的全新巅峰!

48. #千问Qwen3.5大模型发布#阿里在除夕夜甩出了个王炸——全新大模型千问Qwen3.5开源了,看完参数我直接好家伙: 用了Mamba混合注意力+MoE稀疏专家架构,总参数3970亿,但每次推理只激活170亿,相当于“小身材干大活”,显存占用直接砍半还多,长文本处理速度直接起飞。终于从纯文本模型进化成原生多模态,以后图文交互、复杂任务处理更丝滑。性能直接对标顶级开源产品,关键是部署门槛低了一大截,不管是企业还是个人开发者,都能轻松玩起来。 与其说是发布新模型,不如说是把大模型的“技术普惠”又往前推了一大步。

49. 多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。记者实测中发现,DeepSeek在问答中称自身支持上下文1M,可以一次性处理超长文本。(科创板日报)

50. DeepSeek以开源、低成本、高效率著称,被英伟达用作新架构性能试金石,推理吞吐量可提升10倍;Kimi采用DeepSeek V3架构优化自身模型,但需平衡性能与成本,其K2.5模型虽支持长文本与智能体任务,却受限于部署资源。因此,就有了这个建议:#Kimi建议网友先用DeepSeek##Kimi好卑微#

51. 大模型时代法务文档智能处理技术实践

52. #DeepSeek新模型为何被夸爆#因为这一次又是一个突破,让大家看到了上下文压缩的可行性。所谓“光学压缩”,就是直接把文本转成图像,因为一张图能包含大量的文字信息,并且用的 Token 还少,用视觉模态来给文本信息瘦身。OCR 适合验证这个思路,因为它本身就是在做视觉到文本的转换。论文显示,DeepSeek-OCR 的压缩率能达到 10 倍,OCR 准确率还能保持在 97% 以上。也就是说,如何提升大规模文本处理与智能体系统的计算效率,Deepseek又给出了一个新的思考方向。对视觉语言模型与大语言模型的发展来说,都有推动作用。

53. 月之暗面发布 Kimi K2 Thinking:在推理、搜索、代码测试等关键基准上,超越 GPT-5 和 Claude 4.5,在人类最难 AI 测试 Humanity’s Last Exam 拿下 44.9% 历史最高分。最震撼的是成本:训练成本 < 500 万美元,推理成本比 GPT-5 便宜近 10 倍支持 256k 长上下文,能自动执行 200–300 次工具调用,像人一样思考和执行。过去顶级推理能力只有巨头能负担,现在一个不到 500 万美元、完全开源的模型,把 GPT-5 拉下神坛。#ai#

54. 阿里发布千问3.5,性能媲美Gemini 3, Token价格仅为其1/18

55. 黄仁勋罕见长文:未来10年,AI拼的到底是什么? #黄仁勋 #英伟达 #gtc #科技改变生活

56. 领先iPhone十年的初代AI手机,为何无人知晓

57. 刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习

58. 对话云栖大会:下一个AI爆款、大模型进化与Agent万亿级企业市场

59. 小米突然发布新模型:媲美 DeepSeek-V3.2,把手机的性价比卷到 AI

60. 华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

61. DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点?

62. 据最新爆料:DeepSeek V4和姚顺雨的新混元模型,将同时于下月发布

63. 编程新基准CursorBench:GPT-5.4拿下第一!

64. SmartBench:首个专注于中文智能手机场景的大模型能力评估基准

65. 超越传统 RAG:知识图谱如何增强 AI 的记忆与推理能力

66. DeepSeek 团队发布视觉压缩 OCR 模型,哪些信息和技术亮点值得关注?知乎答主们做了一波测评,总结:这个工作不是在单纯提高 OCR 的准确率,而是在尝试解决一个更大的问题——大模型的上下文瓶颈。它不是单纯在「识字」,而是在试图用视觉的方式去压缩长文本上下文,因为它碰到的其实是所有大模型都头疼的问题:上下文太长,token 不够用。简言之,大模型可以一目十行了!

67. #2025科技年度热问# 受@微博科技 邀请,参与年度话题,分享我对今年AI发展的几点思考:Q1:2025年推动AI进入下一阶段的关键突破是什么?我认为关键在于国产开源大模型的崛起,从年初 DeepSeek 引发的轰动,到 Qwen、GLM、Kimi 等国产开源模型轮番刷榜。站在未来尺度,开源大模型对AI发展的重要程度大于闭源模型。而在业界,越来越多看到 Qwen 取代 Llama,成为微调、研究的热门模型。这证明我们国家,在前沿 AI 研究中发挥越来越重要的价值。Q2:2025年有哪些AI产品真正让我感到眼前一亮?最让我眼前一亮的是 Gemini 3 Pro,他让我看到了百万级上下文结合出色的推理能力,所带来的巨大产能。尽管受限于成本,超长上下文还难以大规模应用。但是在我个人多个使用场景中,通过超长上下文推理,为我的生活、工作、自学都带来了很好的收益。Q3:展望2026哪个趋势是不可忽视的必然路径?2026年我认为是 AI 加速落地的一年。原因有二。第一是 25年 AI 的 Agent 能力大幅提升,却仅在编程等少数场景落地,在其它行业中还存在巨大的落地价值。第二是大模型的推理成本整体呈下降趋势。我比较看好的领域是 AI 教育,在 26 年是一个值得关注的趋势,比如 Google 最新推出的 Learn Your Way,将教科书变为 AI 私教。

68. 2025 AI 大模型全年盘点:谷歌反超,国产爆发,三大榜单一文看懂!

69. 现在的大语言模型只是开始,真正的智能,要让机器理解物理世界。 #大咖观察 #红衣聊AI #智能制造 #科技

70. 「Github一周热点96期」Flux2绘图模型、腾讯的视频生成模型、AI记忆、开源Launchpad、笔记和知识库,Nginx可视化工具

71. 盘点一周AI大事(1月11日)|最强人形机器人 OpenAI公布2026研发路线图 DeepSeek被爆2月发布DeepSeek V4 Google推出Veo3驱动的数字人Vids 字节开源换脸视频模型DreamID-V 阿里开源数字人框架HRM2Avatar Lightricks开源顶级视频模型LTX-2 ElevenLabs推出最强语音转录模型Scribe v2 斯坦福开源睡眠分析模型SleepFM 港大发布开源版NotebookLM DeepTutor Razer推出全息AI老婆Project AVA 波士顿动力推出下一代Atlas #抖音知识年终大赏 #前沿科技趋势发布月 #AI新星计划 #AI #机器人

72. DeepSeek V4 前瞻:华为寒武纪接棒,拆解中国 AI 大模型告别英伟达后的生存战 | DeepSeek V4 | 华为昇腾 | 寒武纪 | 国产算力 |

73. #千问Qwen3.5大模型发布#千问 Qwen3.5 是采用极致稀疏 MoE 架构在保持超强性能的同时,显存占用降低 60%,推理效率大幅提升,部署成本显著下降。模型支持最高 256K 超长上下文,让长文本处理变的更加的轻松有效率了!原生多模态统一也是Qwen3.5的特点之一,也是目前国内外大模型的发展的主要趋势,模型在图文、视频理解能力全面升级,精准解析图表、文档与复杂视觉内容。实现了一个入口实现多种属性。Qwen3.5对于中小企业特别友好, 很大程度上降低了企业运营成本,可以让中小企业得到高效、普惠、全能的运营工具。不再因为高昂的费用而排斥企业去追逐AI。#过个有AI年##HOW I AI#

74. 用一加13还是一加15,当我犹豫时千问帮我做出了决定。

75. 【#DeepSeek新模型更新#,#DeepSeek新版本灰度测试#】据鞭牛士,DeepSeek可能正在测试新的V4模型。科创板日报2月11日讯,多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。经实测,无论是安卓还是苹果,在手机App端和网页端,用户直接询问“你的上下文是多少”,得到的回答均显示DeepSeek的上下文窗口已达到约100万token。同时,知识歌更新时间也到了2025年5月份。这意味着它能一次性吃透极长的书籍、复杂的代码库或者海量的历史对话,而不会像以前那样聊着聊着就“失忆”。这一数据较此前版本有大幅提升,与目前行业头部模型的上下文容量处于同一水平。结合App版本的更新节奏,有观点认为DeepSeek可能正在为V4模型的正式发布做前期测试。截至发稿,DeepSeek官方尚未就新模型的相关信息发表回应。各位网友,您怎么看?(综合鞭牛士、科创板日报)@东方财经 #DeepSeek更新新模型#

76. Anthropic发布了最新模型 Claude Opus 4.5。主要是编程能力突破。在真实世界软件工程测试中超越GPT-5.1-Codex-Max等,而且支持8种编程语言开发,SWE-bench多语言基准7项领先。系统上也进化了,长程任务稳定性提升29%(Vending-Bench基准),新增多智能体协同管理能力,支持构建复杂系统。终端工具使用流畅度达行业新高度。价格也打下来了。输入/输出价格分别降至5/25美元/百万token,较上代直降67%,创顶级模型价格新低。

77. 阿里自研AI芯片亮相,由通义实验室、阿里云、平头哥组成的“通云哥”体系,有哪些信息值得关注?

78. #DeepSeek新模型为何被夸爆#DeepSeek这次的OCR新模型,可能真打开了AI的新思路。传统语言模型读长文本像逐字抄经,费算力又慢;而DeepSeek反其道而行把长文本变成图像,再让AI去看图识字。结果不仅省算力,还把精度拉到97%,一张A100能处理20万页文档。感觉这个模型特别适合用来处理旧杂志、扫描文档、混合排版内容的数字化。传统OCR输出的是混乱的文本,需要大量手工清理,而这个模型能直接输出结构化的Markdown,大大减少后期处理的工作量。

79. #豆包大模型2.0发布# 打开豆包 App、电脑客户端或网页版,点击「专家模式」,即可第一时间体验全新升级的豆包大模型 2.0 Pro。豆包2.0全面升级了多模态能力,在各类视觉理解任务上均达到世界顶尖水平,视觉推理、感知能力、空间推理与长上下文理解能力表现尤为突出,豆包2.0 Pro 在大多数相关基准测试中取得最高分。#HOW I AI##过个有AI年# 豆包官方的微博视频

80. 【#DeepSeek新模型或下周发布#】#DeepSeek新模型亮点曝光# 3月1日,据媒体报道,DeepSeek将于下周发布其最新的大模型V4。据两位知情人士透露,这是一款具备图片、视频和文本生成功能的多模态模型。在硬件适配方面,DeepSeek为国产算力提供深度支持,DeepSeek致力于优化V4模型以适配中国制造的芯片,此举有望提振中国市场对其半导体产品的需求,并加速AI模型“推理”环节靠拢本土芯片。据一位直接了解相关计划的人士透露,DeepSeek预计在发布V4版本的同时,发布一份篇幅较短的技术说明,并在大约一个月后发布一份更全面的报告。截至发稿,DeepSeek官方尚未对V4的任何信息进行正式回应或确认,所有信息均来媒体爆料,详细信息多集中在正在进行秘密测试的简化版本V4 Lite(精简版)上。据《科创板日报》综合的消息,关于V4 Lite:其代号为“sealion-lite”,拥有100万(1M)个tokens的上下文窗口,相比V3系列的128K有近8倍提升,理论上可一次处理如《三体》全集体量的长文本;为原生多模态架构,意味着模型从预训练阶段就将文本与视觉理解融合,而非后期拼接。(财联社)V4 Lite参数规模估算为2000亿,另有猜测认为完整版V4参数量可能突破1万亿;效果显著优于网页端/APP端模型;泄露的测试示例显示,V4 Lite能用极简代码(如54行)生成高质量的SVG图像(如Xbox手柄),在代码优化和视觉还原度上被认为超越了DeepSeek V3.2、Claude Opus 4.6等模型,这暗示了其空间推理和结构化输出能力的提升。(财联社)

81. 面向大模型推理的模型与系统协同优化

82. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型

83. 盘点一周AI大事(1月4日)|Google包揽年度最佳模型 LMArena大模型盲选排行榜公布年度冠军 Google推出AI辅助学习系统Learn Your Way 阿里开源最强手机智能体MAI-UI DeepSeek发布新研究mHC IQuest发布最强开源编码模型IQuest-Coder-V1 字节发布动态概念大模型DLCM 腾讯发布最强开源翻译模型HY-MT1.5 阿里更新最强开源图像模型Qwen-Image-2512 Meta开源极速视频生成模型HiStream 研究员开源对象植入模型InsertAnywhere 研究员开源MV智能体AutoMV 腾讯开源3D动作生成模型Hunyuan Motion 1.0 研究员开源高保真3D模型UltraShape 研究员开源世界模型Yume 1.5 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #AIGC

84. “龙虾模型”能管公司?实测GLM-5-Turbo接入openclaw运营公司

85. 别再用 Ollama 了!OpenClaw 秒级响应方案(vLLM + 本地模型)完全免费!| 零度解说

86. 盘点一周AI大事(3月15日)|首次上传大脑成功 工程师开源龙虾办公室Claw3D 龙虾彻底出圈,,百虾大战正式开打 工程师开源一键装龙虾AlphaClaw 斯坦福开源科学家龙虾LabClaw 工程师Karpathy 开源龙虾版GitHub AgentHub Chrome上线龙虾Web协议 WebMCP 工程师开源龙虾软件协议CLI-Anything 吴恩达开源龙虾上下文工具Context Hub 研究员开源最强动漫图像模型Anima-v2 研究员开源最强视频分割模型MatAnyone 2 科学家成功上传了一只果蝇的大脑 #AI新星计划 #AI #AIGC #龙虾 #openclaw

87. GPT-5.4据传下周上线!200万上下文窗口+持久化状态,告别频繁遗忘

88. 马斯克Grok 4深夜大升级:200万逆天上下文、五倍GPT-5「脑容量」!

89. 年度国产AI工具榜单!2026年真正好用的10个免费AI办公工具

90. 文本已死,视觉当立!Karpathy狂赞DeepSeek新模型,终结分词器时代

91. 【#小米大模型# 深夜上线】今天凌晨,小米宣布推出三款大模型。官方介绍 MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。拥有超过1T的总参数量,采用创新的混合注意力架构,支持1M超长上下文长度。在全球大模型智能排行榜 Artificial Analysis上,位列全球第八,国内第二。

92. 如何看待最新发布的GPT-5.4 模型,能力较之前有何种提升?

93. 大模型能生成连贯文本,却出现与事实不符的“幻觉”或逻辑错误,是训练数据有偏差,还是架构无法真懂语义?

94. 「Github一周热点104期」智谱GLM-5发布,打响春节AI大战模型第一枪

95. #千问发布QwenImage2.0#千问全新升级,QwenImage2.0重磅登场,以技术突破重塑AI图像创作体验。模型首创生图与编辑一体化架构,无需切换即可完成从创作到精修,流程更高效。支持1K token超长指令与2K高清分辨率,精准理解复杂需求,直出海报、PPT、信息图等专业作品。中文渲染能力大幅提升,可清晰呈现古文、长文本与艺术字体,细节饱满、构图精准。人物、自然、建筑等场景质感细腻逼真,光影与纹理达到专业级摄影师水准。更轻量架构带来更快生成速度,兼顾性能与效率。经过体验下来,个人感觉它更贴合中文用户需求。从创意构思到成品输出,一步到位更高效,QwenImage2.0让复杂创作变简单,全面提升你的内容生产力!

96. 图灵奖得主Bengio斩获AAAI 2026大奖!5篇杰出论文,华人占3篇

97. 人类很容易跟踪可疑目标,智驾却很难只有更长的上下文,才能让智驾系统持续、稳定、不丢失地跟踪动态危险目标(横穿行人、加塞车辆、逆行非机动车等),减少“突然消失、突然出现、ID 切换”的跟踪错误,显著提升极端路况下的安全性特斯拉模型架构迭代的方向,在不断增加上下文长度特斯拉terafab不但要造逻辑芯片,还要造存储因为延长上下文长度,主要依赖更大的存储来支撑 KV Cache#特斯拉fsd##人工智能 # 刘智驾的微博视频

98. Alex Albert 正在征集 Opus 4.5 的反馈,用户们纷纷指出了使用中的痛点和改进建议:- 上下文限制频繁导致查询失败,界面空白,且离开页面后常丢失输入(Deedy)- 模型偶尔过于急于下结论,忽略指令,且有时回答直觉化,缺乏严格核查- 需要更强的“长上下文智能”,能提炼主题、战略方向,而非简单检索- UI体验欠佳,比如无法在会话中切换Sonnet和Opus,自动压缩功能不可控,浪费时间和资源- 性能和成本问题,期望更快更便宜- 代码生成时常忽视已有抽象,重复造轮子;合并冲突处理不够智能,导致等待CI失败- 安全研究场景识别不足,拒绝分析恶意软件样本- 记忆和上下文管理不理想,频繁重复说明,影响效率- 功能期待:自动生成并保持最新的CLAUDE .md文档,异步渐进式压缩,支持视频输入- 质量波动大,有时表现“迷糊”,甚至比旧版本Sonnet还差- 期望下一个版本能更快推出,提升智能和稳定性总体来看,Opus 4.5 功能强大,用户体验和技术细节仍有不少提升空间。真正的挑战是如何在保持模型强度的同时,提升稳健性和实用性,减少“直觉式”错误,增强上下文理解和持续学习能力。只有这样,才能让AI成为日常工作中真正值得信赖的助手,而非偶尔拖后腿的“聪明伪专家”。x.com/alexalbert__/status/1998801676854337643

99. 🚀 Kimi 智能助手

100. 《国产AI对决!多款大语言模型横评,居然还可以同时使用?》第二弹

101. 通义千问Qwen 3.5

102. 通义千问Qwen3.6Plus登陆OpenRouter 百万上下文免费使用 国产大模型降维打击海外付费服务

103. DeepSeek V4定档4月!百万上下文、原生多模态,国产大模型再迎“核弹级”更新?

104. 2026全球AI大模型榜

105. 国产大模型最新一代到底多能打?我们把主流选手扒了一遍

106. DeepSeek 之后,国产大模型还有哪些被低估的玩家?

107. 科技浪丨Qwen3.5,国产大模型实现全球领跑

108. 美团LongCat-Flash-Lite

109. DeepSeek 大模型强势崛起!国产 AI 如何突围全球竞争?

110. 【论文精读】一文读透

111. LongBench-Pro

112. QwenLong-L1.5

113. 别再迷信“大海捞针”了!清华 LongBench v2 揭露真相

114. ChatGLM2-6B评测

115. 国内主流 AI 大模型底层能力对比

116. DeepSeek V4 旗舰大模型技术升级与能力解析

117. 国产大模型“星火4.0”正式商用,多模态能力大幅提升

118. 400万token上下文无压力?阿里通义QwenLong-L1.5刷新长文本推理纪录,性能比肩GPT-5

119. 对标GPT-5!阿里通义开源QwenLong-L1.5

120. 阿里通义Qwen-Doc

121. 文心一言(文心5.0)深度解析

122. 国产大模型崛起

123. 2026 年 AI 写作工具对比评测

124. Kimi AI 助手深度测评

125. 为什么 Kimi 能突然杀出来?国产大模型的下半场拼的是什么?

126. DeepSeek 可一次性处理《三体》三部曲

127. 国内大模型横评

128. DeepSeek V4来了!国产大模型杀疯了

129. 2026 开源大模型全景图

130. DeepSeek发布两款正式版模型

131. 中英文阅读 | DeepSeek测试全新1M上下文长文本模型

132. DeepSeek-V3.2-Exp

133. DeepSeek-V3.2深夜炸场

134. deepseek发布deepseekV3.2,性能超gpt5、追平gemini3 Pro,token消耗进一步降低~

135. DeepSeek V3深度解析

136. 2026年AI推理能力大比拼

137. 大模型驱动的合同管理系统开源!企业级应用,AI管理企业合同,不需要律师

138. “智契AI”合同审查与风险预警系统

139. 基于 DeepSeek-R1 大语言模型开发的合同风险审核平台

140. GLM-5.1 实测

141. GLM-5.1 实测

142. 太强了!GLM-5.1 第一手实测,平替Claude Opus 4.6?

143. 国模崛起 GLM-5.1编程能力实测

144. GLM 5.1重磅发布!智谱AI的"长时程智能体"能否改写中国大模型格局?

145. Kimi比想象中凶猛太多了

146. 亲测Kimi,手把手教你怎么把它利用最大化!

147. 阿里巴巴③:阿里巴巴通义大模型介绍及相关概念

148. 清华LongBench v2:长文本理解AI接受人类专家级挑战 - 哔哩哔哩

149. 别再依赖 Gemini!国产 AI 工具 DS4 上线,1 步解决论文长文本分析难题

150. 通义千问Qwen3-VL技术报告发布,256K超长多模态上下文,性能全面领先!

151. 长上下文大模型综述:挑战、价值与技术路径

152. 大模型时代,解锁智能合同管理最佳实践——合同管理系统深度测评

153. DeepSeek疑似已更新:上下文暴增至100万

154. 阿里通义QwenLong-L1.5长文RL全链路公开

155. 百万token长文档问答新突破:InfMem让小模型准确率飙升10个点,推理速度快4倍

156. 重磅!Kimi 发布并开源 K2.5 模型带来全新视觉理解、代码和 Agent 集群能力。Kimi k2.5 原来已经极其强大的长文本,再次进化成了一个既有「眼睛」能看懂复杂屏幕,又有「双手」能指挥庞大智能体集群的超级工头。在 SWE-Bench Verified(编程)和 HLE(人类最后考试)等硬核基准测试中,它不仅超越了 DeepSeek V3,甚至在多项指标上击败了闭源的 GPT 和 Gemini。 #AI #大模型 #agent #kimi #抖音科技

157. 【工程师必看】AI回答总差“一点点”?揭秘RAG分块(Chunk)核心技巧!语义切分+重叠策略,手把手提升检索准确率,全程干货,建议收藏!大模型|LLM

158. 真够顶的!GLM-5 炸裂发布:连续工作 24 小时,开源 AI 的“长任务”时代真的来了

159. 🔥 AI 日报 2026.04.04 | GPT-5发布,国产大模型破100万!

160. 大语言模型重塑智能合同管理:从工具革新到生态重构的深度测评

161. AI大模型如何提高上下文长度?

162. DeepSeek开源新模型,提出长文本处理新思路

163. 十大国产AI大模型深度测评 比拼,谁才是你的最强“最强大脑”?

164. 我把文心一言、通义千问、Kimi、智谱清言、讯飞星火全部测了一遍

165. 上海交大谷云飞出席2026人工智能基础设施峰会,破解大模型长上下文KV Cache加速难题

166. 上下文工程已死,上下文工程的上下文来了,什么破玩意...

167. 国产大模型大PK,看哪家的好,哪家最适合你

168. 文心一言 vs Kimi:2个国产AI工具,谁更适合你?

169. 主流国产AI大模型核心能力全梳理,工作学习不用愁

170. 为什么大模型都在拼命堆上下文窗口?1M到底够不够用

171. 当RAG遇上噪声难题:中科院团队提出“段落注入”,让LLMs在推理中辨伪存真

172. ChatGPT vs Claude vs 文心一言,谁更强?2026年AI工具深度对比

173. 2026国产大模型TOP10

174. AI科研平台之——科研论文生成的长文本处理

175. 大模型上下文详解

1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章