百万元上下文模型实测:能跑满100万token的不到三成,你的场景真需要这么长吗?
04-27 14:15
精选参考来源
抖音 2025-12-12
新浪微博 2026-03-09
来源
精选参考来源
1. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型
抖音 2025-12-12 00:00:00
2. #科技先锋官# 别再被 GPT-5.4、DeepSeek V4 的超长上下文洗脑了!很多人以为上下文越长,AI 就越厉害,这完全是误区!真正决定 AI 实力的,从来不是能记住多少字,而是能不能思考、推理、落地做事。超长上下文只是锦上添花,强推理和多模态融合,才是下一代 AI 的核心杀招!只会读文档、背内容的 AI,再长的上下文也只是 “复读机”;能拆解难题、看懂图像、自主执行任务,才是真进化。为什么很多大模型参数再高、上下文再长,依然不好用?答案就在视频里。看完你会彻底明白:AI 的未来,拼的不是记忆,而是真正的专业能力。#过个有AI年##HOW I AI##微博超有用视频大赛##上微博涨知识##MWC2026# 种斌Marco的微博视频
新浪微博 2026-03-09 00:00:00
3. 姚顺雨在腾讯首个研究:在“上下文”这事上,在座的各位都不及格
微信公众号 2026-02-05 00:00:00
4. Claude Sonnet 4.6 发布了,Anthropic 迄今最强的 Sonnet 模型。这次升级覆盖面很广:编程、计算机操作、长上下文推理、智能体规划、知识工作、设计,全线提升。上下文窗口也扩到了 100 万 token(beta)。价格不变,依然是 3/15 美元每百万 token。下面快速过一遍值得关注的点。【1】编程能力大幅提升,用户甚至更偏爱它超过 OpusAnthropic 的内部测试显示,Claude Code 用户在 70% 的情况下更偏好 Sonnet 4.6 而非上一代 Sonnet 4.5。更夸张的是,59% 的用户甚至更喜欢它而非去年 11 月发布的旗舰模型 Opus 4.5。用户反馈集中在几个点:Sonnet 4.6 在改代码之前会先读上下文,会合并重复逻辑而不是到处复制粘贴,过度工程化和偷懒的情况也明显减少。多步骤任务执行更稳定,虚假的成功报告更少。【2】计算机操作从实验品变成了实用工具2024 年 10 月 Anthropic 首次推出计算机操作功能时,自己都说"还很笨拙、容易出错"。16 个月后,OSWorld 基准测试(让 AI 在真实软件环境里完成任务)的得分从最初的 14.9% 涨到了 72.5%。早期用户反馈,Sonnet 4.6 在操作复杂电子表格、填写多步骤网页表单这类任务上,已经接近人类水平。它还能跨多个浏览器标签协调操作,把不同来源的信息整合到一起。当然,跟最熟练的人类比还有差距。但这个进步速度说明,更强的版本不会太远。安全方面也有改进。计算机操作最大的风险是提示词注入(prompt injection),恶意网页可以藏指令试图劫持模型。Sonnet 4.6 在抵抗这类攻击方面比 Sonnet 4.5 有明显提升。【3】基准测试全面提升,逼近 Opus 水平Sonnet 4.6 在各项基准测试中全面进步,接近 Opus 级别的智能水平,但价格只是 Sonnet 级别。换句话说,以前需要用 Opus 才能搞定的任务,现在 Sonnet 就能做。特别值得一提的是 Vending-Bench Arena 评测,这个测试让 AI 模型在模拟环境中经营一家企业,不同模型之间还要相互竞争。Sonnet 4.6 展现出了有意思的策略:前 10 个月大举投资扩产能,最后阶段突然转向盈利优先,靠这个时机差打赢了竞争对手。【4】100 万 token 上下文窗口100 万 token 足够装下整个代码库、长篇合同或几十篇研究论文。更关键的是,Sonnet 4.6 能在这么长的上下文里有效推理,而不只是把文本塞进去。这对需要长期规划的复杂任务很有价值。【5】产品和 API 更新API 层面有几个实用更新:网页搜索和抓取工具现在会自动过滤处理搜索结果,只保留相关内容,节省 token;代码执行、记忆、程序化工具调用、工具搜索等功能正式发布(GA)。Claude in Excel 插件现在支持 MCP 连接器,可以直接在 Excel 里调用 S&P Global、PitchBook、Moody's 等数据源,不用切出去。免费版也升级到了 Sonnet 4.6,并开放了文件创建、连接器、Skills 和上下文压缩功能。【6】怎么选:Sonnet 4.6 还是 Opus?对大多数任务来说,Sonnet 4.6 性价比更高。Anthropic 自己的建议是:需要最深层推理的场景(大规模代码重构、多智能体编排、必须零容错的问题),Opus 4.6 仍然是更好的选择。其他场景,Sonnet 4.6 足够了。Sonnet 4.6 的模型标识符是 claude-sonnet-4-6,已在所有 Claude 方案、Cowork、Claude Code、API 以及主要云平台上线。官方公告:网页链接
新浪微博 2026-02-18 00:00:00
5. #deepseekv4发布#DeepSeek 发布新一代大模型 DeepSeek V4,本次更新主要围绕上下文能力、推理能力以及 Agent 场景进行优化。来看一看它的核心更新如下:🔻上下文能力大幅提升 支持最长 1M tokens(百万级上下文) 可处理完整代码库、长文档、多轮复杂对话🔻强化 Agent 场景能力 优化多步骤推理能力 支持更复杂任务执行 提升长流程稳定性🔻模型性能提升 多项 benchmark 表现提升 对标主流闭源大模型🔻提供双版本 Pro:高性能版本 Flash:高性价比版本(更快、更便宜)🔻 延续开源路线 持续推动开源大模型发展 强调低成本与高性能结合目前 DeepSeek V4 已开放相关能力与体验入口,可以在Hugging Face体验,具体应用场景仍在持续拓展deepseekv4发布
新浪微博 2026-04-24 00:00:00
6. 如何评价阿里 1 月 26 日新发布的 Qwen3-Max-Thinking 模型?
知乎 2026-01-27 00:00:00
7. 盘点一周AI大事2月8日|AI相亲、AI当老板、AI狼人杀 Anthropic发布最强大模型Claude Opus 4.6 OpenAI发布最强编码模型GPT5.3Codex OpenAI推出Codex桌面版 Google上线AI狼人杀 AI雇佣人类平台RentAHuman爆火 AI雇佣AI平台ClawTasks爆火 龙虾相亲平台MoltMatch爆火 智谱开源最强OCR模型GLM-OCR 字节发布最强视频模型Seedance 2.0 研究员开源无痕编辑视频模型Edit Yourself 字节开源最强分子预测模型Protenix-v1 Google发布论文配图AI Paper Banana #AI新星计划 #前沿科技趋势发布月 #AI #AIGC #OpenAI
抖音 2026-02-08 00:00:00
8. 今天AI太热闹了,DeepSeek V4预览版正式上线并开源,OpenAI几乎同期推出GPT-5.5,两大重磅发布“撞车”,直接把话题推向高潮。DeepSeek V4和GPT-5.5谁更强?哪些领域哪个更领先?从目前公开信息和基准来看,两者各有侧重,没有绝对碾压:🔻• DeepSeek V4(预览版): • 亮点:百万上下文(1M tokens)标配,这对处理整个代码库、长文档或复杂知识库非常友好。采用MoE架构(V4-Pro约1.6T总参数/49B活跃,V4-Flash更轻量),强调高效Agent能力和成本控制。 • 强项:长上下文理解、编码相关任务(SWE-bench Verified接近80.6%)、数学/推理(部分基准追平或接近顶级闭源模型)、极致性价比。开源权重已放出,支持本地部署和华为昇腾等国产硬件优化。 • 弱势:作为预览版,某些复杂Agentic任务(需要多轮工具调用、真实世界交互)可能还需进一步打磨,整体智能上限在部分基准上略落后于最新闭源旗舰。🔻• GPT-5.5: • 亮点:主打更快、更省Token,在编码、办公自动化、研究任务上优化明显。OpenAI宣称它在多项基准(包括Terminal-Bench、编码相关)超越同期竞品,Agent能力更“直觉”、能处理有限指令下的复杂工作流。 • 强项:通用智能、工具使用、实际生产力任务(写代码、调试、跨应用操作)、响应速度和效率。付费用户(Plus/Pro等)已可直接体验,生态集成(ChatGPT、Codex)成熟。 • 弱势:上下文窗口相对较小(此前系列多在128K-256K级别,未见1M标配),API定价较高,闭源限制了自定义和本地化。总结:• 长上下文/大文档/代码库级任务:DeepSeek V4明显领先,百万上下文不是宣传,是实际可用。• 通用Agent、生产力、复杂工作流:GPT-5.5更强,尤其在“省Token”和直观性上,实际使用中可能感觉更丝滑。• 编码/数学/推理:两者接近,DeepSeek在开源性价比上拉开差距,GPT-5.5在某些官方基准上略胜。• 多模态/综合体验:GPT-5.5目前更成熟(OpenAI生态加持),DeepSeek V4预览版据称有原生多模态潜力,但需验证。#DeepSeekV4和GPT5.5谁更强#
新浪微博 2026-04-24 00:00:00
9. 除夕迎「源神」?Qwen3.5以小胜大,捅破性价比天花板,大模型竞赛下半场开始了
微信公众号 2026-02-16 00:00:00
10. #DeepSeekV4发布# DeepSeekV4终于发布了,简单总结下:1、双版本发布:推出 DeepSeek-V4-Pro(高性能)和 DeepSeek-V4-Flash(高性价比)两个版本,可按需选择。2、超长上下文:支持 1M token(约百万字) 的上下文长度,能一次性处理海量信息。3、核心能力领先:在 Agent能力、世界知识和推理性能 三方面均达到国内及开源模型的领先水平。4、具体任务表现:V4-Pro版本的代理编码能力接近顶尖闭源模型,在数学、编程等推理任务上超越所有已开源评测的模型。5、技术创新与迁移提醒:采用 DSA稀疏注意力机制 降低长上下文计算成本;原有 deepseek-chat 等模型名3个月后停止使用,需迁移到新名称。
新浪微博 2026-04-24 00:00:00
11. #Google发布Gemini3.1Pro##过个有AI年##HOW I AI#美国AI大模型也加入春节大战!科技巨头Google更新了自家的大模型——Gemini 3.1 Pro,距离Gemini 3 Pro 上线仅三个月。Gemini 3.1 Pro这次升级的核心卖点是推理能力翻倍,但价格不变。在评估模型解决全新逻辑模式的ARC-AGI-2测试中,Gemini 3.1 Pro得分达77.1%,较Gemini 3 Pro的31.1%提升超一倍,显著领先Claude Opus 4.6(68.8%)和GPT-5.2(52.9%)。定价与 Gemini 3 Pro 完全一致。200k token 以内输入 $2/百万 token,输出 $12/百万 token;超过 200k 则为 $4/$18。能力大幅提升但价格不变,性价比明显提高。对比参考:Claude Opus 4.6 为 $5/$25,GPT-5.2 为 $1.25/$10。不过,Gemini 3.1 Pro被部分用户反馈性能不均衡,基准测试和真实体验有落差。不过考虑到目前仅是预览版,后面稳定版将会进一步优化。#老张聊科技#
新浪微博 2026-02-20 00:00:00
12. 盘点一周AI大事(4月12日)|Mythos太强不敢发布 Anthropic官宣最强大模型Claude Mythos OpenAI发布超级智能经济蓝图 Meta发布大模型 Muse Spark 智谱上线最强开源大模型GLM-5.1 Anthropic上线Agent包工头Claude Managed Agents Gemini上线概念可视化visualizations 阿里发布最强视频模型HappyHorse-1.0 米哈游发布最强数字人模型LPM 1.0 Ace开源最强音乐模型ACE-Step-1.5-xl 研究员开源最强虚拟试穿模型Vanast #前沿科技趋势发布月 #AI新星计划 #AIGC #大模型 #Agent
抖音 2026-04-12 00:00:00
13. “龙虾模型”能管公司?实测GLM-5-Turbo接入openclaw运营公司
哔哩哔哩 2026-03-17 00:00:00
14. DeepSeek悄悄地又发布了一份重磅报告。他们提出了 Engram,这是一种将查找表记忆与上下文感知门控融合在一起的记忆技术,并将其添加到他们的模型中。因此,无需强制密集层每次都对事实进行编码和重新计算。在相同的浮点运算次数下,MoE 的容量可以从「存储」转向「推理 + 长上下文」,从而提高知识水平和整体性能
新浪微博 2026-01-14 00:00:00
15. #2月DeepSeek还会发新模型吗#AI圈2月模型的发布和迭代处于一个高峰期!头部厂商扎堆上新大模型,DeepSeek的新模型动态目前其新模型已完成灰度测试,技术储备到位,大概率会在2月正式亮相。根据目前媒体的爆料来看,DeepSeek的新模型主要亮点应该在:1M Token超长上下文,可轻松处理完整长篇文档;Engram条件记忆架构,大幅降低推理成本;强化数学与代码能力三个方面。巩固开源领域优势,同时更新知识库,提升多模态文档理解能力。也是DeepSeek稳稳抓住关注的关键。因为“长上下文+低成本”的差异化优势,精准匹配法律、金融等专业场景,开源属性也贴合开发者与企业需求。#过个有AI年# #HOW I AI#
新浪微博 2026-02-24 00:00:00
16. #DeepSeekV4要来了吗#DeepSeek V4开启灰度测试,百万Token超长上下文与2025年5月的知识截止日期,让这款国产大模型成为春节档AI圈焦点。从技术来看,V4摒弃参数内卷,依托创新架构实现算力效率跃升,推理成本大幅降低,还深度适配国产芯片,让超长文本处理、代码跨文件分析成为现实,精准契合2026年大模型向高效实用演进的行业趋势。此前DeepSeek凭技术优势收获颇高热度,此次V4的升级,不仅补上了长上下文能力的短板,更让国产大模型在全球竞争中再添筹码。随着灰度测试推进,全量更新或很快落地,其兼具技术突破与国产化适配的双重优势,不仅能复现过往热度,更有望在AI普惠落地中,为国产大模型开辟新的增长空间。#DeepSeekv4要来了吗##HOW I AI##过个有AI年# deepseekv4要来了吗 川北小哥的微博视频
新浪微博 2026-02-11 00:00:00
17. 如何评价OpenAI最新发布的GPT-5.4 mini和GPT-5.4 Nano?
知乎 2026-03-18 00:00:00
18. 阿里通义千问 Qwen3-Max 上线「深度思考」功能,目前该功能用户使用体验如何?
知乎 2025-11-03 00:00:00
19. #DeepSeek v4 百万上下文# 直接就发布了,这次太炸裂,又是行业重磅!DeepSeek-V4已经正式上线并开源,其核心特点如下:拎几个重点来聊聊:1、百万上下文标配:Pro与Flash双版本均原生支持1M token超长上下文。2、领先性能:Agent能力、世界知识与推理性能达国内与开源领域领先,Agentic Coding性能登顶开源模型。3、架构革新:创新采用基于token维度的动态压缩与DSA稀疏注意力技术,大幅降低算力与显存消耗。4、双版本策略:推出Pro版(1.6T参数,49B激活)与Flash版(284B参数,13B激活)。5、开源生态:同步开源模型权重,并已完成对华为昇腾等国产芯片的深度适配。#DeepSeekV4发布##DeepSeekV4和GPT5.5谁更强#
新浪微博 2026-04-24 00:00:00
20. DeepSeek-V4预览版发布:开启百万上下文普惠时代4月24日,深度求索公司正式上线并开源DeepSeek-V4预览版。该模型具备百万字超长上下文能力,在智能体、世界知识和推理性能上实现国内与开源领域领先,标志大模型长文本处理进入新纪元。DeepSeek-V4系列包含两个版本:参数1.6万亿的DeepSeek-V4-Pro和参数2840亿的DeepSeek-V4-Flash。两者均基于超大规模预训练数据,并将百万上下文作为标准配置。性能方面,DeepSeek-V4-Pro展现出世界顶级水平。官方评测显示,其在Agentic Coding评测中达开源模型最佳水平,使用体验优于Claude 3.5 Sonnet,交付质量接近GPT-4o Opus非思考模式。在知识推理、数学、STEM和竞赛型代码测评中,V4-Pro超越所有已公开评测的开源模型,成绩比肩顶级闭源模型。技术突破在于全新注意力机制,通过token维度压缩结合DSA稀疏注意力,实现全球领先的长上下文处理能力,同时大幅降低计算资源和显存需求。模型针对Agent能力专项优化,深度适配Claude Code、OpenClaw等主流产品,在代码任务、文档生成方面表现显著提升。官方示例显示,V4-Pro能生成包含复杂数据表格、营销策略和排期规划的完整PPT方案。DeepSeek API已同步支持V4-Pro与V4-Flash,兼容OpenAI ChatCompletions和Anthropic接口。定价为:V4-Pro输入每百万token 12元,输出24元;V4-Flash输入每百万token 1元,输出2元。受限于高端算力,Pro版本服务吞吐量有限,预计下半年昇腾950超节点批量上市后价格将大幅下调。深度求索已在Hugging Face和ModelScope平台开源DeepSeek-V4模型权重并发布技术报告。
新浪微博 2026-04-24 00:00:00
21. Gemini上位苹果Siri,背后藏着谷歌三大狠招。 #大咖观察 #Siri #Gemini #iPhone #红衣聊AI
抖音 2026-01-22 00:00:00
22. 刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习
微信公众号 2026-02-03 00:00:00
23. ControlNet作者张吕敏最新论文:长视频也能实现超短上下文
微信公众号 2026-01-03 00:00:00
24. OpenRouter最新测算,3月30日至4月5日,全球AI大模型总调用量达27万亿Token,环比增长18.9%。中国AI大模型表现强劲,周调用量升至12.96万亿Token,环比上涨31.48%,已连续五周实现增长并超越美国。从全球模型调用量排名来看,前六位均被中国AI大模型包揽。Qwen3.6 Plus (free) 以4.6万亿Token的周调用量位居榜首;小米 MiMo-V2-Pro 本周下滑至第二位,周调用量为3.08万亿Token;Qwen3.6 Plus Preview 排名第三,周调用量为1.64万亿Token;阶跃星辰Step 3.5 Flash (free) 排名第四,周调用量1.26万亿Token;MiniMax M2.7 排名第五,周调用量1.19万亿Token;DeepSeek V3.2 位列第六,周调用量同样为1.19万亿Token。
新浪微博 2026-04-06 00:00:00
25. 【Claude的100万token上下文,是里程碑还是营销的障眼法?】快速导读:Claude把上下文窗口免费升到100万token,但别高兴太早。一线重度用户警告,这根本不是性能天花板,而是一个“烧钱陷阱”。真正的用法,跟你想的完全不一样。---Anthropic刚刚给Claude Opus 4.6用户送上了一份大礼:上下文窗口直接从200k升级到100万token,价格不变。很多人的第一反应是:太棒了,这下可以把整个代码库、几百页的PDF一次性扔进去了。你以为这是一个可以无限填充的超级大脑,但残酷的真相是,它更像一个巨大的、容易混乱的工作台。来自一线开发者和AI重度用户的密集讨论揭示了一个共识:模型的推理能力在上下文超过25万到40万token后,就会开始出现明显衰减甚至断崖式下跌。它不是遗忘了,而是开始“忽略”早期的指令,导致结果质量直线下降。那这100万token的意义何在?答案是“呼吸空间”,而不是一个新的性能上限。把它想象成高速公路上的应急车道。它的价值不在于让你全程在上面飞驰,而是在于当你的复杂任务(比如一个多文件代码重构)快要“撞墙”(触及旧的200k限制)时,能让你平稳地完成,而不会因为被迫压缩上下文(`/compact`)而中途“失忆”。专家们总结的最佳实践是:将大型任务拆解,确保核心推理环节在30万token内完成,然后主动开启新会话。所以,这暴露了一个新的技能鸿沟。天真的用户试图填满整个100万token窗口,结果不仅得到更差的输出,还因为每次交互都带着巨大的上下文,导致token额度以前所未有的速度被烧光。而聪明的用户,则把它看作一个安全气囊,同时利用环境变量手动设置一个更低的自动压缩阈值,实现成本和性能的平衡。当所有大模型厂商都在为上下文窗口的长度大搞军备竞赛时,真正的战场已经悄悄转移了。问题不再是你一次能喂给AI多少东西,而是你懂不懂如何管理它那块昂贵、健忘又极不稳定的“工作内存”。---简评:终于有人把皇帝的新衣戳破了。AI的上下文窗口就像办公桌,桌子再大,你一次也只能处理手边的几份文件。把一屋子文件全堆上来,只会让你找不到北。这标志着AI应用从“大力出奇迹”的蛮荒时代,进入了需要精细化运营的阶段。---ref: www.reddit.com/r/ClaudeAI/comments/1rst3zv/opus_46_now_defaults_to_1m_context_same_pricing#AI创造营##人工智能#
新浪微博 2026-03-14 00:00:00
26. Anthropic又“踢馆”!Sonnet 4.6操作电脑接近人类,性能堪比旗舰模型、定价仅1/5
知乎 2026-02-18 00:00:00
27. MiniMax M2.7+OpenClaw实战!AI到底能接管多少工作?
哔哩哔哩 2026-03-23 00:00:00
28. 「Github一周热点105期」Rust 版openclaw,本地语音克隆工具,Qwen3.5, AI 渗透测试系统和精美源码图片生成工具
哔哩哔哩 2026-02-28 00:00:00
29. Gemini 3实现智能水平断层碾压。Artificial Analysis智能指数73分(行业平均42分),在Humanity's Last Exam等基准测试中刷新纪录。核心突破在于生成式UI,可创建交互式界面和微型应用,从"回答问题"跃升至"生成体验"。原生多模态能力无缝处理文本、图像、视频、音频,并集成Nano Banana图像模型;支持100万token超长上下文。智能体能力实现自主规划与多工具协同,代码生成在SWE-bench达76.2%,搭配Antigravity平台构建自动化编码代理。响应速度达128 tokens/秒,但输出成本较高。Gemini 3无疑是当前最强大脑,适合需要顶尖推理和企业保障的场景;Grok 4.1以2M上下文和超低成本称王,适合海量文本处理;ChatGPT 5.1仍是均衡的通用选择,生态最成熟;国内Kimi K2在开源和Agentic方向独具特色,适合定制化部署#Gemini3凭什么被称为最强AI#
新浪微博 2025-11-19 00:00:00
30. 刚刚,阿里端出春节「硬菜」千问 3.5!我让它做了个拜年网页,结果出乎意料
微信公众号 2026-02-16 00:00:00
31. Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文
微信公众号 2026-04-17 00:00:00
32. 创新Transformer!面壁基于稀疏-线性混合架构SALA训练9B模型,端侧跑通百万上下文
微信公众号 2026-02-11 00:00:00
33. 谷歌Gemini 3.1 Pro屠榜封神,清华姚顺宇出手!Claude和GPT被逼入死角
知乎 2026-02-20 00:00:00
34. #deepseekv4和gpt5.5谁更强#DeepSeek V4与GPT-5.5同日登场,路线截然不同、各领风骚。GPT-5.5作为闭源旗舰,通用推理、跨工具Agent、办公工作流全面领先,综合基准屠榜、生态成熟,适合全球通用场景。DeepSeek V4主打开源+百万上下文,中文理解、长文档/代码库处理、低成本私有化部署优势突出,适配国产算力,性价比碾压闭源模型。论全能上限,GPT-5.5更强;论中文、长文本、自研落地,V4更实用。二者不是替代,而是互补,共同推动AI走向普惠与专业并行的新阶段。deepseekv4和gpt5.5谁更强
新浪微博 2026-04-24 00:00:00
35. 除夕夜,国产顶流压轴上线,QWEN3.5多模态开源!
微信公众号 2026-02-16 00:00:00
36. 大模型的上下文工程,都说很重要,但相关的研究那么少,对Agent开发有什么影响,有大佬能解释一下吗?
知乎 2025-11-27 00:00:00
37. OpenAI、Anthropic 和 Google 的工程师为什么从不为提示词发愁?秘诀在于“上下文栈”——真正的元技巧是“上下文工程”。过去,我们用提示词“黑客”式地与AI沟通,像用简单短语和关键词和陌生人对话。但现在的模型不只是理解指令,它们理解的是“环境”。你的工作不再是简单“提示”,而是设计它的上下文。什么是上下文?就是你在模型开始生成内容前搭建的数字环境,包括:- 它应该“扮演”的角色(身份)- 它的目标是什么- 它的沟通风格和语气- 它参考的例子、数据和过往作品这才是保证输出连贯、高质且符合品牌调性的关键。举个例子:旧式提示: “写一篇关于AI生产力工具的LinkedIn帖子。”上下文设计版: “你是一位技术创始人,写实用且能病毒传播的推文,语气自信且带点挑衅,基于真实案例。这里有你过去的三篇示例。现在,写一篇关于AI生产力工具的新推文。”区别就在于,你不是在“提示”,而是在“简报”。模型不再是工具,而是你团队的新成员。就像招新人一样,它需要了解你的品牌、目标和期待,而非随便发号施令。这就是“上下文工程”的力量。一个简单且实用的框架是4C: 角色(Character)、命令(Command)、限制(Constraints)、上下文(Context)。 一次设定,反复使用。有了正确的上下文,你的模型变成真正懂你声音、受众和意图的创意伙伴。没有它,你只是靠运气。停止“提示词黑客”,开始“上下文构建”。每次简报,都像培训新员工一样,问自己:“他们需要知道什么,才能像我一样思考?”这才是2025年AI合作的未来。掌握上下文工程,不只是问什么,更是给什么;不只是它写什么,更是它懂什么。创作者借此放大品味,创始人放大判断力,团队放大知识。你今天的上下文结构是什么样的?原文:x.com/hasantoxr/status/1995891151535259864
新浪微博 2025-12-03 00:00:00
38. 正面硬刚Gemini 3 Pro,阿里开源Qwen3.5-Plus|甲子光年
微信公众号 2026-02-16 00:00:00
39. DeepSeek V4终于发布了!昇腾首发,超长上下文记忆达1M,有V4-Pro和V4-Flash两个版本。性价比超高!这次每百万tokens输入最低仅需1元,输出仅需2元,Pro版本是12元和24元。什么水平?Flash版本跟GPT-5.4和Claude Opus 4.6比,输入分别低了约5倍和13倍,输出分别低了约52倍和85倍,快去试试吧~V4直通车:网页链接#DeepSeekV4发布# #DeepSeek v4 百万上下文#
新浪微博 2026-04-24 00:00:00
40. #DeepSeekV4更新了什么#DeepSeek‑V4:国产AI算力与技术双突破,以双版本架构、百万上下文、全栈国产算力三大突破,重新定义开源大模型上限。V4采用Pro+Flash双路线:Pro版1.6万亿参数、激活49亿,Agent能力超越Claude Sonnet 4.5,接近Opus 4.6非思考模式;Flash版2840亿参数、激活13亿,主打普惠,输入1元/百万tokens、输出2元/百万tokens,成本仅为GPT‑5.5的约1/20。全系标配1M上下文,依托自研DSA稀疏注意力,显存与计算量大幅下降,可一次性处理全书、大型代码库与长文档。最具行业意义的是,V4全面迁移至华为CANN框架,全流程跑在昇腾950PR,推理速度较H20提升2.87倍、能耗降40%,标志国产芯片可支撑万亿级模型训练与推理。当前Pro受产能限制高价限流,下半年量产放量后价格将下调,普惠可期。第三方测评显示,V4知识储备仅次于Gemini 3.1 Pro,与GLM‑5.1整体相当,长文本与成本优势突出;目前暂未开放原生多模态,为后续迭代重点方向。模型已深度适配OpenClaw等主流Agent,企业长文本任务成本可降约90%。从技术攻坚到算力自主,DeepSeek‑V4以长期主义推进技术普惠,不仅拉高国产AI天花板,更加速国产算力产业链商业化,为开源模型树立新标杆。#科技先锋官#
新浪微博 2026-04-26 00:00:00
41. 本地AI哪家强?统一内存大横评!
哔哩哔哩 2026-03-13 00:00:00
42. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen
抖音 2025-11-21 00:00:00
43. 盘点一周AI大事(1月11日)|最强人形机器人 OpenAI公布2026研发路线图 DeepSeek被爆2月发布DeepSeek V4 Google推出Veo3驱动的数字人Vids 字节开源换脸视频模型DreamID-V 阿里开源数字人框架HRM2Avatar Lightricks开源顶级视频模型LTX-2 ElevenLabs推出最强语音转录模型Scribe v2 斯坦福开源睡眠分析模型SleepFM 港大发布开源版NotebookLM DeepTutor Razer推出全息AI老婆Project AVA 波士顿动力推出下一代Atlas #抖音知识年终大赏 #前沿科技趋势发布月 #AI新星计划 #AI #机器人
抖音 2026-01-11 00:00:00
44. 告别KV Cache枷锁,将长上下文压入权重,持续学习大模型有希望了?
微信公众号 2026-01-02 00:00:00
45. #DeepSeek下个王炸是什么# DeepSeek2026年的王炸大概率聚焦长上下文与效率优化的深度融合,继2026年初灰度测试百万token上下文模型后,DeepSeek将完善相关技术,依托mHC流形约束超连接与Engram条件记忆模块,解决长序列计算的内存开销问题,实现100万token下的高准确率推理。DeepSeekV4完整版模型的发布应该也是DeepSeek的一个重要的更新,新模型将结合混合专家架构优化,延续DeepSeek低成本高性能的优势,让中小企业也能便捷接入顶尖AI能力。推动开发者共建垂直场景应用;贴合2026年AI从会生成向会行动的进化趋势。#HOW I AI#
新浪微博 2026-02-15 00:00:00
46. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?
知乎 2026-02-16 00:00:00
47. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?
知乎 2026-02-16 00:00:00
48. 【#DeepSeekV4Pro大幅领先其他开源模型#】4月24日, DeepSeek全新系列模型DeepSeek-V4 的预览版本正式上线并同步开源,据介绍DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本deepseek-v4-pro 和deepseek-v4-flash,其中DeepSeek-V4-Pro在 Agentic Coding 评测中,已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异;在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1;在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。(密度新闻)#DeepSeekV4深度适配国产算力##DeepSeek v4 百万上下文#
新浪微博 2026-04-24 00:00:00
49. Gemini 3.1 Pro 与 Claude Sonnet 4.6 深度对比:2026 年性价比之王花落谁家
微信公众号 2026-02-26 00:00:00
50. 【#DeepSeek唯一遗憾无多模态##DeepSeekV4再次开出行业最低价#】DeepSeek今日宣布,拥有百万字超长上下文的deepseek-v4-pro和deepseek-v4-flash两款模型发布并开源,即日起登录官网或官方App即可与最新的DeepSeek-v4对话,探索1M(百万)超长上下文记忆的全新体验。 据官方公布基准测评,在上下文长度、知识、推理及Agent等能力上,DeepSeekv4性能比肩国际顶级闭源模型,达到国际开源模型一流水平。《BUG》栏目对比发现,在API调用价格上,去年以一己之力撬动国内大模型行业降价的DeepSeek,V4版本再次开出了行业“最低价”。 据DeepSeek官方介绍,受限于高端算力,目前Pro的服务吞吐量十分有限,预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调。 “虽然每百万Tokens调用价格国内模型均未下降太多,但超长上下文长度及不俗的性能,让其极具竞争优势!”有业内人士感慨道:“那个大模型价格屠夫,又回来了!” 遗憾的是,目前v4版本依然是一款纯文本模型,没有太多的文生图、文生视频等多模态能力。(新浪科技 文) “价格屠夫”!DeepSeekV4百万上下文打到2毛,国产卡将腰斩API价格?
新浪微博 2026-04-24 00:00:00
51. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型
抖音 2025-11-23 00:00:00
52. 盘点一周AI大事(1月4日)|Google包揽年度最佳模型 LMArena大模型盲选排行榜公布年度冠军 Google推出AI辅助学习系统Learn Your Way 阿里开源最强手机智能体MAI-UI DeepSeek发布新研究mHC IQuest发布最强开源编码模型IQuest-Coder-V1 字节发布动态概念大模型DLCM 腾讯发布最强开源翻译模型HY-MT1.5 阿里更新最强开源图像模型Qwen-Image-2512 Meta开源极速视频生成模型HiStream 研究员开源对象植入模型InsertAnywhere 研究员开源MV智能体AutoMV 腾讯开源3D动作生成模型Hunyuan Motion 1.0 研究员开源高保真3D模型UltraShape 研究员开源世界模型Yume 1.5 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #AIGC
抖音 2026-01-04 00:00:00
53. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群
抖音 2025-12-22 00:00:00
54. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说
哔哩哔哩 2026-04-24 00:00:00
55. 刚刚,让谷歌翻身的Gemini 3,上线Flash版
微信公众号 2025-12-18 00:00:00
56. 如何评价最新发布的GPT-5.4模型?实际使用体验如何?
知乎 2026-03-06 00:00:00
57. 如何评价最新发布的GPT-5.4模型?实际使用体验如何?
知乎 2026-03-06 00:00:00
58. Claude 5史诗级泄露,史上最强编程模型评测炸裂!核心秘密曝光
知乎 2026-02-03 00:00:00
59. 明天,是GPT-4o的葬礼。
知乎 2026-02-13 00:00:00
60. #Easy同学正在独立开发# 今天学习了下一篇关于上下文工程的论文。看视频比看论文好多了
新浪微博 2025-11-04 00:00:00
61. 【#DeepSeek更新新模型# 上下文达百万级token】多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。《科创板日报》记者实测中发现,DeepSeek在问答中称自身支持上下文1M,可以一次性处理超长文本。记者在提交了超过24万个token的《简爱》小说文档,DeepSeek可以支持识别文档内容。
新浪微博 2026-02-11 00:00:00
62. 【AI Agent的终局不是无限上下文,而是60年前的操作系统】快速导读:大家都在卷百万上下文窗口,但一篇新论文和一线实践者的共识是:真正的解法是把AI的上下文当成一个文件系统来管。这不仅是理论,更是正在发生的事实。---几乎所有人都默认,AI Agent的瓶颈是上下文窗口不够大。从几千个token卷到上百万,仿佛只要窗口无限,AI就能包揽一切。但一篇名为《Everything is Context》的论文提出了一个反直觉的观点:解决上下文问题的最佳方式,是退回到60年前,像操作系统一样,把一切都视为文件系统。记忆、工具、外部源、人类笔记,都作为文件出现在一个共享空间里,只在需要时加载必要的部分。这不只是个学术脑洞。评论区里的一线开发者证实,他们早已在实践中这么做了。他们发现,真正的难题不是建立文件结构,而是决定“不加载什么”。上下文工程的核心,是战略性地遗忘,而不是暴力地堆砌。当AI的每一次信息调用都有时间戳和来源记录,调试Agent的过程就从“重跑一遍碰运气”,变成了像git-blame一样精确回溯。有人一针见血地评论:我们正在以惊人的速度,重跑一遍计算机科学60年的历史,最后发现,操作系统第一次就做对了。最好的想法不会消亡——它们只是在等待房间里的人跟上。---简评:长上下文的暴力美学走到了尽头,架构的优雅开始回归。从“大力出奇迹”到“万物皆文件”,不是技术倒退,而是认知升级。AI的未来,藏在计算机科学的过去里。---ref: x.com/rohanpaul_ai/status/2028184543040270769#AI创造营##人工智能#
新浪微博 2026-03-03 00:00:00
63. 如何评价 Anthropic 最新发布的 Claude Opus 4.6?有哪些技术亮点值得关注?
知乎 2026-02-06 00:00:00
64. 【#DeepSeek新模型更新#,#DeepSeek新版本灰度测试#】据鞭牛士,DeepSeek可能正在测试新的V4模型。科创板日报2月11日讯,多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。经实测,无论是安卓还是苹果,在手机App端和网页端,用户直接询问“你的上下文是多少”,得到的回答均显示DeepSeek的上下文窗口已达到约100万token。同时,知识歌更新时间也到了2025年5月份。这意味着它能一次性吃透极长的书籍、复杂的代码库或者海量的历史对话,而不会像以前那样聊着聊着就“失忆”。这一数据较此前版本有大幅提升,与目前行业头部模型的上下文容量处于同一水平。结合App版本的更新节奏,有观点认为DeepSeek可能正在为V4模型的正式发布做前期测试。截至发稿,DeepSeek官方尚未就新模型的相关信息发表回应。各位网友,您怎么看?(综合鞭牛士、科创板日报)@东方财经 #DeepSeek更新新模型#
新浪微博 2026-02-11 00:00:00
65. #DeepSeekV4 价格屠夫##DeepSeekV4 价格屠夫#刚用上GPT-5.5,转身就得给DeepSeek-V4让路,不到半天。OpenAI加价,DeepSeek降价,双管齐下让人哭笑不得。2元/百万Token的输出价,让Pro版12元的价格都显得“昂贵”,相比之下GPT-5.5 Pro高达180美元。Flash速度经济,Pro性能比肩顶级闭源,百万上下文还标配。当友商还在纠结性价比,DeepSeek已经用1.55‰的价格把Agent大战拉入普惠元年。算力成本遮羞布,这次真被扯干净了。 #DeepSeekV4比海外模型便宜约60%##黄仁勋预言的灾难仅9天就成真##DeepSeek昇腾首发#请问老黄现在作何感想?
新浪微博 2026-04-24 00:00:00
66. 2月18日,Anthropic正式宣布推出Claude Sonnet 4.6,并将其直接设为免费用户和Pro付费用户的默认模型。这一升级标志着公司进一步将高性能AI能力向更广泛用户群体开放。Claude Sonnet 4.6在编码能力、指令遵循、长上下文理解、代理规划、知识密集型任务以及设计等领域实现显著提升。模型新增beta版100万token上下文窗口,可一次性处理完整代码库、长篇法律合同或数十篇学术论文等超大文档。最受关注的在于,免费用户现可直接使用Sonnet 4.6作为默认模型,同时获得文件创建、外部连接器、技能调用、上下文压缩等此前部分受限的功能,而API定价保持不变(输入/输出每百万token分别为3美元/15美元,与前代Sonnet 4.5一致)。Anthropic官方表示,该模型在真实世界办公场景中的表现已接近甚至超过2025年11月发布的旗舰版Claude Opus 4.5,尤其在编码一致性和复杂多步任务执行上获得开发者高度评价。公司强调,Sonnet 4.6的计算机使用能力较前代有明显飞跃,能更可靠地完成需要与界面交互的自动化任务。此次更新距Claude Opus 4.6发布仅12天,反映出当前AI领域竞争的白热化与迭代速度。Claude Sonnet 4.6已即刻在claude.ai网页端、移动端、Claude Cowork生产力工具以及API和主流云平台全面上线,为数百万用户带来更强大、更普惠的AI体验。
新浪微博 2026-02-18 00:00:00
67. AI的未来,也许不在于模型规模的无限扩大。 #大咖观察 #红衣聊AI #transformer神经网络架构 #人工智能
抖音 2025-12-13 00:00:00
68. 盘点一周AI大事(12月28日)|最强开源大模型易主 智谱发布最强开源大模型GLM 4.7 MiniMax发布最强开源编码模型MiniMax M2.1 阿里开源超长上下文模型QwenLong-L1.5 字节发布最强数学模型Seed-Prover 1.5 英伟达开源游戏智能体Nitrogen 阿里开源语音对话模型Fun-Audio-Chat 字节开源短剧视频模型StoryMem 字节开源关键帧视频模型DreaMontage 奥特曼认为通用人工智能已成为过去式,并提出超级人工智能定义 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #OpenAI #大模型
抖音 2025-12-28 00:00:00
69. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何
哔哩哔哩 2026-02-19 00:00:00
70. 「Github一周热点104期」智谱GLM-5发布,打响春节AI大战模型第一枪
哔哩哔哩 2026-02-15 00:00:00
71. 小米 MiMo 团队负责人罗福莉:全球算力跟不上 Agent 时代的 Token 消耗,出路不是更便宜的 Token,而是更省 Token 的框架和更高效的模型共同进化。一个技术细节:OpenClaw 的上下文管理做得非常糟糕。一个用户请求会触发多轮低价值的工具调用,每次都带着超过 10 万 Token 的长上下文窗口,实际请求次数是 Claude Code 自身框架的好几倍。换算成 API 价格,真实成本可能是订阅价的几十倍。罗福莉提了两个观点:第一,短期阵痛反而是好事。第三方框架被迫走 API 付费后,成本压力会倒逼它们改进上下文管理、提高 prompt 缓存命中率、减少无效 Token 消耗。第二,呼吁其他大模型公司不要在没想清楚定价模型之前盲目打价格战。低价卖 Token 的同时对第三方框架大开门户,看着对用户友好,实际是个陷阱,Anthropic 刚从这个坑里爬出来。
新浪微博 2026-04-06 00:00:00
72. 今天DeepSeek V4预览版正式上线并开源,带来了百万上下文标配和全面提升的Agent能力;OpenAI也在同期推出GPT-5.5,主打更快、更省Token。那#DeepSeekV4和GPT5.5谁更强# ?我是觉得没有绝对的强者,只有更合适的选择。
新浪微博 2026-04-24 00:00:00
73. 艹 Claude 最近特别的好Claude Opus 4.6 和 Claude Sonnet 4.6,现在全部支持100 万上下文窗口了在 Claude Code 中, Max、Team 和 Enterprise 用户默认模型自动由原来的200k,升级到1M...价格没变,Opus 4.6 还是 $5/$25 per million tokens,Sonnet 4.6 还是 $3/$15。媒体限制扩大 6 倍。 单次请求最多可以塞 600 张图片或 600 页 PDF,之前上限是 100。不需要改代码。 之前用超长上下文要加 beta header,现在直接就能用,旧的 header 也不影响。
新浪微博 2026-03-14 00:00:00
74. #千问Qwen3.5大模型发布# 阿里“年夜饭”来了,开源全新一代大模型千问Qwen3.5-Plus。 总参数为3970亿,激活170亿,性能超过万亿参数的Qwen3-Max模型,部署显存占用降低60%,推理效率大幅提升,最大推理吞吐量可提升至19倍。 在推理、编程、Agent智能体等全方位基准评估中均表现优异,并在视觉理解能力的权威评测中斩获数项性能最佳。 支持长达2小时(1M token上下文)的视频直接输入,适用于长视频内容分析与摘要生成。#过个有AI年#
新浪微博 2026-02-16 00:00:00
75. DeepSeek v4全面支持百万上下文 token,这意味着什么?到底有多厉害?
知乎 2026-04-25 00:00:00
76. 【上下文工程实战指南:如何让AI代理真正听懂你的话】“AI垃圾输出”的锅,现在该用户来背了。在Claude Code这类黑箱系统中,上下文是我们唯一能控制的输入变量。既然如此,如何优化它就成了关键问题。+ 什么是上下文?上下文指的是你发送消息时提供给大语言模型的一切——不仅是提示词本身,还包括系统提示、元数据、历史对话、模型的思考过程、工具调用和响应。大模型的上下文窗口有限,对话越长,追踪信息的准确度就越低。Claude Code的上下文窗口看似有20万token,但实际可用空间远没那么多。运行/context命令就能看清真相:22.5%被预留,10.2%被系统提示占用,加上MCP服务器、子代理和规则,真正留给我们的只有约12万token。更关键的是,无论是否接近窗口上限,上下文越多,模型质量就越差。+ 基础功夫最重要和大多数事情一样,820法则同样适用于vibe coding。做好以下基础,你就已经完成了80%:- /upgrade升级到Max计划- /model选择opus 4.5- /init创建项目说明文件然后是基本工作流:1. 从计划模式开始(Shift + Tab)2. 让Claude通过提问来澄清模糊点3. 执行经过打磨的计划创建子代理、自定义命令、钩子、多代理编排确实很酷,但说实话,没有我们想象的那么重要。掌握基础才是核心竞争力。+ 如何实际运用这套工作流把每次新对话当作一个目标,严格控制范围:-“我要修复这个bug”-“我要构建这个功能”对于新项目,目标可以更宽泛,但这意味着需要更多规划和打磨——因为模糊性越大,误解空间就越大。多花时间规划,再多花时间打磨规划。让Claude不断提问,直到它开始为问而问。请它多次审查计划,讨论架构、最佳实践、安全风险、生产就绪度、测试策略——目标是在每个模糊点提供细节。+ 何时重置,如何重置如果进展顺利且后续任务与当前上下文相关,继续就好。接近上下文上限时,运行/compact释放空间,或让Claude Code自动处理。但如果事情不顺利呢?模型没做对,你陷入了“这太糟糕了请修复”→垃圾输出→“这更糟糕了你在想什么”→垃圾输出的循环。这时不要试图在同一线程中挽救,而是:- /rewind回到进展顺利的节点- /new开启新线程,优化原始提示词,明确指出“不要做什么”——把上次的教训写进去+ 避开复杂性陷阱如果你常刷社交媒体,可能已经收藏了无数花哨设置——MCP服务器、子代理、技能包……我的建议是:不要过度复杂化。正如Anthropic所说,我们的目标是“找到最小的高信号token集合”。往上下文塞太多MCP数据,只会用低信号填满窗口,同时烧掉你的钱。+ 善用MCP服务器获取优质上下文MCP服务器本质上是让模型能调用的第三方工具——文档、GitHub代码、Linear工单、Figma设计等。这类工具刚推出时被热捧,但人们很快发现很多会疯狂消耗上下文,得不偿失。我目前只用三个经过验证的:- exa.ai:AI代理的网络搜索- context7:AI代理的最新文档- grep.app:AI代理的GitHub搜索我主要用它们研究如何正确实现代码——这些事我自己查文档也能做。Anthropic把这称为“即时上下文”策略——代理在需要时自己寻找信息。这对Claude Code这类代理式编码工具非常有效。+ 用子代理节省上下文——我最喜欢的隐藏技巧Claude Code可以创建子代理——作为主代理的子实例运行。关键在于:- 子代理拥有独立于主代理的上下文窗口- 可以使用不同模型(比如非opus)这意味着我们可以让子代理执行消耗大量token的操作(如研究),然后向主代理提供精炼摘要——信息密度高,token消耗低。我最常用的是一个自定义的“图书管理员”子代理,运行sonnet模型扫描开源仓库和文档,向主代理返回精炼摘要。我会说:“用librarian研究如何用Y库实现X,然后实现Z”——子代理触发,调用所有工具找到高质量答案。这既防止主上下文被污染,又用更便宜的模型完成简单任务。+ 用技能包引入相关上下文技能包与子代理相反——不是把任务委派给专门代理,而是把专业能力引入当前代理的上下文。比如Claude Code内置的“前端设计师”技能,会引入一段较长的提示词,告诉Claude前端设计的注意事项。这些工作流听起来花哨,但原理很简单——Claude只是在认为需要时,把一段文本拉入上下文。+ 核心要义好的vibe coding是为价值密集的上下文而优化。你添加或从模型接收的任何信息,都应简洁地服务于帮助模型回答下一个请求。如果做不到这点,就不应继续在同一上下文中工作——这是避免陷入令人沮丧的垃圾输出循环的关键。社交媒体上那些花哨命令可能让你觉得自己落伍了。但实际上,事情没那么复杂——尽力用简洁、高质量的信息帮助模型,给它工具让它自己找到相关信息。就像你对待一位同事那样。x.com/jarrodwatts/status/1926054877836624014
新浪微博 2026-01-07 00:00:00
77. 最具性价比的 Claude Sonnet 4.6 发布了
知乎 2026-02-18 00:00:00
78. 刚刚,GPT-5.4 突袭上线!百万上下文,AI 操作电脑,首次超越人类!
微信公众号 2026-03-06 00:00:00
79. 「Github一周热点107期」OpenAI收购的AI安全工具、AI代理事务所、OpenClaw技能库、claude code插件和上下文数据库
哔哩哔哩 2026-03-21 00:00:00
80. TRAE中国版白送SOLO,一人指挥一支AI大军 重磅消息!SOLO终于上线TRAE中国版了,Waitlist免费开放中 本期视频实测TRAE的新版本,亮点很多 1、先规划再动手的 Plan 模式 2、带专家团一起干活的 Subagent 子智能体 3、DiffView 差异视图 4、多任务并行 5、上下文智能压缩长时运行不掉链子 SOLO终于把AI从“瞎干活的外包”变成了“懂协作的队友” #AI #人工智能 #TRAE #AI编程 #vibecoding
抖音 2025-11-26 00:00:00
81. 给大家解释一下,DeepSeek V4的百万上下文亮点在于,主要解决了普通人用AI经常聊着聊着,或者分析内容的时候,经常忘记上面说话的问题。以后你用DeepSeek V4的模型聊天,AI更能通过上下文,理解你的意思。DeepSeek还是以前的风格,车展日搞突然袭击。
新浪微博 2026-04-24 00:00:00
82. 大模型的记忆能力现在完全靠内存的大小决定,也就是上下文的大小决定了当前大模型的智能水平。这与去年我们玩小模型硬吃显存的逻辑是不一样的。现在经过量化的小模型已经能稳定地高效产出tokens。我在本地的gemma4上下文测试时一直对话,上下文的用量除着对话不断抬升内存用量,直到拉满然后爆炸了。从内存用量一半到爆炸,GPU显存几乎纹丝不动。也就是说对显存的需求被量化的压缩给控制住了。硬件从GPU的算力,发展到了存储容量的记忆力比拼。所以各大厂商都在无限堆推理上下文内存。但对内存的依赖应该在算法上可以优化,将上下文进行关键压缩和向SSD固化,需要时再对内存激活。不过内存厂家也是SSD厂家。这就是为什么最近半年多,内存被拉冒烟的根本原因。当LLM的算法遇到scaling law的天花板,内存大小决定了智能化程度。注意算法扰动,如果真出现数倍级压缩算法,那么内存的预期就会被暴击。因为现在认为内存决定能力还看不到天花板。我们迫切需要内存上下文量化技术和内存版MOE的出现。
新浪微博 2026-04-18 00:00:00
83. 不知道大家想过这个问题没有,大家都感觉现在大模型的记忆存储受限,200万的上下文记忆其实也不够用。但我想说,其实即使大模型能够记住海量的上下文,也未必有用,它依然需要上下文的管理。也就是说,在AI时代,一个人非常重要的能力就是如何去管理上下文,去领导Agent。为什么这么讲呢?大家可以想想,如果记忆不受限,大模型可以无限存储,你和它聊的内容越多,它大脑里塞的东西就越满。在执行任务的过程中,它不知道到底应该怎么去执行,因为塞的东西太多了,哪个是核心的?是不是太多了?如果记忆太多,就容易导致错乱和模糊,因为你塞得太满,它不知道怎么执行,很多东西在里面很乱。所以,上下文管理是必须的。第二,即使大模型的记忆非常多,人和人之间沟通,一句话的理解都可能不同,何况大模型和人之间的沟通呢?这里面肯定也会存在交流的摩擦。所以,人需要及时干预和介入到大模型的工作流程当中,去管理上下文、管理整个流程,这是非常必要的。所以大家不要期待说,大模型的上下文越来越长就越好,不一定,有利有弊。即使大模型不会丢掉记忆,记忆永存,它依然不会精准地按照人类的要求去执行。我之前看过一个调查或研究,就是说大模型里,你上下文塞得越多越满,它的执行就会越混乱、越模糊,就是因为东西太多了,它不知道怎么执行了。所以,管理上下文这个事情,依然需要有人去管理、去做。#科技先锋官##How I AI#
新浪微博 2026-04-11 00:00:00
84. 网页链接langchain发了篇官博,探讨了智能体如何利用文件系统进行上下文工程,以提升其性能和可靠性。智能体失败的主要原因并非模型能力不足,而是缺乏正确的上下文信息。上下文工程的目标是精准地将必要信息填入模型的上下文窗口,避免信息缺失、冗余或不相关。常见的上下文工程挑战包括: 信息过多(检索内容远超所需):如网络搜索返回大量无用内容,浪费token并增加成本。 信息过少或超出上下文窗口:复杂任务需大量信息,单次无法加载全部。 难以定位小众信息:所需信息埋藏在大量文件中,语义搜索效果有限。 缺乏持续学习能力:无法从交互中积累新知识。文件系统是解决这些问题的关键工具,其优势体现在: 作为“草稿板”:将大体积工具输出(如网页内容)存入文件系统,按需通过grep等工具提取关键信息,减少上下文占用。 动态管理上下文:存储长期计划、子任务结果或复杂指令,按需调用,避免系统提示过载。 精准搜索:利用ls、glob、grep等命令在结构化目录中快速定位特定文件、行甚至字符,尤其适合代码或技术文档。 持续学习与自我更新:智能体可通过用户反馈更新自身“技能文件”,将新知识写入文件系统,实现长期记忆与能力进化。#科技先锋官#
新浪微博 2025-11-23 00:00:00
85. #用声音马住中国年##微博声浪计划# DeepSeek近期因技术升级引发用户集中吐槽,交互温度骤降。旧版用个性化昵称,新版统一改称“用户”,语气从细腻共情转为短句说教,情感支持功能弱化。转变源于技术优化与情感体验的权衡,为提升长文本处理能力,降低情感交互模块权重。用户立场分化,官方称V4正式版将恢复相关功能。 科技开的微博音频
新浪微博 2026-02-14 00:00:00
86. 大模型上下文工程指南
知乎 2026-04-12 00:00:00
87. DeepSeek v4全面支持百万上下文 token,这意味着什么?到底有多厉害?
知乎 2026-04-26 00:00:00
88. #微博声浪计划##听见微博# DeepSeekV4发布,采用双版本架构,旗舰版V4-Pro参数达1.6万亿,轻量版V4-Flash性价比高。适配华为昇腾芯片,推理速度超英伟达H20的2.87倍,能耗降40%。推动国产算力自主,带动产业链发展,长文本处理优势显著,但暂未支持多模态。 谯华的微博音频
新浪微博 2026-04-25 00:00:00
89. 最新数据显示,Anthropic 的 Claude 在企业级大模型 API 市场份额正式反超 OpenAI:2023 年 OpenAI 占 49%,Claude 只有 11%;两年后,Claude 干到 30%,OpenAI 掉到 24%,直接翻盘。其实这个结果也是意料之中,过去两年,OpenAI在To C端狂奔做生态:ChatGPT App、GPT Store、小程序……但企业客户更关心的是:数据能否隔离、模型是否稳定、能否内嵌到自己的系统里。Anthropic恰好踩中这条赛道,用Claude 3系在文档理解、长文本、合规可控上的优势,稳稳切走了金融、法律、医疗等高利润行业。OpenAI在做超级入口,Anthropic在做超级供应商。C端属于OpenAI,但B端的金矿,正在被Claude挖走。#ai#
新浪微博 2025-10-28 00:00:00
90. DeepSeek v4全面支持百万上下文 token,这意味着什么?到底有多厉害?
知乎 2026-04-26 00:00:00
91. 「Github一周热点112期」DeepSeek V4王者归来,一个项目玩转GPT-Image-2
哔哩哔哩 2026-04-25 00:00:00
92. #DeepSeekV4要发布了吗#DeepSeek V4 最新爆出的消息来看,主要的变化就是上下文窗口扩至100 万 token,编程基准 SWE-Bench 达83.7%,原生多模态、创新架构降低显存占用,延续高性价比,API 定价仅为海外竞品的 15%-30%,预计 2 月底至 3 月初正式发布。现在市场比较关注DeepSeek V4 编程与长文本处理能力是否真的跻身全球第一梯队?是否真的能够实现以算法创新打破算力内卷,普惠企业与开发者?DeepSeek作为一款专业大模型覆盖能力是否能够解决开发工具与行业解决方案的生态体系问题。DeepSeek V4会成为2026年的第一炸吗?
新浪微博 2026-02-26 00:00:00
93. DeepSeek-V4 发布了,全系标配百万上下文,一口气读完《三体》没问题。#DeepSeekV4发布# Pro 版性能很强,据说代码快赶上 Claude 了,Flash 版主打便宜大碗,速度快还省电。最关键是彻底跑通了华为昇腾芯片,不用英伟达了,这步棋挺硬气。#DeepSeek v4 百万上下文# API 也换了新名字,老接口七月底就停了,用的人都得改。话说回来,现在国产模型进步真快,以前觉得遥不可及的能力现在都开源了。不过 Pro 版现在因为芯片少有点贵,还得排队,打算先玩玩 Flash 版试试水,等下半年降价了再说。#DeepSeekV4#
新浪微博 2026-04-24 00:00:00
94. #DeepSeekV4发布# 这算是千呼万唤始出来,终于发布了。DeepSeek今天正式发布V4系列预览版并同步开源,分为V4-Pro和V4-Flash两个版本,主打100万(1M)超长上下文能力,官网、App及API均已同步更新。V4-Pro在Agent能力、世界知识、数学推理等多项评测中达到开源模型最佳水平,推理性能比肩顶尖闭源模型;V4-Flash则以更小的参数量提供更快速、更经济的API服务,适合轻量场景。技术层面,V4采用全新注意力机制,结合DSA稀疏注意力,在大幅压缩计算和显存需求的同时,实现百万级超长上下文。DeepSeek表示,1M上下文将成为旗下所有官方服务的标配。此外,V4针对多款主流Agent产品进行了专项适配优化。旧版API接口模型名deepseek-chat和deepseek-reasoner将于2026年7月24日正式停用,用户需提前切换至新模型名。#老张聊科技# deepseekv4发布
新浪微博 2026-04-24 00:00:00
95. 终于,全球 AI 圈等待了几个月的 DeepSeek V4,它终于来了!今天上午,DeepSeek API 文档上线.此次,DeepSeek V4 按大小会有两个版本,分别是 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。上下文长度是 100 万 tokens。同时,输出长度最大为 384K tokens。 #DeepSeekV4发布# #DeepSeekV4和GPT5.5谁更强#
新浪微博 2026-04-24 00:00:00
96. 当前,如何评价Gemini、Claude、ChatGPT、DeepSeek和Grok的综合表现?
知乎 2026-04-08 00:00:00
97. 【#DeepSeekAPI更新百万Token上下文#,看齐 App 及网页版】4 月 22 日消息,今日有大量用户反馈称,DeepSeek 官方 API 已经更新到了与客户端及网页版相同的 1M tokens 上下文版本(似乎是此前曝光的 DeepSeek V4 Lite),比之前的 128k 上下文更长。与此同时,最新 DeepSeek 的知识库已经更新到 2025 年 5 月,非联网状态下可准确输出 2025 年 4 月的新闻。另外,该模型仍不支持视觉输入,仅支持文本和处理语音,依然为非多模态模型。#DeepSeek##AI大模型#
新浪微博 2026-04-22 00:00:00
98. #Kimi建议网友先用DeepSeek# 最近Kimi因太受欢迎导致算力紧张,竟建议网友“先用DeepSeek”,这波操作太圈粉了!作为登顶OpenRouter榜单的模型,Kimi本可强留用户,却为体验着想坦诚分流。DeepSeek擅长复杂逻辑推理,可快速生成初稿、搭建框架,Kimi则精于长文本处理与细节润色。二者配合,效率拉满,这才是AI该有的格局,为Kimi点赞!#Kimi好卑微#
新浪微博 2026-02-09 00:00:00
99. 「人类负责消除歧义,AI 负责在较少歧义的环境下执行」。看上去这是一个上下文问题,但有三种情况,上下文是人类提供不了的。第一种情况是,这个人是个外行,他根本不知道必要的上下文。第二种情况是,这个人是个内行,但他目前还没有掌握必要的上下文,得在随后的思考和实践过程中,一步步探索和理解关键约束。第三种情况是,上下文的信息量过于庞大,无法浓缩与输入,其中还有不少是 “体感” 一类的不容易翻译成语言的信息,或者上下文分散在不同的人那里(协作场景),无法约束所有人整齐划一地输入。缺乏必要的上下文,AI 就不可能输出可靠的概率计算结果。
新浪微博 2026-03-02 00:00:00
100. 使用 Gemini 3 Pro Vibe Coding Flutter 的进展,个人管理软件,添加了时间记录的功能。我说强到没边,不是没有依据的而且哦,我没有用 Agent 工具,只是在 AI Studio 里面,提出要求,LLM 给出实现,我人工搬进代码里,有了运行效果或者 Bug,再跟 LLM 聊,所有 Vibe 部分都在 AI Studio 里面进行。这样做很低效,但是有个好处,就是充分发挥了 Gemini 3 Pro 的超长上下文能力,比起 Agent 工具每次创建一个新的上下文(丢失背景),LLM 能够了解事情的来龙去脉。得益于 Gemini 3 Pro 的 100w Token 上下文,一个对话能聊很久,网页这两天出点 bug,看不到上下文开销了,也不知道实际用多少了。也就是 AI Studio 免费用,要是自己调 API,这么长的上下文,每次往里做增量调用,每次输入都是几万、几十万 token,得花很多钱
新浪微博 2025-11-29 00:00:00
101. 【苹果新款Siri明年春季发布:融入谷歌Gemini大模型】由于苹果自研大模型进展不顺,苹果如今决定引入谷歌Gemini大模型提供技术支持,让新版Siri更智能、功能更强。苹果拟每年支付谷歌约10亿美元,获取定制化Gemini模型使用权,核心版本为1.2万亿参数的Gemini 2.5 Pro。该模型将负责Siri的信息摘要、任务规划、复杂多步指令执行等核心功能,相比当前Siri使用的1500亿参数云端模型,处理能力、上下文理解深度实现量级跃升,支持多模态交互与128K token超长文本处理。苹果新款Siri明年春季发布:融入谷歌Gemini大模型
新浪微博 2025-11-06 00:00:00
102. #DeepSeekv4要来了吗# 大家还记得去年春最火的三件套吗?今年的春节也马上到,DeepSeekV4要来了,这个很真实了吧。进入灰度测试阶段,也就表明正式版已经不远了。更牛的地方是说,该模型支持 100 万 Token 超长上下文,知识截止日期为 2025 年 5 月。有个尝试的小技巧:“你的上下文长度是多少”,会被告知上下文长度为128K,知识截止日期是24年7月,说明当前为老版本然后切换在手机端再问一下,如果知识库更新到25年5月,那恭喜你,灰测成功。#HOW I AI##过个有AI年#deepseekv4要来了吗
新浪微博 2026-02-11 00:00:00
103. iPhone 17 Pro Max太空探月/AI生成“X片”以假乱真/阿里Qwen 3.6-Plus登顶
微信公众号 2026-04-05 00:00:00
104. DeepSeek-V4发布,百万上下文来了
微信公众号 2026-04-24 00:00:00
105. DeepSeek V4 预览版发布
微信公众号 2026-04-25 00:00:00
106. DeepSeek V4 预览版正式发布
知乎 2026-04-24 00:00:00
107. DeepSeek-V4开源
微信公众号 2026-04-25 00:00:00
108. DeepSeek API 更新百万 Token 上下文,到底改变了什么?
知乎 2026-04-24 00:00:00
109. DeepSeek V4震撼发布
知乎 2026-04-25 00:00:00
110. DeepSeek V4来了
微信公众号 2026-04-24 00:00:00
111. DeepSeek-V4 震撼开源!百万上下文,推理比肩闭源
今日头条 2026-04-25 00:00:00
112. 一百萬 token 到底能夠做哪些事情?
知乎 2026-03-23 00:00:00
113. 上下文窗口再大,也装不下真正的理解
今日头条 2026-03-09 00:00:00
114. OOLONG
微信公众号 2025-11-07 00:00:00
115. 为什么 200k 以上的上下文,可能并没有你想的那么重要
知乎 2026-01-04 00:00:00
116. 上下文窗口越大越好吗?聊聊长上下文的代价
微信公众号 2026-04-12 00:00:00
117. LLM上下文工程指南
微信公众号 2026-04-07 00:00:00
118. 【智能体漫游】百万Token上下文窗口是个陷阱
微信公众号 2026-01-30 00:00:00
119. 更大的上下文窗口为什么让RAG变得更重要而非更多余
知乎 2026-03-14 00:00:00
120. 为什么大模型都在卷上下文窗口?更大上下文真的有用吗?
微信公众号 2026-04-23 00:00:00
121. 长上下文军备竞赛结束了
微信公众号 2026-04-25 00:00:00
122. 🌋 大模型长上下文|正确率暴跌❗️。🔥大模型集体翻车!平均正确率仅17.2%!颠覆认知的CL-Bench测试结果
抖音 2026-02-05 00:00:00
123. 百万字上下文
微信公众号 2026-02-02 00:00:00
124. 为什么AI大模型都在拼“上下文长度”?
微信公众号 2026-04-10 00:00:00
125. 对长上下文能力有不同要求,怎么选择合适的模型?
知乎 2025-12-17 00:00:00
126. 文章分享丨腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习
什么值得买 2026-02-20 00:00:00
127. 让AI不胡说、不跑偏的核心技术——上下文工程
微信公众号 2026-02-28 00:00:00
128. QwenLong-L1.5发布
微信公众号 2025-12-30 00:00:00
129. QwenLong-L1.5
微信公众号 2025-12-25 00:00:00
130. 【今日短讯】FlashPrefill
微信公众号 2026-03-25 00:00:00
131. 2026年实测
什么值得买 2026-03-21 00:00:00
132. 大模型应用要学会分而治之的思想
知乎 2025-12-23 00:00:00
133. 实测DeepSeek V4百万上下文能力
微信公众号 2026-04-25 00:00:00
134. DeepSeek V4 发布全解析
今日头条 2026-04-25 00:00:00
135. 解读DeepSeek-V4预览版上线
微信公众号 2026-04-24 00:00:00
136. deepseekV4刚刚官宣!百万上下文 AI 正式开源,中国企业第一次站在世界顶流
微信公众号 2026-04-25 00:00:00
137. DeepSeek V4实测
今日头条 2026-04-25 00:00:00
138. 爆款标题
今日头条 2026-04-24 00:00:00
139. Qwen3.5开源397B版,8毛钱1百万token
小红书 2026-02-17 00:00:00
140. 100万上下文全面上线!Claude两款4.6模型取消长文本溢价,支持直塞600张图
微信公众号 2026-03-14 00:00:00
141. 告别 1M 上下文“免费午餐”
知乎 2026-04-01 00:00:00
142. Qwen3.5技术报告解读
知乎 2026-04-08 00:00:00
143. 刚刚,阿里千问Qwen3.5-Plus登顶全球最强开源模型,推理效率提升8.6倍
微信公众号 2026-02-16 00:00:00
144. Claude 最新版到底值不值得折腾?聊聊我这两周的真实体验
知乎 2026-03-23 00:00:00
145. 阿里Qwen3.5-Flash实测
知乎 2026-02-27 00:00:00
146. Qwen3.5 35B封神!M1 Ultra 64GB RAM实测60 tokens/秒,保姆级调参
今日头条 2026-03-03 00:00:00
147. Qwen3.5 27B实测
今日头条 2026-03-01 00:00:00
148. 告别 Token 焦虑!Qwen3.5 + OpenClaw 本地部署完整教程
今日头条 2026-04-07 00:00:00
149. Qwen3.5-122B实测翻车?128GB M4 Max仅跑10toks,别人却能40+
今日头条 2026-04-15 00:00:00
150. 64GB M5pro实测Qwen 3.5 122B!开源免费还能跑满32k ctx?
今日头条 2026-04-14 00:00:00
151. Qwen 3.5多模态训练能力提升
知乎 2026-02-16 00:00:00
152. Qwen3.5小型模型全面剖析,揭秘其核心技术亮点
今日头条 2026-03-23 00:00:00
153. Qwen3.5模型深度评测
知乎 2026-03-05 00:00:00
154. The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试
微信公众号 2026-03-25 00:00:00
155. OpenClaw 解锁 Qwen3.5 效率密码
微信公众号 2026-03-25 00:00:00
156. 深度解析Qwen3.5中的MTP(多token预测)技术
微信公众号 2026-03-15 00:00:00
157. 本地部署 Qwen3.5 模型
微信公众号 2026-04-01 00:00:00
158. Claude 3.7 来了!程序员的第一反应是什么?
微信公众号 2026-04-15 00:00:00
159. Kimi深度测评
微信公众号 2026-04-06 00:00:00
160. 别再用错大模型了!2026年国产AI大模型实测对比,帮你省掉大几千
今日头条 2026-04-17 00:00:00
161. 百万上下文上线!DeepSeek 专家模式发布,国产大模型专业能力再突破
微信公众号 2026-04-10 00:00:00
162. 2026 年 4 月第一周大模型技术进展汇总
微信公众号 2026-04-07 00:00:00
163. 2026 国内最新大模型实测
知乎 2026-04-14 00:00:00
164. DeepSeek深夜发布V4大模型“百万上下文”时代彻底来了
今日头条 2026-04-24 00:00:00
165. 刚刚,Opus 4.6「百万上下文」全量上线!Claude Code 直接封神
知乎 2026-03-14 00:00:00
166. DeepSeek-V4预览版上线:迈入百万上下文普惠时代
今日头条 2026-04-24 00:00:00
167. 刚刚,DeepSeek悄悄测试新模型:百万token上下文、V4要来了?
今日头条 2026-02-11 00:00:00
168. 官方定档4月下旬!DeepSeek V4实测:万亿MoE+百万上下文
今日头条 2026-04-15 00:00:00
169. DeepSeek-V4 横空出世!百万字上下文标配,性能比肩顶级闭源模型
今日头条 2026-04-24 00:00:00
170. DeepSeekV4来了:百万上下文开源!国产AI掀起性价比革命
什么值得买 2026-04-24 00:00:00
171. Gemini vs Claude 技术硬核对决:长文本处理、推理架构深度对比
什么值得买 2026-03-21 00:00:00
172. LongBench-Pro:25个评测任务全面揭示46个大模型的真实长上下文能力
知乎 2025-12-13 00:00:00
173. 百万Token上下文的“皇帝新衣”
今日头条 2026-04-01 00:00:00
174. QwenLong-L1.5:长上下文推理的后训练优化
知乎 2025-12-16 00:00:00
175. 上下文窗口有多重要?它决定了你的 AI 产品“智商上限”
微信公众号 2026-04-19 00:00:00
176. 碾压海外巨头!DeepSeek V4百万上下文标配,国产AI再突破
今日头条 2026-04-24 00:00:00
177. 模型够强还不够,上下文和技能才是分水岭
微信公众号 2026-04-11 00:00:00
178. 别卷上下文窗口了!MIT新研究:让LLM学会‘递归’拆解,性能完爆硬抗长文本
微信公众号 2026-01-05 00:00:00
179. 180万行源码+ 3万条数据记录!DeepSeek V4百万上下文极限能力实测!
哔哩哔哩 2026-04-25 00:00:00
180. 为什么大模型要限制上下文长度?不是故意卡你,是你没找对记忆方法
知乎 2026-03-15 00:00:00
181. AI提示词工程已死? 浅谈大模型上下文工程(Context Engineering)
微信公众号 2025-11-17 00:00:00
182. ClaudeOpus4.6技术深度拆解:百万上下文、AgentTeams与自适应思考
什么值得买 2026-04-14 00:00:00
183. 长上下文建模综述
知乎 2026-02-11 00:00:00
184. 给AI一个文件系统就够了:Coding Agent用grep和sed碾压专用长上下文模型
微信公众号 2026-04-01 00:00:00
185. 上下文干旱:LLM 窗口的物理极限
微信公众号 2026-03-16 00:00:00
186. 大模型应用开发-2 上下文工程
知乎 2026-04-05 00:00:00
187. Claude 4.6 新功能全解读:百万上下文开启AI编程新纪元
微信公众号 2026-03-25 00:00:00
188. GPT-5.2 Codex长上下文处理技术深度解析
微信公众号 2025-12-23 00:00:00
189. 一个 pip 命令,让大模型突破上下文长度限制!MIT 开源 RLM 递归推理引擎火了
微信公众号 2026-04-21 00:00:00
190. 长上下文推理技术综述
微信公众号 2026-04-16 00:00:00
191. Claude Opus 4.6 发布:百万上下文开启智能体协作新纪元
微信公众号 2026-04-05 00:00:00
192. 【炸裂】刚刚,DeepSeek 突然上线 V4!全球首发"百万字上下文",开源阵营彻底变天
微信公众号 2026-04-24 00:00:00
193. AI Agent核心:别再混淆!上下文管理≠记忆系统,一篇讲透原理与落地
微信公众号 2026-04-17 00:00:00
194. 上下文达百万Token 实测DeepSeek风格突变 V4将至?
今日头条 2026-02-12 00:00:00
195. 清华、智谱推出Glyph框架:通过视觉-文本压缩扩展上下文窗口
微信公众号 2025-10-30 00:00:00
196. 长上下文窗口≠万能?AI Agent 的上下文难题与解决办法
知乎 2025-11-06 00:00:00
197. 国产大模型哪家强?2026 年 4 月三大模型横评:智谱GLM-5.1、千问 Qwen3.6-Plus 与Kimi K2.6 实测对比
哔哩哔哩 2026-04-23 00:00:00
198. AI大模型如何提高上下文长度?
知乎 2025-11-25 00:00:00
199. 🫖 上下文窗口到底是什么?为什么聊着聊着 AI 就“失忆”了?
微信公众号 2025-11-14 00:00:00
200. DeepSeek‑V4 实测:百万字上下文、Agent、逻辑推理一次看全
微信公众号 2026-04-26 00:00:00
201. 上下文窗口:AI能记住多长的对话? - AI小知识
微信公众号 2026-03-29 00:00:00
202. 什么是长上下文窗口?-AI小知识
今日头条 2026-01-26 00:00:00
203. 长上下文大模型综述:挑战、价值与技术路径
知乎 2025-12-17 00:00:00
204. 5万字剧本自动分集,长文本处理谁最强
知乎 2026-04-08 00:00:00
205. 浅解大模型的上下文窗口
微信公众号 2025-12-25 00:00:00
206. 为什么大模型都在刷上下文窗口,1M真的够用了吗?
微信公众号 2026-03-30 00:00:00
207. DeepSeek-V4预览版开源上线!百万上下文加持,硬刚全球顶级模型
今日头条 2026-04-24 00:00:00
208. 大模型上下文详解
知乎 2025-11-27 00:00:00
209. 2026年4月AI大爆发!GPT-6、Claude Code、国产大模型8大重磅动态
微信公众号 2026-04-20 00:00:00
210. DeepSeek V4 来了!百万上下文时代,正式开启
微信公众号 2026-04-24 00:00:00
已收藏
去我的收藏夹