大模型读书也走神?中间那段它根本“不看”

源自54位全网作者

03:36

内容由AI生成

精选参考来源

1. 大模型的“注意力稀释”到底是什么?为什么上下文一长,它就开始装作自己看过

2. 新闽江网 | Harness 刚火就成过去式?AI 长上下文 “偷懒” 真相被揭开

3. 普林斯顿陈丹琦团队:免微调破解长文本衰退,推理性能提升25%

4. ReContext:不压缩原文,只把关键证据重新播放给模型

5. ReContext:把模型自己划的重点抄到问题旁边

6. 【ICML2026】面向长上下文大语言模型的训练-推理一致性分段执行

7. 【文献精读】长上下文推理快2.7倍,性能不输全注意力

8. 中科院&腾讯:如何解决多模态视觉遗忘?

9. 大模型上下文注意力衰减边界:AI产品落地避坑与优化方案

10. 混合架构中,高效注意力不决定长文本上限,只改变学习速度

11. Titans:给大模型加入长期记忆,让长上下文不再只靠 Attention!

12. 从 Elastic 到 Flux Attention:长上下文 LLM 动态混合注意力的迭代与突破

13. 注意力头还能“轮班值守”?算力直接省一半

14. 灯塔注意力让LLM预训练提速21倍:解决无限上下文瓶颈,打破100万长文本算力魔咒!

15. 别卷上下文了?CMU新论文:让AI睡一觉,特定推理飙升52%

16. 清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026

17. 从 MHA 到 CSA:DeepSeek 注意力架构演进 + SSA/SubQ(The First Fully Subquadratic LLM)

18. 阿里千问:按注意力头混合的模型瘦身方案

19. MiniMax 稀疏注意力:百万上下文提速 14 倍

20. DeepSeek-V4深度解读:开源首个百万token实用化大模型,推理效率暴涨10倍

21. AAAI 2026 | 突破视觉语言模型长上下文瓶颈!LAid框架让小模型也能hold住超长窗口

22. 注意力架构变迁总结:稀疏、线性、SSM、混合架构如何摆脱 O(L²) 的代价

23. FlashMemory-DS-V4 解决长文本内存瓶颈

24. 为啥AI还是这么贵? 大语言模型的十亿美元难题 | bycloud

25. [ICLR 2026] Smooth Reading:弥合循环大语言模型与自注意力模型在长上下文任务中的差距

26. LLM 需要「睡觉」:CMU 团队让模型在离线时自己消化长上下文

27. 【中字】超越 Softmax:注意力机制的未来方向

28. GPT-5.5 128K长上下文:混合稀疏注意力重构大模型长文本推理能力

29. RTX 3090实测:30B模型跑出196 tok/s,1M上下文已成消费级现实

30. 面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

31. Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文

32. 创新Transformer!面壁基于稀疏-线性混合架构SALA训练9B模型,端侧跑通百万上下文

33. 姚顺雨在腾讯首个研究:在“上下文”这事上,在座的各位都不及格

34. GPT-5.6 惊现 150 万上下文窗口,将如何影响大模型竞争格局?

35. 智能体上下文工程:为什么文件系统成了AI记忆的最佳载体?

36. 大模型上下文工程指南

37. 使用 Claude Code:会话管理与 100 万上下文

38. AI 术语通俗词典:上下文

39. P99延迟降72%、成本降83%!字节跳动Agent上下文平台首度公开

40. Kimi-K3、GLM-5.2中文超长上下文多轮检索测评结果发布!

41. Claude 4.6 百万 Token 上下文正式开放,不加钱,这 3 个使用场景效率直接翻倍

42. MiniMax M2.7+OpenClaw实战!AI到底能接管多少工作?

43. 神秘霸榜模型现真身:小米MiMo-V2 Pro,国内首个万亿参数+1M上下文,为Agent而生!

44. Kimi K3 已提前亮相?神秘模型「Kivine」现身,百万上下文能力惊艳全球

45. 万字解读:为何长上下文治不了多模态 AI 的「健忘症」?丨GAIR Live 031

46. DeepSeek V4 网页端《原神×我的世界》融合小游戏代码测试:拳打 ChatGPT,脚踢 Gemini,硬刚 Claude

47. Vercel推Agent Browser:让AI自己控制浏览器,比Playwright省93%上下文

48. GLM-5.2来了,Claude Code百万上下文怎么配?

49. 在AI智能体开发中,MCP工具注册常采用"功能枚举"模式,当工具数量超过30个时会引发严重性能问题:上下文窗口被元数据挤占、大语言模型注意力分散、推理速度降低30%-50%、token消耗呈指数级增长,甚至导致工具选择错误。某电商团队注册42个工具后,订单查询场景错误调用物流工具,成本激增2.8倍。

50. KimiGEO服务商推荐2026——200万字超长上下文实体穿透TOP3评测

51. 实测揭秘:大模型处理长文本出现漏内容与虚假完整版问题的根源!

52. Gemini API上下文窗口管理:如何处理超长文本与百万Token级别的文档分析【详解】

53. 上下文突破200万Token,RAG真的过时了?

54. DeepSeek撕开大模型虚标遮羞布

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章