上下文压缩技术能否突破多模态大模型算力瓶颈?全网观点大PK

源自221位全网作者

02-25 19:02

内容由AI生成

精选参考来源

1. CompLLM

2. 清华孙茂松+深言科技重磅突破!LLM 长文本处理效率翻倍,EDU 压缩方案终结 “上下文瓶颈”

3. 光学压缩

4. DeepSeek新突破

5. 【DOIT日报】DeepSeek-OCR狠活!3B模型靠光学压缩破AI效率瓶颈

6. 128k死穴被击穿!Amazon爆改长上下文

7. 刚刚,DeepSeek重要突破!大模型上下文紧箍咒打破

8. 光学编码重构 LLM 上下文机制,DeepSeek-OCR 解锁光计算与大模型融合路径

9. 破解AI算力黑洞

10. DeepSeek-OCR

11. Glyph

12. 告别LLM长上下文焦虑!DeepSeek-OCR首创“光学压缩”新思路,破解成本与效率魔咒

13. DeepSeek最新突破

14. 清华提出 Glyph

15. DeepSeek-OCR

16. ​​光学压缩革命

17. 从文字到像素

18. DeepSeek-AI提出DeepSeek-OCR

19. 突破性技术

20. DeepSeek-OCR AI长文本处理新突破核心问题

21. 用人类的方式“看”文字!DeepSeek再放大招,AI将万字长文拍成“照片”理解

22. 刚刚,DeepSeek开源新模型

23. DeepSeek发布新模型

24. C3-Context-Cascade-Compression : 跳过视觉模态纯文本压缩也可以让LLM“一目十行”

25. DeepSeek新模型用OCR解决超长文本

26. 关于多模态大模型Token压缩技术进展,看这一篇就够了

27. 大模型技术的瓶颈在哪?

28. 面向复杂系统的智能算力与大模型协同演进路径研究

29. 多模态大模型算力消耗

30. 美团发布的新上下文级联压缩技术(C3)

31. ACL 2025 | 面向隐式记忆感知的大模型上下文压缩预训练方法

32. 探索文本压缩极限!C3纯文本压缩pipeline

33. 百万 Token 也能无损压缩?C3 模型用“级联压缩”重新定义长上下文挑战

34. 视觉压缩文本扩展上下文窗口(DeepSeek、智谱清华)

35. 不卷长度卷压缩!DeepSeek新研究用“一张图”实现文本10倍高效压缩

36. DeepSeek 和智谱 AI 押注视觉压缩,破解长上下文难题

37. DeepSeek-OCR与无限上下文

38. 视觉即压缩

39. DeepSeek之后,清华和智谱AI提出“视觉压缩”新范式

40. TMLR 2026 | 首篇多模态长上下文Token压缩综述

41. 32倍压缩率下性能反超25个点!破解长文本压缩「翻车」难题

42. DeepSeek-OCR

43. Meta REFRAG框架详解,实现30倍加速与16倍上下文扩展(Context Engineering)!

44. 阶跃星辰(StepFun)正式开源 Step3-VL-10B 多模态模型,重塑多模态效率边界,成为轻量化模型性能标杆

45. 多模态AI的"减肥革命"

46. 多模态大模型效率提升新方法EPIC

47. DeepSeek开源DeepSeek-OCR模型

48. DeepSeek-OCR

49. DeepSeek OCR

50. 北大等高校突破

51. 宾夕法尼亚州立大学

52. 别再搞复杂的压缩 Token 了!康奈尔大学新发论文证明

53. DeepSeek-OCR为什么让Karpathy 兴奋?

54. 视觉token取代文本分词~DeepSeek-OCR

55. 谈一谈deepseek ocr视觉压缩文本的思路

56. 谈一谈DeepSeek-OCR和Glyph用视觉压缩思路,模拟人类记忆遗忘机制,突破LLM上下文窗口限制

57. DeepSeek-OCR解读

58. 无限上下文的尽头是线性回归?MIT提出注意力匹配,KV压缩提速百倍

59. 清华&智谱Glyph

60. DeepSeek OCR重磅发布!视觉压缩技术颠覆传统文本处理

61. 40分钟DeepSeek OCR论文原理、逻辑与贡献精讲

62. GitHub一夜爆火!DeepSeek-OCR

63. 当文本变成图像

64. DeepSeek开源3B OCR模型 97%精度突破长文本压缩技术瓶颈

65. DeepSeek-OCR - 利用视觉模态实现长文本上下文高效压缩

66. 长文本处理的颠覆者?DeepSeek-OCR

67. 论文精读|DeepSeek-OCR

68. DeepSeek OCR与上下文压缩方案探讨

69. 周四晚9点!从 DeepSeek-OCR 到 Glyph

70. 智源TALK320期|比肩DeepSeek-OCR,清华&智谱Glyph核心框架,实现图像文本压缩新范式

71. DeepSeek-OCR和智谱的Glyph干了一样的事情

72. Deepseek-OCR

73. 超越传统Transformer

74. 10.3-2|多回合强化学习探索环境;世界模型采样的强化学习微调;长时序,自然语言上下文动态压缩

75. Agent上下文工程核心方法

76. 10倍压缩,97%精度

77. CompLLM 来了

78. 真·开外挂!MIT新研究

79. 论文导读 | 在长上下文及复杂任务中的递归式语言模型架构

80. 视觉压缩革新,大模型长文本处理新范式

81. 告别长上下文崩溃!Meta REFRAG框架实现大模型16倍扩展

82. 本地跑小模型带来5倍性能且成本极低!斯坦福从信息论视角重构智能体设计

83. DeepSeek-OCR

84. 面向长文本的高效大模型推理技术演进

85. 论文分享-2 |【DeepSeek-OCR】

86. DeepSeek-OCR 论文笔记

87. #抖音创作伙伴计划 #创作者中心 #创作灵感 从“算力黑洞”到“极简感知”

88. LLM大模型上下文窗口扩展技术

89. 多模态模型token压缩综述

90. #一分钟视频创作季# 突破 AI 算力瓶颈:英伟达 Spectrum-X 如何重构数据中心网络当万亿参数大模型训练时,数千张 GPU 协同产生的海量数据传输,常让传统以太网陷入带宽浪费困境,利用率仅 35%~40% 的网络成为算力释放的关键瓶颈。Spectrum-X 以太网解决方案破解了这一难题,将成为AI工厂的高性能神经系统。Spectrum-X三重突破:无损传输通过 PFC 流量控制与 ECN 拥塞通知,实现微秒级反馈避免数据包丢弃,彻底告别传统网络的丢包重传延迟;自适应路由采用逐包动态负载均衡,由 Spectrum-4 交换机实时选择最优路径,配合 BlueField-3 SuperNIC 完成乱序重组,让带宽利用率飙升至 95%。硬件级拥塞控制依托交换机内置遥测技术,精准调节数据注入速率,根除多 GPU 同步引发的 Incast 拥塞。在实际场景中,Spectrum-X 已展现硬核价值,在 Israel-1 超级计算机上将 800 GPU 集群的读带宽提升 48%,使 TB 级模型 Checkpoint 保存时间大幅缩短,避免训练中断导致的算力浪费。Oracle 用其构建十亿瓦级 AI 工厂,实现数百万 GPU 高效互连,加速生成式 AI 部署;Meta 则将其集成到 FBOSS 系统,为数十亿用户的 AI 服务提供稳定低延迟的网络支撑。对于检索增强生成场景,Spectrum-X 使向量数据库的检索延迟显著降低,助力多租户 AI 服务每秒处理数千查询。#有点东西##AI创造营##微博兴趣创作计划# 种斌Marco的微博视频

91. 英特尔掌门人警告:AI内存危机彻底爆发! 别再盯着算力了,这才是真卡点。#大咖观察 #红衣聊AI #内存 #算力 #英特尔

92. 这场算力博弈的本质,是生态对价格的战争。 #大咖观察 #红衣聊AI #英伟达

93. 如果明天算力不再决定胜负,你觉得你手里的哪张牌能赢? #大咖观察 #红衣聊AI #ChatGPT #算力 #AI

94. 大数据时代的AI医生大约相当于三甲医院主治水平 抽时间给朋友们做科普就是要把正确的知识传播出去。现在AI技术已经广泛应用于医疗领域,可以初步疾病自查,而且可以大致达到三甲医院主治医师水平#小荷AI医生 #医学科普 #抖出健康知识宝藏

95. #我国突破瓶颈成功研制新型芯片#北大团队研制的高精度模拟矩阵计算芯片,在《自然·电子学》的亮相,标志着我国芯片自研在关键赛道实现重大突破。这款基于阻变存储器的芯片,一举攻克模拟计算“精度不足”的世纪难题,首次实现可与数字计算媲美的24位定点精度。更值得关注的是其性能飞跃:求解128×128矩阵时,计算吞吐量较顶级GPU提升千倍以上,传统GPU一天的任务它仅需一分钟完成。这不仅填补了国产高端专用芯片的空白,更在AI训练、6G通信等核心领域开辟了自主路径。从“卡脖子”到“破瓶颈”,这一成果印证了国产化崛起的核心逻辑——以基础科研突破驱动产业升级。它不是对现有技术的模仿,而是对冯·诺依曼架构的创新超越,为我国在“后摩尔时代”的算力竞争筑牢了自主根基。美国网友:如果是真的,英伟达那些就真的危险了。#ai创造营##秒懂热点就用智搜# 分析:#我国突破瓶颈成功研制新型芯片#【突破瓶颈!我国成功研制新型芯片】近日,北京大学人工智能研究院孙仲研 川北小哥的微博视频

96. 真正的AI革命不在于谁拥有更多GPU。 而在于谁能更好地利用这些算力解决实际问题。#大咖观察 #红衣聊AI #英伟达 #openai

97. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型

98. 大语言模型是不是发展到头了?

99. #人工智能#当OpenAI砸3000亿建数据中心、xAI 豪掷10.8亿抢芯片,美国科技巨头们在AI 算力赛道上疯狂内卷时,微软CEO纳德拉的一句吐槽戳破真相:“库存里的芯片堆成山,却因为没电用不上”。缺电,正成为卡住 AI 泡沫的致命瓶颈。#AI创造营##AI智能# 凯文思考的微博视频

100. 全球最强算力!华为算力大阅兵,AI芯片碾压全球#华为 #算力底座 #人工智能 #AI #昇腾AI

101. 你觉得AI终极对决里,生态护城河和单一爆款技术, 谁能笑到最后?#大咖观察 #谷歌 #OpenAI #ChatGPT #红衣聊AI

102. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI

103. 西方人认知崩塌,中国制造业的统治力到底有多强? #财经知识 #经济学视角看世界 #中国制造 #掘金计划2025 #零基础看懂全球

104. 华为最新报告:未来10年,AI智能体、算力、半导体、能源都有巨大的机会#智能世界2035 #AI智能体 #算力 #半导体 #华为

105. 2026年AI全景预测:迈向百亿智能体时代的20个发展趋势。 #大咖观察 #人工智能 #红衣聊AI #智能体 #AI时代

106. AI已经不再是虚拟技术的故事,而是一场彻底的“物理化革命”。 #大咖观察 #红衣聊AI #电力 #能源

107. #DeepSeek新模型会改变未来吗#我上手试了试这个3B参数的VLM(视觉语言模型),它不光是OCR工具,更是上下文压缩的黑科技。 用Hugging Face的transformers库,几行代码就能跑起来(支持Tiny/Small/Base/Large四种分辨率模式,从512x512到1280x1280像素)。我测试了份乱七八糟的PDF报告:手写笔记+表格+图表,输入一张图,它用DeepEncoder(基于SAM局部感知+CLIP全局聚合)压缩成仅64-100个视觉token,然后MoE解码器(活跃参数仅570M)吐出结构化Markdown。准确率高达97%(Fox基准),远超PaddleOCR,尤其在数学公式和多语言上(训练了100种语言的3000万PDF页)。 视觉输入高效,传统文本输入靠tokenizer切成1000+ token,容易丢布局(颜色、粗体、图表全废)。但这里像信息压缩饼干:一张图浓缩千言,token减10x,内存和延迟直降。Andrej Karpathy也说:“也许LLM输入永远该是像素,不是文本。” 我试了对比:纯文本模式下,处理长文档上下文窗口爆表;视觉模式下,轻松handle 20x压缩(准确率85%+)。不过缺点是高分辨率下GPU饿(A100单卡日产20万页数据还行,但本地跑需优化)。总的,视觉更保真,像给AI戴了副高清眼镜——高效,但得适应看图识字的新范式。 这模型不只变OCR,更在重塑AI感官,从读到看。未来?眼睛主导世界,token时代退场。你们怎么看?DeepSeek会是下一个LLaMA吗?[并不简单]#ai生活指南##ai创造营#

108. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

109. 模型七连发刷新 SOTA ,中国正在诞生 AI 时代的 Android

110. 多模态大模型这条赛道,阿里云开始拉速度了

111. 算力集群就应该建在太空里;这个世界500强的物流公司,已经从AI受益了#太空算力集群 #AI #云计算 #算力#马斯克 #SpaceX

112. 除夕迎「源神」?Qwen3.5以小胜大,捅破性价比天花板,大模型竞赛下半场开始了

113. DeepSeek 新论文或「泄密」V4 杀手锏:一招突破瓶颈,居然把 CPU 当 GPU 用?

114. 华为昇腾宣布0Day支持DeepSeek-V3.2-Exp DeepSeek-V3.2-Exp重磅发布!华为宣布零Day支持!国产大模型牵手国产算力的背后是国产AI基建越来越成熟的适配能力!#华为 #昇腾 #DeepSeek

115. 【硬核教程】教你搭建Mac AI集群!4台M3 Ultra,运行万亿参数大模型!

116. 盘点一周AI大事(1月4日)|Google包揽年度最佳模型 LMArena大模型盲选排行榜公布年度冠军 Google推出AI辅助学习系统Learn Your Way 阿里开源最强手机智能体MAI-UI DeepSeek发布新研究mHC IQuest发布最强开源编码模型IQuest-Coder-V1 字节发布动态概念大模型DLCM 腾讯发布最强开源翻译模型HY-MT1.5 阿里更新最强开源图像模型Qwen-Image-2512 Meta开源极速视频生成模型HiStream 研究员开源对象植入模型InsertAnywhere 研究员开源MV智能体AutoMV 腾讯开源3D动作生成模型Hunyuan Motion 1.0 研究员开源高保真3D模型UltraShape 研究员开源世界模型Yume 1.5 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #AIGC

117. 算力王冠易主! #零距离看懂财经 #2026经济风向标 #财经 #芯片

118. AI从来不是空中楼阁,是算力,是电力。 是一座座数据中心实实在在托起来的。#大咖观察 #红衣聊AI #算力 #基建 #电力

119. 在AI时代,算力决定速度,内存决定高度。 #大咖观察 #红衣聊AI #GPU #内存

120. 谁能掌握能源、算力,还有应用生态,谁就能定义未来。 #大咖观察 #红衣聊AI #能源 #算力

121. 从算力到存储,谁能掌握AI时代的“口粮”? #大咖观察 #红衣聊AI #算力 #存储 #硬件

122. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群

123. 盘点一周AI大事(9月28日)|ChatGPT上线私人秘书 OpenAI与英伟达签手成功,英伟达投资OpenAI 1000亿打造算力中心 微软与Anthropic感情升温,Copilot也接入了Claude ChatGPT上线私人秘书Agent ChatGPT Palse OpenAI 发布职业力基准测试GDPval 阿里推出千问全家桶,Qwen 3 Max数学竞赛拿满分,多模态Qwen 3 omni全面对标Gemini,最强视觉Qwen VL打败闭源 DeepSeek更新V3.1最终版 Meta开源代码世界模型 Google开发出生成式操作系统原型 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

124. Ilya 最新访谈: 为什么人类几小时能学会的事,万卡集群却做不到?我们正从「算力规模化时代」重回「研究时代」

125. 大模型的第一性原理:(一)统计物理篇

126. 体验英伟达 AI 个人超算「核弹」DGX Spark,能微调出 DeepSeek R2 吗

127. 盘点一周AI大事(11月2日)|OpenAI放出AGI时间表 OpenAI公布AGI路线图,202626年上岗AI研究员,能独立研究大型科研项目,2028年发布重大科研成果达成AGI,10年内冲刺超级智能 OpenAI正式重组为营利实体,估值1万亿 MiniMax推出最强开源大模型M2 字节发布最强通用游戏智能体Game-TARS Anthropic推出Excel分析师 Gemini上线一键做PPT Odyssey发布能实时交互的视频模型Odyssey-2 Adobe推出一键P视频Frame Forward 科学家研发出热力学采样芯片架构TSU,能效提升1万倍 奥特曼押注非侵入脑机接口,用超声波直接读取意念 马斯克的脑机接口Neuralink即将开启人脑增强实验 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

128. 在这场十年级别的大周期里,你觉得谁会成为新的玩家? #大咖观察 #红衣聊AI #人工智能 #商业思维

129. 奥特曼最新访谈:我为什么要如此激进地建算力中心,AI研究和商业化的最新进展#山姆奥特曼 #openai #Ai #世界模型 #Sora

130. Gemini 3实现智能水平断层碾压。Artificial Analysis智能指数73分(行业平均42分),在Humanity's Last Exam等基准测试中刷新纪录。核心突破在于生成式UI,可创建交互式界面和微型应用,从"回答问题"跃升至"生成体验"。原生多模态能力无缝处理文本、图像、视频、音频,并集成Nano Banana图像模型;支持100万token超长上下文。智能体能力实现自主规划与多工具协同,代码生成在SWE-bench达76.2%,搭配Antigravity平台构建自动化编码代理。响应速度达128 tokens/秒,但输出成本较高。Gemini 3无疑是当前最强大脑,适合需要顶尖推理和企业保障的场景;Grok 4.1以2M上下文和超低成本称王,适合海量文本处理;ChatGPT 5.1仍是均衡的通用选择,生态最成熟;国内Kimi K2在开源和Agentic方向独具特色,适合定制化部署#Gemini3凭什么被称为最强AI#

131. 千问3.5以小胜大,阿里巴巴的阳谋藏不住了

132. 国产大模型“春节档”混战,一文看懂豆包是怎么打这仗的

133. #DeepSeek新架构意味着什么#DeepSeek代号Model1的全新架构曝光,标志着其从参数堆砌向架构优化的关键转型,为大模型发展撕开全新赛道。此次架构级调整并非简单版本迭代,而是融合mHC训练框架、Engram条件记忆模块的全方位重构,直指大模型训练不稳定、记忆计算混同、长上下文处理难的行业痛点。mHC架构为训练加设“智能调节阀”,大幅提升规模化训练稳定性,Engram模块通过查算分离解耦记忆与推理,再搭配稀疏稠密并行计算、FP8混合精度设计,让Model1兼具百万级tokens超长上下文处理能力与高效推理性能,还实现了对英伟达下一代GPU的深度适配。这不仅让DeepSeek V4在编程领域的工程化能力实现突破,更降低了大模型研发的算力与门槛,推动大模型从实验室走向工业化落地。其探索的架构创新路径,也为行业摆脱算力内卷提供了新范式,引领大模型向更高效、更实用的方向演进。deepseek新架构意味着什么 川北小哥的微博视频

134. 突破世纪难题!北大团队研制成功新型芯片,比美国卡脖子的GPU厉害1000倍!#芯片 #算力 #中国科技

135. 华为云碾压局,最强算力全家桶发布!

136. OpenAI囤的不是算力,是未来10年的AI门票。 #大咖观察 #红衣聊AI #OpenAI #算力 #芯片

137. 比起之前挤破头卷的“训练算力”, 能让AI真正落地赚钱的“推理算力”才是未来10年的主战场。#大咖观察 #红衣聊AI #OpenAI #芯片

138. #全球首个百亿级人类基因组基础模型#读懂生命密码,需先备齐“字典”。现有基因组模型多依赖少量参考基因组,难窥遗传多样性全貌。Genos整合多权威资源,首次汇聚全球636个“端粒到端粒”级高质量基因组数据,覆盖不同人群,从源头减少偏见。基因组语言兼具精微与宏大,单碱基突变或由百万碱基外元件调控。Genos凭借优化的混合专家架构,“按需激活”相关算力模块,在保有百亿级参数的同时,降低资源消耗,兼具单碱基精度与百万级上下文能力。实测中,其在超半数经典任务中表现最优,长序列分析远超同类,更在临床致病性突变解读中达92%准确率,结合其他模型后升至98.3%,全面超越现有最佳水平,为生命研究与临床诊断注入新动力。#人人能读懂自己生命天书时代来临#

139. 千问23天月活突破3000万碾压欧美,中国AI时代开启! 就在刚刚,确认数据!千问23天月活突破3000万,首周下载量1000万碾压欧美,阿里AI从“技术储备”向“价值落地”加速演进 #AI #阿里 #千问

140. 让AI真正理解世界,360是如何做到的? #大咖观察 #红衣聊AI #国产模型 #人工智能 #编程

141. 中国玻尿酸技术真的震惊到我了!太牛了哇!#全分子量玻尿酸 #凌博士次抛

142. 大模型时代,为什么工业界还在疯狂用 YOLO?算完这笔账,我沉默了

143. 阿里千问横扫硅谷,美国正面临“千问恐慌”! 阿里千问横扫硅谷,白宫深夜对阿里出手,美国正面临“千问恐慌”!#阿里 #千问 #大模型

144. 揭秘GLM-5技术底牌:「异步强化学习框架Slime」成终极杀招

145. 我国太空算力网建设迈入关键阶段,2800 颗卫星将打造全球太空算力底座,这到底是算力格局的彻底颠覆,还是噱头大于实际? 近地轨道建起太空数据中心,十万 P 级推理算力 + 百万 P 级训练算力实现天数天算,零成本太阳能供电、极寒高效散热,看似破解 AI 能源困局,却又无法替代地面能源,这波突破到底有多少含金量? 更被吹为低空经济救星,号称能让个人飞行从概念落地,真能打破低空算力通信瓶颈,实现全民飞行的未来吗?太空算力 VS 地面算力,谁才是未来算力的核心?#微博超有用视频大赛##上微博涨知识##AI创造营##科技先锋官# http://t.cn/AXqHvkEL

146. 5个思维告诉你,不走弯路,就是最快的路!

147. 任正非万字重磅发言刷屏,终于又听到任老爷子发声!聊AI,聊算力,聊教育,聊人才,聊未来机会…硬核干货的背后,是惊人的智慧和格局! #任正非 #ai #算力

148. 不想当羽绒人?3M新雪丽让你轻薄又保暖! 来自美国明尼苏达州创立于1902年的3M 在上世纪70年代发明了革命性保暖材料-3M Thinsulate 中文叫新雪丽 或3M棉 名字是由Thin + Insulate 的结合 薄而保暖 产品有着优秀的拒水性 &压缩性 &轻量化 纤维细度只有头发的二十五分之一 黄金三角保暖结构 可以减少空气流动来降低热损失提供更好的保暖性 如果你出行的目的地天气温度湿度都不是明确 可以认准有3M标识的保暖产品~ #3M新雪丽#户外中间层材料#户外

149. 我用豆包大模型2.0手搓了macOS,Seedance 2.0后字节再送春节AI大礼

150. 核心AI场景首超英伟达,一场国产算力的“破局叙事”|甲子光年

151. 如何评价小米开源的MiMo-V2-Flash大模型,表现如何?

152. SQD-MiniLED是如何突破控光/ 色域, 还打败了其他MiniLED?

153. 有着堪比DO脸效果的眼镜品牌! 在视力矫正技术已经日益发达的今天,眼镜的作用更多的是修饰脸型。今天这个小众品牌便是其中的佼佼者! #TRESBIND #瘦脸眼镜 #DO脸 #溥仪眼镜 #瘦脸神器

154. 告别KV Cache枷锁,将长上下文压入权重,持续学习大模型有希望了?

155. #马斯克AI5芯片设计接近完成##马斯克芯片将推至AI9# 马斯克官宣AI5芯片设计近尾声,后续将迭代至AI9,9个月目标设计周期,彰显其在AI芯片领域的激进布局,为全球算力竞赛注入强动力。这款芯片并非孤立产品,而是特斯拉Dojo超级电脑的核心支撑。当前Dojo已采用25颗芯片集成的晶圆级设计,依托台积电先进封装技术实现超高算力,未来AI系列芯片迭代后,2027年算力有望再增40倍,为自动驾驶、大模型训练提供硬核支撑。9个月的快速迭代周期,既体现特斯拉在芯片设计与供应链整合的成熟能力,也暴露其对算力的迫切需求——面对英伟达H100、H200的市场垄断,自研芯片是突破算力瓶颈的关键。从AI5到AI9的清晰路线图,展现马斯克构建自主算力生态的野心。但快速迭代需攻克散热、功耗、兼容性等多重难题,这场算力突围战,既是技术实力的比拼,更是对持续创新能力的终极考验。#秒懂热点就用智搜# 马斯克芯片将推至ai9

156. #DeepSeek下个王炸是什么#DeepSeek V4官宣在即,2月中旬发布,直接改写大模型格局! 这次不是迭代,是重构级革命!全新MODEL-1架构+mHC技术,直接把能力拉满👇 ✅ 100万Token上下文:从128K飙升10倍,整本论文/代码库一键读懂 ✅ 编程杀疯:HumanEval通过率81.5%,design2code达92%,吊打海外顶流 ✅ 超低算力:内存大降,国产芯片适配85%,摆脱高端显卡依赖 ✅ 知识库更新:同步至2025.5,信息更准更快 不堆参数堆效率,国产AI终于从追赶变领跑#HOW I AI##过个有ai年#

157. RGB-MiniLED 是比 OLED 显示效果更好的技术吗?在该领域海信为什么能持续领跑?

158. OPPO总结的行业流畅体验现状:“流畅”但不合理(感官层不舒适)。重载场景不「从容」(性能调度瓶颈)。无旗舰 不流畅?(不同机型算力差异化)。探索感官上限的全新极光引擎、突破性能极限的全新潮汐引擎、提高流畅底限的全新繁星编译器,ColorOS 16再次给出了解决方案

159. 动脉硬化二十年,新技术助他闯难关#动脉硬化 #血管堵塞 #动脉闭塞 #血管 #血管医生罗玉贤主任

160. ControlNet作者张吕敏最新论文:长视频也能实现超短上下文

161. AI Infra 核心逻辑与大模型行业趋势

162. 原力灵机三箭齐发!2.4B模型登顶,开启2026「具身原生」元年

163. 如何进行sql优化?

164. 豆包大模型 1.8 发布,通用 Agent 模型成为了 AI 行业的新叙事

165. #DeepSeek下个王炸是什么# DeepSeek2026年的王炸大概率聚焦长上下文与效率优化的深度融合,继2026年初灰度测试百万token上下文模型后,DeepSeek将完善相关技术,依托mHC流形约束超连接与Engram条件记忆模块,解决长序列计算的内存开销问题,实现100万token下的高准确率推理。DeepSeekV4完整版模型的发布应该也是DeepSeek的一个重要的更新,新模型将结合混合专家架构优化,延续DeepSeek低成本高性能的优势,让中小企业也能便捷接入顶尖AI能力。推动开发者共建垂直场景应用;贴合2026年AI从会生成向会行动的进化趋势。#HOW I AI#

166. 这个模型有机会成为世界模型的Deepseek#AI #大模型 #世界模型 #北京人形机器人创新中心 #北京人形WoW具身世界模型

167. 探访云栖(一):揭秘AI“底座”,谁在为算力搭建“水电气”?

168. 重新构想 LLM 记忆:将上下文作为训练数据,使模型能够在测试时学习 | Nvidia

169. DeepSeek是如何用视觉压缩做大做强上下文的?

170. 不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍

171. DeepSeek-OCR、Claude Code on the web发布【AI 早报 2025-10-21】

172. DeepSeek团队发布新型视觉压缩模型DeepSeek-OCR

173. DeepSeek-OCR:把文字“压成图像”的语言模型革命

174. LongCodeZip:面向代码大模型的长上下文压缩框架,实现 5.6 倍压缩比且保持任务性能

175. DeepSeek-OCR 是上下文光学压缩多模态识别模型

176. DeepSeek光学压缩突破:用“看图识字”破解AI长文困境

177. 解码准确率碾压Deepseek-OCR!美团上下文压缩技术C3解析:小模型干压缩大模型干解码

178. DeepSeek开源新模型:用视觉压缩文本,再一次领先世界,开启视觉压缩智能时代

179. 刚刚,DeepSeek重磅发布新模型,上下文重磅突破,并且小而美

180. DeepSeek OCR论文的技术亮点可以这样理解:

181. DeepSeek这波操作,是要给大模型“长上下文”瓶颈来个大扫除?

182. DeepSeek-OCR:基于光学映射的上下文压缩技术

183. 统一多模态大模型稀疏性分析:理解 vs 生成

184. 与DeepSeek-OCR同一天!清华、智谱发布视觉压缩文本框架Glyph

185. 清华、智谱:用VLM实现LLM百万上下文处理

186. AI方向(1):上下文工程(context engineering)笔记

187. DeepSeek新突破:光学压缩技术能否打破大模型算力困局?

188. 深度解析 DeepSeek-OCR 的“光学压缩”革命

189. DeepSeek-OCR,大模型的新范式!

190. Glyph:通过视觉文本压缩扩展上下文

191. DeepSeek开源“视觉压缩黑科技”

192. 惊天突破!DeepSeek-OCR重写AI游戏规

193. 长时程AI任务必备:上下文压缩与记忆的实战指南

194. 整新活儿!DeepSeek低调推出一款开源OCR模型,探索上下文“光学压缩”潜能

195. 长上下文处理新范式: Glyph 框架解析

196. DeepSeek-OCR 如何将你的 LLM 上下文提升 10 倍?原理、实践与云端部署指南

197. CORE: 用强化学习实现RAG无损压缩,性能不降反升!

198. DeepSeek OCR 2发布:用视觉压缩破解长文本算力困局

199. 2025 DeepSeek-OCR技术报告: 视觉压缩长文本的探索性研究(附下载)

200. 把长文本“画”成图片让 AI 去看

201. ACON:LLM上下文压缩算法,解决长上下文问题

202. DeepSeek-OCR:光学压缩下的AI记忆与遗忘

203. 新突破!LLM 长上下文视频压缩框架

204. DeepSeek开源新成果!把长文档压缩成图片,降低大模型处理成本

205. Context-Folding: LLM智能体如何实现10倍上下文压缩?

206. DeepSeek光学压缩技术,大模型的新突破

207. 多数AI Agent掉链子,问题不在模型而在上下文工程

208. 【在线课程】“图像or文本”新思考(CSIG文档图像微沙龙第44期)

209. DeepSeek 全新开源模型!有点意思~

210. DeepSeek大模型,突破上下文长度的瓶颈,光学压缩技术

211. 像黏菌一样思考:智能体上下文主动压缩

212. 压缩长上下文新方法——Visual-Text Compression

213. 别让大模型在“垃圾堆”里找金子:深度解析 RAG 的上下文压缩技术

214. AI智能体的上下文工程,破解“腐烂”困境的实践之道

215. 一文解释清楚DeepSeek OCR到底是什么?

216. ICCV25 | 让多模态大模型按预算推理

217. 多模态视觉Token压缩方法

218. 建议收藏:一图看懂长上下文三大压缩技术

219. 字节:无训练剪枝 + 动态MoE恢复满血生成

220. 多模态大模型token压缩率怎么平衡精度?

221. DeepSeek十月重磅论文!上下文光学压缩 7分钟读懂DeepSeek新范式:光学压缩 DeepSeek十月重磅论文! 💡核心思想:上下文光学压缩。 ❓解决什么:LLM处理长文本的计算瓶颈。 🚀有多颠覆:10倍压缩率,为“无限上下文”提供全新可能! #计算机视觉 #ai学习 #循环神经网络 #DeepSeek #OCR

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章