一次解析40页还不忘上下文?百度开源OCR刷新纪录,GitHub五天破万星

源自24位全网作者

07-06 13:28

内容由AI生成

精选参考来源

1. 百度开源王炸OCR!Unlimited-OCR一次性识别40页长文档,本地部署免费用

2. 几百页文档一次性搞定,百度这个 OCR 有点六

3. 百度开源 Unlimited OCR:3B 参数干翻 235B 大模型,一口气读完 40 页不失忆

4. 3B参数四榜第一,百度AI大模型杀疯了

5. 百度开源Unlimited OCR:500M小模型「吊打」235B大模型,40 页超长文档无损推理!

6. Unlimited OCR开源即登顶! 准备下班呢,发现全球榜1️⃣上新 🏆近日,百度正式发布并开源端到端OCR模型Unlimited OCR。模型发布后GitHub Star两天突破7K,位列HuggingFace全球多模态大模型榜单第一! 面对长文档发怵?我干的就是长文档 📊Unlimited OCR面向长文档解析场景打造,总参数规模3B、推理时激活参数仅约570M。 🔍公开评测结果显示,模型在OmniDocBench v1.6基准测试中取得93.92%综合成绩,刷新端到端OCR最新纪录。 👉百度提出 Reference Sliding Window Attention (R-SWA) 机制,借鉴人类抄录长文档时的工作方式:始终保持对原始文档内容的关注,同时仅保留最近一段生成内容作为“工作记忆”,而不是无限累积全部历史信息。 基于这一设计,模型能够在一次前向推理中连续完成数十页文档解析,同时将解码阶段的 KV Cache 控制在恒定规模,使计算成本和显存占用不随输出长度持续增长。 🔈Unlimited OCR开源地址—— GitHub: https://github.com/baidu/Unlimited-OCR HuggingFace: https://huggingface.co/baidu/Unlimited-OCR

7. 百度发布最新OCR模型:Unlimited-OCR,3B参数吊打235B大模型!

8. 3B参数仅500M激活!百度开源OCR破纪录,40页解析无失忆登SOTA!

9. 百度开源Unlimited OCR:500M激活参数,一口气读完40页文档

10. 百度开源 Unlimited OCR:让长文档解析一次完成

11. 百度开源文档解析神器

12. Unlimited-OCR 实测乱码!对比Deepseekocr等mineru2.5pro视觉模型glmocr横向对比

13. 百度开源新OCR,免费吃下一本书,职场人知识管理起飞

14. 500M激活跑分93.92%,百度开源小模型碾压大参数量竞品

15. 200页合同不再被截断:百度开源的 Unlimited-OCR,12天GitHub破万星

16. 百度开源3B模型Unlimited OCR:5天Star破万,刷新长文档解析纪录

17. 百度开源OCR登顶全球第一,核心作者疑似DeepSeek出走大神

18. 百度开源Unlimited OCR:3B参数刷新端到端OCR全球SOTA,一次可读40页文档

19. 百度开源Unlimited OCR拿下全球第一,作者可能是前DeepSeek OCR团队核心成员

20. 一次推理读完40页,百度开源的OCR模型凭什么让GitHub两天涨了7000星?

21. 百度Unlimited OCR全球爆火,首创R-SWA打破端到端OCR SOTA

22. 个人电脑玩AI-08让5060 Ti给你打工——我拿 Unlimited-OCR扫了 600 页书,然后悟了

23. 百度新发布的Unlimited-OCR模型,5天就在GitHub和HuggingFace多个趋势榜上登顶,Star直接破万。 这个模型参数其实不大,总参数量3B,激活参数只有570M,用的是MoE架构。但它最突出的能力在长文档连续识别上,几十页文档一口气读下来也不掉链子,解决了OCR在长文本场景下的老大难问题。 OCR本来就是百度的传统强项,之前的PaddleOCR在业内口碑一直不错。这次他们借鉴了人类抄书的方式优化长文本理解,不仅提升了OCR在复杂场景下的可用性,也给大模型的长期记忆管理提供了新的技术思路。模型基于DeepSeek-OCR的DeepEncoder路线,把长文档解析的工程瓶颈往前推了一步。 小模型做出大能力,这大概是最近AI圈最愿意看到的故事。

24. 百度开源 Unlimited-OCR:3.3B 参数实现长文档一次性解析,OCR 进入「无限」时代

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章