# 百度开源 Unlimited OCR 模型再登 HuggingFace 总榜第三

- 来源：Berryxia.AI (@berryxia)
- 发布时间：2026-07-22 22:36
- AIHOT 分数：35
- AIHOT 链接：https://aihot.virxact.com/items/cmrw77zzy00ndro8gyzndprl5
- 原文链接：https://x.com/berryxia/status/2079938656828346473

## AI 摘要

百度开源的 Unlimited OCR 模型再次登上 HuggingFace 全球模型总榜第三，GitHub Star 超 1.65 万，下载量达 224 万。该模型仅 30 亿参数，支持 32K 上下文，可一次性解析整本 100 页 PDF，40 页后错误率低于 0.11，且完全免费本地运行。

## 正文

为什么OCR仍然是AI信息处理的第一步？

人类先有身体再有文字，而 AI 反过来，文字能力先成熟。

OCR 的价值就是把物理世界的文档、图像转成电子文字，后面才能接信息抽取、RAG、知识问答、Agent 等。

在硬地骇客播客这期早就说了这个观点，现在看来的确AI时代并不能脱离这个事实啊！

### 引用推文

> Berryxia.AI：兄弟们,这几天真的是国产模型的高光时刻啊,又有模型海外刷屏! Yann LeCun 转发,Unlimited-OCR 开源模型再次登上 HuggingFace 总榜🔥 Unlimited OCR 模型又火了! 之前还分享过它家出品的几个OCR的新模型,这个模型因为我没有本地部署的资源,因此还没有实测,结果这个模型在海...
