百度近日发布并开源了3B参数规模的端到端OCR模型——
技术上,
在OmniDocBench v1.6基准测试中,该模型以93.92%的成绩刷新纪录。真实场景下,其推理速度较DeepSeek OCR提升约12.7%,在6000Tokens输出长度下速度优势扩大至35%,为海量文档数字化和大模型长程记忆管理提供了全新路径。
AI工具集加载中...

百度开源3B参数端到端OCR模型Unlimited OCR,专攻书籍论文等长文档。项目上线5天GitHub Star破万,登顶四项趋势榜。技术上,推理激活约570M参数,创新引入Reference Sliding Window Attention机制,突破逐页拼接限制,支持数十页一次性连续解析,大幅提升长文档处理效率。
百度近日发布并开源了3B参数规模的端到端OCR模型——
技术上,
在OmniDocBench v1.6基准测试中,该模型以93.92%的成绩刷新纪录。真实场景下,其推理速度较DeepSeek OCR提升约12.7%,在6000Tokens输出长度下速度优势扩大至35%,为海量文档数字化和大模型长程记忆管理提供了全新路径。