回到时间线

7月5日周日23:25ResearchInfra / 成本企业与落地Infra / 成本指南

百度「无限OCR」一次处理数十页文档,内存消耗不增

Decision Brief

变化百度推出「无限OCR」,透过修改注意力机制让单次处理页数从约10页提升至数十页,且内存用量不随页数增加。
为什么重要内存消耗平稳的特性,让处理大量页面的OCR应用不再受限于硬件,对需要批次扫描或数位化的开发者极具吸引力。
谁该关注所有 AI builder
受影响技术栈未识别出特定技术栈
来源可信度 · 可靠媒体或一手报导

百度推出的「无限OCR」技术,核心改进在于修改注意力机制,使内存消耗在处理单一文件时保持平稳,不因页数增加而上升。相较于先前系统最多处理约10页,新系统一次可处理数十页文档。目前该模型在最重要的OCR基准测试中位居榜首。 对于需要批量文档数位化的团队(如企业档案管理、图书馆扫描项目),这项技术能显著减少分批处理的繁琐与成本,并提升处理效率。

摘要依据:官方/RSS 来源详摘依据上方标注的来源范围整理,内容以原文为准。

来源

相关情报

留言

登入后即可留言,和其他 builder 交换实测心得。

还没有留言,抢头香。