≡ AI工具

olmOCR – Ai2 开源的 PDF 转结构化文档工具

分类:AI工具
olmOCR – Ai2 开源的 PDF 转结构化文档工具

olmOCR是什么

olmOCR 是 Ai2 推出的开源工具,用在将 PDF 文档高效转换为干净的结构化纯文本。olmOCR结合文档锚定(document-anchoring)技术与Qwen2-VL-7B-Instruct(阿里多模态模型),支持处理多种类型的 PDF 文档,包括学术论文、书籍、表格和图表等。olmOCR基于提取文档中的文本和布局信息,与页面图像结合,更准确地提取内容、保留结构化信息。olmOCR支持大规模批量处理,每百万页的处理成本仅为 190 美元,远低于其他商业解决方案。

olmOCR