盘天下 | 精选资源分享

Chunkr:开源基于视觉模型的PDF数据提取工具

编程开发 2024-11-22 626 0

Chunkr:开源基于视觉模型的 PDF 数据提取工具

Chunkr 是一个开源基于视觉模型的 PDF 数据提取工具,专注于文档布局分析、OCR 和分块处理。它能够将 PDF、DOC、PPT 和 XLS 文件转换为适用于 RAG(检索增强生成)和 LLM(大 语言 模型)的结构化数据。Chunkr 使用先进的视觉模型和 OCR 技术,提取文档中的边界框和结构化文本,支持文本、表格、图像和手写内容的处理。由 Lu mi na AI Inc. 维护,支持 GPU 和 CPU 环境 ,提供免费试用和定价方案。

开源地址:https:// github .com/lumina-ai-inc/chunkr

闲趣赚

转载请注明出处,本文链接:https://pantx.cn/12741.html

(0)
收藏 (0)

评论列表