盘天下 | 免费精选资源分享

Chunkr-开源基于视觉模型的 PDF数据提取工具

编程开发 管理员 2024-11-13 457 0


Chunkr是什么

Chunkr 是一个开源基于视觉模型的 PDF 数据 提取工具,专注于文档布局分析、OCR 和分块处理。它能够将 PDF、DOC、PPT 和 XLS 文件转换为适用于 RAG(检索增强生成)和 LLM(大 语言 模型)的结构化数据。Chunkr 使用先进的视觉模型和 OCR 技术 ,提取文档中的边界框和结构化文本,支持文本、表格、图像和手写内容的处理。由 Lumina AI Inc. 维护,支持 GPU 和 CPU 环境 ,提供免费试用和定价方案。

Chunkr-开源基于视觉模型的 PDF数据提取工具

Chunkr如何使用

官网:https://chunkr.ai/

GitHub:https://github.com/lumina-ai-inc/chunkr

【新用户手机夸克APP转存可以获得1TB免费空间】

夸克网盘「电影」精选合集:https://pan.quark.cn/s/0755e002f4b6

夸克网盘「大尺度」精选合集:https://pan.quark.cn/s/0cac2bd0b54e

夸克网盘「纪录片」精选合集:https://pan.quark.cn/s/8c76cd47e8be

夸克网盘「音乐」精选合集:https://pan.quark.cn/s/c999e39a7f49

夸克网盘「教程」精选合集:https://pan.quark.cn/s/27984fcacdad

夸克网盘「书籍」精选合集:https://pan.quark.cn/s/2532536273dd

冲上云霄

转载请注明出处,本文链接:https://www.pantx.cn/6134.html

(2)
收藏 (0)
取消

感谢您的支持,我们会继续努力的!

扫码支持
扫码打赏,你说多少就多少

打开 支付宝 扫一扫,即可进行扫码打赏哦

评论列表