企业级的pdf读取文字和图片,是怎么做的

个人情况

我的公司现在做的ai项目需要去读取pdf

学习问题

pdf确实是一个比较复杂的文件,尝试了几个开源工具,效果不是很好

已有尝试

PyMuPDF:提取文字可以,但图片不行 MinerU:将pdf转成markdown,大概有90%的效果 大模型qwen2.5vl:32b:抽取文字,但不能抽取图片

期望帮助

我其实尝试了多个开源工具,但效果最好的还是MinerU,我期望可能得到企业级处理pdf的文字和图片的介绍或者技术

0个评论
点击登录,快来和大家讨论吧~
表情
图片
暂无评论
凌一
下载 APP