Python或C#有什么办法能比较好使将图片格式的pdf文件转为txt,同时需要能带格式的
地识别图片中的表格
Python或c#实现图片格式的PDF转txt
- 写回答
- 好问题 0 提建议
- 追加酬金
- 关注问题
- 邀请回答
-
1条回答 默认 最新
- threenewbee 2019-12-09 16:10关注
可以分为2步,首先将图片提取出来,然后进行文字识别,至于表格,因为你是图片,所以只能转换成文本,然后再根据一定规则去还原
前者可以用pdfminer,后者文字识别可以用pytesseract解决 无用评论 打赏 举报
悬赏问题
- ¥100 有人会搭建GPT-J-6B框架吗?有偿
- ¥15 求差集那个函数有问题,有无佬可以解决
- ¥15 【提问】基于Invest的水源涵养
- ¥20 微信网友居然可以通过vx号找到我绑的手机号
- ¥15 寻一个支付宝扫码远程授权登录的软件助手app
- ¥15 解riccati方程组
- ¥15 display:none;样式在嵌套结构中的已设置了display样式的元素上不起作用?
- ¥15 使用rabbitMQ 消息队列作为url源进行多线程爬取时,总有几个url没有处理的问题。
- ¥15 Ubuntu在安装序列比对软件STAR时出现报错如何解决
- ¥50 树莓派安卓APK系统签名