weixin_36742013 2019-12-09 16:02 采纳率: 0%
浏览 338
已结题

Python或c#实现图片格式的PDF转txt

Python或C#有什么办法能比较好使将图片格式的pdf文件转为txt,同时需要能带格式的
地识别图片中的表格

  • 写回答

1条回答 默认 最新

  • threenewbee 2019-12-09 16:10
    关注

    可以分为2步,首先将图片提取出来,然后进行文字识别,至于表格,因为你是图片,所以只能转换成文本,然后再根据一定规则去还原
    前者可以用pdfminer,后者文字识别可以用pytesseract

    评论

报告相同问题?

悬赏问题

  • ¥100 有人会搭建GPT-J-6B框架吗?有偿
  • ¥15 求差集那个函数有问题,有无佬可以解决
  • ¥15 【提问】基于Invest的水源涵养
  • ¥20 微信网友居然可以通过vx号找到我绑的手机号
  • ¥15 寻一个支付宝扫码远程授权登录的软件助手app
  • ¥15 解riccati方程组
  • ¥15 display:none;样式在嵌套结构中的已设置了display样式的元素上不起作用?
  • ¥15 使用rabbitMQ 消息队列作为url源进行多线程爬取时,总有几个url没有处理的问题。
  • ¥15 Ubuntu在安装序列比对软件STAR时出现报错如何解决
  • ¥50 树莓派安卓APK系统签名