duanpie2414 2016-10-22 19:52
浏览 2581
已采纳

解析.doc和.docx以使用golang获取所有文本?

How can I parse word documents ".doc", ".docx" to get all the text using golang?

  • 写回答

2条回答 默认 最新

  • doumian3780 2016-10-22 20:27
    关注

    You can get some inspiration from those projects:

    https://github.com/nguyenthenguyen/docx
    https://github.com/opencontrol/doc-template

    Basically, DOCX is a Zip file with XMLs in it. All the texts are inside document.xml

    What both project do is remove all XML tags, leaving only text intact. You should see if that approach suits you too.

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(1条)

报告相同问题?

悬赏问题

  • ¥15 vika文档如何与obsidian同步
  • ¥15 华为手机相册里面的照片能够替换成自己想要的照片吗?
  • ¥15 陆空双模式无人机飞控设置
  • ¥15 sentaurus lithography
  • ¥100 求抖音ck号 或者提ck教程
  • ¥15 关于#linux#的问题:子进程1等待子进程A、B退出后退出(语言-c语言)
  • ¥20 web页面如何打开Outlook 365的全球离线通讯簿功能
  • ¥15 io.jsonwebtoken.security.Keys
  • ¥15 急,ubuntu安装后no caching mode page found等
  • ¥15 联想交换机NE2580O/NE1064TO安装SONIC