duanpie2414 2016-10-22 19:52
浏览 2566
已采纳

解析.doc和.docx以使用golang获取所有文本?

How can I parse word documents ".doc", ".docx" to get all the text using golang?

  • 写回答

2条回答 默认 最新

  • doumian3780 2016-10-22 20:27
    关注

    You can get some inspiration from those projects:

    https://github.com/nguyenthenguyen/docx
    https://github.com/opencontrol/doc-template

    Basically, DOCX is a Zip file with XMLs in it. All the texts are inside document.xml

    What both project do is remove all XML tags, leaving only text intact. You should see if that approach suits you too.

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(1条)

报告相同问题?

悬赏问题

  • ¥15 #MATLAB仿真#车辆换道路径规划
  • ¥15 java 操作 elasticsearch 8.1 实现 索引的重建
  • ¥15 数据可视化Python
  • ¥15 要给毕业设计添加扫码登录的功能!!有偿
  • ¥15 kafka 分区副本增加会导致消息丢失或者不可用吗?
  • ¥15 微信公众号自制会员卡没有收款渠道啊
  • ¥15 stable diffusion
  • ¥100 Jenkins自动化部署—悬赏100元
  • ¥15 关于#python#的问题:求帮写python代码
  • ¥20 MATLAB画图图形出现上下震荡的线条