Brian_BAI79 2021-04-12 19:35 采纳率: 100%
浏览 44
已采纳

python正则表达式如何利用关键词提高提取个人信息的精准度

我想问的就是如何利用python提取电脑中html文件,然后利用关键词精准地提取出电话号码、qq号、邮箱等等一些个人的虚拟身份。

 

  • 写回答

3条回答 默认 最新

  • 关注

    用python提取电脑中html文件是:

    with open("xxx.html","r",encoding="utf-8") as fileObj:

        data = fileObj.read()

     

    要提取出电话号码、qq号、邮箱等信息, 需要根据这些信息的前后内容的特征写正则表达式。

    你把html文件的内容发一下,正则表达式要根据文件内容的格式来写。

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?

悬赏问题

  • ¥15 fpga自动售货机数码管(相关搜索:数字时钟)
  • ¥20 Python安装cvxpy库出问题
  • ¥15 用前端向数据库插入数据,通过debug发现数据能走到后端,但是放行之后就会提示错误
  • ¥15 python天天向上类似问题,但没有清零
  • ¥30 3天&7天&&15天&销量如何统计同一行
  • ¥30 帮我写一段可以读取LD2450数据并计算距离的Arduino代码
  • ¥15 C#调用python代码(python带有库)
  • ¥15 活动选择题。最多可以参加几个项目?
  • ¥15 飞机曲面部件如机翼,壁板等具体的孔位模型
  • ¥15 vs2019中数据导出问题