lkkmm 2015-05-17 04:27 采纳率: 100%
浏览 2546
已采纳

HtmlAgilityPack 怎么正确提取包含小于号“<”等类似html标签符号的内容?

【原始html】

 <table width="770" border="0" cellpadding="0" cellspacing="0">
    <tr>
        <td class="even" width="640" valign="middle">
               <span style="line-height: 20px;">10年≤年限<50年</span>
        </td>
    </tr>
</table>

【需要达到的效果】
提取出

 “10年≤年限<50年”

【遇到的问题】

 用InnerHtml时,取不到“<50年”,只能取到“10年≤年限”这样的结果;
用OuterHtml时,只能取到“<span style="line-height: 20px;">10年≤年限<></span>”;
我猜,是不是HtmlAgilityPack把小于号“<”当做html标签来看待了?
我该如何做才能正确取出“10年≤年限<50年”这个结果呢?
  • 写回答

2条回答 默认 最新

  • threenewbee 2015-05-17 08:28
    关注

    不规范的html,只能用正则表达式提取,已经写给你了。

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(1条)

报告相同问题?

悬赏问题

  • ¥15 运筹学排序问题中的在线排序
  • ¥15 关于docker部署flink集成hadoop的yarn,请教个问题 flink启动yarn-session.sh连不上hadoop,这个整了好几天一直不行,求帮忙看一下怎么解决
  • ¥30 求一段fortran代码用IVF编译运行的结果
  • ¥15 深度学习根据CNN网络模型,搭建BP模型并训练MNIST数据集
  • ¥15 lammps拉伸应力应变曲线分析
  • ¥15 C++ 头文件/宏冲突问题解决
  • ¥15 用comsol模拟大气湍流通过底部加热(温度不同)的腔体
  • ¥50 安卓adb backup备份子用户应用数据失败
  • ¥20 有人能用聚类分析帮我分析一下文本内容嘛
  • ¥15 请问Lammps做复合材料拉伸模拟,应力应变曲线问题