iteye_17257 2009-08-24 16:02
浏览 214
已采纳

正则提取复杂的<a href="" ...>

  • 写回答

5条回答 默认 最新

  • wanghaolovezlq 2009-08-25 09:49
    关注

    [code="java"]
    import java.util.regex.*;

    public class RegExpParseHTML {

    /**
     * @param args
     */
    public static void main(String[] args) {
        // TODO Auto-generated method stub
        String html = "<a href=\"http://www.autohome.com.cn/780/\" style=\"text-decoration:none;\" target=\"_blank\" title=\"[D] 大众UP频道\" >[D] 大众UP频道</a>";
        String href = parseHref(html);
        System.out.println(href);
    }
    
    public static String parseHref(String html)
    {
        String regex = "<a[\\s]+href[\\s]*=[\\s]*\"([^<\"]+)\"";
        //String regex = "[^.]";
        Pattern p = Pattern.compile(regex, Pattern.CASE_INSENSITIVE);
    
        Matcher m = p.matcher(html);
    
        StringBuffer ret = new StringBuffer();
        while(m.find())
        {
            ret.append(m.group(1));
        }
    
        return ret.toString();
    }
    

    }

    [/code]

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(4条)

报告相同问题?

悬赏问题

  • ¥20 BAPI_PR_CHANGE how to add account assignment information for service line
  • ¥500 火焰左右视图、视差(基于双目相机)
  • ¥100 set_link_state
  • ¥15 虚幻5 UE美术毛发渲染
  • ¥15 CVRP 图论 物流运输优化
  • ¥15 Tableau online 嵌入ppt失败
  • ¥100 支付宝网页转账系统不识别账号
  • ¥15 基于单片机的靶位控制系统
  • ¥15 真我手机蓝牙传输进度消息被关闭了,怎么打开?(关键词-消息通知)
  • ¥15 装 pytorch 的时候出了好多问题,遇到这种情况怎么处理?