源码网商城,靠谱的源码在线交易网站 我的订单 购物车 帮助

源码网商城

php 正则表达式提取网页超级链接url的函数

  • 时间:2020-03-25 00:21 编辑: 来源: 阅读:
  • 扫一扫,手机访问
摘要:php 正则表达式提取网页超级链接url的函数
[u]复制代码[/u] 代码如下:
function match_links($document) { preg_match_all("'<\s*a\s.*?href\s*=\s*([\"\'])?(?(1)(.*?)\\1|([^\s\>]+))[^>]*>?(.*?)</a>'isx",$document,$links); while(list($key,$val) = each($links[2])) { if(!empty($val)) $match['link'][] = $val; } while(list($key,$val) = each($links[3])) { if(!empty($val)) $match['link'][] = $val; } while(list($key,$val) = each($links[4])) { if(!empty($val)) $match['content'][] = $val; } while(list($key,$val) = each($links[0])) { if(!empty($val)) $match['all'][] = $val; } return $match; }
主要是正则的问题,下面给出个asp.net下的,多测试正则 获取页面的链接正则
[u]复制代码[/u] 代码如下:
public string GetHref(string HtmlCode) { string MatchVale = ""; string Reg = @"(h|H)(r|R)(e|E)(f|F) *= *('|"")?((\w|\\|\/|\.|:|-|_)+)('|""| *|>)?"; foreach (Match m in Regex.Matches(HtmlCode, Reg)) { MatchVale += (m.Value).ToLower().Replace("href=", "").Trim() + "||"; } return MatchVale; }
  • 全部评论(0)
联系客服
客服电话:
400-000-3129
微信版

扫一扫进微信版
返回顶部