您现在的位置是:网站首页> 编程资料编程资料
php 正则表达式提取网页超级链接url的函数_正则表达式_
2023-05-25
169人已围观
简介 php 正则表达式提取网页超级链接url的函数_正则表达式_
复制代码 代码如下:
function match_links($document) {
preg_match_all("'<\s*a\s.*?href\s*=\s*([\"\'])?(?(1)(.*?)\\1|([^\s\>]+))[^>]*>?(.*?)'isx",$document,$links);
while(list($key,$val) = each($links[2])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[3])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[4])) {
if(!empty($val))
$match['content'][] = $val;
}
while(list($key,$val) = each($links[0])) {
if(!empty($val))
$match['all'][] = $val;
}
return $match;
}
主要是正则的问题,下面给出个asp.net下的,多测试正则
获取页面的链接正则
复制代码 代码如下:
public string GetHref(string HtmlCode)
{
string MatchVale = "";
string Reg = @"(h|H)(r|R)(e|E)(f|F) *= *('|"")?((\w|\\|\/|\.|:|-|_)+)('|""| *|>)?";
foreach (Match m in Regex.Matches(HtmlCode, Reg))
{
MatchVale += (m.Value).ToLower().Replace("href=", "").Trim() + "||";
}
return MatchVale;
}
您可能感兴趣的文章:
相关内容
- javascript 基于正则表达式的文本框验证代码_正则表达式_
- 一个替换目录结构的正则表达式 实现目录的增加_正则表达式_
- js 常用正则表达式表单验证代码_正则表达式_
- 正则表达式中的反向预搜索(下)_正则表达式_
- 正则表达式中的反向预搜索(上)_正则表达式_
- ASP 正则表达式常用的几种方法(execute、test、replace)_正则表达式_
- php中常用的正则表达式的介绍及应用实例代码_正则表达式_
- Javascript 字符串字节长度计算函数代码与效率分析(for VS 正则)_正则表达式_
- ip138中各种客户端验证js代码_正则表达式_
- javascript 手机号码正则表达式验证函数[原创]_正则表达式_
