復(fù)制代碼 代碼如下:
function match_links($document) {
preg_match_all("'\s*a\s.*?href\s*=\s*([\"\'])?(?(1)(.*?)\1|([^\s\&;]+))[^>]*>?(.*?)/a>'isx",$document,$links);
while(list($key,$val) = each($links[2])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[3])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[4])) {
if(!empty($val))
$match['content'][] = $val;
}
while(list($key,$val) = each($links[0])) {
if(!empty($val))
$match['all'][] = $val;
}
return $match;
}
主要是正則的問題,下面給出個asp.net下的,多測試正則
獲取頁面的鏈接正則
復(fù)制代碼 代碼如下:
public string GetHref(string HtmlCode)
{
string MatchVale = "";
string Reg = @"(h|H)(r|R)(e|E)(f|F) *= *('|"")?((w|\|/|.|?1|-|_)+)('|""| *|>)?";
foreach (Match m in Regex.Matches(HtmlCode, Reg))
{
MatchVale += (m.Value).ToLower().Replace("href=", "").Trim() + "||";
}
return MatchVale;
}
您可能感興趣的文章:- php正則表達式驗證(郵件地址、Url地址、電話號碼、郵政編碼)
- php使用正則表達式獲取圖片url的方法
- php使用curl和正則表達式抓取網(wǎng)頁數(shù)據(jù)示例
- php用正則表達式匹配URL的簡單方法
- php URL驗證正則表達式
- php利用正則表達式取出圖片的URL
- php使用正則表達式獲取字符串中的URL