>  기사  >  백엔드 개발  >  正则表达式匹配url地址的问题求救

正则表达式匹配url地址的问题求救

WBOY
WBOY원래의
2016-06-23 14:08:451086검색

我想匹配出 http://www.so.com/s?q=csdn&pn=7&j=0里每个搜索结果的url,用下面的正则匹配出的结果为空,错在哪里呢?

$c1 = "/<h3 class=\"res-title (?:mark\-nowrap)?\">\s*<a target=\"_blank\" data-m=\"(?:.*)\" data-pos\"(?:\d+)\" data-e=\"(?:\d+)\" data-st=\"(?:\d+)\" href=\"(.*)\">(?:.*)<\/a>\s*<\/h3>/Uis";		$content= get_content('http://www.so.com/s?q=csdn&pn=7&j=0');		preg_match_all($c1,$content,$arr1);		print_r($arr1);


回复讨论(解决方案)

你应该重新考虑一下问问题的方法,这样问没几个人愿意回答的

全文都找不到一个 

用惯了DOM解析,正则生疏了,那个href太长了,所有用了2次preg_match_all,勉强匹配出来了。


$urls = 'http://www.so.com/s?q=csdn&pn=7&j=0';$ch = curl_init();curl_setopt($ch, CURLOPT_URL,$urls);curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);$content = curl_exec($ch);curl_close($ch);$c1 = "/<li class=\"res-list\">(.*?)<a href=\"(.*?)\">(.*?)<\/a>(.*?)<\/li>/is";preg_match_all($c1,$content,$arr1);foreach($arr1[0] as $part){	$c2 = "/href=('|\")(.*?)(?1)\s+/is";	preg_match_all($c2,$part,$arr2);	echo $arr2[2][0].'<br />';}

성명:
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.