PHP を使用してページのコンテンツをキャプチャすることは、単純なコンテンツ コレクターを作成したり、Web ページからコンテンツの一部を抽出したりするなど、実際の開発で非常に役立ちます。
キャプチャされたコンテンツは 正規表現 を介して処理されます
フィルターするだけです正規表現を使用してフィルタリングする方法については、ここでは紹介しません。興味がある方のために、PHP を使用して Web ページのコンテンツをクロールする一般的な方法をいくつか紹介します。 1.file_get_contents
<?php $url = "http://www.jb51.net"; $contents = file_get_contents($url); //如果出现中文乱码使用下面代码 //$getcontent = iconv("gb2312", "utf-8",$contents); echo $contents; ?>2.curl
<?php $url = "http://www.jb51.net"; $ch = curl_init(); $timeout = 5; curl_setopt($ch, CURLOPT_URL, $url); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); curl_setopt($ch, CURLOPT_CONNECTTIMEOUT, $timeout); //在需要用户检测的网页里需要增加下面两行 //curl_setopt($ch, CURLOPT_HTTPAUTH, CURLAUTH_ANY); //curl_setopt($ch, CURLOPT_USERPWD, US_NAME.":".US_PWD); $contents = curl_exec($ch); curl_close($ch); echo $contents; ?>3.fopen->fread->fclose
<?php $handle = fopen ("http://www.jb51.net", "rb"); $contents = ""; do { $data = fread($handle, 1024); if (strlen($data) == 0) { break; } $contents .= $data; } while(true); fclose ($handle); echo $contents; ?>
以上がPHPでWebページのコンテンツを取得する方法の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。