Rumah >pembangunan bahagian belakang >tutorial php >详细介绍PHP+JavaScript如何爬取网页内容

详细介绍PHP+JavaScript如何爬取网页内容

零到壹度asal: 2018-04-11 17:27:386224semak imbas

本篇文章给大家分享的内容是详细介绍PHP+JavaScript如何爬取网页内容，有着一定的参考价值，有需要的朋友可以参考一下

php+js爬取网页内容—–先看下效果

我的网站目标网站

如何做到的呢？

我们一直以为只有Python才能爬取网页内容，那是因为Python本身集合很多类库用来爬取网页很方便，但是我们使用PHP+js的方法一样很方便，一样可以拿到我们想要的网页内容，而且也不用很繁琐。

首先我们需要PHP来模拟请求获取整个网站的HTML

  // 允许所有域访问
  header("Access-Control-Allow-Origin: *");
  / 接收一个参数，参数名叫parm
  $parm=$_GET[&#39;mod&#39;];
  if (empty($parm)) {  
    $url = &#39;http://m.80s.tw/&#39;;//目标网站
    $html = file_get_contents($url);
}else{  
  $url = &#39;http://m.80s.tw/&#39;.$parm;    
  $html = file_get_contents($url);
} 
    preg_match("/<body[^>]*?>(.*\s*?)<\/body>/is",$html,$match1);//正则匹配body里面的内容
    echo $match1[0];//输出网页

注意：如果遇到 file_get_contents报错请尝试在 php.ini中找到extension=php_openssl.dll 开启就OK了

然后就是前端来获取数据进行处理了

首先写个异步请求

$.ajax({ 
        type:&#39;get&#39;,
        url: &#39;.././admin/test.php&#39;,
        success: function(data) {
        console.log(data)//可以看到获取的HTML，很简单吧，很兴奋吧
        }
    });

获取HTML后我们就可以随心所欲了

怎么来使用这些HTML呢？这是问题吗？不是

        //首先创建一个容器
        var p = document.createElement(&#39;p&#39;);        
        // 把整个html的字符串存到这个p节点里
        p.innerHTML = data;        
        //然后就可以对p一顿检查了
        //比如获取类list_mov_title下所有的a标签
        var list = p.querySelectorAll(&#39;.list_mov_title a&#39;);        
        //赶紧打印出来看一下
        console.log(list)        
        //想要的东西都在吧
        //然后就把想要的东西往自己的页面里面塞吧

一个爬取网页内容的教程就这样结束了，如果你豁然开朗了就转发一下吧，不明白的就留言吧

Atas ialah kandungan terperinci 详细介绍PHP+JavaScript如何爬取网页内容. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Python php JavaScript html JS 异步

Kenyataan：

Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn

Artikel sebelumnya：nginx下启动php-fpm出现错误的原因以及解决方案Artikel seterusnya：详解在阿里云上部署PHP后端的方法

Artikel berkaitan

Lihat lagi