検索
ホームページバックエンド開発PHPチュートリアルPHP は Web サイトの画像をリモートで取得して保存します

この記事では、Web サイトの画像をキャプチャして保存するための PHP のコードを共有します。この例では、画像をキャプチャしてローカルに保存する方法を詳しく紹介します。必要な場合は、

サンプル、PHP キャプチャ Web サイト データ コードを参照してください。

コード例:

<?php  
/** 
 * 一个用于抓取图片的类 
 * 
 * @package default 
 * @author  WuJunwei 
 */  
class download_image   
{  
      
    public $save_path;  //抓取图片的保存地址  
  
    //抓取图片的大小限制(单位:字节) 只抓比size比这个限制大的图片  
    public $img_size=0;   
  
    //定义一个静态数组,用于记录曾经抓取过的的超链接地址,避免重复抓取         
    public static $a_url_arr=array();     
      
    /** 
     * @param String $save_path    抓取图片的保存地址 
     * @param Int    $img_size     抓取图片的保存地址 
     */  
    public function __construct($save_path,$img_size)  
    {  
        $this->save_path=$save_path;  
        $this->img_size=$img_size;  
    }      
      
    /** 
     * 递归下载抓取首页及其子页面图片的方法  ( recursive 递归) 
     * 
     * @param   String  $capture_url  用于抓取图片的网址 
     *  
     */  
    public function recursive_download_images($capture_url)  
    {  
        if (!in_array($capture_url,self::$a_url_arr))   //没抓取过  
        {                           
            self::$a_url_arr[]=$capture_url;   //计入静态数组  
        } else   //抓取过,直接退出函数  
        {  
            return;  
        }          
          
        $this->download_current_page_images($capture_url);  //下载当前页面的所有图片  
          
        //用@屏蔽掉因为抓取地址无法读取导致的warning错误  
        $content=@file_get_contents($capture_url);   
          
        //匹配a标签href属性中?之前部分的正则  
        $a_pattern = "|<a[^>]+href=[&#39;\" ]?([^ &#39;\"?]+)[&#39;\" >]|U";     
        preg_match_all($a_pattern, $content, $a_out, PREG_SET_ORDER);  
          
        $tmp_arr=array();  //定义一个数组,用于存放当前循环下抓取图片的超链接地址  
        foreach ($a_out as $k => $v)   
        {  
            /** 
             * 去除超链接中的 空&#39;&#39;,&#39;#&#39;,&#39;/&#39;和重复值   
             * 1: 超链接地址的值 不能等于当前抓取页面的url, 否则会陷入死循环 
             * 2: 超链接为&#39;&#39;或&#39;#&#39;,&#39;/&#39;也是本页面,这样也会陷入死循环,   
             * 3: 有时一个超连接地址在一个网页中会重复出现多次,如果不去除,会对一个子页面进行重复下载) 
             */  
            if ( $v[1] && !in_array($v[1],self::$a_url_arr) &&!in_array($v[1],array(&#39;#&#39;,&#39;/&#39;,$capture_url) ) )   
            {  
                $tmp_arr[]=$v[1];  
            }  
        }  
    
        foreach ($tmp_arr as $k => $v)   
        {              
            //超链接路径地址  
            if ( strpos($v, &#39;http://&#39;)!==false ) //如果url包含http://,可以直接访问  
            {  
                $a_url = $v;  
            }else   //否则证明是相对地址, 需要重新拼凑超链接的访问地址  
            {  
                $domain_url = substr($capture_url, 0,strpos($capture_url, &#39;/&#39;,8)+1);  
                $a_url=$domain_url.$v;  
            }  
  
            $this->recursive_download_images($a_url);  
  
        } 
    }   
    /** 
     * 下载当前网页下的所有图片  
     * 
     * @param   String  $capture_url  用于抓取图片的网页地址 
     * @return  Array   当前网页上所有图片img标签url地址的一个数组 
     */  
    public function download_current_page_images($capture_url)  
    {  
        $content=@file_get_contents($capture_url);   //屏蔽warning错误  
  
        //匹配img标签src属性中?之前部分的正则  
        $img_pattern = "|<img [^ alt="PHP は Web サイトの画像をリモートで取得して保存します" >]+src=[&#39;\" ]?([^ &#39;\"?]+)[&#39;\" >]|U";     
        preg_match_all($img_pattern, $content, $img_out, PREG_SET_ORDER);  
  
        $photo_num = count($img_out);  
        //匹配到的图片数量  
        echo &#39;<h1 id="capture-url-nbsp-nbsp-共找到-nbsp-nbsp-nbsp-photo-num-nbsp-nbsp-nbsp-张图片">&#39;.$capture_url . "共找到 " . $photo_num . " 张图片</h1>";  
        foreach ($img_out as $k => $v)   
        {  
            $this->save_one_img($capture_url,$v[1]);  
        }  
    }
  
    /** 
     * 保存单个图片的方法  
     * 
     * @param String $capture_url   用于抓取图片的网页地址 
     * @param String $img_url       需要保存的图片的url 
     *  
     */  
    public function save_one_img($capture_url,$img_url)  
    {          
        //图片路径地址  
        if ( strpos($img_url, &#39;http://&#39;)!==false )   
        {  
            // $img_url = $img_url;  
        }else     
        {  
            $domain_url = substr($capture_url, 0,strpos($capture_url, &#39;/&#39;,8)+1);  
            $img_url=$domain_url.$img_url;  
        }             
        $pathinfo = pathinfo($img_url);    //获取图片路径信息          
        $pic_name=$pathinfo[&#39;basename&#39;];   //获取图片的名字  
        if (file_exists($this->save_path.$pic_name))  //如果图片存在,证明已经被抓取过,退出函数  
        {  
            echo $img_url . &#39;<span style="color:red;margin-left:80px">该图片已经抓取过!</span><br/>&#39;;   
            return;  
        }                  
        //将图片内容读入一个字符串  
        $img_data = @file_get_contents($img_url);   //屏蔽掉因为图片地址无法读取导致的warning错误  
        if ( strlen($img_data) > $this->img_size )   //下载size比限制大的图片  
        {  
            $img_size = file_put_contents($this->save_path . $pic_name, $img_data);  
            if ($img_size)  
            {  
                echo $img_url . &#39;<span style="color:green;margin-left:80px">图片保存成功!</span><br/>&#39;;  
            } else  
            {  
                echo $img_url . &#39;<span style="color:red;margin-left:80px">图片保存失败!</span><br/>&#39;;  
            }  
        } else  
        {  
            echo $img_url . &#39;<span style="color:red;margin-left:80px">图片读取失败!</span><br/>&#39;;  
        }   
    }   
} // END  
  
set_time_limit(120);     //设置脚本的最大执行时间  根据情况设置   
$download_img=new download_image(&#39;E:/images/&#39;,0);   //实例化下载图片对象  
$download_img->recursive_download_images(&#39;http://www.jbxue.com/&#39;); //递归抓取图片方法  
//$download_img->download_current_page_images($_POST[&#39;capture_url&#39;]); //只抓取当前页面图片方法  
?>

関連する推奨事項:

Webサイトから写真を取得し、フォルダーに自動的にダウンロードする

PHP_PHPチュートリアルで写真を取得する具体的な実装方法

PHP Snoopyクラスを使用してキャプチャする画像_PHP チュートリアル

以上がPHP は Web サイトの画像をリモートで取得して保存しますの詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

声明
この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。
PHP:サーバー側のスクリプト言語の紹介PHP:サーバー側のスクリプト言語の紹介Apr 16, 2025 am 12:18 AM

PHPは、動的なWeb開発およびサーバー側のアプリケーションに使用されるサーバー側のスクリプト言語です。 1.PHPは、編集を必要とせず、迅速な発展に適した解釈言語です。 2。PHPコードはHTMLに組み込まれているため、Webページの開発が簡単になりました。 3。PHPプロセスサーバー側のロジック、HTML出力を生成し、ユーザーの相互作用とデータ処理をサポートします。 4。PHPは、データベースと対話し、プロセスフォームの送信、サーバー側のタスクを実行できます。

PHPとWeb:その長期的な影響を調査しますPHPとWeb:その長期的な影響を調査しますApr 16, 2025 am 12:17 AM

PHPは過去数十年にわたってネットワークを形成しており、Web開発において重要な役割を果たし続けます。 1)PHPは1994年に発信され、MySQLとのシームレスな統合により、開発者にとって最初の選択肢となっています。 2)コア関数には、動的なコンテンツの生成とデータベースとの統合が含まれ、ウェブサイトをリアルタイムで更新し、パーソナライズされた方法で表示できるようにします。 3)PHPの幅広いアプリケーションとエコシステムは、長期的な影響を促進していますが、バージョンの更新とセキュリティの課題にも直面しています。 4)PHP7のリリースなど、近年のパフォーマンスの改善により、現代の言語と競合できるようになりました。 5)将来的には、PHPはコンテナ化やマイクロサービスなどの新しい課題に対処する必要がありますが、その柔軟性とアクティブなコミュニティにより適応性があります。

なぜPHPを使用するのですか?利点と利点が説明されましたなぜPHPを使用するのですか?利点と利点が説明されましたApr 16, 2025 am 12:16 AM

PHPの中心的な利点には、学習の容易さ、強力なWeb開発サポート、豊富なライブラリとフレームワーク、高性能とスケーラビリティ、クロスプラットフォームの互換性、費用対効果が含まれます。 1)初心者に適した学習と使用が簡単。 2)Webサーバーとの適切な統合および複数のデータベースをサポートします。 3)Laravelなどの強力なフレームワークを持っています。 4)最適化を通じて高性能を達成できます。 5)複数のオペレーティングシステムをサポートします。 6)開発コストを削減するためのオープンソース。

神話を暴く:PHPは本当に死んだ言語ですか?神話を暴く:PHPは本当に死んだ言語ですか?Apr 16, 2025 am 12:15 AM

PHPは死んでいません。 1)PHPコミュニティは、パフォーマンスとセキュリティの問題を積極的に解決し、PHP7.xはパフォーマンスを向上させます。 2)PHPは最新のWeb開発に適しており、大規模なWebサイトで広く使用されています。 3)PHPは学習しやすく、サーバーはうまく機能しますが、タイプシステムは静的言語ほど厳格ではありません。 4)PHPは、コンテンツ管理とeコマースの分野で依然として重要であり、エコシステムは進化し続けています。 5)OpcacheとAPCを介してパフォーマンスを最適化し、OOPと設計パターンを使用してコードの品質を向上させます。

PHP対Pythonの議論:どちらが良いですか?PHP対Pythonの議論:どちらが良いですか?Apr 16, 2025 am 12:03 AM

PHPとPythonには独自の利点と短所があり、選択はプロジェクトの要件に依存します。 1)PHPは、Web開発に適しており、学習しやすく、豊富なコミュニティリソースですが、構文は十分に近代的ではなく、パフォーマンスとセキュリティに注意を払う必要があります。 2)Pythonは、簡潔な構文と学習が簡単なデータサイエンスと機械学習に適していますが、実行速度とメモリ管理にはボトルネックがあります。

PHPの目的:動的なWebサイトの構築PHPの目的:動的なWebサイトの構築Apr 15, 2025 am 12:18 AM

PHPは動的なWebサイトを構築するために使用され、そのコア関数には次のものが含まれます。1。データベースに接続することにより、動的コンテンツを生成し、リアルタイムでWebページを生成します。 2。ユーザーのインタラクションを処理し、提出をフォームし、入力を確認し、操作に応答します。 3.セッションとユーザー認証を管理して、パーソナライズされたエクスペリエンスを提供します。 4.パフォーマンスを最適化し、ベストプラクティスに従って、ウェブサイトの効率とセキュリティを改善します。

PHP:データベースとサーバー側のロジックの処理PHP:データベースとサーバー側のロジックの処理Apr 15, 2025 am 12:15 AM

PHPはMySQLIおよびPDO拡張機能を使用して、データベース操作とサーバー側のロジック処理で対話し、セッション管理などの関数を介してサーバー側のロジックを処理します。 1)MySQLIまたはPDOを使用してデータベースに接続し、SQLクエリを実行します。 2)セッション管理およびその他の機能を通じて、HTTPリクエストとユーザーステータスを処理します。 3)トランザクションを使用して、データベース操作の原子性を確保します。 4)SQLインジェクションを防ぎ、例外処理とデバッグの閉鎖接続を使用します。 5)インデックスとキャッシュを通じてパフォーマンスを最適化し、読みやすいコードを書き、エラー処理を実行します。

PHPでのSQL注入をどのように防止しますか? (準備された声明、PDO)PHPでのSQL注入をどのように防止しますか? (準備された声明、PDO)Apr 15, 2025 am 12:15 AM

PHPで前処理ステートメントとPDOを使用すると、SQL注入攻撃を効果的に防ぐことができます。 1)PDOを使用してデータベースに接続し、エラーモードを設定します。 2)準備方法を使用して前処理ステートメントを作成し、プレースホルダーを使用してデータを渡し、メソッドを実行します。 3)結果のクエリを処理し、コードのセキュリティとパフォーマンスを確保します。

See all articles

ホットAIツール

Undresser.AI Undress

Undresser.AI Undress

リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover

AI Clothes Remover

写真から衣服を削除するオンライン AI ツール。

Undress AI Tool

Undress AI Tool

脱衣画像を無料で

Clothoff.io

Clothoff.io

AI衣類リムーバー

AI Hentai Generator

AI Hentai Generator

AIヘンタイを無料で生成します。

ホットツール

mPDF

mPDF

mPDF は、UTF-8 でエンコードされた HTML から PDF ファイルを生成できる PHP ライブラリです。オリジナルの作者である Ian Back は、Web サイトから「オンザフライ」で PDF ファイルを出力し、さまざまな言語を処理するために mPDF を作成しました。 HTML2FPDF などのオリジナルのスクリプトよりも遅く、Unicode フォントを使用すると生成されるファイルが大きくなりますが、CSS スタイルなどをサポートし、多くの機能強化が施されています。 RTL (アラビア語とヘブライ語) や CJK (中国語、日本語、韓国語) を含むほぼすべての言語をサポートします。ネストされたブロックレベル要素 (P、DIV など) をサポートします。

AtomエディタMac版ダウンロード

AtomエディタMac版ダウンロード

最も人気のあるオープンソースエディター

EditPlus 中国語クラック版

EditPlus 中国語クラック版

サイズが小さく、構文の強調表示、コード プロンプト機能はサポートされていません

PhpStorm Mac バージョン

PhpStorm Mac バージョン

最新(2018.2.1)のプロフェッショナル向けPHP統合開発ツール

WebStorm Mac版

WebStorm Mac版

便利なJavaScript開発ツール