用Python网络爬虫来看看最近电影院都有哪些上映的电影-Python教程-PHP中文网

首页

后端开发

Python教程

用Python网络爬虫来看看最近电影院都有哪些上映的电影

Go语言进阶学习

Jul 25, 2023 pm 05:21 PM

python

/1 前言/

猫眼电影是淘宝联合打造电影分类最全的电影的平台，能够第一时间告知用户，最新的电影上线时间。今天教大家获取猫眼电影的即将上映的电影详情。

用Python网络爬虫来看看最近电影院都有哪些上映的电影

/2 项目目标/

获取猫眼电影的即将上映的电影详情。

/3 项目准备/

软件：PyCharm

需要的库：requests、lxml、random、time

插件：Xpath

网站如下：

https://maoyan.com/films?showType=2&offset={}

点击下一页的按钮，观察到网站的变化分别如下：

https://maoyan.com/films?showType=2&offset=30
https://maoyan.com/films?showType=2&offset=60
https://maoyan.com/films?showType=2&offset=90

点击下一页时，页面每增加一页offset=()每次增加30，所以可以用{}代替变换的变量，再用for循环遍历这网址，实现多个网址请求。

/4 项目实现/

1、定义一个class类继承object，定义init方法继承self，主函数main继承self。导入需要的库和网址，代码如下所示。

import requests
from lxml import etree


import time
import random


class MaoyanSpider(object):
    def __init__(self):
      self.url = "https://maoyan.com/films?showType=2&offset={}"


    def main(self):
        pass


if __name__ == '__main__':
    spider = MaoyanSpider()
    spider.main()

2、随机产生UserAgent。

 for i in range(1, 50):
    # ua.random,一定要写在这里,每次请求都会随机选择。
        self.headers = {
            &#39;User-Agent&#39;: ua.random,
        }

3、发送请求，获取页面响应。

def get_page(self, url):
  # random.choice一定要写在这里,每次请求都会随机选择
  res = requests.get(url, headers=self.headers)
  res.encoding = &#39;utf-8&#39;
  html = res.text
  self.parse_page(html)

4、xpath解析一级页面数据，获取页面信息。

1）基准xpath节点对象列表。

 # 　创建解析对象
parse_html = etree.HTML(html)
# 基准xpath节点对象列表
dd_list = parse_html.xpath(&#39;//dl[@class="movie-list"]//dd&#39;)

2）依次遍历每个节点对象，提取数据。

 for dd in dd_list:
    name = dd.xpath(&#39;.//div[@class="movie-hover-title"]//span[@class="name noscore"]/text()&#39;)[0].strip()
    star = dd.xpath(&#39;.//div[@class="movie-hover-info"]//div[@class="movie-hover-title"][3]/text()&#39;)[1].strip()
    type = dd.xpath(&#39;.//div[@class="movie-hover-info"]//div[@class="movie-hover-title"][2]/text()&#39;)[1].strip()
    dowld=dd.xpath(&#39;.//div[@class="movie-item-hover"]/a/@href&#39;)[0].strip()
    # print(movie_dict)
    movie = &#39;&#39;&#39;【即将上映】

5、定义movie，保存打印数据。

 movie = &#39;&#39;&#39;【即将上映】
            
电影名字: %s


主演：%s


类型：%s
详情链接：https://maoyan.com%s
=========================================================
                                   &#39;&#39;&#39; % (name, star, type,dowld)
print( movie)

6、random.randint()方法，设置时间延时。

time.sleep(random.randint(1, 3))

7、调用方法，实现功能。

html = self.get_page(url)
self.parse_page(html)

/5 效果展示/

1、点击绿色小三角运行输入起始页，终止页。

用Python网络爬虫来看看最近电影院都有哪些上映的电影

2、运行程序后，结果显示在控制台，如下图所示。

用Python网络爬虫来看看最近电影院都有哪些上映的电影

3、点击蓝色下载链接, 网络查看详情。

用Python网络爬虫来看看最近电影院都有哪些上映的电影

/6 小结/

1、不建议抓取太多数据，容易对服务器造成负载，浅尝辄止即可。

2、本文基于Python网络爬虫，利用爬虫库，实现爬取猫眼电影。

以上是用Python网络爬虫来看看最近电影院都有哪些上映的电影的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文转载于：Go语言进阶学习。如有侵权，请联系admin@php.cn删除

详细讲解Python之Seaborn（数据可视化）Apr 21, 2022 pm 06:08 PM

本篇文章给大家带来了关于Python的相关知识，其中主要介绍了关于Seaborn的相关问题，包括了数据可视化处理的散点图、折线图、条形图等等内容，下面一起来看一下，希望对大家有帮助。

详细了解Python进程池与进程锁May 10, 2022 pm 06:11 PM

本篇文章给大家带来了关于Python的相关知识，其中主要介绍了关于进程池与进程锁的相关问题，包括进程池的创建模块，进程池函数等等内容，下面一起来看一下，希望对大家有帮助。

Python自动化实践之筛选简历Jun 07, 2022 pm 06:59 PM

本篇文章给大家带来了关于Python的相关知识，其中主要介绍了关于简历筛选的相关问题，包括了定义 ReadDoc 类用以读取 word 文件以及定义 search_word 函数用以筛选的相关内容，下面一起来看一下，希望对大家有帮助。

归纳总结Python标准库May 03, 2022 am 09:00 AM

本篇文章给大家带来了关于Python的相关知识，其中主要介绍了关于标准库总结的相关问题，下面一起来看一下，希望对大家有帮助。

Python数据类型详解之字符串、数字Apr 27, 2022 pm 07:27 PM

本篇文章给大家带来了关于Python的相关知识，其中主要介绍了关于数据类型之字符串、数字的相关问题，下面一起来看一下，希望对大家有帮助。

分享10款高效的VSCode插件，总有一款能够惊艳到你！！Mar 09, 2021 am 10:15 AM

VS Code的确是一款非常热门、有强大用户基础的一款开发工具。本文给大家介绍一下10款高效、好用的插件，能够让原本单薄的VS Code如虎添翼，开发效率顿时提升到一个新的阶段。

详细介绍python的numpy模块May 19, 2022 am 11:43 AM

本篇文章给大家带来了关于Python的相关知识，其中主要介绍了关于numpy模块的相关问题，Numpy是Numerical Python extensions的缩写，字面意思是Python数值计算扩展，下面一起来看一下，希望对大家有帮助。

python中文是什么意思Jun 24, 2019 pm 02:22 PM

pythn的中文意思是巨蟒、蟒蛇。1989年圣诞节期间，Guido van Rossum在家闲的没事干，为了跟朋友庆祝圣诞节，决定发明一种全新的脚本语言。他很喜欢一个肥皂剧叫Monty Python，所以便把这门语言叫做python。

See all articles

热AI工具

热工具

2、随机产生UserAgent。

3、发送请求，获取页面响应。

4、xpath解析一级页面数据，获取页面信息。

2）依次遍历每个节点对象，提取数据。

5、定义movie，保存打印数据。

6、random.randint()方法，设置时间延时。

7、调用方法，实现功能。

热AI工具

Undresser.AI Undress

AI Clothes Remover

Undress AI Tool

Clothoff.io

AI Hentai Generator

热门文章

热工具

Dreamweaver CS6

记事本++7.3.1

安全考试浏览器

SublimeText3 英文版

ZendStudio 13.5.1 Mac

热门话题