recherche

Maison  >  Questions et réponses  >  le corps du texte

网页爬虫 - Python爬虫返回状态码与实际情况不符?

import urllib2

opener = urllib2.build_opener()

html = None
response = None

response = opener.open('http://www.sxxrcs.com/was5/web/')
html = response.code
print html

比如这个爬虫,输出状态码是200。

可是直接访问http://www.sxxrcs.com/was5/web/是404,抓包响应的也是404,请问这是为什么?

黄舟黄舟2872 Il y a quelques jours641

répondre à tous(2)je répondrai

  • 伊谢尔伦

    伊谢尔伦2017-04-18 10:26:31

    Utiliser les requêtes

    import requests
    
    r = requests.get('http://www.sxxrcs.com/was5/web/')
    print r.status_code
    print r.text

    répondre
    0
  • 高洛峰

    高洛峰2017-04-18 10:26:31

    200, c'est normal, les demandes sont pratiques et rapides.

    répondre
    0
  • Annulerrépondre