suchen
HeimBackend-EntwicklungPython-TutorialAusführliches Tutorial zur Verwendung der Scrapy-Shell zur Überprüfung der Ergebnisse der XPath-Auswahl

1. Scrapy Shell

ist ein gutes interaktives Tool des Scrapy-Pakets. Derzeit verwende ich es hauptsächlich, um die Ergebnisse der XPath-Auswahl zu überprüfen. Nach der Installation von Scrapy können Sie die Scrapy-Shell direkt über cmd bedienen.

Scrapy Shell

Scrapy-Terminal ist ein interaktives Terminal. Wir können den Code testen, ohne den Spider zu starten. Es kann auch verwendet werden, um XPath- oder CSS-Ausdrücke zu testen und zu sehen, wie sie funktionieren. Möglichkeit, die Extraktion von Daten aus den von uns gecrawlten Webseiten zu erleichtern.

Wenn IPython installiert ist, verwendet das Scrapy-Terminal IPython (anstelle des Standard-Python-Terminals). Das IPython-Terminal ist leistungsfähiger als andere und bietet intelligente automatische Vervollständigung, hervorgehobene Ausgabe und andere Funktionen. (Es wird empfohlen, IPython zu installieren)

Scrapy Shell starten

Geben Sie das Stammverzeichnis des Projekts ein und führen Sie den folgenden Befehl aus, um die Shell zu starten:

scrapy shell "http ://www.itcast.cn/channel/teacher.shtml"

Scrapy Shell erstellt automatisch einige praktische Objekte basierend auf der heruntergeladenen Seite, wie z. B. Antwortobjekt und Selektor Objekt (für HTML- und XML-Inhalte).

Wenn die Shell geladen wird, erhalten Sie eine lokale Antwortvariable mit Antwortdaten. Durch Eingabe von „response.body“ wird der Antworttext ausgegeben und „response.headers“ wird ausgegeben, um den Antwortheader anzuzeigen.

Wenn Sie „response.selector“ eingeben, erhalten Sie ein durch „response“ initialisiertes Objekt der Klasse „Selektor“. Zu diesem Zeitpunkt können Sie die Antwort mit „response.selector.xpath()“ oder „response.selector.css(“ abfragen. ).

Scrapy bietet auch einige Verknüpfungen, wie zum Beispiel „response.xpath()“ oder „response.css()“, die ebenfalls wirksam werden können (wie im vorherigen Fall).

Selectors

Scrapy Selectors integrierter XPath- und CSS-Selector-Ausdrucksmechanismus

Selector verfügt über vier grundlegende Methoden, die am häufigsten verwendete ist xpath:

xpath (): Übergeben Sie den xpath-Ausdruck und geben Sie die Auswahlliste aller Knoten zurück, die dem Ausdruck entsprechen

extract(): Serialisieren Sie den Knoten in einen Unicode-String und geben Sie die Liste zurück

css() : Übergeben Sie einen CSS-Ausdruck und geben Sie die Auswahlliste aller dem Ausdruck entsprechenden Knoten zurück. Die Syntax ist dieselbe wie bei BeautifulSoup4

re(): Extrahieren Sie Daten basierend auf der übergebenen Unicode-String-Liste Liste


2. ipython

auf der offiziellen Website Es wird empfohlen Ich wollte ipython verwenden, um Scrapy Shell auszuführen, also habe ich versucht, es zu installieren. Da meine Python-Umgebung zuvor über Conda konfiguriert wurde (siehe vorherigen Artikel), ist es sehr praktisch, ipython über conda zu installieren.

conda install -c conda-forge ipython

Dann wird das gesamte ipython-Paket heruntergeladen Alles ist kompiliert, es gibt keinen lästigen Kompilierungsfehlerprozess.

3. Führen Sie ipython aus und führen Sie Scrapy Shell auf ipython aus

im aktuellen cmd-Ausführungsfeld, weil Das System Die Umgebung wurde konfiguriert und Sie können das Python-Paket direkt ausführen. Geben Sie also ipython direkt in das cmd-Ausführungsfeld ein und Sie gelangen in das ipython-Ausführungsfeld, das dem Systemstandard-cmd ähnelt, jedoch umfangreichere Funktionen, kräftigere Farben und ein besseres Layout aufweist . Es kann auch gut sein.

Aber wenn ich den Scrapy-Shell-Befehl direkt darauf eingebe, wird immer wieder angezeigt, dass es keinen solchen Befehl gibt, und es schlägt fehl. Ich stecke hier fest.

Später durch sorgfältiges Lesen der Scrapy-Shell-Anweisungen

Wenn Sie IPython installiert haben, wird es von der Scrapy-Shell verwendet (anstelle der Standard-Python-Konsole ).

Das bedeutet, dass die Scrapy-Shell die Ipython-Laufbox selbst findet.

Geben Sie also direkt Scrapy Shell in das Standard-Ausführungsfeld von cmd ein, und das zurückgegebene Ergebnis wird direkt in das Ipython-Ausführungsfeld aufgerufen.

Das obige ist der detaillierte Inhalt vonAusführliches Tutorial zur Verwendung der Scrapy-Shell zur Überprüfung der Ergebnisse der XPath-Auswahl. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Stellungnahme
Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn
Der Hauptzweck von Python: Flexibilität und BenutzerfreundlichkeitDer Hauptzweck von Python: Flexibilität und BenutzerfreundlichkeitApr 17, 2025 am 12:14 AM

Die Flexibilität von Python spiegelt sich in Multi-Paradigm-Unterstützung und dynamischen Typsystemen wider, während eine einfache Syntax und eine reichhaltige Standardbibliothek stammt. 1. Flexibilität: Unterstützt objektorientierte, funktionale und prozedurale Programmierung und dynamische Typsysteme verbessern die Entwicklungseffizienz. 2. Benutzerfreundlichkeit: Die Grammatik liegt nahe an der natürlichen Sprache, die Standardbibliothek deckt eine breite Palette von Funktionen ab und vereinfacht den Entwicklungsprozess.

Python: Die Kraft der vielseitigen ProgrammierungPython: Die Kraft der vielseitigen ProgrammierungApr 17, 2025 am 12:09 AM

Python ist für seine Einfachheit und Kraft sehr beliebt, geeignet für alle Anforderungen von Anfängern bis hin zu fortgeschrittenen Entwicklern. Seine Vielseitigkeit spiegelt sich in: 1) leicht zu erlernen und benutzten, einfachen Syntax; 2) Reiche Bibliotheken und Frameworks wie Numpy, Pandas usw.; 3) plattformübergreifende Unterstützung, die auf einer Vielzahl von Betriebssystemen betrieben werden kann; 4) Geeignet für Skript- und Automatisierungsaufgaben zur Verbesserung der Arbeitseffizienz.

Python in 2 Stunden am Tag lernen: Ein praktischer LeitfadenPython in 2 Stunden am Tag lernen: Ein praktischer LeitfadenApr 17, 2025 am 12:05 AM

Ja, lernen Sie Python in zwei Stunden am Tag. 1. Entwickeln Sie einen angemessenen Studienplan, 2. Wählen Sie die richtigen Lernressourcen aus, 3. Konsolidieren Sie das durch die Praxis erlernte Wissen. Diese Schritte können Ihnen helfen, Python in kurzer Zeit zu meistern.

Python gegen C: Vor- und Nachteile für EntwicklerPython gegen C: Vor- und Nachteile für EntwicklerApr 17, 2025 am 12:04 AM

Python eignet sich für eine schnelle Entwicklung und Datenverarbeitung, während C für hohe Leistung und zugrunde liegende Kontrolle geeignet ist. 1) Python ist einfach zu bedienen, mit prägnanter Syntax, und eignet sich für Datenwissenschaft und Webentwicklung. 2) C hat eine hohe Leistung und eine genaue Kontrolle und wird häufig bei der Programmierung von Spielen und Systemen verwendet.

Python: zeitliches Engagement und LerntempoPython: zeitliches Engagement und LerntempoApr 17, 2025 am 12:03 AM

Die Zeit, die zum Erlernen von Python erforderlich ist, variiert von Person zu Person, hauptsächlich von früheren Programmiererfahrungen, Lernmotivation, Lernressourcen und -methoden und Lernrhythmus. Setzen Sie realistische Lernziele und lernen Sie durch praktische Projekte am besten.

Python: Automatisierung, Skript- und AufgabenverwaltungPython: Automatisierung, Skript- und AufgabenverwaltungApr 16, 2025 am 12:14 AM

Python zeichnet sich in Automatisierung, Skript und Aufgabenverwaltung aus. 1) Automatisierung: Die Sicherungssicherung wird durch Standardbibliotheken wie OS und Shutil realisiert. 2) Skriptschreiben: Verwenden Sie die PSUTIL -Bibliothek, um die Systemressourcen zu überwachen. 3) Aufgabenverwaltung: Verwenden Sie die Zeitplanbibliothek, um Aufgaben zu planen. Die Benutzerfreundlichkeit von Python und die Unterstützung der reichhaltigen Bibliothek machen es zum bevorzugten Werkzeug in diesen Bereichen.

Python und Zeit: Machen Sie das Beste aus Ihrer StudienzeitPython und Zeit: Machen Sie das Beste aus Ihrer StudienzeitApr 14, 2025 am 12:02 AM

Um die Effizienz des Lernens von Python in einer begrenzten Zeit zu maximieren, können Sie Pythons DateTime-, Zeit- und Zeitplanmodule verwenden. 1. Das DateTime -Modul wird verwendet, um die Lernzeit aufzuzeichnen und zu planen. 2. Das Zeitmodul hilft, die Studie zu setzen und Zeit zu ruhen. 3. Das Zeitplanmodul arrangiert automatisch wöchentliche Lernaufgaben.

Python: Spiele, GUIs und mehrPython: Spiele, GUIs und mehrApr 13, 2025 am 12:14 AM

Python zeichnet sich in Gaming und GUI -Entwicklung aus. 1) Spielentwicklung verwendet Pygame, die Zeichnungen, Audio- und andere Funktionen bereitstellt, die für die Erstellung von 2D -Spielen geeignet sind. 2) Die GUI -Entwicklung kann Tkinter oder Pyqt auswählen. Tkinter ist einfach und einfach zu bedienen. PYQT hat reichhaltige Funktionen und ist für die berufliche Entwicklung geeignet.

See all articles

Heiße KI -Werkzeuge

Undresser.AI Undress

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

Clothoff.io

KI-Kleiderentferner

AI Hentai Generator

AI Hentai Generator

Erstellen Sie kostenlos Ai Hentai.

Heißer Artikel

R.E.P.O. Energiekristalle erklärten und was sie tun (gelber Kristall)
1 Monate vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Beste grafische Einstellungen
1 Monate vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. So reparieren Sie Audio, wenn Sie niemanden hören können
1 Monate vorBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Chat -Befehle und wie man sie benutzt
1 Monate vorBy尊渡假赌尊渡假赌尊渡假赌

Heiße Werkzeuge

mPDF

mPDF

mPDF ist eine PHP-Bibliothek, die PDF-Dateien aus UTF-8-codiertem HTML generieren kann. Der ursprüngliche Autor, Ian Back, hat mPDF geschrieben, um PDF-Dateien „on the fly“ von seiner Website auszugeben und verschiedene Sprachen zu verarbeiten. Es ist langsamer und erzeugt bei der Verwendung von Unicode-Schriftarten größere Dateien als Originalskripte wie HTML2FPDF, unterstützt aber CSS-Stile usw. und verfügt über viele Verbesserungen. Unterstützt fast alle Sprachen, einschließlich RTL (Arabisch und Hebräisch) und CJK (Chinesisch, Japanisch und Koreanisch). Unterstützt verschachtelte Elemente auf Blockebene (wie P, DIV),

Sicherer Prüfungsbrowser

Sicherer Prüfungsbrowser

Safe Exam Browser ist eine sichere Browserumgebung für die sichere Teilnahme an Online-Prüfungen. Diese Software verwandelt jeden Computer in einen sicheren Arbeitsplatz. Es kontrolliert den Zugriff auf alle Dienstprogramme und verhindert, dass Schüler nicht autorisierte Ressourcen nutzen.

ZendStudio 13.5.1 Mac

ZendStudio 13.5.1 Mac

Leistungsstarke integrierte PHP-Entwicklungsumgebung

SublimeText3 Mac-Version

SublimeText3 Mac-Version

Codebearbeitungssoftware auf Gottesniveau (SublimeText3)

Dreamweaver Mac

Dreamweaver Mac

Visuelle Webentwicklungstools