Was kam zuerst? Der Webcrawler oder der Webscraper?
Das hängt davon ab, wie man zwischen Extraktion und Herunterladen unterscheidet. Web-Scraping erfordert nicht immer die Nutzung des Internets. Das Extrahieren von Informationen aus einem lokalen System, einer Datenbank oder mithilfe von Data-Scraping-Tools kann als Datenerfassung bezeichnet werden. Web-Crawler hingegen haben in erster Linie die Aufgabe, eine Kopie aller aufgerufenen Seiten für die spätere Verarbeitung durch Suchmaschinen zu erstellen, die die gespeicherten Seiten indexieren und schnell nach nicht indexierten Seiten suchen.
Dieser Artikel soll die Unterschiede und Gemeinsamkeiten von Web-Scraping, Crawling und allem dazwischen erläutern. Als Bonus haben wir einen ausführlichen Leitfaden zum Erstellen eines eigenen Web-Crawlers beigefügt – lesen Sie also weiter!




