Die Praxis, Bots einzusetzen, um Informationen und Inhalte von einer Website zu sammeln, wird als Web-Scraping bezeichnet. Ein Anbieter von Web-Scraping-Diensten erfasst den grundlegenden HTML-Code und die auf einem Server gespeicherten Daten, im Gegensatz zum Screen-Scraping, bei dem die auf dem Bildschirm sichtbaren Pixel erfasst werden. Anschließend kann der Scraper den gesamten Inhalt einer Website an anderer Stelle reproduzieren.
Viele digitale Unternehmen, die auf Datenerfassung angewiesen sind, nutzen Web-Scraping. Unternehmen, die Marktforschung betreiben, verwenden Scraper, um Informationen aus sozialen Medien und Foren zu gewinnen. Eine Website wird von Web-Suchalgorithmen gecrawlt, die anschließend ihre Daten untersuchen und ihr eine Bewertung zuweisen.
Preisvergleichswebsites nutzen Bots, um Produktpreise und Details von verbundenen Verkäufer-Websites zu beziehen. Web-Scraping wird darüber hinaus für Aktivitäten wie Preisabsprachen und Content-Diebstahl eingesetzt. Eine Website, die gescrapt wird, kann erhebliche finanzielle Verluste erleiden, insbesondere wenn es sich um ein Unternehmen handelt, das auf wettbewerbsorientierte Preisgestaltungsmethoden setzt oder Content-Distribution betreibt.
Der groß angelegte Diebstahl von Material von einer bestimmten Website wird als Content-Scraping bezeichnet. Online-Produktverzeichnisse und Websites, die auf digitale Inhalte angewiesen sind, um Traffic zu generieren, sind häufige Ziele. Ein Content-Scraping-Angriff kann für diese Unternehmen fatal sein.
So kostet beispielsweise die Erstellung der Inhalte für ihre Datenbank Zeit, Geld und Mühe für virtuelle lokale Branchenverzeichnisse. Durch Scraping kann all dies der Öffentlichkeit zugänglich gemacht, für Spam-Aktionen genutzt oder an Konkurrenzunternehmen verkauft werden.




