Wissen

Wie man Kundenbewertungen mit Proxys überwacht

Bewertungsdaten sind lokalisiert, ratenbegrenzt und oft gesperrt. So ermöglichen Proxys die Erfassung von Kundenbewertungen über verschiedene Märkte hinweg, ohne Abdeckung zu verlieren.

Matt Brown

Matt Brown

25. September 2022 · Aktualisiert 31. August 2026 · 8 Min. Lesezeit

Bewertungsmonitoring sieht aus wie ein Reporting-Problem und verhält sich wie ein Datenerhebungsproblem. Die Bewertungen sind öffentlich, die Seiten sind leicht zu lesen, und dann stößt der erste ernsthafte Durchlauf auf die zwei Dinge, die diese Arbeit nicht trivial machen: Was eine Bewertungsseite anzeigt, hängt davon ab, woher die Anfrage kommt, und täglich dieselben Seiten abzurufen, ist genau das Traffic-Muster, auf das Anti-Bot-Systeme trainiert sind.

Dieser Artikel behandelt, wie Proxies dabei eine Rolle spielen, was gesammelt werden sollte, und wie eine Bewertungs-Pipeline stabil bleibt, wenn sie nach einem Zeitplan läuft.

Was ohne Proxies wirklich kaputtgeht

Beginnen wir mit der Lokalisierung. Google Reviews, die App-Stores, Trustpilots Länderdomains und die großen Marktplätze variieren ihre Ausgabe je nach Region des Anfragenden. Der Sternedurchschnitt kann sich unterscheiden, das Bewertungsset unterscheidet sich, übersetzte Versionen erscheinen in manchen Regionen und in anderen nicht, und auf Marktplätzen existiert das Listing selbst in einem bestimmten Land möglicherweise gar nicht. Ein Team, das von einer einzigen Büro-IP aus überwacht, sieht kein globales Bild. Es sieht das Bild eines Landes und nennt es global.

Dann das Volumen. Eine Marke, die einige hundert Produkte oder einige hundert Filialstandorte überwacht, fragt jeden Tag Tausende von Seiten von einer stabilen Adresse aus ab. Das ist ein Fingerabdruck. Die Reaktion ist zunächst meist keine harte Sperre, sondern eine Verschlechterung: langsamere Antworten, eine Zwischenseite, eine gekürzte Bewertungsliste, eine Challenge-Seite, die einen gültigen 200er-Status ohne Daten zurückgibt. Pipelines, die das nicht prüfen, zeichnen still und leise Nullen auf, und das Dashboard zeigt eine Bewertungsdürre, die es nie gegeben hat.

Proxies lösen beide Probleme. Geo-Targeting versetzt die Anfrage in den Markt, dessen Bewertungen man sehen möchte, und die Verteilung des Traffics über einen großen Residential-Pool hält jede einzelne Adresse deutlich unter der Rate, bei der eine Seite anfängt, aufmerksam zu werden.

Illustration of monitoring online customer reviews with proxies

Welcher Proxy-Typ zu welchem Ziel passt

Consumer-Bewertungsseiten sind der schwierige Fall. Google, Trustpilot, G2, Capterra, der App Store und Play Store, Amazon und die regionalen Marktplätze sitzen alle hinter ausgereiftem Bot-Management. Diese wollen residentielle IPs, weil diese Adressen zu echten Verbraucherverbindungen gehören und das Vertrauensprofil tragen, gegen das die Seite bewertet. Das ist der Großteil der meisten Bewertungsprogramme.

ISP-Proxies verdienen sich ihren Platz dort, wo der Ablauf einen Zustand hat. Wenn Bewertungen erst erscheinen, nachdem ein Geschäft ausgewählt, ein Lieferort festgelegt oder man sich bei einem eigenen Verkäuferkonto angemeldet hat, ist eine stabile Adresse über diese Schritte hinweg mehr wert als Rotation. ISP-Adressen sind statisch und consumer-geroutet, das ist genau die Kombination, die dieses Szenario braucht.

Datacenter-Proxies sind weiterhin sinnvoll bei der langen Schwanzverteilung: Nischen-Branchenbewertungsseiten, Foren, öffentliche Feeds, alles mit geringen Abwehrmaßnahmen. Die Kosten pro Anfrage sind niedriger, und die Vertrauensstrafe greift nicht. Sie gegen Google-Bewertungen einzusetzen, ist der Punkt, an dem Teams Geld verschwenden, denn eine billige Anfrage, die eine Challenge-Seite zurückgibt, ist nicht billig.

Die meisten ausgereiften Setups routen nach Ziel statt einen Typ für alles zu wählen. Harte Consumer-Plattformen bekommen residentielle Proxies, zustandsbehaftete Abläufe bekommen sticky Sessions, der einfache Rest läuft, wo es am günstigsten ist. Unser Hinweis zum Vermeiden von Blockierungen beim Scraping behandelt die Seite des gleichen Problems auf Anfrageebene.

Rotation, Sessions und Taktung

Die meiste Bewertungserhebung ist ein einfacher Seitenabruf: URL anfragen, Bewertungen parsen, weitermachen. Bei jeder Anfrage zu rotieren ist die richtige Standardeinstellung, und das macht ein rotierender residentieller Endpunkt ohne jeden Aufwand auf Ihrer Seite.

Sticky Sessions sind für die Ausnahmen wichtig. Das Paginieren einer Bewertungsliste hängt oft von einem Cursor ab, den die Seite an eine Session ausgibt, und ortsabhängige Bewertungen hängen von einer Auswahl ab, die die Seite gegen eine solche gespeichert hat. Ein IP-Wechsel mitten im Ablauf setzt diesen Zustand zurück, und man erhält entweder wieder Seite eins oder ein leeres Ergebnis. Die Session für die Dauer des Ablaufs halten, dann fallen lassen.

Die Taktung ist der Teil, in den Teams zu wenig investieren. Bewertungszahlen ändern sich langsam. Es hat keinen Nutzen, eine Produktseite stündlich zu bombardieren, wenn sich die zugrundeliegenden Daten wöchentlich ändern, und die Kosten dafür sind eine höhere Blockierungsrate auf den Seiten, die einem tatsächlich wichtig sind. Die Crawl-Frequenz sollte an die Geschwindigkeit angepasst werden, mit der sich Bewertungen für dieses Ziel ansammeln: täglich für stark frequentierte Marktplatz-Listings und App-Stores, wöchentlich für die meisten B2B-Software-Verzeichnisse, und ereignisgesteuert rund um Launches und Kampagnen, wenn ein Anstieg zu erwarten ist.

Auswahl dessen, was gesammelt wird

Der Instinkt ist, alles zu erfassen. Eine nützlichere Pipeline sammelt die Felder, die Entscheidungen unterstützen, und lässt den Rest weg.

Bewertung und Bewertungsanzahl pro Produkt, pro Standort und pro Markt liefern die Trendlinie. Bewertungstext, Datum und Sprache liefern die Substanz, und die Sprache ist es, die es ermöglicht, eine Beschwerde an ein Team weiterzuleiten, das sie lesen kann. Verified-Purchase-Kennzeichnungen und die Historie des Rezensenten trennen echtes Signal von Kampagnen. Verkäufer- oder Listing-Identität ist auf Marktplätzen wichtig, wo dasselbe Produkt, verkauft von einem Fälscher, Bewertungen trägt, die man kennen möchte, aber nicht mit dem eigenen Durchschnitt vermischt haben will.

Zwei Dinge sind es wert, ihnen zu widerstehen. Mehr persönliche Daten zu speichern, als die Analyse benötigt, macht aus einer Bewertungs-Pipeline ohne Nutzen ein Datenschutzproblem, und Rezensentennamen rechtfertigen sich selten. Und Bewertungstext wird von anderen Personen geschrieben, daher ist es eine Sache, ihn zur Analyse zu aggregieren, aber eine andere, ihn als Website-Inhalt erneut zu veröffentlichen.

Für Teams, deren Interesse an Bewertungen eher reputationsbezogen als analytisch ist, decken Markenschutz und Social Listening die benachbarten Bereiche ab, in denen dieselbe Beschwerde meist zuerst auftaucht.

Aufbau der Pipeline

Die Mechanik ist gewöhnlich. Ein Scheduler steuert eine Arbeitsliste von URLs nach Markt, jede Anfrage läuft über einen Proxy-Endpunkt mit dem für diese Zeile eingestellten Land, die Antwort geht an einen Parser, und die geparsten Bewertungen landen im Speicher, indiziert nach Plattform, Produkt und Markt, sodass dieselbe Bewertung niemals doppelt gezählt wird.

Die Teile, die entscheiden, ob sie den Kontakt mit der Produktion überlebt, sind weniger offensichtlich.

Antworten validieren, statt Statuscodes zu vertrauen, denn eine Challenge-Seite gibt einen 200er zurück und parst zu null Bewertungen. Ein Durchlauf, der plötzlich keine Bewertungen auf einer Seite findet, die gestern vierhundert hatte, ist ein Erhebungsfehler, kein Geschäftsereignis, und die Pipeline sollte das entsprechend kennzeichnen.

Günstig abrufen. Bewertungsseiten enthalten Bilder, Schriften und Analytics-Skripte, die zum Parsen nichts beitragen. Sie zu blockieren senkt die Bandbreite erheblich, und bei einem bandbreitenpreisigen Plan ist das der Unterschied zwischen ein paar GB pro Monat und einer Rechnung, über die man streiten müsste.

Nur rendern, wenn nötig. Manche Bewertungsbereiche sind serverseitig gerendert, und eine einfache HTTP-Anfrage reicht aus. Andere brauchen einen Headless-Browser, was eine Größenordnung mehr an Bandbreite und Zeit kostet. Das sollte pro Ziel geprüft werden, statt standardmäßig alles über einen Browser laufen zu lassen.

Die Rohantwort für ein kurzes Zeitfenster aufbewahren. Wenn ein Parser kaputtgeht, weil eine Plattform ihr Markup geändert hat, und das wird passieren, macht es der gestrige HTML-Bestand zu einem Zehn-Minuten-Job statt zu einem erneuten Crawl.

Wenn Ihr Team keine Lust hat, irgendetwas davon zu pflegen, liefert eine Scraping-API strukturierte Ausgaben zurück und übernimmt Rotation, Rendering und Wiederholungslogik zu einem höheren Preis pro Anfrage. Der Tradeoff ist Geld gegen Entwicklungszeit, und für ein Bewertungsprogramm, das ein paar Tausend Seiten pro Tag durchläuft, lohnt sich das meist nur, solange das Programm klein ist.

Was das kostet

Bewertungsmonitoring ist eine der günstigeren Proxy-Workloads, weil die Seiten klein sind, sobald man aufhört, Assets herunterzuladen, und die Crawl-Frequenz niedrig ist.

Bei Residential-Preisen ab $1.00/GB liegt ein täglicher Durchlauf über einige Tausend Produktseiten und mehrere Märkte typischerweise bei einem einstelligen monatlichen Bandbreitenwert. Die Variablen, die das bewegen, sind Headless Browsing, Bildladung und zu häufige Crawls, in dieser Reihenfolge. Alle drei sind Entwicklungsentscheidungen und keine Preisentscheidungen, was gut zu wissen ist, bevor man der Proxy-Rechnung die Schuld gibt.

Shifters Eignung hier ist die gewöhnliche: 205M+ residentielle IPs in über 195 Ländern mit Targeting auf Stadt- und ASN-Ebene, rotierende und sticky Sessions im selben Account, und unbegrenzte gleichzeitige Verbindungen, sodass ein Marktdurchlauf parallel statt sequenziell laufen kann. Unabhängige Zahlen zum Netzwerkverhalten stehen auf der Benchmarks-Seite statt hier behauptet zu werden.

Der Teil, der keine Infrastruktur ist

Erhebung ist die einfache Hälfte. Bewertungen zu überwachen lohnt sich nur, wenn dadurch etwas passiert, und die Programme, die sich auszahlen, leiten eine negative Bewertung an das Team weiter, das das Produkt verantwortet, nicht an ein Dashboard, das niemand öffnet.

Das bedeutet, im Voraus festzulegen, was Handlungen auslöst: eine Bewertung, die in einem bestimmten Markt unter einen Schwellenwert fällt, ein Anstieg von Bewertungen, die ein bestimmtes Wort erwähnen, ein Listing, das unter einem Verkäufer auftaucht, den man nicht kennt, ein Konkurrent, dessen Bewertung die eigene in einer Kategorie übertrifft, die man verteidigt. Die Proxy-Ebene existiert, um sicherzustellen, dass diese Signale vollständig und aktuell über jeden Markt hinweg sind, in dem man verkauft. Was man damit macht, ist die eigentliche Arbeit.

Weiterlesen: Wie man lokale Geschäftsdaten mit Proxies scrapt, das die standortbezogene Version desselben Erhebungsproblems behandelt.

Häufig gestellte Fragen

Warum brauche ich überhaupt Proxies, um Kundenbewertungen zu überwachen?

Zwei Gründe. Bewertungsseiten sind lokalisiert, sodass sich die Menge der Bewertungen, die Zusammenfassung der Bewertungen und manchmal sogar das Produkt selbst je nach dem Land ändern, aus dem die Anfrage kommt, und eine einzelne Büro-IP sieht immer nur eine Version. Zudem werden Bewertungsseiten wiederholt abgefragt, was genau dem Verkehrsmuster entspricht, das Rate Limiting erkennen soll. Proxies lösen das erste Problem durch Geo-Targeting und das zweite, indem sie Anfragen über mehrere Adressen verteilen.

Sind Residential- oder Datacenter-Proxies besser für die Überwachung von Bewertungen?

Residential für die Verbraucherplattformen, was den größten Teil der Arbeit ausmacht. Google, Trustpilot, die App-Stores und die großen Marktplätze behandeln Datacenter-Bereiche misstrauisch und liefern ihnen oft eine eingeschränkte oder mit einer Challenge versehene Seite. Datacenter-Proxies bleiben nützlich für leichtere Ziele wie kleinere Bewertungsseiten und öffentliche Feeds, bei denen die Kosten pro Anfrage entscheidend sind.

Sollten Sessions bei jeder Anfrage rotieren oder sticky bleiben?

Rotieren für einfache Seitenaufrufe, was den Großteil der Bewertungssammlung ausmacht. Sticky Sessions verwenden, wenn die Bewertungen erst nach einem Ablauf erscheinen, an den sich die Seite erinnern muss, etwa bei der Auswahl eines Geschäfts oder einer Lieferadresse, oder bei der Paginierung einer Bewertungsliste hinter einem Token. Beides in einem Crawler zu kombinieren ist normal.

Ist das Sammeln von Kundenbewertungen legal?

Öffentliche Bewertungsseiten sind öffentliche Daten, und das Lesen dieser Seiten wird im Allgemeinen so behandelt, aber die Bewertungen enthalten Benutzernamen und manchmal mehr, sodass Datenschutzregeln für das gelten, was du speicherst, nicht für das, was du abrufst. Auch die Nutzungsbedingungen jeder Plattform spielen eine Rolle, und manche schränken automatisierten Zugriff komplett ein. Aggregiere und analysiere, vermeide es, Bewertungstexte als eigene zu veröffentlichen, und lass dich für deine Rechtsordnung von einem Anwalt beraten. Dies ist keine Rechtsberatung.

Wie viel Bandbreite verbraucht die Überwachung von Bewertungen?

Weniger, als Teams erwarten, wenn der Crawler disziplin­iert arbeitet. Bewertungsseiten sind textschwer, aber ressourcenarm, und das Blockieren von Bildern und Schriftarten reduziert die Übertragung einer Seite meist um den größten Teil ihres Gewichts. Ein tägliches Durchsuchen von einigen Tausend Produkt- oder Standortseiten über mehrere Länder hinweg liegt meist im einstelligen GB-Bereich pro Monat, weshalb bandbreitenbasierte Residential-Tarife für diese Arbeitslast geeignet sind.

Bereit, loszulegen?

Testen Sie Shifters Residential-Proxys, 205M+ IPs, 195+ Länder, ab $0.75/GB.

Jetzt starten