Zum Inhalt springen
Anmelden Registrieren

Extraktionsregeln

Übergeben Sie URL-codiertes JSON an extract_rules, um strukturierte Ausgaben von der Zielseite zu erhalten. Jede Regel besitzt einen CSS-Selektor, einen optionalen Ausgabetyp und ein Flag, um alle Treffer zurückzugeben. Extraktionsregeln funktionieren mit oder ohne JavaScript-Rendering.

GET https://scrape.shifter.io/v1?api_key=YOUR_API_KEY&url=<TARGET_URL>&extract_rules=<URL_ENCODED_JSON>
ParameterTypErforderlichBeschreibung
api_keystringjaIhr Web Scraping API-Schlüssel
urlstringjaZiel-URL, die abgerufen werden soll
extract_rulesstringjaURL-codiertes JSON, das die Extraktionsregeln beschreibt.
FeldTypErforderlichBeschreibung
selectorstringjaCSS-Selektor.
outputstringneinhtml (Standard), text, oder @attr, um ein Attribut auszulesen.
allstringnein"1", um alle Treffer als Array zurückzugeben, "0" (Standard) für den ersten Treffer.

Extrahieren Sie den Seitentitel als Text:

{"title": {"selector": "h1", "output": "text"}}
Terminal-Fenster
curl "https://scrape.shifter.io/v1?api_key=YOUR_API_KEY&url=https%3A%2F%2Fexample.com&extract_rules=%7B%22title%22%3A%20%7B%22selector%22%3A%20%22h1%22%2C%20%22output%22%3A%20%22text%22%7D%7D"
{ "title": "Example Domain" }