Ir al contenido
Iniciar sesión Registrarse

Reglas de extracción

Pasa JSON codificado en URL a extract_rules para obtener una salida estructurada de la página de destino. Cada regla tiene un selector CSS, un tipo de salida opcional y un indicador para devolver todas las coincidencias. Las reglas de extracción funcionan con o sin renderizado de JavaScript.

GET https://scrape.shifter.io/v1?api_key=YOUR_API_KEY&url=<TARGET_URL>&extract_rules=<URL_ENCODED_JSON>
ParameterTypeRequiredDescription
api_keystringyesTu clave de la Web Scraping API
urlstringyesURL de destino que se va a obtener
extract_rulesstringyesJSON codificado en URL que describe las reglas de extracción.
FieldTypeRequiredDescription
selectorstringyesSelector CSS.
outputstringnohtml (por defecto), text, o @attr para extraer un atributo.
allstringno"1" para devolver todas las coincidencias como un array, "0" (por defecto) para la primera coincidencia.

Extrae el título de la página como texto:

{"title": {"selector": "h1", "output": "text"}}
Ventana de terminal
curl "https://scrape.shifter.io/v1?api_key=YOUR_API_KEY&url=https%3A%2F%2Fexample.com&extract_rules=%7B%22title%22%3A%20%7B%22selector%22%3A%20%22h1%22%2C%20%22output%22%3A%20%22text%22%7D%7D"
{ "title": "Example Domain" }