Skip to main content

Scrape

O endpoint POST /scrape executa scraping síncrono em uma URL e retorna o conteúdo nos formatos solicitados. O motor anti-bot nativo do Messora evade proteções automaticamente.

Endpoint

Autenticação

Header X-API-Key obrigatório. Veja Autenticação.

Parâmetros

string
obrigatório
URL pública a ser raspada. URLs internas (RFC1918, loopback, metadata cloud) são rejeitadas pelo SSRF guard.
string[]
padrão:"[\"markdown\"]"
Formatos de saída desejados. Valores aceitos: markdown, json, raw.
object
Schema JSON para extração estruturada. Obrigatório quando formats inclui json.
string
Prompt de contexto para guiar a extração estruturada (usado junto com json_schema).
boolean
padrão:"false"
Se true, renderiza JavaScript antes da extração (headless browser).
boolean
padrão:"false"
Se true, extrai apenas o conteúdo principal da página, removendo navegação, rodapés e sidebars.
integer
padrão:"60"
Tempo máximo de espera em segundos (1–180).
integer
Tempo adicional em milissegundos para aguardar após o carregamento (útil com render_js).
integer
padrão:"1"
Máximo de páginas extraídas em uma única chamada (1–50). Multiplica o custo: markdown/raw cobram 1 crédito por página, então max_pages: 50 custa até 50 créditos. Ignorado quando formats inclui json (10 créditos fixos).
string[]
Tags de atribuição para o registro de uso (até 10 tags).
A lista completa de parâmetros — incluindo fact_check, max_age_ms, max_depth, follow_subdomains, include_frames e parse_pdf — é gerada a partir do schema na página de referência POST /scrape.

Custo

Falhas (blocked_antibot, timeout, extraction_failed) não consomem créditos.

Exemplo

Resposta de sucesso

Extração estruturada (JSON)

Para extrair dados estruturados, inclua json nos formats e forneça um json_schema:
Extração estruturada consome 10 créditos por request. Uma execução que falha (blocked_antibot, timeout, extraction_failed) estorna os 10.

Status da resposta

Erros