Skip to main content

Scrape

O endpoint POST /scrape executa scraping síncrono em uma URL e retorna o conteúdo nos formatos solicitados. O motor anti-bot nativo do Messora evade proteções automaticamente.

Endpoint

Autenticação

Header X-API-Key obrigatório. Veja Autenticação.

Parâmetros

string
obrigatório
URL pública a ser raspada. URLs internas (RFC1918, loopback, metadata cloud) são rejeitadas pelo SSRF guard.
string[]
padrão:"[\"markdown\"]"
Formatos de saída desejados. Valores aceitos: markdown, json, raw.
object
Schema JSON para extração estruturada. Obrigatório quando formats inclui json.
string
Prompt de contexto para guiar a extração estruturada (usado junto com json_schema).
boolean
padrão:"false"
Se true, renderiza JavaScript antes da extração (headless browser).
boolean
padrão:"false"
Se true, extrai apenas o conteúdo principal da página, removendo navegação, rodapés e sidebars.
integer
padrão:"60"
Tempo máximo de espera em segundos (1–180).
integer
Tempo adicional em milissegundos para aguardar após o carregamento (útil com render_js).
string[]
Tags de atribuição para o registro de uso (até 10 tags).

Custo

Falhas (blocked_antibot, timeout, extraction_failed) não consomem créditos.

Exemplo

Resposta de sucesso

Extração estruturada (JSON)

Para extrair dados estruturados, inclua json nos formats e forneça um json_schema:
Extração estruturada consome 10 créditos por request (independente do resultado).

Status da resposta

Erros