Scrape
O endpointPOST /scrape executa scraping síncrono em uma URL e retorna o
conteúdo nos formatos solicitados. O motor anti-bot nativo do Messora evade
proteções automaticamente.
Endpoint
Autenticação
HeaderX-API-Key obrigatório. Veja Autenticação.
Parâmetros
string
obrigatório
URL pública a ser raspada. URLs internas (RFC1918, loopback, metadata cloud) são rejeitadas pelo SSRF guard.
string[]
padrão:"[\"markdown\"]"
Formatos de saída desejados. Valores aceitos:
markdown, json, raw.object
Schema JSON para extração estruturada. Obrigatório quando
formats inclui json.string
Prompt de contexto para guiar a extração estruturada (usado junto com
json_schema).boolean
padrão:"false"
Se
true, renderiza JavaScript antes da extração (headless browser).boolean
padrão:"false"
Se
true, extrai apenas o conteúdo principal da página, removendo navegação, rodapés e sidebars.integer
padrão:"60"
Tempo máximo de espera em segundos (1–180).
integer
Tempo adicional em milissegundos para aguardar após o carregamento (útil com
render_js).integer
padrão:"1"
Máximo de páginas extraídas em uma única chamada (1–50). Multiplica o
custo:
markdown/raw cobram 1 crédito por página, então max_pages: 50
custa até 50 créditos. Ignorado quando formats inclui json (10 créditos fixos).string[]
Tags de atribuição para o registro de uso (até 10 tags).
A lista completa de parâmetros — incluindo
fact_check, max_age_ms,
max_depth, follow_subdomains, include_frames e parse_pdf — é gerada a
partir do schema na página de referência POST /scrape.Custo
Falhas (
blocked_antibot, timeout, extraction_failed) não consomem créditos.Exemplo
Resposta de sucesso
Extração estruturada (JSON)
Para extrair dados estruturados, incluajson nos formats e forneça um json_schema: