OCR (documentos)
Extraia texto de imagens e PDFs (incluindo PDFs multi-página) e receba markdown.
POST https://api.norlen.io/v1/ocrAuthorization: Bearer SUA_API_KEYRequisição
Seção intitulada “Requisição”multipart/form-data — envie o arquivo a processar.
| Campo | Tipo | Obrigatório | Descrição |
|---|---|---|---|
file | arquivo | sim | Imagem (png, jpg, webp, bmp, tiff) ou pdf — até 20MB |
clean | string | não | true remove marcações de layout/detecção; padrão false |
curl https://api.norlen.io/v1/ocr \ -H "Authorization: Bearer $NORLEN_API_KEY" \ -F file="@documento.pdf" \ -F clean="true"import requests
resp = requests.post( "https://api.norlen.io/v1/ocr", headers={"Authorization": f"Bearer {NORLEN_API_KEY}"}, files={"file": open("documento.pdf", "rb")}, data={"clean": "true"},)print(resp.json()["text"])import fs from "fs";
const fd = new FormData();fd.append("file", new Blob([fs.readFileSync("documento.pdf")]), "documento.pdf");fd.append("clean", "true");
const resp = await fetch("https://api.norlen.io/v1/ocr", { method: "POST", headers: { Authorization: `Bearer ${process.env.NORLEN_API_KEY}` }, body: fd,});const { text } = await resp.json();console.log(text);Resposta
Seção intitulada “Resposta”{ "text": "# Título do documento\n\nConteúdo extraído em markdown..."}PDFs multi-página são processados em sequência e concatenados no mesmo text.