API de extração e inteligência documental. PDF, imagens, planilhas, áudio — estruturado para seus produtos.
curl -X POST https://doclenz.dev/v1/extract \ -H "X-API-Key: dlens_prod_yourkey_abc123" \ -F "file=@cardapio.pdf" \ -F 'schema={"type":"object","properties":{"pratos":{"type":"array"}}}' { "status": "completed", "chunks": [{ "text": "Bruschetta de tomate...", "type": "text", "tokens": 142 }], "structured": { "pratos": [{ "nome": "Bruschetta", "preco": 25.90 }] }, "processing_ms": 380 }
PDF, DOCX, XLSX, HTML, CSV, imagens — Kreuzberg extrai texto, tabelas e código nativamente.
pipeline: TEXTPaddleOCR + table detection para imagens e PDFs escaneados. Fallback automático quando necessário.
pipeline: OCRQwen2.5-VL local ou Gemini Flash. Foto de prato retorna ingredientes, categoria e descrição.
pipeline: VISIONWhisper large-v3 com diarização. Áudio de 1min transcrito em <30s com segmentos temporais.
pipeline: AUDIOPasse um JSON Schema e receba dados estruturados. GPT-4o-mini, Claude ou Gemini — você escolhe.
+ schemaJobs assíncronos com polling ou webhook. Retry automático com backoff exponencial.
async=true