DocLenz

API de extração e inteligência documental. PDF, imagens, planilhas, áudio — estruturado para seus produtos.

curl -X POST https://doclenz.dev/v1/extract \
  -H "X-API-Key: dlens_prod_yourkey_abc123" \
  -F "file=@cardapio.pdf" \
  -F 'schema={"type":"object","properties":{"pratos":{"type":"array"}}}'

{
  "status": "completed",
  "chunks": [{ "text": "Bruschetta de tomate...", "type": "text", "tokens": 142 }],
  "structured": { "pratos": [{ "nome": "Bruschetta", "preco": 25.90 }] },
  "processing_ms": 380
}

Extração nativa

PDF, DOCX, XLSX, HTML, CSV, imagens — Kreuzberg extrai texto, tabelas e código nativamente.

pipeline: TEXT

OCR inteligente

PaddleOCR + table detection para imagens e PDFs escaneados. Fallback automático quando necessário.

pipeline: OCR

Vision (VLM)

Qwen2.5-VL local ou Gemini Flash. Foto de prato retorna ingredientes, categoria e descrição.

pipeline: VISION

Transcrição de áudio

Whisper large-v3 com diarização. Áudio de 1min transcrito em <30s com segmentos temporais.

pipeline: AUDIO

LLM Enrichment

Passe um JSON Schema e receba dados estruturados. GPT-4o-mini, Claude ou Gemini — você escolhe.

+ schema

Webhooks + Async

Jobs assíncronos com polling ou webhook. Retry automático com backoff exponencial.

async=true

Planos

Free

R$ 0 / mês
  • 500 UPs / mês
  • 10 req/min
  • OCR apenas
  • Suporte comunidade

Pro

R$ 97 / mês
  • 10.000 UPs / mês
  • 60 req/min
  • OCR + Vision + Audio
  • LLM Enrichment
  • Webhooks
  • Suporte prioritário

Enterprise

Sob consulta
  • UPs ilimitados
  • Rate limit customizado
  • Todas as features
  • Deploy on-premise
  • SLA 99.9%