Saltar al contenido Nuevo Te presentamos nuestra oferta Perfect Docs Guaranteed — 99,2% de precisión para equipos de alto volumen. Plazas limitadas. Saber más

API de OCR de documentos, hecha para developers

Haz OCR de cualquier documento PDF o imagen a través de un único endpoint y recibe JSON estructurado y validado — facturas, suministros, documentación hipotecaria, DNIs o cualquier schema que definas. La auth es un header; los resultados llegan en segundos vía webhook.

  • 500 páginas gratis
  • Sin tarjeta
# Upload a document — any PDF or image
curl -X POST https://api.invofox.com/v1/ingest/uploads \
  -H "x-api-key: $INVOFOX_API_KEY" \
  -F "[email protected]" \
  -F 'info={"type":"invoice"}'

# → the document.processed webhook delivers:
{
  "type": "invoice",
  "data": {
    "invoiceNumber": "INV-2026-0841",
    "provider": {
      "name": "Acme Supplies GmbH",
      "taxId": "DE811570831"
    },
    "totalAmount": 1804.28
  }
}

OCR de un documento PDF a JSON estructurado

Esta es la factura del quickstart de arriba, completa — líneas, fechas, IBAN y totales que cuadran, lista para tu ERP.

Los campos mostrados son el schema de factura por defecto — define tus propios campos para cualquier tipo de documento.

GET /documents/{id} json
 {
  "_id": "68a1f30b2c9e4d0012f7a1b3",
  "type": "invoice",
  "data": {
    "invoiceNumber": "INV-2026-0841",
    "issueDate": "2026-07-02",
    "dueDate": "2026-08-01",
    "provider": {
      "name": "Acme Supplies GmbH",
      "taxId": "DE811570831",
      "iban": "DE89370400440532013000"
    },
    "lines": [
      {
        "description": "Thermal paper rolls 80x80",
        "quantity": 40,
        "unitPrice": 21.90,
        "amount": 876.00
      },
      {
        "description": "Label printer ZD421",
        "quantity": 2,
        "unitPrice": 307.85,
        "amount": 615.70
      },
      {
        "description": "Shipping & handling",
        "quantity": 1,
        "unitPrice": 24.50,
        "amount": 24.50
      }
    ],
    "subtotal": 1516.20,
    "taxRate": 0.19,
    "taxAmount": 288.08,
    "totalAmount": 1804.28,
    "currency": "EUR"
  }
} 

Límites, latencia y pricing

Los números que normalmente tendrías que rebuscar en la documentación.

  • ~10 s latencia típica

    De la subida al JSON estructurado

    El procesado es asíncrono — suscríbete al webhook document.processed en vez de hacer polling.

  • 1→N classifier + splitter

    Lotes y archivos mixtos bienvenidos

    Envía un lote comprimido o un PDF multi-documento — el splitter lo separa y el classifier enruta cada documento a su extractor.

  • Todos tipos de documento

    No solo facturas

    Facturas de suministros, documentación hipotecaria, DNIs, albaranes — tipos pre-entrenados o definidos por tu schema. Independiente del layout por diseño, sin plantillas.

  • 500 páginas gratis

    Pricing por uso

    Precio por página que escala linealmente — sin seats, sin coste de setup. Empieza gratis, sin tarjeta.

Todos los tipos de documento, una sola API

Los tipos pre-entrenados extraen datos de cualquier documento PDF o imagen out of the box — o define tu propio schema para cualquier otro. Cada tarjeta enlazada tiene su página en profundidad.

Por qué una API de OCR especializada gana al DIY

Lo que tendrías que construir alrededor de Tesseract o de una API de hyperscaler ya viene dentro.

  • JSON validado, no texto en bruto

    Los motores OCR devuelven caracteres; los hyperscalers devuelven cajas. Esta API devuelve campos tipados y validados con tus reglas de negocio ya aplicadas.

  • Cualquier layout, cero plantillas

    Entrenada con diversidad documental real — escaneos torcidos, fotos, PDFs de 100 páginas. Sin plantillas por proveedor que construir ni mantener.

  • Document ops incluido

    Reintentos, colas asíncronas, webhooks, clasificación y splitting vienen con la API — la infraestructura que los pipelines DIY tardan meses en reconstruir.

Benchmark hecho, no prometido: GPT-4o vs Claude vs Invofox para document parsing — con code samples →

La OCR API, en preguntas

~/invofox / faq.json
howto.json
1
2 ··"question" "¿Cómo hago OCR de un PDF a JSON estructurado?"
3
4 ··"answer" "Sube el PDF al endpoint de ingesta con su tipo de documento, suscríbete al webhook document.processed y lee los campos extraídos del endpoint de documentos. El flujo completo está en el quickstart de arriba en cURL, Python y Node — sin motor OCR que operar ni post-procesado que escribir."
5
How-to howto.json
main 0 errors 0 warnings UTF-8 LF JSON

¿Queda algo sin responder? Ver la documentación