API de OCR de documentos, hecha para developers
Haz OCR de cualquier documento PDF o imagen a través de un único endpoint y recibe JSON estructurado y validado — facturas, suministros, documentación hipotecaria, DNIs o cualquier schema que definas. La auth es un header; los resultados llegan en segundos vía webhook.
- 500 páginas gratis
- Sin tarjeta
# Upload a document — any PDF or image
curl -X POST https://api.invofox.com/v1/ingest/uploads \
-H "x-api-key: $INVOFOX_API_KEY" \
-F "[email protected]" \
-F 'info={"type":"invoice"}'
# → the document.processed webhook delivers:
{
"type": "invoice",
"data": {
"invoiceNumber": "INV-2026-0841",
"provider": {
"name": "Acme Supplies GmbH",
"taxId": "DE811570831"
},
"totalAmount": 1804.28
}
} OCR de un documento PDF a JSON estructurado
Esta es la factura del quickstart de arriba, completa — líneas, fechas, IBAN y totales que cuadran, lista para tu ERP.
Los campos mostrados son el schema de factura por defecto — define tus propios campos para cualquier tipo de documento.
{
"_id": "68a1f30b2c9e4d0012f7a1b3",
"type": "invoice",
"data": {
"invoiceNumber": "INV-2026-0841",
"issueDate": "2026-07-02",
"dueDate": "2026-08-01",
"provider": {
"name": "Acme Supplies GmbH",
"taxId": "DE811570831",
"iban": "DE89370400440532013000"
},
"lines": [
{
"description": "Thermal paper rolls 80x80",
"quantity": 40,
"unitPrice": 21.90,
"amount": 876.00
},
{
"description": "Label printer ZD421",
"quantity": 2,
"unitPrice": 307.85,
"amount": 615.70
},
{
"description": "Shipping & handling",
"quantity": 1,
"unitPrice": 24.50,
"amount": 24.50
}
],
"subtotal": 1516.20,
"taxRate": 0.19,
"taxAmount": 288.08,
"totalAmount": 1804.28,
"currency": "EUR"
}
} Límites, latencia y pricing
Los números que normalmente tendrías que rebuscar en la documentación.
- ~10 s latencia típica
De la subida al JSON estructurado
El procesado es asíncrono — suscríbete al webhook document.processed en vez de hacer polling.
- 1→N classifier + splitter
Lotes y archivos mixtos bienvenidos
Envía un lote comprimido o un PDF multi-documento — el splitter lo separa y el classifier enruta cada documento a su extractor.
- Todos tipos de documento
No solo facturas
Facturas de suministros, documentación hipotecaria, DNIs, albaranes — tipos pre-entrenados o definidos por tu schema. Independiente del layout por diseño, sin plantillas.
- 500 páginas gratis
Pricing por uso
Precio por página que escala linealmente — sin seats, sin coste de setup. Empieza gratis, sin tarjeta.
Todos los tipos de documento, una sola API
Los tipos pre-entrenados extraen datos de cualquier documento PDF o imagen out of the box — o define tu propio schema para cualquier otro. Cada tarjeta enlazada tiene su página en profundidad.
-
Facturas
Extrae nº de factura, fechas, totales, datos del proveedor, líneas y más.
-
Órdenes de compra
Extrae datos de comprador y proveedor, fechas, ítems pedidos y más.
-
Facturas de suministros
Extrae titular, nº de cuenta, periodo de facturación, consumos y más.
-
Recibos
OCR y escaneo de recibos a escala — comercio, fecha, IVA, líneas y método de pago desde fotos o PDFs.
-
Nóminas
Extrae deducciones, datos de pago, IDs fiscales y más.
-
Closing disclosures
Extrae condiciones del préstamo, costes de cierre, tipo de interés, datos de escrow y más.
-
Extractos bancarios
Extrae titular, saldos, movimientos, fechas, IBAN y más.
-
Formularios fiscales
Extrae datos del contribuyente, base imponible, retenciones, cuota y más.
-
Informes de gastos
Extrae comercio, categoría, importe, fecha, impuestos y total reembolsable y más.
También pre-entrenados: Bill of lading · Cheques · Facturas pro-forma · Lohnkonto — o define tu propio schema para cualquier otro →
Por qué una API de OCR especializada gana al DIY
Lo que tendrías que construir alrededor de Tesseract o de una API de hyperscaler ya viene dentro.
-
JSON validado, no texto en bruto
Los motores OCR devuelven caracteres; los hyperscalers devuelven cajas. Esta API devuelve campos tipados y validados con tus reglas de negocio ya aplicadas.
-
Cualquier layout, cero plantillas
Entrenada con diversidad documental real — escaneos torcidos, fotos, PDFs de 100 páginas. Sin plantillas por proveedor que construir ni mantener.
-
Document ops incluido
Reintentos, colas asíncronas, webhooks, clasificación y splitting vienen con la API — la infraestructura que los pipelines DIY tardan meses en reconstruir.
Benchmark hecho, no prometido: GPT-4o vs Claude vs Invofox para document parsing — con code samples →
La OCR API, en preguntas
¿Queda algo sin responder? Ver la documentación