OCR de imagen
OCR de imagen es una API que lee el texto de una foto o captura (una factura, un cartel, una página escaneada) y te lo devuelve como texto normal. El motor corre en nuestro propio servidor: la imagen no se manda a ningún proveedor de IA externo.
Cómo funciona
Le mandas la imagen y el idioma del texto (eng o spa), y te devuelve el texto encontrado junto con un porcentaje de confianza.
Aviso honesto: funciona muy bien con texto impreso y una imagen razonablemente nítida (facturas, documentos escaneados, capturas de pantalla). Con letra manuscrita o fotos borrosas/torcidas, el resultado empeora bastante: para eso, un servicio de pago especializado en IA hará mejor trabajo.
Lo único que necesitas
- Tu API key. La creas en tu panel con "+ Crear llave".
- En tu plataforma de automatización, un paso de tipo "HTTP Request" (n8n, Make, Zapier, Pipedream…).
Cómo usarlo en n8n
- Method:
POST· URL:https://api.cofferdock.com/image-ocr - Send Headers:
x-api-key= tu llave - Send Body: archivo binario (en n8n: "n8n Binary File")
Opciones
| Opción | Por defecto | Para qué sirve |
|---|---|---|
language | eng | eng (inglés) o spa (español). |
Resumen de la API
- Endpoint:
POST https://api.cofferdock.com/image-ocr - Auth:
x-api-key: TU_LLAVE. - Entrada: bytes crudos de la imagen, o JSON
{ "file": "<base64>" }. - Motor: Tesseract, alojado por nosotros (código abierto, sin proveedor de IA de terceros).
- Idiomas: solo
engyspapor ahora. - Límites: 20 peticiones/min por IP (más bajo que el resto: el OCR gasta más CPU). 1 llamada = 1 crédito.
Ejemplo
curl -X POST "https://api.cofferdock.com/image-ocr?language=spa" \
-H "x-api-key: TU_LLAVE" -H "Content-Type: image/jpeg" \
--data-binary @factura.jpg
Respuesta
{ "success": true, "text": "FACTURA Nº 2026-001\nTotal: 145,00 €",
"confidence": 94, "meta": { "language": "spa", "used": 12, "remaining": 488 } }
Lo que recibes
text (el texto encontrado) y confidence (0 a 100, qué tan segura está la herramienta del resultado).