Hacer buscable un PDF escaneado
PDF buscable (OCR) es una API que coge un PDF escaneado (solo una foto de cada página, sin texto real detrás) y le añade una capa de texto invisible sobre cada página: se ve exactamente igual, pero ya se puede buscar, seleccionar y copiar el texto.
Cómo funciona
Le mandas el PDF y te devuelve el mismo documento, página por página, con el texto reconocido "pegado" encima de cada imagen (invisible: no cambia cómo se ve). El motor corre en nuestro propio servidor, sin mandar tus páginas a ningún proveedor de IA externo.
A diferencia del resto de herramientas de PDF, aquí se cobra 1 crédito POR PÁGINA, no 1 por llamada: el OCR de verdad cuesta CPU por cada página, a diferencia de operaciones casi instantáneas como rotar o poner una marca de agua. Tope de 30 páginas por llamada; para un PDF más largo, primero divídelo.
Lo único que necesitas
- Tu API key. La creas en tu panel con "+ Crear llave".
- En tu plataforma de automatización, un paso de tipo "HTTP Request" (n8n, Make, Zapier, Pipedream…).
Cómo usarlo en n8n
- Method:
POST· URL:https://api.cofferdock.com/pdf-ocr - Send Headers:
x-api-key= tu llave - Send Body: archivo binario (en n8n: "n8n Binary File")
- En Options → Response → Response Format: elige File
Opciones
| Opción | Por defecto | Para qué sirve |
|---|---|---|
language | eng | eng (inglés) o spa (español): el idioma del texto escaneado. |
Resumen de la API
- Endpoint:
POST https://api.cofferdock.com/pdf-ocr - Auth:
x-api-key: TU_LLAVE. - Entrada: bytes crudos del PDF, o JSON
{ "file": "<base64>" }. - Motor: rasteriza cada página (mismo motor que PDF a imágenes) y le pasa el resultado a Tesseract, alojado por nosotros.
- Idiomas: solo
engyspapor ahora. - Límites: 10 peticiones/min por IP (el más bajo de la plataforma). Máximo 30 páginas. 1 crédito POR PÁGINA, no por llamada.
Ejemplo
curl -X POST "https://api.cofferdock.com/pdf-ocr?language=spa" \
-H "x-api-key: TU_LLAVE" -H "Content-Type: application/pdf" \
--data-binary @escaneado.pdf \
--output buscable.pdf
Respuesta
{ "success": true, "pdf": "JVBERi0xLjQK...", "mime_type": "application/pdf",
"meta": { "language": "spa", "pages": 3, "size_bytes": 184213, "used": 15, "remaining": 485 } }
Lo que recibes
Por defecto: con el PDF a pelo devuelve el PDF directo; con JSON devuelve pdf en base64. Añade output=pdf para forzar el binario, o output=url para un enlace temporal.