Herramientas API Blog
Entrar Crear cuenta

Hacer buscable un PDF escaneado

PDF buscable (OCR) es una API que coge un PDF escaneado (solo una foto de cada página, sin texto real detrás) y le añade una capa de texto invisible sobre cada página: se ve exactamente igual, pero ya se puede buscar, seleccionar y copiar el texto.

Cómo funciona

Le mandas el PDF y te devuelve el mismo documento, página por página, con el texto reconocido "pegado" encima de cada imagen (invisible: no cambia cómo se ve). El motor corre en nuestro propio servidor, sin mandar tus páginas a ningún proveedor de IA externo.

A diferencia del resto de herramientas de PDF, aquí se cobra 1 crédito POR PÁGINA, no 1 por llamada: el OCR de verdad cuesta CPU por cada página, a diferencia de operaciones casi instantáneas como rotar o poner una marca de agua. Tope de 30 páginas por llamada; para un PDF más largo, primero divídelo.

Lo único que necesitas

  • Tu API key. La creas en tu panel con "+ Crear llave".
  • En tu plataforma de automatización, un paso de tipo "HTTP Request" (n8n, Make, Zapier, Pipedream…).

Cómo usarlo en n8n

  • Method: POST · URL: https://api.cofferdock.com/pdf-ocr
  • Send Headers: x-api-key = tu llave
  • Send Body: archivo binario (en n8n: "n8n Binary File")
  • En Options → Response → Response Format: elige File

Opciones

OpciónPor defectoPara qué sirve
languageengeng (inglés) o spa (español): el idioma del texto escaneado.

Lo que recibes

Por defecto: con el PDF a pelo devuelve el PDF directo; con JSON devuelve pdf en base64. Añade output=pdf para forzar el binario, o output=url para un enlace temporal.