Herramientas API Blog
Entrar Crear cuenta

Extraer texto de un PDF

Extraer texto es una API que saca todo el texto de un PDF, listo para buscar, analizar o guardar en una hoja de cálculo. Perfecto para procesar facturas, contratos o informes desde n8n, Make o Zapier, sin montar servidores.

Cómo funciona

Le mandas un PDF y te devuelve su texto en un JSON, junto con el número de páginas y los metadatos del documento (título, autor…). No guarda nada: se procesa al momento.

Ojo con los PDFs escaneados: si el PDF es una foto o un escaneo sin capa de texto (no puedes seleccionar el texto al abrirlo en tu ordenador), esta herramienta devuelve texto vacío: no da error, simplemente no hay texto que extraer. Para esos casos hace falta OCR, que esta herramienta no hace.

Lo único que necesitas

  • Tu API key. La creas en tu panel con "+ Crear llave". Se muestra una sola vez, así que cópiala y guárdala.
  • En tu plataforma de automatización, un paso de tipo "HTTP Request" / "Hacer una petición HTTP" (lo tienen n8n, Make, Zapier, Pipedream…).

Cómo usarlo en n8n (paso a paso)

Le envías tu PDF tal cual (como archivo binario) y te devuelve el texto en JSON. En el nodo HTTP Request:

  • Method: POST
  • URL: https://api.cofferdock.com/pdf-extract-text
  • Send Headers: actívalo y añade dos: x-api-key = tu llave, y Content-Type = application/pdf
  • Send Body: actívalo → elige la opción para mandar un archivo binario (en n8n: "n8n Binary File", con la propiedad binaria de tu PDF, normalmente data)

La respuesta ya es un JSON con el texto en text: puedes usarlo directamente en el siguiente paso (buscar una palabra, guardarlo en una hoja de cálculo, mandarlo a un modelo de IA…).

En Make (módulo HTTP → Make a request): mismo método y URL, en Headers las dos cabeceras, y el PDF como dato binario en el cuerpo.

Opciones (en Query Parameters o en el JSON)

OpciónPor defectoPara qué sirve
pagesfalsePonlo en true para recibir además el texto separado por página.

Lo que recibes

Un JSON con el texto completo del PDF, el número de páginas y sus metadatos (título, autor…).