Ir al contenido
HandfulTools

Extraer el texto de un PDF

Saca el texto de un PDF para citarlo, traducirlo, analizarlo o reutilizarlo en otro sitio. El texto se muestra página a página y se puede copiar o descargar como archivo .txt.

Funciona en tu navegador

Loading…

Cómo se usa

  1. Arrastrar un PDF.
  2. Elegir si se añaden separadores de página.
  3. Hacer clic en «Extraer texto».
  4. Copiar el texto o descargar el archivo .txt.

Cómo funciona

El texto se lee de la capa de texto del PDF con pdf.js y se recompone en líneas según la posición de cada fragmento en la página. En diseños a varias columnas y en tablas, el orden de lectura puede no coincidir con el orden visual.

Los PDF escaneados solo contienen imágenes de texto y no tienen capa de texto; la herramienta lo detecta y te avisa de que haría falta un OCR (reconocimiento óptico de caracteres).

Los archivos se procesan en tu navegador con las bibliotecas de código abierto pdf-lib y pdf.js: nunca se suben.

Ejemplos

Artículo científico
Extrae el texto de un artículo para contar sus palabras o pegarlo en un traductor.

Usos habituales

  • Copiar texto de PDF con la maquetación bloqueada
  • Contar las palabras de un documento PDF
  • Pasar el texto a otras herramientas

Privacidad y seguridad

Esta herramienta funciona por completo en tu navegador. Tus archivos y tus textos nunca se suben a nuestros servidores: el procesamiento ocurre en tu dispositivo y los resultados se generan de forma local. Cómo trata los archivos cada herramienta

Preguntas frecuentes

¿Por qué el texto sale vacío?

Lo más probable es que el PDF sea un escaneo (una imagen). El OCR está previsto para más adelante.

¿Se conserva el formato?

No: la salida es texto plano. Usa PDF a Word (próximamente) si necesitas texto con formato.

Última actualización: