Conversor de PDF a texto

Siguiente: revisar

La forma más rápida de sacar las palabras de un PDF. Esta herramienta lee la capa de texto que ya está guardada en el PDF, página a página, y te devuelve texto plano que puedes copiar o guardar como archivo .txt. Todo se ejecuta en tu navegador, así que tu documento nunca se sube a ningún sitio. Algo que conviene saber de entrada: lee el texto que ya está en el archivo, así que un documento escaneado o fotografiado (una imagen sin capa de texto) saldrá vacío. Para esos casos, usa mejor una herramienta de OCR.

Cómo extraer texto de un PDF

  1. 1

    Sube el PDF

    Arrástralo o haz clic para elegirlo. El archivo permanece en tu dispositivo y nunca se envía a un servidor.

  2. 2

    Extrae el texto

    La herramienta lee la capa de texto de cada página y las une, con una marca antes de cada página.

  3. 3

    Revisa el resultado

    El texto extraído aparece en un cuadro, una página tras otra, listo para revisar.

  4. 4

    Copia o descarga

    Cópialo al portapapeles o guárdalo como archivo .txt para reutilizarlo en otro sitio.

Qué lee esta herramienta y qué no puede leer

Tipo de PDF Resultado
Exportado desde Word, Google Docs, un navegador o una herramienta de diseño Texto completo, limpio y sin fallos
Un PDF digital con una capa de texto correcta Texto extraído página a página
Un escaneo o foto guardado como PDF (solo imagen) Vacío o casi vacío: no hay texto que leer
Un PDF protegido con contraseña No se puede leer hasta que lo desbloquees antes

Aquí no hay OCR: usa la herramienta adecuada para escaneos

Este extractor no ejecuta OCR (reconocimiento óptico de caracteres). Copia el texto que ya está dentro del PDF, no lee píxeles. Si tu archivo es un escaneo y no obtienes nada, pásalo primero por una herramienta de OCR, que convierte la imagen en una capa de texto real que luego sí podrás extraer.

Cómo se presenta el texto

Cada página se separa con una marca --- Page N ---, así ves dónde acaba una página y empieza la siguiente. El texto se extrae en el orden en el que está guardado en el PDF. La mayoría de documentos se leen con naturalidad; unos pocos con diseños de varias columnas poco habituales pueden entrelazar las columnas, porque la herramienta sigue el orden guardado en el PDF en lugar de adivinar el recorrido de lectura.

Usos habituales

  • Alimentar un modelo de IA. Los modelos de lenguaje aceptan texto plano, no PDF. Extraerlo primero lo hace todo más rápido y predecible.
  • Citar y buscar. Copia un fragmento sin pelearte con la selección del visor de PDF.
  • Reutilizar contenido. Lleva el texto a un documento, un correo o una nota sin volver a teclearlo.

Preguntas frecuentes

No. Lee la capa de texto incrustada, y un escaneo es solo una imagen sin capa de texto, así que sale vacío. Usa una herramienta de OCR para documentos escaneados o fotografiados y después extrae el texto.

No. La extracción se ejecuta por completo en tu navegador, en tu propio dispositivo. El PDF nunca se envía a un servidor y no se guarda nada.

Algunos PDF, sobre todo los de varias columnas, guardan su texto en un orden distinto al que lo lees. La herramienta sigue el orden guardado en el PDF, así que las columnas pueden entrelazarse. Los documentos exportados desde procesadores de texto casi siempre salen correctos.

No mientras estén bloqueados. Quita la contraseña primero con una herramienta para desbloquear PDF y después extrae el texto.

Herramientas relacionadas

Herramienta disponible en otros idiomas