Extraer imágenes de PDF

Subir PDF

Sube un PDF y recupera cada imagen incrustada en su resolución original. El extractor recorre el árbol de objetos PDF, encuentra entradas /XObject /Image y exporta cada una como PNG, sin capturas de pantalla, sin pérdida de calidad por rasterizar toda la página. Funciona con escaneos, informes con muchas fotos, catálogos de productos y folletos.

Cómo extraer imágenes de un PDF

  1. 1

    Sube el PDF

    Suelta un solo archivo; los PDFs encriptados deben ser desbloqueados primero.

  2. 2

    Escanea el árbol de objetos

    El extractor enumera cada imagen XObject en todas las páginas.

  3. 3

    Previsualiza los resultados

    Verás cada imagen como una miniatura con su número de página y sus dimensiones.

  4. 4

    Descarga individualmente o como ZIP

    Obtén un único archivo o expórtalo todo en un solo comprimido, con nombres como `image-p1-1.png`.

Cómo viven las imágenes dentro de un PDF

Un PDF almacena imágenes como recursos separados (/XObject streams) referenciados desde el contenido de la página. El extractor lee cada stream en su codificación nativa y reconstruye el archivo que el autor incrustó.

Formatos que verás

Filtro PDF Lo que recibes Fuente típica
/DCTDecode PNG (de un JPEG) Fotos, imágenes de productos, escaneos
/FlateDecode + RGB PNG Logos, gráficos, capturas de pantalla de UI
/JPXDecode PNG (de JPEG 2000) Escaneos de archivo de alta resolución
/CCITTFaxDecode PNG (de un escaneo) Texto escaneado en blanco y negro
/JBIG2Decode PNG (convertido) Documentos escaneados comprimidos

El extractor siempre entrega PNG: recodifica los píxeles en bruto en tu navegador, así que las fuentes JPEG, JPEG 2000 y CCITT llegan también como PNG.

Lo que no recuperará

  • Ilustraciones vectoriales. Los logos dibujados con operadores de ruta PDF no son imágenes, viven en el stream de contenido, no como XObjects. Usa una herramienta de PDF a SVG para esos.
  • Colores de fondo y degradados. Esos son dibujos a nivel de página, no recursos incrustados.
  • Texto renderizado como contornos. Aparece como “gráficos” pero no es un objeto de imagen.

Consejos al trabajar con la exportación

  • Verifica las dimensiones. Una miniatura de 300x300 en la página puede ser en realidad una original de 3000x3000 escalada en el momento de renderizado. Obtienes los píxeles de origen, no el tamaño de visualización.
  • Respeta la licencia. Poder extraer una imagen no otorga derechos para reutilizarla. Las imágenes de stock en un PDF siguen siendo imágenes de stock cuando se extraen.
  • Documentos escaneados. Si cada página produce una imagen gigante con texto incrustado, el PDF es un escaneo. Ejecuta OCR en los PNG exportados para recuperar el texto.

Preguntas frecuentes

Las páginas PDF pueden aplicar una matriz de transformación a cómo se dibuja una imagen (voltear, rotar, sesgar). El extractor devuelve el bitmap almacenado, píxeles en bruto. Si un editor almacenó la imagen al revés y la volteó en el momento de renderizado, la exportación se verá al revés. Rótala de nuevo en cualquier editor de imágenes.

Solo después de desbloquearlos. Ejecuta el archivo a través de una herramienta de desbloqueo de PDF primero, proporcionando la contraseña del propietario, y luego extrae.

Sí. Las imágenes se añaden en el orden de las páginas y cada nombre de archivo incluye su número de página, por ejemplo image-p1-2.png, para que sepas de qué página procede cada imagen.

No. El PDF de origen se abre y se lee por completo en tu navegador y nunca se envía al servidor. Solo se sube el ZIP con las imágenes extraídas para crear el resultado protegido por sesión; se conserva hasta 7 días y después se elimina.

Herramientas relacionadas

Herramienta disponible en otros idiomas