Comparar PDF

Los PDF se leen únicamente en este navegador. En el flujo por pasos caducan a los 30 minutos y se eliminan mientras la página está abierta o al volver a abrir la herramienta. Nunca se añaden a la URL ni se envían a nuestro servidor.

Compara el texto extraíble de dos versiones de un PDF sin subir ningún documento. La herramienta lee cada página con PDF.js, normaliza los espacios y resalta el texto que solo aparece en el archivo anterior o en el revisado.

Cómo comparar dos PDF

  1. 1

    Elige el archivo anterior

    Selecciona el PDF A, con un máximo de 25 MB y 200 páginas.

  2. 2

    Elige la revisión

    Selecciona el PDF B. En el flujo por pasos, ambos archivos permanecen en el almacenamiento privado del navegador durante 30 minutos como máximo.

  3. 3

    Revisa las páginas modificadas

    El navegador extrae el texto por páginas y marca en rojo los pasajes eliminados y en azul los añadidos.

Qué detecta la comparación

El resultado compara el texto que PDF.js puede extraer de cada número de página. Es útil para contratos, informes, pruebas y borradores cuyo contenido haya cambiado. Los espacios se normalizan antes de comparar, por lo que un salto de línea distinto genera menos ruido.

Qué no detecta

No es una comparación visual ni semántica. No compara fuentes, diseño, imágenes, anotaciones, valores de formularios, metadatos ni la validez de firmas digitales. Un PDF escaneado puede no tener texto extraíble si no incluye una capa OCR previa. Si una versión tiene una portada nueva, las páginas posteriores quedarán desalineadas.

Privacidad y límites

Los archivos y el texto extraído permanecen en tu navegador y nunca se envían a nuestro servidor. En el flujo por pasos, el navegador conserva los dos archivos localmente durante un máximo de 30 minutos. Puedes borrarlos antes con el botón de limpieza. Cada archivo admite hasta 25 MB, 200 páginas y 2.000.000 de caracteres extraídos.

Preguntas frecuentes

Solo si el escaneo ya contiene una capa de texto OCR. Esta herramienta no ejecuta OCR.

No. Solo indica que el texto extraíble coincide tras normalizar los espacios. Los elementos visuales y la estructura del PDF aún pueden diferir.

No. PDF.js los lee localmente. El flujo por pasos usa el almacenamiento privado del navegador durante un máximo de 30 minutos, no almacenamiento del servidor.

PDF guarda instrucciones de dibujo posicionadas, no párrafos. Las columnas, tablas y formularios complejos pueden extraerse en un orden inesperado.

Herramientas relacionadas