Creador de PDF con búsqueda

Elige un PDF escaneado

Solo PDF · 10 MB

Solo PDF, hasta 10 MB y 10 páginas

Un PDF escaneado no es más que un montón de imágenes dentro de un contenedor PDF, así que no puedes resaltar, copiar ni buscar el texto. Esta herramienta aplica reconocimiento óptico de caracteres (OCR) a cada página en tu navegador e incrusta el resultado como una capa de texto invisible alineada con la página original. El aspecto de la página se conserva, mientras que Ctrl+F y la selección de texto pueden usar las palabras reconocidas. El reconocimiento puede cometer errores y el resultado no es un PDF de accesibilidad etiquetado, así que compara el texto importante con el escaneo.

Cómo aplicar OCR a un PDF escaneado

  1. 1

    Sube el escaneo

    Arrastra un PDF escaneado (contratos, facturas, informes archivados). El texto impreso funciona mejor; la escritura a mano, no.

  2. 2

    Elige el idioma

    Elige el idioma del documento (inglés, español, francés, alemán, italiano, portugués u holandés) para que el motor de OCR cargue el modelo de caracteres correcto.

  3. 3

    Ejecuta el reconocimiento

    Cada página se renderiza a alta resolución en tu navegador y se pasa al motor de OCR. Los documentos largos pueden tardar unos minutos.

  4. 4

    Se incrusta la capa de texto

    Las palabras reconocidas se colocan como una capa invisible alineada con la página original, así que cada página se ve igual.

  5. 5

    Descarga el nuevo PDF

    Obtén un PDF que conserva los escaneos originales y ahora se puede buscar en cualquier lector moderno.

Cuándo funciona bien el OCR (y cuándo no)

La calidad del OCR depende del escaneo. Compara siempre los nombres, cifras y textos legales importantes con la página original.

Entrada Qué puedes esperar
Escaneo de texto impreso limpio Suele dar buenos resultados; revisa el texto importante.
Foto de una página impresa El resultado depende del enfoque, la iluminación y el ángulo de la página.
Libro antiguo o texto de máquina de escribir desvaído Revisa con cuidado el texto reconocido.
Escritura a mano o cursiva No se admite de forma fiable.
Recibos o impresión térmica Revisa con cuidado los números y los caracteres tenues.
Transparencia intensa del reverso Los resultados pueden ser incompletos o inexactos.

PDF con búsqueda frente a PDF solo de imagen

  • PDF solo de imagen: mapas de bits puros, sin texto. Lo que produce tu escáner por defecto.
  • PDF con búsqueda: mapas de bits más una capa de texto invisible (lo que genera esta herramienta). Se ve idéntico y funciona Ctrl+F.
  • PDF/A: un subconjunto de PDF para archivo que incrusta sus fuentes y prohíbe recursos externos, a menudo exigido por juzgados y archivos. Esta herramienta genera un PDF con búsqueda normal, no un PDF/A certificado; convierte y valida con una herramienta específica de PDF/A si tu flujo lo requiere.

Consejos para mejores resultados

  • Empieza con unos 300 DPI. Suele ser un equilibrio útil entre detalles legibles y tiempo de procesamiento. Una resolución mayor usa más tiempo y memoria.
  • Endereza antes del OCR. La mayoría de escáneres ofrecen giro automático; incluso una ligera inclinación puede reducir la calidad del reconocimiento.
  • Un idioma por pasada. El motor reconoce un solo idioma a la vez, así que elige el predominante. Para un documento bilingüe, ejecútalo una vez por idioma y quédate con el mejor resultado.
  • Conserva siempre el original. El OCR introduce pequeños errores; la capa invisible es una comodidad, no una prueba.

Preguntas frecuentes

El contenido original de la página se conserva. El texto reconocido se añade como una capa invisible alineada con él, por lo que el aspecto de la página debería mantenerse. Revisa el resultado si la fidelidad visual exacta es importante.

Siete idiomas de alfabeto latino: inglés, español, francés, alemán, italiano, portugués y holandés. Elige el que coincida con tu documento. Los alfabetos como el cirílico, el árabe y el CJK (chino, japonés y coreano) no están disponibles en esta herramienta.

No de forma fiable. Esta herramienta está pensada para texto impreso. El reconocimiento de escritura a mano es otra tecnología, así que revisa o transcribe el material manuscrito por separado.

No. El resultado es un PDF con búsqueda normal: las imágenes originales de las páginas más una capa de texto OCR invisible. No es un archivo PDF/A certificado para archivo. Si tu flujo requiere PDF/A, convierte y valida el resultado con una herramienta específica de PDF/A.

El OCR se ejecuta por completo en tu navegador, así que tu PDF de origen no se envía a un servidor para el reconocimiento. Una descarga local normal se queda en tu dispositivo. Solo si eliges Crear una página de descarga se sube a nuestro servidor el PDF con búsqueda terminado; el PDF de origen permanece local y el resultado subido se conserva hasta 7 días.

Herramientas relacionadas