OCR PDF

Reconoce el texto de un PDF escaneado para que puedas buscarlo, seleccionarlo y copiarlo, o expórtalo como texto sin formato. Todo se hace en tu navegador: tus archivos nunca se suben a ningún servidor.

o suelta un archivo aquí

Hasta 50 MB
  1. 1Elige

    Elige un PDF escaneado.

  2. 2Ajusta

    Elige el idioma del documento y el tipo de salida: un PDF con búsqueda o texto sin formato.

  3. 3Descarga

    Haz clic en «Reconocer texto». Calcula unos segundos por página.

Convierte un escaneo en un PDF en el que puedes buscar

Un PDF escaneado es una pila de imágenes: no puedes buscar en él, seleccionar una frase ni copiar un número. El OCR (reconocimiento óptico de caracteres) lee el texto de esas imágenes. ShyPDF coloca las palabras reconocidas como una capa invisible justo encima de las escaneadas, de modo que Ctrl+F, la selección de texto y copiar y pegar funcionan mientras la página se ve exactamente igual que antes.

Las páginas originales no se vuelven a comprimir ni a dibujar, así que no se pierde calidad y el archivo solo crece lo que ocupa el texto. Si solo quieres las palabras, elige «Texto sin formato (.txt)». De forma predeterminada se omiten las páginas que ya contienen texto seleccionable, lo que acelera los documentos mixtos.

Cómo obtener buenos resultados

Elige el idioma en el que está escrito el documento: es el factor que más influye en la precisión. Están disponibles inglés, español, portugués, francés, alemán, italiano, japonés y chino simplificado, y «Reconocer también inglés» ayuda con los documentos que mezclan términos en inglés con otro idioma.

El reconocimiento se hace en tu navegador con Tesseract, un motor de OCR de código abierto con una larga trayectoria, compilado a WebAssembly. Calcula unos segundos por página, según tu dispositivo. Los escaneos de extractos bancarios, documentos de identidad, historiales médicos y contratos firmados son justo el tipo de archivo que no debería subirse a un servicio de OCR; aquí nunca salen de tu dispositivo.

Preguntas frecuentes

¿Mis archivos se suben a un servidor?

No. Todo se procesa dentro de tu navegador, así que tus archivos nunca salen de tu dispositivo. Cierra la pestaña y no queda ni rastro.

¿El PDF se ve distinto después?

No. Las páginas se dejan exactamente como están; ShyPDF solo añade encima una capa de texto invisible, así que el escaneo conserva su calidad y el archivo apenas aumenta de tamaño.

¿Qué precisión tiene?

Los escaneos limpios, rectos y a 200 dpi o más se reconocen muy bien. Las fotos borrosas hechas con el móvil, la letra manuscrita, los sellos y las fuentes poco habituales son mucho menos fiables. Elegir el idioma correcto importa más que cualquier otra cosa.

¿Por qué la primera vez tarda más?

El motor de reconocimiento y los datos del idioma (entre 5 y 10 MB aproximadamente) se descargan de este sitio la primera vez y después se quedan guardados en tu navegador. El PDF nunca se sube.

¿Puedo aplicar OCR a una foto o a un JPG?

Sí, en dos pasos: convierte las imágenes en un PDF con JPG a PDF y luego pasa ese PDF por OCR PDF.