¿Qué es OCR PDF?
El OCR (reconocimiento óptico de caracteres) detecta el texto en imágenes de páginas y lo convierte en texto real, seleccionable y buscable.
Cómo usar OCR PDF
- 1
Elige un PDF escaneado o una imagen.
- 2
Selecciona el idioma o idiomas del documento y un nivel de calidad.
- 3
Pulsa Ejecutar OCR y descarga el PDF buscable y un archivo de texto.
Funciones
- OCR Tesseract ejecutándose en tu dispositivo
- Reconocimiento multilingüe (hasta tres idiomas a la vez)
- Mantiene el aspecto original de la página
- Exporta un PDF buscable y un archivo .txt
Formatos compatibles
- JPG
- PNG
Tamaño máximo: 100 MB por archivo.
Usos prácticos
- Buscar dentro de contratos y facturas escaneados.
- Copiar texto de un documento fotografiado.
- Preparar escaneos para resúmenes, traducción o PDF a Word.
Limitaciones
- La precisión depende de la calidad del escaneo; en general no se reconoce la escritura a mano.
- La primera vez se descarga el modelo del idioma (unos pocos MB), que después queda en caché.
- Los diseños complejos, como tablas, pueden reconocerse solo en orden de lectura.
Preguntas frecuentes
¿El OCR es 100 % preciso?
Ningún OCR es perfecto. Los escaneos limpios y rectos a 200–300 PPP dan los mejores resultados; revisa a mano los números importantes.
¿Se suben mis escaneos?
No. El reconocimiento se ejecuta en tu navegador. Solo se descarga el archivo del modelo de idioma desde una CDN pública.
¿Qué idiomas son compatibles?
Español, inglés, portugués, francés, alemán, indonesio, italiano y neerlandés.
