Ir al contenido

How to extract Arabic text from a scanned PDF

Un documento árabe escaneado es una imagen: no se puede copiar ni buscar su texto. El reconocimiento óptico de caracteres lo resuelve y puede funcionar en tu propio dispositivo.

Por qué ocurre

Un escaneo es una fotografía de la página. Lo que ves son píxeles, no letras; por eso no puedes seleccionarlo ni copiarlo. El OCR lee las formas y las convierte de nuevo en texto.

Paso a paso

  1. Abre la herramienta OCR.
  2. Añade el archivo escaneado o la foto.
  3. Elige árabe como idioma.
  4. Ejecútala y descarga el texto.

Conviene saber

La precisión depende del escaneo: uno recto, bien iluminado y a 300 ppp da buenos resultados; una foto torcida de un fax tenue, no. Revisa siempre nombres y cifras.

Abrir OCR PDF