Imagen a texto (OCR)

Extrae el texto de una foto o captura de pantalla.

Funciona en tu navegador. Tus archivos nunca salen de tu dispositivo.

Cómo extraer texto de una imagen

  1. Suelta una foto o captura de pantalla aquí.
  2. Espera unos segundos mientras lee el texto.
  3. Copia o descarga el resultado.

Qué lee bien el OCR

OrigenResultado
Captura de pantalla limpia de texto escrito a máquinaExcelente, por lo general 95% de confianza o más
Escaneo de un documento impresoMuy bueno
Foto de un cartel o una página, tomada de frenteBueno
Foto en ángulo, borrosa o con poca luzMalo, muchos errores
Letra manuscritaPoco confiable, funciona mejor con letra de imprenta muy prolija

Cómo funciona la puntuación de confianza

El motor de OCR devuelve un porcentaje de confianza para toda la extracción, su propia estimación de qué tan seguro está del texto que encontró. Por encima de 90, el resultado suele ser preciso. Por debajo de 70, compara el resultado con la imagen original antes de confiar en él, sobre todo con nombres, números y fechas que un pequeño error de lectura cambiaría.

Cómo obtener un mejor resultado

  • Recorta todo lo que no sea texto antes de subir la imagen, como un fondo cargado o una foto, ya que el OCR intenta leer patrones en todo.
  • Endereza primero una foto tomada en ángulo con la herramienta Rotar imagen de TabbyKit. El texto inclinado confunde el paso de detección de líneas.
  • Una resolución más alta ayuda hasta cierto punto. Una foto borrosa en alta resolución sigue leyéndose peor que una nítida en resolución más baja.
  • Una iluminación buena y uniforme, sin reflejos, es mejor que una foto más brillante pero mal iluminada.
  • Un escaneo plano y de frente de una página casi siempre da mejor resultado que una foto de la misma página tomada a mano, incluso con una buena cámara.

Cómo funciona este motor de OCR

Esta herramienta usa Tesseract, un motor de OCR de código abierto desarrollado originalmente en HP y mantenido ahora por Google, funcionando por completo dentro de tu navegador como WebAssembly. El modelo de reconocimiento de texto en inglés se descarga una sola vez, y cada foto después de eso se lee en tu dispositivo sin ningún servidor de por medio.

Preguntas frecuentes sobre Imagen a texto

¿Qué idiomas admite esta herramienta?

Por ahora esta herramienta lee texto en inglés. Los mejores resultados se obtienen con texto impreso o escrito a máquina, bien claro.

¿Puede leer letra manuscrita?

A veces puede leer letra manuscrita muy prolija, pero el OCR está hecho para texto impreso y le cuesta con la letra cursiva o desordenada.

¿Qué significa la puntuación de confianza?

Es la propia estimación del motor de OCR sobre qué tan seguro está del texto, de 0 a 100. Por encima de 90 el resultado suele ser preciso; por debajo de 70, revísalo contra la imagen original.

¿Por qué una captura de pantalla se lee mejor que una foto?

Las capturas de pantalla y los escaneos tienen iluminación uniforme y bordes nítidos. Una foto tomada en ángulo, con sombras o desenfoque, le da al OCR menos con qué trabajar.

¿Se sube mi imagen a un servidor?

No. El motor de OCR se descarga una sola vez a tu navegador, y cada foto después de eso se lee en tu propio dispositivo.

¿Por qué no pudo leer mi imagen?

Esto pasa muy pocas veces, solo si el archivo de imagen en sí no se puede decodificar. Prueba con otra foto o con una captura de pantalla directa en vez de una foto de una pantalla.

¿Puedo copiar solo una parte del texto extraído?

Sí. El resultado aparece en un cuadro de texto editable, así que puedes seleccionar, copiar o editar cualquier parte antes de descargarlo.

¿Funciona con un PDF?

No directamente. Toma una captura de la página del PDF o expórtala como imagen primero, y luego suelta esa imagen aquí.

¿Puedo usar esto en un celular?

Sí. Todo funciona en el navegador, incluidos Safari y Chrome en el celular, aunque una foto muy grande puede tardar unos segundos más en un teléfono antiguo.

Herramientas relacionadas