Imagen a texto (OCR)

Extrae texto de imágenes mediante OCR. Los resultados pueden variar según la calidad de la imagen, fuente y disposición del documento. No es una transcripción certificada ni un reconocimiento infalible.

Selecciona una imagen

Procesando...

Tu texto está listo

No se pudo extraer el texto

Descargar

Límites

  • Formatos admitidos: JPEG, PNG y WEBP. Una imagen por trabajo; no es OCR de PDF multipágina.
  • Tamaño máximo: 25 MB por archivo.
  • Techo de imagen: 40 megapíxeles y 8000 px por lado.
  • Idiomas disponibles: español e inglés.
  • Resolución recomendada: texto nítido, contrastado, al menos ~300 DPI si viene de un escáner.
  • Tiempo máximo: 90 segundos.
  • El resultado es un archivo de texto (.txt). Los resultados pueden variar según la calidad de la imagen, fuente y disposición del documento.

Cómo funciona

  1. Selecciona la imagen. Elige un JPEG, PNG o WEBP con texto legible. Una imagen por trabajo.
  2. Procesa la imagen. Envía el trabajo. Entra en la cola OCR y Tesseract genera un archivo de texto.
  3. Descarga el texto. Descarga el .txt. Revisa el resultado: puede haber errores de reconocimiento.

Tesseract lee texto de una foto o un escaneo y lo deja en un archivo .txt. La calidad no es un porcentaje publicado: depende de la resolución, el contraste, la orientación y el idioma. ToolZen corre el motor en una cola OCR propia; la petición HTTP no ejecuta el reconocimiento. El resultado no es un Word ni un PDF con capa de texto invisible.

Se aceptan JPEG, PNG y WEBP, una imagen por trabajo, con el tamaño máximo de invitado (25 MB). Los idiomas instalados son español e inglés (el motor corre `spa+eng`; no hay selector en el formulario). No declaramos francés, alemán u otros paquetes porque no están en la imagen. Un escaneo nítido de ~300 DPI, derecho y contrastado suele ir mejor que una foto oscura, de lado o con flash. No hay OCR de PDF multipágina en esta herramienta. Una imagen por encima del techo de megapíxeles se rechaza antes de Tesseract.

El tiempo máximo está publicado. Un trabajo que se pasa de tiempo falla y limpia temporales. Si Tesseract no reconoce nada usable, el archivo de texto indica que no se reconoció texto: no inventamos palabras. Tampoco “corregimos” el resultado con un modelo de lenguaje. Lo que ves es la salida del motor, recortada de espacios, lista para copiar o archivar.

Privacidad: la imagen de entrada se borra al terminar el proceso. El .txt dura la retención temporal. No enviamos la imagen a un OCR en la nube. No hay cuenta. Revisa siempre el texto antes de usarlo en un trámite: un DNI borroso, una factura con sello o una captura con columnas pueden salir con errores, líneas mezcladas o caracteres cambiados.

Casos de uso: pasar un apunte manuscrito claro a texto, extraer un párrafo de una captura, o recuperar texto de un escaneo sencillo. No sustituye a una transcripción profesional ni a un OCR de producción con plantillas. Si la imagen pesa mucho, comprímela antes. Si partes de un PDF, rasterízalo a JPG con el límite de páginas de esa herramienta y luego elige la página que quieras leer.

Preguntas frecuentes

¿El OCR es preciso al 100%?

No. La calidad depende del contraste, la fuente, el ruido y la inclinación. Publicamos un resultado usable, no una garantía de exactitud.

¿Qué idiomas están instalados?

Español e inglés. No anunciamos otros idiomas porque no están en la imagen.

¿Puedo pasar un PDF de varias páginas?

No en esta herramienta. Acepta una imagen. Si tienes un PDF, conviértelo antes a JPG página a página con el límite de esa herramienta.

¿Qué archivo descargo?

Un archivo de texto plano (.txt), no un Word ni un PDF con capa de texto.

¿Se envía la imagen a un servicio de OCR en la nube?

No. Tesseract corre en el worker OCR de ToolZen. La entrada se borra al terminar; el .txt caduca con la retención.

¿Influyen resolución, contraste, orientación e idioma?

Sí. Una foto nítida, contrastada y derecha en español o inglés suele ir mejor. Texto de lado, borroso o en otro idioma baja la calidad. No hay selector de idioma: el motor usa español e inglés a la vez.