OCR de imágenes — extrae texto de fotos y capturas

Extrae texto de fotos y capturas con un motor OCR WASM que funciona por completo en tu navegador: sin subidas, con modelos en inglés, español, portugués e indonesio.

Tu imagen se procesa por completo en tu navegador con Tesseract.js — nunca se sube. Solo el modelo de idioma público se descarga de una CDN en el primer uso.

Extrae texto de una imagen

Suelta una imagen aquí o haz clic para buscar — PNG, JPG o WebP · procesado localmente

El primer uso descarga el modelo de idioma (unos MB); después queda en caché.
Vista previa de la imagen
Texto reconocido

Cómo funciona

El reconocimiento lo hace Tesseract, un motor OCR de código abierto compilado a WebAssembly. La imagen, el texto que extrae y cada búfer intermedio se quedan en tu pestaña del navegador — no hay endpoint de subida, ni cuenta, ni petición que transporte tus píxeles.

Un motor WASM, totalmente en el navegador
Tesseract.js ejecuta el mismo motor C++ que usan las aplicaciones nativas, compilado a WebAssembly y ejecutado en un worker de fondo, así la página sigue responsive mientras se reconoce el texto. Todo el flujo — análisis de diseño, segmentación de palabras, clasificación de caracteres LSTM — ocurre en tu dispositivo.
El primer uso descarga el modelo de idioma
Cada idioma necesita su archivo traineddata (aprox. 2–15 MB; el inglés unos 10 MB). Se descarga una vez desde una CDN pública y el navegador lo guarda en caché, así que visitas posteriores y el uso sin conexión dentro de la misma sesión funcionan igual. Cambiar de idioma provoca una descarga equivalente.
Capturas frente a fotos
Las capturas son el caso fácil: glifos nítidos sobre un fondo plano, precisión casi perfecta. Las fotos exigen más — iluminación uniforme, página plana y paralela a la cámara, texto que llene el encuadre. Fuentes pequeñas de menos de ~10 px, páginas curvas, sombras y desenfoque de movimiento degradan los resultados, así que recorta justo la zona que quieres.
No para manuscrita
Los modelos están entrenados con tipo impreso. La cursiva, la letra personal y la tipografía estilizada se leen de forma poco fiable — para eso, flujos con texto impreso primero o la transcripción manual siguen siendo las opciones honestas.

Preguntas frecuentes

¿Puede leer letra manuscrita?

No. Tesseract está entrenado con tipografía impresa — libros, documentos, capturas de interfaz y carteles. La cursiva y la letra manuscrita descuidada se leen mal o nada. El texto impreso a un tamaño razonable es donde destaca.

¿Lee PDF?

Esta página solo acepta archivos de imagen — PNG, JPG y WebP. Para un PDF, usa su herramienta hermana, el Extractor de texto de PDF, que lee la capa de texto incrustada de un documento página por página sin ningún OCR.

¿De dónde viene el modelo de idioma y funciona sin conexión después?

En el primer uso, el navegador descarga un modelo entrenado pequeño (unos MB) del idioma seleccionado desde la CDN de Tesseract, junto con su motor WASM. El navegador los guarda en caché, así que visitas posteriores — e incluso una pestaña sin conexión tras una carga — reconocen texto sin descargar nada.

¿Qué tan preciso es y cómo consigo los mejores resultados?

Las capturas de pantalla quedan casi perfectas: texto nítido sobre fondo plano. Las fotos dependen de la calidad de captura — iluminación uniforme, página plana y recta, texto que llene el encuadre. El texto borroso, inclinado o muy pequeño causa la mayoría de los errores, así que recorta justo la zona que quieres.

¿Se sube mi imagen a un servidor?

No. El OCR funciona al 100% en tu navegador con WebAssembly — la imagen nunca se envía a ningún sitio. El único tráfico de red es el archivo de modelo público y precompilado que todos los visitantes descargan una vez desde la misma URL de la CDN.

¿Necesitas texto de un PDF en lugar de una imagen? La herramienta hermana Extractor de texto de PDF lee la capa de texto incrustada del documento página por página — sin OCR.