Skip to content

Imagen a texto: extrae texto de cualquier foto, gratis

Suelta los archivos aquí — pega, arrastra o haz clic para explorar

.png,.jpg,.jpeg,.webp,.bmp

Procesado en tu dispositivo: no se sube nada. Verifícalo en la pestaña de red.

Esta herramienta saca las palabras de una imagen y te las devuelve como texto plano y editable que puedes copiar. Suelta una foto, una captura de pantalla, una página escaneada o la imagen de un documento, y los caracteres vuelven como texto seleccionable en unos segundos. Es gratis, no hay registro y no hay paso de subida.

La diferencia está en dónde ocurre el trabajo. El reconocimiento óptico de caracteres (OCR) se ejecuta por completo dentro de la pestaña de tu navegador. La primera vez que la usas, un pequeño modelo de reconocimiento (unos 25 MB) se descarga y queda en caché en tu dispositivo; después de eso, cada imagen que conviertes se lee localmente. Tu imagen nunca se envía a un servidor: puedes comprobarlo tú mismo en la pestaña de red de tu navegador, y te explicamos cómo más abajo.

Está pensada para texto impreso y tipografiado: recibos, capturas de pantalla, páginas de libros, formularios, diapositivas, etiquetas de productos y tarjetas de presentación. Al lanzamiento se admiten inglés, español e indonesio, con más idiomas en camino. La escritura a mano es lo único que todavía no hace bien, y somos claros sobre ese límite más abajo en la página.

Cómo funciona

  1. 01

    Agrega tu imagen

    Arrastra una foto, captura de pantalla o escaneo a la página, o haz clic para buscar en tus archivos. JPG, PNG y WebP funcionan directamente, y también se admiten las fotos HEIC del iPhone. Puedes agregar varias imágenes a la vez y se leerán en orden.

  2. 02

    Deja que el OCR se ejecute en tu navegador

    El modelo de reconocimiento lee la imagen en tu propio dispositivo. En la primera ejecución se descarga una sola vez (unos 25 MB) y queda en caché, así que cada conversión posterior empieza al instante. Nada se sube: los bytes de la imagen nunca salen de la pestaña.

  3. 03

    Copia o descarga el texto

    El texto extraído aparece en un panel editable. Cópialo directamente al portapapeles o descárgalo como archivo .txt. Puedes corregir un carácter suelto o reordenar líneas antes de guardar.

Cómo funciona la conversión de imagen a texto en el navegador

La mayoría de los convertidores en línea suben tu imagen a un servidor, ejecutan el OCR allí y devuelven el texto. Este no. El modelo de reconocimiento —un motor de OCR compacto y moderno de la familia PaddleOCR— se descarga a tu navegador una sola vez y luego se ejecuta localmente en un proceso en segundo plano cada vez que conviertes una imagen.

Ese diseño tiene dos consecuencias prácticas. Primero, la privacidad es estructural, no una promesa: como la conversión ocurre en tu pestaña, no hay ningún servidor que llegue a tener una copia de tu imagen. Nada del archivo —ni los píxeles ni el nombre— se transmite. Segundo, sigue funcionando sin conexión una vez que el modelo está en caché, así que un recibo o una captura de pantalla se convierten incluso sin internet.

No tienes que creernos sin más. Abre las herramientas de desarrollo de tu navegador, cambia a la pestaña Red (Network) y convierte una imagen. Verás que el archivo del modelo se descarga en la primera ejecución (y se carga desde el caché después), pero no verás que tu imagen se suba a ningún lado. Los bytes se quedan en el dispositivo.

Captura de pantalla a texto: saca las palabras de cualquier captura

Las capturas de pantalla son lo que la gente más procesa con esta herramienta, y también lo que mejor lee. Una captura de pantalla es nítida, está uniformemente iluminada y se renderiza a la densidad de píxeles nativa, lo cual es un input casi ideal para el OCR.

Tareas típicas de captura de pantalla a texto que resuelve sin problemas:

  • Copiar un mensaje de error o un stack trace que un programa muestra como imagen o no deja seleccionar
  • Sacar texto de un chat, una publicación en redes o un hilo de comentarios
  • Tomar código, un comando o un fragmento de configuración de un video o una diapositiva
  • Extraer números de un panel, la etiqueta de un gráfico o la captura de una hoja de cálculo
  • Volver a convertir en texto editable la captura de un PDF o de una página con muro de pago

En macOS usa Mayús-Comando-4, en Windows usa la Herramienta Recortes (Windows-Mayús-S), y luego suelta la captura directamente en esta página. Como el texto de una captura ya es nítido, la precisión en estos casos suele ser casi perfecta.

Qué lee bien y qué no

Ser honestos sobre los límites te ahorra tiempo, así que este es el panorama real.

Lee excelentemente: texto impreso y tipografiado de casi cualquier tipo: libros, recibos, facturas, formularios, etiquetas, letreros, presentaciones y capturas de pantalla. Las fotos claras de la página de un documento también funcionan bien, siempre que el texto esté enfocado y razonablemente derecho.

Le cuesta: la escritura a mano. La letra cursiva y las notas manuscritas informales son genuinamente difíciles para el OCR en el navegador, y los resultados serán pobres; esta herramienta no es la adecuada para eso. Estamos desarrollando una herramienta dedicada de escritura a mano a texto que usa un modelo distinto y más pesado exactamente para este caso; llega pronto.

Algunos consejos para mejores resultados: fotografía los documentos de frente en lugar de en ángulo, encuadra todo el bloque de texto, y evita reflejos y sombras. Si una foto sale borrosa, vuelve a tomarla: un input más nítido supera a cualquier posprocesamiento. El texto muy pequeño o de muy bajo contraste puede perder caracteres, así que acércate cuando puedas.

Idiomas y formatos de imagen admitidos

Idiomas al lanzamiento: inglés, español e indonesio. El motor reconoce los caracteres de alfabeto latino, los acentos y la puntuación que se usan en estos idiomas, así que las eñes y las vocales acentuadas del español salen correctamente. Hay más idiomas planeados, y la herramienta cargará el modelo adecuado automáticamente a medida que se agreguen.

Formatos de imagen: JPG/JPEG, PNG y WebP se leen directamente. HEIC/HEIF —el formato que usan los iPhone por defecto— también se admite, así que puedes soltar una foto directamente desde tu galería sin convertirla primero. Para documentos de varias páginas, un PDF suele encajar mejor que una imagen; usa nuestra herramienta de PDF a texto para esos casos.

No hay un límite de tamaño de archivo impuesto por un servidor, porque no hay ningún servidor de por medio: el límite práctico es la memoria de tu dispositivo. Las fotos y capturas de pantalla del día a día están muy lejos de ese límite.

Preguntas frecuentes

¿Mi imagen es realmente privada y cómo puedo verificarlo?
Sí. El OCR se ejecuta por completo en tu navegador, así que tu imagen nunca se sube a ningún servidor. Puedes confirmarlo directamente: abre las herramientas de desarrollo de tu navegador, ve a la pestaña Red y convierte una imagen. Verás que el modelo de reconocimiento se descarga en la primera ejecución y se carga desde el caché después, pero nunca verás que tu imagen se envíe a ningún lado. Los bytes se quedan en tu dispositivo.
¿Qué formatos de imagen puedo convertir a texto?
JPG/JPEG, PNG y WebP funcionan directamente. HEIC y HEIF —el formato de foto por defecto en los iPhone— también se admiten, así que puedes soltar una imagen directamente desde tu galería sin convertirla primero. Si tienes un escaneo de varias páginas, un PDF suele ser la mejor opción; nuestra herramienta de PDF a texto se encarga de esos. Puedes agregar varias imágenes a la vez y se leerán en secuencia.
¿Qué tan precisa es la extracción de texto?
Para texto impreso y tipografiado —recibos, capturas de pantalla, páginas de libros, formularios, diapositivas— la precisión es muy alta, a menudo casi perfecta con un input limpio y nítido. Las capturas de pantalla se leen especialmente bien porque los píxeles son nítidos. La precisión baja con la borrosidad, los reflejos, la inclinación pronunciada o el texto muy pequeño, así que una imagen derecha, bien iluminada y enfocada da el mejor resultado. La escritura a mano es la principal excepción y todavía no se maneja bien.
¿Qué idiomas admite la herramienta de imagen a texto?
Al lanzamiento admite inglés, español e indonesio, incluidos los caracteres acentuados y la puntuación que usan esos idiomas, así que las eñes y las vocales acentuadas del español salen correctamente. La herramienta carga el modelo de reconocimiento adecuado automáticamente. Hay más idiomas en la hoja de ruta y estarán disponibles sin ningún cambio en la forma de usar la página: solo suelta tu imagen y convierte.
¿Cómo copio texto de una foto en mi iPhone o Android?
Abre esta página en el navegador de tu teléfono, toca para agregar una foto desde tu galería (o toma una al momento) y el texto se extrae directamente en el dispositivo. Las fotos HEIC del iPhone funcionan sin ninguna conversión. Cuando el texto aparezca en el panel editable, toca Copiar para ponerlo en tu portapapeles, o descárgalo como archivo .txt. Nada se sube desde tu teléfono.
¿Puedo convertir varias imágenes a la vez?
Sí. Agrega varias imágenes juntas y la herramienta las lee una tras otra, devolviendo el texto de cada una. Como todo se ejecuta localmente, no hay espera de subida por archivo: el principal costo es que tu dispositivo procese cada imagen, lo que suele ser un segundo o dos por cada foto o captura típica. Los lotes más grandes simplemente tardan proporcionalmente más.
¿Por qué la primera conversión es más lenta que las demás?
La primera vez que usas la herramienta, descarga el modelo de OCR —unos 25 MB— a tu navegador y lo guarda en caché. Esa descarga única es la parte lenta. Cada conversión posterior reutiliza el modelo en caché y empieza al instante, incluso entre visitas e incluso sin conexión. Así que la primera imagen puede tardar unos segundos más; las demás son rápidas.
¿Puede leer escritura a mano?
No bien, y no vamos a fingir lo contrario. El OCR en el navegador está hecho para texto impreso y tipografiado; la letra cursiva y las notas manuscritas informales dan resultados pobres con este motor. Estamos desarrollando una herramienta aparte de escritura a mano a texto que usa un modelo más pesado y creado a propósito exactamente para ese trabajo, y llega pronto. Para cualquier cosa impresa —incluidas las mayúsculas de imprenta bien hechas— esta herramienta funciona bien hoy.