toolsmith

Sin subidas · todo se ejecuta en tu navegador

Imagen y PDF a texto (OCR)

Lee las palabras de una imagen o de un PDF escaneado y te devuelve texto plano que puedes copiar. El reconocimiento ocurre en tu dispositivo.

Suelta una imagen o un PDF aquí

PNG · JPG · WebP · PDF — de uno en uno

¿Adónde van mis archivos?

A ninguna parte. La imagen se lee dentro de esta pestaña del navegador y nunca se sube. Lo único que viaja es el motor de reconocimiento, que se descarga desde una CDN pública — va en el sentido contrario.

¿Por qué descarga unos megabytes antes de empezar?

Porque el OCR necesita un motor real y un modelo entrenado para el idioma elegido. Entre los dos suman unos 4 a 6MB. Lo descargamos en el momento en que pulsas el botón y no antes, y tu navegador lo conserva, así que el segundo documento empieza al instante.

¿Por qué el texto no es perfecto?

Usamos los modelos compactos, que son entre cinco y diez veces más pequeños que los precisos (inglés: 2MB frente a 11MB; japonés: 1,5MB frente a 16MB). En un escaneo limpio la diferencia es pequeña; en una foto movida se nota. Preferimos no hacerte descargar 16MB para descubrirlo. Endereza la página y dale más luz y mejora bastante.

¿Puede leer un PDF?

Sí, hasta 30 páginas de una vez. Cada página se dibuja primero como imagen y luego se lee. Si el PDF ya contiene texto real, copiarlo desde cualquier lector será más rápido y exacto — el OCR es para los que solo son fotos de papel.

¿Mantiene la maquetación?

No. Obtienes las palabras en orden de lectura, no columnas, tablas ni encabezados. Si la maquetación importa más que las palabras, esta no es la herramienta.

Otras herramientas

Vale la pena leer