Haz clic para subir o suelta un PDF escaneado aquí
Un PDF: se lee con OCR en tu dispositivo y nunca se subeSobre el OCR para PDF
Algunos PDF no tienen nada de texto dentro. Un contrato escaneado, un recibo fotografiado, un fax, un libro antiguo pasado por el escáner de una biblioteca: cada página es solo una imagen de texto. Puedes leerla, pero no puedes seleccionarla, copiarla ni buscar en ella.
El OCR (reconocimiento óptico de caracteres) lo soluciona. Mira la imagen de cada página, reconoce la forma de las letras y te devuelve texto real que puedes copiar, editar y buscar.
Esta herramienta lo hace página a página y muestra el texto en cuanto termina cada página, así que no tienes que esperar al documento entero para empezar.
Todo ocurre en tu dispositivo
Los PDF escaneados suelen ser los privados: un documento de identidad, una carta del banco, un formulario médico, un contrato firmado. La mayoría de los servicios de OCR en línea te piden que los subas.
Este no. El motor OCR (Tesseract, el motor de código abierto que usan muchas herramientas profesionales) funciona dentro de tu navegador:
- Privado: el PDF nunca sale de tu dispositivo
- Sin registro, sin límite de páginas, sin marca de agua
La primera vez se descargan el motor y los datos del idioma: unos pocos megabytes. Tu navegador los guarda, así que la siguiente vez empieza más rápido.
Páginas de texto y páginas escaneadas en un mismo archivo
Muchos PDF son mixtos. Páginas escritas a máquina con una página de firma escaneada al final. Un escaneo al que alguien ya le pasó el OCR. Un informe con algunas páginas fotografiadas en medio.
Por defecto, la herramienta revisa primero cada página:
- Una página que ya tiene texto real se copia tal cual — exacta, al instante, sin errores de OCR
- Una página que es solo una imagen se lee con OCR
Al final ves cuántas páginas fueron por cada camino. Desmarca «Páginas que ya tienen texto real» para forzar el OCR en todas las páginas: útil cuando la capa de texto antigua está mal o desordenada.
Cómo conseguir el mejor resultado
El OCR es muy bueno, pero lee una imagen, así que la imagen importa:
- Elige el idioma correcto. Cambia qué letras y acentos espera el motor. Un texto en español leído como inglés pierde sus ñ y sus tildes.
- Las páginas rectas y nítidas se leen mejor. Una foto torcida del móvil o un fax borroso dan más errores.
- El texto impreso normal se lee bien. La letra a mano, la letra muy pequeña y las fuentes decorativas se leen mal.
- Las tablas salen como líneas de texto, no como tabla. Si es una tabla, revisa las columnas después.
- Lee siempre el resultado antes de fiarte de él. Ojo con 1 / l / I, 0 / O y rn / m: las confusiones clásicas del OCR.
Para qué se usa
- Copiar un párrafo de un contrato escaneado o una carta
- Sacar el texto de un libro o artículo antiguo que solo existe escaneado
- Hacer que un recibo o una factura escaneados se puedan buscar en tus notas
- Sacar citas de artículos de investigación escaneados y apuntes
- Pasar a texto formularios y registros sin teclearlos a mano
- Convertir un documento enviado por fax en algo que puedas editar
Conviene saber
- Un PDF protegido con contraseña hay que desbloquearlo primero; usa Desbloquear PDF
- Los documentos grandes llevan tiempo: unos 2–10 segundos por página en un ordenador, más en un móvil. Usa Páginas para leer solo la parte que necesitas
- Detener conserva todas las páginas ya leídas
- El resultado es texto sin formato. Para llevarlo a Word, pégalo, o usa PDF a Word para los PDF que ya tienen texto
- Si tu PDF tiene texto real en todas las páginas, PDF a texto es más rápido y tiene más opciones de formato
Preguntas frecuentes
¿Es gratis?
Sí. Sin registro, sin límite de páginas, sin marca de agua.
¿Se sube mi PDF?
No. Las páginas se dibujan y se leen dentro de esta página, en tu propio dispositivo.
¿Qué idiomas lee?
Inglés, español, francés, alemán, italiano, portugués, neerlandés, chino (simplificado), japonés y coreano. Elige uno antes de empezar.
¿Por qué hay errores en el texto?
El OCR adivina cada letra por su forma. Un escaneo borroso, torcido o de baja resolución hace que se equivoque más. Revisa el resultado y corrige los pocos errores en el cuadro antes de copiarlo.
¿Puede hacer que mi PDF admita búsquedas?
Todavía no: te da el texto en un archivo .txt aparte. Tu PDF original no cambia.
Cómo se usa
- Haz clic en Haz clic para subir, o arrastra tu PDF escaneado al cuadro
- Elige el idioma del texto
- Escribe un rango de páginas si solo necesitas algunas, o déjalo vacío para leerlas todas
- Haz clic en Leer el texto y mira cómo van llegando las páginas
- Revisa el texto y haz clic en Copiar o Descargar .txt
Herramientas relacionadas
- PDF a texto — para PDF que ya contienen texto real
- Imagen a texto — el mismo OCR para una foto o una captura de pantalla
- PDF a Word — convertir un PDF con texto en un documento editable
- PDF a JPG — guardar las páginas escaneadas como imágenes
- Comprimir PDF — reducir un escaneo pesado
- Desbloquear PDF — quitar una contraseña antes de leer