Cómo extraer texto de un PDF escaneado

Un PDF escaneado es un montón de imágenes de páginas, así que no hay texto que seleccionar ni copiar. Para sacar las palabras hace falta OCR. La herramienta gratuita PDF a texto hace las dos cosas en tu navegador: lee directamente la capa de texto de las páginas digitales y aplica OCR solo a las páginas que son imágenes.

¿Por qué no puedo copiar texto de un PDF?

Normalmente porque la página es un escaneo o una foto guardada como PDF. El archivo muestra letras, pero debajo solo hay píxeles. Algunos PDF además tienen la copia desactivada por su autor. Si no puedes resaltar una palabra suelta, la página necesita OCR antes de poder copiar el texto.

¿Cómo saber si un PDF está escaneado?

Ábrelo e intenta seleccionar una frase. Si las palabras se resaltan una a una, la página tiene capa de texto. Si toda la página se selecciona como una imagen, o no se selecciona nada, es un escaneo. Muchos PDF mezclan ambos: páginas escritas con algunos anexos escaneados al final.

¿Cómo hacer OCR a un PDF gratis?

  1. Abre la herramientaEntra en PDF a texto.
  2. Añade el PDFElige un archivo de hasta 50 MB.
  3. Elige el idioma OCRSelecciona el idioma del documento para que las páginas escaneadas se lean bien.
  4. ExtraeLas páginas con texto salen al instante; las escaneadas se reconocen una a una.
  5. Copia o descargaCopia el resultado o guárdalo como archivo de texto.

¿Cómo limpiar el texto extraído?

Los escaneos suelen cortar las frases al final de cada línea impresa y partir palabras con guiones. Si trabajas el texto con código, unas líneas de JavaScript vuelven a unir los párrafos. Pega el resultado del OCR en la variable text y ejecútalo en la consola del navegador o en Node.js.

join-ocr-lines.js
const text = `pega aquí el resultado del OCR`;

const cleaned = text
  .replace(/-\n(?=\p{Ll})/gu, '')   // une palabras cortadas
  .replace(/(?<!\n)\n(?!\n)/g, ' ') // saltos simples -> espacios
  .replace(/[ \t]{2,}/g, ' ');      // espacios repetidos -> uno

console.log(cleaned);

¿Es seguro con documentos privados?

Sí. El PDF lo procesa tu propio navegador y nunca se sube a un servidor, así que sirve para contratos, facturas e informes médicos. Un mejor escaneo da mejor texto: mira qué afecta de verdad a la precisión del OCR antes de volver a escanear.

¿Y si solo tengo fotos de las páginas?

Entonces sáltate el PDF y usa directamente las herramientas de imagen: copiar texto de una imagen para una página, o el OCR de varias imágenes para hasta 20 páginas a la vez.

Extrae el texto de tu PDF

Primero la capa de texto, OCR para los escaneos. Todo en tu navegador.

Artículos relacionados

October 4, 2026
Guía
Arbab Naseer

Cómo leer números de teléfono y correos de una imagen

Saca números de teléfono y correos de una foto, un folleto o una captura con OCR gratis en el navegador y cópialos sin volver a escribir ni un dígito.

October 4, 2026
Guía
Arbab Naseer

Cómo copiar texto de una imagen en iPhone, Android, Windows y Mac

Copia texto de una imagen en iPhone, Android, Windows o Mac con las herramientas del sistema o con un OCR gratis en el navegador que funciona igual en todos.

October 3, 2026
Guía
Arbab Naseer

Cómo extraer texto de una captura de pantalla

Convierte una captura de pantalla en texto editable: pégala en un OCR gratis en el navegador y copia el resultado. Atajos para Windows, Mac y el celular.

Volver al blog

We are also available in other languages

Ad Sponsored Check this offer
Ad Sponsored Check this offer