Convertir PDF a texto
Saca el texto ya seleccionable de un PDF a un archivo .txt sencillo que puedes copiar, buscar o pegar en otro sitio. La herramienta lee la capa de texto que ya está en el documento: no es OCR, así que es rápido y no se sube nada.

Tu archivo no sale de tu dispositivo. No se copia en ningún servidor ni se guarda en caché. Cada herramienta de este sitio funciona con JavaScript, directamente en la pestaña que tienes abierta.
Suelta tu archivo aquí o haz clic para elegirlo
Extrae el texto que ya es seleccionable en el PDF. Para escaneos, usa OCR PDF.
Por qué convertir en tu navegador y no con un programa de escritorio
- Convierte un PDF a texto en línea gratis, sin subir el archivo a un servidor de conversión.
- Es inmediato con documentos que ya tienen capa de texto (exportaciones de Word o de Google Docs), sin esperas de OCR.
- La extracción se hace en tu navegador: un contrato o un extracto no se envía a ningún sitio solo para copiar sus palabras.
- Gratis, sin registro y sin marca de agua (un texto plano, de todos modos, no la lleva).
Cómo funciona PDF a texto, paso a paso
1Elige el PDF
Arrastra a la herramienta un PDF en el que se pueda seleccionar texto, o haz clic para elegirlo. Se queda en tu dispositivo.
2Espera
Espera un momento mientras se lee la capa de texto de cada página en esta pestaña.
3Revisa el texto
Revisa el texto extraído. Puedes editarlo en el campo si quieres corregir una línea antes de guardar.
4Descarga o copia
Descarga el texto con «Descargar .txt» o cópialo al portapapeles con «Copiar texto».
Cuándo hace falta
Una investigadora tiene un PDF de 40 páginas con las actas de una reunión, exportado desde Word, y necesita el texto en una aplicación de notas que no abre PDF. Arrastra el archivo, copia el texto extraído y lo pega, o descarga el .txt si la aplicación prefiere un archivo. Si el PDF fuera en cambio una foto de las actas hecha con el móvil, aquí saldría casi nada y OCR PDF sería el paso siguiente adecuado.
Cómo funciona la conversión en realidad
pdf.js abre el archivo en esta pestaña y lee la capa de texto existente de cada página, el mismo contenido que usa un lector de PDF cuando seleccionas y copias. Los elementos se agrupan en líneas según su posición en la página para que el .txt conserve un orden de lectura aproximado, y se unen con separadores de página. Nada se convierte en imagen y no se carga ningún motor de OCR. Si el PDF no tiene capa de texto, el resultado sale vacío o casi vacío y la herramienta te remite a OCR PDF. Si cierras la pestaña, el texto y el archivo desaparecen de la memoria. Puedes comprobarlo con F12, en la pestaña «Red»: no sale ninguna petición con tu archivo.
Qué conviene saber antes de convertir
- Las páginas escaneadas o las fotos de páginas no se leen. Si en un lector de PDF normal no puedes seleccionar texto, usa OCR PDF. Que el resultado salga vacío no es un error.
- Los diseños complejos (artículos a varias columnas, tablas, notas al pie) se aplanan en líneas en orden de lectura. El orden de las columnas puede mezclarse a veces si los objetos de texto del original no están guardados de izquierda a derecha.
- El texto oculto o recortado que un lector de PDF no mostraría puede aparecer igualmente si está en la capa de texto.
- Los archivos protegidos con contraseña hay que desbloquearlos antes, porque la extracción necesita abrir el documento.
- La salida es texto plano. Se pierde el formato como negrita, tamaño o color, y cada página se separa con una línea como «--- Página 2 ---».
