Saltar al contenido
AtlasDocs
Blog

Cómo copiar todo el texto de un PDF de una vez (gratis)

Publicado el 01 de agosto de 2026

Para copiar el texto de un PDF entero, sube el archivo, pulsa "Extraer y descargar" y recibe un .txt con todas las páginas, gratis y en el navegador. Mira qué esperar.

Cómo copiar el texto de un PDF de una vez

Abre la herramienta "Extraer texto", sube el PDF y haz clic en "Extraer y descargar": se descarga un archivo .txt con el mismo nombre del PDF, con el texto de todas las páginas en secuencia. Funciona con PDF que tienen texto de verdad, aquellos en los que puedes seleccionar las palabras con el ratón. Un PDF escaneado necesita OCR. Todo ocurre en tu navegador.

  1. Abre "Extraer texto" y sube el PDF. Puedes subir varios: sale un .txt por PDF.
  2. Haz clic en "Extraer y descargar" (con varios archivos, el botón muestra "Extraer de 3 PDF", por ejemplo).
  3. Abre el .txt en cualquier editor y copia lo que necesites, o usa la búsqueda (Ctrl+F) para encontrar una palabra en todo el documento.

La herramienta solo lee: el PDF original sigue igual, sin ningún cambio, y el .txt es un archivo nuevo junto a él. Si solo quieres las palabras, borra el PDF después; si quieres los dos, guarda los dos. Si quieres más que las palabras, convierte el PDF a Word o Excel editable para mantener el formato, o a Markdown para tener títulos y listas marcados.

Extraer texto de PDF

Cómo sale el texto

  • Texto plano, en UTF-8, con los acentos conservados. El archivo tiene el mismo nombre del PDF y la extensión .txt.
  • Las páginas vienen una tras otra, separadas por una línea en blanco.
  • Los saltos de línea siguen los del PDF: donde el documento termina una línea, el .txt también. Los fragmentos de una misma línea se separan con un espacio.
  • El orden es aquel en que los fragmentos aparecen dentro del archivo. En páginas a dos columnas, el texto puede salir intercalado; revísalo antes de reutilizarlo.
  • Las columnas, las tablas, la negrita, el tamaño de fuente y la posición exacta de las cosas se quedan atrás. Lo que te llevas son las palabras.
  • No hay opciones ni selección de páginas: es el documento entero, de una vez. El límite es de 2 GB por archivo.

¿PDF con texto de verdad o imagen escaneada?

Hay dos tipos de PDF. El nativo, generado por ordenador, guarda el texto dentro del archivo: es aquel en el que pasas el cursor y seleccionas las palabras. El escaneado es, en la práctica, una foto de la página: parece texto, pero el ordenador solo ve una imagen, y nada se puede seleccionar. La herramienta "Extraer texto" es para el primer caso y solo lee el texto que ya existe, por eso es rápida y fiel al original. En un PDF escaneado no encuentra nada y muestra el aviso "Este PDF no contiene texto extraíble (puede ser un documento escaneado)".

En ese caso, la herramienta de OCR reconoce las letras dentro de la imagen, también en el navegador, y guarda un .txt. El paso a paso, con la elección del idioma y las precauciones con el escaneado, está en la guía de OCR.

OCR: extraer texto de PDF escaneado e imágenes

Cuándo conviene extraer el texto así

  • Reutilizar el contenido de un informe o contrato en un procesador de texto, sin volver a teclear nada.
  • Pegar pasajes largos en un correo, un mensaje o una presentación.
  • Buscar una palabra en todo el documento después de abrirlo como texto simple.
  • Pasar el contenido a una hoja de cálculo u otra herramienta que solo acepta texto.
  • Guardar una versión ligera, solo con las palabras, de un PDF pesado lleno de imágenes.
  • Contar palabras o revisar un texto en un corrector que no abre PDF.

Errores comunes y qué hacer

  • "Este PDF no contiene texto extraíble": el archivo está escaneado o se guardó como imagen. Usa el OCR.
  • Palabras pegadas o líneas desordenadas: es la forma en que se generó el PDF, común en documentos con columnas, cuadros de texto o tablas. Arréglalo en el editor después de pegar.
  • Texto en blanco o con símbolos raros: algunas fuentes incrustadas no tienen correspondencia con letras reales. El OCR también lo resuelve, porque lee la página como imagen.
  • Falta un fragmento: los encabezados y pies repetidos y los números de página sí entran en el .txt; las marcas de agua hechas como imagen no.
  • "No fue posible extraer el texto.": suele ser un PDF protegido con contraseña o dañado. Quita la contraseña con la herramienta Quitar contraseña de PDF y súbelo de nuevo.

Toda la extracción ocurre dentro de tu navegador: el PDF se lee en tu propio dispositivo y nunca se envía a ningún servidor.

¿Solo necesitas algunas páginas? Extrae el documento entero y recórtalo en el editor: como cada página termina en una línea en blanco, es fácil localizar el fragmento que te interesa y borrar el resto.