BestPDFInTheWorld
Convertir · Premium

Extraer texto

Extraer texto guarda el texto del PDF en un archivo .txt simple, listo para abrir en cualquier editor. Puedes elegir solo algunas páginas y decidir si quieres un separador entre ellas. Es la herramienta correcta cuando quieres el contenido y no el formato: para pegarlo en otro sitio, para buscar, o para tratar el texto en un programa. Todo el procesamiento ocurre en tu navegador.

Cómo se usa

Tres pasos, sin instalar nada.

Todo el trabajo ocurre en tu ordenador, de principio a fin.

1

Elegir el archivo

Arrastra el PDF a la ventana de la herramienta, o haz clic para elegirlo.

2

Elegir las páginas

Déjalo vacío para el documento entero, o indica intervalos y números sueltos.

3

Descargar el .txt

Recibes un archivo de texto simple, sin ningún formato.

¿Funciona con un PDF escaneado?

No, y es la limitación más importante de esta herramienta. Un PDF escaneado es una fotografía de la página: el texto que ves es una imagen, y no hay texto dentro del archivo para extraer. En ese caso la herramienta te lo dice en vez de entregarte un archivo vacío. Lo que resuelve los escaneos es el OCR, reconocimiento óptico de caracteres, y para eso está la herramienta OCR, que reconoce portugués, inglés y español y corre en tu navegador como todas las demás. Es la única que exige suscripción. Para saber de antemano si tu PDF tiene texto de verdad, usa la herramienta de propiedades del PDF, que responde exactamente a eso.

¿Qué pasa con el formato?

Se pierde, y eso es lo que se busca. Un .txt no tiene negritas, tablas, columnas ni imágenes: tiene solo las palabras. Si quieres mantener la apariencia, la herramienta correcta es la de PDF a Word, que conserva más, aunque los diseños complejos no sobreviven bien en ningún sitio.

¿Qué es la separación por páginas?

Una línea con el número de página entre el texto de una página y el de la siguiente, para saber de dónde vino cada parte. Puedes desactivarla y recibir el texto todo seguido.

¿Puedo extraer solo un capítulo?

Sí. El campo de páginas acepta intervalos (10-25) y números sueltos (3), separados por comas.

Tus archivos nunca salen del navegador. Ningún PDF se envía a un servidor para extraerle el texto.
Errores y límites

La herramienta dice que el PDF no tiene texto. ¡Pero yo veo texto!

Ves una imagen de texto. Es la diferencia entre un documento escrito en el ordenador y un documento fotografiado o escaneado: en el segundo, las letras son píxeles. Es la causa número uno de que alguien intente extraer texto y no pueda. La salida es el OCR, que lee la imagen y devuelve texto. Compruébalo primero con la herramienta de propiedades del PDF, que te dice si el archivo tiene capa de texto.

El texto salió desordenado, con frases mezcladas.

Ocurre en documentos de dos o más columnas, y en páginas con cajas de texto repartidas. El PDF no guarda el orden de lectura, guarda trozos de texto con la posición de cada uno; la herramienta sigue el orden en que están en el archivo, que suele ser el correcto pero no siempre. En revistas y artículos académicos a dos columnas es frecuente que salga intercalado.

Faltan espacios entre palabras, o hay de más.

El PDF muchas veces no guarda espacios: guarda la distancia entre trozos de texto. La herramienta decide dónde hay espacio a partir de esa distancia, proporcional al tamaño de la letra. Funciona bien en la mayoría de los casos y falla en tipografías muy espaciadas o muy condensadas.

El archivo muestra acentos raros al abrirlo.

El .txt sale en UTF-8, que es el estándar actual. Algunos editores antiguos asumen otra codificación. Abrirlo con un editor moderno lo resuelve.

Preguntas

Preguntas sobre extraer texto de PDF.

¿Necesito crear cuenta?

Sí. La cuenta (por magic link, sin contraseña) es necesaria para la suscripción. Esta herramienta forma parte de la suscripción Premium, 1,99 EUR al mes, que quita los límites de todas las herramientas y añade el OCR. Firmar PDF abre en el plan gratuito, con una firma al día.

¿Ya tenéis OCR?

Sí, desde agosto de 2026, y es una herramienta aparte de esta. El OCR lee escaneos en portugués, inglés o español y devuelve un PDF con búsqueda o el texto; forma parte del plan de pago. Corre en tu ordenador como todo lo demás, y no lee letra manuscrita.

¿En qué se diferencia de PDF a Word?

Esta da texto simple, sin ningún formato. La de Word intenta mantener parte de la apariencia y devuelve un .docx editable.

¿Mis archivos quedan guardados en vuestros servidores?

No. Como nada se envía, nada queda guardado fuera de tu navegador.

¿Necesitas el texto
y no el formato?

Abre la herramienta y pruébala. Sin instalar nada, sin enviar nada a ningún sitio.

Abrir Extraer texto