PDF a texto

Extrae las palabras de un PDF como algo que puedes copiar, citar y editar. Las páginas que ya contienen texto se leen al instante, y las páginas escaneadas se reconocen con OCR, todo dentro de tu navegador.

Añade tu PDF

Solo PDF

Arrastra un PDF aquí o haz clic para buscarlo

Funciona con PDF digitales y con escaneos de páginas en papel

PDF

Texto extraído

Añade un PDF para empezar

El texto de tu documento aparecerá aquí

Las páginas escaneadas pasan por reconocimiento, así que cuenta con unos segundos por página y revisa el resultado por si hay palabras mal leídas. El texto digital se copia literalmente.

Cómo extraer texto de un PDF

Añade tu PDF

Arrastra el documento. Se abre y se renderiza en local, no se sube nada.

Inicia la extracción

Las páginas con capa de texto vuelven al instante. Las páginas escaneadas se reconocen una a una.

Copia o descarga el texto

Corrige lo que se haya leído mal y luego copia el texto o guárdalo como archivo .txt.

Por qué usar PDF a texto de Aihangsoft

Instantáneo en PDF digitales

Si el documento ya lleva texto real, se extrae directamente sin reconocimiento ni conjeturas.

Los escaneos nunca salen de tu equipo

Los contratos, facturas y documentos de identidad escaneados se renderizan y se leen en local, así que nada sensible se envía a ningún sitio.

Gratis, sin límite de páginas

Sin registro y sin tope en el número de páginas, tanto si traes una factura de una página como un informe completo.

Dos motores tras un solo botón

Extracción de la capa de texto

La mayoría de los PDF exportados desde un procesador de textos, un navegador o una herramienta de diseño llevan una capa de texto real. Ese texto se copia exactamente como se escribió, incluidos la puntuación y los acentos.

Caso de uso: informes, contratos, facturas exportadas

Respaldo OCR para escaneos

Una página que en realidad es solo una fotografía se renderiza al doble de resolución y pasa por reconocimiento, así que un documento en papel escaneado se convierte en texto buscable.

Caso de uso: papeleo escaneado, archivos antiguos, páginas fotografiadas

Informe por página

El resumen te dice cuántas páginas vinieron de una capa de texto y cuántas necesitaron reconocimiento, para que sepas qué páginas merecen un segundo vistazo.

Caso de uso: documentos mixtos, mitad digitales y mitad escaneados

Marcadores de página en la salida

Cada página lleva un marcador al principio para que puedas rastrear una cita hasta su página, algo que importa cuando la fuente es un informe largo.

Caso de uso: investigación, citas, revisión legal

Cómo funciona y adónde va tu archivo

Motor
PDF.js 4.10.38 lee la capa de texto ya presente en el archivo. Las páginas que no la tienen se pasan a Tesseract.js 7.0.0 para OCR.
Ubicación de los datos
Todo se ejecuta en esta pestaña del navegador. El archivo nunca se sube a un servidor.
Compruébalo tú mismo
Inicia una tarea aquí y observa el panel de red del navegador: ninguna petición lleva tu archivo. Cómo comprobar cualquier herramienta online.

Preguntas frecuentes sobre PDF a texto

Sí, esa es la razón principal por la que existe la herramienta. Si una página es solo una imagen de una página, se renderiza y se lee con OCR. Si el PDF ya contiene texto real, ese texto se extrae directamente, lo que es a la vez más rápido y perfectamente preciso.
El resumen junto al resultado muestra cuántas páginas se leyeron de una capa de texto existente y cuántas necesitaron OCR, para que sepas qué parte de la salida merece una revisión más atenta.
No. El archivo se abre y se renderiza dentro de tu navegador. Ni el documento ni el texto extraído se envían nunca a un servidor.
Cada página escaneada tiene que renderizarse a una imagen y luego reconocerse, lo que tarda unos segundos por página en un portátil normal. Un PDF con una capa de texto real vuelve casi al instante porque no necesita reconocimiento.
No puede abrir un documento que pida contraseña. Usa primero la herramienta Desbloquear PDF con la contraseña que conoces, descarga la copia desbloqueada y luego lee el texto de ese archivo.
El inglés viene incluido, y se pueden seleccionar once idiomas más, entre ellos chino, japonés, coreano, alemán, francés y español. Los datos de idioma se descargan una vez en el primer uso y luego se almacenan en caché.

Extrae el texto de tu PDF

Gratis, privado e ilimitado. No necesitas cuenta.

Sube un PDF