PDF a texto
Extrae las palabras de un PDF como algo que puedes copiar, citar y editar. Las páginas que ya contienen texto se leen al instante, y las páginas escaneadas se reconocen con OCR, todo dentro de tu navegador.
Añade tu PDF
Solo PDFArrastra un PDF aquí o haz clic para buscarlo
Funciona con PDF digitales y con escaneos de páginas en papel
Texto extraído
Añade un PDF para empezarEl texto de tu documento aparecerá aquí
Las páginas escaneadas pasan por reconocimiento, así que cuenta con unos segundos por página y revisa el resultado por si hay palabras mal leídas. El texto digital se copia literalmente.
Cómo extraer texto de un PDF
Añade tu PDF
Arrastra el documento. Se abre y se renderiza en local, no se sube nada.
Inicia la extracción
Las páginas con capa de texto vuelven al instante. Las páginas escaneadas se reconocen una a una.
Copia o descarga el texto
Corrige lo que se haya leído mal y luego copia el texto o guárdalo como archivo .txt.
Por qué usar PDF a texto de Aihangsoft
Instantáneo en PDF digitales
Si el documento ya lleva texto real, se extrae directamente sin reconocimiento ni conjeturas.
Los escaneos nunca salen de tu equipo
Los contratos, facturas y documentos de identidad escaneados se renderizan y se leen en local, así que nada sensible se envía a ningún sitio.
Gratis, sin límite de páginas
Sin registro y sin tope en el número de páginas, tanto si traes una factura de una página como un informe completo.
Dos motores tras un solo botón
Extracción de la capa de texto
La mayoría de los PDF exportados desde un procesador de textos, un navegador o una herramienta de diseño llevan una capa de texto real. Ese texto se copia exactamente como se escribió, incluidos la puntuación y los acentos.
Caso de uso: informes, contratos, facturas exportadasRespaldo OCR para escaneos
Una página que en realidad es solo una fotografía se renderiza al doble de resolución y pasa por reconocimiento, así que un documento en papel escaneado se convierte en texto buscable.
Caso de uso: papeleo escaneado, archivos antiguos, páginas fotografiadasInforme por página
El resumen te dice cuántas páginas vinieron de una capa de texto y cuántas necesitaron reconocimiento, para que sepas qué páginas merecen un segundo vistazo.
Caso de uso: documentos mixtos, mitad digitales y mitad escaneadosMarcadores de página en la salida
Cada página lleva un marcador al principio para que puedas rastrear una cita hasta su página, algo que importa cuando la fuente es un informe largo.
Caso de uso: investigación, citas, revisión legalCómo funciona y adónde va tu archivo
- Motor
- PDF.js 4.10.38 lee la capa de texto ya presente en el archivo. Las páginas que no la tienen se pasan a Tesseract.js 7.0.0 para OCR.
- Ubicación de los datos
- Todo se ejecuta en esta pestaña del navegador. El archivo nunca se sube a un servidor.
- Compruébalo tú mismo
- Inicia una tarea aquí y observa el panel de red del navegador: ninguna petición lleva tu archivo. Cómo comprobar cualquier herramienta online.