Acerca de PDF a texto
Saca el texto plano de un PDF para que puedas reutilizarlo — pegarlo en un documento o correo, citar un informe, pasarlo a un traductor o app de notas, o quitar el formato para quedarte solo con las palabras. Lee el texto tal como está guardado en el archivo, página por página, y te entrega el resultado para copiar o descargar como .txt.
La extracción se ejecuta en tu dispositivo, así que incluso los documentos confidenciales siguen siendo privados.
Cómo funciona
El PDF se abre con pdf.js en tu navegador. Para cada página, la herramienta lee la capa de texto de la página — los datos reales de caracteres y posición que el PDF guarda — y la añade, separando las páginas con una línea en blanco. Va mostrando el texto a medida que avanza, así que lo ves llenarse página por página, y muestra un estado «página X de N». No se reescribe ni se adivina nada; muestra el texto que realmente está en el archivo.
Supuestos y valores predeterminados
- Lee la capa de texto incrustada, así que los resultados dependen de cómo se creó el PDF. Un PDF exportado desde Word, un navegador o la mayoría del software tiene una capa de texto limpia; un PDF escaneado o solo de imagen no tiene ninguna.
- Las páginas se muestran en el orden del documento, separadas por una línea en blanco.
- La descarga es un
.txtde texto plano con el nombre del PDF de origen. - Si no se encuentra texto seleccionable, la herramienta te dice explícitamente que el PDF parece escaneado y necesitaría OCR.
Limitaciones
- Sin OCR. Lee el texto existente; no reconoce texto dentro de imágenes o fotos escaneadas. Si el PDF es un escaneo, obtendrás un resultado vacío y un aviso de que se necesita OCR — esta herramienta no puede hacer ese paso.
- El diseño no se reconstruye del todo. El texto sale en el orden en que el PDF lo guarda, que suele ser correcto para documentos de una columna, pero puede intercalar o desordenar columnas, tablas, encabezados/pies y cuadros de texto en diseños complejos.
- El formato se pierde — obtienes texto plano, no fuentes, negrita/cursiva, títulos ni estructura de tablas.
- Los PDF cifrados o dañados no se pueden leer y mostrarán un error.
Privacidad
El texto se extrae con pdf.js por completo en tu navegador. Tu PDF y su texto nunca salen de tu dispositivo — no se sube ni almacena nada.

