KippiLex

Pasar un PDF a texto, sin subirlo a ningún lado

Respuesta rápida

Abre el PDF aquí y el texto sale completo en segundos, separado por páginas, listo para copiar al portapapeles o descargar como .txt. Todo ocurre dentro de tu navegador: el archivo no se sube a ningún servidor. Y si el PDF resulta ser un escaneo sin texto, te lo decimos y te llevamos al OCR.

El texto sale en segundos: se lee el que el PDF ya trae por dentro, no hay reconocimiento que esperar.

«Copiar todo» lo deja en el portapapeles y «Descargar .txt» te lo baja como archivo de texto plano.

Si el PDF es un escaneo —una foto de las letras—, te lo dice en el acto y te lleva al OCR en español.

El archivo se lee en tu propio navegador. No se sube a ningún servidor: tampoco al nuestro.

Arrastra tu PDF aquí

El texto sale en segundos, listo para copiar

Tus archivos no salen de tu dispositivo. KippiLex no los recibe ni los guarda: todo se hace dentro de tu navegador. Cómo comprobarlo.

¿Cómo saco el texto de un PDF?

  1. 1

    Abre el PDF

    Arrástralo a la ventana o búscalo en tu equipo. Se lee en el acto, dentro de tu navegador, sin subida ni cola de espera.

  2. 2

    Espera unos segundos

    La herramienta recorre el documento página por página, junta los fragmentos de texto que el PDF guarda sueltos y los recompone en renglones legibles. Cada página queda separada con su número, para que sepas de qué folio salió cada párrafo.

  3. 3

    Copia o descarga

    El texto completo aparece en un área de lectura. «Copiar todo» lo manda al portapapeles para pegarlo en Word, en un correo o en un chat; «Descargar .txt» lo baja como archivo de texto plano, que abre en cualquier equipo.

Copiar la cláusula, citar el auto

El caso más común no es convertir un documento entero: es sacar un pedazo. Te mandaron el contrato de arrendamiento en PDF y hay una cláusula que no entiendes, o que te huele mal; seleccionarla en el visor de PDF del celular es una pelea, y al pegarla llega partida en renglones rotos. Aquí el documento completo queda como texto corrido: seleccionas la cláusula, la copias limpia y se la mandas a quien te la pueda explicar. Si esa cláusula es la razón de un problema, puedes contar tu caso gratis y pegarla tal cual: un abogado que la lee completa responde mejor que uno que la adivina.

Para un abogado el gesto es el mismo con otros papeles: citar un aparte de un auto o de una sentencia en un escrito sin reescribirlo a mano, llevarse los hechos de una demanda a una matriz de trabajo, buscar un nombre dentro de un documento largo con el buscador del propio bloc de notas. El separador «— Página N —» existe para eso: el texto que copias sigue diciendo de qué folio salió.

Y hay un tercer uso silencioso: el archivo .txt pesa nada y se abre en cualquier equipo, incluso viejo. Un expediente de 30 MB convertido a texto cabe en un correo sin adjuntos pesados, cuando lo que importa es lo que dice y no cómo se ve.

Qué extrae exactamente, y qué se pierde

Un PDF no guarda párrafos. Guarda miles de fragmentos de texto —a veces palabras, a veces sílabas— cada uno clavado en una coordenada de la hoja. Esta herramienta lee esos fragmentos y los recompone: agrupa en un mismo renglón los que comparten altura (con tolerancia, para que un superíndice o una tilde no partan la línea), los ordena de izquierda a derecha y decide dónde va un espacio midiendo el hueco entre uno y otro. El resultado es el texto en su orden de lectura, en la enorme mayoría de los documentos.

Lo que se pierde es el formato, y es deliberado: la salida es texto plano, sin negritas, tamaños ni colores, porque para eso la quieres — pegarla, buscarla, rearmarla en Word a tu manera. Y hay un límite que conviene conocer: en documentos a dos columnas o con tablas densas, la recomposición por coordenadas puede cruzar un renglón con el de la celda vecina. No es frecuente, pero pasa; revisa esas zonas en vez de confiarles una cifra.

Si necesitas lo contrario —conservar el aspecto del documento y cambiar algo puntual dentro de él—, la herramienta correcta es el editor de PDF, que corrige el texto en su sitio y con su letra.

«Mi PDF no suelta el texto»: casi seguro es un escaneo

La mitad de los PDF que la gente intenta convertir a texto no tienen texto. Son escaneos: la fotocopiadora, el escáner del juzgado o la aplicación del celular fotografiaron un papel y metieron esa foto en un PDF. Para el computador, esa página es una imagen; no hay una sola letra que extraer, y cualquier herramienta que prometa lo contrario está haciendo otra cosa por debajo (OCR) o mintiendo.

Esta página lo comprueba al abrir el archivo: si el documento no trae texto por dentro, te lo dice con esas palabras en vez de entregarte un resultado vacío. Y te deja a un clic de la salida real: el OCR de PDF escaneado en español, que lee la imagen letra por letra, también sin subir el archivo a ningún servidor. La diferencia práctica: extraer texto vivo tarda segundos y es exacto; el OCR tarda minutos y hay que revisarle las cifras. Por eso son dos herramientas y esta prueba primero el camino barato.

Un caso intermedio: los «PDF con búsqueda», escaneos a los que alguien ya les pasó un OCR y les dejó el texto reconocido en una capa invisible debajo de la foto. Esos sí sueltan texto aquí — con los errores que aquel OCR haya cometido, así que la advertencia de revisar cifras y nombres aplica igual.

¿Dónde queda mi documento?

En tu equipo, que es donde estaba. Los convertidores de PDF a texto más conocidos funcionan subiendo el archivo a un servidor, procesándolo allá y devolviéndote el resultado; te prometen borrarlo después. Los documentos que la gente convierte —contratos con cédulas, sentencias con nombres, historias clínicas— no son el tipo de archivo que uno quiere dejar en el servidor de un desconocido con una promesa.

Aquí no hay subida que prometer borrar. El PDF se abre y se lee dentro de la pestaña, con el mismo motor de lectura que usan los navegadores modernos. La comprobación está a tu alcance: herramientas de desarrollador (F12), pestaña Red, procesa un documento y mira. En esta página está explicado paso a paso.

Preguntas frecuentes

¿Cómo extraigo el texto de un PDF sin instalar nada?

Abriéndolo en esta página. El navegador lee el archivo, saca el texto que trae por dentro y te lo muestra completo, listo para copiar o para bajar como .txt. No hay que instalar programas, no hay registro y el PDF no se sube a ningún servidor: todo pasa en tu propio equipo.

¿Por qué mi PDF sale vacío o dice que es un escaneo?

Porque ese PDF no contiene letras: contiene la fotografía de unas letras. Es lo que producen la fotocopiadora, el escáner y la aplicación de escanear del celular. De una foto no hay texto que extraer directamente; hace falta reconocimiento óptico (OCR), que lee la imagen y deduce las letras. Esta herramienta lo detecta y te lleva a nuestro OCR de PDF en español, que también trabaja sin subir el archivo.

¿El texto sale en orden en documentos con columnas o tablas?

Casi siempre, pero no está garantizado. Un PDF no guarda párrafos: guarda fragmentos de texto con coordenadas, y esta herramienta los recompone en renglones agrupándolos por su posición. En un documento corriente —un contrato, una sentencia, una carta— el resultado sigue el orden de lectura. En documentos a dos columnas o con tablas complejas, algún renglón puede quedar cruzado con el de la columna vecina: revisa esas zonas antes de usarlas.

¿Se conserva la negrita, el tamaño de letra o el formato?

No. La salida es texto plano a propósito: sin tipografías, sin tamaños, sin colores. Es lo que necesitas para pegar una cláusula en un correo, buscar dentro del texto o llevarlo a Word y darle tu propio formato. Si lo que quieres es corregir el PDF conservando su aspecto, esa es otra herramienta: el editor de PDF.

¿Puedo copiar solo una parte, por ejemplo una cláusula?

Sí. El texto completo queda en un área de lectura normal: selecciona con el dedo o el ratón el fragmento que te interesa y cópialo como copiarías cualquier texto. «Copiar todo» existe para el caso contrario, cuando quieres el documento entero de una vez.

¿Suben mi PDF a algún servidor?

No. El archivo se abre y se lee dentro de la pestaña del navegador, en tu equipo. Puedes comprobarlo: abre las herramientas de desarrollador (F12), entra a la pestaña Red y procesa un documento; ninguna petición lleva tu archivo. Por eso sirve para un contrato con tu cédula, una historia clínica o un expediente.

¿Cuántas páginas y de qué tamaño aguanta?

Hasta 100 MB de archivo. Como no hay OCR de por medio, un documento de cientos de páginas se procesa en segundos en un computador y en algo más en un teléfono: el trabajo es leer, no reconocer. Cada página sale separada con su número, así que encontrar el folio 47 en el resultado es buscar «Página 47».

¿Sirve para un PDF protegido con contraseña?

Si el PDF pide contraseña para abrirse, esta herramienta no puede leerlo mientras esté cifrado. Ábrelo primero con su clave en la herramienta de quitar contraseña —también funciona sin subir el archivo— y pasa por aquí el resultado.

¿Copiaste la cláusula y sigue sin cuadrarte?

Sacar el texto es un segundo. Saber si esa cláusula te obliga, si el plazo ya venció o si lo que firmaste se puede pelear, no. Cuenta tu caso gratis —puedes pegar el texto que acabas de copiar— y recibe propuestas de abogados verificados, con precio y tiempos, sin comisiones.

Contar mi caso gratis

Otras herramientas gratuitas

Ver todas
PDF a texto: extrae y copia el texto gratis | KippiLex