PDF a Markdown — saca el texto de un PDF

Extrae el texto de un PDF y recibe Markdown limpio — encabezados, listas y tablas conservados — listo para notas o para dárselo a una IA. Las páginas escaneadas se pueden leer con OCR en la misma pasada. Todo se ejecuta en tu dispositivo.

  1. Your PDF

    Arrastra un PDF aquí — o haz clic para elegir

    PDF

    Tus archivos nunca se suben — todo se ejecuta en tu dispositivo.

  2. Markdown

Cómo funciona

  1. Añade tu PDF

    Arrastra y suelta un PDF, o haz clic para elegir uno. Se carga directamente en tu navegador — nada se sube.

  2. Extrae el texto

    Haz clic en Convertir a Markdown. El texto, los encabezados, las listas y las tablas se extraen en tu dispositivo en un momento. Si el PDF resulta estar escaneado, aparece un botón para leer esas páginas con OCR.

  3. Copia o descarga

    Copia el Markdown al portapapeles o descárgalo como un archivo .md — listo para notas, documentos o para alimentar a una IA.

Qué obtienes

Extrae tablas de un PDF

Los encabezados, las listas con viñetas y numeradas, y las tablas salen como Markdown real — las tablas con barras verticales y el orden de lectura conservado — no un muro de texto plano.

Listo para IA y notas

Un Markdown limpio es exactamente lo que buscan herramientas como ChatGPT y aplicaciones de notas — pégalo directamente o descarga un archivo .md.

Privado y gratis

Sin cuentas, sin límites de páginas, sin marcas de agua. Tu PDF nunca se sube — toda la conversión se ejecuta en tu navegador.

Sobre qué funciona

Construido sobre pdf.js, el motor PDF de Mozilla, que lee la capa de texto que el propio PDF ya contiene: sin modelo y sin adivinar. Las páginas escaneadas no tienen capa de texto, así que esas pasan por OCR con Tesseract.

Preguntas frecuentes

¿Se sube mi PDF a algún sitio?
No. La conversión se ejecuta completamente en tu navegador en tu propio dispositivo. Tu PDF nunca se sube y no se guarda nada una vez que cierras la pestaña.
¿Maneja tablas y encabezados?
Sí. Los encabezados se convierten en encabezados de Markdown, las tablas en tablas de Markdown con barras verticales y las listas numeradas se conservan. Mantiene el orden de lectura del documento.
¿Qué pasa con los PDF escaneados?
Los PDF digitales (de texto) se convierten mejor. Se detectan los PDF escaneados o solo de imágenes, y obtienes el texto que ya contengan — la lectura de las imágenes con OCR estará disponible pronto.
¿Cómo convierto un PDF en texto plano?
De la misma forma — el Markdown es texto plano. Convierte y luego usa Copiar Markdown o descarga el archivo .md y ábrelo en cualquier editor de texto. Los marcadores son simples caracteres como # y -, así que bórralos si lo quieres completamente pelado.
¿Puedo extraer tablas de un PDF?
Sí. Las tablas salen como tablas de Markdown con barras verticales, que se pegan sin problemas en cualquier cosa que lea Markdown. Un límite que conviene conocer: la salida es solo Markdown — no hay exportación a CSV ni a hoja de cálculo, así que una tabla que quieras en columnas tendrás que convertirla por tu cuenta.
¿Es realmente gratis? ¿Hay límites?
Sí — completamente gratis, sin cuenta y sin límite de páginas. Como todo se ejecuta en tu dispositivo, no hay nada que tengamos que medir o limitar.
¿Usa un modelo de IA?
Con los PDF normales no: pdf.js lee el texto incrustado directamente, por eso es rápido y exacto. Solo las páginas escaneadas necesitan el motor OCR Tesseract, y son precisamente esas donde pueden colarse errores.