PDF a Markdown — gratis, en tu navegador, sin subir nada | nopa

Texto y datos

PDF a Markdown

Suelta un PDF y obtén Markdown con títulos, párrafos y listas, no una línea por cada línea impresa. Convierte varios de una vez y llévatelos en un ZIP. El archivo no sale de este navegador.

Pruébalo ahora — sin cuenta

Guardar y continuar en el escritorio

Descarga o copia tu resultado aquí primero. Continúa en el escritorio para guardar en Archivos o usar más funciones.

  • Notas simples con negrita y listas — guardadas localmente
  • Guarda en Archivos cuando continúes en el escritorio
  • Todas las herramientas en un lugar, sin pestañas nuevas
Abrir el escritorio gratis

Después de descargar — continúa en el escritorio para Archivos o la app completa.

Qué puede hacer PDF a Markdown

Párrafos, no líneas impresas

Un PDF no tiene párrafos. Tiene glifos en coordenadas, y todo lo que un lector percibe como estructura se deduce de dónde están y de qué tamaño son. Copia desde un lector de PDF y obtendrás exactamente eso: un salto de línea duro donde la página quiso cortar, un guion en mitad de cada palabra partida en el margen y un número de página en medio de una frase. Ese resultado es inservible en un documento y peor aún en un prompt. Aquí las líneas se recomponen en los párrafos de los que salieron, las palabras partidas se vuelven a unir y los encabezados y pies repetidos —el mismo título cuarenta veces— se descartan.

Los títulos salen del cuerpo de letra

Nada en un PDF dice «esto es un título». Lo que dice es que una línea está compuesta a 18 puntos entre texto de 10, así que esa línea se convierte en H1, las de 13 en H3, y una línea larga en cuerpo algo mayor sigue siendo un párrafo: esa es la salvaguarda que impide que una introducción entera acabe como titular. Es una inferencia, y acierta mucho más de lo que falla, pero conviene saber que es una inferencia y no una estructura que el archivo llevara dentro.

Lo que no va a fingir que hace

Texto y títulos, no maquetación: los artículos a dos columnas se leen como texto, y figuras, gráficos y cuadros de texto no se reconstruyen. Si el PDF es un escaneo, sus páginas son imágenes de letras y no hay texto que tomar: esto lo dice en vez de entregarte un archivo vacío. Leerlo exigiría OCR, que son 40 MB de modelo y otra promesa distinta.

Apps relacionadas

Preguntas

¿Se sube mi PDF a algún sitio?

No. Se analiza en tu navegador, en este dispositivo. El archivo nunca se envía a un servidor y nosotros no lo vemos.

¿Puedo convertir varios archivos a la vez?

Sí. Añade los que quieras: cada uno será su propio `.md`, y un botón se los lleva todos en un ZIP.

¿Por qué mi PDF escaneado no produce nada?

Porque no tiene capa de texto: las páginas son imágenes, así que no hay caracteres que leer. La herramienta te lo dice en lugar de devolver un archivo vacío. Sacar texto de un escaneo requiere OCR, y aquí no lo hacemos.

¿Se convierten las tablas?

Desde PDF no. Una tabla en un PDF son líneas y texto en coordenadas, sin nada que la marque como tabla, así que sus celdas llegan como texto. Las tablas de archivos `.docx` sí se convierten, como tablas reales de Markdown.

¿Funciona sin conexión?

Sí, una vez que la página se ha abierto alguna vez. La conversión es código ejecutándose en tu navegador, así que no hay nada que ir a buscar.