Saltar al contenido principal

Convertidor de PDF a Markdown

Para convertir un PDF a Markdown, sube el PDF y elige Markdown (MD). Nuestro servidor extrae el texto, convierte los tamaños de fuente mayores en títulos #, ## y ###, reconoce las listas con viñetas y numeradas, y devuelve un archivo .md con sintaxis de GitHub. Las tablas del PDF no se reconstruyen como tablas de Markdown; su texto llega como párrafos. Los PDF escaneados no son compatibles porque no hay OCR.

  • Gratis, sin registro
  • Archivos eliminados en 30 minutos
  • Hasta 100 MB

Los archivos se eliminan definitivamente de nuestros servidores en 30 minutos.

Cómo convertir PDF a Markdown

  1. Sube tu archivo PDF

    Arrastra tu archivo PDF al área de carga o búscalo en tu equipo (hasta 100 MB).

  2. Deja Markdown como destino

    Markdown ya está seleccionado en el menú; puedes elegir otro formato si lo necesitas.

  3. Convierte y descarga

    Pulsa «Convertir» y la descarga del archivo convertido empieza automáticamente.

¿Qué se conserva?

Se conserva

  • El texto principal y los párrafos
  • Los títulos detectados por el tamaño de fuente (#, ##, ###)
  • Las listas con viñetas y numeradas

Cambia

  • Las líneas que empiezan por #, -, > o 1. se escapan para que se mantengan como texto literal

No se transfiere

  • La estructura de las tablas: las celdas pasan a ser párrafos
  • Las fuentes, los colores y el diseño de página
  • Las imágenes de fondo de página completa

Cuándo usarlo

Preparar documentos para LLM y flujos RAG

Antes de dar PDF a ChatGPT, Claude o a un sistema de generación aumentada por recuperación (RAG), convertirlos a Markdown elimina el ruido de la maquetación y conserva la jerarquía de títulos, lo que facilita mucho dividir el texto en fragmentos y citar secciones.

Llevar manuales a documentación como código y apps de notas

Al migrar manuales en PDF a GitHub, a una wiki de GitLab, a Obsidian o a Notion, puedes partir de un archivo .md cuyos títulos y listas ya están marcados, en lugar de dar formato a todo a mano.

Limitaciones que debes conocer

  • Sin OCR para PDF escaneados.
  • La detección de títulos depende del tamaño de fuente; los títulos en negrita con el tamaño del texto principal pueden quedarse como párrafos.
  • Los PDF cifrados se rechazan.

Sobre los formatos

¿Qué es PDF?

PDF (Portable Document Format) es un formato de documento de diseño fijo creado por Adobe y normalizado como ISO 32000. Cada texto, imagen y línea se guarda con su posición en la página, de modo que un PDF se ve igual en todos los dispositivos y se imprime de forma fiable. La contrapartida es la edición: un PDF guarda posiciones en una página, no párrafos ni tablas. Los PDF escaneados solo contienen imágenes de las páginas y necesitan OCR (reconocimiento óptico de caracteres) antes de poder extraer texto.

¿Qué es Markdown (MD)?

Markdown es un lenguaje de marcado ligero diseñado por John Gruber en 2004. El formato se escribe con símbolos sencillos dentro de texto plano: # para títulos, ** para negrita, - para elementos de lista y | para tablas. Los archivos Markdown (.md) están por todas partes: en los README de GitHub, la documentación técnica, las aplicaciones de notas y las respuestas de los asistentes de IA. La variante más extendida es GitHub Flavored Markdown (GFM), que añade tablas, listas de tareas y tachado.

Preguntas frecuentes

¿Cómo se detectan los títulos en el PDF?

El conversor compara el tamaño de fuente de cada bloque de texto con el del texto principal. Los bloques claramente mayores se convierten en títulos #, ## o ### según cuánto mayores sean. Los títulos en negrita con el tamaño del texto principal pueden quedarse como párrafos normales, algo que puedes corregir en el archivo .md.

¿Las tablas de un PDF se convierten en tablas de Markdown?

No. Un PDF solo guarda texto posicionado, no filas ni celdas, así que el conversor escribe el contenido de las tablas como párrafos. Si necesitas tablas reales en Markdown y tienes también el documento en Word o DOC, convierte ese archivo a Markdown, porque las tablas de los archivos de Word se conservan.

¿El resultado es adecuado para ChatGPT y otros LLM?

Sí, es un uso habitual. Markdown es compacto y fácil de interpretar para los modelos de lenguaje: los títulos marcan las secciones y los marcadores de lista marcan los elementos. Sube el archivo .md o pega su contenido. Eso sí, recuerda que los PDF escaneados no producen texto, ya que no se aplica OCR.

¿Es gratis convertir PDF a Markdown?

Sí, es totalmente gratis. No hay cuenta, suscripción ni marca de agua: solo sube tu archivo y conviértelo.

¿Mi archivo está seguro y cuándo se elimina?

Tu archivo se transfiere por HTTPS y se guarda en nuestro servidor con un código aleatorio. El archivo subido y el resultado se eliminan definitivamente en 30 minutos, y el enlace de descarga solo funciona para quien tenga tu código único.