Saltar al contenido
freeonlinemarkdowneditor
Español

Blog

Qué descarta un limpiador de Markdown, y cómo conservarlo

markdowntexto planodecisiones de diseño

«Quitar el Markdown» suena como una única operación. En realidad es una serie de pequeñas decisiones, y un conversor las toma todas por ti, lo reconozca o no.

Esto es lo que normalmente se decide mal.

La numeración de las listas

La más importante. Las bibliotecas habituales tratan una lista como una construcción de formato y la aplanan, lo que elimina 1. 2. 3. junto con los caracteres de viñeta.

Para una lista con viñetas eso es discutiblemente aceptable. Para una numerada destruye el significado: los números se referían a algo. Respuestas a un cuestionario numerado, pasos de una secuencia, elementos ordenados por prioridad: todo se convierte en un montón sin orden.

Aquí la numeración se conserva, incluidas las listas que empiezan en 7 y las listas numeradas anidadas dentro de otra.

La URL detrás de un enlace

[la documentación](https://example.com/guia) contiene dos informaciones. El texto plano no tiene dónde poner la segunda, así que un conversor debe o escribirla o descartarla.

Descartarla es silencioso y frecuente. El lector recibe «la documentación» y ninguna forma de llegar hasta ella. Aquí el valor por defecto escribe las dos — la documentación (https://example.com/guia) — porque un lector que no puede seguir el enlace ha perdido algo. Solo texto y solo URL están disponibles cuando sabes que el enlace no importa.

El lenguaje de un bloque de código

Un bloque marcado ```java lleva un dato: esto es Java. Quita la marca y ese dato se va con ella, dejando un bloque de símbolos sin explicar que podría ser cualquier cosa.

El lenguaje se emite como una etiqueta — [java] — para que el lector lo sepa. Desactivado, o conservado como la marca original, si lo prefieres.

El texto alternativo de una imagen

Una imagen no puede sobrevivir como imagen. Pero su texto alternativo es una frase que alguien escribió para describirla, y a menudo es la única descripción de ese contenido en el documento. Descartar la imagen y conservar la descripción suele ser mejor que descartar las dos cosas.

Notas al pie, citas, separadores, frontmatter

Cada uno es contenido que un limpiador puede eliminar sin decir nada. Aquí cada uno se conserva por defecto y se puede desactivar por separado.

Por qué no perder nada es el valor por defecto correcto

La prueba que resuelve la mayoría de estos casos: ¿podría un lector que nunca vio la entrada entender todo lo que decía, solo con la salida?

Si la respuesta es no, el conversor ha tirado información en nombre del lector sin preguntar. Un conversor que deja algo que tienes que borrar tú es molesto durante diez segundos. Uno que borra algo que necesitabas es un problema que quizá no notes hasta que importe.

Así que los valores por defecto conservan todo, y cada eliminación es un interruptor que eliges. Un perfil — Informe y tablas — rompe esa regla a propósito y quita los bloques de código y las imágenes, porque existe para llevar una tabla comparativa a un informe donde un fragmento suelto es ruido. Es la excepción, lo dice, y el perfil Por defecto no quita nada en absoluto.

Las cosas que genuinamente no tienen respuesta

Algunas decisiones no tienen un valor por defecto correcto, solo un contexto:

  • ¿Cómo se ve un título sin forma alguna de ser un título? Plano, en mayúsculas o con la # conservada.
  • ¿Cómo se ve una tabla sin tabla? Columnas alineadas, tabuladores o etiqueta y valor.
  • ¿Cómo se ve una lista de tareas? [ ], o nada.

Por eso existen los perfiles. En lugar de elegir uno y llamarlo universal, cada perfil responde a todas esas preguntas para un destino concreto — un cliente de correo, una hoja de cálculo, una ventana de chat, una página de documentación, un formulario web — y te muestra un ejemplo para que veas las respuestas antes de fiarte de ellas.

Probar el conversor →