Herramienta

Generador de llms.txt: monta el archivo y comprueba si se sostiene

Completa el nombre del sitio, el resumen y la lista de enlaces: la herramienta monta el llms.txt en el formato de la especificación, audita el resultado en 10 ítems que suman 100 puntos y muestra la fila de lo que falta. Puedes pegar el sitemap.xml entero y dejar que arme el borrador. Gratis, sin registro, y nada sale de tu navegador.

Generador de llms.txt
Nota del archivo-

  • - enlaces
  • - secciones
  • - tamaño
  • - tokens estimados

Tu llms.txt

Qué cumple el archivo (y qué falta)

  • H1 con el nombre del sitio-
  • Resumen en blockquote-
  • Al menos una sección H2-
  • Todas las URLs absolutas-
  • Descripción en cada enlace-
  • Sin URL repetida-
  • Cobertura mínima de enlaces-
  • Sección Optional declarada-
  • Párrafo de contexto-
  • Cabe en una sola lectura-

Todo corre en tu navegador: ni los campos ni el archivo salen de aquí, y no se visita ninguna URL. La nota mide conformidad con el formato y calidad de la curaduría, que es lo que está bajo tu control. No promete citación: ningún sistema publica el criterio real de elección de fuente.

Esta página monta y audita el archivo. Si lo que quieres saber es si tu sitio en conjunto está listo para ser citado por IA, incluyendo acceso del rastreador, formato del texto y señal de autoría, la página correcta es el checklist de preparación GEO, que corre otro modelo de 16 ítems y trata el llms.txt como un ítem de 4 puntos entre muchos. Las dos se complementan: el checklist dice si vale la pena, esta te entrega el archivo.

Cómo usarla

  1. Completa primero nombre y resumen. El nombre será el H1 y el resumen será la línea de cita de bloque justo debajo. Esos dos campos valen 30 de los 100 puntos porque son la parte que el formato exige y lo primero que procesa cualquier lector.
  2. Pon el dominio base sin barra final. Existe para que escribas solo la ruta, tipo /precios, y la herramienta la resuelva a la URL completa. Un archivo leído fuera de tu sitio con enlace relativo no resuelve en ningún lado.
  3. Escribe la lista de enlaces en la caja grande, uno por línea, en formato Título | URL | descripción. Abre una sección nueva con ## Nombre de la sección. La caja también entiende markdown, la URL suelta y un sitemap.xml pegado entero, así que puedes partir de lo que ya tienes.
  4. Mira la lista de verificación debajo del archivo y resuelve lo que está en rojo, de arriba hacia abajo. Cada ítem muestra cuánto vale y cuánto te llevaste.
  5. Copia o descarga y publica en tusitio.com/llms.txt, servido como texto plano. Después abre la dirección en una ventana privada para confirmar que aparece el markdown crudo y no una descarga.

Cómo funciona: el formato y los 10 pesos

El llms.txt es markdown con estructura fija, y el orden de los bloques es parte del formato. Que sea pobre es a propósito: cuanta menos libertad, más fácil le resulta a un parser simple leerlo sin heurística.

# Nombre del sitio
> Resumen de una frase
Párrafos libres de contexto
## Nombre de la sección
- [Título](https://url): descripción
## Optional
- [Título](https://url): descripción

Solo el H1 es obligatorio en la especificación. Todo lo demás es opcional en el papel y decisivo en la práctica, y ahí entra la nota. La auditoría suma 10 ítems que cierran en exactamente 100 puntos, repartidos entre conformidad (¿esto es de verdad un llms.txt?) y curaduría (¿le resuelve algo a quien lo lee?).

nota = conformidad (44) + curaduría (56)
conformidad = H1 15 + resumen 15 + sección H2 14
curaduría = URL absoluta 12 + descripción por enlace 12 + sin repetidas 8 + cobertura 8 + Optional 6 + contexto 5 + cabe en una lectura 5
descripción por enlace: 12 × enlaces con descripción ÷ total de enlaces
cobertura: 8 × limitado(0 a 1 de enlaces ÷ 6)
tokens estimados = caracteres ÷ 4, y el ítem cae por encima de 20.000

H1 y resumen valen 15 cada uno porque son lo que un lector busca antes que nada: sin ellos el archivo es una lista de enlaces huérfana. La URL absoluta vale 12 porque un enlace relativo simplemente no resuelve cuando el archivo se lee fuera del sitio, y es el error más común de quien lo genera a mano. La descripción por enlace vale 12 y es proporcional, no todo o nada, porque la mitad de las descripciones escritas ya vale mucho más que ninguna.

Ejemplo trabajado (reproduce el resultado por defecto)

Los valores que vienen cargados describen un SaaS pequeño con 3 secciones y 7 enlaces, de los cuales 6 tienen descripción: el enlace de integraciones quedó a propósito sin la frase explicativa, para que la fila de corrección no nazca vacía. Nombre, resumen y párrafo de contexto completos, dominio base informado, ninguna URL repetida y la sección secundaria nombrada Optional en inglés.

Escribe la descripción del enlace de integraciones y la nota sube a 100. Es el mismo razonamiento que repites con tus enlaces: cada línea sin frase cuesta 12 dividido por el número de enlaces, y el precio por línea sube a medida que el archivo se achica.

Cómo interpretarla y dónde la nota engaña

La nota mide el archivo, no el resultado. Un llms.txt de 100 en un sitio que los rastreadores de IA no logran leer sigue sin generar ninguna citación, porque el problema estaba dos capas antes. Corre el checklist de preparación GEO antes de celebrar: si tu robots.txt bloquea GPTBot o el contenido solo existe después del JavaScript, el archivo es decoración.

La segunda trampa es tratar el llms.txt como factor de posicionamiento. No lo es, y nadie prometió que lo fuera. La adopción hoy es asimétrica: muchos sitios publican, pocos sistemas consumen de forma automática. La razón racional para publicarlo es el costo bajo sumado a dos ventajas que no dependen de que ningún buscador cambie de idea: quien usa asistentes de IA a diario puede señalar la URL a mano y recibir tu contexto ya armado, y la curaduría en sí obliga a una decisión interna que casi nadie tomó, que es cuál es la lista de las diez páginas que representan el negocio.

La tercera es generar el archivo desde el sitemap y detenerse ahí. La herramienta acepta el sitemap pegado porque es un buen punto de partida, no un buen punto de llegada: sin secciones y sin descripción, la nota queda en la franja media y el archivo repite lo que el sitemap ya decía. El trabajo de valor es el recorte, no la recolección.

Por último, el archivo envejece. No tiene lastmod, nadie lo revalida, y un enlace roto adentro pasa desapercibido durante meses. Pon la revisión al ritmo de la revisión del menú del sitio, no al ritmo del blog.

Del archivo a la evidencia

Publicar el llms.txt es una apuesta sobre cómo terceros tratan tu sitio, y una apuesta sin medición se vuelve folclore de equipo. El camino honesto es corto:

Para convertir el primer ítem de la fila en hipótesis testeable, usa el generador de hipótesis. Para dimensionar el experimento antes de encender nada, la calculadora de tamaño de muestra lo resuelve en un minuto.

Preguntas frecuentes

¿Qué es el archivo llms.txt?
Es un archivo de texto en markdown publicado en la raíz del dominio, en /llms.txt, que señala el contenido canónico del sitio a los sistemas de IA. La idea detrás es simple: en lugar de dejar que un modelo adivine qué importa dentro de un HTML lleno de menú, banner y pie de página, entregas una lista curada de enlaces con una frase que explica cada uno. El formato fue propuesto en septiembre de 2024 por Jeremy Howard, de Answer.AI, y es deliberadamente pobre: un H1 con el nombre del sitio, un resumen de una frase como cita de bloque, párrafos libres de contexto y secciones con listas de enlaces anotados. Nada más.
¿Dónde publico el llms.txt?
En la raíz del dominio, servido como texto plano en https://tusitio.com/llms.txt, igual que el robots.txt. No en una subcarpeta, no detrás del panel, no dentro de una página HTML. Si tu sitio es estático, el archivo va en la carpeta pública junto al robots.txt y al sitemap. En WordPress o lo subes a la raíz por FTP o usas un plugin que sirva esa ruta. Después de publicarlo, abre la dirección en una ventana privada: si ves el markdown crudo, está bien; si el navegador descarga un archivo o muestra un error, el tipo de contenido del servidor está mal.
¿Alguna IA lee de verdad el llms.txt hoy?
La respuesta honesta es que la adopción es fuerte en la publicación y débil en la lectura. Cientos de sitios de documentación técnica ya publican el archivo, y varias herramientas de desarrollo lo consumen cuando les indicas la URL a mano. Ningún buscador grande ha confirmado usarlo para elegir fuentes, y portavoces de Google han dicho públicamente que no lo utilizan. Publicarlo sigue valiendo la pena por el costo, que es media hora de trabajo, y por un efecto lateral útil: hacer la curaduría te obliga a decidir cuáles son las diez páginas que representan el sitio, y esa lista sirve para mucho más que un archivo.
¿El llms.txt reemplaza al robots.txt o al sitemap?
No, y confundir los tres es el error más común. El robots.txt dice quién puede entrar, es una regla de acceso y es el único de los tres que bloquea algo. El sitemap lista todo lo que existe para que el rastreador no deje nada fuera. El llms.txt hace lo contrario del sitemap: elige lo que importa y explica por qué. Un sitio bien resuelto publica los tres y no se pisan. Si tu llms.txt tiene 400 enlaces, escribiste un sitemap con otro nombre y perdiste la única ventaja que tenía.
¿Cuántos enlaces debe tener el llms.txt?
Entre 6 y 40 en la mayoría de los sitios, con raras excepciones de documentación grande. El criterio no es la cantidad, es la sustitución: cada enlace debe responder una pregunta que alguien haría sobre tu negocio, y la descripción debe dejar claro cuál es esa pregunta. Si no puedes escribir la frase que justifica el enlace, no debería estar ahí. La herramienta satura el ítem de cobertura en 6 enlaces y avisa por encima de 150, que es el punto en el que el archivo se volvió un volcado de sitemap.
¿Por qué la sección opcional debe llamarse Optional en inglés?
Porque Optional es el único nombre de sección con significado reservado en el formato: marca el bloque que un lector puede saltarse cuando necesita un contexto más pequeño. Traducirlo no rompe nada, pero convierte la sección especial en una sección común y se pierde la señal de prioridad. Los demás títulos de sección son libres y deben ir en el idioma de tu contenido. Esta herramienta avisa cuando encuentra la versión traducida.
¿Necesito publicar también un llms-full.txt?
Solo si tu documentación es grande y quieres ofrecer el contenido entero en un único archivo. El llms-full.txt es una convención paralela: no lista enlaces, concatena el texto completo de las páginas. Tiene sentido para documentación de producto técnico, donde alguien va a pegar todo en un prompt. Para un sitio de marca, de servicio o de ecommerce el archivo crece demasiado, queda desactualizado al día siguiente y nadie lo lee. Empieza por el llms.txt y haz el segundo solo si alguien lo pide.
Incrustar esta herramienta en tu sitio

Pega este código donde quieras mostrar el generador. El enlace de crédito debajo del cuadro nos ayuda y es libre de mantener.

Sigue

Con el archivo publicado, el siguiente paso es la capa que no resuelve: acceso del rastreador, texto recortable y señal de autoría. Lee el método completo en GEO en 2026, mira la estructura de FAQ que más citaciones rinde en estructurar FAQ para citación por IA y qué cambia en el trabajo de conversión en CRO en la era de la IA.

Herramientas relacionadas

Ver todas las herramientas →