llms.txt es un único archivo Markdown, situado en la raíz de su sitio web, que describe en un lenguaje sencillo que un modelo puede analizar qué es su organización y dónde están sus páginas importantes. Es una convención propuesta y no un estándar aprobado, se escribe en cerca de una hora y a menudo se le atribuye más de lo que puede dar. Esta es la versión exacta.
Qué es llms.txt
Un archivo, en https://sudominio.com/llms.txt, escrito en Markdown. La forma habitual es un título, un párrafo que resume lo que hace su empresa y, después, secciones de enlaces a las páginas que importan, cada una con una breve descripción de su contenido.
El nuestro empieza con un párrafo que dice qué es Gigabit, el modelo con el que trabajamos, dónde están nuestras oficinas y desde cuándo ponemos sistemas en producción. Sigue un bloque Key facts con todos los precios escritos tal cual, y después secciones de enlaces a precios, servicios, sectores y casos de éxito. Puede leerlo (en inglés): tiene más de cien líneas.
La intención es ofrecer un resumen que se pueda leer sin navegador: sin menús que recorrer, sin JavaScript que ejecutar, sin texto de marketing que atravesar. Solo qué hace su empresa, cuánto cuesta y dónde está el contenido de fondo.
Qué no es llms.txt
Tres aclaraciones, porque sobre este archivo se promete demasiado:
No es robots.txt. El archivo robots.txt concede o deniega el acceso. El archivo llms.txt ofrece un resumen. Resuelven problemas distintos y ninguno sustituye al otro. Si su robots.txt bloquea a los rastreadores de IA, un llms.txt no cambia nada en absoluto.
No es un factor de posicionamiento. Ningún asistente importante se ha comprometido públicamente a leerlo como dato de entrada para sus recomendaciones. Quien le diga que subirá su tasa de citación describe una esperanza, no un comportamiento documentado.
No sustituye a las páginas. Lo que afirma debe ser cierto y verificable en su sitio real. Un resumen que afirma cosas que sus páginas no respaldan es peor que no tener resumen: justo en el paso de verificación es donde una entidad incoherente queda fuera de una respuesta sin que nadie lo note.
Entonces, ¿llms.txt sirve de algo?
La respuesta honesta: por sí solo, todavía no mucho, y aun así vale la pena hacerlo.
El argumento a favor es el costo, no la evidencia. Es una hora de trabajo y un archivo estático. La convención se está adoptando a buen ritmo entre las empresas de herramientas para desarrolladores y los sitios de documentación, varios frameworks de agentes lo descargan cuando se les indica un dominio, y un resumen legible por máquinas le resulta útil, sin más esfuerzo, a cualquier cosa que inspeccione su sitio de forma programática, incluidas herramientas de las que usted todavía no ha oído hablar.
El argumento en contra de invertir de más es que lo que mueve la tasa de citación de forma demostrada está en otra parte: contenido presente en el HTML sin procesar, páginas que responden a preguntas de compra reales, datos citables y datos de entidad coherentes en toda la web. Esos son mecanismos documentados. llms.txt es una apuesta barata por una convención que puede llegar a ser importante. Trátelo como el último punto de la lista, no el primero: las cinco cosas que de verdad importan (en inglés) van antes.
Cómo escribir un buen llms.txt
- Empiece por decir qué es su empresa, en un párrafo. Un desconocido sin ningún contexto debe terminarlo sabiendo qué vende usted y a quién.
- Ponga los datos, literalmente. Precios, fechas, ubicaciones, cifras. Es la sección de más valor, porque lo concreto es lo que un modelo puede citar y verificar. Si publica sus precios, indíquelos aquí en cifras.
- Enlace las páginas que importan, con una descripción para cada una. No todo su mapa del sitio: las diez o quince páginas que contienen lo esencial.
- Diga qué no es su empresa. El nuestro indica que no dependemos de ninguna herramienta concreta y que no estamos afiliados al área de despliegue de ningún proveedor de modelos. Las afirmaciones negativas eliminan ambigüedades, y de eso se trata.
- Manténgalo al día. Un archivo desactualizado que afirma los precios del año pasado juega directamente en su contra en el paso de verificación.
Sea breve. Es un resumen para una máquina, no un folleto. El nuestro tiene más de cien líneas, y más o menos esa es la medida adecuada.
Los archivos vecinos: robots.txt y ai.txt
Hay otros dos que conviene conocer, porque a menudo se confunden con llms.txt. robots.txt controla el acceso de los rastreadores. Compruebe que los agentes de IA que se identifican por su nombre estén permitidos, porque una regla Disallow general heredada anula todo lo demás sin avisar. ai.txt es otra convención propuesta, que declara su política de uso y de citación. El nuestro dice que se anima a citar, indica la atribución que nos gustaría y remite al llms.txt.
Ninguno de los tres es una estrategia de crecimiento. Juntos llevan una tarde y eliminan toda una categoría de bloqueos tontos e invisibles. Es una definición razonable de lo mínimo exigible.
Qué hacer si solo tiene una tarde
Escriba el archivo y dedique el resto del día a algo respaldado por evidencia: compruebe que sus páginas clave muestran su contenido en el HTML sin procesar, confirme que los rastreadores de IA no están bloqueados y asegúrese de que el nombre y la descripción de su empresa coinciden en su sitio web, su marcado schema y LinkedIn.
Después, mida. La auditoría de citación gratuita (en inglés) le dice dónde está realmente su empresa en los principales asistentes, y eso orienta mucho mejor qué corregir a continuación que cualquier lista de comprobación, incluida esta. La guía completa de GEO cubre los mecanismos que hacen la mayor parte del trabajo.



