¿Qué es llms.txt? La especificación, quién lo lee y si lo necesitas
llms.txt es un archivo Markdown propuesto en la raíz de tu dominio que da a los modelos de IA un mapa curado de tu contenido clave. Esta es la especificación exacta, quién lo lee de verdad, por qué Google dice que no lo usa y una opinión honesta sobre si vale la pena.
llms.txt es un estándar web propuesto: un archivo de texto plano en Markdown situado en la raíz de tu dominio (tusitio.com/llms.txt) que da a los grandes modelos de lenguaje un mapa curado y legible por humanos de tu contenido más importante. Lo propuso en septiembre de 2024 Jeremy Howard, de Answer.AI, y su objetivo es acotado: ayudar a un modelo a encontrar y leer las páginas que de verdad quieres que use, sin abrirse paso entre navegación, anuncios y JavaScript.
Esa es toda la idea. No es una señal de posicionamiento, ni un interruptor mágico que consigue que te citen, ni algo que todos los motores de IA hayan acordado leer. La confusión que lo rodea viene casi por completo de gente que espera que haga más de lo que promete. Esto es lo que dice realmente la especificación, quién lee el archivo, quién lo ignora y si publicar uno vale tu tiempo.
¿Qué exige realmente la especificación de llms.txt?
La especificación es deliberadamente mínima, y seguirla al pie de la letra es lo que hace que el archivo sea legible por máquinas. Un archivo conforme usa Markdown en un orden fijo:
- Un H1 con el nombre del sitio o proyecto. Es el único elemento obligatorio.
- Una cita en bloque con un resumen corto: el contexto clave que un modelo necesita para entender todo lo que va debajo.
- Cero o más secciones de prosa o listas (sin encabezados) con más detalle.
- Cero o más secciones H2, cada una una lista de enlaces Markdown a tus páginas clave, opcionalmente con una descripción de una línea tras cada enlace.
También existe la convención de publicar versiones llms-full.txt o .md de páginas individuales, para que un modelo pueda obtener Markdown limpio en lugar de HTML renderizado. La estructura importa: como el formato es predecible, un analizador puede extraer tus enlaces y resúmenes sin adivinar. Puedes generar y validar un archivo con nuestra herramienta de llms.txt, y ver cómo encaja en el conjunto más amplio en mejores herramientas de llms.txt.
¿Quién lee realmente llms.txt?
Aquí la honestidad importa más que el bombo. Publicar un archivo llms.txt es común: Anthropic, Stripe, Vercel, Cloudflare y cientos de sitios con mucha documentación ya sirven uno. Pero publicar un archivo no es lo mismo que un motor consumirlo para responder una pregunta. A mediados de 2026, ningún proveedor de IA importante ha confirmado públicamente que su motor de respuestas obtenga tu llms.txt en el momento de la recuperación para decidir qué citar.
Con lo que el archivo ayuda de forma fiable es más acotado: documentación para desarrolladores que los asistentes y agentes de IA leen bajo demanda, donde un índice curado de Markdown limpio de verdad ahorra contexto y mejora las respuestas. Para un sitio de documentación, eso es un beneficio real. Para un negocio local o un sitio de marketing que espera aparecer en las recomendaciones de ChatGPT, hay poca evidencia de que el archivo mueva nada por sí solo. Trátalo como una cortesía de bajo coste para los rastreadores que quizá lo usen, no como una palanca de crecimiento.
¿Google usa llms.txt?
No. Google lo ha dicho directamente y más de una vez. El 17 de junio de 2025, John Mueller, de Google, afirmó que ningún sistema de IA usa actualmente llms.txt, comparándolo con la antigua metaetiqueta de palabras clave: una señal autodeclarada, fácil de manipular y finalmente abandonada. En los eventos Search Central de julio de 2025, Gary Illyes, de Google, dijo que Google no admite llms.txt ni tiene planes de hacerlo, y que posicionar en los AI Overviews solo requiere SEO normal (Search Engine Land).
Mueller también aclaró un punto de confusión habitual: cuando la gente notó que algunas propiedades de Google servían un archivo llms.txt, explicó que el equipo de Search ni lo usa ni lo respalda; un sistema interno de contenidos había añadido soporte y algunos equipos simplemente no lo habían quitado. Así que si tu objetivo son los AI Overviews de Google en concreto, llms.txt no hace nada. Las señales que ganan esas citas son las de siempre: contenido útil, estructura limpia y corroboración entre fuentes de confianza; consulta cómo eligen las fuentes los AI Overviews.
¿Es llms.txt lo mismo que robots.txt?
No, y confundirlos causa errores reales. robots.txt dice a los rastreadores a qué tienen permitido acceder; llms.txt dice a los modelos qué contenido vale la pena leer y dónde está la versión limpia. Uno es un límite de permisos, el otro es un índice curado. Bloquear un rastreador en robots.txt mientras listas las mismas páginas en llms.txt es una contradicción que no ayuda a nadie.
También sirven a públicos distintos con el tiempo. robots.txt lo respeta prácticamente todo rastreador bien educado porque tiene décadas y está implementado casi universalmente. llms.txt es una propuesta joven con adopción real en la publicación pero con consumo no probado. Si te importa qué rastreadores de IA pueden llegar a tus páginas públicas, eso es una cuestión de robots.txt y firewall, no de llms.txt.
¿Necesitas de verdad un archivo llms.txt?
Esta es la opinión honesta. Publica uno si tienes un sitio con mucha documentación o para desarrolladores, porque los asistentes y agentes que leen documentación bajo demanda pueden usar de verdad un índice curado y limpio, y el coste de mantenerlo es bajo. Sáltatelo, o trátalo como mantenimiento opcional, si eres un negocio local o un sitio de marketing estándar: no hay evidencia de que te gane citas de IA, y Google ha dicho sin rodeos que no lo usará.
En cualquier caso, no dejes que llms.txt te distraiga del trabajo que de verdad mueve la visibilidad en IA: ganar menciones en las fuentes de terceros que los motores confían, estructurar las páginas como respuestas limpias y mantener tus datos coherentes y extraíbles por máquinas. Un archivo llms.txt es una puerta de entrada ordenada; no es la casa. Si quieres saber si algo de esto está funcionando, mídelo: comprueba si los motores te nombran hoy con la comprobación gratuita de visibilidad en IA.
Preguntas frecuentes
¿Dónde va el archivo llms.txt?
En la raíz de tu dominio, servido como texto plano en tusitio.com/llms.txt, exactamente igual que robots.txt está en tusitio.com/robots.txt. Las versiones limpias en Markdown de páginas individuales pueden estar junto a tus páginas como archivos .md o listarse en el índice.
¿llms.txt hará que ChatGPT cite mi sitio?
No hay evidencia pública de que lo haga por sí solo. Las citas en ChatGPT vienen de la recuperación sobre el índice de Bing más el rastreo propio de OpenAI y la corroboración de terceros; consulta cómo recomienda marcas ChatGPT. Un archivo llms.txt puede ayudar a un modelo a leer tu documentación, pero no fabrica citas.
¿Google lee llms.txt?
No. John Mueller y Gary Illyes, de Google, han dicho públicamente que Google no usa llms.txt ni tiene planes de hacerlo. Posicionar en los AI Overviews depende de señales de SEO normales, no de este archivo.
¿Es llms.txt un estándar oficial?
Todavía no. Es una propuesta de Answer.AI con adopción creciente entre editores, pero no está ratificada por un organismo de estándares y ningún motor importante se ha comprometido a consumirla. Sigue la especificación si publicas uno, pero no des por hecho que se leerá.
¿Cuál es la diferencia entre llms.txt y robots.txt?
robots.txt controla a qué tienen permitido acceder los rastreadores; llms.txt sugiere qué contenido vale la pena leer y apunta a versiones limpias de él. Uno es un archivo de permisos, el otro un mapa curado de contenido.
Comprueba si la IA te menciona
Haz una comprobación gratuita de visibilidad en IA: introduce tu negocio y mira si ChatGPT te nombra cuando los clientes piden recomendaciones, además de los competidores que aparecen y las mejoras para cerrar la brecha.