Análisis

Qué hace llms.txt, qué no hace y quién lo lee realmente

La adopción crece y los rastreadores para los que se diseñó lo ignoran. Esto es lo que muestran los registros, y por qué este sitio lo publica igualmente.

Flexsent Labs · 22 de agosto de 2026 · 2 min de lectura · 4 fuentes

La propuesta llms.txt es simple y atractiva: un archivo markdown en la raíz del sitio que enumera lo que publicas, para que un modelo de lenguaje no tenga que reconstruir tu estructura a partir de los menús. Se escribe en una tarde. La adopción sube de forma constante.

Y, con la evidencia actual, los rastreadores para los que se diseñó lo ignoran casi por completo.

Qué muestran los registros

El análisis de registros a gran escala encuentra que el 97% de los archivos llms.txt publicados no recibe ni una sola petición. GPTBot, ClaudeBot, PerplexityBot, OAI-SearchBot y Google-Extended lo omiten de forma abrumadora y rastrean el HTML directamente.

Los proveedores tampoco se han comprometido. En el primer trimestre de 2026, ninguna gran empresa de IA se ha comprometido públicamente a leer llms.txt en producción. La actualización de documentación de Google en junio fue más lejos: el archivo no tiene efecto — ni positivo ni negativo — sobre el ranking en Search ni sobre AI Overviews.

Mientras tanto, la adopción crece. Según el panel que midas, va desde cerca del 10% en una muestra de 300 000 dominios hasta más de la mitad de un panel fijo y pequeño de sitios técnicos. La distancia entre esas cifras es el hallazgo: llms.txt lo han adoptado con entusiasmo los sitios cuya gente lee artículos como este, y lo ha ignorado todo lo demás.

Quién sí lo lee

Nadie no. Los consumidores demostrables hoy son navegadores agénticos y herramientas de código: los asistentes que abren una documentación mientras escriben código contra ella. Por eso los sitios de documentación lo adoptaron mucho antes que nadie: tienen un consumidor que de verdad lo lee.

Si tu audiencia programa contra tu producto, llms.txt está trabajando. Si tu audiencia es alguien preguntándole a ChatGPT qué proveedor incluir en su lista corta, no.

Por qué este sitio lo publica igualmente

Publicamos /llms.txt y /llms-full.txt, y se generan desde el contenido en vez de mantenerse a mano. Dada la evidencia anterior, eso merece una explicación y no un encogimiento de hombros.

Tres razones, en orden decreciente de honestidad:

Mantenerlo correcto no cuesta nada. El nuestro se genera al compilar y cada URL se verifica antes de dar la compilación por buena. Un archivo mantenido a mano que se desvía es peor que no tener ninguno; uno generado es casi gratis.

El conjunto de consumidores crece, no se reduce. Los agentes de código ya lo leen. Si los motores de respuesta seguirán es desconocido, y el coste de llegar pronto es un paso de compilación.

Es una declaración legible de estructura. Escribir el archivo obliga a decir qué contiene realmente tu publicación. El ejercicio vale la pena aunque ningún rastreador pida el resultado.

Lo que no afirmamos es que mejore la visibilidad en las respuestas de IA. Nada en la evidencia actual lo respalda, y una publicación sobre descripción precisa no debería afirmar sobre sus propias herramientas algo que no puede sostener.

Qué hacer en su lugar

Si el objetivo es que un asistente te describa con precisión, dedica la tarde a lo que los rastreadores sí leen: el HTML servido sin exigir JavaScript, y las páginas de terceros que hablan de ti. llms.txt son diez minutos razonables al final de ese trabajo. No es el trabajo.