El archivo llms.txt prometía ser el robots.txt de la era generativa. La evidencia de 2026 es más incómoda: el 97% de los archivos publicados no recibe una sola visita, y Google declaró que no lo usa. ¿Por qué lo publicamos igual en bisonagents.com y lo recomendamos a clientes? Porque cuesta dos horas, no penaliza, y donde sí se lee, el orden editorial importa. Esta es la guía honesta.
La idea original sigue siendo elegante. Si robots.txt fue el contrato que las marcas firmaron con los crawlers en 1994, llms.txt —propuesto por Jeremy Howard en septiembre de 2024— aspira a ser el contrato con los motores generativos: robots.txt dice qué no indexar; llms.txt dice qué priorizar, en qué orden y con qué contexto. La diferencia entre la promesa y la práctica es lo que este artículo mide.
¿Qué es exactamente?
Un archivo Markdown servido desde la raíz de tu dominio (/llms.txt) que sigue una estructura predecible:
# Bison Agents > La plataforma AEO/GEO #1 para marcas de LatAm — el sistema > operativo de AEO/GEO: monitorea, diagnostica, optimiza, genera > el contenido para cerrar las brechas y posiciona tu marca en > ChatGPT, Gemini, Claude, Perplexity y Google AI Overviews. ## ¿Qué es Bison Agents? [descripción canónica + nota de desambiguación para sistemas de IA] ## Propuesta de valor - **Monitoreo**: rastrea tu presencia en 10+ motores de IA [...] - **Diagnóstico**: score 0-100 en 4 dimensiones [...] ## Metodología Documentación completa: https://bisonagents.com/metodologia [...] ## Blog técnico ### Artículos publicados - [Schema.org bien hecho](https://bisonagents.com/blog/schema-org-aeo) [...]
Es Markdown plano. Sin HTML, sin schema, sin convenciones especiales. La única estructura que importa: un # con el nombre de la marca, un blockquote con la descripción canónica, y secciones ## que listan las URLs en el orden en que querrías que un modelo las lea.
Ese orden es lo que la mayoría no entiende. No es una sitemap. Es una jerarquía de relevancia editorial. El motor que respeta llms.txt va a leer lo que pongas arriba antes de lo que pongas abajo, y va a ponderar lo de arriba como autoritativo, lo de abajo como complementario.
¿Quién lo lee de verdad en 2026?
La medición más dura publicada hasta ahora es de Ahrefs (15 de junio de 2026): de 137.210 dominios con tráfico analizados, 38.360 publicaban un llms.txt — y el 97% de esos archivos no recibió una sola visita en mayo. Del 3% que sí tuvo tráfico, la mayor parte vino de herramientas de auditoría SEO (21,7%) y bots no identificados (14,9%); los asistentes de IA navegando la web generaron apenas el 2,5% de las visitas. Y un detalle revelador: ningún bot de IA pidió un llms.txt en dominios donde el archivo no existía — es decir, no lo están buscando activamente.
Google es explícito: Gary Illyes confirmó en julio de 2025 que Google no soporta llms.txt ni planea hacerlo — John Mueller llegó a compararlo con la vieja meta keywords —, y la guía oficial de Search Central, actualizada el 15 de junio de 2026, dice que no se necesita ningún archivo machine-readable nuevo para aparecer en Google, incluidas sus funciones de IA generativa.
El otro lado del balance también es real: la adopción creció 8,8 veces en un año según el tracking de PPC Land, el 8,7% del top 1.000 mundial ya lo publica (junio de 2026), y Anthropic y Perplexity lo publican para su propia documentación técnica. Es una convención comunitaria viva — solo que todavía no es el contrato universal que promete el hype.
robots.txt te excluye; llms.txt te prioriza — pero solo ante quien decide leerlo. En 2026 esa lista es corta, y decirlo con claridad vale más que venderte el archivo como magia.
¿Qué medimos en cuatro clientes? (datos propios)
Entre febrero y abril de 2026 publicamos llms.txt para cuatro clientes con perfiles distintos: un SaaS B2B, un e-commerce, una marca local regional, y la propia plataforma de Bison. La metodología fue idéntica en los cuatro:
- Tres semanas de baseline midiendo cobertura en los 5 motores.
- Release del
llms.txten una sola noche. - Cuatro semanas post-release con el mismo prompt set.
- Análisis diff por motor.
El cliente con menor delta (un e-commerce de tecnología reacondicionada) sumó +3 puntos. El de mayor delta (un SaaS B2B con sitio bien estructurado y blog técnico extenso) sumó +9. La diferencia no es del archivo; es de qué tan citables eran las páginas a las que el archivo apuntaba. llms.txt no crea autoridad —la desbloquea cuando ya existe.
La advertencia honesta que le debemos a cualquier lector técnico: n=4 no es un estudio, es una serie de casos. La medición fue anterior al estudio de Ahrefs, y no podemos aislar el efecto del archivo de otras mejoras publicadas en paralelo — correlación no es causalidad. Lo que sí podemos afirmar: el costo fue de ~2 horas por cliente, ningún motor penalizó el archivo, y el score no bajó en ninguno de los cuatro casos.
Errores comunes
De los cuatro casos, los tres primeros tuvieron que ser corregidos después de la primera publicación. Estos son los errores que vimos —y los seguimos viendo en auditorías nuevas casi cada semana—:
1. Apuntar a páginas que requieren JavaScript
El crawler de Perplexity renderiza JavaScript; el de Claude no. Si tu URL es una SPA de React que solo muestra contenido tras hidratación, Claude va a leer una página vacía. El cliente W. nos llevó dos semanas darnos cuenta de por qué sus citas en Claude no se movían: el blog estaba detrás de SSR opcional que estaba en modo CSR ese mes.
2. Listar 80 URLs en la sección principal
No es una sitemap. Si listas 80 URLs, el motor las va a tratar como ruido. La sección ## principal debería tener entre 3 y 7 URLs —las páginas que tú consideras canónicas para definir tu marca—. Todo lo demás va a ## Optional al final.
3. Escribir descripciones de marketing en el blockquote
El blockquote de la cabecera es lo primero que el LLM lee. Si escribes "líderes innovadores en soluciones digitales", el modelo aprende exactamente nada. Recomendamos: una oración factual con qué hace tu marca, dónde opera y qué la diferencia. Sin adjetivos vacíos.
4. No actualizar nunca
llms.txt tiene lastmod implícito (la cabecera HTTP). Los motores lo cachean entre días y semanas, dependiendo del crawler. Si lanzas un producto nuevo, edita el archivo. Si publicas un caso destacado, súbelo a la sección principal. Tratarlo como contenido vivo es 70% del valor del estándar.
¿Qué cambia para una marca de LatAm?
No existe una medición de adopción de llms.txt específica para sitios hispanohablantes a mediados de 2026 — y eso mismo es un dato: nadie está midiendo este terreno todavía. La referencia más cercana es global: 8,7% del top 1.000 mundial lo publica. En un ecosistema donde el español concentra solo el 6,0% del contenido web (W3Techs, junio de 2026), cada superficie de identidad que una marca controla — schema, Wikidata, llms.txt — pesa proporcionalmente más, porque hay menos corpus independiente que la describa.
Nuestra práctica con bisonagents.com es literal: el archivo se genera desde la misma fuente de datos que alimenta el sitio y el servidor MCP (un solo origen, cero copias manuales), y el hosting envía una cabecera Link: rel="describedby" apuntando a /llms.txt en cada respuesta, para que cualquier crawler lo descubra sin buscarlo. Ese es el estándar de implementación que recomendamos: no un archivo suelto, sino una pieza integrada del sistema de identidad.
Lo que no resuelve
Hay que ser claros sobre el alcance. llms.txt hace tres cosas: ayuda a la descubribilidad, mejora la priorización, y entrega contexto canónico. No reemplaza schema.org, no construye autoridad editorial, y no genera citas en los motores que no lo consumen — Google lo dijo por escrito; ChatGPT tampoco lo lee según los datos de tráfico de Ahrefs.
Pensarlo como "el truco AEO de las 2 horas" es sobrestimarlo. Pensarlo como "la acción barata que deja tu identidad lista para quien decida leerla, sin costo si nadie lo hace" es la lectura correcta. En nuestra metodología sigue entre los mínimos absolutos de identidad técnica — por su relación costo/riesgo, no porque mueva citas por sí solo.
- 01Ahrefs · análisis de 137.210 dominios: 97% de los llms.txt sin visitas; asistentes de IA = 2,5% de las requests (Louise Linehan, Xibeijia Guan) · 15.06.2026
- 02Google Search Central · guía de IA actualizada: no se necesitan archivos machine-readable nuevos para aparecer en Google · 15.06.2026
- 03Google · Gary Illyes: sin soporte ni planes para llms.txt; John Mueller lo compara con la meta keywords · 07.2025
- 04Rankability · adopción de llms.txt en el top 1.000 mundial: 8,7% · 06.2026
- 05PPC Land · crecimiento de adopción interanual: 8,8× · 2026
- 06llmstxt.org · especificación de la convención, propuesta por Jeremy Howard · 09.2024
- 07W3Techs · idiomas del contenido web: español 6,0% · 06.2026
- 08Bison Agents · medición propia en 4 clientes (baseline 3 semanas + 4 semanas post-release, feb–abr 2026): +6,2 pts de score AEO promedio · datos propios, n=4

