InicioInvestigaciónllms.txt y el acceso legible por máquinas

SEMPITE Investigación · Estudio cruzado · Agosto 2026

Las marcas con archivo llms.txt son justo las que la IA ignora

Ya sabíamos dos cosas sobre la nutrición deportiva: que la IA de Google cita a medios editoriales en el 95% de sus respuestas sobre suplementos, y que los archivos llms.txt de la web se están pudriendo en silencio. Así que cruzamos las dos listas — quién publica un llms.txt frente a quién lee realmente la IA. El resultado está exactamente al revés. Los sitios a los que la IA hace caso no se molestan con el archivo. Las marcas a las que ignora lo tienen todas — y ni siquiera es del tipo de archivo para el que se inventó el formato.

1 de 10medios principales (que concentran el 95% de las respuestas de IA) publica algún llms.txt
0 de 17marcas tienen un llms.txt que sea un auténtico mapa de contenido
7marcas sirven automáticamente la misma plantilla de comercio
5,1%de las citas de IA van a dominios propiedad de marcas, en total

Las fuentes que la IA lee de verdad no publican llms.txt

En 39 Vistas Generales de IA sobre nutrición deportiva, diez dominios editoriales aparecieron en el 95% de las respuestas — tres de ellos (Forbes, Healthline y Garage Gym Reviews) en el 77%. Comprobamos si cada uno de esos diez publica un llms.txt. Nueve no lo hacen:

forbes.com404
healthline.com404
garagegymreviews.com404
fortune.com404
gq.com404
health.usnews.comninguno
wired.com404
yahoo.com404
cozymeal.com404
tigerfitness.comtiene uno

La única excepción, tigerfitness.com, es además el menoscitado de los diez (7,7% de las respuestas). Las publicaciones que dominan las respuestas de IA llegaron a esa posición sin haberle dicho nunca a una IA cómo leerlas. Su palanca es la autoridad editorial y el contenido estructurado de reseñas — no un archivo de manifiesto.

Las marcas lo tienen todas — y es un manifiesto de pago, no un mapa de contenido

Hicimos la misma comprobación sobre las 17 marcas puntuadas en el estudio. Ni una sola publica el tipo de llms.txt para el que se diseñó el formato: un mapa curado de su mejor contenido explicativo. Lo que encontramos en su lugar:

  • 7 sirven una plantilla idéntica byte a byte — RAW Nutrition, Nutricost, REDCON1, RYSE, NutraBio, Bloom y Xwerks publican todas un archivo titulado «Agent Instructions — cómo pueden los agentes de IA interactuar con nuestra tienda online». Es el manifiesto de comercio agéntico de Shopify (el Universal Commerce Protocol / la función de pago de shop.app), inyectado automáticamente. Le dice a una IA cómo añadir al carrito y pasar por caja — no por qué recomendar la marca en primer lugar.
  • Las otras 10 no tienen ningún archivo funcional — el /llms.txt de Optimum Nutrition es un bucle de redirecciones que termina en una página de error de Cloudflare; Transparent Labs sirve un archivo de 0 bytes; Ghost, Red Bull y Guayakí devuelven el HTML de su portada (el modo de fallo «parece vivo, es inútil»); Celsius y Bucked Up dan 404; Monster y Reign lo bloquean a bots con un 403; y BUM Energy no tiene un dominio canónico que resuelva limpiamente donde alojarlo.

El desajuste en una frase: las marcas optimizaron el archivo para una IA que compra, cuando el problema real — demostrado por ese mismo estudio — es que la IA nunca las menciona . Un manifiesto de pago no vale nada si el asistente recomienda Transparent Labs a partir de un artículo de Forbes y nunca dirige a un comprador a su tienda para empezar.

Por qué esto está al revés — y qué mueve realmente la aguja

El llms.txt se le vendió a las marcas como la forma de «aparecer en la IA». Esta categoría demuestra lo contrario: los dominios propiedad de marcas se llevan solo el 5,1% de las citas publiquen o no el archivo, y los medios que poseen el otro 95% se lo saltaron por completo. Publicar un manifiesto no le compra una cita. Serlo el tipo de fuente en la que una IA confía, sí.

Para una marca de suplementos, eso significa que el trabajo está antes del archivo: resultados de laboratorio independientes y certificaciones que un reseñador pueda citar, contenido comparativo y de «los mejores» que los medios referencien de verdad, marcado estructurado de Producto y Reseña, y relaciones con el guardián concreto que domina su pasillo — que, como mostró el estudio matriz, es una publicación distinta para preentrenos, creatina, proteína y bebidas energéticas. Un archivo de pago autogenerado no es una estrategia. Es una casilla que una plataforma marcó por usted.

¿Quiere saber qué dicen realmente los asistentes de IA sobre su marca — y qué medios lo deciden?

Haga una comprobación gratuita de visibilidad en IA

Metodología: las 17 marcas y los 10 medios principales son los puntuados en el estudio de cuota de respuesta en IA de SEMPITE (40 consultas de intención de compra en nutrición deportiva, Vistas Generales de IA de Google, agosto de 2026). El 5 de agosto de 2026 se descargaron el /llms.txt y el /robots.txt de cada dominio con un agente de usuario de escritorio identificado como rastreador de investigación; los archivos se clasificaron por código de estado, tipo de contenido y cuerpo (un 200 que sirve HTML o un cuerpo de 0 bytes cuenta como ausencia de archivo funcional). «Plantilla idéntica» = el manifiesto «Agent Instructions» del Universal Commerce Protocol / shop.app de Shopify, identificado por título y marcadores de endpoints de comercio. Instantánea única; el bloqueo a bots puede variar según agente de usuario e IP. Las cifras de cuota de citas proceden del estudio matriz. Conjunto de datos publicado bajo CC BY 4.0 — cítese como «SEMPITE: llms.txt Adoption vs AI Citation Share, agosto de 2026».

Estudios relacionados

Todos los estudios de esta área: llms.txt y el acceso legible por máquinas →

EN