Ir al contenido
Visibilidad IA

¿Ayuda el archivo llms.txt a ser citado por las IA?

Publicado el

Nada demuestra que el archivo llms.txt ayude a ser citado por las IA. Se trata de una propuesta de 2024, cuyo uso para elegir fuentes no está documentado por ningún gran desarrollador de IA, y Google escribió en julio de 2026 que es inútil crear archivos de texto para la IA. Lo hemos medido: en los sitios web devueltos por las búsquedas de ChatGPT, Claude y Gemini en una decena de sectores de actividad, el 17% publica un llms.txt, y los sitios citados no lo publican de manera significativamente más frecuente que los demás. En el caso de ChatGPT, ocurre incluso ligeramente lo contrario.

¿Para qué tipo de pregunta? Todo depende de lo que se espere del archivo. Para ser citado en la respuesta de una IA a una pregunta, nada demuestra que sea útil. Se propuso para ayudar a las herramientas de IA a leer un sitio web, por ejemplo una documentación técnica, algo que no hemos medido.

Qué es el archivo llms.txt

El archivo llms.txt fue propuesto por Jeremy Howard el 3 de septiembre de 2024. La idea consiste en añadir a la raíz de un sitio web un archivo en formato Markdown, legible por los modelos de lenguaje, que presente el sitio web. El formato requiere un título con el nombre del sitio web, seguido generalmente de un breve resumen y listas de enlaces a las páginas importantes, con una sección opcional para lo que una herramienta puede ignorar cuando falta espacio.

Este archivo se presenta a menudo en los consejos de GEO como una forma de guiar a ChatGPT, Claude o Gemini hacia las páginas adecuadas. En las documentaciones de OpenAI, Anthropic y Google que hemos leído, ninguna indica que lo utilice para elegir sus fuentes. No sustituye al archivo robots.txt, que indica a los robots lo que tienen permitido leer.

Qué dicen Google y los estudios

Google responde en su guía sobre optimización para sus funciones de IA generativa, actualizada el 10 de julio de 2026: es inútil crear archivos de texto para la IA, ya que su motor de búsqueda no los utiliza. Ya en abril de 2025, John Mueller, de Google, observaba que, hasta donde él sabía, ningún servicio de IA había declarado utilizar este archivo, y que en los registros de su servidor se observa que estos servicios ni siquiera van a buscarlo.

SE Ranking publicó en noviembre de 2025 un análisis de casi 300 000 dominios, de los cuales aproximadamente el 10% publicaba un llms.txt. Conclusión: tener este archivo no hacía que un dominio fuera más propenso a ser citado por los modelos de IA. No obstante, el desarrollador considera que adoptarlo conlleva poco riesgo, en previsión de un uso futuro.

Qué hemos medido

Hemos analizado los sitios web devueltos por las búsquedas de ChatGPT, Claude y Gemini en una decena de sectores de actividad consultados en francés el 10 de septiembre de 2026, y comprobado el 16 de septiembre si cada uno de ellos publica un llms.txt válido, con su título en el formato previsto. Antes de realizar la medición, habíamos escrito nuestra predicción: menos del 10% de los sitios web publicarían uno, y la diferencia entre sitios citados y no citados no superaría los 3 puntos en ninguna IA.

La primera predicción ha fallado: el 17% de los sitios web publica un llms.txt, más de lo previsto. Las diferencias siguen siendo bajas y no van en la misma dirección: en Claude, el 16% de los sitios citados frente al 12% de los sitios no citados; en ChatGPT, el 14% de los sitios citados frente al 16% de los sitios no citados. Una prueba estadística de permutación demuestra que estas diferencias son compatibles con el azar. En Gemini, cuya API no distingue las páginas descartadas, el 23% de los sitios citados publica uno, sin punto de comparación.

Por qué el archivo no puede hacer que se cite una página

En ChatGPT y Claude, una página es localizada primero mediante una búsqueda que la propia IA genera, y luego es elegida entre los resultados. Lo que cuenta en estas dos etapas, según nuestras mediciones, es la posición de la página en los resultados, las palabras de la pregunta en su título y en su dirección, y los párrafos que responden utilizando el vocabulario de la búsqueda. Un archivo independiente, que la búsqueda no lee, no interviene en ninguna de estas etapas.

Este sitio web publica por sí mismo un archivo llms.txt que enumera sus páginas. No pretendemos que haga que nos citen: es un resumen más, no una palanca medida.

Qué cambia esto para una empresa

Si su sitio web no tiene un archivo llms.txt, esta no es la razón de su ausencia en las IA. Comience por lo que se puede medir: el acceso de los robots de búsqueda de las IA a su sitio web, páginas que respondan a las preguntas de sus clientes con sus propias palabras y una presencia en las fuentes que las IA consultan.

Publicar un llms.txt casi no cuesta nada y no hace daño. Pero un proveedor que lo presenta como una palanca de citación vende una promesa que ni Google, ni los estudios, ni nuestras mediciones confirman.

Lo que no sabemos

Nuestra medición se centra en los sitios web recopilados de una decena de sectores en francés, verificados seis días después de la recopilación: un sitio pudo haber añadido o eliminado su archivo entretanto. Compara sitios citados y no citados, lo que describe una asociación, no un efecto. No hemos medido el uso del archivo por parte de agentes que leen una documentación.

Fuentes

  1. Jeremy Howard — « The /llms.txt file », propuesta, .
  2. Google Search Central — « Optimizing your website for generative AI features on Google Search », .
  3. Search Engine Journal, Roger Montti — Google compara llms.txt con la etiqueta meta keywords, .
  4. SE Ranking, Yulia Deda — llms.txt y citas por las IA, .
  5. Mediciones de FaireDuBruit, del 4 al 16 de septiembre de 2026 — ver «Cómo medimos».

Preguntas relacionadas

Todas las preguntas sobre la visibilidad en las IA · Nuestra oferta