Saltar al contenido

Google ignora tu llms.txt

La documentación de Google dice que la Búsqueda no usa llms.txt, y que tenerlo no ayuda ni perjudica. Conviene saberlo antes de publicarlo, y entenderlo después.

Hay un archivo que muchos sitios añadieron en los últimos dos años, con la teoría de que la búsqueda con IA lo querría. Google acaba de decir, en su propia documentación, que la Búsqueda no lo lee.

La redacción no es ambigua. La Búsqueda de Google no usa archivos llms.txt, crear uno no perjudica ni ayuda a tu visibilidad ni a tu posicionamiento, y si lo mantienes para otro servicio, no hay problema. La documentación de funciones de IA resume la versión general en una frase: no hace falta crear archivos legibles por máquinas, ficheros de texto para IA ni marcado para aparecer en esas funciones. Y añade que tampoco hay datos estructurados especiales de schema.org que añadir.

Por qué se extendió de todos modos

llms.txt es una idea con buena pinta. Toma la forma de robots.txt, que sí es un estándar real que rastreadores reales respetan, y la aplica a un público nuevo. Cuesta una tarde. Y a diferencia de casi todo lo demás en este terreno, publicarlo da la sensación de haber terminado algo.

Esa combinación es todo el mecanismo. Un artefacto barato que se parece a un estándar, dirigido a un sistema que nadie puede inspeccionar, es dificilísimo de discutir, porque discutirlo exige pruebas sobre una caja negra y el archivo no exige ninguna.

También llegó en un momento en el que el sector quería una palanca con desesperación. Nadie sabe influir en una respuesta de IA como sabe influir en un enlace azul, así que un archivo que puedes crear y luego señalar llena un hueco psicológico real. Lo que no llena es un hueco técnico, al menos en Google.

Qué decide de verdad si las funciones de IA te citan

La misma página que descarta el archivo enuncia el requisito en una línea: para poder aparecer en AI Overviews y en AI Mode, una página tiene que estar indexada y ser apta para mostrarse en la Búsqueda con un fragmento, cumpliendo los requisitos técnicos de la Búsqueda.

Léelo como una cadena de dependencias, porque lo es. Ser apto para un fragmento depende de estar indexado. Estar indexado depende de haber sido rastreado y luego guardado, que es una decisión que Google toma sobre tu contenido y el punto donde la mayoría de los sitios se está quedando fuera. Ningún archivo en la raíz de tu dominio mueve nada de eso.

Lo que significa que las palancas que ya tenías son las palancas. Si quieres controlar cómo aparece tu contenido en las funciones de IA, los controles documentados son nosnippet, data-nosnippet, max-snippet y noindex, los mismos que regían los fragmentos antes de todo esto, más el control de IA generativa de Search Console si quieres salir del todo de esas superficies.

¿Entonces hay que borrarlo?

No necesariamente, y aquí la honestidad nos cuesta algo: nosotros publicamos una herramienta que revisa archivos llms.txt, y la vamos a mantener. Google no es el único que lee un sitio. Algunas plataformas de documentación y algunos frameworks de agentes sí leen estos archivos, y si uno de los tuyos lo hace, el archivo está haciendo un trabajo.

Lo que cambia es su sitio en la lista. Es un detalle de integración con servicios concretos que puedes nombrar, no una medida de SEO. Si no puedes nombrar el servicio que lee el tuyo, tienes un archivo que nadie lee, y los veinte minutos por trimestre que le dedicas podrían ir al problema de indexación.

La prueba que conviene guardar

Esto va a volver a pasar. El próximo archivo con buena forma, el próximo vocabulario de marcado, la próxima convención obligatoria para la IA llegarán con las mismas propiedades: baratos, plausibles y apuntando a algo opaco.

Dos preguntas resuelven casi todos los casos. ¿Quién lee esto, con nombre y apellido? ¿Y qué dice la plataforma sobre ello en su propia documentación? Si la respuesta a la primera es “la IA” y la respuesta a la segunda es nada, lo que tienes delante es una costumbre formándose, no una técnica.

Preguntas frecuentes

¿Tener un llms.txt perjudica mi posicionamiento?

No. La guía de Google es explícita: estos archivos no perjudican ni ayudan a la visibilidad ni al posicionamiento en la Búsqueda, porque la Búsqueda los ignora. Es un archivo neutro, no un archivo peligroso.

¿Otros sistemas de IA usan llms.txt?

Algunas herramientas y plataformas sí lo leen, y por eso la guía de Google dice que mantenerlo para otros servicios está bien. La disciplina útil es poder nombrar el servicio para el que lo mantienes. “La IA” no es un nombre.

¿Y servir versiones en Markdown de mis páginas?

Misma respuesta de Google: no hace falta crear Markdown ni otros archivos legibles por máquinas para aparecer en la Búsqueda, incluidas sus funciones generativas. Puede seguir siendo buena idea por otros motivos, este sitio sirve una copia en Markdown de cada artículo porque a los agentes les cuesta menos leerla que el HTML, pero es una decisión de experiencia de desarrollo, no de posicionamiento.

¿Cómo evito que AI Overviews use mi contenido?

Con los controles que ya existían: nosnippet, data-nosnippet, max-snippet o noindex, según cuánto quieras reservarte. También hay un control de IA generativa en Search Console que excluye tu sitio de esas funciones, y Google afirma que no se usa como señal de posicionamiento ni de inclusión en el resto de la Búsqueda.

¿Google-Extended es lo mismo?

No. Google-Extended regula si tu contenido se usa para entrenamiento en otros productos de IA de Google. Es un control distinto de si AI Overviews y AI Mode pueden citar una página indexada, y no es un ajuste de SEO.

Fuentes

Lo que cuesta

Leer sobre esto es la parte fácil.

Conecta tus datos de Google y deja que tu IA lea tu sitio. Desde $19/mes, garantía de devolución de 14 días.

  • Nunca escribe en tu sitio
  • Diagnóstico, no automatización
  • Se conecta por MCP a Claude, ChatGPT y Cursor
Ver precios

Acceso de solo lectura. Nunca escribimos en tu sitio.