Archivo llms.txt con signo de interrogación sobre fondo azul corporativo

llms.txt: qué es, si sirve y cómo crearlo (ejemplo real)

llms.txt es un archivo de texto en formato Markdown, alojado en la raíz de tu web (tudominio.com/llms.txt), que ofrece a los modelos de lenguaje un índice curado de tus páginas más importantes. Lo propuso Jeremy Howard (Answer.AI) en septiembre de 2024 y su especificación vive en llmstxt.org.

Crearlo lleva menos de una hora. Que sirva para aparecer en ChatGPT, Perplexity o Google es otra cuestión, y la respuesta honesta es que hoy no hay evidencia de que lo haga.

En esta guía verás qué es, qué dicen Google y los estudios (incluida la contradicción entre Search y Chrome), cómo crearlo paso a paso y nuestro propio llms.txt explicado línea a línea.

Última actualización: septiembre de 2026.

Resumen en 30 segundos

  • Qué es: un índice en Markdown pensado para que una IA sepa qué leer de tu web. No bloquea ni permite nada.
  • Qué no es: un factor de ranking, un sustituto de robots.txt ni un archivo de permisos de entrenamiento.
  • ¿Sirve? Google dice por escrito que estos archivos no afectan, ni para bien ni para mal, a tu visibilidad. Un estudio de SE Ranking con 300.000 dominios no encontró relación con las citas en IA.
  • Dónde sí tiene sentido: documentación técnica y agentes de programación.
  • Veredicto: hazlo si te cuesta menos de una hora y puedes mantenerlo. No lo vendas ni lo compres como estrategia de visibilidad en IA.

¿Qué es llms.txt?

llms.txt es una propuesta de estándar abierto: un archivo Markdown en /llms.txt que resume tu sitio y enlaza, con una descripción breve, a las páginas que un modelo debería leer primero.

El problema que intenta resolver es práctico. Una página web incluye menús, scripts y bloques repetidos que consumen la ventana de contexto de un modelo. El mismo contenido convertido a Markdown ocupa mucho menos: las mediciones publicadas sitúan a Markdown en torno a cinco veces más eficiente en tokens que el HTML equivalente.

Howard lo concibió sobre todo para la inferencia: el momento en que un modelo o agente consulta tu web para responder a una pregunta. No está pensado para el entrenamiento.

llms.txt frente a robots.txt y sitemap.xml

Archivo Qué hace Pregunta que responde ¿Quién lo respeta?
robots.txt Controla a qué rutas puede acceder cada rastreador ¿Puedes entrar aquí? Buscadores y la mayoría de bots de IA declarados, por convención
sitemap.xml Lista las URLs que quieres indexar ¿Qué URLs existen? Buscadores como Google y Bing
llms.txt Resume el sitio y prioriza páginas en Markdown ¿Qué debería leer primero? Ningún gran proveedor de IA lo ha confirmado

Lo que llms.txt no hace

Varias guías en español atribuyen a llms.txt directivas para permitir o prohibir el entrenamiento, como $trainingAllowed o $chatAllowed. Esas directivas no existen en la especificación. llms.txt no tiene ningún mecanismo de permisos.

La confusión mezcla tres propuestas distintas:

  • robots.txt: controla el acceso de los rastreadores.
  • ai.txt (Spawning): propone permisos de entrenamiento.
  • Content Signals (Cloudflare): añade directivas dentro de robots.txt.

Si quieres bloquear o permitir a un bot de IA, hazlo en robots.txt.

Formato oficial del archivo

La especificación define una estructura sencilla:

  1. H1 con el nombre del sitio. Es lo único obligatorio.
  2. Blockquote (>) con un resumen de una a tres frases. Es la parte más importante.
  3. Párrafos opcionales de contexto, sin encabezados.
  4. Secciones H2 con listas de enlaces: - [Nombre](URL): descripción breve.
  5. Una sección H2 llamada «Optional», reservada para contenido prescindible.
Anatomía de un archivo llms.txt: título H1, resumen, secciones H2 con enlaces y sección Optional
Estructura oficial de llms.txt según la especificación de llmstxt.org.

Existe además llms-full.txt, un archivo complementario que concatena el contenido completo de las páginas en un solo Markdown. Lo popularizó la colaboración entre Mintlify y Anthropic. Solo tiene sentido si tu contenido es documentación que un agente quiere cargar entero.

Mantén llms.txt ligero: unos pocos KB es suficiente. Una lista de cientos de URLs deja de ser un índice curado.

¿Sirve llms.txt de algo? Lo que dicen Google y los datos

Con la evidencia disponible en septiembre de 2026, llms.txt no mejora el posicionamiento en Google y no hay prueba de que aumente tus citas en ChatGPT, Perplexity o Gemini.

Qué dice Google

Esta es la parte donde conviene ir a la fuente y no al titular. La guía oficial de Google sobre sus funciones de IA dice literalmente:

«You don’t need to create new machine readable files, AI text files, or markup to appear in these features.»

Y más adelante Google añadió una aclaración específica sobre llms.txt en su registro oficial de cambios de la documentación, bajo el epígrafe «Clarifying guidance on llms.txt files»:

«While these files aren’t needed for Google Search (and won’t negatively or positively impact your visibility or rankings), it’s fine if you want to maintain these files for other services or systems that use them.»

Traducido y sin rodeos: Google no lo usa, no te penaliza por tenerlo y no te beneficia. Es la propia documentación de Google nombrando el archivo, no una interpretación de terceros. Encaja con lo que analizamos en Google I/O 2026: qué cambia para el SEO.

A eso se suman las declaraciones de dos portavoces:

  • John Mueller lo comparó con la etiqueta meta keywords y lo calificó de «puramente especulativo», señalando WebMCP como la prioridad real para agentes.
  • Gary Illyes confirmó que Google no lo soporta ni planea hacerlo.

La contradicción: Lighthouse, la herramienta de Chrome, añadió una categoría experimental de navegación agéntica con una auditoría de llms.txt. Habla de agentes de navegador, no del buscador, y no afecta al ranking. Es la misma empresa con dos equipos mirando problemas distintos.

Qué dicen los estudios

  • SE Ranking (cerca de 300.000 dominios): solo el 10,13% tenía llms.txt. No hubo correlación con las citas de IA y, al retirar la variable del modelo, la precisión incluso mejoró.
  • Otterly.AI (90 días de logs): de 62.100 peticiones de bots de IA, solo 84 fueron a /llms.txt. Un 0,1%. Para comparar, una página de contenido normal del mismo sitio recibió unas 265 visitas de esos bots, más del triple que el archivo pensado para ellos.

Los grandes proveedores publican su propio llms.txt en sus documentaciones. Publicarlo no equivale a leer el de otros.

Resumen visual: Google no usa llms.txt y un estudio de 300.000 dominios no ve efecto en las citas de IA
Fuentes: Google Search Central, SE Ranking y Otterly.AI.

Dónde sí tiene sentido

En documentación para desarrolladores. Los agentes de programación cargan documentación en Markdown de forma habitual. Mueller reconoce esa utilidad, aunque la ve como un apoyo temporal, y para webs no técnicas no ve un sentido claro.

¿Te conviene a ti?

Tipo de web ¿Merece la pena? Prioridad
SaaS, APIs, documentación técnica Sí Alta: los agentes de código lo aprovechan
Agencia o empresa B2B con guías Opcional Baja: 30-60 minutos y revisión trimestral
Ecommerce Opcional Antes: datos de producto estructurados, reseñas y GEO para ecommerce
Negocio local Prescindible Antes: Google Business Profile y reseñas
Web corporativa de menos de 50 páginas Prescindible Un buen sitemap y una arquitectura clara ya cubren lo mismo
Árbol de decisión para saber si crear llms.txt según tengas documentación técnica o guías
Guía rápida: ¿merece la pena crear llms.txt en tu web?

Cómo crear tu llms.txt paso a paso

Son seis pasos y no requieren programar.

Paso 1. Comprueba si ya lo tienes

Abre tudominio.com/llms.txt en el navegador o ejecuta:

curl -I https://tudominio.com/llms.txt

Un 200 con text/plain significa que existe. Un 404, que no. Yoast, Rank Math y All in One SEO pueden generarlo automáticamente, así que revisa qué publican antes de crear uno. Nos pasó a nosotros: el plugin estaba volcando el blog entero.

Paso 2. Elige entre 15 y 30 URLs

Selecciona las páginas que recomendarías a alguien que quiere entender tu negocio: servicios, guías de referencia, precios, contacto y quiénes sois.

Deja fuera:

  • etiquetas, categorías vacías y páginas paginadas;
  • carrito, cuenta y páginas legales;
  • URLs con parámetros;
  • cualquier página tras login;
  • cualquier URL con datos personales (RGPD).

Paso 3. Escribe el resumen

El blockquote debe contener datos concretos y verificables: qué eres, dónde estás, a quién sirves y cómo trabajas.

Mal

«Somos una empresa líder e innovadora con un enfoque orientado al cliente.»

Bien

«Agencia SEO en Barcelona especializada en SEO técnico, ecommerce y visibilidad en IA. Trabaja mes a mes, sin permanencia.»

Paso 4. Agrupa los enlaces con descripciones útiles

Crea entre tres y seis secciones H2 (Servicios, Guías, Empresa) y describe cada enlace en una frase que responda a lo que resuelve esa página. Un enlace sin contexto obliga al agente a abrirlo para decidir si le interesa.

Paso 5. Publícalo con la codificación correcta

  • A mano: sube llms.txt a la raíz del dominio por FTP o desde el gestor de archivos del hosting.
  • Con plugin: actívalo en Yoast, Rank Math o AIOSEO y limita los tipos de contenido para que no liste todo el sitio.

Si tu web está en español, fuerza UTF-8. Si ves símbolos raros en tildes o eñes, el servidor no declara la codificación. En Apache:

<Files "llms.txt">
  Header set Content-Type "text/plain; charset=utf-8"
</Files>

En Nginx, define charset utf-8; para esa ubicación. La configuración depende de tu hosting, así que verifica el resultado con curl -I.

Paso 6. Valida y mantenlo

  1. Comprueba que devuelve 200 y text/plain.
  2. Revisa que no haya enlaces rotos ni redirecciones.
  3. Copia el contenido en ChatGPT o Claude y pregunta: «Según este archivo, ¿qué hace este sitio y qué debería leer primero?» Si la respuesta es correcta, la estructura funciona.
  4. Revísalo cada vez que publiques un servicio o guía nuevos.
Resultado del comando curl sobre llms.txt con código 200 y tipo text/plain en UTF-8
Así debe responder el servidor: código 200 y texto plano en UTF-8.

Un llms.txt con enlaces rotos o desactualizados es peor que no tener ninguno.

Nuestro llms.txt, explicado

Este es el archivo que publicamos en seowebsolutions.es/llms.txt:

# Seo Web Solutions

> Agencia SEO en Barcelona especializada en posicionamiento web, SEO técnico, SEO para ecommerce y visibilidad en buscadores de IA (GEO). Trabaja mes a mes, sin permanencia. Dirigida por Xavier Serra, atiende a pymes y ecommerce de toda España.

Precios orientativos publicados en la web: SEO local y pyme, 350-800 EUR/mes; empresas medianas y ecommerce, 800-2.000 EUR/mes; SEO + GEO, 600-1.700 EUR/mes. Oficina en Santa Coloma de Gramenet (Barcelona). Contacto: admin@seowebsolutions.es.

## Servicios
- [Todos los servicios](https://www.seowebsolutions.es/servicios/): índice de los 9 servicios de la agencia, cómo trabajamos y en qué nos diferenciamos.
- [Auditoría SEO web](https://www.seowebsolutions.es/auditoria-seo-web/): análisis técnico, de enlaces, de contenido y de visibilidad en IA, con plan priorizado por impacto.
- [Posicionamiento en IA (GEO)](https://www.seowebsolutions.es/agencia-geo-posicionamiento-llms/): visibilidad en ChatGPT, Perplexity, Gemini y Claude.
- [SEO para ecommerce](https://www.seowebsolutions.es/seo-para-ecommerce/): WooCommerce, PrestaShop y Shopify, categorías, fichas y schema de producto.
- [SEO local Barcelona](https://www.seowebsolutions.es/agencia-seo-local-barcelona/): Google Business Profile y Local Pack.
- [SEO para B2B](https://www.seowebsolutions.es/seo-para-b2b/): empresas industriales y de servicios con ciclos de compra largos.
- [Migración web SEO](https://www.seowebsolutions.es/migracion-web-seo/): inventario de URLs, redirecciones 301 y monitorización en Search Console.
- [Consultoría SEO](https://www.seowebsolutions.es/consultoria-seo/): diagnóstico de qué frena tu crecimiento y plan de acción priorizado que puedes ejecutar tú mismo o con nosotros.
- [Precios SEO en Barcelona](https://www.seowebsolutions.es/precios-seo-barcelona/): rangos por tipo de proyecto.

## Guías de referencia
- [llms.txt: qué es, si sirve y cómo crearlo](https://www.seowebsolutions.es/llms-txt/): qué es, qué dicen Google y los estudios, y cómo crearlo paso a paso.
- [GEO: qué es y cómo aparecer en ChatGPT y Perplexity](https://www.seowebsolutions.es/geo-generative-engine-optimization/): diferencias con SEO y AEO y acciones concretas.
- [GEO para ecommerce](https://www.seowebsolutions.es/geo-ecommerce-chatgpt-shopping/): cómo aparecer cuando alguien pregunta a ChatGPT qué comprar.
- [Google I/O 2026: qué cambia para el SEO](https://www.seowebsolutions.es/google-io-2026-que-cambia-seo/): guía oficial de Google sobre IA generativa.
- [Claude para SEO](https://www.seowebsolutions.es/claude-para-seo/): uso desde el chat y desde Claude Code.
- [Cómo hacer una auditoría SEO paso a paso](https://www.seowebsolutions.es/como-hacer-auditoria-seo-paso-a-paso/): los 8 bloques, herramientas y matriz de priorización.
- [SEO técnico en 2026](https://www.seowebsolutions.es/seo-tecnico-guia-completa/): guía para no técnicos.
- [Core Web Vitals](https://www.seowebsolutions.es/core-web-vitals-guia-completa/): LCP, INP y CLS, cómo medirlos y mejorarlos.
- [Linkbuilding en 2026](https://www.seowebsolutions.es/linkbuilding-2026-estrategias-que-funcionan/): qué funciona y qué no.
- [Cuánto cuesta el SEO en España](https://www.seowebsolutions.es/cuanto-cuesta-el-seo-en-espana/): precios reales en 2026.
- [Guía SEO para WooCommerce](https://www.seowebsolutions.es/guia-seo-para-woocommerce/): manual completo y práctico.

## Empresa
- [Sobre nosotros](https://www.seowebsolutions.es/sobre-nosotros/): cómo trabajamos, sin permanencia y con acceso directo a tus datos.
- [Xavier Serra, consultor SEO](https://www.seowebsolutions.es/xavier-serra-consultor-seo/): fundador de la agencia y responsable de los proyectos, 4 años posicionando negocios.
- [Contacto](https://www.seowebsolutions.es/contacto/): solicitud de presupuesto.

## Optional
- [Google Search Console para no técnicos](https://www.seowebsolutions.es/google-search-console-guia-no-tecnicos/)
- [Cómo elegir una agencia SEO en Barcelona](https://www.seowebsolutions.es/como-elegir-agencia-seo-barcelona/)
- [Error 404: cómo solucionarlo](https://www.seowebsolutions.es/error-404-que-es-como-solucionarlo/)
- [Google Ads Barcelona](https://www.seowebsolutions.es/google-ads-barcelona/)
- [Diseño de landing pages](https://www.seowebsolutions.es/diseno-landing-pages/)
Archivo llms.txt de Seo Web Solutions publicado en la raíz del dominio
Nuestro llms.txt en producción, con tildes correctas en UTF-8.

Las decisiones detrás del archivo:

  1. Un resumen con hechos. Nombre, especialidad, ciudad, modelo de trabajo y responsable, sin adjetivos vacíos.
  2. Precios idénticos a los de la web. Si un modelo los cita, coinciden con la fuente. Hay que actualizar ambos sitios a la vez.
  3. Curaduría, no volcado. Elegimos las guías de referencia y dejamos fuera noticias puntuales y contenido ajeno a la especialidad.
  4. Descripciones que responden algo. Cada línea indica qué resuelve la página.
  5. Sección «Optional». Lo secundario queda al final, como prevé la especificación.
  6. Sin legales, etiquetas ni URLs con parámetros.

Un detalle de nuestra propia implementación: nuestro servidor es Nginx, así que el bloque de .htaccess no nos servía. Servimos el archivo desde PHP y declaramos nosotros mismos la cabecera Content-Type: text/plain; charset=utf-8. Es otra forma válida de llegar al mismo sitio, y de paso deja el control de la codificación en el código y no en la configuración del hosting.

Errores frecuentes

  1. Inventar directivas. $trainingAllowed y similares no existen en la especificación.
  2. Listar todo el blog. Se convierte en un sitemap peor mantenido.
  3. Enlaces rotos o con redirecciones. Revísalos cada trimestre.
  4. Servirlo como HTML o con codificación incorrecta. El servidor debe devolver text/plain en UTF-8.
  5. Bloquearlo sin querer. Un firewall o una regla de autenticación pueden impedir el acceso sin que lo notes.
  6. Incluir URLs sensibles o con datos personales.
  7. Esperar resultados. Ninguna evidencia respalda una mejora en citas o tráfico.

Cómo comprobar si alguien lo lee

La única forma fiable es mirar los logs del servidor o de tu CDN y filtrar las peticiones a /llms.txt por user-agent de IA.

Filtra por:

  • OpenAI: GPTBot, OAI-SearchBot y ChatGPT-User
  • Anthropic: ClaudeBot
  • Perplexity: PerplexityBot

Compara las visitas a /llms.txt con el total de peticiones de esos bots a tu web. En el experimento de Otterly.AI fue el 0,1%.

Una visita referida desde ChatGPT no demuestra que llms.txt la causara: puede venir de una cita en una respuesta. Revisa a los 30, 60 y 90 días.

Qué sí mueve la aguja en visibilidad en IA

Si tu objetivo es aparecer en respuestas generativas, estas acciones tienen más recorrido que llms.txt:

  • Permitir los bots de búsqueda de IA en robots.txt. OpenAI recomienda permitir OAI-SearchBot.
  • Publicar datos propios y respuestas directas. Frases con cifras y entidades verificables, no generalidades.
  • Cubrir el tema de forma completa. Un clúster de contenido con autoridad temática.
  • Conseguir menciones externas en medios y directorios del sector.
  • Medir citas reales en ChatGPT, Perplexity y Gemini con un conjunto fijo de consultas, sin fiarte de suposiciones.

Lo explicamos en GEO: qué es y cómo aparecer en ChatGPT y Perplexity. Si quieres partir de un diagnóstico, empieza por una auditoría SEO que incluya visibilidad en IA, o consulta nuestro servicio de posicionamiento en IA (GEO).

Preguntas frecuentes

¿Qué es llms.txt?

Un archivo Markdown en la raíz de tu web (/llms.txt) que ofrece a los modelos de lenguaje un índice curado de tus páginas clave. Lo propuso Jeremy Howard en septiembre de 2024.

¿llms.txt mejora el SEO?

No. Google indica por escrito en su documentación que estos archivos no son necesarios para Google Search y que no afectan ni positiva ni negativamente a tu visibilidad ni a tu posicionamiento.

¿Lo lee ChatGPT?

No hay confirmación de que OpenAI, Anthropic, Google o Perplexity lo consulten en webs de terceros. Publican el suyo en sus documentaciones, lo que no equivale a leer el de otros.

¿Qué diferencia hay entre llms.txt y robots.txt?

robots.txt controla el acceso de los rastreadores. llms.txt no bloquea ni permite nada: solo propone qué leer primero.

¿Qué es llms-full.txt?

Un archivo complementario que concatena el contenido completo de las páginas en Markdown. Es útil sobre todo para documentación técnica.

¿Puede perjudicar a mi web?

No hay evidencia de penalización. Lo que sí perjudica es tenerlo desactualizado o con enlaces rotos.

Conclusión: hazlo, pero sin expectativas exageradas

llms.txt es una tarea de higiene de bajo coste, no una palanca de visibilidad. Si tu web es de documentación o tienes guías de referencia, invierte una hora y mantenlo. Si buscas aparecer en ChatGPT o Google, concentra el esfuerzo en contenido citable, autoridad y medición.

¿Quieres saber cómo te ven hoy ChatGPT, Perplexity y Gemini?

Medimos tu visibilidad real en los motores generativos con un conjunto fijo de consultas y te decimos dónde te citan, dónde citan a tu competencia y qué hace falta para cambiarlo.

Solicita tu auditoría

Fuentes

Xavier Serra

Escrito por

Xavier Serra

Fundador y Consultor SEO en Seo Web Solutions

Xavier Serra es fundador y consultor SEO en Seo Web Solutions, agencia especializada en posicionamiento web y visibilidad en IA en Barcelona, con más de 4 años de experiencia ayudando a empresas a crecer en internet.

Política de Privacidad | © 2026 SEO Web Solutions — Todos los derechos reservados