Cómo Crear un /llms.txt para Tu Sitio: La Guía Completa para Hacer Tu Contenido Legible por Agentes de IA

Publicado el — Actualizado el — Por

Existe un archivo de texto simple que puede cambiar la forma en que los agentes de IA entienden tu sitio. Tiene menos de 50 líneas, no requiere programación avanzada y puede crearse en menos de 30 minutos. Se llama `llms.txt` — y en esta guía aprenderás exactamente qué es, por qué importa y cómo crear uno para cualquier tipo de sitio. --- ## Qué Es el `/llms.txt` y Por Qué Existe El `llms.txt` es un archivo de texto en formato Markdown, alojado en la raíz de tu dominio (en `tusitio.com/llms.txt`), que instruye a agentes de inteligencia artificial sobre qué es tu sitio, qué páginas son más relevantes y cómo interpretar tu contenido. La propuesta fue creada por Jeremy Howard, fundador de fast.ai, y publicada en septiembre de 2024. La motivación es directa: los modelos de lenguaje tienen ventanas de contexto limitadas y no pueden procesar un sitio entero de una vez. Cuando un agente de IA necesita entender tu negocio para responder a una pregunta o recomendar un producto, necesita una fuente confiable, estructurada y concisa de información. El `llms.txt` es exactamente eso. > "Mientras los sitios sirven tanto a lectores humanos como a LLMs, estos últimos se benefician de información más concisa y especializada reunida en un único lugar accesible." > — Jeremy Howard, llmstxt.org Piénsalo como el `robots.txt` — pero en lugar de decir a los crawlers lo que *no* indexar, el `llms.txt` dice a los agentes de IA qué *es más importante* entender sobre tu sitio. --- ## La Diferencia Entre `llms.txt`, `robots.txt` y `sitemap.xml` Los tres archivos coexisten y tienen funciones complementarias. Entender la diferencia evita confusión al implementar: | Archivo | Para quién | Qué hace | Formato | |---|---|---|---| | `robots.txt` | Crawlers de búsqueda | Controla el acceso de bots a las páginas | Texto plano con directivas | | `sitemap.xml` | Crawlers de búsqueda | Lista todas las URLs del sitio | XML estructurado | | `llms.txt` | Agentes de IA y LLMs | Explica el sitio y señala recursos relevantes | Markdown legible por humanos y máquinas | El `llms.txt` no sustituye a ninguno de los otros dos — los complementa, añadiendo una capa semántica que los formatos anteriores no pueden expresar. --- ## Quién Ya Está Usando La adopción aún es baja en el universo general de la web: análisis de alrededor de 300.000 dominios encontraron una tasa de adopción de solo 10,13%, y solo 3 de los 1.000 sitios más grandes del mundo tienen el archivo. Pero entre las empresas que más entienden de IA, la adopción es significativa y creciente. Empresas como **Cloudflare**, **Anthropic**, **Vercel**, **ElevenLabs** y **Supabase** ya implementaron el `llms.txt`. Cloudflare va más allá y mantiene archivos específicos por producto. Vercel tiene un `llms-full.txt` tan extenso que fue descrito como "una novela de 400.000 palabras" — toda la documentación consolidada en un único archivo para consumo por IA. El estándar es especialmente popular entre empresas de herramientas para desarrolladores, SaaS y documentación técnica — exactamente los sectores donde la precisión de la información consumida por IA impacta directamente en la experiencia del usuario final. --- ## Qué Dice la Ciencia: ¿El `llms.txt` Realmente Aumenta las Citas de IA? Esta es la pregunta más honesta que debes hacer antes de invertir tiempo en la implementación. La respuesta, basada en los datos disponibles hasta mayo de 2026, es: **no directamente — pero eso no significa que no debas crearlo**. El estudio más riguroso disponible, realizado por SE Ranking con alrededor de 300.000 dominios y publicado en Search Engine Journal, llegó a una conclusión directa: el `llms.txt` no parece impactar directamente la frecuencia de citas por IA en ChatGPT, Perplexity y Google AI Mode. El estudio controló por autoridad de dominio y calidad de contenido, por lo que el resultado no es simplemente "los sitios más grandes son los más citados". Tres razones importantes para implementarlo aun así: **Primera:** Ninguna de las grandes plataformas confirmó públicamente que *ignora* el `llms.txt`. La ausencia de evidencia de impacto positivo no es evidencia de impacto nulo — el ecosistema aún se está formando. **Segunda:** El archivo tiene valor inmediato para agentes de IA que operan en modo de investigación (como Perplexity Deep Research y ChatGPT con navegación activa). Cuando un agente visita tu sitio para recopilar información, el `llms.txt` es lo primero que lee — y determina qué páginas va a priorizar. **Tercera:** El costo de implementación es mínimo. Un archivo de texto bien estructurado, creado en 30 minutos, que puede tener impacto positivo a medida que el ecosistema madura — la relación costo-beneficio es favorable. --- ## La Estructura Oficial del `llms.txt` El formato está definido por la especificación en [llmstxt.org](https://llmstxt.org) y usa Markdown puro. La estructura sigue este orden: **1. H1 obligatorio** — El nombre del proyecto o del sitio. Es la única sección realmente obligatoria. **2. Blockquote opcional** — Un resumen corto con la información más importante para entender el resto del archivo. **3. Secciones de texto opcionales** — Párrafos o listas con información detallada sobre el proyecto. No pueden contener headings. **4. Secciones H2 con listas de enlaces** — Cada sección H2 delimita una "lista de archivos" con enlaces a donde hay más información disponible. Cada ítem es un enlace Markdown con una nota opcional después de los dos puntos. **5. Sección especial "Optional"** — Si está presente, indica que los enlaces que contiene pueden ser ignorados cuando el contexto necesite reducirse. Úsala para información secundaria. El template base: ``` # Nombre del Sitio o Proyecto > Descripción corta y objetiva de qué es el sitio, para quién sirve > y cuál es su diferencial principal. Información adicional relevante que un agente de IA necesita saber para interpretar correctamente el contenido del sitio. ## Sección Principal - [Título de la Página](https://url.com/pagina): Descripción de lo que hay en esta página ## Otra Sección - [Título](https://url.com/otra): Descripción ## Optional - [Página Secundaria](https://url.com/secundaria): Puede ser ignorada si el contexto es corto ``` --- ## Guía Paso a Paso: Creando el `llms.txt` para Cada Tipo de Sitio ### Para E‑commerces y Tiendas Online El foco debe estar en productos, categorías, políticas de compra e información que un agente de IA necesitaría para recomendar o comprar un producto en nombre del usuario. ``` # Vetfleur — Aromaterapia Natural para Mascotas > Tienda especializada en productos de aromaterapia y bienestar natural > para perros y gatos. Todos los productos están libres de ingredientes > artificiales. Envíos a todo Brasil con seguimiento. Fundada en 2019, Vetfleur desarrolla fórmulas naturales basadas en aromaterapia para promover el bienestar de las mascotas. Nuestros productos son probados por veterinarios y no contienen parabenos, sulfatos ni colorantes artificiales. ## Productos Destacados - [Bioprotector Natural para Mascotas](/produtos/bioprotetor): Protector solar natural para perros y gatos, FPS 30, resistente al agua - [Aceite Relajante Lavanda](/produtos/oleo-relaxante): Blend aromático para ansiedad y agitación canina, 30ml - [Kit Bienestar Completo](/produtos/kit-bem-estar): Combo con 3 productos para la rutina de cuidados ## Categorías - [Protección Solar](/categorias/protecao-solar): Todos los protectores solares para mascotas - [Aromaterapia](/categorias/aromaterapia): Aceites esenciales y difusores para mascotas - [Higiene Natural](/categorias/higiene): Champús y acondicionadores naturales ## Políticas - [Envío y Entrega](/frete): Envío gratis por compras superiores a R$ 150, plazo de 3-7 días hábiles - [Cambios y Devoluciones](/devolucoes): Política de 30 días para cambio o reembolso completo - [Pago](/pagamento): Tarjeta, Pix, boleto y pago en hasta 12x sin intereses ## Optional - [Blog](/blog): Artículos sobre bienestar y cuidados naturales para mascotas - [Sobre Nosotros](/sobre): Historia y valores de Vetfleur - [Preguntas Frecuentes](/faq): Dudas comunes sobre productos y pedidos ``` ### Para Sitios de Servicios y Agencias El foco debe estar en los servicios ofrecidos, diferenciales, proceso de trabajo y cómo contactarlos. ``` # SEO 5.0 — Arquitectura Estratégica para IA > Plataforma de SEO especializada en optimización para motores de búsqueda > y sistemas de IA generativa (GEO). Diagnóstico automatizado con el > Score IAS™, planes mensuales y anuales para empresas brasileñas. SEO 5.0 es la primera plataforma de Brasil enfocada en GEO (Generative Engine Optimization) — la práctica de estructurar contenido para ser encontrado, citado y recomendado por sistemas como ChatGPT, Perplexity, Gemini y Claude. ## Servicios Principales - [Diagnóstico IAS™](/diagnostico): Análisis gratuito de 10 dimensiones de visibilidad en IA, resultado en 2 minutos - [Plan Starter](/planos): R$ 129/mes — ideal para freelancers y pequeñas empresas - [Plan Profesional](/planos): R$ 297/mes — para agencias y empresas en crecimiento - [Plan Enterprise](/planos): A consultar — para grandes operaciones y múltiples dominios ## Recursos y Herramientas - [Blog & Insights](/blog): Artículos técnicos sobre SEO 5.0, GEO y visibilidad en IA - [Herramientas Gratuitas](/ferramentas): Analizadores de Schema, verificadores de llms.txt y más - [Casos de Éxito](/cases): Resultados reales de clientes con SEO 5.0 ## Contacto - [Hablar con un Especialista](/contato): Formulario de contacto y agendamiento de consultoría - [Soporte](/suporte): Centro de ayuda y apertura de tickets ## Optional - [Sobre SEO 5.0](/sobre): Historia, equipo y metodología - [Socios](/parceiros): Agencias y freelancers asociados ``` ### Para Blogs y Portales de Contenido El foco debe estar en categorías de contenido, artículos más importantes y cómo está organizado el contenido. ``` # Blog de Nutrición Deportiva — NutriPerformance > Portal de contenido especializado en nutrición para atletas amateurs > y profesionales. Artículos basados en evidencia científica, > revisados por nutricionistas deportivos registrados en el CRN. Publicamos semanalmente artículos sobre suplementación, periodización nutricional, recetas para atletas y análisis de investigaciones recientes. Todo el contenido es revisado por al menos un nutricionista deportivo. ## Categorías Principales - [Suplementación](/suplementacao): Guías completas sobre proteínas, creatina, cafeína y otros - [Nutrición para Carrera](/corrida): Estrategias nutricionales para corredores de calle y trail - [Recetas para Atletas](/receitas): Más de 200 recetas con macros calculados - [Investigación y Ciencia](/ciencia): Análisis de estudios recientes traducidos a la práctica ## Artículos Más Accedidos - [Guía Completa de Creatina](/suplementacao/creatina-guia): Dosificación, timing, tipos y evidencia - [Carbohidratos en el Pre‑Entrenamiento](/corrida/carboidratos-pre-treino): Qué comer y cuándo - [Proteína: Cuánta Necesitas Realmente](/suplementacao/proteina-quantidade): Basado en metaanálisis ## Optional - [Sobre los Autores](/autores): Perfiles de los nutricionistas que revisan el contenido - [Metodología Editorial](/metodologia): Cómo seleccionamos y revisamos los artículos ``` --- ## El Archivo `llms-full.txt`: Cuándo y Por Qué Usarlo Además del `llms.txt` estándar (que funciona como un índice), la especificación prevé un archivo complementario llamado `llms-full.txt`. La diferencia es fundamental: - **`llms.txt`** — Un índice con enlaces hacia donde está la información. Ligero, rápido de procesar, ideal para la mayoría de los sitios. - **`llms-full.txt`** — El contenido completo consolidado en un único archivo. Útil para documentaciones técnicas, donde el agente necesita todo el contexto sin hacer múltiples peticiones. Para la mayoría de los sitios de negocio, el `llms.txt` estándar es suficiente. El `llms-full.txt` tiene más sentido para documentaciones de APIs, librerías de software o bases de conocimiento extensas — exactamente el caso de uso de empresas como Vercel y Anthropic. --- ## Dónde Alojar y Cómo Verificar El archivo debe estar accesible en `https://tudominio.com/llms.txt`. No hay necesidad de configuración especial de servidor — es un archivo de texto estático como cualquier otro. **Para verificar que funciona**, accede directamente a la URL en el navegador. El archivo debe mostrarse como texto plano, sin HTML alrededor. **Herramientas de validación disponibles:** - [llmstxt.org](https://llmstxt.org) — Especificación oficial con validador - [llms-text.com/generator](https://www.llms-text.com/) — Generador automático basado en URL - [directory.llmstxt.cloud](https://directory.llmstxt.cloud) — Directorio de ejemplos reales para referencia **Cómo añadirlo en diferentes plataformas:** En sitios con WordPress, basta con crear el archivo `llms.txt` en la carpeta raíz vía FTP o por el administrador de archivos del hosting. En sitios con Next.js o React, coloca el archivo en la carpeta `public/`. En Shopify, usa un archivo de tema estático o una app de archivos personalizados. --- ## Buenas Prácticas y Errores Comunes **Sé específico, no genérico.** Un `llms.txt` que dice "somos una empresa de marketing digital" no ayuda a ningún agente de IA. Incluye qué haces, para quién, dónde y cómo — con detalles que diferencien tu negocio. **Prioriza las páginas que convierten.** El `llms.txt` no necesita listar todas las URLs del sitio. Lista las páginas que un agente de IA necesitaría para entender tu negocio y guiar a un usuario hacia la compra o el contacto. **Manténlo actualizado.** Si lanzas nuevos productos, cambias precios o creas nuevas secciones, actualiza el `llms.txt`. Un archivo desactualizado puede hacer que un agente de IA recomiende información incorrecta sobre tu negocio. **Usa la sección `## Optional` con criterio.** Coloca allí solo lo que realmente es secundario. Si un agente de IA necesita reducir el contexto, ignorará esa sección — así que no pongas información crítica de negocio allí. **No dupliques el `robots.txt`.** El `llms.txt` no es el lugar para bloquear acceso de bots. Para eso, usa `robots.txt` normalmente. El `llms.txt` es para *orientar*, no para *restringir*. --- ## Checklist de Implementación Antes de publicar tu `llms.txt`, verifica: | Ítem | Verificado | |---|---| | H1 con el nombre del sitio presente | ✓ | | Blockquote con resumen claro y objetivo | ✓ | | Secciones H2 con listas de enlaces relevantes | ✓ | | Cada enlace tiene una nota descriptiva después de los dos puntos | ✓ | | Sección `## Optional` usada solo para contenido secundario | ✓ | | Archivo alojado en `/llms.txt` en la raíz del dominio | ✓ | | URL accesible directamente en el navegador | ✓ | | Información de precio, disponibilidad y contacto actualizada | ✓ | --- ## El `llms.txt` en el Contexto del SEO 5.0 El `llms.txt` es una de las capas de la estrategia de **GEO (Generative Engine Optimization)** — la práctica de estructurar la presencia digital para ser comprendida, indexada y citada por sistemas de IA generativa. No reemplaza los datos estructurados Schema.org, contenido semántico rico o la autoridad de dominio — pero los complementa, añadiendo una capa de legibilidad directa para agentes. En el contexto del Score IAS™, la presencia de un `llms.txt` bien estructurado contribuye a la dimensión de **Interacción con IA** — una de las 10 dimensiones evaluadas en el diagnóstico. Sitios que ya tienen Schema.org implementado, contenido semántico rico y además añaden el `llms.txt` están construyendo una presencia digital que habla el lenguaje de los sistemas que cada vez más median el descubrimiento de productos y servicios. La ventana de oportunidad está abierta: solo el 10% de los sitios tiene el archivo. Quien implemente ahora ocupa un espacio que la mayoría de los competidores aún no ha percibido. --- *¿Quieres saber en qué dimensiones tu sitio está perdiendo visibilidad frente a los agentes de IA? Haz el diagnóstico IAS™ gratuito — resultado en 2 minutos, sin registro.*