llms.txt: qué es, para qué sirve y cómo crearlo para tu negocio
Qué es llms.txt — definición exacta
llms.txt es un archivo de texto plano en formato Markdown que se coloca en la raíz de tu dominio (tudominio.com/llms.txt) y describe tu negocio de forma estructurada para los modelos de lenguaje. Es el equivalente de robots.txt, pero en lugar de decirle a los crawlers qué pueden rastrear, le dice a las IAs qué deben entender de tu negocio.
Lo propuso Jeremy Howard en 2024 y desde entonces lo han adoptado miles de sitios técnicos y, cada vez más, negocios que trabajan su visibilidad en IA (GEO).
Para qué sirve realmente
Cuando ChatGPT, Perplexity o Gemini buscan información sobre tu negocio, se encuentran tu web: menús, banners, scripts, textos repartidos en veinte páginas. Extraer de ahí "qué hace esta empresa y cuánto cobra" es costoso y propenso a errores.
El llms.txt les da la versión limpia: una página de texto sin ruido con lo esencial. Efectos prácticos:
- Reduce errores: menos probabilidad de que una IA diga mal tus precios o tus servicios.
- Aumenta la citabilidad: contenido fácil de extraer es contenido fácil de citar.
- Controla el mensaje: decides tú qué versión de tu negocio leen las IAs, en vez de dejar que la deduzcan.
Importante ser honesto con los límites: llms.txt es un estándar emergente, no una garantía. No todos los crawlers lo leen todavía. Pero su coste es tan bajo (una tarde de trabajo) y su adopción tan escasa en España que la relación esfuerzo/beneficio es de las mejores del GEO.
Estructura de un llms.txt bien hecho
El formato es Markdown simple. Estructura recomendada para un negocio:
Ejemplo de esqueleto (adaptado a una PYME de servicios)
Un llms.txt de agencia en Sevilla empezaría así: encabezado con el nombre; debajo, "Agencia de ingeniería de IA en Sevilla que construye chatbots, automatizaciones y agentes de IA para PYMEs"; después secciones de Servicios (con precios), FAQ ("¿Cuánto cuesta un chatbot de WhatsApp? Entre 800 y 2.500€ de setup más 50-150€/mes...") y Contacto (C. Tabladilla 7, Sevilla, +34 684 77 25 94).
Cada respuesta de la FAQ debe poder citarse sola, sin contexto: si una IA extrae solo esa línea, tiene que seguir siendo verdad y estar completa.
Cómo implementarlo paso a paso
Errores comunes
| Error | Consecuencia |
| Escribirlo en tono publicitario ("¡somos líderes!") | Las IAs descartan el hype; quieren datos |
| No poner precios ni datos concretos | Pierde su principal utilidad citable |
| Dejarlo desactualizado | Una IA citando precios viejos es peor que ninguna cita |
| Ponerlo en una subcarpeta | Los crawlers lo buscan en la raíz, no lo encontrarán |
| Contradecir lo que dice la web | La inconsistencia reduce la confianza del modelo en ambas fuentes |
Cuándo se nota el efecto
Los crawlers de IA rastrean con frecuencias variables: entre 2 y 8 semanas es un plazo realista para que el contenido nuevo se refleje en respuestas con búsqueda en tiempo real (Perplexity es normalmente el más rápido). Para comprobarlo, pregunta a las IAs en sesión privada lo que preguntaría tu cliente y observa si la información mejora.
El llms.txt es una pieza del GEO, no todo el GEO: funciona mejor acompañado de schema.org bien montado, entidad consistente y contenido citable. Si quieres saber qué le falta a tu web para ser visible en IAs, el diagnóstico gratuito lo revisa punto por punto.
¿Quieres aplicar esto en tu negocio?
Esto es lo que puedes automatizar en una pyme como la tuya, con una agencia de IA en Sevilla: