Generador de llms.txt
Rellena el nombre de tu sitio, una descripción de una línea y las páginas que importan, y esta herramienta construye un archivo llms.txt válido que puedes copiar directamente a la raíz de tu dominio. Funciona en tu navegador, no necesita cuenta y no envía nada a ninguna parte.
Páginas clave
Tu archivo
# Your site
Qué es llms.txt
llms.txt es un archivo Markdown sencillo en la raíz de tu dominio —tusitio.com/llms.txt— que le cuenta a un lector de IA, con tus propias palabras, qué es el sitio y qué páginas conviene leer primero. Es una propuesta, no un estándar aprobado: ningún proveedor de modelos se ha comprometido a leerlo, y por sí solo no te va a traer tráfico.
Aun así merece diez minutos. El archivo es diminuto, servirlo no cuesta nada y es el único sitio donde puedes decir claramente qué es tu producto en vez de dejar que un rastreador lo deduzca del menú y del texto de marketing. Tampoco bloquea nada: impedir el paso a un rastreador es tarea del robots.txt.
Cómo usar el archivo que obtienes
Guarda el resultado con el nombre exacto llms.txt y publícalo en la raíz de tu dominio, junto al robots.txt. Las herramientas buscan esa ruta exacta; una copia en una subcarpeta no la encontrará nadie. En Next.js puedes servirlo desde una ruta; en un alojamiento estático es una subida; en WordPress va a la raíz web por el gestor de archivos o por SFTP.
Luego compruébalo de la forma aburrida: abre la URL en un navegador y confirma que recibes texto plano y un 200, no una redirección ni tu página 404. Vuelve a generarlo cuando cambien los datos: un archivo que lista páginas que borraste es peor que no tener archivo.
Lo que este generador no es
- No es una garantía de que ningún asistente vaya a leer el archivo. El soporte de llms.txt es voluntario y, hoy, más una aspiración que un hecho.
- No rastrea tu sitio ni descubre páginas por ti. Tú eliges qué páginas importan, y ese criterio es la parte valiosa.
- No publica nada. Copias el texto y lo pones en producción tú.
Preguntas sobre llms.txt
- ¿Dónde va exactamente el archivo?
- En la raíz de tu dominio, como https://tusitio.com/llms.txt, servido como texto plano con estado 200. El mismo sitio donde vive robots.txt. Un archivo en /docs/llms.txt o /public/llms.txt no lo encuentra nada que busque la ruta estándar.
- ¿Cuántos enlaces debería listar?
- Los suficientemente pocos como para que cada uno se gane su sitio: normalmente entre cinco y veinte. El sentido del archivo es la selección: una lista que replica todo tu sitemap no le dice al lector nada sobre qué importa, que es justo lo que el archivo existe para comunicar.
- ¿llms.txt impide que los rastreadores de IA accedan a mi contenido?
- No, y este es el malentendido más común. El archivo es una invitación, no una valla. No puede prohibir el rastreo ni el entrenamiento. Si quieres dejar fuera a un rastreador concreto, eso va en el robots.txt con sus reglas por user-agent.
- ¿Sigo necesitando sitemap y marcado Schema?
- Sí. Hacen cosas distintas: robots.txt controla el acceso, sitemap.xml lista todo para los buscadores, Schema describe entidades dentro de una página y llms.txt selecciona lo mejor del sitio para los lectores de IA. Tres de las cuatro son infraestructura asentada; llms.txt es la apuesta.