Robots.txt para IA: cómo no bloquear a ChatGPT, Gemini y Perplexity sin darte cuenta
La causa más común de invisibilidad en IA es la más fácil de resolver: el sitio bloquea a GPTBot, ClaudeBot y PerplexityBot en robots.txt. Muchos dueños de empresa no saben que esto está ocurriendo.
El problema de fondo
robots.txt es un archivo que le dice a los bots cuáles páginas pueden y cuáles no pueden leer. Fue diseñado en los años 90 para motores de búsqueda. Los bots de IA son nuevos: plataformas con configuraciones antiguas los bloquean porque simplemente no los conocen.
El resultado: el sitio web existe, Google lo indexa, aparece en búsquedas, pero ChatGPT, Gemini y Perplexity nunca lo vieron. Para la IA, la empresa no existe.
Cómo revisar tu robots.txt ahora
tudominio.cl/robots.txt
Escribe esto en el navegador y presiona Enter.
Busca estas señales de alerta:
El robots.txt correcto para visibilidad en IA
Los cinco agentes, uno por uno
Cada empresa de inteligencia artificial manda su propio lector y cada uno tiene nombre propio. Escribirlos por separado toma diez minutos y es la primera capa de todo: sin permiso, nada de lo que hay más abajo se lee.
| Agente | De quién | Para qué entra |
|---|---|---|
| GPTBot | OpenAI | Entrenar sus modelos |
| OAI-SearchBot | OpenAI | Buscar en vivo cuando alguien pregunta |
| ClaudeBot | Anthropic | Entrenar y responder |
| PerplexityBot | Perplexity | Buscar en vivo |
| Google-Extended | Decidir si alimenta a Gemini, aparte del buscador |
El que más se olvida es OAI-SearchBot, y es el que decide si hoy te pueden citar, porque es el que entra a buscar en vivo cuando alguien pregunta en ChatGPT. GPTBot, en cambio, entra a entrenar y eso es otra decisión.
Lo que encontramos al medir ocho competidores
El 20 de agosto de 2026 corrimos nuestro motor sobre las ocho casas chilenas que salen primero cuando alguien busca posicionamiento en inteligencia artificial. El archivo se lee escribiendo /robots.txt después del dominio, así que la medición se puede repetir hoy sobre cualquiera.
- Bloquear a todos protege el contenido de ser usado para entrenar y también te saca de las respuestas
- Google-Extended es independiente del permiso normal de Google: puedes salir en el buscador y quedar fuera de Gemini
- Un plugin que regenera el archivo puede borrar lo que escribiste, sin avisar
- Por eso se vuelve a medir: una capa se apaga sola y nadie se entera
Solo dos de las ocho nombran a estos agentes de forma explícita. Las otras seis dejaron el archivo tal como vino con su plataforma, y ahí el permiso queda a merced de una regla general escrita para otra cosa hace años.
Hay un dato que nos deja mal parados y va igual: BigBuda nombra dieciséis agentes uno por uno, más que nosotros ese día. Un dato que solo favorece a quien lo publica no es un dato.
Un caso con fecha, y muestra lo rápido que se pierde
AB Limitada, instalaciones eléctricas en Antofagasta, pasó de 1 capa activa de 5 a 4 de 5 el 21 de julio de 2026. Se le publicó el schema de negocio local, una página de certificación con sus preguntas marcadas y el FAQPage de la portada, todo sobre su WordPress.
El 20 de agosto de 2026 su servidor empezó a responder con error y hoy mide 1 de 6 capas. Una capa apagada no distingue entre un archivo de permisos borrado y un servidor que no responde: para un lector automático las dos cosas se ven igual, que es no existir.
Por eso este archivo se vuelve a revisar y no se escribe una vez. Un plugin que lo regenera, una migración o un cambio de plataforma lo dejan como vino de fábrica, y nadie se entera hasta que alguien mide.
Para seguir
Preguntas frecuentes
¿Qué agentes de IA hay que nombrar en el robots.txt?
GPTBot y OAI-SearchBot de OpenAI, ClaudeBot de Anthropic, PerplexityBot y Google-Extended de Google. El segundo es el que más se olvida y el que decide si hoy te pueden citar, porque entra a buscar en vivo cuando alguien pregunta en ChatGPT.
¿Cuántas empresas chilenas los nombran?
Dos de ocho. Medimos el 20 de agosto de 2026 las ocho casas chilenas que salen primero cuando alguien busca posicionamiento en inteligencia artificial, y seis dejaron el archivo tal como vino con su plataforma.
¿Bloquear a los bots de IA protege mi contenido?
Lo protege de ser usado para entrenar y también te saca de las respuestas. Las dos cosas ocurren juntas, así que conviene decidirlo mirando ambas y no dejarlo al azar de una plantilla.
¿Por qué mi sitio bloquea los bots de IA sin que yo lo haya configurado así?
Muchas plataformas web (Jumpseller, Wix, algunos WordPress) incluyen en robots.txt reglas que bloquean todos los bots no reconocidos o usan "Disallow: /" como default de seguridad. GPTBot, ClaudeBot y PerplexityBot son bots relativamente nuevos: plataformas con configuraciones antiguas los bloquean por default. Es un ajuste que trae la plataforma y no una decisión del dueño, y es de las primeras comprobaciones que se revisan.
¿Cómo sé si mi robots.txt está bloqueando los bots de IA?
Accede a tudominio.cl/robots.txt directamente en el navegador. Si ves "Disallow: /" bajo "User-agent: *" o no hay mención explícita de GPTBot, ClaudeBot, Google-Extended y PerplexityBot como permitidos, es probable que estén bloqueados o sin acceso. Gerentia hace esta auditoría como primer paso de diagnóstico.
¿Cómo se ve un robots.txt correcto para IA?
Un robots.txt correcto para visibilidad en IA debe incluir explícitamente: User-agent: GPTBot, Allow: / (User-agent: ClaudeBot, Allow: /) User-agent: Google-Extended, Allow: /. User-agent: PerplexityBot, Allow: /. Además, el Sitemap debe estar listado al final para facilitar el rastreo.
¿Hay algún riesgo en permitir los bots de IA en robots.txt?
No hay riesgo técnico o de seguridad en permitir GPTBot, ClaudeBot, Google-Extended y PerplexityBot. Estos bots solo leen el contenido público del sitio: no extraen contraseñas, datos de clientes ni información privada. El contenido que ya es público para usuarios también puede ser visto por estos bots.
¿Tu robots.txt está bloqueando los bots de IA?
Gerentia audita robots.txt como primer paso. Lo corregimos en el mismo día.
Quiero el diagnóstico