677 asistentes de IA leyeron nuestra web en una semana: qué significa y cómo verlo en la tuya

Durante la semana del 29 de agosto al 5 de septiembre de 2026, 677 visitas de robots de asistentes de IA entraron en proxera.es. No son personas. Son los programas que ChatGPT, Claude, Perplexity, Siri o Alexa usan para leer páginas y responder con ellas.
Esa cifra no sale de una herramienta de SEO, porque ninguna la da: sale de los registros del servidor.
El desglose, con lo que no cuadra incluido
Estos son los ocho agentes que más nos leyeron en esos 7 días:
| Agente | Visitas |
|---|---|
| ChatGPT leyendo la web en directo | 164 |
| El buscador de ChatGPT | 110 |
| Alexa | 78 |
| OpenAI, para entrenar | 76 |
| Perplexity | 47 |
| Siri y Apple Intelligence | 41 |
| Claude | 39 |
| Gemini | 35 |
| Otros agentes, sin desglosar | 87 |
| Total | 677 |
Los ocho de arriba suman 590, no 677. Los 87 restantes son agentes con menos volumen que nuestro informe no lista uno a uno. Aparecen aquí como «otros» en vez de repartirse entre los ocho o desaparecer de la tabla, porque una tabla que no suma y no lo dice es peor que una tabla incompleta: quien la lee no tiene forma de saber que le falta algo.
Es el mismo criterio que aplicamos al resto: si un dato no está confirmado, se dice que no está.
Por qué una impresión sin clic no siempre es un fracaso
En la misma ventana, de cada 1.000 veces que aparecemos en Google, entran 0,8 personas. Leído a la manera clásica, eso es un desastre.
Pero hay un dato al lado que cambia la lectura: el 13% de esas apariciones no son de personas. Son asistentes de IA buscando por alguien.
Cuando quien consulta es una máquina, el clic no es el objetivo ni es posible. El asistente lee la página, extrae lo que necesita y responde en su propia interfaz. La persona recibe la respuesta —a veces con la fuente citada— y nunca pasa por tu web. Esa visita no aparece en tu analítica, y sin embargo tu contenido ha hecho su trabajo.
Esto no significa que un CTR bajo sea siempre bueno. Significa que el CTR ya no se puede leer solo: hay que saber qué parte de tus impresiones son humanas antes de sacar conclusiones sobre tu titular. Un titular malo y un lector que es una máquina producen el mismo cero, y arreglar el titular sólo sirve en uno de los dos casos.
De hecho, la consecuencia práctica es incómoda: optimizar el titular para una consulta que sólo hacen máquinas no sirve de nada. Lo que sí sirve es ser citable — respuestas directas, datos concretos con su fuente y precios explícitos en los primeros párrafos, en vez de tres párrafos de introducción antes de decir nada.
Qué leen, que no es lo que uno espera
Las cuatro páginas nuestras que más interesaron a estos agentes en esos 7 días fueron:
- Mejores herramientas de IA para abogados en España 2026
robots.txt— el fichero de instrucciones, no una página- WhatsApp Business API con IA para gestorías y despachos
- Alternativas a Harvey AI para abogados en España
Que robots.txt sea el segundo contenido más leído del sitio dice bastante: antes de leerte, estos agentes van a mirar si pueden. Un robots.txt mal escrito no te penaliza — te hace invisible para ellos, en silencio.
Cómo verlo en TU web, sin comprar nada
No hace falta una herramienta. Estos agentes se identifican en cada petición, y tu servidor lo apunta. Si tienes nginx, esto cuenta cuántas veces te ha leído cada uno:
LOG=/var/log/nginx/TU-DOMINIO.access.log
for b in GPTBot ClaudeBot PerplexityBot \
Applebot Amazonbot OAI-SearchBot \
ChatGPT-User Google-Extended; do
printf '%6s %s\n' "$(grep -ic "$b" "$LOG")" "$b"
done | sort -rn
Tres avisos para que no leas de más el resultado:
- Cuenta peticiones, no visitantes. Un agente que lee cinco páginas cuenta cinco veces.
- El registro se rota. Ese fichero suele guardar sólo los últimos días; los anteriores están comprimidos al lado, con otro nombre.
- Si el fichero no existe o no puedes leerlo, no lo estimes. No hay forma de deducir el tráfico de robots a partir de otra cosa, y un número inventado aquí es peor que no tener número.
Con Apache el fichero cambia de sitio, pero la idea es la misma: el agente va escrito en cada línea.
Lo que hicimos nosotros, y por qué
Dos cosas, ninguna espectacular.
Un fichero llms.txt. Es un resumen en texto plano, pensado para que un asistente entienda quién eres sin tener que deducirlo de una web hecha para personas. El nuestro está en proxera.es/llms.txt y ocupa poco más de 6 KB. Lo que más nos importa de él es lo que dice hacia el final: que no publicamos métricas de ROI ni porcentajes de mejora, y que si alguien encuentra uno atribuido a nosotros, no sale de ahí. Un asistente que nos cite tiene delante ese aviso.
⚠️ Conviene decirlo claro: llms.txt es una convención, no un estándar, y ningún asistente está obligado a leerlo. No es una palanca de posicionamiento. Es barato, es honesto y te obliga a escribir en una página lo que de verdad ofreces.
Arreglar el robots.txt. El 23 de agosto de 2026 corregimos un error que llevaba tiempo ahí y que no se ve mirando el fichero por encima: un robot obedece un solo grupo, el más específico que coincida con su nombre, y hace como si los demás no existieran. Teníamos un grupo User-agent: Googlebot que sólo decía Allow: /. No añadía permiso al grupo general: lo sustituía, y con él se iban todas las restricciones del grupo *. El resultado era lo contrario de lo que el fichero parecía decir.
La regla que sacamos de ahí, y que hoy está escrita como comentario en el propio fichero: si un bot tiene grupo propio, ese grupo repite todas las restricciones. Hoy tenemos 35 grupos, uno por agente relevante, cada uno completo.
Qué hacer con esto esta semana
Tres cosas, por orden de esfuerzo:
- Mira tus registros con el comando de arriba. Si el número es cero, ya sabes por dónde empezar. Si no lo es, ya tienes una cifra que antes no tenías.
- Abre tu
robots.txty comprueba si algún agente tiene grupo propio. Si lo tiene, comprueba que ese grupo repite todo lo que quieres restringir. - Mira tus páginas con muchas impresiones y cero clics antes de reescribir sus titulares. Si las consultas que las traen son frases largas y completas —del tipo «necesito un proveedor que…»—, quien busca probablemente no es una persona, y el titular no es el problema.
Nada de esto es un canal nuevo que sustituya a lo anterior. Es un canal que ya estaba pasando por tu servidor sin que lo estuvieras contando.
Artículos relacionados
IA en acción
¿Quieres ver XERA en acción?
Habla directamente con XERA y descubre cómo puede automatizar las tareas repetitivas de tu negocio.
Respuesta en <30s · Sin compromiso · 24/7
¿Lo prefieres con día y hora cerrados?
Reserva una videollamada de 30 minEliges hueco y te llega la invitación al momento
Contenido Relacionado
Automatizar tu Gestoría en 2026: Guía Práctica para Despachos Profesionales
Guía completa para automatizar tu gestoría o despacho profesional en 2026. Qué automatizar, por dónde empezar y cómo XERA lo hace posible sin cambiar tu software fiscal.
Checklist IRPF 2026 para Gestorías: Calendario, Documentación y Errores que Cuestan Sanciones
Checklist completo IRPF 2026 para gestorías. Todas las tareas pre-campaña, durante y post-campaña. Automatiza con XERA y evita el caos de abril-junio.