Servicios · informe por dominio
¿Cómo se comporta tu web ante los agentes?
Cada vez más lecturas de una web no las hace una persona, sino un sistema automático que resume, cita o copia. Analizamos lo que tu sitio le dice a esos sistemas y lo que pasa cuando se portan bien: si hay reglas nombradas para ellos, si existe un resumen legible, si la caché condicional funciona y si la autoría se puede leer sin interpretar el diseño.
Qué se comprueba
robots_existe
robots.txt legible
Indica reglas públicas de rastreo; detectamos si responde y puede interpretarse.
robots_agentes_ia
Reglas explícitas para agentes de IA
Detectamos tokens conocidos sin inferir qué hará cada sistema.
llms_txt
llms.txt publicado
Resume en texto plano qué se puede usar y cómo citarlo.
sitemap
Sitemap declarado y accesible
Reduce el rastreo a ciegas y hace medible qué se ha leído.
condicional
Caché condicional (ETag o Last-Modified)
Permite que un agente educado reciba 304 en vez de descargar de nuevo.
condicional_304
Respuesta 304 ante petición condicional
Comprueba que la caché no solo se anuncia, sino que funciona.
condiciones_visibles
Condiciones de uso enlazadas desde la portada
Un agente necesita encontrar los términos sin adivinar la URL.
datos_estructurados
Datos estructurados en la portada
Hace que autoría y fecha se puedan leer sin interpretar el diseño.
canonica
URL canónica declarada
Evita que una misma página se cite con direcciones distintas.
novedades
Canal de novedades (RSS o Atom)
Permite seguir cambios sin repetir el rastreo completo.
Cómo funciona
- 1. Solicitud con autorización. Declaras que puedes autorizar el análisis de ese dominio. Queda registrada con fecha y texto, vale 90 días y la puedes retirar cuando quieras desde tu área privada: al retirarla dejamos de analizar.
- Un informe por dominio cada 24 horas. El límite se reserva antes de hacer ninguna petición a tu web, así que no se puede duplicar por accidente.
- 2. Verificación de control. Publicas un código en un registro TXT (_observatorio.tu-dominio) o en /.well-known/observatorio-de-agentes.txt.
- 3. Análisis externo. Leemos solo recursos públicos y pensados para máquinas: robots.txt, llms.txt, sitemap.xml y la portada. Son unas pocas peticiones, y el informe dice cuántas fueron.
- 4. Informe con versión. Cada comprobación sale como detectado, no detectado o no evaluable, con la evidencia técnica y comparada con un grupo de referencia de medios españoles (solo proporciones, nunca dominios concretos).
Límites, dichos antes de empezar
- No analizamos ningún dominio sin autorización declarada y control verificado.
- No entramos en zonas privadas, no rodeamos protecciones y no probamos contraseñas ni vulnerabilidades. Esto no es una auditoría de seguridad.
- Aplicamos robots.txt a cada recurso y a nuestro agente. Si una ruta no está permitida, esa comprobación queda «no evaluable»: no se fuerza.
- Describimos conducta observable del sitio. No atribuimos identidad, intención ni infracción a ningún tercero.
- Los datos de cliente son privados: nunca entran en las cifras públicas del observatorio.
Panel continuo (después)
El siguiente paso es un panel que mida en continuo qué sistemas leen tu sitio y cómo se comportan, con un fragmento de código en tus páginas. Todavía no está abierto: desde tu área puedes apuntarte a la lista de espera y contarnos qué necesitas medir.
En esta primera entrega no hay cobro. Consulta también el aviso de tratamiento de datos y la política de acceso automatizado que aplicamos a nosotros mismos.