Un ejemplo del resultado que da este prompt. La estructura procede de la salida real de las herramientas; cifras y nombres son ficticios.
Ejemplo de resultado (basado en un sitio ficticio, no en datos reales de clientes)
El archivo actual tiene dos grupos: User-agent: * (Disallow: /panel/, /cart/) y User-agent: GPTBot (Disallow: /). Tu preferencia es la B: búsqueda abierta, entrenamiento cerrado.
| Crawler | Función | Decisión anterior | Decisión nueva |
|---|
| OAI-SearchBot | Búsqueda | Permitido | Permitido |
| Claude-SearchBot | Búsqueda | Permitido | Permitido |
| PerplexityBot | Búsqueda | Permitido | Permitido |
| ChatGPT-User | Consulta del usuario | Permitido | Permitido |
| GPTBot | Entrenamiento | Bloqueado | Bloqueado |
| ClaudeBot | Entrenamiento | Permitido | Bloqueado |
| Google-Extended | Entrenamiento | Permitido | Bloqueado |
| CCBot | Entrenamiento | Permitido | Bloqueado |
Nota: el grupo GPTBot anterior no repetía las líneas /panel/ y /cart/. Era inofensivo, porque ese grupo cerraba todo el sitio, pero en el archivo nuevo ambas líneas se escriben en cada grupo con nombre.
Tras tu aprobación, robots.txt se escribió con site_write_file. site_read_url lo leyó en vivo, devolvió 200 y muestra el contenido nuevo. Para revertir, la versión de las 14:02 en site_versions conserva el archivo anterior.
Nota: los crawlers suelen volver a leer el archivo en el plazo de un día. Si una regla de firewall bloquea por nombre de crawler, robots.txt por sí solo no es suficiente.