Sitio web

Define una política de robots.txt para rastreadores de IA y publícala de forma segura

Te ayuda a decidir a qué rastreadores de IA debe estar abierto el sitio, separando los roles de búsqueda, consulta a petición del usuario y entrenamiento. Muestra una vista previa de un nuevo robots.txt que conserva tus reglas actuales, lo escribe en tu sitio alojado o en WordPress tras tu aprobación y verifica que esté en línea.

Cuándo usarlo

Cuando no tienes claro qué rastreadores de IA permitir en tu sitio y quieres una política de robots.txt deliberada sin abrir áreas privadas por error.

Qué obtienes

Obtienes un nuevo robots.txt que conserva tus reglas actuales, organizado por rol de rastreador, con vista previa línea por línea, publicado tras tu aprobación y verificado en vivo.

¿Cambia algo en mi cuenta?

Solo con tu aprobación. El asistente muestra primero una vista previa de cada cambio y espera tu confirmación.

Funciona con

SEO Intelligence, WordPress

Completa antes de enviar

[site URL][Opus Growth hosting or WordPress]
Rehaz el robots.txt de mi sitio [site URL] en torno a una política deliberada para los rastreadores de IA. Tipo de sitio: [Opus Growth hosting or WordPress]. Mi preferencia: [A: open to all / B: search open, training closed / C: custom, explain]. 1. Lee el estado actual. Lee [site URL]/robots.txt con site_read_url. Si el sitio está en el hosting de Opus Growth, lee también robots.txt con site_read_file y confirma que coincide con lo que está publicado. Si es WordPress, averigua qué plugin de SEO lo gestiona con wordpress_seo y comprueba con wordpress_snippet action='list' si ya hay algún snippet que toque robots.txt. Enumera todos los grupos de reglas existentes, todas las líneas Disallow y todas las líneas Sitemap. 2. Explica los roles. Agrupa los rastreadores en tres grupos y dime en una frase cada uno qué pierdo o gano: 1. Búsqueda y citación: OAI-SearchBot, Claude-SearchBot, PerplexityBot, Bingbot, Googlebot, Applebot. Bloquearlos impide que el sitio se cite como fuente en las respuestas de ese asistente. 2. Consulta en vivo en nombre de un usuario: ChatGPT-User, Claude-User, Perplexity-User. Llegan cuando un usuario comparte mi enlace o cuando el asistente abre una página para responder. Según la documentación de los proveedores, es posible que robots.txt no se aplique en todos los casos a estas solicitudes iniciadas por el usuario, así que indica que una regla aquí no es una garantía. 3. Entrenamiento de modelos: GPTBot, ClaudeBot, Google-Extended, Applebot-Extended, CCBot, meta-externalagent. Bloquearlos limita el uso del contenido en futuros entrenamientos, pero no elimina el contenido de los modelos que ya fueron entrenados. Bloquear Google-Extended no afecta a la Búsqueda de Google ni a las AI Overviews. 3. Redacta el borrador. Prepara el nuevo robots.txt según mi preferencia y sigue estas reglas: 1. Cuando escribes un grupo con el nombre propio de un rastreador, ese rastreador deja de leer el grupo `User-agent: *`. Por eso, copia todas las líneas Disallow del grupo * (área de administración, carrito, resultados de búsqueda interna, etc.) en cada grupo con nombre; de lo contrario abrirás zonas privadas sin darte cuenta. 2. No bloquees archivos CSS, JavaScript ni de imagen, porque los rastreadores los necesitan para renderizar la página. 3. Conserva las líneas Sitemap existentes y añade la URL completa del sitemap si falta. 4. No bloquees ningún rastreador con rol de búsqueda a menos que yo lo pida explícitamente. 5. Deja en paz a los rastreadores SEO de la competencia (como AhrefsBot y SemrushBot) salvo que yo lo pida; quedan fuera del alcance de este trabajo. 4. Muestra una vista previa. Compara el archivo antiguo y el nuevo línea por línea, y muestra una tabla con la decisión anterior y la nueva para cada rastreador: rastreador, rol, decisión anterior, decisión nueva. Espera mi aprobación. 5. Aplica los cambios tras la aprobación. 1. Sitio alojado: escribe robots.txt con site_write_file. La plataforma toma una instantánea de versión antes de cada escritura, así que dime a qué versión de site_versions puedo volver. 2. WordPress: cuando no existe un archivo físico en el servidor, WordPress genera robots.txt por sí mismo y el filtro `robots_txt` puede modificarlo. Crea con wordpress_snippet un snippet de PHP que use este filtro, con ubicación 'everywhere'. El snippet se crea inactivo, así que muéstrame el código y actívalo solo después de que yo lo apruebe. Si hay un plugin de caché activo, limpia la caché con wordpress_purge_cache. 6. Vuelve a leerlo. Lee robots.txt de nuevo con site_read_url y demuestra que el nuevo contenido está en línea. En WordPress, si el contenido no cambió, significa que hay un archivo robots.txt físico en el servidor y el filtro no puede alcanzarlo. En ese caso, desactiva el snippet y guíame para cambiar el archivo desde el editor de archivos del plugin de SEO (Yoast: Herramientas, Editor de archivos; Rank Math: Ajustes generales, Editar robots.txt) o desde el panel del hosting. Termina con una nota de dos frases: el cambio surte efecto cuando los rastreadores vuelvan a leer el archivo (normalmente en un día), y si una regla de CDN o de firewall bloquea por nombre de rastreador, robots.txt por sí solo no es suficiente.

Resultado de ejemplo

Un ejemplo del resultado que da este prompt. La estructura procede de la salida real de las herramientas; cifras y nombres son ficticios.

Ejemplo de resultado (basado en un sitio ficticio, no en datos reales de clientes)

El archivo actual tiene dos grupos: User-agent: * (Disallow: /panel/, /cart/) y User-agent: GPTBot (Disallow: /). Tu preferencia es la B: búsqueda abierta, entrenamiento cerrado.

CrawlerFunciónDecisión anteriorDecisión nueva
OAI-SearchBotBúsquedaPermitidoPermitido
Claude-SearchBotBúsquedaPermitidoPermitido
PerplexityBotBúsquedaPermitidoPermitido
ChatGPT-UserConsulta del usuarioPermitidoPermitido
GPTBotEntrenamientoBloqueadoBloqueado
ClaudeBotEntrenamientoPermitidoBloqueado
Google-ExtendedEntrenamientoPermitidoBloqueado
CCBotEntrenamientoPermitidoBloqueado

Nota: el grupo GPTBot anterior no repetía las líneas /panel/ y /cart/. Era inofensivo, porque ese grupo cerraba todo el sitio, pero en el archivo nuevo ambas líneas se escriben en cada grupo con nombre.

Tras tu aprobación, robots.txt se escribió con site_write_file. site_read_url lo leyó en vivo, devolvió 200 y muestra el contenido nuevo. Para revertir, la versión de las 14:02 en site_versions conserva el archivo anterior.

Nota: los crawlers suelen volver a leer el archivo en el plazo de un día. Si una regla de firewall bloquea por nombre de crawler, robots.txt por sí solo no es suficiente.

Búsquedas relacionadas

Estos prompts funcionan mejor cuando tu asistente de IA está conectado a tus cuentas con Opus Growth.

Conecta tus cuentas gratis

Más prompts

Sitio webCambia tras tu aprobaciónDemo en vivo

Crea un sitio editorial de experto con sección de guías y schema de autor

Pide a tu asistente que construya el sitio de un experto con portada tipo revista, guías extensas y un perfil de autor. Tipografía serif, schema Article y Person y artículos fechados y con fuentes dan como resultado una publicación que la gente lee y que las respuestas de IA pueden citar.

Cuándo usarloCuando eres un experto, consultor o autónomo y tu web parece un folleto que no demuestra tu experiencia ni es citada por buscadores y respuestas de IA.

SEO Intelligence, Search Console
Sitio webCambia tras tu aprobaciónDemo en vivo

Crea el sitio de un negocio familiar con look clásico y estándares modernos

Pide a tu asistente que construya un sitio con el espíritu de una etiqueta antigua y un letrero de tienda para un productor de tercera generación, con marco y textura de papel. El aspecto es antiguo, la construcción es nueva: mobile first, sin JavaScript, fuentes alojadas en el propio sitio, WebP, schema Product y HowTo.

Cuándo usarloCuando diriges un negocio familiar de producción o una tienda y quieres un sitio con el aspecto de una etiqueta antigua y un letrero de comercio, pero que cargue rápido en el móvil y supere las pruebas de SEO y accesibilidad.

SEO Intelligence, Search Console
Sitio webCambia tras tu aprobaciónDemo en vivo

Crea una web minimalista suiza para un despacho jurídico o contable con señales de confianza

Hace que tu asistente construya un sitio estático para un despacho, sobre una cuadrícula estricta y con la jerarquía sostenida por una sola familia tipográfica. Incluye las señales de confianza que exige un sector YMYL: perfiles de los profesionales, una nota informativa fechada y con fuentes, textos que respetan las normas de publicidad profesional y schema Person.

Cuándo usarloCuando diriges un despacho de abogados o una asesoría contable y necesitas un sitio web creíble y rápido que genere confianza sin infringir las normas de publicidad profesional.

SEO Intelligence, Search Console
Sitio webCambia tras tu aprobaciónDemo en vivo

Crea un sitio corporativo multipágina sin JavaScript y entrégalo con puntuación 100

Pide a tu asistente que construya un sitio estático, rápido y accesible para un negocio corporativo como arquitectura, ingeniería o consultoría. El menú y el pie de página son HTML estático, las fuentes y el CSS están alojados por ti y cada página se mide antes de la entrega.

Cuándo usarloCuando necesitas un sitio corporativo de varias páginas, rápido y accesible, para un estudio de arquitectura, ingeniería o consultoría, sin nada de JavaScript.

SEO Intelligence, Search Console