Ir al contenido

Qué significa aparecer en las respuestas de ChatGPT, Google y Perplexity

Qué necesita tu web para que un asistente de inteligencia artificial pueda citarla, qué depende de ti y qué nadie te puede garantizar.

Equipo SimplixityPublicado el Read in English

Un cliente te cuenta que le preguntó a ChatGPT por un negocio como el tuyo y le salieron otros. O te llega un mensaje que ofrece "ponerte en las respuestas de la IA". Es normal preguntarse qué hay de cierto en eso y qué puedes hacer tú.

Qué pasa cuando alguien le pregunta algo a un asistente

ChatGPT, Perplexity y las respuestas con IA de Google (llamadas AI Overviews y AI Mode) pueden buscar en internet antes de responder. Cuando lo hacen, a veces muestran enlaces a las páginas de donde sacaron la información. "Aparecer" quiere decir eso: que tu página sea una de esas fuentes enlazadas.

Para que sea posible, un programa de esa empresa tiene que poder entrar a tu web y leerla. A esos programas se les llama rastreadores: robots que recorren páginas para guardarlas y usarlas después.

Qué pide cada uno

Google

Google explica en su página AI features and your website que no hay requisitos extra para salir en sus respuestas con IA. La página tiene que estar indexada, es decir, guardada en el buscador. También tiene que poder mostrarse con un fragmento de texto en la búsqueda normal. Google aclara que no hace falta crear archivos especiales para IA ni código nuevo.

En su guía para las funciones de IA generativa, Google agrega que las buenas prácticas de siempre para buscadores siguen sirviendo. La razón que da: estas respuestas se apoyan en los mismos sistemas de la búsqueda. Dice además que no hace falta partir tu contenido en pedacitos para que la IA lo entienda.

ChatGPT

OpenAI tiene varios rastreadores y cada uno sirve para algo distinto, según su página sobre rastreadores:

  • OAI-SearchBot es el que permite que tu web salga en la búsqueda de ChatGPT.
  • GPTBot recoge contenido que puede usarse para entrenar sus modelos.
  • ChatGPT-User entra a una página cuando un usuario se lo pide.

Si bloqueas GPTBot, le indicas a OpenAI que no use tu contenido para entrenar. Eso es distinto de salir en la búsqueda. OpenAI dice que un cambio en tus reglas puede tardar unas 24 horas en aplicarse.

Perplexity

Según la documentación de Perplexity, PerplexityBot sirve para mostrar y enlazar sitios en sus resultados, y no se usa para entrenar modelos. Perplexity-User entra a páginas cuando un usuario hace una pregunta. La empresa dice que este último en general ignora las reglas de robots.txt.

Qué es robots.txt y por qué importa

robots.txt es un archivo de texto en tu web que les dice a los rastreadores qué pueden visitar y qué no. Google explica cómo lo lee en su especificación de robots.txt. Si ahí está bloqueado un rastreador de búsqueda, tu web no puede salir en esa herramienta, aunque el contenido sea muy bueno.

Permitir el entrenamiento de modelos es una decisión aparte. Google lo muestra con Google-Extended, el control que decide si tu contenido se usa para sus modelos Gemini. Según su lista de rastreadores, ese control no cambia si tu sitio sale en la Búsqueda de Google y no se usa para ordenar resultados.

Lo que no se puede garantizar

  • Google escribe en su guía que una página que cumple todos los requisitos no por eso va a ser rastreada, indexada o mostrada. Lo resume así: indexar y mostrar no están garantizados.
  • Google también advierte que ninguna herramienta externa tiene acceso a sus sistemas internos de clasificación o de IA. Si alguien te ofrece datos secretos de Google, desconfía.
  • No existe un archivo que te ponga en las respuestas. Hay una propuesta llamada llms.txt: un archivo con un resumen de tu web pensado para la IA. Google lo nombra en su guía y dice que su búsqueda ignora ese tipo de archivos, así que ni ayuda ni perjudica ahí. No hay evidencia publicada de que ayude en otros asistentes.
  • Nadie puede prometerte un puesto, un número de citas o una cantidad de visitas desde un asistente.

Si alguien te ofrece "hacerte aparecer en ChatGPT", pídele que te diga qué cambios concretos va a hacer en tu web y cómo vas a revisarlos.

Qué sí depende de ti

Esto es lo que puedes revisar:

  • Que tus páginas importantes estén indexadas en Google.
  • Que tu robots.txt no bloquee a los rastreadores de búsqueda que te interesan.
  • Que no tengas la etiqueta nosnippet en las páginas que quieres que citen. Es una instrucción que le pide a Google no mostrar fragmentos de tu texto, y Google la cuenta entre los controles que también aplican a sus respuestas con IA.
  • Que tu contenido responda con datos reales de tu negocio: qué haces, en qué zona, en qué horario, cómo se contrata y qué incluye. Google recomienda contenido propio, no textos genéricos que podría escribir cualquiera.

Pasos para esta semana

  1. Entra a Google Search Console, la herramienta gratuita de Google para dueños de sitios. Revisa si tus páginas principales están indexadas. Si no tienes cuenta, créala con el correo del negocio.
  2. Abre en el navegador la dirección de tu web seguida de /robots.txt. Busca los nombres Googlebot, OAI-SearchBot y PerplexityBot. Si debajo de alguno dice "Disallow: /", ese rastreador no puede entrar a ninguna página.
  3. Decide por separado si permites el entrenamiento: GPTBot para OpenAI y Google-Extended para Google. Bloquearlos no te saca de la Búsqueda de Google.
  4. Pídele a quien maneja tu web que confirme que no hay nosnippet ni noindex en las páginas que quieres mostrar. La etiqueta noindex le pide a Google no guardar la página.
  5. Escribe tres respuestas a preguntas que tus clientes te hacen seguido, con datos concretos, y ponlas en la página donde se buscan.
  6. En Search Console, abre el informe de rendimiento de IA generativa (Google lo explica aquí) para ver cómo le va a tu contenido.

Si quieres ayuda para revisar tu web, escríbenos.

Fuentes

  1. AI features and your websiteGoogle Search Central. consultada el
  2. Optimizing your website for generative AI features on Google SearchGoogle Search Central. consultada el
  3. Overview of OpenAI CrawlersOpenAI. consultada el
  4. Perplexity CrawlersPerplexity. consultada el
  5. Google's common crawlersGoogle Search Central. consultada el
  6. How Google interprets the robots.txt specificationGoogle Search Central. consultada el
  7. The /llms.txt filellmstxt.org. consultada el

Volver al blog