Los tres tipos de animales que pueden ser confirmados según documentos oficiales:
OpenAI ha publicado tres agentes de usuario con diferentes propósitos, que pueden ser controlados por la plataforma: OAI-SearchBot: Se utiliza para crear índices de búsqueda y asegurar que el sitio web aparezca en los resultados de búsqueda de ChatGPT.; ChatGPT-User: Representa la solicitud inmediata del usuario para acceder al contenido de una página durante una conversación.; GPTBot: Se utiliza para la recopilación de datos para el entrenamiento del modelo. Cada uno de estos agentes tiene su propia sección en el archivo robots.txt, lo que significa que el bloqueo de GPTBot no implica la salida de ChatGPT de los resultados de búsqueda. Para que un sitio web sea visible en las búsquedas, es necesario permitir el acceso de OAI-SearchBot.
Los tres agentes de usuario de OpenAI: ¿para qué sirven?| User agent | Usos | Quiero que ChatGPT pueda encontrar y citar fuentes al buscar información. |
|---|
| OAI-SearchBot | Crear un índice de búsqueda y mostrar los enlaces. | Debe autorizarse. |
| ChatGPT-User | Los usuarios desean que la página se cargue de forma inmediata. | Recomendación: Dejar pasar |
| GPTBot | Recopilar datos para el entrenamiento de modelos. | De acuerdo con las políticas de uso y distribución, decida usted mismo. |
¿Cómo se producen las citas? ¿Cuáles son las que se pueden confirmar y cuáles no?
Se puede confirmar que: ChatGPT realiza búsquedas, sintetiza respuestas a partir de múltiples fuentes y proporciona enlaces a las fuentes junto con las respuestas. No se puede confirmar: cómo se clasifican las fuentes, por qué se elige A en lugar de B, y qué peso tienen las características del contenido. OpenAI no ha publicado esta información. La mayoría de los "estudios sobre factores de citación de ChatGPT" son inferencias realizadas por terceros sobre una muestra, y pueden ser útiles como referencia, pero al citar estas conclusiones, se debe indicar que son inferencias y no reglas del sistema. Nuestra postura: priorizar la verificación de los datos y utilizar la observación en lugar de la especulación.
Nuestro método de observación: conjunto de consultas fijas.
El procedimiento consiste en crear una lista de preguntas fijas, y realizar pruebas periódicas con ChatGPT, registrando los resultados. Los puntos clave son: Las preguntas deben enfocarse en "las preguntas que realmente haría un cliente al tomar una decisión" (por ejemplo, comparar servicios, preguntar sobre precios).; No se deben evaluar solo los nombres de las marcas, ya que estos solo reflejan el conocimiento existente.; Cada conversación debe ser nueva para evitar que el contexto influya en las respuestas.; Registrar la fecha, si se menciona la marca, y las fuentes y páginas web utilizadas para cada pregunta.; Repetir la misma serie de preguntas mensualmente para observar las tendencias, en lugar de obtener resultados únicos. Este método es de bajo costo: una simple tabla y un cumplimiento constante.
Es importante destacar las limitaciones de este método.
Los conjuntos de consultas fijas tienen limitaciones claras, y lo mencionamos en nuestro informe: las respuestas generadas por la IA son aleatorias, y hacer la misma pregunta dos veces puede dar resultados diferentes según la fuente; las respuestas están influenciadas por la cuenta, la región y la versión del modelo, por lo que lo que tú observes no es lo que ven todos los usuarios; además, cuando se actualizan los modelos o los productos, todo el conjunto de consultas puede perder su validez. Por lo tanto, solo pueden responder a "las tendencias relativas de nuestra marca en este conjunto de preguntas", pero no pueden inferir cuota de mercado o nivel de exposición. Cualquier informe que afirme "ser recomendado por ChatGPT" basándose en una única captura de pantalla debe ser considerado con escepticismo.
¿Qué se puede hacer con el contenido?
En lugar de perseguir algoritmos no públicos, es más útil establecer una base verificable, que sirva tanto a la búsqueda tradicional como a todas las plataformas de IA: asegurarse de que OAI-SearchBot pueda acceder a las páginas (verificando los archivos robots.txt y los WAF); que el contenido importante esté en formato de texto dentro del HTML, y no oculto en elementos interactivos; que la estructura de escritura sea de "respuesta primero", es decir, responder primero a la pregunta y luego ampliarla; que haya evidencia y autores identificados, ya que solo el contenido verificable tiene valor para ser citado; y que el nombre de la marca y la información de la empresa sean consistentes en toda la web, para evitar confusiones.
¿Cómo se mide el tráfico después de que se haya citado?
La URL de referencia oficial de OpenAI para ChatGPT, que incluye automáticamente "utm_source=chatgpt.com", permite crear grupos en GA4 utilizando tanto la fuente como la fuente de sesión. Esto permite analizar el rendimiento de las páginas de destino, los casos de estudio, las llamadas a la acción y las consultas. Sin embargo, esto no significa que todas las interacciones con ChatGPT puedan ser rastreadas. Si no hay clics, los datos de llegada a la página pueden no estar disponibles. Además, las aplicaciones abiertas, las restricciones de privacidad, las redirecciones o la eliminación de parámetros pueden resultar en que se atribuyan a referencias o tráfico directo. Es importante revisar tanto las etiquetas UTM como los encabezados de referencia, y evaluar el valor en función de las consultas posteriores, en lugar de simplemente contar el número de sesiones.