Chats privados de Claude aparecieron en resultados de Google y Bing

Lo que ocurre entre tú y un chatbot de IA no siempre se queda entre tú y el chatbot. ¿No nos crees? Pregúntaselo a Google.
Durante el fin de semana, muchos se sorprendieron al descubrir que algunos chats de Claude podían encontrarse fácilmente mediante una búsqueda en internet. El problema, que fue denunciado inicialmente por un usuario de Reddit, reveló conversaciones en las que se pedía consejo sobre a qué partido político unirse, si los abogados de Kansas están obligados a autodenunciarse cuando creen haber cometido una infracción ética y juegos de rol eróticos.
Qué ocurrió con Claude
Claude permite a los usuarios compartir con otras personas sus conversaciones mediante la creación de una URL pública que enlaza a un hilo específico del chatbot. El hecho de que algunas de estas URL fueran indexadas por los principales motores de búsqueda se debe a las funciones básicas de los sitios web, los motores de búsqueda y la interacción entre ambos cuando entra en juego la IA generativa.
Básicamente, Anthropic instruye a los rastreadores web, como los que usan los motores de búsqueda como Google y Bing, para que no indexen los chats que un usuario decide compartir con otras personas. La empresa lo hace mediante un archivo llamado robots.txt, que desde hace tiempo se considera el método estándar para indicar a los rastreadores web qué partes de un sitio son apropiadas para acceder. El archivo robots.txt de Anthropic ha impedido que los rastreadores web indexen los chats compartidos desde al menos septiembre de 2025, según una captura de pantalla de Wayback Machine.
Sin embargo, evitar que las páginas aparezcan en los resultados de los motores de búsqueda es más difícil que eso.
Puedes evitar los resúmenes de la IA de Google en tus resultados de búsqueda simplemente ajustando tu consulta o cambiando de motor de búsqueda.
La etiqueta "no indexar"
Bing, que sigue mostrando alrededor de 612 resultados si se busca "site:claude.ai/share" en el momento de redactar este artículo, indica en su documentación técnica que los desarrolladores pueden bloquear los rastreadores web del motor de búsqueda mediante el archivo robots.txt, pero que los desarrolladores web también deberían incluir una etiqueta "noindex" en cada una de las páginas.
Algunas de las conversaciones que aparecían en los resultados de búsqueda señaladas en la publicación de Reddit ya habían sido eliminadas cuando WIRED las consultó, y los resultados ya no aparecen en Google al realizar la búsqueda con la consulta "share", que aún funcionaba en Bing. En una guía para desarrolladores, Google puede ignorar las instrucciones del archivo robots.txt si otra página de internet enlaza a ese contenido y su propietario no añade una etiqueta HTML "noindex" o un encabezado "X-Robots-Tag" para impedir que aparezca en los resultados de búsqueda.
WIRED revisó una muestra de las páginas de chat de Claude que quedaron expuestas y descubrió que no incluían la etiqueta "noindex", que tanto Bing como Google afirman tener en cuenta a la hora de decidir si indexan o no una página.
Microsoft, propietaria de Bing, no hizo declaraciones antes de la publicación. Anthropic tampoco respondió a las múltiples solicitudes de comentarios.
El portavoz de Google, Ned Adriance, explica a WIRED que la indexación de los chats compartidos de Claude es responsabilidad de Anthropic. "Ni Google ni ningún otro motor de búsqueda controla qué páginas se hacen públicas en la web, y estas fueron indexadas por muchos motores de búsqueda. Ofrecemos a los propietarios de los sitios controles claros para decidir si las páginas pueden ser rastreadas o indexadas, y siempre respetamos esas directrices", afirma Adriance.
Anthropic no respondió a las preguntas sobre por qué no incluyó la etiqueta "noindex" en las páginas de chats compartidos.
El pasado mes de septiembre, Anthropic fue objeto de críticas por el mismo motivo y declaró a Forbes que utiliza el archivo robots.txt para indicar a los rastreadores que no deben acceder a los chats compartidos. Sin embargo, tal y como señala el informe de Forbes, no hay garantía de que eso impida que los motores de búsqueda indexen páginas web concretas.
Aunque el archivo robots.txt no siempre funciona para evitar que las páginas sean indexadas en los motores de búsqueda, los laboratorios de IA siguen utilizándolo para otros fines. Muchos prometen a los creadores que sus sitios web no se utilizarán como material de entrenamiento para la IA siempre y cuando los desarrolladores se aseguren de "prohibir" el acceso a determinados rastreadores en sus archivos robots.txt, y los propios laboratorios también siguen ese consejo.
¿Se puede evitar que la IA filtre el chat?
Anthropic, Meta y OpenAI incluyen instrucciones en los archivos robots.txt de sus chatbots que "prohíben" a los rastreadores web de sus competidores acceder a cualquier parte del sitio web donde se alojan los chatbots. OpenAI y Meta no respondieron a una solicitud de comentarios sobre esta práctica. Google tampoco respondió a las preguntas sobre el hecho de que sus competidores estén bloqueando el acceso de su rastreador de entrenamiento de IA, Google-Extended, a los sitios web de sus chatbots.
Aunque los chats compartidos ya no aparecen en los resultados de Google, las páginas que WIRED ha revisado siguen sin tener una etiqueta "noindex", lo que significa que podrían volver a aparecer en los motores de búsqueda. Los usuarios de Claude pueden ir a Ajustes > Privacidad > Chats compartidos para gestionar el acceso y mantener la privacidad de sus conversaciones.
Información adicional de Andrew Couts.
Artículo originalmente publicado en WIRED. Adaptado por Alondra Flores.