ZONA $ Claude > Google > Anthropic

FALLA DE PRIVACIDAD

Escándalo en Claude: filtraron chats privados en Google por un error de Anthropic

Descubrí por qué conversaciones compartidas de Claude terminaron en Google y Bing y qué falló en el sistema de Anthropic. El problema podría repetirse.

En pocas palabras

  • Filtración de chats: Conversaciones privadas de Claude fueron indexadas en Google y Bing debido a un error de Anthropic.
  • Falla técnica: Anthropic no implementó correctamente la etiqueta "noindex", permitiendo que los buscadores indexaran los chats compartidos.
  • Riesgo persistente: Aunque los resultados se eliminaron, la falta de la etiqueta "noindex" en las páginas expuestas podría generar futuras indexaciones.
Resumen generado por Thinkindot AI

El fin de semana pasado, usuarios descubrieron que algunas conversaciones compartidas de Claude podían encontrarse fácilmente con una búsqueda en Google o Bing. El hallazgo, que fue reportado primero en Reddit, expuso chats donde personas pedían consejos sobre qué partido político unirse, consultaban sobre obligaciones éticas de abogados en Kansas, y mantenían juego de roles erótico.

Anthropic no respondió a las consultas de Wired sobre el incidente. Google dijo que la responsabilidad es de Anthropic. Bing, al momento de publicación, todavía mostraba alrededor de 612 resultados al buscar chats de Claude.

Claude permite compartir conversaciones mediante URLs públicas, un mecanismo pensado para facilitar el intercambio entre usuarios.

Claude permite compartir conversaciones mediante URLs públicas, un mecanismo pensado para facilitar el intercambio entre usuarios.

Cómo funciona el sistema que falló

Para entender qué salió mal hay que entender cómo se supone que funciona el sistema. Claude permite a los usuarios compartir "snapshots" de sus conversaciones generando una URL pública que pueden enviar a otras personas. Esas URLs no deberían aparecer en los resultados de búsqueda.

Para evitarlo, Anthropic usa algo llamado robots.txt, un archivo estándar que le indica a los rastreadores web de los buscadores qué partes de un sitio pueden indexar y cuáles no.

Según una captura del archivo en Wayback Machine, Anthropic tiene marcados los chats compartidos como prohibidos para rastreadores desde al menos septiembre de 2025.

El problema es que robots.txt no es suficiente.

Tanto Google como Bing documentan en sus guías técnicas que para garantizar que una página no aparezca en resultados de búsqueda, los desarrolladores deben agregar también una etiqueta "noindex" directamente en cada página individual.

Sin esa etiqueta, si la página está enlazada desde otro lugar en internet, los buscadores pueden indexarla de todas formas ignorando las instrucciones del robots.txt.

Wired revisó una muestra de las páginas de chats expuestas y confirmó que ninguna incluía esa etiqueta noindex. Anthropic no respondió preguntas sobre por qué no la habían incluido.

Los chats dejaron de aparecer en Google, pero las páginas seguían sin la configuración técnica recomendada para impedir futuras indexaciones.

Los chats dejaron de aparecer en Google, pero las páginas seguían sin la configuración técnica recomendada para impedir futuras indexaciones.

No es la primera vez

Este no es un problema nuevo para Anthropic. En septiembre pasado, la empresa recibió críticas por el mismo motivo y le dijo a Forbes que usaba robots.txt para indicar a los rastreadores que no accedieran a los chats compartidos.

La respuesta era técnicamente correcta pero prácticamente insuficiente, como quedó demostrado este fin de semana.

Los chats que aparecían en Google al momento del reporte de Wired ya no están visibles en ese buscador.

Pero las páginas revisadas por la revista todavía no tienen la etiqueta noindex, lo que significa que podrían volver a aparecer en resultados de búsqueda.

La ironía del ecosistema

Hay un detalle adicional. Anthropic, Meta y OpenAI incluyen en sus propios archivos robots.txt instrucciones que bloquean los rastreadores de IA de sus competidores para que no accedan a sus sitios y usen ese contenido como datos de entrenamiento.

Es decir: las mismas empresas que dependen de datos de internet para entrenar sus modelos se protegen mutuamente bloqueando el acceso a sus plataformas.

Google no respondió a las preguntas de Wired sobre el hecho de que sus competidores bloquean específicamente a Google-Extended, el rastreador de entrenamiento de IA de la empresa, en sus sitios de chatbots.

Qué pueden hacer los usuarios ahora

Los usuarios de Claude que hayan compartido conversaciones pueden gestionar el acceso desde Configuración, en la sección de Privacidad, bajo "Chats compartidos".

Desde ahí es posible revocar el acceso a cualquier conversación que se haya compartido previamente.

La lección es que compartir una conversación con un chatbot, incluso de manera que parece controlada, implica crear una URL pública en internet. Y en internet, lo que tiene una URL pública puede terminar siendo indexado, archivado o encontrado por alguien que no era el destinatario original.

Los sistemas técnicos para evitarlo existen, pero requieren que las empresas los implementen correctamente. Esta vez, Anthropic no lo hizo.

-------------

Más contenido en Urgente24

Plan A: vida social sin parar; B: mascotas; C: robot chino novio/a; y D: ¿panda con IA de peluche?

Sedentarismo a la fuerza: 20% de la gente pasa más de 6 horas-culo por día

Qué hará Milei con los 233.000 adultos mayores que pierden la jubilación por no reunir los aportes

El dinero para la IA provoca vértigo en los mercados y temen defaults

Rosalía sumó otro papelón en Chile y ahora la tienen entre ceja y ceja: "No pega una"

FUENTE: Urgente24, Wired