Un usuario de Reddit descubrió recientemente que, al introducir en Google el comando de búsqueda «site:claude.ai/share», se pueden recuperar cientos de registros de conversaciones con Claude, exponiendo más de 200 conversaciones. El contenido abarca al menos 25 páginas de resultados de búsqueda, y algunas conversaciones ocurrieron hace semanas. Anthropic ya corrigió añadiendo la etiqueta noindex, y Google eliminó de los resultados de búsqueda relacionados el 26 de julio.
Tipos de contenido filtrado: credenciales de criptomonedas, datos de pacientes de ensayos clínicos y planes de productos no publicados por empresas
(Fuente: Reddit)
Tras realizar pruebas, los internautas descubrieron que las conversaciones filtradas de Claude abarcan diversos tipos de información sensible personal y empresarial:
· Credenciales de carteras de criptomonedas
· Supuesto número de Seguro Social
· Asesoría legal y registros de salud (incluyendo nombres completos, edad, sexo, raza y fechas de tratamiento de pacientes de ensayos clínicos)
· Documentos internos de empresas (nóminas, registros de conversaciones del sistema CRM y planes de productos aún no publicados)
· Nombres de niños y números de teléfono
· Datos de ubicación (una base de datos de «recolección de datos de ubicación» que presuntamente incluye direcciones y códigos de acceso a apartamentos)
Om Patel (fundador de BigIdeasDB) añadió que la filtración no se limita a los registros de conversación, sino que también incluye interacciones generadas por la función «Artifacts» de Claude: pequeños programas y documentos.
Causa técnica raíz: ausencia de la etiqueta noindex y limitaciones del robots.txt
La causa directa de esta filtración fue que las páginas de compartido de Claude carecían de la etiqueta «noindex». Anthropic ya había configurado, desde septiembre de 2025, instrucciones en robots.txt para que los rastreadores de motores de búsqueda no accedieran a los enlaces de compartido, pero esto no fue suficiente: según la documentación para desarrolladores de Google, si una página ya está enlazada por otros sitios, para que Google decida si indexarla, la página misma debe incluir la etiqueta noindex o bien añadir x-robots-tag en el encabezado de respuesta para impedir realmente su indexación.
El medio 《Wired》, tras revisar las páginas filtradas, confirmó que efectivamente no incluyen la etiqueta noindex; esto también explica parte de los resultados de búsqueda que muestran «no hay información relevante para esta página». Google sabe que existe el enlace, pero no puede leer el contenido de la página; el mismo problema también se observó en la página pública de Artifacts de Claude.
Progreso de la corrección y el problema del “sellado” permanente: 453 conversaciones ya fueron archivadas
(Fuente: Claude)
Anthropic ya agregó la etiqueta noindex, y alrededor del 26 de julio Google empezó a retirar de los resultados de búsqueda las entradas relacionadas con Claude; pero al cierre de la redacción, Bing aún podía encontrar parte del contenido. Lo que ya no se puede revertir es que, en GitHub, el repositorio llamado «Shared-Claude-Chats» quedó archivado de forma permanente: 453 conversaciones de Claude y 519 conversaciones de Grok, con un total de 11,241 mensajes, todo almacenado en formato de texto plano.
Este incidente no es el primero: ChatGPT también experimentó un caso casi idéntico hace 11 meses (la función «Hacer que esta conversación pueda encontrarse» provocó que miles de conversaciones fueran indexadas por motores de búsqueda; la función ya fue retirada); el año pasado, Anthropic también tuvo un caso similar en el que aproximadamente 600 conversaciones fueron recogidas por Google.
Preguntas frecuentes
¿Cuál es la causa técnica directa que provocó la filtración de las conversaciones de Claude?
La causa directa es que las páginas de compartido de Claude carecían de la etiqueta «noindex». Aunque Anthropic ya tenía robots.txt configurado desde septiembre de 2025, según la explicación para desarrolladores de Google, para las páginas que ya han sido enlazadas por otros sitios, Google necesita que la página misma incluya la etiqueta noindex para impedir completamente la indexación en búsquedas; tras revisar las páginas filtradas, el medio 《Wired》 confirmó que estas páginas no tenían esa etiqueta. Anthropic corrigió el problema añadiendo la etiqueta noindex después del incidente.
Aunque Anthropic haya reparado, ¿las conversaciones filtradas del pasado ya quedaron guardadas de forma permanente?
Sí. En GitHub, el repositorio llamado «Shared-Claude-Chats» ha archivado 453 conversaciones de Claude y 519 conversaciones de Grok, un total de 11,241 mensajes, almacenados de forma permanente en texto plano; además, al momento del reporte, Bing aún podía buscar parte del contenido. Los usuarios pueden administrar las conversaciones compartidas en la sección de privacidad configurada por Claude, pero el contenido ya archivado no puede eliminarse a través de esa opción.
¿Cómo respondieron Anthropic y Google a este incidente?
El portavoz de Anthropic, Amie Rotherham, indicó que los enlaces de compartido no son adivinables: si un usuario elige compartir, equivale a publicarlo, como ocurre con otros contenidos públicos de internet que pueden ser guardados por terceros; el portavoz de Google, Ned Adriance, señaló que los motores de búsqueda no pueden controlar qué páginas se publican en internet, y que Google ofrece herramientas claras para que los propietarios de sitios decidan si una página debe ser indexada, y que siempre respeta esas configuraciones.