Un utilisateur de Reddit a découvert le 25 juillet que des centaines de conversations privées avec l’IA Claude étaient consultables publiquement sur Google, révélant des données sensibles des utilisateurs, notamment des identifiants de portefeuilles crypto, des numéros de Sécurité sociale apparemment, ainsi que des discussions juridiques. L’exposition s’explique par l’absence d’une balise meta noindex dans la fonctionnalité de partage de liens d’Anthropic, qui a permis aux moteurs de recherche d’indexer les liens de conversations partagées, malgré l’existence d’un fichier robots.txt. L’incident fait écho à une exposition de données similaire qui avait touché ChatGPT 11 mois plus tôt, lorsque la fonctionnalité de partage des conversations d’OpenAI avait rendu des milliers de discussions accessibles via les moteurs de recherche.
Un utilisateur de Reddit a effectué le 25 juillet une recherche Google ciblée sur un site, avec la requête « site:claude.ai/share », qui a renvoyé des centaines de conversations Claude entièrement lisibles. Les résultats de recherche ont exposé un large éventail de contenus sensibles : un avocat demandant s’il devait se déclarer au sujet d’une violation de l’éthique professionnelle, un utilisateur collant une phrase de récupération (seed phrase) de portefeuille crypto, et diverses discussions personnelles. Le fil Reddit documentant la découverte a reçu 4 000 votes positifs.
Le même manque d’indexation a affecté la fonctionnalité d’artefacts publiés de Claude. Une recherche pour « site:claude.ai/public/artifacts » a fait apparaître des tableurs de paie avec les noms des employés, des exports de conversations internes de gestion de la relation client, ainsi que des feuilles de route de produits non publiées. Chaque lien partagé avec Claude portait l’étiquette « Anyone with the link », mais l’indexation signifiait que Google avait aussi accès.
L’exposition s’est produite parce qu’Anthropic n’avait pas ajouté de balise meta noindex à sa fonctionnalité de partage. Cette instruction HTML unique indique aux moteurs de recherche de ne pas lister une page dans les résultats de recherche. La fonctionnalité de partage d’Anthropic était conçue pour fonctionner comme une vidéo YouTube non répertoriée—accessible uniquement via un lien direct—mais sans la balise noindex, chaque lien de partage publié dans des forums publics, sur des tweets ou dans des espaces de travail Slack devenait une page web entièrement indexée.
Le fichier robots.txt d’Anthropic était déjà en place et bloquait l’accès des robots aux URL de partage de Claude. Toutefois, la documentation de Google précise que le blocage d’un crawl n’empêche pas l’indexation si l’URL apparaît ailleurs sur le web. Le robot ne peut pas ouvrir la page bloquée, ce qui signifie qu’il ne peut pas non plus voir l’instruction noindex à l’intérieur. Les conversations ont alors été visibles dans les résultats de recherche Google, avec la mention « No information is available for this page »—Google a identifié le lien à partir de publications de tiers, sans pouvoir décrire le contenu.
Google a commencé à retirer les résultats liés à Claude dès le 26 juillet après qu’Anthropic a mis à jour sa configuration et ajouté des balises noindex. Cependant, Bing a continué à afficher des liens partagés au moment de la publication. Anthropic n’avait émis aucune déclaration publique au moment de la publication.
Un dépôt GitHub appelé Shared-Claude-Chats a archivé 453 conversations Claude et 519 discussions Grok provenant des liens exposés avant suppression—11 241 messages en texte brut. Les données archivées restent accessibles malgré le correctif d’indexation.
Les utilisateurs d’Anthropic peuvent révoquer leurs propres conversations partagées en allant dans Settings → Privacy → Shared Chats. Cette action stoppe l’accès futur aux liens partagés. La révocation ne supprime pas les copies déjà enregistrées par des tiers ni les dépôts archivés.
ChatGPT a connu un incident similaire 11 mois auparavant. La case « Make this chat discoverable » d’OpenAI a envoyé des milliers de conversations à Google, Bing et DuckDuckGo, jusqu’à ce que le CISO d’OpenAI, Dane Stuckey, supprime la fonctionnalité, la qualifiant « d’une expérience de courte durée visant à aider les gens à découvrir des conversations utiles ». Beaucoup de ces discussions se sont retrouvées dans l’Internet Archive avant qu’OpenAI ne puisse les retirer, et restent accessibles.
Qu’a découvert l’utilisateur de Reddit le 25 juillet ?
Un utilisateur de Reddit a découvert le 25 juillet qu’une recherche Google pour « site:claude.ai/share » renvoyait des centaines de conversations d’IA Claude entièrement lisibles, révélant des données sensibles, notamment des identifiants de portefeuilles crypto, des numéros de Sécurité sociale apparemment, ainsi que des discussions juridiques.
Pourquoi les conversations Claude étaient-elles indexées par Google ?
Les conversations Claude ont été indexées parce qu’Anthropic n’avait pas ajouté de balise meta noindex à sa fonctionnalité de partage. Bien que le fichier robots.txt d’Anthropic bloque l’accès des robots, Google pouvait encore indexer les URL apparaissant sur des sites publics, des forums ou des publications sur les réseaux sociaux.
Comment les utilisateurs peuvent-ils révoquer leurs conversations Claude partagées ?
Les utilisateurs peuvent révoquer des conversations partagées en allant dans Settings → Privacy → Shared Chats dans leur compte Claude. Cela stoppe l’accès futur aux liens partagés, mais ne supprime pas les copies déjà enregistrées par des tiers.
Actualités associées
Nvidia lance l’Open Secure AI Alliance avec Microsoft, SpaceX et IBM
Les chats de Claude AI indexés par Google exposent les données des portefeuilles cryptographiques
En 1987, la conjecture de Jacobi a été percée par Claude ; Altman affirme être « en plein dans la singularité ».
Les entreprises Neocloud subissent une pression sur le crédit tandis que les ratios d’endettement liés à l’IA atteignent 739x.