Fuite Claude AI : des centaines de conversations privées contenant des données de santé et juridiques indexées par Google et Bing
L'IA Claude d'Anthropic n'a pas correctement masqué les URL des conversations partagées des moteurs de recherche, ce qui a fait apparaître dans les résultats Google et Bing des centaines de conversations contenant des dossiers médicaux, des documents internes et des numéros de téléphone d'enfants.
Découverte
Le week-end dernier, des utilisateurs de Reddit sont tombés sur une faille de confidentialité : en tapant l'opérateur de recherche "site :claude.ai/share" dans Google, une longue liste de conversations et d'Artifacts Claude (des mini-applications et documents interactifs) que tout le monde pouvait ouvrir s'affichait. Lundi, l'information a été rapportée par 404 Media, Axios, WIRED et d'autres médias, confirmant que des liens partageables destinés à une diffusion limitée avaient été balayés dans les index de Google, Bing, Brave Search, Ecosia et DuckDuckGo. Le bouton de partage de Claude prévient que "toute personne disposant du lien peut le voir", mais n'explique pas que le lien peut se retrouver dans les caches des moteurs de recherche.
Nous donnons aux gens le contrôle sur le partage public de leurs conversations Claude, et conformément à nos principes de confidentialité, nous ne partageons pas les répertoires de conversations ni les sitemaps avec les moteurs de recherche comme Google.
Pourquoi les liens ont été indexés
Le fichier robots.txt d'Anthropic indique aux robots d'exploration de ne pas toucher aux URL des conversations partagées depuis au moins septembre 2025, selon des captures sur la Wayback Machine. Néanmoins, Google et Bing recommandent tous deux aux développeurs d'inclure également une balise meta "noindex" sur les pages individuelles qu'ils souhaitent exclure des résultats. WIRED a examiné un échantillon des pages Claude exposées et a constaté qu'aucune ne portait cette balise. Le guide du développeur de Google indique qu'il peut ignorer robots.txt si la page est liée depuis ailleurs et ne comporte pas de directive noindex explicite. Parce que les gens ont partagé leurs URL Claude sur Reddit, X et des forums, ces liens ont été récupérés par les robots d'exploration et intégrés dans les résultats de recherche.
Ni Google ni aucun autre moteur de recherche ne contrôle quelles pages deviennent publiques sur le web, et ces pages ont été indexées par de nombreux moteurs de recherche.
La documentation de Bing reflète cela : bloquer un robot d'exploration avec robots.txt seul peut ne pas empêcher l'indexation. Lundi soir, une recherche Bing pour "site :claude.ai/share" renvoyait encore environ 612 résultats.
Des données sensibles exposées
La BBC a dénombré plus de 200 conversations sur au moins 25 pages de résultats de recherche, mais La Vanguardia a estimé le total à des milliers. Le contenu était saisissant. Futurism a trouvé un rapport médical détaillé d'un patient, des résultats d'essais cliniques avec des noms, des documents contenant des numéros de téléphone d'enfants d'école primaire, des fichiers internes d'entreprise et des évaluations d'employés contenant des informations personnelles. 404 Media a découvert une application de thérapie IA codée par vibe, des notes de réunion et des données de facturation médicale. Un artifact s'opposait à la dissolution d'une agence municipale de Miami chargée de la gestion des parcs ; un autre proposait des modifications au calendrier universitaire d'une université. Des plans d'affaires, des diagrammes d'infrastructure multi-cloud et des documents de planification d'essais cliniques ont également fait surface. Des utilisateurs ont demandé des conseils de carrière et partagé des CV avec des coordonnées complètes, se sont interrogés sur les obligations éthiques des avocats au Kansas, ont joué des scénarios érotiques et débattu d'affiliations politiques. Un chat d'avril montrait un utilisateur demandant à "devenir un renard à neuf queues", Claude affirmant donner des "pouvoirs de renard pleinement fonctionnels".
Nettoyage et conséquences
Après que le problème soit devenu viral, Anthropic a pris des mesures pour corriger l'exposition. Lundi après-midi, une requête test de TechCrunch sur Google n'a renvoyé aucun résultat. La BBC a noté que de nombreux journaux de discussion avaient déjà été sauvegardés et largement partagés en ligne avant d'être retirés. La déclaration d'Anthropic a maintenu que les liens "ne sont pas devinables ou découvrables à moins que les gens ne choisissent de les partager eux-mêmes". L'incident fait suite à un incident similaire en juin 2025, lorsque des conversations de chatbot Meta AI sont apparues accidentellement dans un flux public. L'épisode Claude montre qu'une fonctionnalité conçue pour un partage rapide peut devenir un risque pour la vie privée lorsque les mécanismes d'indexation web sont négligés.
- Un utilisateur de Reddit découvre des conversations Claude publiquement consultables
- 404 Media rapporte l'exposition en premier
- La recherche Google ne renvoie aucun résultat pour la requête site:claude.ai/share
- WIRED constate que Bing affiche encore environ 612 résultats


