Le 27 juillet, Anthropic et des moteurs de recherche comme Google, Bing et DuckDuckGo ont retiré du moteur de recherche le contenu lié au site de Claude après la révélation d’une fuite massive d’informations personnelles à propos de Claude ; toutefois, les moteurs de recherche ont aussi omis de supprimer l’autre fuite de données, celle des utilisateurs de Perplexity.
Omission après la correction de la faille de Claude
Le 25 juillet 2026, un billet sur Reddit a révélé un problème de recherche lié à Claude, affirmant que certaines conversations indexées contenaient des identifiants, des CV, des informations internes à l’entreprise et des discussions privées ; l’information s’est rapidement propagée, et les moteurs de recherche ont retiré l’annuaire de partage public de Claude de l’index. Cependant, lorsqu’ils ont traité le problème de Claude, ils ont oublié de traiter en parallèle une situation similaire chez Perplexity : la recherche de « Claude » renvoie désormais zéro résultat, mais la recherche de « Perplexity » renvoie encore une liste sur plusieurs pages.
La cause fondamentale de la faille de Claude est que les liens partageables n’étaient pas correctement configurés avec une balise noindex ou d’autres accords de protection de la vie privée, ce qui a conduit les moteurs de recherche à indexer automatiquement les liens des clients et le contenu des documents associés.
Le mécanisme de fuite de données de Perplexity Computer
Protos, en utilisant une structure d’URL standard pour les liens partageables, peut accéder, via des recherches sur Google, Bing et DuckDuckGo, à des dizaines de fichiers complets de Perplexity Computer provenant de différents clients. Ces documents ne sont pas de simples caches des moteurs de recherche : ils sont réellement stockés sur le domaine Perplexity.ai, avec des titres spécifiques à divers sujets.
À noter que Perplexity propose aux clients qui souhaitent publier volontairement du contenu sur le web un domaine séparé, pplx.app, ce qui n’est pas lié à l’incident de fuite évoqué ci-dessus. Comme l’utilisation de mots-clés différents pour des requêtes plus ciblées pourrait renvoyer davantage de résultats, l’étendue des contenus touchés pourrait dépasser le périmètre actuellement connu.
Historique des failles de confidentialité des entreprises d’IA
Cet incident n’est pas la première fois qu’un problème de confidentialité survient chez une entreprise d’IA ; l’historique est le suivant :
OpenAI (juillet 2025) : son responsable sécurité indique que la société a supprimé une fonctionnalité optionnelle permettant aux conversations partagées de ChatGPT d’être découvertes par les moteurs de recherche
Anthropic (septembre 2025) : selon le magazine Forbes, avant leur suppression des résultats de recherche, des centaines de conversations partagées de Claude avaient figuré dans les résultats de recherche Google
Anthropic (25 juillet 2026) : un billet Reddit révèle le problème de recherche de Claude, affirmant que des identifiants, des CV, des informations internes à l’entreprise et des discussions privées étaient inclus
Perplexity (27 juillet 2026) : Protos a découvert que les données des utilisateurs de Perplexity Computer pouvaient encore être recherchées publiquement, les moteurs de recherche n’ayant pas encore supprimé les index concernés
FAQ
Pourquoi les données des utilisateurs de Perplexity apparaissent-elles dans les résultats des moteurs de recherche ?
D’après le rapport de Protos, le cœur du problème vient du fait que les liens partageables de Perplexity utilisent une structure d’URL standard prévisible et ne disposent pas des protections de confidentialité adéquates (comme la balise noindex), ce qui amène les moteurs de recherche à indexer automatiquement ces liens et leur contenu ; l’interface de partage de Perplexity indique seulement que « toute personne disposant du lien peut consulter », au lieu d’indiquer clairement que le contenu peut être trouvé par n’importe quel utilisateur d’un moteur de recherche.
Lors de la correction de la faille de Claude, les moteurs de recherche ont-ils aussi corrigé en parallèle le problème de Perplexity ?
Selon le rapport de Protos, au 27 juillet 2026, après que les moteurs de recherche ont retiré l’annuaire de partage public de Claude, ils n’ont pas traité en parallèle un problème similaire chez Perplexity ; la recherche de « Perplexity » renvoie encore une liste sur plusieurs pages liée aux données des utilisateurs. Protos a signalé cette faille à Perplexity et aux trois principaux moteurs de recherche.
Le domaine pplx.app de Perplexity est-il lié à cette fuite ?
D’après les explications de l’article, pplx.app est un domaine séparé fourni par Perplexity aux clients souhaitant publier volontairement du contenu sur le web, et il n’est pas lié à l’incident de fuite dans lequel les données des utilisateurs de Perplexity Computer ont été indexées par les moteurs de recherche.