Reddit attaque Perplexity et d’autres sociétés d’IA pour vol de données
Reddit a récemment déposé une action en justice contre Perplexity et plusieurs autres sociétés d’exploration de données, les accusant d’avoir contourné ses systèmes de sécurité pour extraire des informations précieuses. Ce procès soulève des inquiétudes sur la protection des données et l’utilisation éthique des contenus en ligne.
Le 25 septembre 2024, Reddit a annoncé son intention de poursuivre Perplexity ainsi que trois autres entreprises : Oxylabs UAB, AWM Proxy et SerpApi. Selon le procès, ces sociétés auraient illégalement contourner les gardes-fous numériques mis en place par Reddit pour récupérer du contenu via Google.

Dans un passage marquant du document juridique, Reddit compare les actions des accusés à celles de « voleurs de banque potentiels qui. s’introduisent par effraction dans le camion blindé transportant l’argent ».
En mai 2024, Reddit avait déjà tenté de stopper cette exploitation en adressant une lettre à Perplexity, lui demandant de cesser ses activités « à moins de conclure un accord avec la société », similaire à ceux établis avec Google et OpenAI. Cependant, Perplexity a affirmé dans le procès qu’il respectait le fichier robots.txt de Reddit.
Pourtant, il est allégué que les citations provenant de Reddit utilisées par Perplexity aient été multipliées par quarante après cet avertissement. Le texte du procès indique que malgré ces demandes répétées, « plutôt que de respecter. les droits »Perplexity aurait cherché à développer « des stratagèmes sournois » pour contourner les protections mises en place.
Le document indique également que la technique commerciale principale adoptée par Perplexity consisterait à extraire du contenu depuis Google afin de l’intégrer dans ses modèles basés sur l’intelligence artificielle (IA), sans autorisation adéquate. Cette méthode se traduit selon le procès par une valorisation atteignant 20 milliards USD, mais sans aucune volonté déclarée d’indemniser Reddit ou ses utilisateurs.
Jesse Dwyer, représentant de Perplexity, a défendu son entreprise en affirmant qu’elle continuerait « à lutter vigoureusement pour le droit des utilisateurs à accéder librement et équitablement à la connaissance publique ». Il précise également que leur mission est fondée sur « des principes responsable… avec une IA précise »
Le porte-parole officiel chez Reddit a confirmé avoir dépensé dizaines millions USD dans des systèmes anti-grattage auxquels ont réussi à échapper certaines sociétés mentionnées dans ce litige. De plus, lors du suivi d’une opération détectée au sein même des garde-fous internes, il semble qu’un message test ait été indûment exploité puisque celui-ci est apparu rapidement sur la plateforme concernée.
Matthew Prince, PDG Cloudflare a exprimé sa frustration face aux pratiques jugées peu scrupuleuses : « Certaines sociétés d’IA prétendument réputées agissent davantage comme des pirates informatiques nord-coréens… »
Les entités visées n’ont pas répondu immédiatement aux demandes concernant leurs positions respectives sur ce dossier épineux. En revanche Ben Lee,SDE REDDIT’S LEGAL DIRECTOR , souligne : « Les scrapers contournent les protections technologiques pour voler des données. », ajoutant que cela fait partie intégrante des défis auxquels fait face reddit.
L’entreprise fondée en 2005 vise désormais non seulement à établir elle-même sa présence dans le secteur numérique mais aspire aussi à être perçue comme une alternative viable face aux géants comme Google grâce au lancement récent du trafic interne destiné au moteur recherche._
Alors que cette affaire continue d’évoluer devant courts américains , elle questionne plus largement encore les adaptation nécessaires accrue en termes de régulation autour gestion accès public donnees internautes.