Home Technologie et sciencePoursuite : Reddit a surpris Perplexity en train de voler des données dans les résultats de Google

Poursuite : Reddit a surpris Perplexity en train de voler des données dans les résultats de Google

by Thomas Caron

Publié le 24 octobre 2024 17h04:00. Reddit poursuit en justice la société Perplexity, spécialisée dans l’intelligence artificielle, pour avoir illégalement utilisé son contenu afin d’alimenter ses réponses et de contourner ses mesures de protection des données. L’affaire soulève des questions cruciales sur le droit d’auteur et l’accès aux données à l’ère de l’IA.

  • Reddit accuse Perplexity d’utiliser des techniques de “scraping” pour voler le contenu de son site et l’intégrer dans ses résultats de recherche.
  • Perplexity se défend en affirmant qu’elle ne forme pas de modèles d’IA sur le contenu Reddit et qu’elle n’a donc pas besoin de licence.
  • Reddit craint que les méthodes de Perplexity ne se généralisent et ne nuisent à ses accords de licence existants.

Reddit a intenté une action en justice contre Perplexity, alléguant que la société a recours à des méthodes sophistiquées pour extraire illégalement du contenu de sa plateforme. Selon Reddit, Perplexity dissimule son identité, masque son emplacement et utilise des programmes informatiques déguisés pour contourner les mesures de sécurité mises en place pour protéger ses données.

Lee, un représentant de Reddit, a déclaré :

« Incapables de récupérer directement Reddit, ils masquent leur identité, cachent leur emplacement et déguisent leurs grattoirs Web pour voler le contenu Reddit de la recherche Google. »

Lee, représentant de Reddit

Il accuse également Perplexity d’acheter des données volées plutôt que de négocier un accord de licence légal avec Reddit.

Perplexity rejette ces accusations. La société affirme qu’elle ne forme pas de modèles d’intelligence artificielle sur le contenu de Reddit et qu’elle n’a donc pas besoin de licence.

« C’est faux. Chaque fois que quelqu’un nous pose des questions sur les licences de contenu, nous expliquons que Perplexity, en tant que société de couche application, ne forme pas de modèles d’IA sur le contenu. Jamais. Il nous est donc impossible de signer un accord de licence pour le faire. »

Perplexity

Perplexity accuse également Reddit d’avoir exigé un paiement même pour un accès légal aux données.

« Reddit a insisté pour que nous payions quand même, malgré l’accès légal aux données de Reddit. Se plier à des tactiques musclées n’est tout simplement pas notre façon de faire des affaires. »

Perplexity

Jesse Dwyer, un porte-parole de Perplexity, a souligné que la société avait choisi de publier sa déclaration sur Reddit pour illustrer un point important.

« Il s’agit d’un lien Reddit public accessible à tous, mais selon la logique du procès de Reddit, si vous le mentionnez ou le citez de quelque manière que ce soit (ce qui est votre travail en tant que journaliste), ils pourraient vous poursuivre en justice. »

Jesse Dwyer, porte-parole de Perplexity

Reddit soutient que les actions de Perplexity ont causé des dommages à son activité et à sa réputation. La plainte indique que le “détournement des données de Reddit et le contournement des mesures de contrôle technologique” nuisent à la capacité de Reddit à contrôler l’accès à ses données, leur utilisation et leur conformité avec sa politique de confidentialité et ses conditions d’utilisation.

Reddit craint également que la méthode utilisée par Perplexity ne se propage et ne perturbe d’autres accords de licence. La société doit investir des “ressources importantes” dans des technologies anti-scraping, ce qui entraîne des pertes de bénéfices, une atteinte à sa réputation et une perte de confiance des utilisateurs.

Reddit demande au tribunal d’interdire aux entreprises comme Perplexity de supprimer le contenu Reddit des résultats de recherche de Google (SERP), de vendre des données Reddit et de développer ou de distribuer des technologies permettant de contourner ses mesures de sécurité. En cas de victoire, Reddit pourrait obtenir des dommages et intérêts importants ou la restitution des bénéfices tirés de la vente du contenu Reddit.

Advance Publications, qui possède la société mère d’Ars Technica, Condé Nast, est le principal actionnaire de Reddit.

You may also like

Leave a Comment