Présentation du contexte

Un juge a rejeté une demande de rejet d'une affaire intentée par Reddit contre SerpApi, une entreprise de scraping web, qui est accusée de conspiration avec Perplexity AI pour extraire illégalement du contenu protégé par le droit d'auteur de Reddit à partir des résultats de recherche Google.

Le fonctionnement de la technologie de scraping

Le juge Paul A. Engelmayer a estimé que Reddit a plausiblement prouvé qu'il y a eu une conspiration, avec SerpApi fournissant un produit pour contourner les contrôles d'accès de Google et Perplexity AI payant pour cela. Cette décision est intervenue moins de deux semaines après qu'un autre tribunal a rejeté une action similaire intentée par Google, qui n'a pas pu prouver que les détenteurs de droits, tels que Reddit, avaient autorisé le moteur de recherche à empêcher le scraping de contenu protégé.

Implications et limites de la décision

La mission de Google et de Reddit est de prouver que SerpApi et Perplexity AI ont conspiré pour accéder à des extraits d'œuvres protégées par la loi sur le droit d'auteur, qui sont protégées par une mesure technologique contrôlant effectivement l'accès, et que les défendeurs ont contourné cette technologie. Google a échoué sur le premier point, ce qui a donné à SerpApi une rare victoire à ce stade précoce, mais cela peut renforcer les arguments de Google selon lesquels Engelmayer a convenu avec Reddit qu'il était plausible que l'entreprise ait autorisé Google à utiliser une technologie anti-contournement pour bloquer le scraping malveillant.

Analyse scientifique des impacts

Il est probable que cette décision soit dérangeante pour les entreprises de scraping web comme SerpApi, car Engelmayer pense que Reddit peut faire valoir son cas, même si la technologie de Google a été inventée plus d'un an après que Google et Reddit ont conclu leur accord de licence. Cette affaire soulève des questions importantes sur la manière dont les entreprises peuvent utiliser la loi sur le droit d'auteur pour contrôler l'accès à leur contenu et sur les limites de la technologie de scraping web.