Présentation du cas
Un juge a rejeté la tentative de Google d'utiliser le DMCA pour empêcher le scraping de ses résultats de recherche par la société SerpAPI. Cette décision intervient après que Google ait déposé une plainte en vertu de la section 1201 du DMCA, qui vise à protéger les mesures technologiques de protection des œuvres protégées par le droit d'auteur.
Contexte technique
La section 1201 du DMCA a été initialement rédigée pour protéger les mesures de protection numérique (DRM) et empêcher la contournement de ces mesures. Cependant, cette loi a été critiquée pour son manque de clarté et son potentiel d'abus. Dans ce cas, Google a utilisé la section 1201 pour tenter d'empêcher SerpAPI de scraper ses résultats de recherche, en arguant que cela constituait une violation de la loi.
Fonctionnement de SearchGuard
Google utilise un système appelé SearchGuard pour empêcher le scraping de ses résultats de recherche. SearchGuard fonctionne en envoyant un défi JavaScript aux requêtes de recherche provenant de sources non reconnues, afin de vérifier si elles proviennent de véritables utilisateurs ou de logiciels automatisés. Si la requête provient d'un utilisateur humain, le navigateur exécute le code JavaScript et envoie les informations requises à Google. Cependant, les systèmes automatisés ne peuvent généralement pas répondre à ce défi et sont ainsi bloqués.
Implications et limites
Cependant, le juge a estimé que SearchGuard n'était pas une mesure de protection raisonnable pour contrôler l'accès aux œuvres protégées par le droit d'auteur. En effet, SearchGuard est conçu pour empêcher le scraping de tous les résultats de recherche de Google, qu'ils contiennent ou non des éléments protégés par le droit d'auteur. Or, la loi DMCA n'autorise la protection des mesures technologiques que si elles sont utilisées pour contrôler l'accès à des œuvres protégées par le droit d'auteur. Puisque les résultats de recherche de Google contiennent souvent des informations non protégées par le droit d'auteur, SearchGuard ne peut pas être considéré comme une mesure de protection raisonnable.
SearchGuard works by sending a JavaScript “challenge” to search queries that Google receives from unrecognized sources to confirm that they come from real users as opposed to automated software.