Scraping et RGPD : le guide de conformité

Le RGPD n'interdit pas le web scraping : il encadre le traitement des données personnelles. Voici comment collecter des données publiques en respectant le règlement européen — base légale, données personnelles, robots.txt et mesures de conformité.

  • Nom, prénom, e-mail, téléphone, adresse
  • Identifiants en ligne, adresse IP, cookies
  • Données de localisation et de navigation
  • Données sensibles (santé, opinions, orientation) : régime renforcé
  • Intérêt légitime : le plus fréquent (veille, recherche, sécurité)
  • Consentement : peu praticable en scraping automatisé
  • Obligation légale ou intérêt public : cas spécifiques
  • Mise en balance obligatoire avec les droits des personnes
  • Minimisation : uniquement les données nécessaires
  • Finalité limitée et déterminée
  • Durée de conservation définie et justifiée
  • Sécurité : chiffrement, accès restreints
  • Information des personnes et droit d’opposition (opt-out)
Le web scraping est-il légal ?

Le scraping n'est pas illégal en soi : tout dépend des données collectées et de leur usage. Tant que la collecte porte sur des données non personnelles, ou sur des données personnelles traitées avec une base légale et des garanties, elle peut être conforme au RGPD.

Peut-on scraper des données personnelles publiques ?

Oui, mais sous conditions. Les données publiquement accessibles peuvent être traitées sur la base de l'intérêt légitime, à condition de mettre en balance les droits des personnes et de prendre des mesures : minimisation, information, droit d'opposition et anonymisation dès la collecte.

Faut-il respecter le robots.txt ?

Le robots.txt traduit la volonté de l'éditeur du site. Le respecter n'est pas une obligation du RGPD, mais il réduit le risque de litige contractuel et de blocage technique. Il ne dispense pas de définir une base légale.

Quelles sanctions en cas de scraping non conforme ?

Le RGPD prévoit des amendes pouvant atteindre 20 millions d'euros ou 4 % du chiffre d'affaires mondial. La CNIL a par exemple sanctionné Clearview AI de 20 millions d'euros en 2022 pour une collecte sans base légale.

Prêt à aspirer un site web ?

Lancez votre premier scraping en quelques secondes, gratuitement.

Lancer un scraping