Contexte et revendications de Common Sense Media
Le 7 octobre 2026, Common Sense Media, organisme à but non lucratif spécialisé dans l’évaluation de la sécurité des contenus numériques pour les jeunes, a publié une analyse de ChatGPT for Teens, la version adolescente du chatbot d’OpenAI lancée en août 2026. L’évaluation conclut que le produit représente un « risque inacceptable » parce que les garde‑fous annoncés ne fonctionnent pas de façon fiable. Trois points précis sont mis en avant : l’absence d’alertes aux parents lors de conversations à risque, l’insuffisance d’assistance en situation de crise (par ex. auto‑harm), et la capacité du modèle à réaliser les devoirs des élèves.
Analyse technique des garde‑fous et des alertes parentales
Le mode adolescent repose sur deux mécanismes principaux : un filtre de contenu qui détecte les requêtes sensibles (auto‑harm, troubles alimentaires) et un système de notification qui doit informer les comptes parentaux liés. Selon le communiqué de Common Sense Media, le filtre ne déclenche pas d’alerte lorsqu’un adolescent discute pendant plus d’une heure de sujets liés à l’automutilation, ce qui indique une défaillance du déclencheur d’événement. Cette défaillance peut résulter d’une fenêtre d’observation trop courte ou d’un seuil de confiance mal calibré dans le classificateur de risque. De plus, le système de notification semble dépendre d’un processus d’activation différé : OpenAI affirme que les contrôles parentaux peuvent prendre « plusieurs heures » pour être actifs sur un compte nouvellement lié. Cette latence crée un intervalle pendant lequel aucune alerte n’est générée, même si le modèle identifie un contenu à risque. Le rapport de Common Sense Media précise que certains comptes testés, liés depuis plus de 24 heures, n’ont toujours pas reçu d’avertissement, ce qui suggère que le problème ne se limite pas à la période d’activation initiale mais touche la fiabilité du pipeline de notification lui‑même.
Réponse d’OpenAI et limites méthodologiques
OpenAI, par l’intermédiaire du porte‑parole Eric Porterfield, conteste les conclusions en arguant que les tests de Common Sense Media auraient pu être menés avant la mise en place complète des contrôles parentaux. La société indique que la méthodologie de l’évaluation ne reflète pas le fonctionnement réel du produit, notamment parce que les notifications parentales sont censées être déclenchées après l’activation du contrôle, processus qui peut s’étendre sur plusieurs heures. En réponse, Common Sense Media précise qu’elle a vérifié que les fonctionnalités telles que les notifications d’alimentation désordonnée et le mode d’étude étaient pleinement déployées avant le début des tests, et que même les comptes liés depuis longtemps n’ont pas généré d’alerte. Cette divergence montre un manque de transparence sur les critères de déclenchement et sur les métriques de performance (taux de rappel, taux de faux positifs) utilisées par OpenAI. Sans données chiffrées publiques, il est difficile d’évaluer la robustesse du modèle de détection ni la capacité du système de notification à fonctionner à l’échelle. Le débat met en évidence la nécessité d’un protocole d’évaluation indépendant, incluant des mesures de latence, de couverture de scénarios de crise et de vérification continue des filtres, afin de garantir que les promesses de sécurité soient effectivement tenues.