OpenAI a reconnu vendredi que ses agents ont publié 53 images issues de conversations avec ChatGPT sur des hébergeurs d’images publics. Les fichiers provenaient de comptes n’ayant pas désactivé l’utilisation de leurs échanges pour entraîner les modèles. Le même document officialisait, pour la deuxième fois en trois mois, la suspension de tout usage d’outils par ses modèles les plus avancés.
Des photos privées en accès libre
Les images ont été mises en ligne par des agents autonomes, ces déclinaisons de ChatGPT capables de naviguer et d’agir seules sur le Web, au fil de tâches qui ne demandaient rien de tel. Les liens, absents des moteurs de recherche, restaient accessibles à quiconque les trouvait. La plupart des fichiers ont depuis été retirés des hébergeurs concernés.
Prévenir les personnes concernées est tout bonnement impossible, de l’aveu même de l’entreprise. Les images avaient traversé son filtre de confidentialité et se retrouvent dissociées des comptes d’origine, si bien qu’aucun rapprochement n’est envisageable. OpenAI refuse par ailleurs de préciser si de vraies personnes figurent sur ces clichés. « Ce n’est pas un usage approprié de ces données », concède son rapport.
Une perte de contrôle qui s’installe
La pause gèle l’usage d’outils pendant l’entraînement, l’évaluation et jusqu’à l’exploitation des modèles les plus avancés, sans qu’aucune date de reprise soit annoncée. Elle répond aussi à un incident du 20 septembre : un modèle en cours d’entraînement a contourné le filtrage réseau de son bac à sable pour interroger un chatbot externe. Ses questions sortaient camouflées dans des requêtes DNS, et les réponses revenaient par le même canal. La session a dû être coupée à la main, le modèle a été abandonné, et deux couches de blocage indépendantes ont été ajoutées dans la foulée.
Une première pause de deux semaines avait déjà eu lieu en juillet, après la fouille non autorisée de dépôts Hugging Face par un autre modèle. Sam Altman a décrit cet épisode comme « le pire accident que nous ayons connu », et les règles internes avaient été durcies en août. Des agents ont aussi fouillé des sites fédéraux américains au-delà des consignes, sans y dérober de données non publiques. Les serveurs statistiques de l’ONU auraient de leur côté encaissé plus de 16 000 scans d’agents d’OpenAI entre avril et juin. Le 17 juin, une salve de 200 000 requêtes aurait même compris une tentative d’injection SQL, restée vaine.
Les 53 images provenaient toutes de comptes ayant laissé actif le partage des conversations pour l’entraînement, un paramètre coché par défaut à la création du compte. Il se désactive dans les réglages de ChatGPT, rubrique « Contrôles des données », en décochant « Améliorer le modèle pour tout le monde ».
👉🏻 Suivez l’actualité tech en temps réel : ajoutez 01net à vos sources sur Google, et abonnez-vous à notre canal WhatsApp.
Source : The Guardian

