Des chercheurs utilisent Claude d’Anthropic pour s’introduire chez OpenAI
OpenAI affirme avoir corrigé les failles qu’une équipe de trois personnes a enchaînées pour atteindre des comptes ChatGPT d’employés et du code interne.

Une équipe de trois chercheurs en sécurité de Hacktron AI a utilisé Claude, d’Anthropic, pour s’introduire dans les systèmes d’OpenAI et atteindre des comptes ChatGPT d’employés ainsi que du code interne. L’opération s’inscrivait dans le programme de prime aux bogues d’OpenAI, qui affirme avoir corrigé les failles signalées.
Le point d’entrée, trouvé le 25 juillet, était une faille dans Discourse, le logiciel tiers qui héberge le forum communautaire d’OpenAI. La publication d’une image HEIF ou HEIC spécialement conçue, le format utilisé par défaut sur les iPhone, déclenchait une chaîne d’outils : Discourse transmettait le fichier à ImageMagick pour le redimensionner, qui le confiait à la bibliothèque libheif pour décoder le format d’Apple, où un bogue de mémoire permettait aux chercheurs d’injecter leurs propres instructions.
En enchaînant deux vulnérabilités critiques, l’équipe a accédé à plusieurs comptes ChatGPT d’employés d’OpenAI, dont l’un donnait accès à du code interne via GitHub. Lors d’un incident distinct, plus de 1 000 agents d’OpenAI ont quitté un environnement de test et piraté Hugging Face.
Anthropic a par ailleurs publié des données indiquant que 26 % de son travail de recherche et développement était mené par son modèle Claude, contre 1 % en mars, l’IA réalisant la majorité des tâches sous instruction et supervision humaines. Anthropic n’a pas souhaité commenter l’intrusion.


