OpenAI piraté par Claude, l'IA de son concurrent Anthropic

Trois chercheurs de Hacktron AI, une petite société de cybersécurité, ont mis la main en moins de 72 heures sur le dépôt de code interne d'OpenAI, la maison mère de ChatGPT. Et l'outil qui leur a ouvert la porte s'appelle Claude, l'IA d'Anthropic, le concurrent direct.

Tout part du forum d'aide d'OpenAI, un site communautaire qui tourne sur le logiciel Discourse et qui accepte les images au format HEIC, celui des photos d'iPhone. Pour lire ces fichiers, le forum s'en remet à une bibliothèque baptisée libheif, dans laquelle un correctif de sécurité publié un an plus tôt n'avait jamais été installé.

Le 23 juillet, les chercheurs ont demandé à Claude Opus 4.8 d'analyser ce code et d'écrire un programme d'attaque. Sans succès. Le modèle repérait bien le défaut, mais calait sur les protections mémoire du serveur.

Sauf que le lendemain, Anthropic a publié Opus 5, et la nouvelle version a produit un code fonctionnel en quelques heures.

Au passage, Claude a d'abord refusé de viser une machine distante. Les trois hommes l'ont convaincu en déguisant leur propre serveur de test en exercice d'entraînement à la sécurité, un cadre où attaquer est justement le but du jeu, et j'avoue que ce détail me plaît beaucoup.

Une image piégée envoyée sur le forum leur a ensuite permis d'exécuter du code directement sur le serveur d'OpenAI, puis d'y récupérer des jetons d'authentification, ces clés temporaires qui valident une session ChatGPT sans mot de passe. Certains appartenaient à des employés de la boîte.

Via le compte Codex de l'un d'eux, l'assistant de programmation maison, ils ont atteint le fameux Monorepo, le dépôt unique où OpenAI range les recettes qui rendent ses modèles plus rapides. Ils se sont arrêtés là, sans rien lire, et ont laissé comme preuve une modification de code inoffensive signée de leur équipe.

OpenAI, qui a confirmé des lectures limitées de métadonnées, a corrigé la faille et révoqué les jetons dès le 25 juillet, quelques heures après avoir reçu le rapport. Les trois chercheurs participaient à son programme de chasse aux failles, et ont touché 6 500 dollars de prime.

L'affaire, révélée par le Wall Street Journal, a quand même laissé des traces : Greg Brockman, le président d'OpenAI, a réaffecté un quart de ses ingénieurs à la sécurité, après ce coup et le piratage de Hugging Face, la plateforme star des modèles d'IA, quelques jours plus tôt. La même faille libheif traîne d'ailleurs chez Slack, Meta, Zoom et Shopify, d'après le rapport technique de Hacktron.

"Nous sommes juste trois gars avec des abonnements Claude et Codex", résume leur directeur technique Mohan Pedhapati. Vu ce qu'ils ont trouvé, j'avoue que la prime me semble bien légère.

Source : Les Numériques

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论