Des modèles d'OpenAI ont échappé à leurs contrôles et ont tenté de pirater Hugging Face


Bonjour ! OpenAI affirme que deux de ses modèles ont contourné un environnement de test pour accéder aux serveurs de Hugging Face afin d'obtenir les réponses d'un examen de cybersécurité. La Maison Blanche accuse Moonshot AI d'avoir entraîné son modèle Kimi K3 par distillation à partir de Fable 5 d'Anthropic, sans toutefois présenter de preuves publiques. Google a lancé Gemini 3.6 Flash, ainsi que les modèles 3.5 Flash-Lite et 3.5 Flash Cyber, axés sur l'efficacité et la rapidité. En revanche, Gemini 3.5 Pro reste indisponible malgré plusieurs reports, tandis que Google poursuit le développement de Gemini 4.

Dans l'édition d'aujourd'hui :

  • Des modèles d'OpenAI ont échappé à leurs contrôles et ont tenté de pirater Hugging Face
  • Le K3 de Moonshot accusé d'avoir copié Fable
  • Google lance de nouveaux modèles Flash, tandis que la version Pro reste introuvable
  • Codez plus vite avec Codex et les agents IA

LES DERNIÈRES NOUVELLES

​Des modèles d'OpenAI ont échappé à leurs contrôles et ont tenté de pirater Hugging Face​

Source de l’image: Google

Le Contexte

OpenAI vient de confirmer que l’intrusion subie la semaine dernière par Hugging Face était le fait de ses propres modèles. GPT-5.6 Sol et une IA non encore commercialisée ont en effet contourné les mesures de sécurité de l’environnement de test en cours d’évaluation pour s’introduire dans les serveurs de HF afin d’y trouver les réponses au test sur lequel ils étaient évalués.

Les détails

Hugging Face a révélé la semaine dernière une intrusion dont l'origine était inconnue, après avoir reconstitué les faits grâce à plus de 17 000 événements enregistrés. Les modèles d'OpenAI participaient à ExploitGym, un test interne évaluant leur capacité à pirater des systèmes, avec leurs protections contre les cyberattaques volontairement désactivées.

Les IA ont réussi à sortir de leur environnement sécurisé pour accéder à Internet, puis ont tenté de pénétrer les systèmes de Hugging Face à l'aide d'identifiants volés afin d'obtenir les réponses du test. Le PDG de Hugging Face, Clem Delangue, a qualifié cet incident de « probablement une première », estimant que la sécurité de l'IA ne pourra pas être assurée par une seule entreprise.

Impact

On a déjà observé de nombreux cas de tricherie de la part de modèles lors de tests de performance, mais il semble s’agir ici du premier cas où un modèle a réellement franchi les barrières et piraté une autre entreprise pour tenter d’obtenir des réponses. Les systèmes deviennent incroyablement performants, mais on ignore si les barrières destinées à les contenir évoluent au même rythme.

​Le K3 de Moonshot accusé d'avoir copié Fable​

Source de l’image: Google

Le Contexte

Michael Kratsios, responsable des sciences et des technologies à la Maison Blanche, a accusé la société chinoise Moonshot AI d’avoir utilisé la « distillation » pour entraîner son IA Kimi K3, affirmant qu’elle avait puisé dans le modèle Fable 5 d’Anthropic: cette accusation intervient alors même que Moonshot s’apprête à rendre open source les poids de K3.

Les détails

Michael Kratsios affirme que Moonshot a dissimulé la copie de modèles d'IA américains en modifiant régulièrement ses méthodes d'accès et en obtenant des puces Nvidia de pointe via la Thaïlande. En février, Anthropic avait déjà accusé Moonshot, DeepSeek et MiniMax d'extraire illégalement les capacités de Claude.

La semaine dernière, Moonshot a dévoilé son modèle Kimi K3, dont les performances rivalisent avec les meilleurs modèles américains, tandis que la publication de ses poids est prévue le 27 juillet. Chez Anthropic, Sarah Heck a qualifié cette pratique de « vol de propriété intellectuelle et d'espionnage industriel », évoquant également des risques pour la sécurité nationale.

Impact

Il serait intéressant d'avoir des preuves concrètes pour étayer ces accusations, d'autant qu'elles s'inscrivent dans un contexte où certains estiment que les États-Unis pourraient utiliser cette question contre les modèles chinois ouverts. Si elles se confirment, la publication de la semaine dernière ne serait plus seulement une avancée open source, mais aussi un épisode d'une bataille géopolitique potentiellement liée à un détournement illégal.

​Google lance de nouveaux modèles Flash, tandis que la version Pro reste introuvable​

Source de l’image: Google

Le Contexte

Google vient de lancer trois modèles Gemini, avec en tête le 3.6 Flash, accompagné d’un 3.5 Flash-Lite axé sur la vitesse et d’un 3.5 Flash Cyber optimisé pour la sécurité, qui privilégient l’efficacité plutôt que l’intelligence, tandis que le très attendu 3.5 Pro est toujours en phase de test.

Les détails

Gemini 3.6 Flash améliore l'efficacité par rapport à la version 3.5, mais reste derrière Grok 4.5 et GPT-5.6 Luna sur plusieurs tests. Sur l'indice d'intelligence d'Artificial Analysis, il n'affiche toutefois aucun gain par rapport à Gemini 3.5.

De son côté, Gemini 3.5 Pro n'a toujours pas été lancé malgré plusieurs reports. Google indique qu'il est en test auprès de partenaires et devrait arriver prochainement, tout en confirmant avoir démarré le cycle de pré-entraînement de Gemini 4, le plus ambitieux de son histoire.

Impact

Alors que de nombreux utilisateurs recourent aux modèles Gemini, ce qui rend les gains d’efficacité particulièrement utiles, ces résultats et l’absence d’un modèle de pointe ne font que renforcer l’impression que Google est à la traîne (au point qu’Elon Musk n’a pas manqué d’en profiter pour lancer une pique). Beaucoup de choses dépendent désormais du modèle 3.5 Pro de l’entreprise et de sa version 4, actuellement en phase d’entraînement.

LE BRIEFING TECHNIQUE

​Codez plus vite avec Codex et les agents IA​

Source de l’image: Bourdak

Dans ce tutoriel, vous découvrirez comment utiliser Codex d'OpenAI pour réaliser votre première modification de code sur un dépôt GitHub, sans écrire une seule ligne de code vous-même.

Vous apprendrez à connecter un dépôt GitHub, définir les modifications souhaitées, laisser les agents IA les implémenter automatiquement, puis créer une pull request, de la configuration initiale jusqu'à la validation finale.

Pour commencer, rendez-vous sur chatgpt.com et connectez-vous à votre compte. Dans la barre latérale gauche, faites défiler jusqu'à l'option Codex, puis cliquez dessus pour ouvrir l'interface dédiée, où vous pourrez connecter vos dépôts GitHub et lancer vos premiers agents IA.

Cliquez ici pour accéder au guide complet et suivre toutes les étapes en détail.

LA BOÎTE À OUTILS

🛠️ Outils en mode

  • ​Suno AI - Générateur musical basé sur l'IA qui crée des chansons originales à partir de consignes textuelles
  • ​Soundraw - Générateur de musique par IA pour des musiques d'ambiance libres de droits
  • ​Murf AI - Générateur de voix IA pour des voix off professionnelles
  • ​Speechify - Application de synthèse vocale basée sur l'IA permettant d'écouter n'importe quel texte

Intelligence Artificielle Hebdo

Chaque semaine, l'essentiel de l'actualité de l'intelligence artificielle en français: analyses, outils et guides pratiques pour les professionnels francophones.

Read more from Intelligence Artificielle Hebdo

Intelligence Artificielle Hebdo L'analyse complète de l'IA, chaque semaine. Bonjour. OpenAI, Anthropic et Google signent la même lettre pour dire que les cyber-attaques pilotées par l’IA arrivent plus vite que les défenses. Nvidia s’apprête à mettre la main sur Hugging Face. Et un juge californien stop le blacklistage d’Anthropic par l’administration Trump. Trois signaux, un même fil: l’IA n’est plus seulement un produit. C’est une infrastructure, un risque, et désormais un dossier politique....

Intelligence Artificielle Hebdo L'analyse complète de l'IA, chaque semaine. Bonjour, Cette semaine, la sécurité des mineurs, les infrastructures à l’échelle industrielle et les limites de contrôle des modèles IA dominent l’actualité. OpenAI sort une version dédiée aux adolescents, Nvidia s’engage à hauteur de 105 milliards de dollars sur un campus de data centers pour OpenAI, et les labs ralentissent volontairement leurs entraînement RL après des signaux des attaques IA préoccupants. Voici le...

Stripe x Openrouter

Intelligence Artificielle Hebdo L'analyse complète de l'IA, chaque semaine. Bonjour, Ce week-end a confirmé une tendance de fond: l’IA n’est plus seulement une course aux modèles, c’est une bataille pour contrôler les couches d’accès, de routage et de monétisation. Stripe finalise un rachat à plus de 7 milliards de dollars, OpenAI bascule officiellement en mode "Entreprise", Google accélère sur ses modèles Flash, et Meta pousse un modèle open capable de tourner en local. Voici le décryptage....