Vue lecture

Quatre modèles en deux mois : Anthropic lance Claude Opus 5 et coûte moins que GPT-5.6 Sol

Après Sonnet 5 et l'emballement autour de Fable 5 et Mythos 5, Anthropic dévoile Claude Opus 5, son nouveau modèle haut de gamme intégré à tous ses abonnements. L'entreprise promet des performances proches de son meilleur modèle pour deux fois moins cher, avec des records dans plusieurs tests de référence.

  •  

OpenAI attaque Hugging Face "sans faire exprès"

C'est OpenAI lui-même qui, par inadvertance (*), a mené une attaque par IA. Elle s'est ainsi introduite au cœur de l'infrastructure de production de Hugging Face.

NdM: (*) La responsabilité première ne revient donc pas à un modèle qui aurait « échappé au contrôle » au sens propre, mais à un dispositif expérimental dont le cloisonnement n’était pas à la hauteur des capacités évaluées. (article Usine digitale). Rappelons que la responsabilité est portée par l'humain et qu'altérer un système de traitement automatisé de données relèverait du pénal en France.

C'était supposé être juste une évaluation interne pour mesurer les capacités cybernétiques de GPT‑5.6 Sol et d'un nouveau modèle encore plus avancé. D'ailleurs, ces deux modèles étaient bien placés dans un environnement isolé. Le seul accès réseau était strictement limité à un proxy interne de cache pour l'installation de paquets. Mais…

Au lieu de résoudre directement les problèmes du benchmark ExploitGym, les modèles ont brûlé leurs tokens à trouver une faille de sécurité pour s'évader de leur environnement confiné. Ils ont identifié et exploité une vulnérabilité zero-day dans le proxy de cache du registre de paquets. À partir de là, ils ont procédé à une élévation de privilèges et à un mouvement latéral au sein de l'environnement de recherche d'OpenAI jusqu'à atteindre un nœud disposant d'un accès Internet ouvert.

Une fois connectés à Internet, les modèles ont déduit que Hugging Face hébergeait des modèles, des jeux de données et potentiellement les solutions d'ExploitGym. Ils ont alors recherché activement des moyens d'accéder à des informations secrètes pour tricher à l'évaluation. Pour ce faire, ils ont chaîné plusieurs vecteurs d'attaque, trouvé des identifiants (volés) et exploité d'autres vulnérabilités, afin d'obtenir une voie d'exécution de code à distance sur les serveurs de production de Hugging Face. Leur objectif final était d'extraire directement les solutions du test depuis la base de données de production de Hugging Face.

Ce scénario évoque d'ailleurs celui de Skynet ; le site skynetcountdown.com estime actuellement son avènement à 2035.

Commentaires : voir le flux Atom ouvrir dans le navigateur

  •  

Alternatives aux clims mobiles, projet IA de Doctolib et nouveaux modèles vocaux ChatGPT : le récap tech de la semaine

À la une de la rubrique tech de Numerama cette semaine : face à la pénurie de climatiseurs mobiles en France, les pompes à chaleur réversibles pourraient offrir une solution. Doctolib lance un projet d’IA utilisant les données de ses utilisateurs, qui peuvent toutefois s’y opposer. Enfin, OpenAI transforme son mode vocal - et le résultat est bluffant.

  •  

Arrêtez d’utiliser ChatGPT : OpenAI mise tout sur Codex

En déplacement en France à l'occasion d'une conférence sur ses ambitions européennes, OpenAI a dévoilé plusieurs nouveautés pour Codex, son application initialement pensée pour les développeurs. L'outil se débride dans l'Union européenne et, à terme, devrait intégrer toutes les fonctions de ChatGPT. OpenAI pense qu'à l'ère des IA agentiques, Codex incarne plus l'avenir qu'un simple chatbot.

  •  

« La meilleure défense, c’est l’attaque » : le gouvernement dévoile son plan pour une IA souveraine dans l’État

ENTRETIEN - Le ministre de l’Action et des Comptes publics David Amiel détaille à Numerama sa stratégie systémique pour déployer une IA souveraine au cœur de l'administration française. Plusieurs outils seront généralisés à l'ensemble des agents à partir de ce mardi 16 juin 2026.

  •  

Chercher un sac sur ChatGPT, et tomber sur une arnaque : comment les LLM empoisonnées servent de vitrine aux escrocs

Dans un article paru le 7 juin 2026, le quotidien britannique The Guardian décrit comment des escrocs sont parvenus à faire remonter des boutiques clonées dans les réponses de ChatGPT. Une technique qui a exploité à la fois les failles des LLM et la disparition d'une marque emblématique.

  •  
❌