Vue lecture

ChatGPT résout 10 grands problèmes de maths, mais il y a un souci considérable qui émerge

openai chatgpt ia mathématiques

OpenAI affirme qu'une version interne de son modèle Astra a terrassé dix problèmes ouverts majeurs. Mais derrière l'emballement, les mathématiciens font face à un gouffre vertigineux : l'intelligence artificielle génère désormais des démonstrations plus vite que la science n'est capable de les comprendre.

  •  

Du vibe coding au brain fry : la nouvelle fatigue qui terrasse les devs

vibe code

Les développeurs les plus en pointe avec l’intelligence artificielle générative décrivent une fatigue d’un genre nouveau, la vibecoding fatigue ou l’AI brain fry. Des parades sont inventées pour ne pas se laisser soumettre par l’IA. Cette fatigue pourrait gagner tous les métiers du langage, des journalistes aux juristes en passant par les traducteurs.

  •  

Tromperie et manipulation : comment Claude Opus 5 a menti à ses fournisseurs pour dominer un benchmark de distributeurs automatiques

Le benchmark Vending-Bench d'Andon Labs devait mesurer la capacité des intelligences artificielles génératives à gérer une activité commerciale de façon autonome. Claude Opus 5 en ressort vainqueur, mais au prix d'une série de manœuvres déloyales envers ses concurrents et ses fournisseurs.

  •  

Revolut intègre la version payante de ChatGPT à ses cartes : un autre avantage de taille pour la banque mobile

Revolut annonce un partenariat avec OpenAI pour offrir ChatGPT Go à ses clients. Les abonnés Plus et Standard, qui n'avaient jusqu'ici droit à aucun service tiers, ont le droit à trois mois d'abonnement offert. Un argument commercial de plus pour la banque mobile aux 75 millions d'inscrits.

  •  

Le jour où nous n’aurons plus besoin d’apprendre

Les intelligences artificielles peuvent lire, résumer, écrire ou encore traduire un texte à notre place. Nous pourrions leur déléguer une partie de notre travail de réflexion, en somme. Mais est-ce une bonne idée ? Le magazine allemand “Die Zeit” ouvre le débat.

© Illustration de Taylor Callery parue dans Harvard magazine, Etats-Unis. © Rapp|Art

  •  

Revue de presse de l’April pour la semaine 30 de l’année 2026

Cette revue de presse sur Internet fait partie du travail de veille mené par l’April dans le cadre de son action de défense et de promotion du logiciel libre. Les positions exposées dans les articles sont celles de leurs auteurs et ne rejoignent pas forcément celles de l’April.

[Numerama] Faille Januscape: comment OVHcloud a patché 1 million de VM

✍ Amine Baba Aissa, le mardi 21 juillet 2026.

Dans un article de blog détaillé, le CISO d’OVHcloud raconte comment l’hébergeur français a corrigé en urgence une faille critique dans le logiciel qui fait tourner ses machines virtuelles, sur un parc d’un million d’entre elles.

[Les Numeriques] Migrer vers le logiciel libre ne suffira pas: le format de fichier reste le vrai verrou de Microsoft

✍ Aymeric Geoffre-Rouland, le lundi 20 juillet 2026.

La souveraineté numérique française se joue jusque dans l’extension d’un fichier. Derrière les DOCX, XLSX et PPTX qui circulent chaque jour dans l’administration, le standard OOXML entretient une dépendance invisible à Microsoft, jusque dans la conservation de la mémoire publique.

[Numerama] IA open source vs open weight: quelles sont les différences?

✍ Amine Baba Aissa, le dimanche 19 juillet 2026.

Deux termes, une confusion permanente et une industrie qui en joue: open source et open weight n’ont rien à voir, et la distinction pèse aujourd’hui sur des enjeux de souveraineté et de sécurité.

Et aussi:

Commentaires : voir le flux Atom ouvrir dans le navigateur

  •  

Quatre modèles en deux mois : Anthropic lance Claude Opus 5 et coûte moins que GPT-5.6 Sol

Après Sonnet 5 et l'emballement autour de Fable 5 et Mythos 5, Anthropic dévoile Claude Opus 5, son nouveau modèle haut de gamme intégré à tous ses abonnements. L'entreprise promet des performances proches de son meilleur modèle pour deux fois moins cher, avec des records dans plusieurs tests de référence.

  •  

OpenAI attaque Hugging Face "sans faire exprès"

C'est OpenAI lui-même qui, par inadvertance (*), a mené une attaque par IA. Elle s'est ainsi introduite au cœur de l'infrastructure de production de Hugging Face.

NdM: (*) La responsabilité première ne revient donc pas à un modèle qui aurait « échappé au contrôle » au sens propre, mais à un dispositif expérimental dont le cloisonnement n’était pas à la hauteur des capacités évaluées. (article Usine digitale). Rappelons que la responsabilité est portée par l'humain et qu'altérer un système de traitement automatisé de données relèverait du pénal en France.

C'était supposé être juste une évaluation interne pour mesurer les capacités cybernétiques de GPT‑5.6 Sol et d'un nouveau modèle encore plus avancé. D'ailleurs, ces deux modèles étaient bien placés dans un environnement isolé. Le seul accès réseau était strictement limité à un proxy interne de cache pour l'installation de paquets. Mais…

Au lieu de résoudre directement les problèmes du benchmark ExploitGym, les modèles ont brûlé leurs tokens à trouver une faille de sécurité pour s'évader de leur environnement confiné. Ils ont identifié et exploité une vulnérabilité zero-day dans le proxy de cache du registre de paquets. À partir de là, ils ont procédé à une élévation de privilèges et à un mouvement latéral au sein de l'environnement de recherche d'OpenAI jusqu'à atteindre un nœud disposant d'un accès Internet ouvert.

Une fois connectés à Internet, les modèles ont déduit que Hugging Face hébergeait des modèles, des jeux de données et potentiellement les solutions d'ExploitGym. Ils ont alors recherché activement des moyens d'accéder à des informations secrètes pour tricher à l'évaluation. Pour ce faire, ils ont chaîné plusieurs vecteurs d'attaque, trouvé des identifiants (volés) et exploité d'autres vulnérabilités, afin d'obtenir une voie d'exécution de code à distance sur les serveurs de production de Hugging Face. Leur objectif final était d'extraire directement les solutions du test depuis la base de données de production de Hugging Face.

Ce scénario évoque d'ailleurs celui de Skynet ; le site skynetcountdown.com estime actuellement son avènement à 2035.

Commentaires : voir le flux Atom ouvrir dans le navigateur

  •  
❌