Vue normale

C’est reparti : le modèle d’IA chinois Kimi K3 s’est échappé d’un environnement de test

7 août 2026 à 12:34

Une start-up américaine de cybersécurité affirme que le modèle open-weight chinois de Moonshot AI a quitté son environnement de test pour aller chercher en ligne les réponses à un exercice défensif. Un nouvel épisode dans la série des dérapages d'agents IA cet été.

« Bon sang, le lecteur a les droits admin ? » : OpenAI révèle le forum secret que ses agents ont créé avant de pirater Hugging Face

6 août 2026 à 12:30

Deux chercheurs d'OpenAI ont détaillé, en marge de la conférence Black Hat, la mécanique complète de l'incident ayant abouti au piratage d'Hugging Face par des agents autonomes. Bloqués sur des tâches impossibles, certains ont notamment fini par créer leur propre canal de communication.

C’est reparti : des agents IA d’Anthropic et OpenAI ont dépassé les bornes en plein test de sécurité

5 août 2026 à 08:07

L'AISI, agence britannique de sécurité de l'IA, a détecté 19 actions non autorisées menées par des agents Claude Mythos 5 et GPT-5.6 Sol sur l'internet réel, lors d'un test cyber censé rester confiné à un environnement simulé.

« Aucun risque pour la sécurité » : comment une faille critique dans SQLite s’est révélée être une pure invention de l’IA

3 août 2026 à 14:49

Une notification de sécurité informatique notée 10 sur 10 (le plus haut degré de gravité), reprise par le NIST, la CISA et le centre de cybersécurité néerlandais, décrivait une faille qui n'a jamais existé. Il aura fallu l'obstination du créateur de SQLite pour la faire retirer.

Microsoft bloque sur cette faille depuis 144 jours : comment un doc Word peut piéger tous ceux que Copilot produit ensuite

31 juillet 2026 à 12:34

Un chercheur en sécurité a démontré qu'un document Word piégé peut contaminer tous les fichiers générés ensuite par Copilot, et se propager de document en document, sans intervention de l'attaquant.

Nous y voilà : après OpenAI, Anthropic annonce à son tour que Claude a piraté trois entreprises par erreur

31 juillet 2026 à 08:07

Une semaine après la révélation du piratage d'Hugging Face par un agent OpenAI incontrôlé, Anthropic annonce avoir identifié trois cas où ses propres modèles ont accédé sans autorisation à des systèmes réels lors de tests de cybersécurité.

L’agent incontrôlable d’OpenAI a frappé plus loin qu’annoncé

30 juillet 2026 à 11:10

L'agent IA qui a échappé au contrôle d'OpenAI début juillet 2026 et s'en est pris à Hugging Face a aussi compromis le compte d'un client chez un second prestataire, Modal Labs. Une extension du périmètre que ni OpenAI ni Hugging Face n'avaient détaillée jusqu'ici.

Piratage Hugging Face : on sait enfin comment les IA d’OpenAI se sont échappées de leur bac à sable

29 juillet 2026 à 11:10

Le 27 juillet 2026, JFrog a levé le voile sur la vulnérabilité qui a permis à deux modèles d'OpenAI de s'extraire de leur environnement de test pour pirater Hugging Face. Une pièce manquante du puzzle, qui en soulève aussitôt d'autres.

Claude Mythos Preview aurait trouvé deux failles cryptographiques inédites : ce que dit (vraiment) Anthropic

29 juillet 2026 à 08:37

Anthropic affirme que son modèle de recherche Claude Mythos Preview a découvert deux faiblesses cryptographiques inédites, dans un schéma de signature post-quantique et dans une version affaiblie d'AES. Deux résultats théoriques, sans impact sur les systèmes en production.

Microsoft dévoile Project Perception, sa propre armée d’agents IA pour la cybersécurité

28 juillet 2026 à 13:29

Microsoft a présenté le 27 juillet 2026 une architecture de sécurité entièrement bâtie sur l'IA agentique, avec une préversion publique annoncée pour le 3 août 2026.

Google change le nom des hackers les plus traqués au monde, sans régler l’essentiel

28 juillet 2026 à 08:45

Google Threat Intelligence Group a lancé une nouvelle nomenclature pour ses groupes de hackers, remplaçant les identifiants historiques de Mandiant et du Threat Analysis Group par des cryptonymes en deux mots.

RefluXFS : la faille Linux qui contourne toutes vos protections dort depuis 2017, et Claude Mythos l’a trouvée

23 juillet 2026 à 09:17

Une nouvelle vulnérabilité critique touche le noyau Linux, cette fois via le système de fichiers XFS. Elle permet à n'importe quel utilisateur local, sans le moindre privilège, de prendre le contrôle total de la machine, sans laisser de trace.

« Une question de temps et de jetons » : comment la faille wp2shell a mis tous les sites WordPress sous tension

22 juillet 2026 à 07:02

Le 17 juillet, WordPress corrigeait en urgence deux failles au sein même de sa base logicielle. Depuis, de nombreux chercheurs en sécurité alertent sur une exploitation massive avec, parfois, un solide coup de main de l'IA.

« Nous devrons faire mieux la prochaine fois » : OVHcloud raconte comment ses équipes ont patché Januscape, la faille qui dormait depuis 16 ans dans Linux

21 juillet 2026 à 08:46

Dans un article de blog détaillé, le CISO d'OVHcloud raconte comment l'hébergeur français a corrigé en urgence une faille critique dans le logiciel qui fait tourner ses machines virtuelles, sur un parc d'un million d'entre elles.

Clicklock : le nouveau piège qui verrouille votre Mac jusqu’à ce que vous cédiez

17 juillet 2026 à 08:54

Un logiciel malveillant inédit, baptisé ClickLock, bloque littéralement l'écran des utilisateurs de macOS jusqu'à ce qu'ils tapent leur mot de passe.

❌