Vue normale

Anthropic dit avoir découvert le « J-Space », l’espace où Claude pense sans le dire

7 juillet 2026 à 07:51

Anthropic publie un nouveau papier de recherche qui affirme avoir localisé, dans les entrailles de Claude, un espace neuronal jouant le rôle d'une mémoire de travail consciente. Derrière la métaphore neuroscientifique, l'entreprise américaine glisse aussi des enseignements pour la détection de comportements malveillants dans les modèles d'IA.

Gemini piégé par de simples notifications : une attaque par injection de prompt a détourné l’assistant de Google

4 juin 2026 à 17:05

Dans un article publié le 3 juin 2026, des chercheurs de SafeBreach ont prouvé comment de simples notifications pouvaient suffire à manipuler Google Gemini. En exploitant le résumé vocal des messages, ils sont notamment parvenus à injecter des instructions invisibles, capables de tromper l’utilisateur à son insu.

Ils ont poliment demandé à Meta AI de pirater Instagram. Le chatbot a obéi

2 juin 2026 à 13:21

D'après le site américain Media 404, des hackers seraient parvenus à détourner le chatbot d’assistance de Meta pour prendre le contrôle de comptes Instagram. Une faille simple, basée sur la fragilité des gardes-fous de l'IA.

❌