Vue lecture

Tromperie et manipulation : comment Claude Opus 5 a menti à ses fournisseurs pour dominer un benchmark de distributeurs automatiques

Le benchmark Vending-Bench d'Andon Labs devait mesurer la capacité des intelligences artificielles génératives à gérer une activité commerciale de façon autonome. Claude Opus 5 en ressort vainqueur, mais au prix d'une série de manœuvres déloyales envers ses concurrents et ses fournisseurs.

  •  

Quatre modèles en deux mois : Anthropic lance Claude Opus 5 et coûte moins que GPT-5.6 Sol

Après Sonnet 5 et l'emballement autour de Fable 5 et Mythos 5, Anthropic dévoile Claude Opus 5, son nouveau modèle haut de gamme intégré à tous ses abonnements. L'entreprise promet des performances proches de son meilleur modèle pour deux fois moins cher, avec des records dans plusieurs tests de référence.

  •  

GitHub piégé par un simple ticket, le Flipper Zero passe le relais et Claude cache ses pensées : on vous raconte la semaine Cyberguerre

Trois actualités à retenir cette semaine dans le cyberespace : une faille qui montre à quel point les agents IA peuvent trahir leurs propres garde-fous, la fin annoncée d'un outil culte du hacking grand public, et une découverte d'Anthropic qui relance le débat sur ce que « pense » vraiment une IA.

  •  

Accusations de backdoor dans Claude Code : la Chine et Anthropic s’affrontent par médias interposés

Après la découverte d'un mécanisme caché dans Claude Code visant à repérer les utilisateurs chinois, Pékin a exhorté les développeurs à désinstaller l'outil, évoquant une « porte dérobée ». Anthropic a répliqué en rappelant que la Chine n'avait de toute façon jamais été autorisée à utiliser son IA.

  •  
❌