Vue normale

Reçu — 2 juillet 2026 Actualités numériques

Une faille dans la fonction Hide My Email d’Apple peut révéler l’adresse principale

2 juillet 2026 à 14:20
Cachez cet émail que je ne saurais voir
Une faille dans la fonction Hide My Email d’Apple peut révéler l’adresse principale

La fonction Hide My Email (masquer mon e-mail) est victime d’une faille. Signalée l’année dernière, elle permet de retrouver la véritable adresse d’un utilisateur, faisant perdre l’intérêt de cette fonction pensée pour la vie privée. En outre, un changement de domaine prévu par l’entreprise pourrait encore affaiblir son efficacité.

« Masquer mon adresse e-mail » est une fonction lancée en 2021 et proposée par Apple à toutes les personnes disposant d’un compte iCloud+. On peut l’obtenir notamment avec n’importe quel abonnement lié au stockage, même l’offre de 50 Go à 0,99 euro par mois. Elle permet, lors de l’inscription à un service, via un site ou une application, de créer automatiquement une fausse adresse, généralement composée de deux mots aléatoires et d’un chiffre, et reliée à l’adresse principale.

Cette fonction contient une faille, révèle 404 Media. Nos confrères ont échangé avec Tyler Murphy, découvreur de la vulnérabilité et cofondateur de la société EasyOptOuts, qui commercialise un service de suppression des données personnelles.

Apple prend son temps

Tyler Murphy a contacté Apple pour la première fois le 11 juin 2025, il y a donc plus d’un an. Le mois suivant, Apple a répondu qu’elle allait examiner le problème. Avance rapide jusqu’en mars 2026, quand Apple signale apparemment avoir « résolu le problème signalé dans une récente modification du système ». Le découvreur, de son côté, dit constater que la faille est toujours exploitable, ce à quoi Apple a répondu qu’elle se repenchait sur le problème.

En mai, l’entreprise a signalé être toujours en cours d’investigation et demandé à Tyler Murphy de ne divulguer aucune information publiquement, le temps que l’enquête soit terminée. Fin mai, Apple a annoncé qu’un correctif a été développé et qu’il serait appliqué « dans les prochaines semaines ». Mais le 29 juin, sans nouvelles, le découvreur finit par contacter 404 Media, qui publie son article deux jours plus tard.

Source : AppleInsider

Dans cette publication, le journaliste Joseph Cox indique avoir généré une nouvelle adresse masquée et l’avoir transmise à Tyler Murphy. Environ cinq minutes plus tard, ce dernier lui a communiqué son adresse e-mail réelle liée à son compte Apple. Selon Murphy, dans les tests limités menés avec des volontaires, 100 % des adresses « Masquer mon adresse e-mail » testées se sont révélées exploitables de cette manière, montrant au passage que le problème n’était toujours pas résolu, plus d’un an après son signalement.

Le découvreur souligne un risque concret lié à l’écosystème des courtiers en données : les sites de recherche de personnes, gratuits et accessibles au public, permettent facilement de relier une adresse e-mail à d’autres informations personnelles, ce qui expose les utilisateurs s’appuyant sur « Masquer mon adresse e-mail » pour leur sécurité. Ce risque touche particulièrement les personnes utilisant le service à des fins sensibles : pour échapper à un harcèlement, lancer une alerte ou encore pour de l’activisme.

404 Media, TechCrunch et d’autres acteurs de la presse en ligne ont contacté Apple pour obtenir des informations, mais l’entreprise n’a pas encore répondu.

Mauvais timing

Si la faille fait parler, c’est parce qu’Apple ne communique pas à son sujet… et aussi parce que l’entreprise prépare un changement qui pourrait affaiblir la sécurité de son service.

TechCrunch a abordé le problème dans un article le 16 juin. Nos confrères expliquent que l’efficacité de « Masquer mon adresse e-mail » tient beaucoup à l’utilisation du même domaine pour les fausses adresses que pour les vraies : elles finissent toutes par « @icloud.com ». Mais dans une note aux développeurs publiée le 15 juin, Apple indique qu’elle va unifier les domaines utilisés aussi bien pour sa fonction « Connexion avec Apple » (qui permet de créer facilement un compte chez un tiers depuis le compte Apple) que par « Masquer mon adresse e-mail » : private.icloud.com.

Et de résumer le changement, qui interviendra « plus tard » cet été :

  • Les adresses utilisées par « Connexion avec Apple », jusqu’ici sur le domaine privaterelay.appleid.com, seront émises sur private.icloud.com.
  • Les adresses utilisées par « Masquer mon adresse e-mail », jusqu’ici sur le domaine icloud.com, seront émises sur private.icloud.com.

Or, depuis environ deux semaines que l’information est parue, beaucoup critiquent ce changement, notamment sur Reddit. En dehors du changement lui-même qui peut révéler instantanément qu’il s’agit d’une fausse adresse, la critique qui revient le plus souvent est la capacité des entreprises à bloquer plus simplement ce type d’adresse.

« Hide My Email est efficace précisément parce que tu ne peux pas facilement filtrer les adresses qu’il génère. Je serais très surpris si on ne voit pas des services commencer à refuser de te laisser t’inscrire avec un domaine private.icloud.com. Ça sent l’industrie qui fait pression sur Apple, ce qui est hilarant puisque ça a essentiellement tué la principale métrique que les spécialistes du marketing par e-mail utilisaient pour mesurer la performance (ce qui était bien, les clics sont une bien meilleure métrique à optimiser) », juge ainsi l’utilisateur MalevolentFerret.

Problème : si Apple a communiqué sur le changement, l’entreprise n’a rien dit sur les raisons qui la poussaient à cette unification. S’il s’agit réellement d’une pression de l’industrie, il est possible qu’un nombre croissant de services finissent en effet par rejeter les créations de comptes basées sur ces fausses adresses.

Apple précise quand même dans sa note que toutes les adresses déjà en place continueront de fonctionner de la même manière. La modification ne concernera que les adresses créées après la bascule, dont la date exacte n’est pas connue.

TechCrunch rappelle en outre que si un utilisateur iCloud+ peut effectivement créer de fausses adresses, Apple garde en main les informations qui permettent de la relier au compte réel, les fausses adresses fonctionnant – dans les grandes lignes – comme un alias. L’entreprise en a donné la preuve fin mars, lorsqu’elle a remis au FBI les informations d’un utilisateur qui avait utilisé une adresse masquée pour un courrier jugé « menaçant » à la compagne de Kash Patel, directeur du FBI.

Une faille dans la fonction Hide My Email d’Apple peut révéler l’adresse principale

2 juillet 2026 à 14:20
Cachez cet émail que je ne saurais voir
Une faille dans la fonction Hide My Email d’Apple peut révéler l’adresse principale

La fonction Hide My Email (masquer mon e-mail) est victime d’une faille. Signalée l’année dernière, elle permet de retrouver la véritable adresse d’un utilisateur, faisant perdre l’intérêt de cette fonction pensée pour la vie privée. En outre, un changement de domaine prévu par l’entreprise pourrait encore affaiblir son efficacité.

« Masquer mon adresse e-mail » est une fonction lancée en 2021 et proposée par Apple à toutes les personnes disposant d’un compte iCloud+. On peut l’obtenir notamment avec n’importe quel abonnement lié au stockage, même l’offre de 50 Go à 0,99 euro par mois. Elle permet, lors de l’inscription à un service, via un site ou une application, de créer automatiquement une fausse adresse, généralement composée de deux mots aléatoires et d’un chiffre, et reliée à l’adresse principale.

Cette fonction contient une faille, révèle 404 Media. Nos confrères ont échangé avec Tyler Murphy, découvreur de la vulnérabilité et cofondateur de la société EasyOptOuts, qui commercialise un service de suppression des données personnelles.

Apple prend son temps

Tyler Murphy a contacté Apple pour la première fois le 11 juin 2025, il y a donc plus d’un an. Le mois suivant, Apple a répondu qu’elle allait examiner le problème. Avance rapide jusqu’en mars 2026, quand Apple signale apparemment avoir « résolu le problème signalé dans une récente modification du système ». Le découvreur, de son côté, dit constater que la faille est toujours exploitable, ce à quoi Apple a répondu qu’elle se repenchait sur le problème.

En mai, l’entreprise a signalé être toujours en cours d’investigation et demandé à Tyler Murphy de ne divulguer aucune information publiquement, le temps que l’enquête soit terminée. Fin mai, Apple a annoncé qu’un correctif a été développé et qu’il serait appliqué « dans les prochaines semaines ». Mais le 29 juin, sans nouvelles, le découvreur finit par contacter 404 Media, qui publie son article deux jours plus tard.

Source : AppleInsider

Dans cette publication, le journaliste Joseph Cox indique avoir généré une nouvelle adresse masquée et l’avoir transmise à Tyler Murphy. Environ cinq minutes plus tard, ce dernier lui a communiqué son adresse e-mail réelle liée à son compte Apple. Selon Murphy, dans les tests limités menés avec des volontaires, 100 % des adresses « Masquer mon adresse e-mail » testées se sont révélées exploitables de cette manière, montrant au passage que le problème n’était toujours pas résolu, plus d’un an après son signalement.

Le découvreur souligne un risque concret lié à l’écosystème des courtiers en données : les sites de recherche de personnes, gratuits et accessibles au public, permettent facilement de relier une adresse e-mail à d’autres informations personnelles, ce qui expose les utilisateurs s’appuyant sur « Masquer mon adresse e-mail » pour leur sécurité. Ce risque touche particulièrement les personnes utilisant le service à des fins sensibles : pour échapper à un harcèlement, lancer une alerte ou encore pour de l’activisme.

404 Media, TechCrunch et d’autres acteurs de la presse en ligne ont contacté Apple pour obtenir des informations, mais l’entreprise n’a pas encore répondu.

Mauvais timing

Si la faille fait parler, c’est parce qu’Apple ne communique pas à son sujet… et aussi parce que l’entreprise prépare un changement qui pourrait affaiblir la sécurité de son service.

TechCrunch a abordé le problème dans un article le 16 juin. Nos confrères expliquent que l’efficacité de « Masquer mon adresse e-mail » tient beaucoup à l’utilisation du même domaine pour les fausses adresses que pour les vraies : elles finissent toutes par « @icloud.com ». Mais dans une note aux développeurs publiée le 15 juin, Apple indique qu’elle va unifier les domaines utilisés aussi bien pour sa fonction « Connexion avec Apple » (qui permet de créer facilement un compte chez un tiers depuis le compte Apple) que par « Masquer mon adresse e-mail » : private.icloud.com.

Et de résumer le changement, qui interviendra « plus tard » cet été :

  • Les adresses utilisées par « Connexion avec Apple », jusqu’ici sur le domaine privaterelay.appleid.com, seront émises sur private.icloud.com.
  • Les adresses utilisées par « Masquer mon adresse e-mail », jusqu’ici sur le domaine icloud.com, seront émises sur private.icloud.com.

Or, depuis environ deux semaines que l’information est parue, beaucoup critiquent ce changement, notamment sur Reddit. En dehors du changement lui-même qui peut révéler instantanément qu’il s’agit d’une fausse adresse, la critique qui revient le plus souvent est la capacité des entreprises à bloquer plus simplement ce type d’adresse.

« Hide My Email est efficace précisément parce que tu ne peux pas facilement filtrer les adresses qu’il génère. Je serais très surpris si on ne voit pas des services commencer à refuser de te laisser t’inscrire avec un domaine private.icloud.com. Ça sent l’industrie qui fait pression sur Apple, ce qui est hilarant puisque ça a essentiellement tué la principale métrique que les spécialistes du marketing par e-mail utilisaient pour mesurer la performance (ce qui était bien, les clics sont une bien meilleure métrique à optimiser) », juge ainsi l’utilisateur MalevolentFerret.

Problème : si Apple a communiqué sur le changement, l’entreprise n’a rien dit sur les raisons qui la poussaient à cette unification. S’il s’agit réellement d’une pression de l’industrie, il est possible qu’un nombre croissant de services finissent en effet par rejeter les créations de comptes basées sur ces fausses adresses.

Apple précise quand même dans sa note que toutes les adresses déjà en place continueront de fonctionner de la même manière. La modification ne concernera que les adresses créées après la bascule, dont la date exacte n’est pas connue.

TechCrunch rappelle en outre que si un utilisateur iCloud+ peut effectivement créer de fausses adresses, Apple garde en main les informations qui permettent de la relier au compte réel, les fausses adresses fonctionnant – dans les grandes lignes – comme un alias. L’entreprise en a donné la preuve fin mars, lorsqu’elle a remis au FBI les informations d’un utilisateur qui avait utilisé une adresse masquée pour un courrier jugé « menaçant » à la compagne de Kash Patel, directeur du FBI.

☕️ Le support du décodage vidéo via Vulkan arrive enfin dans Firefox

2 juillet 2026 à 09:39


C’est une excellente nouvelle pour les utilisateurs sur Linux : le navigateur de Mozilla va enfin se doter d’une vraie solution de décodage matériel en utilisant Vulkan, comme relevé par Phoronix.

Historiquement, Mozilla désactive par défaut le décodage vidéo matériel pour l’ensemble des cartes NVIDIA sur Linux. Pour pallier cela, la communauté devait s’appuyer sur des solutions de contournement tierces comme le paquet nvidia-vaapi-driver.

L’implémentation d’une voie de décodage native basée sur l’extension Vulkan Video (en s’appuyant sur le support de décodage Vulkan de FFmpeg) vise à éliminer le besoin de ces pilotes intermédiaires. Initialement motivé par le besoin d’apporter le décodage matériel sur les architectures ARM64 (comme le NVIDIA DGX Spark basé sur une puce Grace Hopper GB10 qui ne supporte ni VA-API ni V4L2), ce chantier profite par extension aux configurations x86_64 équipées de GPU NVIDIA.

Logo de la fondation Mozilla

Le code est d’ores et déjà présent et testable dans les versions Firefox 153 Beta et Nightly. La version finale doit sortir le 21 juillet, mais la fonction y sera désactivée par défaut. Elle est en effet considérée comme hautement expérimentale, avec des régressions et des cas limites identifiés, notamment sur les ordinateurs portables équipés de solutions graphiques hybrides (IGP AMD ou Intel + GPU dédié).

De plus, et c’est un vrai problème, cette implémentation a absolument besoin des pilotes propriétaires NVIDIA en version 595.X au moins. Ce qui exclut d’office les architectures plus anciennes, dont les cartes 10XX (génération Pascal), limitées aux versions 580.X des pilotes.

Pour les personnes souhaitant essayer cette nouveauté dans l’une des deux branches tests concernées de Firefox, il faut se rendre dans about:config et passer les deux clés suivantes sur « true » :

  • media.hardware-video-decoding-vulkan.enabled
  • media.hardware-video-decoding-vulkan.direct-export.enabled

☕️ Le support du décodage vidéo via Vulkan arrive enfin dans Firefox

2 juillet 2026 à 09:39


C’est une excellente nouvelle pour les utilisateurs sur Linux : le navigateur de Mozilla va enfin se doter d’une vraie solution de décodage matériel en utilisant Vulkan, comme relevé par Phoronix.

Historiquement, Mozilla désactive par défaut le décodage vidéo matériel pour l’ensemble des cartes NVIDIA sur Linux. Pour pallier cela, la communauté devait s’appuyer sur des solutions de contournement tierces comme le paquet nvidia-vaapi-driver.

L’implémentation d’une voie de décodage native basée sur l’extension Vulkan Video (en s’appuyant sur le support de décodage Vulkan de FFmpeg) vise à éliminer le besoin de ces pilotes intermédiaires. Initialement motivé par le besoin d’apporter le décodage matériel sur les architectures ARM64 (comme le NVIDIA DGX Spark basé sur une puce Grace Hopper GB10 qui ne supporte ni VA-API ni V4L2), ce chantier profite par extension aux configurations x86_64 équipées de GPU NVIDIA.

Logo de la fondation Mozilla

Le code est d’ores et déjà présent et testable dans les versions Firefox 153 Beta et Nightly. La version finale doit sortir le 21 juillet, mais la fonction y sera désactivée par défaut. Elle est en effet considérée comme hautement expérimentale, avec des régressions et des cas limites identifiés, notamment sur les ordinateurs portables équipés de solutions graphiques hybrides (IGP AMD ou Intel + GPU dédié).

De plus, et c’est un vrai problème, cette implémentation a absolument besoin des pilotes propriétaires NVIDIA en version 595.X au moins. Ce qui exclut d’office les architectures plus anciennes, dont les cartes 10XX (génération Pascal), limitées aux versions 580.X des pilotes.

Pour les personnes souhaitant essayer cette nouveauté dans l’une des deux branches tests concernées de Firefox, il faut se rendre dans about:config et passer les deux clés suivantes sur « true » :

  • media.hardware-video-decoding-vulkan.enabled
  • media.hardware-video-decoding-vulkan.direct-export.enabled

Proton lance son assistant IA Lumo 2.0 avec génération d’images et mémoire

2 juillet 2026 à 07:58
Avec de vrais morceaux de Chine dedans
Proton lance son assistant IA Lumo 2.0 avec génération d’images et mémoire

L’éditeur suisse passe la seconde avec la nouvelle version majeure de son LLM et de l’assistant qui l’accompagne. Lumo 2.0 marque surtout un gros rattrapage sur les produits existants, avec des fonctions comme la mémoire et la recherche sur le web.

Proton a lancé la première version de son assistant IA en juillet 2025, avec la promesse d’une confidentialité totale basée sur le chiffrement de bout en bout, zéro accès, et l’absence de logs. Selon l’entreprise, son assistant est utilisé par dix millions de personnes aujourd’hui.

Pour fêter son premier anniversaire, Proton lance la version 2.0. L’éditeur affirme que cette mouture est le changement le plus important sur l’assistant depuis sa création, avec une nouvelle architecture.

L’assistant peut être utilisé selon quatre modes :

  • Lumo 2.0 Lite : gère les questions générales, l’aide à la rédaction, le résumé et les autres tâches courantes
  • Lumo 2.0 Max : offre un raisonnement plus poussé, une compréhension contextuelle plus large et des réponses plus précises, pour les tâches complexes
  • Mode Fast : conçu pour les requêtes simples, les recherches rapides et les tâches bénéficiant de réponses immédiates
  • Mode Thinking : réponses plus détaillées pour les problèmes nécessitant une analyse multi-étapes plus profonde, avec le classique raisonnement visible en temps réel

Nombreuses nouvelles fonctions

Lumo 2.0 apparait comme une vaste mise à jour visant à rattraper le retard sur les modèles existants. Le nouveau modèle prend ainsi en charge la multimodalité, capable de traiter du texte et des images. On peut envoyer une image à analyser, créer des visuels à partir d’un prompt ou d’une esquisse, éditer des images existantes, le tout dans la même conversation. Proton assure que toutes les données envoyées bénéficient de la garantie zéro accès.

L’un des plus gros changements de Lumo 2.0 est la possibilité de chercher – enfin – des informations sur le web pour répondre à des questions, avec citation des sources. L’assistant reçoit également une mémoire persistante, qui lui permet d’apprendre les préférences et le style, pour que chaque conversation démarre avec plus de contexte. Comme dans les autres fonctions du même acabit, l’utilisateur décide de ce qui est retenu ou oublié.

Puisque l’on parle de contexte, Proton indique dans son billet d’annonce que la fenêtre a doublé avec Lumo 2.0, permettant des conversations plus longues et cohérentes ainsi qu’un raisonnement sur des documents et jeux de données plus volumineux. L’entreprise ne donne malheureusement aucun chiffre.

Les Projects deviennent des espaces de travail chiffrés dédiés regroupant conversations, fichiers et instructions. S’y ajoutent les Custom Lumos, décrits comme des assistants sur mesure adaptés à des tâches spécifiques, comparables aux « Gems » de Gemini.

Performances : les gros chiffres

Proton communique des gains de performance mesurés sur l’Artificial Analysis Intelligence Index, un benchmark indépendant agrégeant neuf évaluations dont GDPval-AA v2, Terminal-Bench v2.1, Humanity’s Last Exam et GPQA Diamond. Les résultats annoncés : Lumo 2.0 Lite obtient un score supérieur de 127 % à Lumo 1.4, et Lumo 2.0 Max de 240 %. Sur les mêmes résultats, on peut voir que Lumo 2.0 Max obtient 51 points, à mi-chemin entre les 44 points de Claude Sonnet 4.6 et les 55 points de GPT 5.5 (56 pour Claude Opus 4.8).

Sur la latence, Proton annonce que les requêtes courantes sont traitées jusqu’à 76 % plus rapidement que sous Lumo 1.4. Andy Yen, PDG de Proton, affirme (via 9to5Mac) que les tests utilisateurs montrent que l’écart s’est réduit au point que, pour de nombreux cas d’usage, les utilisateurs ne perçoivent plus de différence qualitative entre Lumo 2.0 Max et les derniers modèles d’OpenAI et d’Anthropic. Il s’agit toutefois d’une déclaration du fabricant, non d’un benchmark tiers indépendant.

Le court test publié par It’s FOSS relativise ce discours marketing : sur une tâche d’édition d’image (correction d’une faute de frappe dans une bannière), Lumo 2.0 Max en mode Thinking n’a pas détecté l’erreur, puis a fini par abandonner après plusieurs tentatives.

Confidentialité, disponibilité et prix

Comme on pouvait s’y attendre, Proton met largement l’accent sur la confidentialité. L’éditeur suisse s’est spécialisé depuis longtemps dans les services chiffrés de bout en bout. Il pointe le contraste avec les fournisseurs dominants et affirme que Lumo repose sur cinq principes : aucun log, chiffrement zéro accès (en transit et au repos), aucun partage de données, aucune utilisation des conversations pour l’entraînement, et modèles de langage open source.

Quels modèles ? Dans une page du support, Proton le précise : Qwen 3.5, GLM 5.2, Image-Turbo et FireRed-Image-Edit-1.1. Dans cette configuration, Qwen est très probablement utilisé pour la version Light et GLM pour Max. Pour rappel, le modèle chinois GLM 5.2 fait sensation depuis sa sortie, pour ses performances autant que ses poids ouverts. Proton prend bien soin d’ajouter que tous les modèles fonctionnent exclusivement sur ses serveurs et que les données ne sont jamais envoyées chez un tiers.

L’infrastructure reste entièrement européenne, protégée par le droit suisse sur la confidentialité et le chiffrement zéro accès, « ce qui signifie que l’accès à Lumo ne peut pas être soumis aux décrets exécutifs américains et que les données des utilisateurs ne sont pas soumises aux demandes de collecte américaine ».

Lumo 2.0 est déjà disponible avec l’ensemble de ses fonctions. La formule Free permet d’utiliser la version Lite pour les fonctions de base, pour un « usage privé quotidien ». Il faut la formule Plus, vendue 12,99 euros par mois, pour avoir la version max du modèle avec discussions illimitées, Projects, génération d’images et accès au modèle Max.

Des formules Professional (14,99 euros par utilisateur et par mois) et Business (24,99 euros par utilisateur et par mois) sont disponibles pour les entreprises, la seconde apportant une administration centralisée et des garanties de conformité pour les organisations.

Enfin, sur Reddit, on note des signalements de fonctions absentes et que des utilisateurs aimeraient avoir, notamment l’API correspondante, le support MCP et un Lumo CLI.

Proton lance son assistant IA Lumo 2.0 avec génération d’images et mémoire

2 juillet 2026 à 07:58
Avec de vrais morceaux de Chine dedans
Proton lance son assistant IA Lumo 2.0 avec génération d’images et mémoire

L’éditeur suisse passe la seconde avec la nouvelle version majeure de son LLM et de l’assistant qui l’accompagne. Lumo 2.0 marque surtout un gros rattrapage sur les produits existants, avec des fonctions comme la mémoire et la recherche sur le web.

Proton a lancé la première version de son assistant IA en juillet 2025, avec la promesse d’une confidentialité totale basée sur le chiffrement de bout en bout, zéro accès, et l’absence de logs. Selon l’entreprise, son assistant est utilisé par dix millions de personnes aujourd’hui.

Pour fêter son premier anniversaire, Proton lance la version 2.0. L’éditeur affirme que cette mouture est le changement le plus important sur l’assistant depuis sa création, avec une nouvelle architecture.

L’assistant peut être utilisé selon quatre modes :

  • Lumo 2.0 Lite : gère les questions générales, l’aide à la rédaction, le résumé et les autres tâches courantes
  • Lumo 2.0 Max : offre un raisonnement plus poussé, une compréhension contextuelle plus large et des réponses plus précises, pour les tâches complexes
  • Mode Fast : conçu pour les requêtes simples, les recherches rapides et les tâches bénéficiant de réponses immédiates
  • Mode Thinking : réponses plus détaillées pour les problèmes nécessitant une analyse multi-étapes plus profonde, avec le classique raisonnement visible en temps réel

Nombreuses nouvelles fonctions

Lumo 2.0 apparait comme une vaste mise à jour visant à rattraper le retard sur les modèles existants. Le nouveau modèle prend ainsi en charge la multimodalité, capable de traiter du texte et des images. On peut envoyer une image à analyser, créer des visuels à partir d’un prompt ou d’une esquisse, éditer des images existantes, le tout dans la même conversation. Proton assure que toutes les données envoyées bénéficient de la garantie zéro accès.

L’un des plus gros changements de Lumo 2.0 est la possibilité de chercher – enfin – des informations sur le web pour répondre à des questions, avec citation des sources. L’assistant reçoit également une mémoire persistante, qui lui permet d’apprendre les préférences et le style, pour que chaque conversation démarre avec plus de contexte. Comme dans les autres fonctions du même acabit, l’utilisateur décide de ce qui est retenu ou oublié.

Puisque l’on parle de contexte, Proton indique dans son billet d’annonce que la fenêtre a doublé avec Lumo 2.0, permettant des conversations plus longues et cohérentes ainsi qu’un raisonnement sur des documents et jeux de données plus volumineux. L’entreprise ne donne malheureusement aucun chiffre.

Les Projects deviennent des espaces de travail chiffrés dédiés regroupant conversations, fichiers et instructions. S’y ajoutent les Custom Lumos, décrits comme des assistants sur mesure adaptés à des tâches spécifiques, comparables aux « Gems » de Gemini.

Performances : les gros chiffres

Proton communique des gains de performance mesurés sur l’Artificial Analysis Intelligence Index, un benchmark indépendant agrégeant neuf évaluations dont GDPval-AA v2, Terminal-Bench v2.1, Humanity’s Last Exam et GPQA Diamond. Les résultats annoncés : Lumo 2.0 Lite obtient un score supérieur de 127 % à Lumo 1.4, et Lumo 2.0 Max de 240 %. Sur les mêmes résultats, on peut voir que Lumo 2.0 Max obtient 51 points, à mi-chemin entre les 44 points de Claude Sonnet 4.6 et les 55 points de GPT 5.5 (56 pour Claude Opus 4.8).

Sur la latence, Proton annonce que les requêtes courantes sont traitées jusqu’à 76 % plus rapidement que sous Lumo 1.4. Andy Yen, PDG de Proton, affirme (via 9to5Mac) que les tests utilisateurs montrent que l’écart s’est réduit au point que, pour de nombreux cas d’usage, les utilisateurs ne perçoivent plus de différence qualitative entre Lumo 2.0 Max et les derniers modèles d’OpenAI et d’Anthropic. Il s’agit toutefois d’une déclaration du fabricant, non d’un benchmark tiers indépendant.

Le court test publié par It’s FOSS relativise ce discours marketing : sur une tâche d’édition d’image (correction d’une faute de frappe dans une bannière), Lumo 2.0 Max en mode Thinking n’a pas détecté l’erreur, puis a fini par abandonner après plusieurs tentatives.

Confidentialité, disponibilité et prix

Comme on pouvait s’y attendre, Proton met largement l’accent sur la confidentialité. L’éditeur suisse s’est spécialisé depuis longtemps dans les services chiffrés de bout en bout. Il pointe le contraste avec les fournisseurs dominants et affirme que Lumo repose sur cinq principes : aucun log, chiffrement zéro accès (en transit et au repos), aucun partage de données, aucune utilisation des conversations pour l’entraînement, et modèles de langage open source.

Quels modèles ? Dans une page du support, Proton le précise : Qwen 3.5, GLM 5.2, Image-Turbo et FireRed-Image-Edit-1.1. Dans cette configuration, Qwen est très probablement utilisé pour la version Light et GLM pour Max. Pour rappel, le modèle chinois GLM 5.2 fait sensation depuis sa sortie, pour ses performances autant que ses poids ouverts. Proton prend bien soin d’ajouter que tous les modèles fonctionnent exclusivement sur ses serveurs et que les données ne sont jamais envoyées chez un tiers.

L’infrastructure reste entièrement européenne, protégée par le droit suisse sur la confidentialité et le chiffrement zéro accès, « ce qui signifie que l’accès à Lumo ne peut pas être soumis aux décrets exécutifs américains et que les données des utilisateurs ne sont pas soumises aux demandes de collecte américaine ».

Lumo 2.0 est déjà disponible avec l’ensemble de ses fonctions. La formule Free permet d’utiliser la version Lite pour les fonctions de base, pour un « usage privé quotidien ». Il faut la formule Plus, vendue 12,99 euros par mois, pour avoir la version max du modèle avec discussions illimitées, Projects, génération d’images et accès au modèle Max.

Des formules Professional (14,99 euros par utilisateur et par mois) et Business (24,99 euros par utilisateur et par mois) sont disponibles pour les entreprises, la seconde apportant une administration centralisée et des garanties de conformité pour les organisations.

Enfin, sur Reddit, on note des signalements de fonctions absentes et que des utilisateurs aimeraient avoir, notamment l’API correspondante, le support MCP et un Lumo CLI.

Reçu — 1 juillet 2026 Actualités numériques

Dans l’ombre de Mythos et Fable ressuscités, la Chine progresse rapidement

1 juillet 2026 à 14:01
La vie trouve toujours un chemin
Dans l’ombre de Mythos et Fable ressuscités, la Chine progresse rapidement

Anthropic l’a annoncé le 30 juin : Mythos 5 est de retour et Fable 5 à partir de ce 1ᵉʳ juillet. L’entreprise s’explique dans un billet, mais elle a perdu un temps précieux face à la Chine et ses modèles à poids ouvert. L’image d’Anthropic est également entachée par des rumeurs de surveillance d’utilisateurs chinois.

Petit rappel des faits sur les dernières semaines. Le 9 juin 2026, Anthropic lance Claude Fable 5 (version publique de son architecture Mythos, avec garde-fous). Mythos 5 (version sans ces garde-fous) reste soumis à un accès via son programme Glasswing, réservé à des organisations vérifiées.

Trois jours plus tard, le 12 juin, le Département du Commerce, par l’intermédiaire du secrétaire Howard Lutnick, envoie à Anthropic une directive de contrôle des exportations exigeant la suspension de tout accès à Fable 5 et Mythos 5 pour tout ressortissant étranger, où qu’il se trouve dans le monde, y compris les employés étrangers d’Anthropic. Techniquement incapable de filtrer les utilisateurs par nationalité en temps réel, Anthropic coupe l’accès aux deux modèles pour l’ensemble de ses clients, sur Claude.ai, l’API, AWS Bedrock, Google Cloud et Microsoft Foundry.

Le 26 juin, le gouvernement autorise le rétablissement de Mythos 5 pour environ 100 organisations vérifiées, centrées sur les infrastructures critiques et la cyberdéfense. Fable 5, la version grand public, reste hors service. Désormais, les modèles sont de retour, dans la même situation qu’avant le blocage imposé par Washington. Anthropic a cependant perdu un temps précieux et la situation reste floue.

Une relation complexe avec la Maison-Blanche

Les raisons qui ont poussé la Maison-Blanche ne sont pas entièrement claires aujourd’hui. Selon le propre billet d’Anthropic, la lettre reçue ne fournissait pas de détails précis sur la préoccupation de sécurité nationale, mais l’entreprise a compris que le gouvernement avait eu connaissance d’une méthode permettant de contourner, ou de « jailbreaker », Fable 5. Ce qui revenait presque à dire que l’on pouvait obtenir Mythos facilement. La technique en question consistait, selon Anthropic, à demander au modèle de lire une base de code spécifique et d’en corriger les failles logicielles.

Bien que certaines rumeurs aient évoqué un modèle si puissant qu’il avait fait tomber les défenses de la NSA, il est difficile d’établir le sérieux de ces bruits de couloir. Anthropic, dans tous les cas, a vigoureusement contesté la proportionnalité de la mesure. L’entreprise a ainsi affirmé que le niveau de capacité démontré était largement disponible chez d’autres fournisseurs, y compris GPT-5.5 d’OpenAI. En outre, les tests menés avant le lancement, pendant des milliers d’heures avec le gouvernement américain, l’AISI britannique et des tiers, n’avaient identifié aucun jailbreak universel.

Pour Anthropic, cela revient à dire qu’un contournement spécifique et non-universel, permettant d’obtenir dans un cas précis des informations de type « recherche de vulnérabilité », a suffi à déclencher le retrait mondial de deux modèles commerciaux déployés auprès de centaines de millions d’utilisateurs.


Il reste 73% de l'article à découvrir.
Vous devez être abonné•e pour lire la suite de cet article.
Déjà abonné•e ? Générez une clé RSS dans votre profil.

Microsoft lance ses conteneurs WSL (Linux) en préversion

1 juillet 2026 à 08:32
C'est contre-naturaaaaaaan
Microsoft lance ses conteneurs WSL (Linux) en préversion

Durant sa conférence Build 2026, Microsoft a présenté « WSL container », une intégration native de gestion de conteneurs Linux dans WSL (Windows Subsystem for Linux). L’outil est désormais disponible en préversion, avec une version finale prévue pour l’automne.

L’objectif est de fournir un moyen intégré – et prêt pour l’entreprise – de créer, exécuter et gérer des conteneurs Linux sur Windows, sans nécessiter d’outillage tiers supplémentaire. La préversion publique est disponible depuis ce 29 juin. On peut la récupérer via la commande « wsl --update --pre-release » ou en la téléchargeant directement depuis GitHub, en version 2.9.3.

Pour le CLI et les applications

La fonction se déploie à travers deux composants. Le CLI d’abord (wslc.exe), via un nouveau binaire ajouté au PATH lors de la mise à jour. Il permet de gérer l’intégralité du flux de travail pour le développement de conteneurs Linux, avec exécution, débogage, tests et autres. Ensuite, une API conteneurs, via un paquet NuGet qui permet aux applications Windows natives d’utiliser des conteneurs Linux dans leur logique. Les langages C, C++ et C# sont pris en charge. Cette API s’intègre aussi avec MSBuild et CMake, permettant d’automatiser le build/déploiement de conteneurs dans le pipeline.

L’arrivée de cette fonction provoque également d’autres changements. Par exemple, le plugin Microsoft Defender for Endpoints (MDE) est mis à jour pour couvrir aussi les événements de conteneurs Linux, via une nouvelle version en préversion privée. Dans Intune, on trouve de nouveaux paramètres de gestion permettant de contrôler l’usage des distributions et conteneurs WSL. Signalons encore le support de wslc dans Visual Studio Code Dev Containers, pour l’instant en préversion 0.462.0. On peut l’activer en modifiant le paramètre « Docker Path » vers « wslc ».

Un nouveau système de fichiers

Plusieurs évolutions techniques importantes sont aussi de la partie. La plus significative est sans doute virtiofs, un nouveau système de fichiers par défaut qui rend l’accès aux fichiers Windows deux fois plus rapide, selon Microsoft. Il est pour l’instant limité aux conteneurs WSL, mais devrait être répercuté plus tard dans tout WSL.

Autre ajout majeur : un nouveau mode réseau. Baptisé « Consomme », il permet de relayer le trafic réseau Linux à travers Windows pour que les applications Linux bénéficient du même environnement réseau, des mêmes politiques de sécurité et des mêmes intégrations entreprise que les applications Windows. Enfin, Microsoft évoque de meilleures techniques de libération progressive de la mémoire vers l’hôte Windows « quand elle n’est pas utilisée par la machine virtuelle Linux ».

La disponibilité en version finale est fixée à l’automne 2026, donc dans quelques mois. Microsoft précise dans son billet de blog que des outils tiers existants comme Docker Desktop, Podman Desktop et Rancher Desktop, qui s’appuient sur WSL, « bénéficieront de tous de ces changements de plateforme de bas niveau ».

Microsoft lance ses conteneurs WSL (Linux) en préversion

1 juillet 2026 à 08:32
C'est contre-naturaaaaaaan
Microsoft lance ses conteneurs WSL (Linux) en préversion

Durant sa conférence Build 2026, Microsoft a présenté « WSL container », une intégration native de gestion de conteneurs Linux dans WSL (Windows Subsystem for Linux). L’outil est désormais disponible en préversion, avec une version finale prévue pour l’automne.

L’objectif est de fournir un moyen intégré – et prêt pour l’entreprise – de créer, exécuter et gérer des conteneurs Linux sur Windows, sans nécessiter d’outillage tiers supplémentaire. La préversion publique est disponible depuis ce 29 juin. On peut la récupérer via la commande « wsl --update --pre-release » ou en la téléchargeant directement depuis GitHub, en version 2.9.3.

Pour le CLI et les applications

La fonction se déploie à travers deux composants. Le CLI d’abord (wslc.exe), via un nouveau binaire ajouté au PATH lors de la mise à jour. Il permet de gérer l’intégralité du flux de travail pour le développement de conteneurs Linux, avec exécution, débogage, tests et autres. Ensuite, une API conteneurs, via un paquet NuGet qui permet aux applications Windows natives d’utiliser des conteneurs Linux dans leur logique. Les langages C, C++ et C# sont pris en charge. Cette API s’intègre aussi avec MSBuild et CMake, permettant d’automatiser le build/déploiement de conteneurs dans le pipeline.

L’arrivée de cette fonction provoque également d’autres changements. Par exemple, le plugin Microsoft Defender for Endpoints (MDE) est mis à jour pour couvrir aussi les événements de conteneurs Linux, via une nouvelle version en préversion privée. Dans Intune, on trouve de nouveaux paramètres de gestion permettant de contrôler l’usage des distributions et conteneurs WSL. Signalons encore le support de wslc dans Visual Studio Code Dev Containers, pour l’instant en préversion 0.462.0. On peut l’activer en modifiant le paramètre « Docker Path » vers « wslc ».

Un nouveau système de fichiers

Plusieurs évolutions techniques importantes sont aussi de la partie. La plus significative est sans doute virtiofs, un nouveau système de fichiers par défaut qui rend l’accès aux fichiers Windows deux fois plus rapide, selon Microsoft. Il est pour l’instant limité aux conteneurs WSL, mais devrait être répercuté plus tard dans tout WSL.

Autre ajout majeur : un nouveau mode réseau. Baptisé « Consomme », il permet de relayer le trafic réseau Linux à travers Windows pour que les applications Linux bénéficient du même environnement réseau, des mêmes politiques de sécurité et des mêmes intégrations entreprise que les applications Windows. Enfin, Microsoft évoque de meilleures techniques de libération progressive de la mémoire vers l’hôte Windows « quand elle n’est pas utilisée par la machine virtuelle Linux ».

La disponibilité en version finale est fixée à l’automne 2026, donc dans quelques mois. Microsoft précise dans son billet de blog que des outils tiers existants comme Docker Desktop, Podman Desktop et Rancher Desktop, qui s’appuient sur WSL, « bénéficieront de tous de ces changements de plateforme de bas niveau ».

Reçu — 30 juin 2026 Actualités numériques

☕️ Voici LinuxMD, un Linux pour… la Mega Drive

30 juin 2026 à 15:05


Ce n’est pas une plaisanterie : le développeur Daniel Palmer propose sur GitHub une distribution visant la Mega Drive, la vénérable console que Sega avait lancé dans nos contrées en 1990 (aussi commercialisée sous le nom Genesis aux États-Unis). Elle avait alors provoqué un séisme vidéoludique, l’entreprise ayant coupé l’herbe sous le pied de Nintendo avec sa propre console 16 bits, la SNES.

L’information peut tellement surprendre que sur le dépôt, son auteur répond « non » à la question « Est-ce une blague ? ». Il précise que pour utiliser ce système, il est nécessaire d’avoir une Mega Drive (on s’en serait douté), la cartouche EverDrive qui permet de charger d’autres contenus sur la console, un câble USB pour relier l’EverDrive au PC et… « du temps à perdre », ajoute l’auteur.

Au sujet de l’émulation, c’est plus compliqué. L’auteur estime que LinuxMD ne fonctionnera « probablement pas » sur un émulateur classique, car plusieurs composants de l’EverDrive y seraient absents. En revanche, il fournit un fork de QEMU qui peut « émuler suffisamment » la Mega Drive et l’EverDrive pour fonctionner. En revanche, la sensation ne sera pas la même, prévient-il, car « QEMU émule le CPU beaucoup trop rapidement ».

De nombreuses instructions sont données, le concept étant clairement destiné à un public très niche d’enthousiastes ayant encore ce genre de matériel à disposition.

☕️ Voici LinuxMD, un Linux pour… la Mega Drive

30 juin 2026 à 15:05


Ce n’est pas une plaisanterie : le développeur Daniel Palmer propose sur GitHub une distribution visant la Mega Drive, la vénérable console que Sega avait lancé dans nos contrées en 1990 (aussi commercialisée sous le nom Genesis aux États-Unis). Elle avait alors provoqué un séisme vidéoludique, l’entreprise ayant coupé l’herbe sous le pied de Nintendo avec sa propre console 16 bits, la SNES.

L’information peut tellement surprendre que sur le dépôt, son auteur répond « non » à la question « Est-ce une blague ? ». Il précise que pour utiliser ce système, il est nécessaire d’avoir une Mega Drive (on s’en serait douté), la cartouche EverDrive qui permet de charger d’autres contenus sur la console, un câble USB pour relier l’EverDrive au PC et… « du temps à perdre », ajoute l’auteur.

Au sujet de l’émulation, c’est plus compliqué. L’auteur estime que LinuxMD ne fonctionnera « probablement pas » sur un émulateur classique, car plusieurs composants de l’EverDrive y seraient absents. En revanche, il fournit un fork de QEMU qui peut « émuler suffisamment » la Mega Drive et l’EverDrive pour fonctionner. En revanche, la sensation ne sera pas la même, prévient-il, car « QEMU émule le CPU beaucoup trop rapidement ».

De nombreuses instructions sont données, le concept étant clairement destiné à un public très niche d’enthousiastes ayant encore ce genre de matériel à disposition.

☕️ Wine 11.12 disponible avec le support de la mise à l’échelle fractionnaire pour Wayland

30 juin 2026 à 09:30


Nouvelle version pour Wine, la couche de compatibilité permettant aux applications Windows de fonctionner sur un système Linux. Wine sert pour rappel de base à Proton, une autre couche de compatibilité. Développée par Valve et spécialisée dans les jeux, elle est au cœur de la distribution SteamOS, qui équipe le Steam Deck et la nouvelle Steam Machine.

Cette mouture 11.12 apporte de petites améliorations çà et là, mais elle introduit surtout la prise en charge de la mise à l’échelle fractionnaire pour Wayland. Cela signifie que cette capacité d’affichage est supportée sur l’ensemble des sessions Wayland.

La mise à l’échelle fractionnaire, ou « fractionnal scaling », est un mécanisme logiciel utilisé par les systèmes d’exploitation pour adapter la taille de l’interface graphique (textes, icônes, fenêtres) sur des écrans à haute densité de pixels (HiDPI ou 4K). On peut la comparer à une loupe. C’est cette technique qui est utilisée quand les réglages d’un système proposent du 125, 150 ou 175 % sur le niveau de zoom de l’interface.

Dans le cas de Wine, la mise à l’échelle de son interface devrait donc être nette, alors que le passage par X11/XWayland utilisé jusqu’à présent pouvait entraîner du flou et d’autres petits artefacts visuels.

Wine 11.12 apporte quelques autres nouveautés, comme le regroupement des bibliothèques libswresample et libswscale de FFmpeg, la mise à jour du moteur Mono avec Mono 11.2, ou encore un retour de XSLPattern dans le parseur MSXML. Une trentaine de bugs ont également été corrigés, dont certains avec de vieilles applications, comme Office 2007. On trouve même un correctif pour… Microsoft Money 97.

☕️ Wine 11.12 disponible avec le support de la mise à l’échelle fractionnaire pour Wayland

30 juin 2026 à 09:30


Nouvelle version pour Wine, la couche de compatibilité permettant aux applications Windows de fonctionner sur un système Linux. Wine sert pour rappel de base à Proton, une autre couche de compatibilité. Développée par Valve et spécialisée dans les jeux, elle est au cœur de la distribution SteamOS, qui équipe le Steam Deck et la nouvelle Steam Machine.

Cette mouture 11.12 apporte de petites améliorations çà et là, mais elle introduit surtout la prise en charge de la mise à l’échelle fractionnaire pour Wayland. Cela signifie que cette capacité d’affichage est supportée sur l’ensemble des sessions Wayland.

La mise à l’échelle fractionnaire, ou « fractionnal scaling », est un mécanisme logiciel utilisé par les systèmes d’exploitation pour adapter la taille de l’interface graphique (textes, icônes, fenêtres) sur des écrans à haute densité de pixels (HiDPI ou 4K). On peut la comparer à une loupe. C’est cette technique qui est utilisée quand les réglages d’un système proposent du 125, 150 ou 175 % sur le niveau de zoom de l’interface.

Dans le cas de Wine, la mise à l’échelle de son interface devrait donc être nette, alors que le passage par X11/XWayland utilisé jusqu’à présent pouvait entraîner du flou et d’autres petits artefacts visuels.

Wine 11.12 apporte quelques autres nouveautés, comme le regroupement des bibliothèques libswresample et libswscale de FFmpeg, la mise à jour du moteur Mono avec Mono 11.2, ou encore un retour de XSLPattern dans le parseur MSXML. Une trentaine de bugs ont également été corrigés, dont certains avec de vieilles applications, comme Office 2007. On trouve même un correctif pour… Microsoft Money 97.

Avec le modèle GLM-5.2, la Chine pourrait rebattre les cartes de la cybersécurité

30 juin 2026 à 08:58
De grandes responsabilités
Avec le modèle GLM-5.2, la Chine pourrait rebattre les cartes de la cybersécurité

La stratégie américaine d’embargo pour contrer le secteur technologique chinois serait-elle contreproductive ? La question se pose, alors qu’une société chinoise pourrait bouleverser la cybersécurité en diffusant un modèle capable de rivaliser avec les LLM d’OpenAI et Anthropic.

La Chine parvient à égaler les performances du modèle Mythos d’Anthropic dans certains scénarios de cybersécurité. Une affirmation du Wall Street Journal ce 27 juin, qui se demande dans quelle mesure les décisions de la Maison-Blanche ont pu jouer dans une telle remontée. Depuis DeepSeek et la vaporisation temporaire de 600 milliards de dollars de capitalisation pour NVIDIA, on pouvait cependant s’attendre à ce que la Chine égalise de nouveau le score. Ou en tout cas vienne flirter une nouvelle fois avec les performances des grands modèles de frontière américains.

Le nouveau modèle chinois qui attire les regards se nomme GLM-5.2, lancé le 13 juin par l’entreprise Zhipu AI, renommée Z.ai. Plusieurs benchmarks lui attribuent de très bons résultats, particulièrement en cybersécurité. Au point de rebattre les cartes d’une situation déjà fébrile dans ce domaine, avec un modèle disponible gratuitement depuis HuggingFace.

GLM-5.2, le trublion

GLM-5.2 est un modèle conséquent de 753 milliards de paramètres. Son architecture est de type MoE (Mixture of Experts) avec environ 40 milliards de paramètres actifs à la fois par token (jeton). Un ratio d’activation de 5,4 % qui peut le rendre beaucoup moins onéreux à exécuter qu’un modèle dense (non-MoE) de taille équivalente. La fenêtre contextuelle est d’un million de tokens.

Si l’on parle de ce modèle, c’est qu’au-delà de ses performances, il est également open source (licence MIT) et à poids ouverts. Traduction : en plus d’un accès commercial par l’API de l’entreprise (1,40 dollar par million de jetons en entrée, 4,40 dollars en sortie), n’importe qui peut récupérer le modèle et le modifier à volonté avant de l’utiliser. À condition bien sûr d’avoir le matériel nécessaire.

Quelles performances ?

Dans sa communication, Z.ai met en avant les très bons résultats généraux de GLM-5.2 de manière générale. S’agissant initialement d’un modèle pensé pour la programmation, les benchmarks utilisés sont classiques : 62,1 % pour SWE-bench Pro (résolution de problèmes sur GitHub), 81 sur Terminal-Bench 2.1 (tâches d’agents), ou encore 99,2 sur AIME 2026 (problèmes mathématiques).

Sur les travaux de longue durée, les résultats obtenus sont proches de ceux d’Opus 4.8 d’Anthropic. Par exemple, sur FrontierSWE, GLM-5.2 obtient 74,4 %, contre 75,1 % pour Opus. Sur PostTrainBench, le score est de 34,3 contre 37,2. Sur SWE-Marathon en revanche, le modèle chinois accuse un retard : 13 %, se faisant largement distancer par les 26 % d’Opus 4.8.

L’entreprise chinoise met en avant certains choix architecturaux, dont l’utilisation d’une technique baptisée IndexShare (publication arXiv), permettant d’optimiser le coût de fonctionnement. Cela permet, selon Z.ai, de diviser par trois le coût en calculs par token quand on grimpe jusqu’au maximum de la fenêtre de contexte (un million). Elle affirme qu’au sein du modèle, 75 % des couches sautent entièrement l’étape d’indexation coûteuse, tout en maintenant la qualité des schémas d’attention adaptative.

L’ensemble fait dire à certains observateurs, comme Flowtivity, que GLM-5.2 est en fait meilleur que la grande majorité des grands modèles de frontières américains, car son fonctionnement est nettement moins onéreux (six fois moins cher que GPT-5.5 selon Z.ai). L’ajout d’IndexShare permettrait au modèle de fonctionner sur du matériel « accessible » (mais pas un MacBook Pro avec 16 Go de RAM, tel que celui utilisé pour nos tests de RAG).

Et dans la cybersécurité ?

C’est ici que les choses sérieuses commencent, peut-on dire. Dans une évaluation comparative réalisée par Semgrep, GLM-5.2 a obtenu un score F1 de 39 % sur la détection IDOR, battant Claude Code (32 %) pour environ 0,17 dollar par vulnérabilité trouvée, tout en restant inférieur au pipeline multimodal de Semgrep (53 - 61 % F1).

Même son de cloche chez Graphistry le 23 juin : avec un taux de résolution de 28 sur 59 sur les benchmarks CTF (Capture The Flag) de cybersécurité, GLM-5.2 est le « top modèle » à poids ouverts et rivalise directement avec les modèles propriétaires. Dans les tests, on peut voir par exemple que Claude Code avec Opus 4.7 est 19 % plus rapide, mais il est aussi 2,2 fois plus cher à l’utilisation.

C’est ce qui fait dire à Graphistry que GLM-5.2 est le premier modèle à poids ouverts testé par leurs soins pouvant être recommandé pour une « expérience de cybersécurité de qualité frontière ».

Comment de tels résultats ont-ils été obtenus si rapidement ?

C’est l’une des grandes questions autour de GLM-5.2. Les soupçons n’ont d’ailleurs pas tardé, dans les jours qui ont suivi la publication du modèle : Z.ai a-t-elle distillé agressivement les grands modèles de frontière américains ? Pour rappel, la distillation est initialement une technique légitime d’apprentissage machine : un modèle étudiant apprend à imiter les sorties d’un modèle enseignant. Cependant, il y a problème quand elle est faite en violation des conditions d’utilisation des API, via des comptes proxy et à l’échelle industrielle. Une technique formellement interdite dans les conditions pour toutes les API commerciales. Pour les « copieurs », le résultat obtenu est un transfert de capacités sans garde-fous.


Il reste 56% de l'article à découvrir.
Vous devez être abonné•e pour lire la suite de cet article.
Déjà abonné•e ? Générez une clé RSS dans votre profil.

Reçu — 29 juin 2026 Actualités numériques

Dis Next, c’est quoi un « RAG » en IA générative ?

29 juin 2026 à 07:09
Rag against the machine
Dis Next, c’est quoi un « RAG » en IA générative ?

Ces dernières années, vous entendez peut-être parler de RAG, surtout dans le monde des entreprises. De quoi s’agit-il ? Pourquoi certaines organisations n’ont que ce mot à la bouche ? On vous explique tout, le plus simplement possible.

RAG signifie « Retrieval-Augmented Generation », littéralement « génération augmentée par récupération ». Dans les grandes lignes, c’est un type d’architecture que l’on met en place pour obtenir des réponses rapides et précises sur une base de connaissances spécifiques, en utilisant de l’IA.

Des explications sans (trop de) jargon

Pour comprendre ce que le RAG permet, on utilise souvent l’analogie d’un expert, mais qui n’aurait pas connaissance de l’armoire dans laquelle vous rangez tous vos documents. Il peut s’agir de modes d’emploi, de cartes de vœux, de livres particuliers, voire de factures et d’autres informations que vous avez jugées suffisamment importantes pour les placer là. L’expert en sait beaucoup, mais il ne pourra répondre à aucune question sur le contenu de cette armoire. On peut toujours décrire le type de documents que l’on possède, ses réponses manqueront de précision.

IA générative : le RAG par l’exemple, avec 15 000 actus Next et Mistral 7B

C’est un comportement que l’on retrouve dans les IA génératives habituellement. Elles « savent » quantité de choses, mais si vous êtes dans une entreprise possédant un grand nombre de ressources, l’IA n’y aura probablement pas accès.

Or, ces ressources internes peuvent être à la fois le cœur d’une entreprise comme sa base d’exploitation. Si vous mettez en place un chatbot pour gérer l’assistance, il vaut mieux qu’il ait accès à ces ressources. Les réponses données pourraient sinon être vagues, ou même – pire ! – inventées. Car les IA génératives hallucinent et ont encore bien du mal à répondre simplement « Je ne sais pas ».


Il reste 80% de l'article à découvrir.
Vous devez être abonné•e pour lire la suite de cet article.
Déjà abonné•e ? Générez une clé RSS dans votre profil.

Reçu — 26 juin 2026 Actualités numériques

☕️ Un an à peine après son lancement, Notion annonce déjà la fin de son client Mail

26 juin 2026 à 09:47


En avril 2025, Notion lançait la première version de sa nouvelle application : Notion Mail. Initialement compatible avec Gmail, sa valeur ajoutée devait résider dans l’utilisation de l’IA et l’organisation automatique, grâce à son expérience acquise dans son application de prise de notes.

Las ! L’entreprise jette l’éponge. Dans un tweet publié le 25 juin, elle annonce qu’elle mettra fin à toutes les variantes le 22 septembre : la version web, l’application desktop et celle pour iOS.

« À mesure que les agents Notion sont devenus plus performants, nous avons vu de plus en plus d’utilisateurs leur confier leurs flux de travail par e-mail. Aujourd’hui, plus de la moitié des utilisateurs de Notion Mail gèrent leurs e-mails sans jamais ouvrir leur boîte de réception. Nous misons donc tout sur l’utilisation des agents pour gérer votre boîte de réception », affirme Notion.

L’éditeur se dit « reconnaissant » envers les personnes qui ont construit leur « routine autour de Notion Mail » et qui lui ont fait confiance pour « quelque chose d’aussi important que […] e-mails ».

Côté marche à suivre, les courriers en eux-mêmes ne bougeront pas, puisque ce sont ceux de Gmail, avec lequel l’application se synchronise. En revanche, les brouillons et les e-mails programmés seront supprimés. Notion recommande donc de les sauvegarder avant le 21 septembre.

D’autres en profitent déjà, comme Spark Email, qui vient tout juste de publier sur X un message d’accueil pour les éventuels transfuges, rappelant que son client (payant, à partir de 8,25 euros par mois) est compatible avec Gmail, Outlook et iCloud (en plus des comptes classiques).

☕️ Un an à peine après son lancement, Notion annonce déjà la fin de son client Mail

26 juin 2026 à 09:47


En avril 2025, Notion lançait la première version de sa nouvelle application : Notion Mail. Initialement compatible avec Gmail, sa valeur ajoutée devait résider dans l’utilisation de l’IA et l’organisation automatique, grâce à son expérience acquise dans son application de prise de notes.

Las ! L’entreprise jette l’éponge. Dans un tweet publié le 25 juin, elle annonce qu’elle mettra fin à toutes les variantes le 22 septembre : la version web, l’application desktop et celle pour iOS.

« À mesure que les agents Notion sont devenus plus performants, nous avons vu de plus en plus d’utilisateurs leur confier leurs flux de travail par e-mail. Aujourd’hui, plus de la moitié des utilisateurs de Notion Mail gèrent leurs e-mails sans jamais ouvrir leur boîte de réception. Nous misons donc tout sur l’utilisation des agents pour gérer votre boîte de réception », affirme Notion.

L’éditeur se dit « reconnaissant » envers les personnes qui ont construit leur « routine autour de Notion Mail » et qui lui ont fait confiance pour « quelque chose d’aussi important que […] e-mails ».

Côté marche à suivre, les courriers en eux-mêmes ne bougeront pas, puisque ce sont ceux de Gmail, avec lequel l’application se synchronise. En revanche, les brouillons et les e-mails programmés seront supprimés. Notion recommande donc de les sauvegarder avant le 21 septembre.

D’autres en profitent déjà, comme Spark Email, qui vient tout juste de publier sur X un message d’accueil pour les éventuels transfuges, rappelant que son client (payant, à partir de 8,25 euros par mois) est compatible avec Gmail, Outlook et iCloud (en plus des comptes classiques).

(màj) La Maison-Blanche demande à OpenAI de retarder GPT-5.6 pour examen

26 juin 2026 à 09:22
Brouillard de guerre
(màj) La Maison-Blanche demande à OpenAI de retarder GPT-5.6 pour examen

Le gouvernement américain aurait exigé d’OpenAI une période d’examen similaire pour son futur modèle GPT-5.6. Les performances atteindraient le niveau de Mythos et Fable d’Anthropic et feraient donc l’objet d’une analyse des risques. Seuls des acteurs triés sur le volet y auraient actuellement accès.

Mise à jour 19h30 – OpenAI a lancé ce vendredi soir GPT-5.6… mais uniquement à destination d’une poignée d’organisations et d’entreprises ayant reçu l’aval du gouvernement américain. Trois versions du LLM sont proposées : Sol (la plus puissante), Terra (équilibre performances/efficacité) et Luna (plus rapide et meilleur marché). L’objectif est de déployer ce modèle plus largement dans les prochaines semaines.

Article d’origine – OpenAI aurait accepté d’échelonner la sortie publique de son prochain modèle, GPT-5.6. C’est ce qu’affirme The Information dans un article du 25 juin, relayé par divers autres médias. Le gouvernement Trump aurait officiellement demandé à l’entreprise de retarder cette disponibilité et de lui donner un délai de 30 jours pour examiner la situation. Durant cette période, l’accès ne serait confié qu’à une poignée de partenaires sélectionnés avec soin, le temps que la Maison-Blanche étudie les implications pour la sécurité nationale.

Dans le sillage du décret présidentiel

Le 2 juin, Donald Trump a signé un décret présidentiel (executive order) intitulé « Promoting Advanced Artificial Intelligence Innovation and Security ». Il demande aux entreprises d’IA de soumettre volontairement leurs modèles les plus puissants à un examen gouvernemental jusqu’à 30 jours avant leur publication publique. Il prévoit également la création d’un AI cybersecurity clearinghouse (bureau central de la cybersécurité de l’IA) et mandate des benchmarks classifiés pour évaluer les capacités cyber des modèles.

Cet executive order stipule explicitement que rien dans son texte ne saurait être interprété comme autorisant la création d’une exigence gouvernementale de licences, de pré-autorisation ou de permis pour le développement, la publication ou la distribution de nouveaux modèles. La participation est formellement volontaire. Du moins, sur le papier.

En outre, le cadre opérationnel du décret n’est pas établi. Benchmarks classifiés, liste de modèles concernés, procédures d’évaluation : rien n’est encore fixé. Un groupe multi-agences dirigé par les secrétaires au Trésor, à la Guerre et à la Sécurité intérieure dispose de 60 jours (soit jusqu’au 31 juillet 2026) pour concevoir ce cadre.

Mythos et Fable en ont fait les « frais »

Il n’aura pas fallu dix jours pour qu’Anthropic essuie les plâtres du décret. Le gouvernement américain, invoquant ses pouvoirs en matière de sécurité nationale, a émis une directive de contrôle des exportations ordonnant la suspension immédiate de tout accès à Fable 5 et Mythos 5 pour tout ressortissant étranger, où qu’il se trouve dans le monde, jusqu’aux employés d’Anthropic eux-mêmes.

Anthropic a reçu l’ordre le 12 juin. Le courrier ne contenait aucune raison précise à cette préoccupation gouvernementale. Anthropic, incapable de filtrer ses utilisateurs par nationalité, a fini par appliquer la seule solution qui s’adressait à elle : couper l’accès à tout le monde.

Dans son communiqué du même jour, l’entreprise explique que le gouvernement semble alors penser que Fable 5 a été « jailbreaké », permettant d’outrepasser ses limites. Fable est pour rappel une version de Mythos protégée en théorie par des garde-fous. Mythos n’étant accessible qu’au travers du projet Glasswing, composé d’une quarantaine d’organisations triées sur le volet, un tel jailbreak représentait effectivement un sérieux problème.

Mais Anthropic a vivement contesté le bien-fondé de la mesure : l’entreprise estimait que le jailbreak cité par le gouvernement était étroit et ne déverrouillerait les capacités cybersécurité de Mythos que dans un cas spécifique, pas de façon universelle. Elle ajoutait que le même jailbreak pouvait être utilisé pour obtenir des capacités similaires d’autres modèles publiquement disponibles, dont GPT-5.5 d’OpenAI, qui n’était pourtant pas concerné par de tels contrôles.

La décision s’est inscrite en outre dans un contexte politique tendu : les principaux conseillers tech de Trump, notamment l’ex-czar de l’IA David Sacks (Palantir) et le sous-secrétaire à la Défense Emil Michael, ont publiquement attaqué Anthropic et ses dirigeants. Sacks a accusé Anthropic d’être « woke » et « gauchiste » et de se livrer à une « stratégie sophistiquée de capture réglementaire fondée sur la peur », comme le rappelait Fortune le 13 juin. En mars 2026, le Pentagone avait déjà qualifié Anthropic de « risque pour la chaîne d’approvisionnement », et Anthropic poursuit le gouvernement en justice pour tenter de faire annuler cette désignation, les procédures étant toujours en cours.

Anthropic, OpenAI : même combat ?

Les deux cas ne sont toutefois pas les mêmes. Pour OpenAI, il s’agit cette fois d’une demande formelle avant le lancement du modèle. Pour Anthropic, l’ordre avait été donné a posteriori.

Si OpenAI veut commercialiser son modèle, elle doit soumettre à la Maison-Blanche les clients potentiels, qui seront approuvés ou pas après examen. Selon l’article de The Information, GPT-5.6 est estimé au même niveau que Mythos en capacités avancées de cybersécurité.

Toujours selon nos confrères, Sam Altman aurait communiqué la situation aux employés d’OpenAI via une note de service. Les responsables fédéraux approuveraient l’accès « client par client pendant cette période de prévisualisation », suivie « quelques semaines plus tard » d’une publication plus générale du modèle 5.6. Ce dernier pourrait alors sortir en juillet. « Nous avons clairement indiqué au gouvernement américain que ce n’est pas notre modèle préféré à long terme, et nous travaillerons avec lui et d’autres acteurs de l’industrie pour trouver une approche plus durable pour les futures publications », indiquerait également la note.

Un fonctionnement pérenne ?

Si la mesure doit s’appliquer désormais sur tout nouveau modèle issu d’une grande société américaine, les conséquences pourraient être multiples. Financièrement d’abord, car ces entreprises ont besoin de vendre des abonnements pour prétendre un jour à toute forme de rentabilité. Dans un domaine où la concurrence est très active et où la Chine peut dégainer à tout moment un modèle capable de faire fléchir la capitalisation boursière d’une société comme NVIDIA, ces retards ne peuvent être que mal vécus par Anthropic et NVIDIA.

Au-delà d’éventuelles manœuvres politiques, la situation illustre aussi l’ambivalence de la situation. D’un côté, un décret mettant l’accent sur la participation volontaire. De l’autre, une mise en œuvre finalement contraignante. L’absence de cadre clair génère de la confusion chez les entreprises, qui ne savent pas qui ou quelle agence gère effectivement la régulation. Par exemple, la demande adressée à OpenAI provenait directement de la Maison-Blanche, tandis que l’interdiction d’exportation pour Anthropic est venue du ministère du Commerce.

L’épisode d’Anthropic a également souligné la dépendance extrême que les entreprises ou d’autres structures peuvent ressentir quand un acteur aussi important désormais coupe les vannes. La clientèle ne peut que s’inquiéter quand un outil aussi majeur que Claude (ou en l’occurrence l’une de ses variantes) peut disparaitre sans préavis par simple décision politique.

C’est une nouvelle fois un enjeu de souveraineté numérique, comme l’a abordé récemment le Conseil de l’IA et du Numérique. Dans un document (PDF), celui-ci notait (point 4) que la vision américaine de cette notion se rapprochait « paradoxalement et étroitement de la vision chinoise ».

(màj) La Maison-Blanche demande à OpenAI de retarder GPT-5.6 pour examen

26 juin 2026 à 09:22
Brouillard de guerre
(màj) La Maison-Blanche demande à OpenAI de retarder GPT-5.6 pour examen

Le gouvernement américain aurait exigé d’OpenAI une période d’examen similaire pour son futur modèle GPT-5.6. Les performances atteindraient le niveau de Mythos et Fable d’Anthropic et feraient donc l’objet d’une analyse des risques. Seuls des acteurs triés sur le volet y auraient actuellement accès.

Mise à jour 19h30 – OpenAI a lancé ce vendredi soir GPT-5.6… mais uniquement à destination d’une poignée d’organisations et d’entreprises ayant reçu l’aval du gouvernement américain. Trois versions du LLM sont proposées : Sol (la plus puissante), Terra (équilibre performances/efficacité) et Luna (plus rapide et meilleur marché). L’objectif est de déployer ce modèle plus largement dans les prochaines semaines.

Article d’origine – OpenAI aurait accepté d’échelonner la sortie publique de son prochain modèle, GPT-5.6. C’est ce qu’affirme The Information dans un article du 25 juin, relayé par divers autres médias. Le gouvernement Trump aurait officiellement demandé à l’entreprise de retarder cette disponibilité et de lui donner un délai de 30 jours pour examiner la situation. Durant cette période, l’accès ne serait confié qu’à une poignée de partenaires sélectionnés avec soin, le temps que la Maison-Blanche étudie les implications pour la sécurité nationale.

Dans le sillage du décret présidentiel

Le 2 juin, Donald Trump a signé un décret présidentiel (executive order) intitulé « Promoting Advanced Artificial Intelligence Innovation and Security ». Il demande aux entreprises d’IA de soumettre volontairement leurs modèles les plus puissants à un examen gouvernemental jusqu’à 30 jours avant leur publication publique. Il prévoit également la création d’un AI cybersecurity clearinghouse (bureau central de la cybersécurité de l’IA) et mandate des benchmarks classifiés pour évaluer les capacités cyber des modèles.

Cet executive order stipule explicitement que rien dans son texte ne saurait être interprété comme autorisant la création d’une exigence gouvernementale de licences, de pré-autorisation ou de permis pour le développement, la publication ou la distribution de nouveaux modèles. La participation est formellement volontaire. Du moins, sur le papier.

En outre, le cadre opérationnel du décret n’est pas établi. Benchmarks classifiés, liste de modèles concernés, procédures d’évaluation : rien n’est encore fixé. Un groupe multi-agences dirigé par les secrétaires au Trésor, à la Guerre et à la Sécurité intérieure dispose de 60 jours (soit jusqu’au 31 juillet 2026) pour concevoir ce cadre.

Mythos et Fable en ont fait les « frais »

Il n’aura pas fallu dix jours pour qu’Anthropic essuie les plâtres du décret. Le gouvernement américain, invoquant ses pouvoirs en matière de sécurité nationale, a émis une directive de contrôle des exportations ordonnant la suspension immédiate de tout accès à Fable 5 et Mythos 5 pour tout ressortissant étranger, où qu’il se trouve dans le monde, jusqu’aux employés d’Anthropic eux-mêmes.

Anthropic a reçu l’ordre le 12 juin. Le courrier ne contenait aucune raison précise à cette préoccupation gouvernementale. Anthropic, incapable de filtrer ses utilisateurs par nationalité, a fini par appliquer la seule solution qui s’adressait à elle : couper l’accès à tout le monde.

Dans son communiqué du même jour, l’entreprise explique que le gouvernement semble alors penser que Fable 5 a été « jailbreaké », permettant d’outrepasser ses limites. Fable est pour rappel une version de Mythos protégée en théorie par des garde-fous. Mythos n’étant accessible qu’au travers du projet Glasswing, composé d’une quarantaine d’organisations triées sur le volet, un tel jailbreak représentait effectivement un sérieux problème.

Mais Anthropic a vivement contesté le bien-fondé de la mesure : l’entreprise estimait que le jailbreak cité par le gouvernement était étroit et ne déverrouillerait les capacités cybersécurité de Mythos que dans un cas spécifique, pas de façon universelle. Elle ajoutait que le même jailbreak pouvait être utilisé pour obtenir des capacités similaires d’autres modèles publiquement disponibles, dont GPT-5.5 d’OpenAI, qui n’était pourtant pas concerné par de tels contrôles.

La décision s’est inscrite en outre dans un contexte politique tendu : les principaux conseillers tech de Trump, notamment l’ex-czar de l’IA David Sacks (Palantir) et le sous-secrétaire à la Défense Emil Michael, ont publiquement attaqué Anthropic et ses dirigeants. Sacks a accusé Anthropic d’être « woke » et « gauchiste » et de se livrer à une « stratégie sophistiquée de capture réglementaire fondée sur la peur », comme le rappelait Fortune le 13 juin. En mars 2026, le Pentagone avait déjà qualifié Anthropic de « risque pour la chaîne d’approvisionnement », et Anthropic poursuit le gouvernement en justice pour tenter de faire annuler cette désignation, les procédures étant toujours en cours.

Anthropic, OpenAI : même combat ?

Les deux cas ne sont toutefois pas les mêmes. Pour OpenAI, il s’agit cette fois d’une demande formelle avant le lancement du modèle. Pour Anthropic, l’ordre avait été donné a posteriori.

Si OpenAI veut commercialiser son modèle, elle doit soumettre à la Maison-Blanche les clients potentiels, qui seront approuvés ou pas après examen. Selon l’article de The Information, GPT-5.6 est estimé au même niveau que Mythos en capacités avancées de cybersécurité.

Toujours selon nos confrères, Sam Altman aurait communiqué la situation aux employés d’OpenAI via une note de service. Les responsables fédéraux approuveraient l’accès « client par client pendant cette période de prévisualisation », suivie « quelques semaines plus tard » d’une publication plus générale du modèle 5.6. Ce dernier pourrait alors sortir en juillet. « Nous avons clairement indiqué au gouvernement américain que ce n’est pas notre modèle préféré à long terme, et nous travaillerons avec lui et d’autres acteurs de l’industrie pour trouver une approche plus durable pour les futures publications », indiquerait également la note.

Un fonctionnement pérenne ?

Si la mesure doit s’appliquer désormais sur tout nouveau modèle issu d’une grande société américaine, les conséquences pourraient être multiples. Financièrement d’abord, car ces entreprises ont besoin de vendre des abonnements pour prétendre un jour à toute forme de rentabilité. Dans un domaine où la concurrence est très active et où la Chine peut dégainer à tout moment un modèle capable de faire fléchir la capitalisation boursière d’une société comme NVIDIA, ces retards ne peuvent être que mal vécus par Anthropic et NVIDIA.

Au-delà d’éventuelles manœuvres politiques, la situation illustre aussi l’ambivalence de la situation. D’un côté, un décret mettant l’accent sur la participation volontaire. De l’autre, une mise en œuvre finalement contraignante. L’absence de cadre clair génère de la confusion chez les entreprises, qui ne savent pas qui ou quelle agence gère effectivement la régulation. Par exemple, la demande adressée à OpenAI provenait directement de la Maison-Blanche, tandis que l’interdiction d’exportation pour Anthropic est venue du ministère du Commerce.

L’épisode d’Anthropic a également souligné la dépendance extrême que les entreprises ou d’autres structures peuvent ressentir quand un acteur aussi important désormais coupe les vannes. La clientèle ne peut que s’inquiéter quand un outil aussi majeur que Claude (ou en l’occurrence l’une de ses variantes) peut disparaitre sans préavis par simple décision politique.

C’est une nouvelle fois un enjeu de souveraineté numérique, comme l’a abordé récemment le Conseil de l’IA et du Numérique. Dans un document (PDF), celui-ci notait (point 4) que la vision américaine de cette notion se rapprochait « paradoxalement et étroitement de la vision chinoise ».

Mistral veut bousculer la gestion des documents avec son modèle OCR 4

26 juin 2026 à 07:31
Plus de dame du CDI
Mistral veut bousculer la gestion des documents avec son modèle OCR 4

Mistral a lancé la quatrième version de son modèle dédié à l’OCR, la reconnaissance de texte. Mais de simple extracteur de texte, le modèle spécialisé devient un parseur documentaire sémantique, que Mistral présente comme particulièrement adapté aux pipelines de recherche ou au RAG. L’entreprise parle désormais d’intelligence documentaire.

Le nouveau modèle Mistral OCR 4 lancé ce 23 juin vise l’extraction d’informations et la restitution de représentations structurées de documents entiers. Cette nouvelle version va donc plus loin que la seule extraction de données, au point que le nom même du modèle devient peu représentatif de ce qu’il a vraiment dans le ventre.

Selon Mistral en effet, OCR 4 « extrait et structure le contenu d’un large éventail de documents ». Tous les formats courants comme PDF, DOC, PPT et ODF sont pris en charge. « Là où les générations précédentes se concentraient sur la conversion d’une page en texte et tableaux clairs, OCR 4 restitue une représentation structurée du document », avec encadrés « englobants » (bounding boxes), classification par blocs et scores de confiance par page et par mot.

Ce que fait le nouveau modèle

Dans son communiqué, Mistral assure que ces encadrements étaient la fonction la plus demandée. OCR 4 prend ainsi en charge des données de localisation capables de présenter une traçabilité de l’information. Le modèle renvoie ainsi une représentation en couches dans laquelle chaque bloc est localisé dans une boite, classé par type (titre, tableau, équation, signature, etc.) et assorti d’une note de confiance.

Mais à quoi tout cela sert-il ? Sans ces informations, et avec les modèles précédents, les systèmes en aval ne pouvaient pas retracer un extrait jusqu’à sa source sur une page spécifique. Impossible de poser alors une question simple comme « D’où vient ce chiffre ? ». OCR 4 permet de résoudre ces problèmes selon Mistral.

Autre avantage de cette classification, un texte tagué comme « titre » peut segmenter un document en morceaux hiérarchiques pour une recherche sémantique. En fait, chaque morceau d’un document, une fois étiqueté, peut être acheminé vers un pipeline de traitement spécifique ou non. Si l’on prend le cas des éléments reconnus comme signatures par exemple, ils peuvent alors être repris dans des flux de travail dans un système de conformité.

Mistral indique que ces opérations ne sont pas nouvelles en soi. En revanche, le nouveau modèle les intègre toutes, annulant pour les clients le besoin d’entreprendre eux-mêmes ces traitements et analyses. OCR 4 propose ainsi une fonction triple : localisation spatiale, typage sémantique et confiance. Les zones ayant une confiance faible pourront par exemple être automatiquement routées vers des vérificateurs humains. À l’inverse, les éléments obtenant une note élevée pourront intégrés automatiquement dans les flux de travail.

La reconnaissance de texte est rarement la finalité dans ce type de processus. Le développement de systèmes RAG, des flux de travail agentiques ou tout ce qui touche à une forme d’automatisation avec les documents demande plus de temps que cette étape. OCR 4 veut justement taper dans la fourmilière en proposant une solution capable de faire sauter toute l’étape de reconstruction, avec à la clé des économies, aussi bien sur les coûts de l’OCR proprement dit que sur les heures investies par les ingénieurs chargés du reste. C’est du moins ce qu’affirme Mistral.

Scores à l’appui

Pour prouver le sérieux de sa nouvelle offre, l’entreprise donne plusieurs chiffres. Des annotateurs indépendants auraient ainsi préféré OCR 4 dans 72 % des cas face « à tous les principaux systèmes OCT et IA documentaires testés ». Le modèle de Mistral affiche également un score de 85,20 % sur le benchmark OlmOCRBench, prenant la première place. Le modèle prend en charge 170 langues réparties dans 10 groupes linguistiques, « avec des gains mesurables sur les langues spécialisées et à faibles ressources où plusieurs systèmes concurrents se dégradent ».

Mistral affirme également que son modèle est suffisamment compact pour être déployé dans un seul conteneur. Le Français met ce point en avant, évoquant les gains de confidentialité, de conformité et – bien sûr – de souveraineté. Plusieurs témoignages élogieux sont de la partie dans le billet de blog, de même que sur X.

La tarification proposée via l’API est de 4 dollars pour 1 000 pages, avec une remise de 50 % sur l’API par lots. Si les développeurs passent par Document AI, le tarif passe à 5 dollars pour 1 000 pages. Les cas d’utilisation recommandés sont ceux attendus : analyse et extraction de documents, RAG, flux de travail agentiques, pipelines de données structurées utilisant des scores de confiance, et recherches en bases de connaissances.

Mistral tient cependant à rappeler que son nouveau modèle vise la compréhension, pas l’aide à la décision. « Il n’est pas destiné au diagnostic médical, aux conseils ou jugements juridiques, aux décisions financières à enjeux élevés, aux systèmes critiques pour la sécurité, au traitement en temps réel ou sensible à la latence, ni aux entrées non documentaires (audio brut, vidéo, etc.) », indique l’entreprise.

❌