GPT-6 Astra : jusqu’à 33 dollars pour un prompt (et ce n’est pas le plus cher d’OpenAI)
Bonjou… Désolé vous avez atteint la limite de votre quota !
Astra est présenté comme une nouvelle étape dans la quête de l’AGI (intelligence artificielle générale). Disponible depuis peu, il dévore les limites d’utilisation à vitesse grand V selon de nombreux retours. Qu’en est-il du coût réel pour les utilisateurs ?
La semaine dernière, OpenAI présentait GPT-6 Astra, son nouveau modèle d’intelligence artificielle. Il est depuis déployé progressivement auprès des utilisateurs d’un abonnement Plus, Pro, Business et Entreprise. Les premiers retours ne se sont pas fait attendre.
Astra, le dévoreur de crédit
Bon nombre concernent les limites d’utilisation très rapidement atteintes pour les clients Plus. « J’ai utilisé GPT-6 Astra pour faire un audit UX/UI d’une appli en lui donnant accès au navigateur. Il a “juste” à cliquer, prendre des captures, et documenter. En 5 mn il a bouffé les crédits », explique Guillaume Champeau. Les retours similaires sont nombreux sur les réseaux sociaux.
Précisons qu’Astra est en cours de déploiement pour les forfaits Pro, Business et Enterprise. Les abonnés Plus doivent se contenter (pour l’instant ?) de Codex et Work.
Au cours du week-end, OpenAI a revu à la hausse « le nombre de messages locaux par période de cinq heures » pour Astra avec ChatGPT Work et Codex. Sur Plus, les estimations grimpent entre 3 et 30 messages à une fourchette plus généreuse de 5 et 45 messages. Les deux abonnements Pro aussi ont droit à des hausses. Comme toujours, le fonctionnement des limites n’est pas détaillé. OpenAI peut ainsi en jouer sans avoir à communiquer auprès des clients, participant au flou autour de ses offres. Cela peut créer de la frustration et pousser des clients vers des offres toujours plus chères.
Les tarifs peuvent doubler selon le contexte
Pour comprendre le coût d’Astra, nous avons plongé dans la grille tarifaire de l’entreprise. Sur l’API, Astra est facturé 10 dollars HT par million de tokens en entrée et 50 dollars HT par million en sortie, soit x2,5 par rapport à GPT-5.6 Sol qui était jusqu’à présent le plus cher. C’est le tarif officiel qui avait été annoncé, pas de surprise.
Toutefois, des frais supplémentaires s’ajoutent en cas de long contexte, c’est-à-dire lorsqu’il dépasse les 272 000 tokens (c’était aussi le cas sur les versions 5.6 de GPT). Il peut s’agir d’un seul et long message (avec un gros document par exemple), ou encore d’un prompt court suivant une longue conversation. Le contexte prend en compte aussi bien les prompts que toutes les réponses déjà données.