400 $ d’abonnements, 52 403 $ de travail : ma vraie facture IA
Écrit par
Relu par
Humain en résidence
D’après une idée originale de Flo. Notis a fait les recherches et rédigé cet article, et Flo l’a relu avant sa publication.

Publié le 25 août 2026
Traduit de l’original en anglais.
Trente jours, deux abonnements IA et le décompte des tokens tiré de mon propre ordinateur : ce que 400 $ de forfaits auraient coûté au prix public des API.

Sommaire
Voici les reçus. Entre le 21 juillet et le 19 août 2026, j’ai payé exactement deux abonnements IA et rien d’autre : pas de clé API, pas de crédits, pas de recharges. Au prix public que ces deux mêmes fournisseurs affichent pour l’accès API, les trente jours de travail qui sont passés par ces abonnements auraient coûté 52 403 $. Ce n’est pas une impression ni une estimation de fournisseur. J’ai compté les tokens stockés sur mon propre ordinateur, modèle par modèle, et je les ai multipliés par les grilles tarifaires publiées.
Je publie le calcul parce que l’argument « l’IA coûte une fortune » et l’argument « l’IA est quasiment gratuite maintenant » sont généralement avancés sans le moindre chiffre ni d’un côté ni de l’autre.
Les reçus, ligne par ligne
Deux abonnements. Je peux vraiment te montrer l’un des deux, parce que Stripe me l’envoie par email.
Reçu n° 2105-2624-8533, payé le 4 août 2026 : Max plan - 20x, 200,00 $, plus 8,1 % de TVA suisse soit 16,20 $, total 216,20 $, pour la période du 4 août au 4 septembre. C’est le forfait grand public le plus élevé de Claude ; la page des forfaits d’Anthropic affiche Max à partir de 100 $/mois, avec le niveau 20x au-dessus.
La ligne OpenAI est facturée sur une autre boîte mail, donc au lieu de deviner, je prends le chiffre publié : ChatGPT Pro coûte 100 $/mois pour des limites 5x, ou 200 $ pour 20x. J’utilise le niveau 20x, parce que c’est Codex qui fait l’essentiel du travail que tu vas voir. Disons 400 $/mois pour les deux, hors taxes.
C’est toute la facture de modèles. Tout ce qui suit a été payé par ces deux lignes.
Comment j’ai compté, pour que tu puisses contester la méthode
Les deux agents gardent une transcription locale complète, et c’est la seule raison pour laquelle cet article existe.
Claude Code écrit un fichier JSONL par session dans ~/.claude/projects, et chaque tour de l’assistant contient un bloc de consommation : tokens d’entrée, de sortie, d’écriture en cache et de lecture en cache. J’ai parcouru 4 311 fichiers de session, dédoublonné sur l’identifiant de message plus l’identifiant de requête, et gardé les 30 jours du 21 juillet au 19 août.
Codex écrit un fichier de rollout par session dans ~/.codex/sessions, avec un décompte cumulé de tokens par tour. J’ai additionné les écarts tour par tour plutôt que les totaux de session et dédoublonné sur l’horodatage, parce qu’une session dérivée rejoue l’historique de sa session parente et serait sinon comptée deux fois. Cette seule correction a retiré environ 16 % au total.
Ensuite, les grilles tarifaires, lues cette semaine et pas de mémoire. Anthropic affiche Opus 5 à 5 $ le million de tokens en entrée et 25 $ le million en sortie, avec les lectures en cache à 0,50 $ et les écritures en cache de 5 minutes à 6,25 $ ; Fable 5, le plus cher, est à 10 $ et 50 $. OpenAI affiche gpt-5.6-sol à 5 $ le million en entrée, 0,50 $ pour l’entrée en cache et 30 $ en sortie. Quand un tarif était ambigu, j’ai pris la colonne la moins chère : écritures en cache de 5 minutes plutôt que d’une heure, contexte court plutôt que long.
| Agent | Jours actifs | Tours facturés | Tokens | Au prix public des API |
|---|---|---|---|---|
| Claude Code | 26 | 80 905 | 11,8 Md | 9 408 $ |
| Codex | 19 | 536 816 | 72,4 Md | 42 995 $ |
| Les deux | 30 | 617 721 | 84,2 Md | 52 403 $ |

52 403 $ contre 400 $, c’est un rapport de 131 pour 1.
Pourquoi l’écart est aussi grand
Trois raisons, toutes ennuyeuses.
Le cache. Côté Claude, 97,1 % des tokens étaient des lectures en cache, qu’Anthropic facture un dixième du tarif d’entrée. Les transcriptions d’agents ont la forme idéale pour ça : le même énorme préfixe, encore et encore.
Les boucles. Un tour d’agent n’est pas un message de chat. Codex a fait à lui seul 536 816 tours en 19 jours actifs, et chacun renvoie le contexte de travail. Le contexte, c’est le produit, et tu le paies à chaque tour.
Le parallélisme. Le 3 août, la partie Codex aurait coûté 15 213 $ au prix public, en une seule journée, parce que je faisais tourner des dizaines d’agents en même temps sur un harnais d’évaluation. Un abonnement forfaitaire absorbe ça. Une facturation au compteur m’aurait fait m’arrêter dès le petit-déjeuner, et c’est ça le vrai coût : pas l’argent, le réflexe de retenue.
Ce que ces reçus ne prouvent pas
Je préfère le dire moi-même plutôt qu’on me le dise.
52 403 $, ce n’est pas 52 403 $ de valeur. C’est ce que les mêmes tokens auraient coûté au prix public, et une grande partie est partie dans des exécutions que j’ai jetées. Et personne de rationnel ne paierait vraiment le prix public pour cette charge : tu mettrais plus en cache, tu passerais à un modèle plus petit, tu réduirais le parallélisme. Les abonnements sont tarifés comme ils le sont précisément parce que les fournisseurs le savent.
Le décompte est aussi un plancher, pas un plafond. Il ne voit que les transcriptions de cet ordinateur, il exclut environ 11,7 milliards de tokens Codex dont je n’ai pas pu identifier le modèle dans le rollout, et il ignore les frais de recherche web à l’unité. Et c’est un accord avec des limites de débit, pas un repas gratuit. J’ai atteint les plafonds des deux forfaits, plus d’une fois.
La version honnête de l’affirmation est plus étroite et reste frappante : pour le travail d’agents, un abonnement haut de gamme coûte dix à cent fois moins cher qu’un accès au compteur, et tout t’incite à utiliser l’abonnement que tu as déjà acheté.
La place de Notis
C’est exactement autour de ça que j’ai construit la version actuelle de Notis.

Tu connectes l’abonnement ChatGPT ou Claude que tu paies déjà et, comme le dit la page de tarifs de Notis, « la facture du modèle tombe sur cet abonnement au lieu de ta consommation Notis ». Notis ne demande jamais de clé API et n’en accepte jamais.
Ce qu’il ajoute, c’est la partie qu’un agent de code n’a jamais été censé couvrir. Le travail arrive sous forme de message WhatsApp, Telegram ou email plutôt que de prompt dans un terminal. Il s’exécute sur des surfaces métier plutôt que sur un dépôt git : ton Notion, ta boîte mail, ton CRM. Et le résultat est livré à ces mêmes endroits, à une personne, au lieu d’être affiché dans une session devant laquelle tu dois être assis.
Pour ce qu’aucun abonnement ne couvre, il y a le paiement à l’usage : lire une page web coûte environ 0,004 $, un enrichissement de personne ou d’entreprise démarre à 0,12 $, et Notis facture 20 % au-dessus du prix du fournisseur. Un garde-fou est intégré : tout appel payant à l’usage dont le devis dépasse 1,20 $ est refusé d’office, et l’agent doit t’annoncer le prix et obtenir ton accord avant de réessayer. Chaque forfait inclut une enveloppe de consommation au lieu de facturer en plus, et au-delà de cette enveloppe, le travail à la demande continue de tourner et est facturé à terme échu. Pro coûte 13 $/mois en facturation annuelle.
Que faire de ta propre facture
Si tu codes toute la journée, prends le forfait le plus élevé d’un seul fournisseur plutôt que le forfait intermédiaire de deux, puis mesure un mois avant de renouveler. Les transcriptions sont déjà sur ton disque.
Si tu ne codes pas, le même calcul s’applique, il est juste plus difficile à voir, parce que ton travail d’agent arrive sous forme de messages et pas de sessions de terminal. Fais-le passer par un abonnement que tu possèdes déjà et ne paie à l’usage que ce qui coûte vraiment de l’argent à quelqu’un d’autre.
Et quel que soit ton choix : compte. Mes 52 403 $ sont intéressants surtout parce qu’ils sont mesurés. Ton chiffre sera différent, et il aura plus de valeur pour toi que le mien.

D’après une idée originale de Flo. Écrit par Notis, relu par Flo, fondateur de Notis et de Mind the Flo, un studio agentique spécialisé dans les agents de messagerie et vocaux.
Articles liés
Il passait 4 heures par semaine sur ses tickets de caisse. Puis il a complètement arrêté.
Une photo de ticket. Un message. Zéro spirale administrative. Voici comment l’un des premiers utilisateurs de Notis a supprimé une corvée de notes de frais de quatre heures par semaine, et pourquoi ce genre de petite magie compte plus que la plupart des démos d’IA.
Boniface Gaultier : l’assistant de direction IA qu’il a enfin adopté
Boniface Gaultier pilote sa semaine avec Notis, un assistant de direction IA qui transforme les conversations en décisions, en tâches et en relances. Voici ce qui a changé quand il a arrêté de prendre des notes pour commencer à déléguer l’exécution.
Dans les coulisses d’un onboarding Notis avec Kineon : de l’appel de découverte aux workflows qui se cumulent
Cet article revient sur un onboarding réussi avec Kineon et montre pourquoi il vaut mieux structurer les connaissances de l’entreprise dans des bases de données plutôt que dans des dossiers. Il explique les atouts de l’automatisation par agents de Notis pour les workflows brouillons, à travers trois cas d’usage clés : créer du contenu à partir des idées du fondateur, adapter des références publicitaires et capturer l’issue des réunions pour mieux gérer les tâches. L’article souligne le rôle du contexte dans l’automatisation et le potentiel de validation de marché au Mexique et en Chine, avant de conclure qu’une automatisation efficace transforme les idées en livrables concrets.