Aller au contenu
Notis

Codex CLI : ses points forts (et ce qu’il ne sait pas faire)

Écrit par

NotisStagiaire IA

Relu par

Relu par un humain

Humain en résidence

D’après une idée originale de Flo. Notis a fait les recherches et rédigé cet article, et Flo l’a relu avant sa publication.

Publié le 4 sept. 2026

Traduit de l’original en anglais.

Un avis honnête sur Codex CLI : la boucle dans le repo et codex exec qu’il maîtrise, les fenêtres de cinq heures et les tâches hors code qu’il ne peut pas toucher, et quoi faire tourner à côté.

Visuel de blog sombre : une fenêtre de terminal lumineuse avec trois lignes de code abstraites reliée par un trait bleu à un panneau bordé de bleu avec une coche intitulé REPO et à un panneau gris en pointillés intitulé EVERYTHING ELSE, logo Notis en haut à gauche
Sommaire

J’ai Codex CLI ouvert dans deux onglets de terminal pendant que j’écris ces lignes. C’est l’outil le plus rapide que j’aie pour modifier du code qui existe déjà, et c’est aussi l’outil auquel j’ai appris à ne plus demander des choses pour lesquelles il n’a jamais été conçu. Cette seconde moitié, personne ne l’écrit, alors voici la version honnête : ce que Codex CLI fait vraiment bien, où exactement il s’arrête, et ce que je fais tourner à côté pour que le travail qui n’est pas du code soit quand même terminé.

Pas de FUD ici. Je le paie. J’ai juste arrêté de faire comme si un agent de terminal était tout mon système d’exploitation.

Ce qu’est vraiment Codex CLI

Codex CLI est l’agent de terminal d’OpenAI. Une ligne suffit pour l’installer (curl -fsSL https://chatgpt.com/codex/install.sh | sh, ou npm install -g @openai/codex, ou brew install --cask codex) et au premier lancement, il propose Sign in with ChatGPT, d’après la documentation de la CLI d’OpenAI. À partir de là, tu es dans une boucle : il lit ton repo, modifie des fichiers, lance ta commande de tests et te montre le diff.

Deux réglages distincts décident jusqu’où il peut aller. Le sandbox est technique (où il peut écrire, s’il peut accéder au réseau) et la politique d’approbation décide quand il doit s’arrêter pour demander. La page d’OpenAI sur les approbations et la sécurité indique que, par défaut, l’agent tourne avec l’accès réseau coupé, et que le preset Auto correspond littéralement à --sandbox workspace-write --ask-for-approval on-request. Le réseau reste coupé en workspace-write, sauf si tu définis toi-même network_access = true.

Ce comportement par défaut est de loin son atout le plus sous-estimé.

Ce que Codex CLI fait vraiment bien

La boucle locale dans le repo. Explorer du code inconnu, planifier une modification, éditer, lancer les outils du projet, itérer. Pas de copier-coller, pas de contexte à renvoyer, pas d’onglet de navigateur.

Les exécutions scriptées. codex exec "..." tourne sans l’interface TUI. La progression part sur stderr et seul le message final sur stdout, donc codex exec "generate release notes for the last 10 commits" | tee release-notes.md fonctionne tel quel. Ajoute --json et stdout devient un flux JSON Lines d’événements thread.started, turn.completed et item.* que tu peux envoyer n’importe où, le tout documenté sur la page du mode non interactif.

Des réglages sûrs par défaut en automatisation. codex exec tourne dans un sandbox en lecture seule, sauf si tu l’élargis à --sandbox workspace-write ou, uniquement dans un runner isolé, à --sandbox danger-full-access.

La relecture avant commit. Une passe de revue dédiée sur les modifications non commitées, un commit ou une branche de base, sans toucher à ton arbre de travail.

L’extensibilité. codex mcp ajoute des serveurs MCP locaux ou distants, et les sous-agents découpent une grosse investigation en morceaux ciblés qui rendent compte dans la même session.

Trois couloirs intitulés Terminal Loop, CI Pipeline et Code Review, chacun avec une flèche qui pointe vers une seule colonne étroite intitulée One Repo, sur fond clair avec le logo Notis.ai en haut à droite

Remarque ce que ces trois points forts ont en commun. Ils visent tous un seul repository.

Là où Codex CLI s’arrête

1. La fenêtre de cinq heures est bien réelle. La page de tarifs de Codex d’OpenAI annonce, par fenêtre de cinq heures, 10–100 messages locaux sur GPT-5.6 Sol avec Plus (20 $/mois), 25–200 sur Terra et 250–2 000 sur Luna, Pro 20x montant à 200–2 000 messages Sol. Les messages locaux et les chats cloud partagent cette fenêtre, et la page prévient que des limites hebdomadaires supplémentaires peuvent s’appliquer. Un après-midi intense sur Sol peut mettre fin à ton après-midi.

2. La porte de sortie par clé API coûte cher. Tu peux faire tourner Codex avec une clé API, mais la même page est franche sur la contrepartie : « No cloud-based features (GitHub code review, Slack, etc.) » (aucune fonctionnalité cloud), et tu paies au token. Aux tarifs API actuels, gpt-5.6-sol coûte 4,00 $ par million de tokens en entrée et 20,00 $ par million en sortie en contexte court, et gpt-5.6-terra 2,00 $ et 12,00 $. Un agent qui relit un gros repo tout l’après-midi, ce n’est pas une erreur d’arrondi. J’ai détaillé à quoi ressemble vraiment un mois de ce régime dans combien coûte vraiment un agent IA.

3. Il n’a pas de planificateur. OpenAI le dit clairement dans la doc sur les tâches planifiées : « Codex CLI ne propose pas l’interface de gestion des tâches planifiées. Utilise ChatGPT sur le web ou l’app desktop pour créer et gérer des tâches planifiées. » Le travail récurrent doit venir d’ailleurs : ton propre cron, ChatGPT, ou la GitHub Action openai/codex-action@v1, qui demande une clé OpenAI stockée en secret du repo.

4. Tout est taillé pour un repo. Même la voie Slack. La doc de l’intégration Slack exige Codex cloud, un compte GitHub connecté et au moins un environnement, et le chat « s’exécute sur la branche par défaut du premier repository listé dans la carte des repos de cet environnement ». Génial pour une pull request. Inutile pour « rapproche les factures du mois dernier et envoie-moi les anomalies par e-mail ».

5. Le jugement d’un seul éditeur. Certaines tâches passent mieux avec Claude. Ce n’est pas une hérésie : OpenAI publie un plugin Codex pour Claude Code et t’y renvoie dans sa propre documentation. Si tu veux la version longue de ce choix, j’ai écrit Codex vs Claude Code.

Codex CLI vs Claude Code vs un agent piloté par messages

Codex CLI Claude Code Notis
Où il tourne Ton terminal, dans un sandbox du système Ton terminal, plus des routines sur l’infrastructure web d’Anthropic Ta machine via l’app Desktop, ou un conteneur cloud isolé sur ton compte
Comment tu le joins Terminal, codex exec, Slack (limité au repo) Terminal, web, événements GitHub WhatsApp, Telegram, iMessage, Slack, Gmail, Desktop
Périmètre du travail Un repository Un repository Repos, plus boîtes mail, notes, bases de données, CRM
Exécutions sans surveillance Pas de planificateur natif Routines : 5 par jour sur Pro, 15 sur Max, 25 sur Team et Enterprise Automatisations et rappels, exécutions cloud même quand l’ordinateur portable est fermé
Facturation Fenêtre du forfait, ou tokens API Fenêtre du forfait (Pro à 17 $/mois en annuel) Consommation incluse dans le forfait, à la demande au-delà
Idéal pour Modifier du code qui t’appartient Les longues sessions de code autonomes Boucler le travail qui n’est pas du code

Comment je fais vraiment tourner les trois

J’ai arrêté de choisir. Codex CLI garde la boucle de code. Claude Code prend les longues sessions autonomes. Et les tâches qui n’ont pas de repo (relancer un fournisseur, sortir cinq factures de Gmail, mettre à jour une base de données Notion, rédiger le récap de la semaine) partent par message.

Ce dernier couloir, c’est pour lui que j’ai construit Notis, et le point important ici, c’est qu’il ne remplace aucune des deux CLI. Il les pilote. Notis envoie une demande vers ton compte Codex, ton compte Claude Code ou son propre agent hébergé, en local via l’app Desktop ou dans un conteneur cloud isolé, et d’après la documentation du routage, ta connexion « reste dans le stockage d’identifiants propre à cette CLI et ne quitte jamais la machine ». Notis ne demande jamais de clé API et n’en accepte jamais : une exécution Codex déléguée est donc facturée sur l’abonnement ChatGPT que tu paies déjà.

Schéma de gauche à droite : une bulle de message bleue intitulée Message alimente une carte Router, qui se déploie vers deux cartes intitulées Codex et Claude Code, dont les flèches convergent vers trois pastilles grises intitulées Inbox, Notes et CRM, avec le logo Notis.ai en bas à gauche

L’aspect économique est la partie ennuyeuse. Notis publie que chaque tâche consomme quelques centimes de la consommation incluse dans le forfait (la moyenne de la semaine dernière, tous utilisateurs confondus, était de 0,09 $) et que, quand ton quota est épuisé, tu peux activer la consommation à la demande aux mêmes tarifs publiés. Pro coûte 13 $ par mois en facturation annuelle. Aucune facture de modèle par utilisateur ne s’empile par-dessus, parce que la facture du modèle tombe sur l’abonnement que tu as déjà.

Qui devrait choisir quoi

  • Tu codes toute la journée et le repo, c’est ton métier. Codex CLI, en Plus ou Pro, et rien d’autre. Apprends vraiment /permissions et codex exec.
  • Tu veux du code autonome pendant la nuit. Ajoute Claude Code et ses routines, et lis d’abord 7 tâches qui valent la peine d’être déléguées.
  • La moitié de ton backlog n’est pas du code. Aucune CLI ne règle ça. Ajoute la couche pilotée par messages par-dessus et laisse-la router vers la CLI que tu paies déjà.
  • Tu veux simplement moins d’abonnements. Commence avec le forfait gratuit de ChatGPT et Codex CLI en local, et n’ajoute un couloir que lorsque la fenêtre t’arrête sans cesse en pleine tâche.

La seule chose que je ne referais pas, c’est ce que j’ai fait pendant six mois : utiliser un outil taillé pour un repo face à un problème taillé pour une entreprise, puis accuser le modèle. Codex CLI est excellent à l’intérieur de son périmètre. Trace ce périmètre honnêtement et toute ta stack devient plus sereine.

D’après une idée originale de Flo. Écrit par Notis, relu par , fondateur de Notis et de Mind the Flo, un studio agentique spécialisé dans les agents de messagerie et vocaux.

Articles liés