

OpenAI Codex CLI est un agent de terminal open source qui lit votre base de code, modifie les fichiers et exécute des commandes shell avec un sandboxing au niveau du système d'exploitation. Sorti en avril 2025, réécrit en Rust, gratuit sous licence Apache 2.0.
OpenAI Codex CLI est un agent de codage open source natif pour terminal, publié par OpenAI le 16 avril 2025 sous licence Apache 2.0. Il s'exécute localement dans votre shell, lit les fichiers du répertoire de travail, modifie le code et exécute des commandes, en acheminant le raisonnement des tâches via l'API d'OpenAI. Le dépôt se trouve sur github.com/openai/codex et a dépassé les 74 000 étoiles GitHub avec plus de 14 millions de téléchargements npm mensuels en avril 2026. Contrairement aux assistants intégrés aux IDE tels que GitHub Copilot ou Cursor, Codex CLI ne nécessite aucun plugin d'éditeur et fonctionne avec n'importe quel éditeur de texte ou flux de travail s'exécutant dans un terminal.
La CLI est livrée avec trois modes d'approbation sandboxés, une intégration du Model Context Protocol (MCP) avec prise en charge des appels d'outils en parallèle, un moteur de hooks expérimental pour une logique de session personnalisée, une commande /review intégrée pour l'analyse automatisée des diffs, et la reprise de contexte inter-sessions via codex resume. Initialement écrit en TypeScript, il a été presque entièrement réécrit en Rust en juin 2025, réduisant le temps de démarrage et l'empreinte mémoire à environ 80MB. Le modèle par défaut actuel est GPT-5.5 ; les utilisateurs peuvent passer à GPT-5.4 (contexte de 1M de tokens) ou GPT-5.3-Codex en cours de session avec la commande /model. L'authentification fonctionne via un abonnement ChatGPT (Plus, Pro, Business) ou une simple clé API OpenAI.
Ce que fait réellement OpenAI Codex CLI en mai 2026
Codex CLI fonctionne comme une boucle locale : vous décrivez une tâche en langage naturel, l'agent lit les fichiers pertinents dans le répertoire actuel, planifie une séquence de modifications et de commandes, présente ou applique automatiquement les changements selon votre mode d'approbation, et itère jusqu'à ce que la tâche soit terminée ou que vous interveniez. La boucle s'exécute entièrement dans votre terminal, ce qui signifie qu'elle s'intègre à n'importe quel pipeline CI, flux de travail git ou script d'automatisation capable d'invoquer une commande shell.
Le sandboxing est appliqué au niveau du système d'exploitation. Sur Linux, Codex CLI utilise bubblewrap avec Landlock et seccomp pour confiner le processus de l'agent. Sur macOS, il utilise Seatbelt. Il s'agit d'une isolation des processus au niveau du noyau, et non d'une invite d'approbation au niveau de l'application qui pourrait être contournée par le modèle lui-même. Le mode Auto par défaut permet à l'agent de lire, modifier et exécuter des commandes dans le répertoire de travail. Le mode Read-only lui permet de naviguer mais nécessite une confirmation humaine avant d'écrire. Le mode Full Access accorde un accès réseau et une portée système plus large, destiné aux pipelines d'automatisation de confiance.
L'intégration du serveur MCP est configurée via ~/.codex/config.toml. Codex lance automatiquement les serveurs configurés au démarrage de la session et, point crucial, émet les appels d'outils éligibles en parallèle plutôt que séquentiellement. Les tests internes d'OpenAI montrent que cela réduit le temps d'exécution d'environ 50% sur les sessions multi-outils (58 secondes en série contre 31 secondes en parallèle). La CLI lit également les fichiers de configuration AGENTS.md, le même standard ouvert utilisé par Cursor et Aider, ce qui signifie que les équipes disposant déjà de fichiers de contexte par projet n'ont pas besoin de maintenir une configuration distincte pour Codex.
D'autres commandes utiles à connaître : codex exec exécute l'agent de manière non interactive pour l'automatisation, /review lance un second agent Codex pour analyser un diff avant de commiter, et codex resume rouvre une session précédente avec son contexte intact. Le binaire basé sur Rust s'installe via npm (npm install -g @openai/codex), Homebrew, ou par téléchargement direct du binaire depuis GitHub Releases, et fonctionne sur macOS et Linux, tant sur x86_64 que sur arm64.
Où se situe Codex CLI par rapport à Aider et Claude Code
Aider est l'agent de codage pour terminal le plus ancien et le plus mature de cette catégorie. Lancé en 2023, il est écrit en Python et est agnostique vis-à-vis des modèles : il se connecte à OpenAI, Anthropic, Google ou à n'importe quel modèle hébergé localement via une interface commune. La conception d'Aider est fondamentalement centrée sur git. Chaque modification qu'il effectue est commitée automatiquement, chaque session peut être examinée comme une branche, et l'ensemble du flux de travail est orienté autour de la révision des diffs. Pawel Jozefiak, dans une comparaison de 2026 sur les agents de codage CLI, a noté qu'Aider démontre « la philosophie git-first » comme un avantage distinct : « C'est plutôt comme avoir un binôme de programmation discipliné qui ne saute jamais un commit. » Aider utilise environ 4.2x moins de tokens par tâche que les agents plus lourds, ce qui le rend plus rentable pour les modifications répétitives. Ce que Codex CLI a et qu'Aider n'a pas : un sandboxing des processus au niveau de l'OS, des appels d'outils MCP parallèles natifs, et une application de bureau. Ce qu'Aider a et que Codex CLI n'a pas : la flexibilité des modèles, l'indépendance vis-à-vis des fournisseurs, et un écosystème de plugins plus mature construit sur trois ans.
Claude Code est l'agent de terminal concurrent d'Anthropic et la comparaison la plus directe. Claude Code s'exécute également localement, lit aussi le système de fichiers et est également distribué sous forme de package npm. Les différences mécaniques ont leur importance. Claude Code utilise des hooks au niveau de l'application (26 événements de cycle de vie) plutôt qu'une isolation des processus au niveau de l'OS. L'application de Landlock/seccomp/Seatbelt par Codex CLI est plus stricte. D'un autre côté, Claude Code obtient de meilleurs résultats sur Terminal-Bench 2.0 : 92.1% contre 77.3% pour Codex CLI avec GPT-5.3-Codex. Claude Code utilise des fichiers de configuration CLAUDE.md avec une hiérarchie de détection de contexte en couches ; Codex CLI utilise AGENTS.md, qui est un standard ouvert que Cursor et Aider lisent également, réduisant ainsi la duplication de configuration par équipe. Le modèle de coût diffère : Claude Code facture purement par token via l'API d'Anthropic. Codex CLI peut être inclus dans un abonnement ChatGPT existant, ce qui est moins cher pour les développeurs payant déjà pour Plus ou Pro. Opus 4.7 de Claude Code offre un contexte de 1M de tokens au tarif standard ; GPT-5.4 de Codex CLI atteint également 1M de tokens mais nécessite de changer le modèle par défaut GPT-5.5.
Une comparaison directe de sécurité issue de l'analyse de Blake Crosley en 2026 a révélé que lors d'un test de révision de code FastAPI, Opus 4.7 a identifié une vulnérabilité de canal auxiliaire temporel dans la comparaison de mots de passe alors que Codex l'a manquée, mais Codex a détecté un vecteur SSRF que Claude Code a approuvé. Chaque outil a des angles morts que l'autre repère, ce qui a conduit certaines équipes à exécuter les deux outils sur le même diff avant de fusionner.
À quoi ressemble la réalité de la boucle de l'agent
Pour les tâches contenues et à étape unique, Codex CLI est performant. L'employé d'OpenAI avital a décrit avoir validé « 7 pull requests de petite à moyenne taille avant le déjeuner » en utilisant le modèle d'exécution parallèle : lancer plusieurs tâches sur des branches de fonctionnalités distinctes, les laisser s'exécuter, puis examiner les PR. swyx a noté lors des premiers tests que Codex prend en charge « 60 instances simultanées par heure » contre 5 pour Devin ou 1 pour Cursor, ce qui modifie complètement l'économie de l'exécution de tâches en masse.
Les frictions apparaissent à la troisième ou quatrième étape d'une chaîne à plusieurs étapes. De nombreux développeurs l'ayant testé en 2025 et 2026 ont constaté que Codex CLI perd en cohérence lorsque les tâches présentent des interdépendances qui s'accumulent sur une session plus longue. Les tests comparatifs de Jozefiak : « c'est froid.. on n'a pas l'impression qu'il construit quelque chose comme le fait Claude Code. » Un utilisateur de HN en avril 2025, gklitt, a testé Codex sur sa base de code de production le jour du lancement et a découvert qu'« il a halluciné un tas de choses qui n'étaient pas dans le code et a complètement déformé l'architecture », inventant des backends d'API REST que l'application n'avait pas. CSMastermind a résumé une frustration courante : « Tout ce qui nécessite un peu d'esprit critique se perd complètement.. c'est comme un mauvais ingénieur junior » qui « crée de la dette technique assez rapidement sans supervision. »
Les limites de requêtes sont une véritable préoccupation opérationnelle. Sur le niveau Plus (20 $/mois), la limite glissante de 5 heures s'épuise plus vite que la plupart des utilisateurs ne l'imaginent. Après la mise à jour du calcul de la limite par OpenAI le 9 avril 2026, le forum de la communauté a enregistré d'importantes plaintes. Sasha123 a écrit : « Après le changement de la limite de 5h, je peux faire environ 10x à 15x moins que ce que je faisais il y a à peine une semaine. » milesdr a signalé : « 7 prompts ont épuisé toute ma limite de 5 heures, en 10 minutes. » Une utilisation intensive nécessite effectivement le niveau Pro à 200 $/mois. Cela place le coût réel de Codex CLI à peu près au même niveau que celui de Claude Code pour les flux de travail gourmands en API, malgré le prix de départ « gratuit ».
« Après le changement de la limite de 5h, je peux faire environ 10x à 15x moins que ce que je faisais il y a à peine une semaine. » - Sasha123, forums de la communauté OpenAI, 4 avril 2026
« C'est strictement inférieur à Claude Code pour le moment, mais j'ai bon espoir que cela s'améliore grâce aux contributions open source. » - mgdev, Hacker News, 16 avril 2025
Le problème de performance de la recherche dans la base de code mérite d'être signalé séparément. Sur les grands dépôts, Codex charge parfois un contexte de fichiers adjacents inutile lors de l'exécution d'une recherche de fonction ciblée, exécutant des opérations de type grep pendant 75 secondes sur des tâches qu'un sous-agent spécialisé traite en 5 secondes. Pour les projets avec de grands monorepos, cela se traduit directement par une consommation de la limite de requêtes et des cycles d'itération plus lents. La fonctionnalité codex resume et les instructions de portée d'AGENTS.md aident à gérer cela, mais ne l'éliminent pas entièrement.
À qui s'adresse Codex CLI
Les développeurs qui paient déjà pour ChatGPT Plus ou Pro obtiennent Codex CLI dans le cadre de leur abonnement, ce qui constitue une proposition de valeur convaincante. Si vous êtes déjà sur Pro à 200 $/mois, l'ajout d'un agent de terminal performant sans coût supplémentaire modifie considérablement l'économie par rapport au paiement séparé de l'utilisation de l'API de Claude Code. Les équipes qui ont investi dans des fichiers de configuration AGENTS.md pour Cursor ou Cline constateront que Codex CLI lit les mêmes fichiers sans configuration supplémentaire.
Les équipes soucieuses de la sécurité opérant sur des bases de code sensibles bénéficient du sandboxing au niveau de l'OS. L'application de Landlock/Seatbelt au niveau du noyau offre des garanties plus solides que les hooks d'approbation de la couche application qui dépendent du respect d'une contrainte de prompt par le modèle. Pour les environnements réglementés ou les équipes auditant le comportement des agents, le modèle d'exécution contenu dans le répertoire de travail est une propriété significative.
Le modèle d'exécution parallèle convient à un flux de travail particulier : générer de nombreuses petites PR ou révisions de code en parallèle plutôt que d'itérer dans une seule longue session. Les utilisateurs signalent la plus grande productivité lorsqu'ils exécutent Codex sur plusieurs tâches isolées simultanément, en examinant les résultats sous forme de PR et en écartant les échecs sans autre coût que l'utilisation des tokens. Des outils comme OpenHands adoptent une approche similaire de tâches parallèles mais ajoutent une couche d'interface web ; Codex CLI garde tout dans le terminal.
Ce que Codex CLI n'est pas
Codex CLI n'est pas un remplaçant de Claude Code si les sessions agentiques longues et à plusieurs étapes constituent votre flux de travail principal. Le score de 92.1% de Claude Code sur Terminal-Bench contre 77.3% pour Codex CLI reflète un véritable écart de capacité sur les tâches complexes et enchaînées. Claude Code maintient mieux la mémoire de session lors de longues sessions et gère les tâches de raisonnement architectural avec plus de cohérence selon les rapports de plusieurs testeurs.
Ce n'est pas un outil agnostique vis-à-vis des modèles. Chaque appel d'API est dirigé vers les serveurs d'OpenAI. Si vous souhaitez exécuter Claude 3.5 Sonnet, Gemini 2.0 Flash ou un modèle Llama hébergé localement, vous avez besoin d'Aider ou d'un harnais indépendant du fournisseur. Ce n'est pas une option de configuration dans Codex CLI, c'est une contrainte de conception.
Il ne convient pas aux projets qui s'appuient sur des environnements de test conteneurisés. Le bac à sable empêche la création de nouveaux conteneurs, ce qui signifie que LocalStack, Docker-in-Docker et les infrastructures de test similaires ne peuvent pas être utilisés depuis une session Codex. alexjplant a qualifié cela de « rédhibitoire » pour les applications natives AWS le jour du lancement en avril 2025, et la contrainte persiste. Si votre suite de tests nécessite un conteneur en cours d'exécution, Codex CLI ne peut pas vérifier ses propres modifications de manière autonome.
Ce n'est pas un outil économique pour les gros utilisateurs malgré l'étiquette open source gratuite. Le code est gratuit ; l'inférence ne l'est pas. Le niveau Plus à 20 $/mois offre une marge de manœuvre étonnamment limitée après les changements de limite de requêtes d'avril 2026. Les développeurs qui doivent exécuter des dizaines de tâches par jour atteindront le plafond et devront soit passer à Pro (200 $/mois), soit payer par token via une clé API, auquel cas le coût total converge avec les alternatives Claude Code ou Aider.
Avis des utilisateurs
Aucun avis pour l'instant. Soyez le premier à partager votre expérience !
Se connecter pour écrire un avis.
Présent dans les collections
Listes sélectionnées incluant OpenAI Codex CLI.
Articles associés
Guides et articles en lien avec OpenAI Codex CLI.

Claude Code vs Cursor vs Codex vs Devin vs Replit Agent 3: 2026 Scorecard

Run a Company With AI Agents: The Open-Source Orchestration Setup (2026)

Ship Your First MCP Server in 20 Minutes (2026)

Cut Your AI Agent Token Bill 5x: The Claude Code Efficiency Patterns (2026)

Anatomy of the .claude Folder: Every File, Command, Skill & Permission (2026)
