Qu’est-ce qu’OpenAI a déjà confirmé pour le DevDay 2026 ?
On planifie autour du calendrier, pas autour de produits qui n’ont pas encore été livrés. Le site DevDay indique le mardi 29 septembre 2026 au Fort Mason, San Francisco. La keynote d’ouverture est à 10 h Pacifique, avec Sam Altman. Les candidatures sur place sont closes ; l’inscription sur invitation coûte 650 dollars. Le livestream de la keynote est gratuit. Les autres sessions arrivent ensuite sur openai.com. Les DevDay Exchanges à Bengaluru, Tokyo, Séoul, Paris, Berlin, Londres, São Paulo et Mexico sont une tournée plus tard — pas la liste de lancement du 29. À Paris, ce sera un récap, pas une seconde date de sortie.
Trois lecteurs : un backend qui quitte Assistants ; un développeur déjà sur Codex qui ne sait pas s’il doit ajouter l’Agents API ; un responsable qui doit dire « on bouge ça / on laisse ça » dans les 48 heures après le stream. Les récaps grand public ne répondent pas à ces trois jobs.
Déjà en ligne et utile pour choisir :
- Agents API— bêta publique le 10 septembre 2026. OpenAI héberge le harness Codex ; vous choisissez modèle, outils et environnement. L’annonce dit qu’il n’y a pas de frais d’API en plus — seulement tokens, outils et conteneurs hébergés.
- Assistants API— arrêtée le 26 août 2026 d’après le changelog plateforme. Ne commencez rien de neuf là-dessus.
- Codex— CLI, extension IDE, Cloud et le Codex SDK sont déjà des surfaces séparées.
- Tarifs— prix des modèles, recherche web, File Search et conteneurs sont sur la page Pricing officielle. Les chiffres de scène ne comptent pas ; la facture est en dollars US.
API, Codex, Agents, Tools : qui fait quoi ?
Ces quatre noms tombent dans la même barre de recherche. Ce ne sont pas quatre forfaits interchangeables. Le guide Agents officiel est la carte : harness géré → Agents API ; boucle dans votre appli → Agents SDK ; I/O modèle brut → Responses API ; chat embarqué → ChatKit. Comparer les runtimes
| Nom que vous entendez | Ce qu’il porte vraiment | Premier travail |
|---|---|---|
| OpenAI API / Responses API | Une requête, une sortie ; historique et outils à vous | Q&R courte, sortie structurée, une boucle déjà écrite |
| Codex | Édite un dépôt : CLI, éditeur, Cloud, SDK | Corriger un test et produire un diff sur la machine ou en CI |
| Agents API | Harness Codex hébergé : sessions, compaction, sous-agents, reprise | Enquêtes de plusieurs heures avec outils et sandbox |
| Agents SDK | La boucle tourne dans votre processus ; vous stockez l’état et les validations | L’état doit rester dans votre VPC ou votre base |
| Tools | Recherche web, File Search, MCP, functions, shell hébergé | N’attacher que ce dont cette tâche a besoin |
Codex et l’Agents API partagent une idée de harness, pas un point d’entrée. Les docs SDK sont nettes : les fils de code passent par le Codex SDK ; si Codex n’est qu’un spécialiste dans un workflow plus large, exposez-le en MCP et orchestrez avec l’Agents SDK. Codex SDK Contrats d’outils lisibles par machine : comment JSON Schema contraint les appels d’outils. Du texte libre au MCP : pourquoi les agents ont quitté l’appel JSON brut.
Quand utiliser Responses plutôt que l’Agents API ?
Ne commencez pas par le dernier nom de modèle. Demandez qui tient la boucle, où vit l’état, et si un run raté peut reprendre.
| Travail | Commencer ici | Éviter d’abord |
|---|---|---|
| Résumer, classer, extraire du JSON en un coup | Responses API | Agents API (vous payez session et sandbox sans gain) |
| Éditer un dépôt et lire le git diff | Codex CLI ou Codex SDK | Envoyer tout le monorepo dans un sandbox hébergé dès le premier jour |
| Travail sur plusieurs heures, sous-tâches, reprise | Agents API | Bricoler une boucle de nuit sur Responses |
| Validations, secrets et sessions doivent rester dans l’appli | Agents SDK | Sessions hébergées par défaut (Agents API : résidence US seulement, pas ZDR) |
| Embarquer un volet de chat | ChatKit | Envelopper le chat dans l’Agents API |
Si Claude Code, Codex et Cursor rebondissent déjà sur trois URL de base, unifiez la passerelle avant de débattre des modèles. Nos notes OmniRoute couvrent une passerelle locale — ça ne répond pas à « faut-il adopter l’Agents API », mais ça évite que trois clés éclatent la facture. Carte plus large des agents de code : le classement 2026 des agents de codage IA.
Comment séparer le coût des tokens des frais d’outils ?
Responses, Chat Completions, Realtime et Batch n’ont pas de frais d’interface séparés. La page Pricing dit la même chose pour la bêta Agents API : pas de surcoût de harness. Découpez le mois en trois lignes :
- Tokens modèle— entrée, entrée en cache, écritures de cache, sortie. Les lignes long-contexte coûtent plus. Le traitement régional ajoute 10 % sur les modèles éligibles sortis le 5 mars 2026 ou après.
- Appels d’outils— la recherche web vaut environ 10 $ / 1k appels plus les tokens récupérés au tarif d’entrée du modèle. Stockage File Search : 0,10 $ / Go / jour (1 Go gratuit) et 2,50 $ / 1k appels.
- Sandbox / conteneurs— Hosted Shell et Code Interpreter se facturent à la taille et à la session, par exemple environ 0,03 $ pour 20 minutes / 1 Go et 0,12 $ pour 4 Go ; les sessions éligibles à la minute, minimum 5 minutes.
Pour un premier budget, prenez les tarifs liste court-contexte de la page live (USD pour 1 M de tokens) :
| Modèle | Entrée | Entrée en cache | Sortie | Meilleur usage |
|---|---|---|---|---|
| gpt-6-astra | 10.00 | 1.00 | 50.00 | Jobs durs ; phare par défaut dans les exemples Agents |
| gpt-5.6-sol | 4.00 | 0.40 | 20.00 | Agents du quotidien ; promo au moins jusqu’au 21 novembre 2026 |
| gpt-5.6-terra | 2.00 | 0.20 | 12.00 | Beaucoup de requêtes courtes |
| gpt-5.6-luna | 0.20 | 0.02 | 1.20 | Classer et router à fort QPS |
| gpt-5.3-codex | 1.75 | 0.175 | 14.00 | Codex / agents de code |
Le même modèle a aussi Batch (environ la moitié) et Fast / Priority (plus cher). Un « chat » avec recherche web, c’est la sortie modèle + 10 $/1k recherches + tokens récupérés. Les sous-agents ajoutent leurs propres tokens au même job. Tool Search et l’appel d’outils programmatique existent pour ne pas fourrer chaque définition de fonction dans le contexte.
Évaluez le coût d’une seule course « investiguer les 30 dernières minutes de 5xx » plutôt que d’apprendre les étiquettes. Agent parent gpt-5.6-sol, 80k en entrée, 6k en sortie, quatre recherches web, un conteneur 1 Go pendant 20 minutes : environ 0,44 $ modèle, 0,04 $ recherche, 0,03 $ conteneur — à peu près 0,50 $. Le même job sur gpt-6-astra, c’est déjà environ 1,10 $ de modèle. Trois sous-agents en parallèle ajoutent chacun une passe complète. Les hits de cache et les extraits récupérés bougent le chiffre ; rejouez une vraie facture avant de publier une prévision.
Estimez les tours d’outils et si un conteneur démarre avant de choisir un modèle. Comparer les étiquettes d’entrée seules ne recoupera pas une facture longue.
Sandbox hébergé, self-hosted ou Codex local : comment déployer ?
L’Agents API sépare « qui tient la boucle » de « où le code s’exécute ». Options officielles : un sandbox hébergé par OpenAI (même famille d’isolation que Codex / ChatGPT), votre propre workspace, ou un sandbox partenaire (l’annonce cite Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop, Vercel).
| Déploiement | Où tourne la boucle | Où vivent fichiers et secrets | Quand l’utiliser |
|---|---|---|---|
| Codex CLI / SDK local | Votre laptop ou la CI | Le dépôt courant | Éditions et diffs du quotidien |
| Agents API + sandbox hébergé | OpenAI | Leur conteneur | Prouver un job long ; à éviter si le dépôt ne peut pas quitter le réseau |
| Agents API + self-hosted | OpenAI tient le harness | Votre workspace / VPC | Orchestration hébergée sans envoyer le source hors disque |
| Agents SDK | Votre application | Le stockage que vous choisissez | Validations, audit, multi-tenant |
Les docs précisent aussi que l’Agents API ne prend aujourd’hui que la résidence US et n’est pas Zero Data Retention ; un sandbox self-hosted ne la rend pas ZDR. Pour une équipe sous RGPD, c’est la première question, pas la dernière : secrets, code client et egress vers les États-Unis avant de choisir un runtime. Le Codex local s’arrête quand un laptop s’endort. Les jobs longs, les sous-agents et la reprise ont besoin d’une machine qui reste éveillée. Brancher MCP sur un nœud fixe : déployer un serveur MCP sur un Mac mini cloud.
N’installez pas trois environnements le premier jour. Faites passer Codex par un passage en lecture seule et un diff d’une fonction, clé dans l’environnement du processus ou un fichier verrouillé. Quand vous avez besoin d’une reprise sur plusieurs heures, ouvrez l’Agents API sur un répertoire isolé ou un dépôt vide — pas la production. Ne déplacez la boucle dans le SDK qu’une fois que vous pouvez montrer l’étape de validation et la table qui stocke la session.
Après le 29 septembre, que basculer et que laisser ?
Les 48 premières heures servent à vérifier, pas à basculer une flotte :
- Vérifier que le post d’index du jour sur openai.com et Pricing ont bougé ensemble. Si un seul a bougé, traiter ça comme une démo.
- Lire le changelog plateforme : l’Agents API est-elle encore en bêta publique ou en GA ? Les champs bêta et la facturation peuvent encore changer.
- Ne pas réécrire une intégration Responses qui marche pour un slogan. Ajoutez des champs quand ils apparaissent sur l’API que vous appelez déjà.
- Gardez le code du quotidien sur Codex CLI / SDK, sauf si les docs disent qu’un modèle de code n’existe que sur l’Agents API.
- N’enflez pas la liste d’outils par défaut du jour au lendemain. Lancez d’abord la même tâche d’acceptation dans un répertoire isolé.
- Ajoutez une colonne « prix unitaire après l’événement ». Le mode Fast, le surcoût régional et les minutes de conteneur bougent une facture plus vite qu’un renommage de modèle.
Si la stack actuelle termine le travail, laissez-la. La scène poussera « tout mettre sur Agents ». Les appels courts restent sur Responses, le code reste sur Codex, le travail long est le seul endroit où réévaluer l’Agents API — sauf si les docs officielles retirent l’une de ces phrases.
Questions fréquentes
Quand a lieu l’OpenAI DevDay 2026, et peut-on regarder sans billet ?
Mardi 29 septembre 2026 au Fort Mason, San Francisco. Les candidatures sur place sont closes. La keynote d’ouverture est diffusée gratuitement ; les autres sessions sont publiées ensuite sur openai.com.
L’Agents API ajoute-t-elle des frais de plateforme ?
Pas pendant la bêta publique. Vous payez les tokens modèle, les appels d’outils et les conteneurs hébergés. Une ligne Agents API absente de la facture est normale.
Codex et l’Agents API sont-ils le même produit ?
Non. Codex est la surface de code (CLI, IDE, Cloud, SDK). L’Agents API héberge le harness Codex pour le travail long à plusieurs outils. Codex sur un dépôt ; Agents API quand le backend a besoin d’une session d’agent durable.
Peut-on encore appeler l’Assistants API ?
L’Assistants API s’est arrêtée le 26 août 2026. Le nouveau travail passe par la Responses API pour les appels courts, et par l’Agents API ou l’Agents SDK pour les tâches longues.
Faut-il attendre le 29 septembre pour commencer ?
Continuez à livrer sur la stack actuelle. N’inscrivez une annonce de keynote dans une bascule de production ou un budget que lorsqu’elle figure dans les docs officiels et sur la page de tarifs.
Les jobs longs et les sessions Codex ont besoin d’une machine qui ne s’endort pas
Une session Agents API peut reprendre sur plusieurs heures. Codex CLI et un sandbox local s’arrêtent quand le capot se ferme, que la machine dort ou que le réseau bascule. Clés, répertoires isolés et processus MCP n’ont pas non plus leur place dans le même dossier personnel que la navigation du quotidien.
Après une tâche locale courte et un premier passage de diff, si vous avez besoin d’un nœud macOS à IP fixe, snapshotable, avec un accès révocable pour Codex ou un sandbox self-hosted, regardez un Mac cloud dédié plutôt que de poser un dépôt de production dans un conteneur hébergé encore en bêta publique. Voir les offres Mac mini cloud ZekVPS