OpenAI lance l'Agents API, la vraie nouveauté de la semaine
C'est probablement l'annonce la plus intéressante du lot. OpenAI sort son Agents API, un service managé pour construire et déployer des agents cloud sans monter toute la tuyauterie soi-même. L'orchestration est assurée par Codex, avec support des sessions longues et de l'utilisation d'outils en natif.
Concrètement, si vous avez déjà bricolé un agent avec LangGraph ou le SDK Swarm, vous voyez le tableau. Sauf qu'ici, plus besoin de gérer la persistance d'état, le retry sur outils, ou l'exécution longue durée qui explose votre serveur. Vous décrivez l'agent, ses outils, et OpenAI héberge la boucle d'exécution.
Côté SDK, la version v3.13.0 du client Python et la v7.15.0 du client Node exposent déjà les nouveaux endpoints. Vous pouvez donc tester immédiatement, sans attendre. Les détails sont sur la page produit et dans les release notes GitHub.
La question qui pique : est-ce que ça tue les frameworks agents indépendants ? Pas complètement, parce que le vendor lock-in est réel. Mais pour prototyper vite, difficile de faire mieux aujourd'hui.
GPT-6 Astra s'installe partout
On avait couvert GPT-6 Astra la semaine dernière sur son arrivée frontière. Cette semaine, OpenAI décline le modèle sur plusieurs verticaux et cas d'usage. D'abord une version enterprise mise en avant pour le raisonnement avancé, l'utilisation d'ordinateur et un meilleur jugement en écriture et design.
Le vrai signal, c'est la publication conjointe avec Cognition sur les tests logiciels. Devin tourne désormais sur Astra pour la génération et la revue de tests, avec des gains de temps mesurés sur la review de code. Si vous utilisez Devin ou un agent similaire, le passage à Astra en backend devrait se faire de manière transparente.
Est-ce que ça change votre workflow au quotidien ? Pas vraiment si vous êtes déjà sur gpt-6. Mais pour les équipes qui hésitaient à passer d'un modèle open-source vers un modèle managé, l'écosystème d'intégrations commence à peser lourd.
ChatGPT pour la finance, la stratégie verticale continue
OpenAI pousse un ChatGPT dédié aux services financiers. Sous le capot, GPT-6 Astra plus des connecteurs vers des sources de données financières intégrées. L'objectif affiché : recherche, modélisation, génération de documents client.
C'est la suite logique de la stratégie verticale entamée avec ChatGPT Enterprise. Au lieu de laisser les intégrateurs assembler eux-mêmes les pipelines Bloomberg, S&P et compagnie, OpenAI pré-package le tout. Pour un analyste sell-side, c'est probablement un gain de temps réel. Pour un dev qui construit son propre RAG financier, c'est un concurrent de plus.
L'agent de données dans ChatGPT Work
Dans la même veine, OpenAI ajoute un agent de données à ChatGPT Work. Vous branchez vos sources d'entreprise (bases SQL, entrepôts, fichiers), et vous posez des questions en langage naturel pour obtenir des dashboards interactifs.
On est en concurrence frontale avec ce que fait Anthropic avec ses Skills, ou ce que proposent Hex et Julius depuis un an. La différence : l'intégration native au reste de ChatGPT Work, donc à votre Slack, vos docs, votre calendrier. Si votre boîte a déjà signé pour Work, ça vaut le coup d'ouvrir la fonctionnalité.
GPT-Live-1, la voix en duplex intégral dans l'API
Autre annonce qui mérite qu'on s'y arrête : GPT-Live-1, un modèle vocal en duplex intégral accessible via API. Duplex intégral, ça veut dire que le modèle peut vous couper la parole et vous écouter en même temps qu'il parle. Fini le walkie-talkie awkward de la Realtime API v1.
Les features qui comptent :
- Meilleur suivi d'instructions, donc moins besoin de rappeler le contexte à chaque tour
- Voix personnalisées, ce qui ouvre les cas d'usage brand voice
- Support téléphonie natif, pour brancher un agent sur Twilio ou un SBC sans transcoding pénible
Si vous montez un assistant vocal ou un agent de call center, c'est la brique qui manquait. Le duplex intégral change vraiment la sensation de conversation, on n'est plus dans le tour de rôle rigide.
DeepSeek V4.1 Flash, la réponse budget
Pendant qu'OpenAI sature l'agenda, DeepSeek avance ses pions. Le nouveau deepseek-flash arrive avec compréhension visuelle multimodale native, et remplace directement V4 Pro à partir du 14 septembre. Détails dans le changelog officiel.
Le pitch : plus rapide et moins cher que V4 Pro, tout en supportant l'image de bout en bout. Les anciens deepseek-v4-flash et deepseek-v4-flash-vision-exp sont retirés, il faut donc migrer vos appels si vous êtes dans l'écosystème.
Pour un usage batch ou du traitement d'images à volume, DeepSeek reste imbattable sur le rapport coût/perf. On n'attend pas de miracle sur du raisonnement long face à Astra, mais pour de l'extraction, du classement ou du captioning, c'est solide.
Ce qu'on retient
Semaine dominée par OpenAI qui empile les briques pour construire un écosystème agentique complet : modèle, API dédiée, SDK, verticaux, voix. La stratégie est claire, ils veulent devenir la plateforme par défaut pour tout ce qui touche aux agents en production.
De son côté, DeepSeek continue sa politique du bon rapport qualité-prix sans faire de bruit. Deux mondes cohabitent : les frontier labs qui vendent du managé haut de gamme, et les acteurs comme DeepSeek qui misent sur le coût. À vous de choisir votre camp selon vos volumes.