OpenAI dégaine GPT-6 Astra, et coche la case cybersécurité critique

C'est l'annonce de la semaine. OpenAI a lancé gpt-6-astra, présenté comme leur modèle le plus intelligent et le mieux aligné à ce jour, avec des gains sur le code, les sciences et surtout la cybersécurité. Le point qui fait tiquer : selon leur propre Preparedness Framework, le modèle atteint le niveau critical capability côté cyber. Traduction : ils considèrent que ce truc peut faire mal si on le laisse traîner sans garde-fous.

OpenAI a publié en parallèle une safety overview dédiée qui détaille les mitigations. C'est la première fois qu'un modèle grand public assume ce niveau de classification, et ça mérite d'être noté. Les détails techniques sont dans l'annonce produit.

Côté SDK, la version 7.10.0 du openai-node intègre déjà gpt-6-astra, avec au passage un nouveau modèle canonique pour la sécurité côté SDK. Rien à configurer, un simple bump de version et vous pouvez appeler le modèle.

Premier retour terrain : Playco a bâti trois prototypes de jeux thématiques avec Astra et rapporte 50% de corrections manuelles en moins par rapport au modèle précédent. C'est le genre de métrique concrète qu'on aime, plutôt qu'un score MMLU de plus. À creuser dans leur retour d'expérience.

Anthropic riposte avec Claude Fable 5.1 et Mythos 5.1

Timing suspect ou coïncidence, Anthropic a sorti deux jours avant Claude Fable 5.1 et Claude Mythos 5.1. La segmentation est claire : Fable vise le codage avancé, Mythos cible le travail de connaissance (recherche, synthèse, analyse documentaire).

C'est la première fois qu'Anthropic assume aussi explicitement une séparation entre modèle code et modèle généraliste. Jusqu'ici on avait Opus, Sonnet, Haiku sur des axes vitesse/qualité. Là on part sur des axes usage, ce qui simplifie le choix quand vous configurez un agent : Fable pour le worker qui touche au code, Mythos pour celui qui digère la doc.

Les détails sont dans les release notes. Anthropic reste avare en benchmarks publics, il faudra attendre les retours communautaires pour savoir si Fable 5.1 tient tête à Astra sur du refactoring sérieux.

Google enchaîne : Gemini 3.8 Flash, compréhension vidéo agentique et Lyria 3.5

Chez Google, c'est le rythme habituel, à savoir trois annonces par semaine. La plus notable : Gemini 3.8 Flash passe en GA. Positionné pour l'ingénierie logicielle long terme, les agents autonomes et les workflows d'entreprise complexes. Rappel : on avait eu 3.7 Flash il y a deux semaines, le rythme d'itération est franchement soutenu.

Le SDK a suivi immédiatement, avec les versions v2.21.0 du JS et v2.22.0 du Python. Détails dans le changelog.

Deuxième annonce qui mérite l'attention : la compréhension vidéo agentique pour Gemini 3.7 Flash, 3.6 Flash et 3.5 Flash-Lite. Concrètement, au lieu de balancer toute la vidéo dans le contexte, le modèle navigue dynamiquement dans la timeline et demande à la volée ce dont il a besoin :

  • Une transcription sur un segment précis
  • Des images clés à un timestamp donné
  • La piste audio uniquement si nécessaire

Résultat annoncé : jusqu'à 88% de tokens en moins sur du contenu long. Si vous faites du résumé de vidéos d'une heure ou plus, c'est directement transposable en économies sur la facture. Détails dans le changelog du 1er septembre.

Troisième item : Lyria 3.5 passe en preview publique pour la génération musicale. Deux variantes disponibles :

  • lyria-3.5-clip-preview pour des clips de 30 secondes
  • lyria-3.5-pro-preview pour des chansons complètes avec meilleure cohérence musicale

Support texte et image en entrée, sortie stéréo 44.1 kHz. Ça reste un marché de niche côté dev, mais si vous bossez sur des jeux ou du contenu vidéo, ça vaut un test. Détails ici : changelog du 3 septembre.

Enfin, plus anecdotique mais mignon : Google Pics arrive dans Workspace, un outil de création et d'édition d'images basé sur le modèle Nano Banana. C'est un concurrent maison à Canva boosté à l'IA, intégré directement dans Docs et Slides.

ChatGPT branche les dossiers médicaux

Signal faible mais intéressant : ChatGPT permet désormais aux organisations de santé de connecter des dossiers médicaux électroniques (EHR). Les cliniciens peuvent accéder au contexte patient, à la recherche médicale et à d'autres sources fiables directement dans l'interface.

C'est le premier pas concret d'OpenAI sur un vertical hyper régulé. Il faudra voir comment ça se combine avec HIPAA et le RGPD côté européen, mais l'intention est claire : sortir du grand public et attaquer les workflows métier lourds. À suivre sur l'annonce officielle.

À retenir

La cadence des sorties frontière n'a jamais été aussi soutenue. En une semaine, on a un GPT-6, un Gemini 3.8 GA et deux nouveaux Claude. Le vrai signal, c'est le niveau critical assumé par OpenAI sur la cybersécurité : les labos commencent à documenter publiquement ce que leurs modèles peuvent faire de mal, pas juste ce qu'ils font de bien.

Côté pratique, l'annonce la plus utile pour beaucoup d'entre nous cette semaine, c'est probablement la compréhension vidéo agentique de Gemini. 88% de tokens en moins, ça se voit sur la facture dès le premier mois.