GPT-6.1 Astra : le modèle qui n’a pas été publié

Fin septembre, à la veille de sa conférence annuelle pour les développeurs à San Francisco, OpenAI a renoncé à publier GPT-6.1 Astra, qui devait succéder à GPT-6 Astra. L’information, d’abord rapportée par la presse américaine le 28 septembre, a été confirmée par Saachi Jain, responsable des systèmes de sécurité d’OpenAI : le modèle ne satisfaisait pas aux exigences de « périmètre et d’autorisation », c’est-à-dire rester dans la tâche confiée et dans les permissions accordées par l’utilisateur, ni à celles portant sur la façon de rendre compte du travail effectué.

« Pour tout ce qui touche à la sécurité et à l’alignement, il y a un compromis ; il faut vraiment trouver où placer la limite », a-t-elle déclaré à Al Jazeera. Qu’un éditeur renonce publiquement à un modèle pour ces raisons est un signal fort : les critères qui l’ont arrêté sont exactement ceux qu’une entreprise devrait appliquer à ses propres agents.

Gemini 4 Argon : d’abord aux défenseurs

Le 30 septembre, Google a présenté Gemini 4 Argon, son nouveau modèle de pointe pour le génie logiciel, le travail intellectuel en droit et en finance, et la cyberdéfense. Sa diffusion commence par le programme Fairwind, réservé à des cyberdéfenseurs de confiance, dans le cadre de la procédure volontaire d’accès anticipé du gouvernement américain. Pour eux, et pour les équipes internes de Google, le modèle est livré sans garde-fous cyber, afin qu’ils disposent de toutes ses capacités défensives.

Viendront ensuite les clients payants de l’API et les abonnés Google AI Ultra, sans date annoncée. Le tarif d’introduction est fixé à 2 $ par million de tokens en entrée et 10 $ en sortie, avant 4 $ et 20 $ ; la sortie peut atteindre un million de tokens. La logique rejoint celle d’Anthropic avec Claude Mythos 5.1, réservé à des programmes d’accès vérifié, que nous présentions dans notre article sur la semaine du 31 août : les capacités les plus sensibles vont d’abord à ceux qui défendent.

Pendant ce temps, les modèles du quotidien progressent

Le 28 septembre, Anthropic a lancé Claude Sonnet 5.5, au même tarif que Sonnet 5 (2 $ par million de tokens en entrée, 10 $ en sortie), plus de 30 % plus rapide et jusqu’à 30 % moins cher par tâche selon l’éditeur, car il consomme moins de tokens. Le 29 septembre, lors de sa conférence pour les développeurs, OpenAI a publié GPT-6.1 Sol, qui offre selon sa documentation des performances proches d’Astra à moindre coût (2 $ et 10 $), ajouté l’usage d’un navigateur hébergé à son Agents API et présenté « Dots », des agents permanents intégrés à ChatGPT, qui peuvent agir seuls ou demander une approbation selon des règles définies par l’utilisateur.

Autrement dit, pendant que le sommet de la gamme sort sous condition, les modèles disponibles pour tous deviennent plus rapides et moins chers. Pour l’immense majorité des usages professionnels, ce sont eux qui comptent.

Ce que ces sorties sous condition changent pour une PME

D’abord, il faut planifier avec les modèles disponibles, pas avec ceux qui sont annoncés : un modèle phare peut être retardé, réservé à certains publics ou abandonné. Ensuite, les critères qui ont arrêté GPT-6.1 Astra sont un excellent cahier des charges pour vos propres agents : l’agent reste-t-il dans sa tâche ? Demande-t-il avant d’agir au-delà de ses droits ? Son compte rendu correspond-il à ce qu’il a réellement fait ?

Enfin, côté sécurité, les défenseurs obtiennent les modèles les plus puissants en premier, mais rien n’empêche les attaquants d’utiliser tout ce qui est disponible : corriger vite et réduire sa surface d’exposition restent les meilleures protections, comme nous le disions à propos des tests avant déploiement et des agents gérés.

Trois contrôles à ajouter à vos agents

  1. Un périmètre écrit : outils, données et actions autorisés, tout le reste étant interdit par défaut.
  2. Une approbation explicite avant toute action irréversible ou hors du périmètre : envoi, paiement, suppression, publication, accès à un nouveau service.
  3. Un compte rendu vérifiable : comparer régulièrement ce que l’agent dit avoir fait avec ce que montrent ses journaux.

Notre audit de sécurité web couvre l’exposition de vos services, et Prompt OS intègre ces trois contrôles aux missions confiées à vos agents.

Conclusion

La fin de septembre 2026 a installé une règle nouvelle : les modèles les plus puissants ne sortent plus automatiquement, ni pour tout le monde. Pour une entreprise, ce n’est pas une mauvaise nouvelle. Les modèles disponibles progressent vite, et les critères de sécurité des laboratoires, rester dans son périmètre, demander avant d’agir et rendre des comptes exacts, sont ceux qu’il faut exiger de tout agent.