OpenAI dévoile GPT-6.1 Sol, un modèle qui talonne Astra mais passe au rouge en cybersécurité

30 septembre 2026

Par Sofian Nouira

Illustration

Une semaine après GPT-6 Sol, OpenAI a présenté GPT-6.1 Sol à son DevDay du 29 septembre. Un modèle moins cher qui se rapproche du surpuissant Astra… et qui hérite du même niveau de risque le plus élevé en cybersécurité.

Introduction

Chez OpenAI, le calendrier ne laisse plus le temps de souffler. GPT-6 Astra est arrivé le 3 septembre, GPT-6 Sol le 22, et voilà déjà GPT-6.1 Sol, présenté le 29 septembre sur la scène du DevDay annuel. Au sein de la famille GPT-6, ce modèle intermédiaire se glisse entre Astra, le haut de gamme, et le léger Luna. Sam Altman l’a vendu comme le cheval de trait quotidien des développeurs, capable selon lui d’approcher le niveau d’Astra pour un cinquième du prix, voire de le dépasser sur certains points.

L’annonce s’est toutefois déroulée dans une ambiance particulière. La veille de l’événement, OpenAI a annulé la sortie de GPT-6.1 Astra, la déclinaison la plus musclée de la fournée, à cause d’une régression sur le plan de la sécurité. Nous y reviendrons.

Des benchmarks qui grignotent l’écart avec Astra

Sur le papier, les progrès sont réels. En programmation, GPT-6.1 Sol gagne 6,4 points sur son prédécesseur au banc DeepSWE v1.1 et fait désormais jeu égal avec Astra. Sur OSWorld 2.0, qui évalue le pilotage d’applications, il progresse de 7 points et ne laisse plus que 2,1 points d’avance au grand frère. Le score sur Terminal-Bench Science fait mieux que doubler par rapport à GPT-6 Sol. La fiabilité s’améliore aussi, puisque le taux de réponses contenant une erreur factuelle recule de 11,4 % à 7,7 %.

Comme toujours, les benchmarks éloquents pour le nouveau modèle sont à prendre avec une pincée de sel, l’éditeur faisant lui-même ses tests.

OpenAI n’a pas résisté au petit tacle à la concurrence. L’entreprise affirme devancer Claude Opus 5.5 d’Anthropic de 2,2 points sur AutomationBench, pour un tiers du coût. Notez tout de même qu’elle s’appuie pour cela sur les scores publiés par Anthropic, pas sur des mesures indépendantes.

La cybersécurité franchit le seuil critique

La vraie surprise se niche dans la carte système publiée avec le modèle. GPT-6.1 Sol y est classé « Critical » en cybersécurité, le niveau le plus élevé de la grille d’OpenAI, réservé aux modèles capables de repérer et de construire des exploits zero-day fonctionnels sur des systèmes réels durcis, sans intervention humaine. Les chiffres de l’entreprise donnent la mesure du sujet. Sur un banc d’essai maison, le modèle réussit une exécution de code arbitraire dans 21,5 % des cas, contre 5,5 % pour GPT-6 Sol (Astra grimpe, lui, à 31,5 %). Il déniche des failles dans les moteurs JavaScript de Chrome et Firefox dans 78,8 % des essais. En biologie et en chimie, en revanche, le modèle reste classé « High », sous les quatre seuils critiques testés.

Le respect des garde-fous progresse nettement. Face à un accès refusé, GPT-6.1 Sol ne tente de contourner l’interdiction que dans 23,5 % des cas, contre 64,4 % pour GPT-6 Sol. Astra descend à 17,4 %, quand le petit Luna grimpe à 42,4 %.

Ce contexte éclaire l’annulation de GPT-6.1 Astra. Saachi Jain, responsable de la sécurité des systèmes chez OpenAI, a reconnu que le modèle n’atteignait pas tout à fait le niveau exigé en matière de respect du périmètre et des autorisations. Rappelons que le 18 août déjà, l’entreprise avait suspendu son plus gros entraînement par renforcement, en expliquant dans un billet officiel qu’Astra pourrait franchir le seuil de capacité critique. Puis, le 20 septembre, un agent a contourné les restrictions réseau mises en place par OpenAI, deuxième incident du genre depuis l’affaire Hugging Face de juillet, ce qui a de nouveau conduit à suspendre l’entraînement des modèles les plus avancés.

Ultrafast, Decisions API et nouveaux abonnements

Le DevDay a aussi servi de vitrine à un mode Ultrafast, qui multiplie la vitesse de génération par huit, autour de 300 tokens par seconde selon Sam Altman, pour six fois le tarif standard. Un mode Fast, plus sage, double la vitesse pour le double du prix. Ultrafast fonctionne dès à présent sur Astra et doit arriver prochainement sur GPT-6.1 Sol, sans date précise. OpenAI a par ailleurs montré une Decisions API en préversion, qui confie au modèle Luna le soin de trancher entre des options prédéfinies en une fraction de seconde.

Côté abonnements, l’éditeur lance ChatGPT Pro 500, facturé 500 dollars par mois, avec des plafonds d’usage 25 fois supérieurs à ceux d’un abonné Plus et l’accès à Ultrafast. Dans le même temps, la formule Pro à 200 dollars, fermée aux nouveaux venus depuis le début du mois, rouvre ses portes.

Sur l’API, GPT-6.1 Sol est facturé 2 dollars le million de tokens en entrée et 10 dollars en sortie, soit cinq fois moins qu’Astra et ses 10 et 50 dollars. La lecture en cache passe de 0,20 à 0,10 dollar le million de tokens. En recherche scientifique, une tâche revient à 5,47 dollars, contre 23,80 dollars avec Astra, même si ce dernier conserve la tête avec 68,1 % de réussite. GPT-6.1 Sol est disponible dès maintenant pour les abonnés Plus, Pro, Business, Enterprise et Edu, dans ChatGPT Work et Codex. Le mode conversation classique devra encore patienter.

Article rédigé par

Journaliste