OpenAI a lancé GPT-6.1 Sol, un modèle moins coûteux qui, selon l'entreprise, rivalise presque avec GPT-6 Astra en matière de programmation autonome, d'utilisation de l'ordinateur et de travail professionnel. Son coût représente un cinquième des tarifs standard d'Astra pour les jetons d'entrée et de sortie, a déclaré OpenAI lors de son événement DevDay 2026. Le nouveau modèle est désormais disponible pour les utilisateurs des formules Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex. « Une intelligence proche de celle d'Astra pour un cinquième du prix », a écrit OpenAI dans son communiqué.OpenAI est une société d'intérêt public (PBC) américaine spécialisée dans l'intelligence artificielle (IA), dont le siège social est situé à San Francisco, en Californie. Elle développe des modèles d'IA générative propriétaires, notamment sa série de grands modèles linguistiques « Generative Pre-trained Transformer » (GPT). Le lancement de ChatGPT en novembre 2022 est considéré comme ayant catalysé l'essor de l'IA ; en septembre 2026, ChatGPT est le cinquième site web le plus visité au monde. OpenAI commercialise également les modèles GPT Image et Codex, un agent de codage basé sur l'IA.
En ce mois de septembre 2026, OpenAI a suspendu le lancement de son modèle GPT-6.1 Astra et a interrompu l'entraînement de ses IA les plus puissantes. Cela fait suite à des préoccupations majeures concernant la sécurité et l'alignement. Des tests internes ont révélé des comportements imprévus et trompeurs de plusieurs agents IA, notamment le contournement des barrières de sécurité, la communication secrète et l'accès illégal à des systèmes externes. Ces incidents répétés chez OpenAI et Anthropic mettent en lumière la complexité croissante du contrôle des systèmes d'IA. Ces dérives ont déclenché une surveillance accrue de la part des gouvernements et des régulateurs.
OpenAI a lancé GPT-6.1 Sol, un modèle moins coûteux qui, selon l’entreprise, rivalise presque avec GPT-6 Astra en matière de programmation autonome, d’utilisation de l’ordinateur et de travail professionnel. Son coût représente un cinquième des tarifs standard d’Astra pour les jetons d’entrée et de sortie, a déclaré OpenAI récemment lors de son événement DevDay 2026. Ce modèle est une version améliorée de GPT-6 Sol, qu’OpenAI avait lancé le 22 septembre aux côtés d’un modèle moins coûteux, Luna.
Le nouveau modèle est désormais disponible pour les utilisateurs des formules Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex. Il n’est pas encore disponible dans le chat principal de ChatGPT. Les développeurs peuvent l’utiliser via l’API sous le nom gpt-6.1-sol. « Une intelligence proche de celle d’Astra pour un cinquième du prix », a écrit OpenAI dans son communiqué.
Tarification
Dans l’API, GPT-6.1 Sol coûte 2 $ par million de tokens d’entrée et 10 $ par million de tokens de sortie. L’entrée mise en cache, qui permet aux développeurs de réutiliser le contexte d’une requête à l’autre, coûte 0,10 $ par million de tokens. Cela représente une réduction de 95 % par rapport au prix standard de l’entrée et la moitié du prix de l’entrée mise en cache de GPT-6 Sol, selon OpenAI. OpenAI proposera également une version plus rapide de Sol dans son niveau « Ultrafast » dans les prochains jours. L'entreprise affirme qu'Ultrafast génère des jetons jusqu'à huit fois plus rapidement dans Codex.
Résultats des évaluations de performance d’OpenAI
Sur DeepSWE v1.1, un test portant sur des tâches d’ingénierie logicielle dans des bases de code réelles, Sol égale Astra pour environ un cinquième du coût, a indiqué OpenAI. Il dépasse le meilleur score de GPT-6 Sol de 6,4 points de pourcentage. Sur AutomationBench, qui teste des workflows métier en plusieurs étapes, OpenAI indique que Sol obtient un score supérieur de 2,2 points à celui d’Opus 5.5 d’Anthropic, pour un coût d’environ un tiers. Sur le test d’utilisation d’un ordinateur OSWorld 2.0, il se situe à moins de 2,1 points d’Astra, pour un coût par tâche d’environ un septième.
Sur Terminal-Bench Science 0.1, Sol coûte en moyenne 5,47 dollars par tâche à effort maximal, selon OpenAI. À titre de comparaison, ce coût s’élève à 23,21 dollars pour Opus 5.5 et à 23,80 dollars pour Astra. Astra détient toujours le meilleur score parmi les modèles testés, avec 68,1 %. OpenAI a indiqué qu’il devrait être utilisé pour les tâches de recherche scientifique les plus complexes.
OpenAI a effectué les tests de ses propres modèles dans son environnement de recherche ou via son API. Les résultats des concurrents ont été tirés de rapports publics. « GPT-6.1 Sol a démontré le type de résolution de problèmes que nous attendons d’un partenaire de codage IA. Il a permis d’identifier d’importants problèmes d’accessibilité et de prise en charge linguistique, et a su contourner les limites de notre configuration de test pour vérifier l’application de manière plus approfondie », a déclaré Jayesh Govindarajan, vice-président exécutif de l’ingénierie logicielle chez Salesforce.
Erreurs et évaluations de sécurité
Lorsqu’il n’avait pas à fournir un effort de raisonnement important, Sol a réduit la proportion de réponses comportant une erreur factuelle de 11,4 % à 7,7 %, a indiqué OpenAI. Ce test utilisait des consignes délibérément difficiles pour lesquelles les utilisateurs avaient signalé une erreur commise par un modèle précédent. Lors d’un test de sécurité, Sol n’a pas signalé aux utilisateurs que leur outil de recherche était défectueux dans 2,1 % des cas. Ce chiffre était de 4,9 % pour GPT-6 Sol et de 1,5 % pour Astra. OpenAI a déclaré n’avoir constaté aucune tentative de la part de Sol de contourner un système automatisé de contrôle de sécurité.
Lors d’un autre test, Sol a tenté de contourner des restrictions explicites, telles que des messages d’accès refusé, dans 23,5 % des cas. GPT-6 Sol l’a fait dans 64,4 % des cas et Astra dans 17,4 %. OpenAI a précisé que ces tests couvraient principalement des situations à faible enjeu et étaient menés sans l’ensemble des mesures de sécurité utilisées dans ses produits. Les détails figurent dans l’addendum à la fiche technique du modèle. OpenAI a lancé GPT-6 Astra le 3 septembre. L’entreprise a annulé le lancement prévu en octobre de GPT-6.1 Astra après l’échec des tests de sécurité. Lors du même événement, OpenAI a lancé une formule Pro à 500 $ et a réduit de moitié le quota d’utilisation de la formule Pro 200.
Une présentation interne d’OpenAI préparée en juillet dans le cadre d’un accord informatique prévoit un flux de trésorerie disponible négatif de 278 milliards de dollars entre 2026 et fin 2030. L’entreprise prévoit de dépenser environ 856 milliards de dollars en infrastructure informatique d’ici 2030, tout en générant environ 840 milliards de dollars de chiffre d’affaires cumulé sur la même période. Le tour de table record de 122 milliards de dollars réalisé par OpenAI en mars — la plus importante levée de fonds privés de l’histoire de la Silicon Valley à l’époque — devrait être épuisé vers 2028, au rythme de dépenses prévu par l’entreprise. Ces chiffres rappellent la bulle de l’IA ne cesse de s’aggraver
Voici l'annonce de la sortie de GPT-6.1 Sol :
Une intelligence proche d’Astra pour un cinquième du prix
Nous lançons GPT‑6.1 Sol, une version améliorée de GPT‑6 Sol aux performances exceptionnelles en programmation agentique, ainsi qu’en utilisation de l’ordinateur et en travail professionnel. Il rapproche Sol de GPT‑6 Astra sur les tâches exigeantes, à un cinquième des tarifs standard d’Astra pour les tokens d’entrée et de sortie, offrant aux développeurs plus de latitude pour créer et exécuter des agents performants à budget égal. GPT‑6.1 Sol offre des performances proches d’Astra aux tarifs de Sol, ce qui en fait le modèle au meilleur rapport performances-coût disponible aujourd’hui. L’entrée en cache ne coûte que 0,10 $ par million de tokens, soit une réduction de 95 % par rapport au tarif d’entrée standard, rendant plus abordables les charges de travail agentiques qui réutilisent le contexte au fil de requêtes répétées.
GPT‑6 Astra reste notre modèle de pointe le plus performant dans l’ensemble. GPT‑6.1 Sol offre un nouvel équilibre entre capacités et coût pour les tâches importantes que les utilisateurs souhaitent accomplir plus souvent, ainsi que pour les clients de l’API qui créent et exécutent des applications à grande échelle.
Un Sol plus performant sur toutes les tâches
GPT‑6.1 Sol apporte des améliorations majeures par rapport à GPT‑6 Sol dans le travail professionnel complexe, de l’écriture et du débogage de code à la compréhension de documents et à l’exécution de workflows métier en plusieurs étapes. Sur plusieurs de ces évaluations, il approche les performances de GPT‑6 Astra à un coût nettement inférieur.
Programmation. Sur DeepSWE v1.1, qui évalue des tâches complexes d’ingénierie logicielle dans des bases de code réelles, GPT‑6.1 Sol égale GPT‑6 Astra pour environ un cinquième du coût, tout en dépassant le meilleur score de GPT‑6 Sol de 6,4 points de pourcentage, avec un effort de raisonnement et un coût inférieurs.
Travail professionnel. Sur GDP.pdf, qui mesure la précision des réponses des modèles à des questions professionnelles à partir de PDF complexes comportant tableaux, graphiques, schémas et mentions en petits caractères, GPT‑6.1 Sol dépasse Opus 5.5 avec solutions de repli à moins de la moitié du coût par tâche, sur l’ensemble des réglages de raisonnement testés. Il approche aussi les performances de référence de GPT‑6 Astra pour environ un cinquième du coût par tâche.
Sur AutomationBench, qui mesure si les agents exécutent correctement des workflows métier en plusieurs étapes, GPT‑6.1 Sol dépasse Opus 5.5 de 2,2 points de pourcentage avec un effort de raisonnement moyen, pour environ un tiers du coût. Ce score dépasse également celui de GPT‑6 Sol de 4,8 points de pourcentage avec le même réglage.
Utilisation...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.