OpenAI présente GPT-6 Astra, un modèle avancé pour le traitement du langage naturel.

OpenAI présente GPT-6 Astra, un modèle avancé pour le traitement du langage naturel.
OpenAI lance GPT-6 Astra, son nouveau modèle frontière

OpenAI lance GPT-6 Astra, son nouveau modèle frontière

Après plusieurs jours de teasing autour du projet Astra, OpenAI dévoile son nouveau modèle, GPT-6 Astra, marquant ainsi l’entrée dans une sixième génération de modèles GPT. Ce modèle est présenté comme le plus performant d’OpenAI pour des tâches telles que le raisonnement, le développement logiciel, l’utilisation autonome d’un ordinateur, la recherche, ainsi que la cybersécurité. Le déploiement de GPT-6 Astra commence auprès d’un nombre limité d’organisations dans le cadre du programme Daybreak, avec une ouverture prévue dans les prochains jours pour les abonnés de ChatGPT Plus, Pro, Business et Enterprise, ainsi que pour l’API et AWS.

Les benchmarks affichés par GPT-6 Astra sont impressionnants. Sur le test Terminal-Bench Science, le modèle atteint 64,6 %, en comparaison avec 22,4 % pour son prédécesseur, GPT-5.6 Sol. Sur AutomationBench, le score passe de 18,1 % à 41,4 %. Pour le test FrontierMath Tier 4, le modèle grimpe de 83 % à 97,6 %.

En cybersécurité, le modèle montre également des progrès significatifs, avec un score de 100 % sur ExploitBench, contre 78,5 % pour Sol. Le test ARC-AGI-3 affiche un bond impressionnant de 7,8 % à 99,9 %. De plus, sur OSWorld 2.0, GPT-6 Astra obtient 72,6 %, surpassant son prédécesseur de 6,9 %, tout en exécutant les tâches environ 47 % plus rapidement.

Cependant, certaines performances sont moins éclatantes. Sur le test Humanity’s Last Exam avec outils, GPT-6 Astra plafonne à 57,2 %, derrière Claude Fable 5.1 qui obtient 65 %. Ces résultats soulignent l’importance de confronter ces benchmarks aux usages réels pour évaluer pleinement l’efficacité du modèle.

InformatiqueNews prévoit de revenir plus en détail sur GPT-6 Astra dès qu’il sera accessible dans ChatGPT, afin d’évaluer ses performances réelles et d’analyser les implications d’un modèle que OpenAI classe désormais au niveau « Critical » pour ses capacités en cybersécurité.

Source : InformatiqueNews

Source

Comments

No comments yet. Why don’t you start the discussion?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *