Le modèle le plus intelligent d’OpenAI améliore sa rapidité de traitement
OpenAI a récemment lancé un aperçu limité de son service Ultrafast, offrant une vitesse de traitement jusqu’à 14 fois supérieure à celle de son modèle standard, le GPT-5.6 Sol. Cette avancée, présentée le 13 août, permet de générer jusqu’à 750 unités de texte par seconde. Toutefois, cette fonctionnalité ne sera pas intégrée à ChatGPT et son accès est actuellement restreint à quelques entreprises.
Le gain de vitesse est rendu possible grâce à une nouvelle technologie développée par Cerebras, une entreprise spécialisée dans la fabrication de processeurs. Contrairement aux méthodes traditionnelles qui utilisent des puces individuelles, Cerebras grave ses processeurs sur une galette de silicium entière. Cela permet de réduire la latence causée par les échanges de données entre plusieurs composants, ce qui améliore considérablement le temps de réponse.
OpenAI a démontré cette avancée en générant un simulateur d’entrepôt logistique en trois dimensions à partir d’une seule consigne écrite, illustrant l’écart de performance entre les deux modes de traitement. Cependant, la me de 14 fois plus rapide reste à confirmer par des vérifications externes.
L’accès à Ultrafast est pour l’instant limité aux développeurs utilisant l’API d’OpenAI, avec des premiers clients provenant de secteurs comme la finance et le service client. L’entreprise cible des domaines où des réponses rapides sont cruciales, tels que la détection de fraude et le support client en temps réel.
Actuellement, OpenAI n’a pas communiqué de tarifs pour ce service, mais il est probable que cette nouvelle option soit facturée au-dessus des tarifs standards, comme c’est déjà le cas pour ses autres modes de traitement. Cela pourrait également réduire la dépendance d’OpenAI à Nvidia, en diversifiant ses sources de matériel.
Pour les utilisateurs finaux, les améliorations de vitesse pourraient se traduire par des expériences plus fluides dans des applications comme les assistants vocaux et les services clients, bien que ces changements ne soient pas immédiats.
Source : OpenAI



