Google préparerait une puce IA optimisée pour ses modèles Gemini

Google prépare le lancement de sa puce d’intelligence artificielle (IA) dédiée à l’optimisation de ses modèles Gemini, marquant ainsi une avancée significative dans la course aux accélérateurs IA maison. Cette initiative intervient après la présentation par OpenAI de sa première puce interne, Jalapeño, développée en collaboration avec Broadcom.

La puce Jalapeño a été conçue spécifiquement pour les tâches d’inférence des grands modèles de langage (LLM), tels que ChatGPT et Codex. Développée en seulement neuf mois, elle vise à améliorer l’efficacité énergétique et à réduire la dépendance aux processeurs traditionnels, notamment ceux de Nvidia. Les premiers tests indiquent que Jalapeño offre des performances par watt supérieures aux solutions existantes sur le marché. ()

Dans le même temps, Google a annoncé le lancement de nouveaux modèles de sa famille Gemini, avec la version Gemini 3.6 Flash en tant que modèle principal. Ce modèle se distingue par une efficacité énergétique et computationnelle améliorée, avec une consommation de tokens réduite de 17 % par rapport à son prédécesseur. De plus, le coût par million de tokens de sortie a été abaissé à 7,50 dollars, offrant ainsi une option plus économique pour les développeurs et les entreprises. (cincodias.elpais.com)

Ces développements illustrent la tendance croissante des entreprises technologiques à concevoir leurs propres puces d’IA afin d’optimiser les performances de leurs modèles et de réduire les coûts opérationnels. Cette stratégie vise également à diminuer la dépendance vis-à-vis des fournisseurs externes et à renforcer le contrôle sur l’ensemble de l’infrastructure technologique.

Highlights:

Source
Leave a Comment

Comments

No comments yet. Why don’t you start the discussion?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *