Google prépare le lancement de sa puce d’intelligence artificielle (IA) dédiée à l’optimisation de ses modèles Gemini, marquant ainsi une avancée significative dans la course aux accélérateurs IA maison. Cette initiative intervient après la présentation par OpenAI de sa première puce interne, Jalapeño, développée en collaboration avec Broadcom.
La puce Jalapeño a été conçue spécifiquement pour les tâches d’inférence des grands modèles de langage (LLM), tels que ChatGPT et Codex. Développée en seulement neuf mois, elle vise à améliorer l’efficacité énergétique et à réduire la dépendance aux processeurs traditionnels, notamment ceux de Nvidia. Les premiers tests indiquent que Jalapeño offre des performances par watt supérieures aux solutions existantes sur le marché. ()
Dans le même temps, Google a annoncé le lancement de nouveaux modèles de sa famille Gemini, avec la version Gemini 3.6 Flash en tant que modèle principal. Ce modèle se distingue par une efficacité énergétique et computationnelle améliorée, avec une consommation de tokens réduite de 17 % par rapport à son prédécesseur. De plus, le coût par million de tokens de sortie a été abaissé à 7,50 dollars, offrant ainsi une option plus économique pour les développeurs et les entreprises. (cincodias.elpais.com)
Ces développements illustrent la tendance croissante des entreprises technologiques à concevoir leurs propres puces d’IA afin d’optimiser les performances de leurs modèles et de réduire les coûts opérationnels. Cette stratégie vise également à diminuer la dépendance vis-à-vis des fournisseurs externes et à renforcer le contrôle sur l’ensemble de l’infrastructure technologique.
Highlights:
- , publié le Wednesday, June 24
- Broadcom and OpenAI debut Jalapeño Intelligence Processor, plot an Apple-like move to ‘build the full stack’, publié le Wednesday, June 24
