OpenAI a publié les résultats benchmarks de sa puce personnalisée Jalapeño, montrant qu’elle dépasse les processeurs Nvidia GB300 avec 1,5 à 1,9 fois plus de performances par watt et une latence réduite de 1,7 à 3,6 fois. Ce circuit ASIC dédié à l’inférenceIA, conçu avec Broadcom et fabriqué par TSMC, fonctionne à 550W avec un avantage de coût d’environ 50% par rapport à l’architecture Blackwell de Nvidia. OpenAI prévoit un déploiement limité d’ici la fin 2026 et une intégration complète en 2027, tout en maintenant ses achats de GPU Nvidia et AMD pour l’entraînement des modèles. Cette initiative s’inscrit dans une tendance où les principaux acteurs de l’IA développent des puces personnalisées pour réduire leur dépendance envers Nvidia.
Source: Lire l’article original

