Meta affirme que ses puces MTIA (Meta Training and Inference Accelerator) offrent une réduction de 44 % du coût total de possession et une amélioration de 40 % de l’efficacité énergétique par rapport aux GPU Nvidia polyvalents pour des charges de travail ciblées, incluant les systèmes de classement et de recommandation, l’optimisation publicitaire et l’inférence d’IA générative. La feuille de route de Meta prévoit quatre générations de puces (MTIA 300, 400, 450 et 500), avec un nouveau génération environ tous les six mois, contre un cycle typique de un à deux ans dans l’industrie des semiconducteurs. La MTIA 300 est déjà en production et la MTIA 400 (codée Iris) est prévue pour septembre 2026. Les dépenses en immobilisations de Meta pour 2026 sont estimées entre 115 et 135 milliards de dollars, avec un objectif de capacité de calcul de 14 gigawatts d’ici 2027. Ces puces ASIC complètent les GPU Nvidia et AMD utilisés pour l’entraînement des modèles, l’inférence représentant le volume de calcul le plus important une fois les modèles déployés à grande échelle.
Source: Lire l’article original

