Accelerated Understanding Inc, fondée par la professeure de Caltech Anima Anandkumar et Benedikt Jenik, a lancé un modèle d’IA basé sur l’architecture des opérateurs neuronaux plutôt que sur le cadre des transformeurs utilisé par la plupart des grandes entreprises d’IA. Le modèle fonctionne en 4D, captant les relations spatiales tridimensionnelles tout en suivant leur évolution dans le temps, et peut traiter jusqu’à 1 milliard de jetons pendant l’entraînement et dépasser 5 milliards de jetons en inférence. Il a été mis à l’échelle à 1 milliard de paramètres en pré-entraînement, le plaçant dans la même catégorie que les plus grands modèles jamais construits. La startup a refusé de diriger Project Prometheus, un projet soutenu par Jeff Bezos, avant de fonder la société. Les applications ciblées incluent l’optimisation énergétique, la conception de puces, la robotique, la prévision météorologique et l’innovation médicale.
Source: Lire l’article original

