Alex Smola, chercheur en apprentissage automatique et cofondateur de Boson AI en 2023, prépare le lancement du modèle Higgs RealTime, un système de reconnaissance et de synthèse vocale en temps réel. La startup basée à Santa Clara a publié le modèle Higgs TTS 3 le 4 juin 2026, compatible avec plus de 100 langues et intégrant des fonctionnalités de clonage vocal instantané et de contrôle émotionnel en ligne. Boson AI a rendu open source ses modèles Higgs TTS 2 en mai 2025 sur Hugging Face après les avoir entraînés sur plus de 10 millions d’heures de données audio. Higgs RealTime élimine l’étape intermédiaire de conversion vers le texte, réduisant ainsi la latence tout en préservant les nuances vocales. Face à des concurrents comme OpenAI, Google et ElevenLabs, Boson AI mise sur son expertise académique et sa stratégie d’adoption communautaire par l’open source pour se démarquer.
Source: Lire l’article original

