OpenAI a lancé GPT-Live le 8 juillet 2024, avec GPT-Live-1 pour les abonnés payants et GPT-Live-1 mini pour les utilisateurs gratuits dans le monde entier. Google développe sa fonction Gemini 3.5 Live Translate depuis juin, ajoutant la traduction vocale en temps réel multilingue dans tout son écosystème de produits. Les deux entreprises ont introduit des modèles vocaux full-duplex capables d’écouter et de parler simultanément, abandonnant les conversations rigides alternées. OpenAI intégrera le filigrane SynthID dans tout le contenu audio GPT-Live d’ici le 31 juillet pour détecter les contenus générés par IA. Ces avancées visent des cas d’usage pratiques quotidiens, notamment la pratique linguistique, l’assistance mains-libres et la gestion de flux de travail complexes.
Source: Lire l’article original

