Open AI : L’entreprise dévoile GPT-Live, un modèle vocal capable de parler et d’écouter simultanément
OpenAI a annoncé le lancement de GPT-Live, une nouvelle génération de modèles vocaux conçus pour rendre les échanges avec ChatGPT plus fluides et naturels. Basé sur une architecture dite full-duplex, le système peut écouter et parler simultanément, interrompre ou reprendre une conversation de manière naturelle, réagir par de courtes expressions (« mmh », « oui ») ou encore laisser des silences lorsque l’utilisateur réfléchit.
GPT-Live s’appuie également sur GPT-5.5 pour les tâches nécessitant un raisonnement approfondi ou une recherche sur le Web. Pendant que ces traitements sont effectués en arrière-plan, le modèle continue d’interagir avec l’utilisateur sans rompre le fil de la conversation. OpenAI précise que GPT-Live sera automatiquement mis à jour pour tirer parti de ses futurs modèles les plus avancés.
Deux versions, GPT-Live-1 et GPT-Live-1 mini, sont en cours de déploiement auprès des utilisateurs de ChatGPT à travers le monde. Elles seront prochainement proposées via l’API de l’entreprise. Cette évolution marque une nouvelle étape dans le développement d’assistants vocaux plus conversationnels, capables à terme d’accomplir des tâches plus longues et plus complexes.