OpenAI a présenté une nouvelle version du mode vocal de ChatGPT, portée par un modèle nommé GPT-Live-1. Selon l’entreprise, cette mise à jour vise à rendre les échanges plus naturels, avec une expérience plus proche d’une conversation humaine. L’un des changements mis en avant est une meilleure gestion du rythme de parole, afin d’éviter que l’assistant ne coupe trop rapidement son interlocuteur.
D’après les éléments rapportés, GPT-Live-1 est conçu pour interrompre moins souvent et pour attendre davantage lorsqu’un utilisateur marque une pause au milieu d’une phrase. Lors d’un point presse, Kundan Kumar, responsable de la recherche chez OpenAI, l’a présenté comme le modèle vocal « le plus intelligent » de l’entreprise à ce jour. Cette évolution répond à une limite fréquente des interfaces vocales: leur tendance à interpréter un silence bref comme la fin d’une demande.
OpenAI indique aussi que ce modèle vocal peut rediriger automatiquement certaines requêtes vers ses modèles textuels les plus avancés, notamment GPT-5.5, lorsqu’un besoin de raisonnement ou de recherche web est détecté. L’objectif est d’enchaîner plus rapidement entre la phase de recherche d’informations et la restitution orale des résultats, sans rupture visible pour l’utilisateur.
La société évoque enfin un enrichissement des conversations par des éléments contextuels supplémentaires, même si les détails complets ne figurent pas dans l’extrait disponible. À ce stade, les informations publiées suggèrent surtout une stratégie claire: faire du mode vocal un point d’entrée plus crédible pour des usages quotidiens, en réduisant les frictions d’interaction. Reste à voir comment ces promesses se traduiront en conditions réelles d’utilisation et à quel rythme cette version sera déployée.