OpenAI a lancé GPT-Live : ChatGPT écoute et parle maintenant simultanément
OpenAI a lancé GPT-Live—une nouvelle version du système vocal de ChatGPT qui écoute et parle simultanément, sans attendre que l'utilisateur termine de parler. Auparavant, ChatGPT fonctionnait en mode : utilisateur parle—pause—modèle répond. GPT-Live permet une communication plus naturelle et semblable à celle des humains. Deux versions ont été lancées : GPT-Live-1 complet et GPT-Live-1 mini léger. Les modèles sont disponibles pour tous les utilisateurs de ChatGPT dans le monde entier depuis le 8 juillet 2026.
Traité par IA depuis TNW ; édité par Hamidun News
Le 8 juillet 2026, OpenAI a lancé GPT-Live — une nouvelle génération de modèles vocaux pour la plateforme ChatGPT. L'innovation principale: communication full-duplex — le modèle peut écouter et parler simultanément sans nécessiter de pauses entre les énoncés de l'utilisateur.
Comment cela fonctionne
Dans la version précédente des interfaces vocales de ChatGPT, le modèle utilisait le mode half-duplex: l'utilisateur parle, le modèle attend une pause dans la parole, puis fournit une réponse. Cela créait une sensation non naturelle. GPT-Live élimine cette limitation: le modèle traite le flux audio entrant en temps réel et peut répondre sans attendre que l'utilisateur termine sa phrase.
Cela rapproche l'interaction de la conversation humaine naturelle, où les gens commencent souvent à répondre avant que le locuteur termine sa phrase.
Deux versions de modèles
OpenAI a lancé deux versions:
- GPT-Live-1 — modèle complet avec toutes les capacités de ChatGPT
- GPT-Live-1 mini — version allégée pour les appareils mobiles et les appareils aux ressources limitées
Les deux versions sont disponibles pour tous les utilisateurs de ChatGPT dans le monde entier à partir du moment du lancement (8 juillet 2026).
Ce que cela signifie pour l'IA conversationnelle
La communication full-duplex est une étape significative vers l'interaction naturelle avec l'IA. Jusqu'à présent, la plupart des assistants vocaux (Siri, Alexa, Google Assistant) fonctionnaient en mode half-duplex. OpenAI démontre que la technologie full-duplex est techniquement réalisable sur les grands modèles de langage.
Cela montre également que les entreprises investissent dans l'amélioration des interfaces conversationnelles — probablement parce que la voix devient la méthode principale d'interaction avec l'IA sur les appareils mobiles.
Pourquoi c'est important
Un assistant d'IA mobile qui parle comme un humain (sans pauses gênantes) peut attirer des millions d'utilisateurs. Cela est particulièrement pertinent pour les marchés où l'interface textuelle est moins pratique (pays en développement, personnes âgées, multitâche).
Les exigences en CPU/GPU pour le traitement full-duplex sont supérieures à celles du half-duplex, mais la version allégée GPT-Live-1 mini permet le déploiement du modèle sur les appareils mobiles.
Ce que cela signifie
La communication full-duplex dans ChatGPT est une étape intermédiaire vers des assistants d'IA personnels qui fonctionnent comme des interlocuteurs naturels. L'industrie se dirige vers la réduction de la friction entre les humains et les modèles. OpenAI montre que la frontière entre "machine parlante" et "assistant intelligent" s'estompe.
Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?
AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.
L'essentiel de l'IA — une fois par semaine
Sept actus qui ont vraiment compté, choisies à la main. Sans bruit ni communiqués.
C'est fait ! Vérifiez votre boîte mail pour la confirmation.