TNW→ original

OpenAI a lancé GPT-Live : ChatGPT écoute et parle maintenant simultanément

OpenAI a lancé GPT-Live—une nouvelle version du système vocal de ChatGPT qui écoute et parle simultanément, sans attendre que l'utilisateur termine de parler. Auparavant, ChatGPT fonctionnait en mode : utilisateur parle—pause—modèle répond. GPT-Live permet une communication plus naturelle et semblable à celle des humains. Deux versions ont été lancées : GPT-Live-1 complet et GPT-Live-1 mini léger. Les modèles sont disponibles pour tous les utilisateurs de ChatGPT dans le monde entier depuis le 8 juillet 2026.

Traité par IA depuis TNW ; édité par Hamidun News
OpenAI a lancé GPT-Live : ChatGPT écoute et parle maintenant simultanément
Source : TNW. Collage: Hamidun News.
◐ Écouter l'article

Le 8 juillet 2026, OpenAI a lancé GPT-Live — une nouvelle génération de modèles vocaux pour la plateforme ChatGPT. L'innovation principale: communication full-duplex — le modèle peut écouter et parler simultanément sans nécessiter de pauses entre les énoncés de l'utilisateur.

Comment cela fonctionne

Dans la version précédente des interfaces vocales de ChatGPT, le modèle utilisait le mode half-duplex: l'utilisateur parle, le modèle attend une pause dans la parole, puis fournit une réponse. Cela créait une sensation non naturelle. GPT-Live élimine cette limitation: le modèle traite le flux audio entrant en temps réel et peut répondre sans attendre que l'utilisateur termine sa phrase.

Cela rapproche l'interaction de la conversation humaine naturelle, où les gens commencent souvent à répondre avant que le locuteur termine sa phrase.

Deux versions de modèles

OpenAI a lancé deux versions:

  • GPT-Live-1 — modèle complet avec toutes les capacités de ChatGPT
  • GPT-Live-1 mini — version allégée pour les appareils mobiles et les appareils aux ressources limitées

Les deux versions sont disponibles pour tous les utilisateurs de ChatGPT dans le monde entier à partir du moment du lancement (8 juillet 2026).

Ce que cela signifie pour l'IA conversationnelle

La communication full-duplex est une étape significative vers l'interaction naturelle avec l'IA. Jusqu'à présent, la plupart des assistants vocaux (Siri, Alexa, Google Assistant) fonctionnaient en mode half-duplex. OpenAI démontre que la technologie full-duplex est techniquement réalisable sur les grands modèles de langage.

Cela montre également que les entreprises investissent dans l'amélioration des interfaces conversationnelles — probablement parce que la voix devient la méthode principale d'interaction avec l'IA sur les appareils mobiles.

Pourquoi c'est important

Un assistant d'IA mobile qui parle comme un humain (sans pauses gênantes) peut attirer des millions d'utilisateurs. Cela est particulièrement pertinent pour les marchés où l'interface textuelle est moins pratique (pays en développement, personnes âgées, multitâche).

Les exigences en CPU/GPU pour le traitement full-duplex sont supérieures à celles du half-duplex, mais la version allégée GPT-Live-1 mini permet le déploiement du modèle sur les appareils mobiles.

Ce que cela signifie

La communication full-duplex dans ChatGPT est une étape intermédiaire vers des assistants d'IA personnels qui fonctionnent comme des interlocuteurs naturels. L'industrie se dirige vers la réduction de la friction entre les humains et les modèles. OpenAI montre que la frontière entre "machine parlante" et "assistant intelligent" s'estompe.

ZK
Hamidun News
Actualités IA sans bruit. Sélection éditoriale quotidienne de plus de 50 sources. Produit de Zhemal Khamidun, Head of AI chez Alpina Digital.

Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?

AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.

Qu'en pensez-vous ?
Chargement des commentaires…