# Google dévoile deux IA vocales Gemini, dont une raisonne

> Google a publié Gemini 3.8 Live et 3.8 Live Extended Thinking, deux modèles parole à parole accessibles via WebSocket et Web Audio API.

Type : Actualité IA · Catégorie : Outils · Publié le 2026-09-16 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/google-publie-gemini-38-live-deux-ia-vocales-en-direct
Tags : google, gemini, ia vocale, websocket, développement, raisonnement

---

## En résumé

- Google a publié Gemini 3.8 Live et 3.8 Live Extended Thinking le 15 septembre 2026.
- Les deux modèles sont conçus pour traiter directement la parole en entrée et en sortie.
- L’implémentation utilise un point de terminaison WebSocket et la Web Audio API.

**Le signal :** Google a publié le 15 septembre 2026 deux modèles parole à parole, Gemini 3.8 Live et 3.8 Live Extended Thinking.

**[Google](/signal-ia/actu/barret-zoph-devient-vice-president-de-la-recherche-chez-google) publie deux modèles** Le 15 septembre 2026, Google a publié Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking. Ces deux nouveautés sont des modèles parole à parole. Ils sont conçus pour gérer directement des échanges vocaux. Leur nom les rattache à la famille Gemini. La publication distingue deux versions, Live et Live Extended Thinking. Le fait porte donc sur deux modèles séparés, et non sur une seule déclinaison. Cette annonce place la voix au centre de l’interface proposée. Les modèles présentent une forme similaire à la famille GPT-Live d’OpenAI. Cette comparaison décrit leur forme générale. Elle ne transforme pas les modèles en produits OpenAI. [Lire l’article de Simon Willison](https://simonwillison.net/2026/Sep/15/gemini-live/).

**Une comparaison avec OpenAI** Les deux modèles de Google sont décrits comme similaires, dans leur forme, à la famille GPT-Live d’OpenAI. Cette ressemblance concerne leur organisation en modèles vocaux parole à parole. [Gemini](/signal-ia/actu/google-deepmind-gemini-robotics-2-bouscule-la-robotique) 3.8 Live et Gemini 3.8 Live Extended Thinking restent les noms associés à la publication de Google. La date annoncée est le 15 septembre 2026. Le format parole à parole distingue ces modèles des systèmes qui séparent nécessairement la reconnaissance vocale et la génération de réponse. L’information porte sur leur nature et leur comparaison. Il ne permet pas de conclure à une identité technique entre Google et OpenAI. La documentation évoquée concerne l’accès aux nouveaux modèles vocaux.

## Google relie les modèles par WebSocket

**Une connexion par WebSocket** L’implémentation de Gemini Live se connecte à un point de terminaison WebSocket. Ce protocole constitue le canal utilisé par l’interface décrite pour accéder aux modèles. La capture et la lecture audio reposent sur la Web Audio API. L’architecture associe donc un point de terminaison réseau et une interface web dédiée à l’audio. Ces deux composants apparaissent ensemble dans l’implémentation présentée. Le WebSocket concerne la connexion aux modèles. La Web Audio API concerne la capture et la restitution du son. Cette séparation donne une description technique précise du fonctionnement exposé. Elle ne fournit pas d’autre détail sur les performances ou les conditions d’utilisation.

**Simon Willison construit une interface** Simon Willison indique avoir demandé à GPT-6 Astra Extra High de consulter la documentation. Selon son témoignage, le modèle a construit une interface web permettant d’essayer les nouveaux modèles. Cette interface sert donc à tester [Gemini 3](/signal-ia/actu/gemini-3-un-modele-dia-de-google).8 Live et Gemini 3.8 Live Extended Thinking. Son récit associe la documentation, GPT-6 Astra Extra High et une interface web. Il présente cette réalisation comme une expérimentation personnelle. Simon Willison mentionne également un tutoriel Gemini Live consacré au démarrage avec l’API WebSockets. Le tutoriel est lié à l’accès aux modèles via cette API. [Consulter le tutoriel Gemini Live](https://simonwillison.net/2026/Sep/15/gemini-live/).

## Le tutoriel présente l’API WebSockets

**Un accès documenté aux modèles** Simon Willison présente un tutoriel Gemini Live pour commencer avec l’API WebSockets. Cette ressource accompagne l’implémentation qui relie les modèles à un point de terminaison WebSocket. L’interface web évoquée permet d’essayer les deux nouveaux modèles de Google. La capture et la lecture audio utilisent la Web Audio API dans cette implémentation. Les éléments décrits forment une chaîne technique identifiable : Gemini 3.8 Live ou Gemini 3.8 Live Extended Thinking, une connexion WebSocket, puis des fonctions audio du navigateur. La publication réunit ainsi les noms des modèles, leur format parole à parole et les composants techniques de leur utilisation.
