Gemini3.8 Live icône
Gemini3.8 LiveIcône vérifiée Veriblue
#27 dans Outils Développeur
4.5/5
« Un modèle de dialogue vocal en temps réel qui raisonne pendant la conversation, traite des entrées visuelles et exécute des appels d'outils en arrière-plan »
En savoir plus : ChatGPT Perplexity
Icône vérifiée
Outil Vérifié
Freemium 6254

Gemini 3.8 Live: parlez à l'IA de Google pendant qu'elle travaille en coulisses

Gemini 3.8 Live est le modèle de dialogue vocal en temps réel de Google DeepMind, épaulé par une déclinaison Extended Thinking pour les tâches complexes. Lancés le 15 septembre 2026, les deux modèles écoutent, répondent et exécutent des appels d'outils en arrière-plan sans couper la conversation. Le français figure parmi les 97 langues reconnues, détectées à la volée en pleine discussion. L'application Gemini, Search Live, Google Workspace et la Live API pour les développeurs y donnent déjà accès.

Avantages
  • Première place au Speech to Speech Quality Index
  • Appels d'outils exécutés pendant que la conversation continue
  • 97 langues détectées et changées en pleine discussion
  • Analyse du flux caméra en quasi temps réel
  • Déjà accessible via la Live API et Google AI Studio
Inconvénients
  • Grille tarifaire API non détaillée au lancement
  • Modèles hébergés, aucune version à poids ouverts
  • Accès complet dans l'appli Gemini lié aux abonnements payants

Gemini 3.8 Live parle, regarde et appelle des outils sans lâcher le fil

Gemini 3.8 Live traite la voix de bout en bout, sans passer par la chaîne classique qui enchaîne reconnaissance vocale, modèle de langage puis synthèse. Google DeepMind a sorti deux déclinaisons le même jour. La version Live vise l'échelle et les coûts contenus, la version Extended Thinking encaisse les scénarios complexes avec un raisonnement multi-étapes mené pendant qu'elle vous répond.

Dans la pratique, vous montrez une facture à la caméra, l'agent la lit, interroge une API en tâche de fond et poursuit sa phrase sans blanc (ce silence gêné des assistants vocaux en pleine réflexion, tout le monde connaît). Les interruptions ne le déstabilisent pas non plus.

  • Dialogue continu qui survit aux interruptions
  • 97 langues détectées à la volée
  • Appels d'outils et d'API en tâche de fond
  • Lecture du flux vidéo et des images partagées en quasi temps réel

La première place des benchmarks vocaux, chiffres à l'appui

Gemini 3.8 Live Extended Thinking occupe la première place de l'index Speech to Speech Quality d'Artificial Analysis avec 82,6, devant GPT-Live-1 Astra et Grok Voice Think Fast 2.0. Le modèle Live, plus léger, a pris la deuxième place de la Speech Agent Arena, un classement fondé sur les préférences humaines.

Sur les tâches bancaires du test de Sierra, le score de 35,1 % laisse encore de la marge. Signe honnête que les agents vocaux restent jeunes sur les parcours réglementés, même en tête de classement.

BenchmarkGemini 3.8 Live Extended ThinkingRival le plus proche
Speech to Speech Quality Index82,6 (1re place)GPT-Live-1 Astra, 81,5
τ-Voice (tâches d'agent)68,6 %GPT-Live-1 Astra, 67,9 %
τ³-Banking de Sierra35,1 %GPT-Live-1 Astra, 32,0 %
Big Bench Audio (raisonnement)97,7 %non communiqué

Où essayer Gemini 3.8 Live, de Search Live à la Live API

Les deux modèles sont disponibles dans la Gemini Live API et Google AI Studio, avec LiveKit, LangChain et Agora déjà branchés pour accélérer les déploiements. Les entreprises les testent en préversion sur Gemini Enterprise. Grand public, Search Live les sert dès maintenant, tandis que l'appli Gemini les associe aux abonnements Google AI Pro à 19,99 $ par mois (environ 18 €) et Ultra à partir de 99,99 $ (environ 92 €). Google n'a pas publié de grille tarifaire propre à ces modèles au lancement, tout en revendiquant un positionnement compétitif face aux autres modèles de pointe. Ces montants bougeront sans prévenir, budgétez depuis la page officielle et nulle part ailleurs.

La bataille des assistants vocaux dopés à l'IA se joue désormais sur la latence et la fiabilité des appels d'outils, et Google avance ici ses meilleurs arguments.

Questions fréquentes

Gemini 3.8 Live est-il gratuit ?

Partiellement. Search Live intègre déjà le modèle sans frais supplémentaires, et Google AI Studio permet de le tester gratuitement. Dans l'appli Gemini, les nouveaux modèles vocaux passent par les abonnements Google AI Pro et Ultra, et l'usage professionnel via la Live API se facture à la consommation.

Quelle est la différence entre Gemini 3.8 Live et Extended Thinking ?

Deux rôles distincts. Gemini 3.8 Live vise le volume et la maîtrise des coûts, avec un dialogue fluide et l'analyse du contexte visuel. Extended Thinking ajoute un raisonnement multi-étapes en arrière-plan pour les cas complexes, comme un diagnostic technique ou une réservation passant par plusieurs API, sans casser le rythme de l'appel.

Peut-on héberger Gemini 3.8 Live sur ses propres serveurs ?

Non. Les deux modèles sont hébergés par Google et accessibles via la Live API, Google AI Studio ou la préversion Gemini Enterprise. Aucun poids ouvert n'est distribué, contrairement à la famille Gemma. Vos flux audio transitent donc par l'infrastructure de Google, un point à vérifier pour les secteurs réglementés.

Gemini 3.8 Live parle-t-il français ?

Oui. Le français fait partie des 97 langues prises en charge, et le modèle détecte automatiquement la langue de son interlocuteur, y compris quand elle change au milieu d'un appel. Un agent peut donc démarrer en français puis basculer en anglais ou en espagnol sans réglage préalable, un argument fort pour les services clients multilingues.

Verdict : Pour équiper un standard téléphonique, un support client multilingue ou un tuteur vocal, Gemini 3.8 Live apporte la brique qui manquait, et les développeurs d'agents vocaux comme les abonnés Gemini y trouvent un interlocuteur qui ne perd plus le fil.

★ Outils IA de Prestige ★
IA Alternatives à Gemini3.8 Live
Payant
Gratuit
Payant
Gratuit
Payant
Gratuit
Gratuit
Gratuit