Google présente Gemini 3.8 Live et Extended Thinking : raisonnement en temps réel pour des tâches vocales complexes

Google a présenté Gémeaux 3.8 en direct et Gemini 3.8 Live Pensée étendueles modèles de dialogue en direct les plus avancés jamais développés. Les deux intègrent des améliorations du raisonnement parallèle presque en temps réel, comme l'explique l'entreprise elle-même, et sont désormais disponibles pour les développeurs, les entreprises et les utilisateurs via plusieurs voies d'accès qui fonctionnent aujourd'hui.

Tom Ouyang et Malini Jaganathande Google, expliquent que les deux modèles représentent des améliorations significatives en termes d'intelligence et de raisonnement parallèle, ce qui, comme ils le détaillent, les rend plus intuitifs pour collaborer et exécuter des tâches complexes à l'aide de la voix. Selon les auteurs de l'annonce, ces mises à jour permettent aux agents vocaux de travailler plus efficacement et de rendre les conversations avec l'intelligence artificielle plus naturelles et intelligentes.

Avec cette annonce, l'entreprise met simultanément à jour les deux variantes : celle conçue pour un usage de masse et celle orientée vers des tâches qui nécessitent plusieurs étapes de raisonnement. Les deux élargissent les options disponibles pour discuter avec Gemini via son application, Google Workspace et le moteur de recherche, comme détaillé par l'entreprise elle-même dans l'annonce.

Gemini 3.8 Live donne la priorité à l'évolutivité et à la rentabilité

Google a conçu Gémeaux 3.8 en direct penser à l’évolutivité et garder le coût de chaque interaction sous contrôle. L'entreprise explique que le modèle combine intelligence conversationnelle, dialogue fluide et ancrage visuel, même si elle n'a pas détaillé le fonctionnement technique de cette dernière capacité.

Cet équilibre entre coût et performance est conçu pour les agents vocaux qui doivent s'occuper d'un volume élevé de conversations, tant dans l'application Gemini que dans le moteur de recherche. Google n'a pas précisé s'il existe des différences dans disponibilité par langue ou régionet n'a pas non plus proposé de chiffres de performances permettant de comparer cette version avec d'autres variantes de ses modèles Live.

L'ancrage visuel fait partie, selon l'entreprise elle-même, des outils visant à rendre la conversation vocale plus naturelle lorsqu'elle est combinée avec du contenu visuel. Google n'a pas publié d'exemples concrets de fonctionnement de cette fonctionnalité ni expliqué quel type de contenu visuel le modèle peut traiter.

Pensée étendue pour des problèmes complexes

Gemini 3.8 Live Pensée étendue Il est conçu pour des tâches très complexes. Google note qu'il intègre une plus grande intelligence et un plus grand raisonnement en plusieurs étapes, lui permettant de travailler sur des problèmes qui nécessitent différentes étapes d'analyse avant de proposer une réponse finale.

Avec les deux modèles, l'entreprise cherche à rendre la conversation avec Gemini via l'application, Workspace et Search plus fluide et collaborative. Selon Google, cela aidera les utilisateurs à résoudre des tâches complexes en utilisant uniquement leur voix, un objectif que l'entreprise relie directement aux améliorations du raisonnement parallèle annoncées pour les deux modèles.

L'interface Gemini Transcribe AI est désormais disponible via le site officiel. Photo : capture Softzone.

La différence avec Gemini 3.8 Live réside dans le type de tâche vers laquelle chaque version est orientée : alors que la première donne la priorité à la vitesse et au coût, Extended Thinking s'engage sur la profondeur du raisonnement, comme l'a détaillé l'entreprise dans l'annonce des deux modèles. Google n'a pas indiqué si cette variante impliquait des temps de réponse plus longs que la version standard.

Disponibilité immédiate dans API, AI Studio et Search Live

Les deux modèles sont désormais accessibles aux développeurs via le API Gémeaux et de Google IA Studio. Au niveau de l'entreprise, les entreprises ont Entreprise Gémeaux comme voie d'accès, comme l'a confirmé l'entreprise elle-même.

Pour le reste des utilisateurs, l'entreprise a permis l'accès via Recherche Google en directétendant immédiatement les capacités de chat en direct de Gemini 3.8 à toute personne utilisant le navigateur. La mise à jour arrive simultanément sur les quatre voies d'accès proposées par l'entreprise.

Google n'a pas précisé si le déploiement s'effectuerait de manière uniforme dans toutes les langues et régions où Search Live opère, ni annoncé de calendrier d'expansion au-delà du lancement d'aujourd'hui. Si vous utilisez déjà le moteur de recherche avec les fonctions vocales activées, vous pouvez vérifier si les réponses intègrent déjà ce raisonnement plus rapide dans des requêtes qui nécessitaient auparavant plusieurs allers-retours.

FAQ Gemini 3.8 en direct

Qu'est-ce qui différencie Gemini 3.8 Live de Gemini 3.8 Live Extended Thinking ?

Gemini 3.8 Live est conçu pour évoluer de manière rentable et combine un dialogue fluide avec un ancrage visuel. Extended Thinking est conçu pour des tâches très complexes, avec une intelligence accrue et un raisonnement en plusieurs étapes.

Où sont disponibles les nouveaux modèles Gemini 3.8 ?

Les développeurs peuvent les utiliser dans l'API Gemini et Google AI Studio, les entreprises via Gemini Enterprise et tout le monde via Google Search Live.

Qu'est-ce que l'ancrage visuel dans Gemini 3.8 Live ?

C'est l'une des capacités qui, selon Google, se combine avec l'intelligence conversationnelle et le dialogue fluide du modèle. L'entreprise n'a pas détaillé son fonctionnement technique exact.