EN DIRECT
NVIDIA dévoile les premiers résultats MLPerf de sa plateforme Vera Rubin NVL7216/09/26 · NVIDIA|OpenAI élargit la publicité dans ChatGPT avec des « Sponsored Agents »16/09/26 · OpenAI|OpenAI se lance dans la publicité avec des « Sponsored Agents »16/09/26 · OpenAI|Google DeepMind lance Gemini 3.8 Live et sa variante à raisonnement étendu15/09/26 · Google DeepMind|L'investissement massif dans les infrastructures IA fait-il courir un risque de bulle ?15/09/26|Une faille dans la surveillance du raisonnement des modèles de langage14/09/26|Stellar Colosseum : un système multi-agents pour la recherche mathématique de long terme14/09/26|Le code d'Apple suggère que Siri pourrait céder la place à ChatGPT ou Claude14/09/26 · Apple|Anthropic dit avoir détecté un usage de Claude Code par les Houthis pour du guidage de missiles13/09/26 · Anthropic|Yoshua Bengio analyse pourquoi les agents IA mentent, trichent et se coordonnent13/09/26|Terence Tao dénonce une « grave dérive » d'OpenAI dans les mathématiques11/09/26 · OpenAI|Terence Tao alerte sur un « désalignement sévère » de l'IA en mathématiques11/09/26|NVIDIA dévoile les premiers résultats MLPerf de sa plateforme Vera Rubin NVL7216/09/26 · NVIDIA|OpenAI élargit la publicité dans ChatGPT avec des « Sponsored Agents »16/09/26 · OpenAI|OpenAI se lance dans la publicité avec des « Sponsored Agents »16/09/26 · OpenAI|Google DeepMind lance Gemini 3.8 Live et sa variante à raisonnement étendu15/09/26 · Google DeepMind|L'investissement massif dans les infrastructures IA fait-il courir un risque de bulle ?15/09/26|Une faille dans la surveillance du raisonnement des modèles de langage14/09/26|Stellar Colosseum : un système multi-agents pour la recherche mathématique de long terme14/09/26|Le code d'Apple suggère que Siri pourrait céder la place à ChatGPT ou Claude14/09/26 · Apple|Anthropic dit avoir détecté un usage de Claude Code par les Houthis pour du guidage de missiles13/09/26 · Anthropic|Yoshua Bengio analyse pourquoi les agents IA mentent, trichent et se coordonnent13/09/26|Terence Tao dénonce une « grave dérive » d'OpenAI dans les mathématiques11/09/26 · OpenAI|Terence Tao alerte sur un « désalignement sévère » de l'IA en mathématiques11/09/26|
ReleaseGoogle

Google ajoute Gemini 3.8 Live et une variante à raisonnement étendu

Google enrichit sa gamme Gemini avec deux nouvelles déclinaisons destinées aux interactions vocales et multimodales en temps réel, dont une version capable d'un raisonnement plus poussé sur les requêtes complexes.

15 septembre 20263 min de lecturePublié parHacker News

Google a annoncé sur son blog officiel l'arrivée de Gemini 3.8 Live ainsi que d'une variante baptisée Gemini 3.8 Live Extended Thinking, deux nouvelles itérations de sa gamme de modèles pensée pour les échanges vocaux et multimodaux en temps réel. Ces modèles s'inscrivent dans la continuité de l'API Live de Google, déjà utilisée pour des assistants capables de tenir une conversation fluide avec latence réduite, en intégrant voix, image et texte dans un même flux d'interaction.

La déclinaison Extended Thinking se distingue par l'ajout d'une phase de raisonnement plus approfondie avant de produire une réponse, une approche que Google avait déjà explorée avec les variantes 'thinking' de précédentes générations Gemini. L'objectif affiché est de permettre au modèle de mieux gérer les requêtes complexes ou ambiguës sans sacrifier la réactivité attendue d'un système conversationnel en temps réel, un compromis qui reste techniquement délicat à tenir.

Le billet de blog publié par Google reste toutefois succinct sur les détails techniques précis : benchmarks, tarification, disponibilité par région ou limites de latence ne sont pas encore documentés dans le communiqué initial. Cette annonce s'inscrit dans un rythme de mises à jour de plus en plus rapproché pour la famille Gemini, Google cherchant visiblement à maintenir la pression face à la concurrence sur les assistants vocaux et les agents conversationnels.

En l'absence de données de performance comparatives, il est difficile d'évaluer précisément l'apport réel de cette version par rapport aux itérations précédentes. Les développeurs et entreprises utilisant l'API Live devront attendre une documentation plus complète, ou des tests indépendants, pour mesurer si le gain en capacité de raisonnement se traduit par une amélioration tangible dans des cas d'usage concrets comme les agents vocaux d'entreprise ou les assistants multimodaux grand public.

Tags
geminigooglelive-apivoice-aimultimodalreasoning

À lire aussi