Google pousse un peu plus loin la traduction vocale avec Gemini 3.5 Live Translate. Présenté mardi, ce nouveau modèle d’intelligence artificielle promet des traductions en temps quasi réel dans plus de 70 langues, avec l’objectif de préserver non seulement le sens des propos, mais aussi l’intonation, le rythme et la voix de la personne qui parle.
Cette annonce intervient quelques semaines après les 20 ans de Google Traduction. Le groupe californien veut désormais dépasser le fonctionnement classique des outils de traduction vocale, souvent fondés sur des échanges alternés où le système attend la fin d’une phrase avant de restituer la traduction.
Gemini 3.5 Live Translate adopte une logique plus continue. Le modèle commence à traduire avec quelques secondes de décalage, puis maintient cet écart tout au long de l’échange. Une fois la langue détectée, il génère une traduction fluide, pensée pour suivre le rythme de la conversation sans casser l’interaction.
Google met en avant une traduction plus naturelle, capable de conserver certains éléments de la voix originale. L’enjeu est de rendre les conversations multilingues plus spontanées, notamment dans les situations où l’attente entre deux prises de parole ralentit les échanges.
Le modèle est déjà intégré à plusieurs services du groupe. Dans Google Traduction, sur iOS et Android, il est accessible via la fonction Traduction instantanée. Google recommande l’usage d’écouteurs pour une expérience plus confortable et plus fluide.
Les utilisateurs Android bénéficient aussi d’un nouveau mode Écouter. Cette fonction permet d’entendre la traduction en portant simplement le téléphone à l’oreille, comme lors d’un appel. Google présente cette option comme une solution plus discrète, notamment dans les environnements bruyants ou les situations où l’utilisateur ne souhaite pas diffuser la traduction à voix haute.
Gemini 3.5 Live Translate arrive également dans Google Meet, sous forme de préversion. Le service de visioconférence, jusqu’ici limité à cinq langues pour ce type d’usage, doit ainsi élargir ses capacités de traduction lors des réunions professionnelles et des échanges internationaux.
Une autre préversion est mise à disposition des développeurs. Elle doit leur permettre d’intégrer la traduction vocale en direct dans des appels, réunions, cours, diffusions ou autres usages multilingues.
Avec ce modèle, Google cherche à installer l’intelligence artificielle au cœur de la traduction conversationnelle. L’objectif est clair, réduire les barrières linguistiques dans les échanges du quotidien, les réunions professionnelles et les services numériques où la rapidité de compréhension devient essentielle.














































