AccueilNews24 langues, un ton pour chaque émotion : Google soigne son outil de...

24 langues, un ton pour chaque émotion : Google soigne son outil de synthèse vocale

Publié le

Text to Speech est une technologie de synthèse vocale qui permet de retranscrire un texte en discours oral naturel et optimisé grâce à Gemini. Google présente aujourd’hui deux nouveaux modes, Gemini 2.5 Flash et Gemini 2.5 Pro, qui introduisent une palette plus large d’expressivité vocale, une meilleure compréhension des consignes données, des ajustements de vitesse plus intelligents et une prise en charge couvrant désormais 24 langues.

Gemini 2.5 Flash et Gemini 2.5 Pro, deux nouveaux modèles pour plus de précision

Le premier mode Gemini 2.5 Flash est adapté aux scénarios à faible latence, tandis que Gemini 2.5 Pro donne la priorité à la qualité vocale.

Ces deux nouveaux modes promettent tous les deux, une expressivité améliorée grâce à une polyvalence de ton proposée. Le dialogue devrait alors être plus fluide grâce à des voix adaptées et cohérentes à chaque situation et ce même dans des scénarios multi-intervenants. Ces voix ont

Les dernières infos

A lire aussi...

Détails

Vidéos overclocking.com Vous êtes à la recherche d’un kit AIO avec une...

La RTX 3060 est adaptée à l’âge grâce à ses 12 Go de mémoire. Vidéos sur overclocking.comUn collègue a utilisé les résultats d’un autre...

Vidéos overclocking.com Pour faire simple, un confrère a dressé un comparatif en...

AMD présente son Instinct MI455X, un GPU IA hors normes !

Vidéos overclocking.com En plus d’avoir annoncé ses nouveaux processeurs Epyc basés sur...