Xiaomi a lancé une nouvelle version des modèles d'IA MiMo V2.5, permettant de convertir le texte en voix et inversement

Xiaomi a lancé une nouvelle version des modèles d'IA MiMo V2.5, permettant de convertir le texte en voix et inversement

25 software

Xiaomi lance de nouveaux modèles vocaux d’intelligence artificielle

La société Xiaomi a présenté deux versions de ses modèles vocaux IA, fonctionnant avec du texte et de l’audio :

Modèle | Fonction | Caractéristiques clés
MiMo‑V2.5‑TTS | Texte → parole | 3 variantes de voix, gratuites pendant une période limitée sur MiMo Studio ; réglage de la vitesse, du ton et des émotions ; possibilité de créer de nouvelles voix à partir d’une courte phrase (VoiceDesign) et clonage de voix à partir d’un petit ensemble d’échantillons (VoiceClone).
MiMo‑V2.5‑ASR | Parole → texte | Reconnaissance vocale dans des conditions difficiles, prise en charge des dialectes chinois + anglais ; dialogues bilingues et textes de chansons (voix sur fond musical) ; fonctionnement en forte présence de bruit ; ponctuation automatique selon l’intonation.

Comment utiliser MiMo‑V2.5‑TTS
1. Variante de base – choisissez une voix préinstallée et ajustez la vitesse, le ton et l’émotion.

2. VoiceDesign – entrez une courte phrase, puis le système génère un nouveau timbre vocal.

3. VoiceClone – téléchargez plusieurs échantillons de la voix choisie ; le modèle reproduit cette voix tout en conservant style et instructions.

Pour obtenir le rendu souhaité, l’utilisateur peut :
- Ajouter des balises spéciales au texte;
- Décrire la voix en langage naturel simple (en chinois ou anglais);
- Créer des scénarios pour des mises en scène virtuelles où plusieurs voix interagissent simultanément.

Caractéristiques de MiMo‑V2.5‑ASR
- Multilinguisme : prise en charge de plusieurs dialectes du chinois et de l’anglais.

- Transcription de chansons : le modèle extrait la voix même avec musique de fond.

- Résistance au bruit : reconnaissance précise dans des environnements bruyants.

- Ponctuation selon l’intonation : insertion automatique de signes de ponctuation, réduisant ainsi le besoin de correction manuelle.

Ainsi, Xiaomi étend ses capacités en matière de technologies vocales, offrant des outils flexibles tant pour la synthèse vocale que pour la reconnaissance précise de l’information orale.

Commentaires (0)

Partagez votre avis — merci de rester courtois et dans le sujet.

Pas encore de commentaires. Laissez un commentaire et partagez votre avis !

Pour laisser un commentaire, connectez-vous.

Connectez-vous pour commenter