Xiaomi ha lanciato la nuova versione dei modelli AI MiMo V2.5, che consentono di convertire il testo in voce e viceversa

Xiaomi ha lanciato la nuova versione dei modelli AI MiMo V2.5, che consentono di convertire il testo in voce e viceversa

26 software

Xiaomi lancia nuovi modelli vocali di intelligenza artificiale

L’azienda Xiaomi ha presentato due versioni dei suoi modelli vocali IA, che funzionano con testo e audio:

Modello Funzione Caratteristiche chiave MiMo‑V2.5‑TTS Testo → voce 3 varianti, gratuite per un periodo limitato su MiMo Studio; impostazione di velocità, tono ed emozioni; possibilità di creare nuovi voci con una breve frase (VoiceDesign) e clonare la voce da un piccolo set di campioni (VoiceClone). MiMo‑V2.5‑ASR Voce → testo Riconoscimento della parlata orale in condizioni complesse, supporto per dialetti cinesi + inglese; dialoghi bilingue e testi di canzoni (voce sullo sfondo musicale); funzionamento con forte rumore; inserimento automatico della punteggiatura secondo l’intonazione.

Come usare MiMo‑V2.5‑TTS
1. Variante base – sceglie una delle voci preimpostate e consente di modificare velocità, tono e sfumature emotive.

2. VoiceDesign – inserisce una breve frase, dopodiché il sistema genera un nuovo timbro vocale.

3. VoiceClone – carica diversi campioni della voce scelta; il modello la riproduce mantenendo stile e istruzioni.

Per ottenere il suono desiderato l’utente può:

- Aggiungere tag speciali al testo;

- Descrivere la voce con un linguaggio naturale semplice (in cinese o inglese);

- Creare scenari per rappresentazioni virtuali, dove più voci interagiscono contemporaneamente.

Caratteristiche di MiMo‑V2.5‑ASR
- Multilinguismo – supporto per diversi dialetti cinesi e l’inglese.

- Decodifica delle canzoni – il modello individua la voce anche in presenza di musica di sottofondo.

- Resistenza al rumore – riconoscimento preciso in condizioni di forte rumore esterno.

- Punteggiatura secondo l’intonazione – inserisce automaticamente i segni di punteggiatura, riducendo la necessità di correzione manuale.

Così Xiaomi amplia le proprie capacità nel campo delle tecnologie vocali, offrendo strumenti flessibili sia per la creazione di voce sintetizzata che per il riconoscimento accurato della parlata.

Commenti (0)

Condividi la tua opinione — per favore, sii cortese e resta in tema.

Non ci sono ancora commenti. Lascia un commento e condividi la tua opinione!

Per lasciare un commento, accedi.

Accedi per commentare