Xiaomi, metni ses haline getirme ve tersini yapma yeteneğine sahip yeni MiMo V2.5 AI modellerini piyasaya sürdü
Xiaomi yeni sesli yapay zeka modelleri başlatıyor
Şirket Xiaomi, metin ve sesle çalışan iki sesli AI modeli sürümü tanıttı:
Model Özellik Önemli Noktalar MiMo‑V2.5‑TTS Metinden Konuşmaya 3 varyant, MiMo Studio’da sınırlı süre için ücretsiz; hız, ton ve duygu ayarı; kısa bir cümleyle yeni sesler oluşturma (VoiceDesign) ve küçük örnek setinden ses klonlama (VoiceClone). MiMo‑V2.5‑ASR Konuşmadan Metne Ses Tanıma karmaşık koşullarda konuşma tanıma, Çin lehçeleri + İngilizce desteği; çift dilli diyaloglar ve şarkı metinleri (vokal arka plan müziğiyle); yüksek gürültüde çalışma; intonasyona göre otomatik noktalama.
MiMo‑V2.5‑TTS nasıl kullanılır
1. Temel seçenek – önceden ayarlanmış seslerden birini seçer ve hız, ton ve duygusal nüansları değiştirir.
2. VoiceDesign – kısa bir cümle girilir, ardından sistem yeni bir ses tonu üretir.
3. VoiceClone – seçilen sesin birkaç örneği yüklenir; model stil ve talimatları koruyarak onu yeniden üretir.
İstenilen sesi elde etmek için kullanıcı:
- Metne özel etiketler ekleyebilir;
- Sesini basit doğal dille (Çince veya İngilizce) tarif edebilir;
- Birden fazla sesin aynı anda etkileşime girdiği sanal sahneler için senaryolar oluşturabilir.
MiMo‑V2.5‑ASR Özellikleri
- Çokdilli – birden çok Çin lehçesi ve İngilizce desteği.
- Şarkı Çözümlemesi – model, arka plan müziği olsa bile vokalı ayırır.
- Gürültü Direnci – yüksek dış gürültü koşullarında doğru tanıma.
- İntonasyona Göre Noktalama – otomatik olarak noktalama işaretleri ekler, manuel düzeltme ihtiyacını azaltır.
Bu şekilde Xiaomi, sentezli konuşma oluşturma ve sözlü bilgi tanıma için esnek araçlar sunarak ses teknolojileri alanındaki yeteneklerini genişletiyor.
Yorumlar (0)
Düşüncenizi paylaşın — lütfen kibar olun ve konu dışına çıkmayın.
Yorum yapmak için giriş yapın