Xiaomi MiMo-V2.5
Xiaomi MiMo-V2.5

Xiaomi MiMo-V2.5 Ses Teknolojisi ile Yapay Zekada Yeni Dönemi Başlatıyor

Teknoloji Haberleri - Xiaomi, Xiaomi MiMo-V2.5 ses teknolojisi ailesini resmen tanıtarak yapay zeka ajanları döneminde sesli iletişimi yeniden tanımlayacak adımı attı. Şirketin 23-24 Nisan 2026’da duyurduğu bu yeni seri, konuşma sentezinden (TTS) ses tanımaya (ASR) kadar uzanan bütüncül bir yapı sunuyor. Daha bir ay önce MiMo-V2 serisini tanıtan Xiaomi, bu kez işin ses boyutuna odaklanarak geliştiricilere ve son kullanıcılara çok daha doğal bir deneyim vaat ediyor. Xiaomi kurucusu Lei Jun, modellerin yayınlanmasının ardından yaptığı kısa paylaşımda “Gelişmeye devam ediyoruz!” ifadelerini kullandı.

Üç Farklı TTS Modeli: VoiceDesign ve VoiceClone Öne Çıkıyor

MiMo-V2.5-TTS Serisi, üç ayrı modelden oluşuyor ve her biri farklı bir ihtiyaca cevap veriyor. Temel MiMo-V2.5-TTS modeli, konuşma hızı, tonlama, duygu ve vurgu gibi parametreler üzerinde kapsamlı kontrol sağlıyor. Kullanıcılar, tıpkı bir seslendirme yönetmeni gibi doğal dil komutlarıyla (Director Mode) modele istediği tarzı dikte edebiliyor. Model, herhangi bir komut verilmese bile düz metindeki noktalama işaretlerine ve duygusal geçişlere duyarlı bir okuma performansı sergiliyor.

Serinin asıl yıldızları ise VoiceDesign ve VoiceClone. VoiceDesign, herhangi bir referans sese ihtiyaç duymadan, yalnızca metinle tarif ettiğiniz yaş, cinsiyet, aksan veya karakter özelliklerine uygun yepyeni bir ses profili yaratabiliyor. VoiceClone ise 30 saniye gibi kısa bir ses örneğinden hedef konuşmacının sesini yüksek doğrulukla kopyalayabiliyor. Bu modeller, oyun NPC’lerinden sanal asistanlara, sesli kitap prodüksiyonundan içerik üretimine kadar geniş bir alanda kullanılabilecek.

ASR Modeli Açık Kaynak Kodlu Olarak Yayınlandı

Ses girişi tarafında konumlanan MiMo-V2.5-ASR modeli, yayınlandığı an itibarıyla model ağırlıkları ve koduyla birlikte açık kaynak haline getirildi. ASR modeli, arka planda yüksek gürültü olsa bile konuşmayı ayırt edebiliyor. Çince ve İngilizce arasında dil etiketi gerektirmeden otomatik geçiş yapabilmesi, çok dilli ortamlarda büyük kolaylık sağlıyor.

Bununla da kalmıyor; Wu, Kantonca, Minnan ve Sichuan gibi Çince lehçelerini tanıyabiliyor. Çoklu konuşmacının olduğu toplantı kayıtlarında kimin ne söylediğini ayırt ederek noktalama işaretleriyle birlikte kullanıma hazır transkript metinler üretebiliyor. Hatta müzikle karışık vokallerde dahi şarkı sözlerini metne dökebiliyor.

Geliştiriciler İçin Kapılar Açık

Xiaomi, bu yeni modelleri MiMo Studio ve MiMo API platformu üzerinden geliştiricilerin kullanımına sundu. TTS modellerine şimdilik ücretsiz erişim imkanı tanınıyor. ASR modelinin açık kaynaklı olması ise topluluk katkısıyla modelin daha da gelişmesinin önünü açıyor. Şirket, bu hamlesiyle ses teknolojileri alanındaki rekabette agresif bir konum alırken, sunduğu esnek fiyatlandırma planlarıyla da bireysel geliştiriciden kurumsal ölçeğe kadar herkesi hedefliyor. Teknoloji Haberleri - Hedef Bilgi Toplumu

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir


Güncel Haberler
ChatGPT iOS ve Web Sürümüne Yeni Kullanım Kolaylıkları Geldi - 22.08.2026Vivo V70 Lite 4G: 8.100 mAh Bataryalı Yeni Modelin Özellikleri - 22.08.2026Moto G Max Tanıtıldı: 7.000 mAh Batarya Ve Snapdragon 6s Gen 4 - 14.08.2026Xiaomi HyperOS 4 Tanıtıldı: Arayüz, Yapay Zekâ Ve Performans Yenilikleri - 14.08.2026Telefonu Düzenli Olarak Yeniden Başlatmak Neden Önemli? Performans Ve Güvenlik Açısından Bilmeniz Gerekenler - 02.08.2026Hiroşima Atom Bombasının Kalıntılarında Daha Önce Görülmeyen Bir Metalik Alaşım Keşfedildi - 02.08.2026Yapay Zeka Şarkıları İçin Küresel Liste Kuralları Değişebilir - 02.08.2026iPhone Air 2 Hakkında İlk Bilgiler Ortaya Çıktı: Beklenen Beş Büyük Yenilik - 02.08.2026Microsoft 365 Copilot İçin Kritik Word Açığı: Gizli Komutlar Belgeler Arasında Yayılabiliyor - 02.08.2026ChatGPT Health ABD’de Geniş Kapsamlı Kullanıma Açıldı: Sağlık Verileri Artık Yapay Zekâ İle Doğrudan Paylaşılabilecek - 24.07.2026Microsoft MAI-Image-2.5-Pro Ve MAI-Voice-2-Flash Modellerini Duyurdu - 24.07.2026Google Gemini Spark AI Pro Abonelerine Sunuldu: Kişisel Yapay Zeka Ajanı Daha Fazla Kullanıcıyla Buluşuyor - 24.07.2026Xiaomi Temmuz 2026 Güvenlik Güncellemesi 58 Cihaz İçin Yayınlandı: İşte Güncelleme Alan Modeller - 24.07.2026Cisco Antares Yapay Zekâ Modelleri Yazılım Güvenliğinde Maliyet Dengesini Değiştiriyor - 22.07.2026Apple iPhone 18 Pro Üretim Hacmini Artırıyor: Foxconn Fabrikalarında Yoğun Mesai Başladı - 22.07.2026Cilde Boya Gibi Uygulanan Yeni Elektrot Teknolojisi Biyometrik Takibi Değiştirebilir - 21.07.2026Hooma Magpulse Slim Manyetik Powerbank Serisi Türkiye’de Satışa Sunuldu - 21.07.2026Apple Live Notes İle Genius Bar Görüşmelerini Yapay Zekâ Destekli Notlara Dönüştürüyor - 21.07.2026Windows 11 İle Linux Karşılaştırması Şaşırttı: Aynı Donanımda Kazanan İş Yüküne Göre Değişti - 21.07.2026Google Chrome Find And Fill With Gemini Özelliği Form Doldurma Deneyimini Değiştiriyor - 21.07.2026

Teknoloji Gündemi

ChatGPT iOS ve Web Sürümüne Yeni Kullanım Kolaylıkları Geldi

ChatGPT iOS ve web sürümü, fotoğraf ekleme, zaman bilgisi ve uzun sohbetlere erişim tarafında kullanım akışını hızlandırmayı hedefleyen yeni iyileştirmeler aldı. Güncellemeler, mobilde dosya paylaşımını daha kısa bir harekete indirirken web tarafında uzun konuşmalarla çalışan...

Vivo V70 Lite 4G: 8.100 mAh Bataryalı Yeni Modelin Özellikleri

Vivo V70 Lite 4G, 8.100 mAh kapasiteli bataryası ve günlük kullanıma odaklanan donanımıyla duyuruldu. Modelin öne çıkan tarafı, giriş segmentinde alışılmışın üzerinde bir pil kapasitesini 44W hızlı şarj desteğiyle bir araya getirmesi. Vivo’nun yeni 4G...

Xiaomi HyperOS 4 Tanıtıldı: Arayüz, Yapay Zekâ Ve Performans Yenilikleri

Xiaomi HyperOS 4, yenilenen cam efektli arayüzü, yapay zekâ yetenekleri, geliştirilmiş animasyonları ve cihazlar arası bağlantı özellikleriyle tanıtıldı. Xiaomi HyperOS 4, şirketin Çin'de kullanıma sunduğu yeni nesil sistem yazılımı olarak arayüzden animasyonlara, yapay zekâdan cihazlar...

Microsoft MAI-Image-2.5-Pro Ve MAI-Voice-2-Flash Modellerini Duyurdu

Microsoft MAI-Image-2.5-Pro ile görsel üretim ve düzenleme alanında yeni nesil yapay zekâ yeteneklerini kullanıma açtı. Şirket ayrıca daha düşük maliyet ve yüksek hız sunan MAI-Voice-2-Flash modelinin teknik ayrıntılarını da paylaştı. Microsoft MAI-Image-2.5-Pro, şirketin bugüne kadar...

Takip Et