Farklı Dilleri Aynı Tını ve Duygu Tonuyla Konuşabilen Yeni Yapay Zeka Duyuruldu

Google Research laboratuvarı, ses mühendisliği ve yapay zeka alanında yeni bir eşik olan ses dönüştürme ve anlık çeviri modeli "AudioAI"ı tanıttı. Model, sadece 5 saniyelik bir ses örneğini analiz ederek konuşmacının kendine has ses rengini, tınısını ve hatta duygu durumunu koruyarak 42 farklı dile sesli çeviri gerçekleştirebiliyor.

Tını ve Vurgu Analizinde Sıfır Hata Payı

Geleneksel metin okuma ve robotik seslendirme sistemlerinin aksine, AudioAI konuşmacının nefes alma aralıklarını ve tonlamalarını da taklit edebiliyor. Google Yapay Zeka Ekip Lideri Dr. Amanda Ross, "Geliştirdiğimiz nöral tını transferi algoritması, diller arasındaki fonetik farklılıkları saniyeler içinde çözümlüyor; bu da global video ve ses içeriklerinin çevirisindeki doğallığı %75 oranında artırıyor" şeklinde konuştu. Sistemin küresel bulut altyapılarında eş zamanlı olarak hizmete açıldığı bildirildi.

Türkçe Dil Seçeneği ve Yerel Dublaj Sektörüne Etkisi

Modelin Türkçe ses kalitesi de yapılan testlerde yüksek puan almayı başardı. Seslendirme ve Dublaj Sanatçıları Derneği Danışmanı Turgut Şener, "AudioAI gibi teknolojiler, başlangıçta dublaj sektörü için tehdit gibi görünse de uzun vadede dijital içeriklerin küreselleşmesini kolaylaştırarak yerel yapımların dünyaya açılma sürelerini %50 kısaltacaktır" değerlendirmesini yaptı. Google, modeli içerik üreticileri için API formatında kullanıma sunacağını açıkladı.