OpenAI, Sadece 1 Saniyelik Ses Kaydıyla İnsan Sesini Tonlama Ve Duygu Kaybı Olmadan 40 Dile Çeviren Modeli Yayınladı

Yapay zeka araştırma kuruluşu OpenAI, ses sentezleme ve canlı çeviri teknolojisinde yeni bir devrim başlatan 'Voice Engine 2.0' modelini duyurdu. Yeni model, kullanıcının sadece 1 saniyelik konuşma örneğini analiz ederek onun kendi sesi, vurgusu ve duygusal tonlamasıyla 40 farklı dilde anında akıcı konuşma üretebiliyor.

Filmler Ve Oyunlar İçin Otomatik Seslendirme Devrimi

Voice Engine 2.0'ın özellikle sinema dublajı, mobil oyun seslendirmeleri ve uluslararası konferanslarda eş zamanlı çeviride %98 doğruluk sunduğu belirtildi. OpenAI Ürün Yöneticisi Jeff Harris, 'Voice Engine 2.0 ile dil bariyerlerini tamamen kaldırıyoruz; bir konuşmacı Türkçe konuşurken dinleyici onu Japonca veya İspanyolca olarak tam kendi doğal sesiyle duyabiliyor' açıklamasını yaptı.

Filigran Ve Güvenlik Önlemleri

Kötüye kullanımı ve ses taklit dolandırıcılıklarını önlemek amacıyla üretilen tüm ses dosyalarına insan kulağının duyamayacağı 'C2PA dijital filigran' eklendiği duyuruldu. Ses Teknolojileri Uzmanı Selim Arslan, 'Gecikmenin 80 milisaniyeye düşmesi, canlı telefon görüşmelerinde bile anlık çok dilli iletişimi mümkün kılacaktır' dedi.