Meta’nın yeni ses modeli konuşmanın ortasında dil değişse bile takip edebiliyor

  • Konuyu Başlatan Konuyu Başlatan Sinan Küstür
  • Başlangıç tarihi Başlangıç tarihi
S

Sinan Küstür

Guest
Meta’nın yeni ses modeli konuşmanın ortasında dil değişse bile takip edebiliyor

Meta, gerçek zamanlı ses işleme alanındaki ilk modeli Muse Voice Transcribe’ı tanıttı. Yeni yapay zekâ modeli, aynı ses kaydı veya görüşme içinde 20’den fazla konuşmacıyı birbirinden ayırabiliyor ve birden fazla dilin kullanıldığı konuşmaları eş zamanlı olarak yazıya aktarabiliyor. Meta’nın verdiği bilgilere göre sistem, konuşmanın ortasında dil değiştirilmesi durumunda da hangi kelimenin hangi dile ait olduğunu belirleyerek transkripsiyonu sürdürebiliyor. Modelin eğitimi 70’ten fazla dili kapsarken, kullanıma sunulduğu aşamada bunların 25’i doğrulanmış durumda. Muse Voice Transcribe şimdilik Meta AI’ın Mac uygulaması üzerinden kullanılabildiği gibi geliştiricilere yönelik araçlarda da yerini alıyor. Meta CEO’su Mark Zuckerberg, Muse Voice Transcribe’ın yeteneklerini gösteren bir örneği X hesabından paylaştı. Zuckerberg’in yaklaşık üç yıllık bir aranın ardından yeniden paylaşım yapmaya başladığı platformdaki videoda modelin birden fazla konuşmacıyı otomatik olarak ayırt ettiği ve konuşma sırasında kullanılan dile göre transkripsiyonu değiştirdiği görülüyor. Bunun yanında sistem, dil biliminde “code-switching” olarak adlandırılan ve aynı cümle içerisinde birden fazla dilden kelimelerin kullanılabildiği konuşma biçimini de işleyebiliyor. Böylelikle özellikle çok dilli toplantılar, röportajlar ve uluslararası ekiplerin görüşmeleri gibi geleneksel otomatik transkripsiyon sistemlerinin zorlanabildiği kullanım senaryolarına odaklanılıyor. Konuşmacı ayrımının otomatik yapılması da uzun kayıtların daha sonra düzenlenmesini kolaylaştırabilecek özelliklerden biri olarak öne çıkıyor. Muse Voice Transcribe 20’den fazla konuşmacıyı ayırt edebiliyor Muse Voice Transcribe’ın çalışma …

Meta’nın yeni ses modeli konuşmanın ortasında dil değişse bile takip edebiliyor haberi ilk önce Teknoblog üzerinde yayımlandı.

Kaynak: https://www.teknoblog.com/meta-muse-voice-transcribe-gercek-zamanli-ses-modeli/
 
Üst