Meta, Çok Konuşmacılı ve Çok Dilli Ses Modeli Muse Voice Transcribe'ı Duyurdu
Meta Superintelligence Labs, konuşmaları metne dönüştüren ve konuşmacıları ayırt edebilen gerçek zamanlı ses algılama modeli Muse Voice Transcribe'ı tanıttı. Sistem, bir saati aşan kayıtları, 20'den fazla konuşmacıyı ve cümle ortasındaki dil değişikliklerini ek bir işleme gerek duymadan işleyebiliyor. Model 70'ten fazla dille eğitilirken bunlardan 25'i kapsamlı bir şekilde doğrulandı.
WWebrazzi
Bu özet makine üretimidir; haberin aslı ve tüm ayrıntılar kaynağın kendi sayfasındadır.
Haberin tamamını oku