繁體
  • 简体中文
  • 繁體中文

熱門資訊> 正文

Meta推出實時語音聽寫模型Muse Voice Transcribe

2026-09-02 01:43

Meta(META)超級智能實驗室推出了一種實時語音識別模型,可以區分20多個説話者,用70多種語言訓練,並且可以轉錄持續一個多小時的對話。

Muse Voice Transcribe被描述為Muse Spark系列的自迴歸多模式模型。通過以80毫秒的「塊」轉錄,該軟件可以確定對話何時出現暫停,Meta稱之為「自適應延迟」。該系統可以快速處理更簡單的單詞,而更困難的單詞則獲得更多的音頻上下文。

Muse Voice Transcribe現在可以通過Meta Model API(每小時0.18美元)、Meta AI for Mac和Meta Code提供。

Meta進入轉錄領域之前,OpenAI(OPEN)、Google(GOOG)(GOOGL)、xAI(SPCX)和阿里巴巴(BABA)也推出了類似產品。

風險及免責提示:以上內容僅代表作者的個人立場和觀點,不代表華盛的任何立場,華盛亦無法證實上述內容的真實性、準確性和原創性。投資者在做出任何投資決定前,應結合自身情況,考慮投資產品的風險。必要時,請諮詢專業投資顧問的意見。華盛不提供任何投資建議,對此亦不做任何承諾和保證。