位元組跳動發布音影片全雙工大模型SeedRealtime
0
PANews 8月5日消息,根據財聯社報道,位元組跳動正式推出原生音視頻全雙工大模型SeedRealtime。 SeedRealtime以統一架構原生融合音訊、視訊與文本,能在連續的多模態資訊流上即時交互,帶來「邊看、邊聽、邊說」的全新體驗。 端對端人工評測結果顯示,相比級聯模型,SeedRealtime的音視頻對話節奏問題減少了一半——模型對說話時機的把握更加自然,“話未說完被搶斷、話音已落卻回應遲緩、或是被背景雜音與閒聊誤觸發”卡殼現象顯著減少;同時,單次交流概率也有明顯地提升對話的概率也有明顯提升。 目前,SeedRealtime已在豆包App全量上架。
來源:
登入回覆
登入分享您的看法評論
相關文章