BTCC / BTCC Square / Abmedia /
字節跳動推 SeedRealtime 音視全雙工模型,豆包 App 上線

字節跳動推 SeedRealtime 音視全雙工模型,豆包 App 上線

Abmedia
Author:
Abmedia
發佈時間:
2026-08-06 10:29:36
0

即時多模態互動又往前一步。根據 TechNode 報導,字節跳動推出原生音視訊全雙工模型 SeedRealtime,能同時處理音訊、影像與文字串流,一邊看、一邊聽、一邊回應。這款模型已在字節跳動的豆包(Doubao)App 上線,從研究展示走向消費者產品,並被視為對標 OpenAI 的 GPT Live。

全雙工:不必等你說完就能開口回應

SeedRealtime 是原生的音視訊全雙工大型語言模型,能同時理解聲音、畫面與時間資訊,辨識互動對象與使用者意圖。所謂全雙工,指的是模型不必等使用者說完才回應,而是能在持續接收影音串流的同時開口,帶來接近真人對話的即時體驗。

從研究走向豆包 App

字節跳動已將 SeedRealtime 部署到旗下的豆包 App,讓一般使用者能舉起手機、開著鏡頭與它對話。這是字節跳動在即時多模態 AI 互動上的最新進展,也讓它在「看得到、聽得到、能對話」的語音助理賽道,與 OpenAI 等對手正面交鋒。

本站轉載文章皆來自公開網絡,部分由AI整理,僅為傳遞產業訊息,不代表BTCC立場。原創權益歸原作者所有。如發現版權問題,請透過[email protected]聯絡我們,我們將依法處理。 BTCC不對資訊準確性、時效性及完整性作任何保證,不承擔因依賴資訊而產生的任何責任。內容僅供參考,不構成投資、法律或商業建議。