字節跳動(ByteDance)將同時處理語音、影像和文本的雙向AI模型SeedRealtime應用於抖包(Doubao)應用中。AI研究組織Seed於10日公開了SeedRealtime。該模型將音頻、視頻和文本整合為端到端結構,並能夠並行處理識別、理解、判斷和表達。SeedRealtime支持在用戶說話結束之前進行輸入,並在接收輸入的同時判斷對話流,內部包含對話輪次轉換功能,取代了外部語音活動檢測器(VAD)。根據字節跳動的內部評估,對話節奏問題比起現有的級聯結構減少了一半。這一模型是4月公開的雙向語音模型Seeduplex功能的影像擴展,Seeduplex在複雜噪音環境中將誤應答率和誤中斷率降低了一半。用戶猶豫時AI先插話的比例減少了40%,而對話流暢性指標提高了12%。然而,這次發布與加密貨幣和區塊鏈市場的直接聯繫尚未確認。字節跳動公開的內容中並未包含代幣發行或區塊鏈網絡連接計劃。
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。



























![[專文] NYSE "開發代幣證券的鏈上支付平台"](/public-static/16_c530d6305c.png?format=avif)

