OpenAI發布了GPT Transcribe和GPT Live Transcribe兩款語音轉文字模型。GPT Transcribe用於處理錄音檔案和批量任務,GPT Live Transcribe則適用於直播字幕和電話等即時場景。這兩款模型能夠結合錄音主題、關鍵詞和語言提示,提升短句、數字、專業術語、多口音和嘈雜環境下的識別效果。根據Artificial Analysis的測評,GPT Transcribe的詞錯誤率為3.31%,比上一代GPT-4o Transcribe低0.7個百分點。新模型的價格也降低了25%,每1000分鐘音頻收費4.5美元。
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。

















