OpenAI推出可同時聆聽與說話的「全雙工」語音對話API「GPT-Live-1」,讓即時語音助理的互動方式更接近真人對話。
根據PANews的報導,於11日OpenAI已將GPT-Live-1導入API服務。這款新模型針對使用者中途插話、說話時的停頓、環境背景噪音以及長時間對話進行優化,同時也支援電話應用程式等傳統通話環境,讓語音助理在各種場景下都能更自然地應對。
PANews報導指出,OpenAI表示GPT-Live-1在全雙工基準測試中的表現,比前代模型「GPT Realtime 2.1」高出30個百分點。報導並提到,語言學習平台Speak在初期測試中發現,相較於過去採用「輪流說話」機制的舊型語音系統,新模型將「把學習者思考停頓誤判為說話結束」的情況減少了約80%,有助於讓語音互動更貼近真實對話節奏。
留言 0