GPT-Live 1 現已於 AI Gateway 上可用
GPT-Live 1 now available on AI Gateway
GPT-Live 1 現已於 Vercel 的 AI Gateway 上可用,支援全雙工語音對話。
- 全雙工功能:同時聽取與說話,消除傳統語音模型的切換延遲。
GPT-Live 1 的全雙工語音功能與客戶端委派可提升對話流暢度與多模型協作。
OpenAI 的 GPT-Live 1 現已在 AI Gateway 上線。
GPT-Live 1 是一個全雙工語音模型,可以同時進行聽取與發言。許多語音模型使用輪流偵測(turn detection)來回應。全雙工則消除了這個界線,因此使用者可以在 GPT-Live 發言時暫停、打斷或補充細節。
GPT-Live 1 同時支援用戶端委派(client delegation)。用戶端委派讓您可以獨立於 GPT-Live 1 之外選擇背景模型。基本的行程僅會執行語音模型。當需要進行更深入的工作時,您的應用程式可以在對話持續進行的同時,使用 AI Gateway 上的任何文字模型來處理 delegation-created。
安裝 AI SDK 7、@ai-sdk/openai 4.0.67 或更新版本,以及 WebSocket 客戶端:
不含委派的簡單範例
這會啟動 openai/gpt-live-1 而不呼叫其他模型。在傳送音訊之前,請等待 session-started。
委派工作並持續對話
您可以呼叫 GPT Live 代理的文字模型,然後將結果回傳至 commentary 通道以供其說話。此範例使用 openai/gpt-5.6-sol,但您可以替換任何 AI Gateway 上可用的文字模型:
您的應用程式可控制委派的工作及其權限、確認與取消。委派模型的請求會透過 AI Gateway 分開計費;語音工作階段的使用量在它們執行期間會持續計算。這些程式碼片段省略了 WebSocket 連線、事件解析、逐字稿組合、音訊串流與關閉程序。如需連線設定、音訊串流與完整範例,請參閱 AI Gateway 文件中的 GPT-Live 指南。若要查看 AI Gateway 上的所有音訊模型,請前往 模型列表。
Source: Vercel Blog · vercel.com