OpenAI 正在全面改版 ChatGPT 的語音模式,導入一個全新的模型,聲稱其對話體驗更像「與真人對話」。這個名為 GPT-Live-1 的新模型旨在減少打斷使用者,並會在您對話中途暫停時,耐心等待您繼續發言。

在一場媒體簡報中,OpenAI 研究主管 Kundan Kumar 稱 GPT-Live-1 是該公司迄今為止「最智慧的語音模型」。當需要推理或網路搜尋時,它會自動將您的查詢傳遞給其最佳的文字模型,例如 GPT-5.5,這使得它能更快地從搜尋您提問的主題,過渡到講述其發現。升級後的模型還會針對天氣、股市和體育等對話,輔以 AI 生成的視覺內容,顯示相關資訊,例如體育賽事比分或本週天氣預報。

過去,ChatGPT 依賴於一個較舊的、回合制的語音模型,該模型不總能產生準確的答案,有時也難以維持自然的對話流暢度。OpenAI 產品主管 Atty Eleti 在簡報中表示:「這是一個全雙工模型。這意味著它可以同時說話和聆聽。從模型的角度來看,它可以連續且同步地處理輸入串流並產生輸出串流。」

這種設定為 ChatGPT 語音模式開啟了新功能,例如即時翻譯。現在,ChatGPT 不再需要等到您停止說話才進行翻譯,而是可以在您說話的同時進行翻譯。您現在還可以要求 ChatGPT 語音停止說話,直到被呼叫為止,OpenAI 表示這在以前是不可能實現的。它還會透過「嗯哼」、「對」或「知道了」等詞語來表示它正在聆聽。

OpenAI 指出,他們已新增內建安全防護措施,引導模型避免產生有害回應,或在「高風險」情況下完全終止聊天。(OpenAI 目前正因一系列訴訟而面臨挑戰,這些訴訟指控 ChatGPT 助長了妄想並損害了使用者的心理健康。)該模型也經過訓練,能在關於自殘的對話中提供「經專家審查的危機求助熱線支援」,並設計為青少年提供「符合年齡」的回應。

GPT-Live-1 正在 iOS、Android 和網頁版上推出。它將為 ChatGPT Voice 的 Go、Plus 和 Pro 訂閱者提供服務,而一個更小、更高效的 GPT-Live-1 mini 模型將成為免費使用者的預設選項。