Skip to content
OpenAI 在 ChatGPT 推出 GPT-Live 支援即時語音對話 episode artwork

EPISODE · Jul 8, 2026 · 2 MIN

OpenAI 在 ChatGPT 推出 GPT-Live 支援即時語音對話

from EasyVibeCoding Podcast · host Sam Altman

OpenAI 在 ChatGPT 推出 GPT-Live 支援即時語音對話。 影片展示了 ChatGPT 應用程式中 GPT-Live 的語音互動介面。 核心功能與架構 Sam Altman 指出,GPT-Live 的推出讓與 AI 的對話變得極具真實感與「魔法」,甚至讓他改變了以往偏好打字勝過語音的習慣。該模型採用了「全雙工」(full-duplex)架構,這項技術變革帶來了以下關鍵提升: 同步聽說:模型不再需要等待使用者說完話才能回應,能同時聆聽與發聲,並能流暢地處理對話中的「嗯哼」、「對」等語氣詞,甚至在使用者思考時保持安靜。 即時互動與翻譯:透過持續性的互動決策,模型能每秒多次判斷是否該發言、暫停或中斷,並支援即時翻譯功能。 這支影片展示了 ChatGPT 的 GPT-Live 語音功能,透過自然對話與即時翻譯,讓使用者能更流暢地與 AI 互動。 智慧委派機制:當對話涉及網頁搜尋、深度推理或複雜任務時,GPT-Live 會在背景自動呼叫最新的前沿模型(發布初期為 GPT-5.5)處理,並在完成後將結果帶回對話中,確保對話流程不中斷。 使用體驗與部署 GPT-Live 提供更具備「人格特質」的對話體驗,並針對語音場景強化了安全性與實用性: 視覺輔助:在對話過程中,ChatGPT 能根據話題(如天氣、股市、賽事)即時呈現豐富的視覺卡片,讓資訊一目了然。 這段影片展示了如何透過 ChatGPT 的語音功能,快速查詢天氣資訊、賽事賽程以及在地推薦。 情境感知:模型具備更好的時間感知與背景雜訊過濾能力,能專注於使用者的聲音,並根據對話情境調整語氣。 三位技術人員示範如何透過語音與 AI 模型即時對話,並展示其對時間與情境的感知能力。 部署範圍:該功能即日起陸續向全球 ChatGPT 使用者開放,支援 iOS、Android 及網頁版,未來也將整合至 API。 版本區分:Plus 與 Pro 使用者將預設使用 GPT-Live-1,免費版使用者則預設使用 GPT-Live-1 mini。 技術背景與安全性 OpenAI 在官方文件中說明,GPT-Live 解決了過往「級聯式語音系統」(Cascaded voice systems)因模型串接導致的延遲與資訊流失,以及「基於輪次」(Turn-based)模型因靜音檢測導致的僵硬中斷問題。 三位技術人員透過對話展示並討論 ChatGPT 的語音互動能力。 為了確保安全性,OpenAI 針對語音特性做了專門的紅隊測試(Red-teaming)與合成評估,涵蓋自我傷害、情緒依賴及暴力內容等風險,並內建了能即時偵測不安全輸出的防護機制,若系統偵測到高風險情境,會主動引導至安全資源或終止對話。 三名技術人員在沙發上演示 ChatGPT 的即時語音翻譯與對話功能。 這支影片展示了 ChatGPT 的 GPT-Live 語音功能,透過自然對話與即時翻譯,讓使用者能更流暢地與 AI 互動。 影片中的 Prompt 與操作: 操作步驟: 1. (00:00)點擊手機上的語音功能進行對話 2. (00:16)點擊手機螢幕啟動語音互動 3. (00:34)點擊手機螢幕進行語音詢問 4. (01:48)點擊手機螢幕進行語音詢問 5. (02:09)點擊手機螢幕進行語音詢問 6. (02:37)點擊手機螢幕進行語音詢問 7. (03:32)點擊手機螢幕進行語音詢問 8. 點擊手機螢幕啟動即時翻譯功能 9. 點擊手機螢幕進行語音詢問 三名技術人員在沙發上演示 ChatGPT 的即時語音翻譯與對話功能。 影片中的 Prompt 與操作: Prompt(00:11): GPT-Live-1 Prompt(00:13): 聆聽與說話 原文:Listening & Speaking Prompt(00:16): Yuchen Zhang Prompt(00:16): Alyssa Huang Prompt(00:16): Justin Uberti Prompt(00:16): 技術人員成員 原文:Members of Technical Staff 操作步驟: 1. (00:11)畫面顯示標題「GPT-Live-1」 2. (00:13)畫面顯示標題「Listening & Speaking」 3. (00:16)畫面標示三位參與者的姓名與職稱「Members of Technical Staff」 4. (00:51)參與者展示使用手機與該模型進行即時語音翻譯互動 5. (02:19)參與者透過手機 UI 介面查看該模型對對話內容的總結 三位技術人員示範如何透過語音與 AI 模型即時對話,並展示其對時間與情境的感知能力。 影片中的 Prompt 與操作: 操作步驟: 1. (00:51)參與者拿起手機與 AI 進行語音對話 2. (01:45)參與者使用手沖壺進行注水操作 3. 參與者將咖啡倒入杯中 三位技術人員透過對話展示並討論 ChatGPT 的語音互動能力。 影片中的 Prompt 與操作: 操作步驟: 1. (00:00)影片開場,三名人員在室內沙發上進行對話。 2. (00:07)三人走在戶外步道上。 3. (00:09)三人坐在戶外長椅上,其中一人使用手機與 AI 進行語音對話。 4. 三人回到室內沙發區繼續討論。 5. 其中一人對著手機詢問 AI 關於拍攝行銷影片的建議。 這段影片展示了如何透過 ChatGPT 的語音功能,快速查詢天氣資訊、賽事賽程以及在地推薦。 影片中的 Prompt 與操作: Prompt(00:00): 詢問 ChatGPT 原文:Ask ChatGPT 操作步驟: 1. (00:00)點擊輸入框並開始語音對話 2. (00:08)畫面自動顯示墨西哥市天氣預報圖表 3. (00:24)畫面自動顯示墨西哥隊小組賽賽程表 4. (00:44)畫面自動顯示墨西哥市地圖與推薦觀賽地點 影片展示了 ChatGPT 應用程式中 GPT-Live 的語音互動介面。 影片中的 Prompt 與操作: 操作步驟: 1. (00:00)點擊語音輸入圖示 2. (00:01)進入語音互動模式,畫面中央出現動態波紋 原文:https://easyvibecoding.app/curated/2415-openai-launches-gpt-live-in-chatgpt

Episode metadata supplied by the publisher feed · Published Jul 8, 2026

Embed this episode

Ready to play

OpenAI 在 ChatGPT 推出 GPT-Live 支援即時語音對話

0:00 2:50

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of EasyVibeCoding Podcast?

This episode is 2 minutes long.

When was this EasyVibeCoding Podcast episode published?

This episode was published on July 8, 2026.

Can I download this EasyVibeCoding Podcast episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!