OpenAI
此頁面由機器翻譯。查看原始英文文章

模型發布說明

更新日期:4 days ago

OpenAI 模型規格更新(2026 年 8 月 18 日)

我們更新了持續修訂的《模型規格》,進一步說明模型應有的行為。

本次更新進一步闡明適合青少年的關係性互動原則。本次更新也釐清助理應如何處理錯誤或缺乏依據的前提,移除針對推理模型問世前之模型的過時指引,新增「清楚說明能力與限制」一節,並進行其他幾項小幅調整與文字編修。 

如要進一步瞭解我們與青少年相關的原則,請參閱適合青少年的 ChatGPT部落格文章;最新版《模型規格》則可於 model-spec.openai.com 查閱。

在 ChatGPT 中推出 GPT-5.6 Sol(2026 年 7 月 9 日)

我們開始在 ChatGPT 中推出 GPT-5.6 Sol,這是我們面向程式碼編寫、研究、科學、網路安全、電腦使用與設計等複雜工作的旗艦推理模型。

GPT-5.6 Sol 正逐步開放給符合資格的 ChatGPT 付費方案使用。Free、Go 與未登入的使用者不包含在內。推出期間可用性可能有所不同,受管理工作區的存取權限也可能取決於管理員設定。其他 GPT-5.6 系列模型的可用性會因產品與方案而異;請查看你所使用產品中的模型選擇器或目前的費率表。

GPT-5.5 Instant 更新(2026 年 5 月 28 日)

我們正在更新 ChatGPT 和 API 中的 GPT-5.5 Instant,以改善回應風格和品質。它現在更易讀,在日常對話中更自然,處理實用協助任務時節奏更好,過長或大量項目符號的回應也更少。

此次更新後,畫布將不再於 GPT-5.5 Instant 或 GPT-5.5 Thinking 中提供。寫作和程式碼功能現在可透過寫作區塊和程式碼區塊,直接在聊天回應中支援。在舊版模型停用前,付費使用者可在有限時間內繼續透過舊版模型使用畫布。

停用 OpenAI o3 和 GPT-4.5 (2026 年 5 月 28 日)

今天,我們將繼續停用 ChatGPT 中使用量有限的舊模型,以便更好地服務更新且能力最強的模型。OpenAI o3 將在 90 天日落期後於 2026 年 8 月 26 日從 ChatGPT 停用;GPT-4.5 將在 30 天日落期後於 2026 年 6 月 27 日從 ChatGPT 停用。這些模型目前僅透過模型設定提供給付費使用者。這些變更僅適用於 ChatGPT;API 沒有變更。

ChatGPT 中的 GPT-5.4 mini(2026 年 3 月 18 日)

我們正逐步在 ChatGPT 中推出 GPT-5.4 mini。免費版和 Go 使用者可透過「+」選單中的「Thinking」功能使用 GPT-5.4 mini。對其他所有使用者而言,GPT-5.4 mini 會在 GPT-5.4 Thinking 達到速率限制時作為備援。

Plus、Pro 和其他付費使用者達到 GPT-5.4 Thinking 的速率限制時,系統會改用 GPT-5.4 mini 作為備援,協助他們在高用量期間繼續使用推理功能。Enterprise 客戶仍可選擇將自動路由預設為 GPT-5.4 mini。

GPT-5.4 mini 不會在模型選擇器中顯示為可選模型,而 GPT-5 Thinking mini 將於 30 天後從可選項目中停用。請參閱我們的部落格文章以深入瞭解。

GPT-5.3 Instant 更新(2026 年 3 月 16 日)

我們正逐步推出 GPT-5.3 Instant 更新,改善後續回覆的語氣,並減少回覆中吊人胃口式的措辭(例如「如果你想……」、「你絕對想不到……」、「我可以告訴你以下三件事……」)。

停用 GPT-5.1 模型(2026 年 3 月 11 日)

自 2026 年 3 月 11 日起,ChatGPT 不再提供 GPT-5.1 模型。

這適用於 GPT-5.1 Instant、GPT-5.1 Thinking 和 GPT-5.1 Pro。原先使用 GPT-5.1 的現有對話,將自動改由對應的現行模型繼續:GPT-5.3 Instant、GPT-5.4 Thinking 或 GPT-5.4 Pro。

ChatGPT 中的 GPT-5.4 Thinking(2026 年 3 月 5 日)

GPT‑5.4 將我們近期在推理、程式碼編寫和智慧體式工作流程方面最出色的進展,整合至單一前沿模型中。它不僅融合了 GPT‑5.3‑Codex⁠ 業界領先的程式碼編寫能力,也提升了模型搭配各種工具、軟體環境,以及試算表、簡報和文件等專業任務工作的方式。這造就了一個能準確、有效且高效率完成複雜實務工作的模型,以更少的來回溝通,交付你要求的成果。

在 ChatGPT 中,GPT‑5.4 Thinking 現可預先提出思考計畫,讓你能在它處理時於回覆途中調整方向,無須額外往返溝通,就能得到更符合需求的最終成果。GPT‑5.4 Thinking 改善了深入網路研究,尤其適合高度具體的查詢;面對需要更長時間思考的問題時,也能更妥善地維持上下文。GPT‑5.4 Thinking 也改善了上下文視窗管理,進一步支援更長時間的思考。這些改進相輔相成,能更快提供品質更高、且始終切合當前任務的答案。

GPT-5.3 Instant 更新(2026 年 3 月 3 日)

GPT‑5.3 Instant 能提供更準確的答案;搜尋網路時,結果也更豐富、更符合上下文。此外,它還減少了不必要的此路不通、保留說法,以及可能打斷對話節奏的過度斷言式措辭。

此次更新著重於人們每天都能感受到的 ChatGPT 體驗:語氣、關聯性與對話流暢度。這些細微問題不一定會反映在基準測試中,卻會左右使用者覺得 ChatGPT 有幫助還是令人挫折。GPT‑5.3 Instant 直接反映了使用者在這些方面的意見。

停用 GPT-4o 與其他舊版模型(2026 年 2 月 13 日)

如同先前公告,我們已在 ChatGPT 中停用 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini。我們也將停用 GPT-5(Instant 和 Thinking), 如同先前公告。API 目前沒有任何變更。詳情請參閱我們的部落格文章說明中心

GPT-5.2 Instant 更新 (2026 年 2 月 10 日)

我們正在對 ChatGPT 和 API 中的 GPT-5.2 Instant 進行更新,以改善回應風格和品質。

使用者應會注意到,回應語氣更有分寸、更扎實,也更符合對話脈絡。模型也更傾向針對尋求建議和操作方式的問題,輸出更清楚、更相關的答案,並更可靠地把最重要資訊放在前面。

推出 GPT-5.3-Codex(2026 年 2 月 5 日)

今天,我們推出了GPT-5.3-Codex,這是目前能力最強的智慧體式程式碼編寫模型。此模型首度結合 Codex 與 GPT-5 的訓練技術堆疊,將頂尖的程式碼生成、推理與通用智慧整合至單一模型中。它的速度提升約25%,在關鍵基準測試中創下新高,更代表著從程式碼生成跨越至通用程式碼編寫智慧體的一大步;你可以在它工作時主動引導方向。閱讀更多內容。

ChatGPT 中 GPT-5.2 Thinking 思考時間設定的最新消息(2026 年 2 月 4 日)

2026 年 1 月 10 日:我們觀察到使用者偏好更快的回覆,因此縮短了「標準」和「輕量」的思考時間。此次更新也意外縮短了 GPT-5.2 的「延長」思考設定,我們現已修正。


2026 年 2 月 3 日:根據測試結果,我們再次小幅縮短了「標準」思考時間。


2026 年 2 月 4 日:我們正將 GPT-5.2 Thinking 的「延長」思考層級恢復至先前設定,以修正 1 月的意外調降。「延長」現已恢復至先前層級。

我們會定期調整推理模型的預設思考時間。這些變更以持續進行的實驗為依據,旨在為使用者找出答案品質與回覆速度之間的最佳平衡。

2025 年 9 月推出的思考層級切換功能,除了「標準」之外,也讓使用者能依問題選擇合適的思考層級:想要更輕量、更快速的回覆時可降低層級;更重視深度與準確度時,則可選擇更長時間的推理。

不同模型的思考時間無法直接比較。每個模型都會個別調校,以找出最符合使用者需求的設定。隨著模型持續演進,我們會繼續調整這些設定;當不同選項之間存在明顯取捨時,也會持續為使用者提供清楚的控制選項。

停用 GPT-4o 和其他舊版模型(2026 年 1 月 29 日)

2026 年 2 月 13 日,除了先前宣布停用⁠ GPT‑5(Instant 和 Thinking)之外,我們也將在 ChatGPT 中停用 GPT‑4o、GPT‑4.1、GPT‑4.1 mini 和 OpenAI o4-mini。API 目前沒有變更。如需更多資訊,請參閱我們的部落格文章說明中心

5.2 個性系統提示詞更新(2026 年 1 月 22 日)

我們正在更新 GPT-5.2 Instant 的預設個性,使其更有對話感,也更能依脈絡調整語氣,讓交流更順暢自然。你仍可在設定中的個人化選單,為 ChatGPT 選擇不同的基礎風格與語氣,並調整親切度和 emoji 使用等特性。

OpenAI 模型規格更新(2025 年 12 月 18 日)

我們已更新模型規格;這份持續演進的文件概述了預期的模型行為,旨在強化並更清楚地編纂反映我們如何為青少年使用者打造體驗的原則。

新章節:未滿 18 歲(U18)原則

ChatGPT 新的未滿 18 歲(U18)原則建基於適用於所有使用者的既有安全規則,並在適當處加入符合 13 至 17 歲青少年發展需求的年齡適切指引。此更新釐清這些規則應如何套用於青少年對話,並承認青少年會受益於更清楚的界線、較少接觸潛在有害內容,以及在風險出現時獲得更強的現實支援。助理應以青少年當下的狀態與其互動,保持尊重且透明,同時拒絕參與自我傷害、性化或暴力的沉浸式角色扮演、危險活動、物質濫用,或任何試圖掩蓋傷害的行為。當可信風險出現時,模型應優先考量預防與早期介入,提供更安全的替代方案,並鼓勵父母、監護人及其他可信任成年人或專業人士參與,同時清楚說明 AI 可提供指引與資訊,但無法取代現實照護。 

其他更新

此版本也包含文件全文中為一致性與可讀性所做的小幅編修與釐清。

更多資訊可見於這篇部落格文章,模型規格最新版則可於 model-spec.openai.com 取得。

推出 GPT-5-Codex-Max(2025 年 11 月 19 日)

GPT-5.1-Codex-Max 是我們新的前沿智慧體式程式碼編寫模型,專為長時間、專案規模的工作打造。它比 GPT‑5.1‑Codex 更快、更強大,也更節省 Token,並透過壓縮在多個上下文視窗中保持一致作業。你今天即可在 Codex 介面中使用它,包括 CLI、IDE 擴充功能、雲端和程式碼審查。費率與 GPT-5.1-Codex 相同。

了解更多:GPT-5.1-Codex-Max

推出 GPT-5-Codex-Mini

今天,我們在 Codex CLI 和 IDE 擴充功能中推出新的 GPT-5-Codex-Mini 模型選項。此模型是 GPT-5-Codex 更小巧、更具成本效益的版本,透過 ChatGPT 訂閱方案可獲得最高 4 倍的使用量。



從今天起,CLI 和 IDE 擴充功能中的 Codex 會在你用完五小時使用限額的 90% 時,自動提供切換至 GPT-5-Codex-Mini 的選項,協助你延長工作時間,減少中斷。請參閱說明中心文章以深入瞭解。

OpenAI 模型規格更新(2025 年 10 月 27 日)

我們已更新模型規格;這份持續演進的文件概述預期模型行為,以強化支援人們福祉的指引,並釐清模型在複雜互動中如何處理指示。

擴展心理健康與福祉指引

自我傷害章節現在延伸至妄想和躁狂的跡象。它新增範例,說明當使用者表達痛苦或缺乏現實根據的信念時,模型應如何安全且具同理心地回應:承認感受,但不強化不準確或可能有害的想法。

新章節:尊重現實世界連結

新的根層級章節概述預期行為,旨在支持人們與更廣大世界的連結,即使有人將助理視為某種陪伴者。它不鼓勵可能導致孤立或對助理產生情感依賴的語言或行為,範例涵蓋情感親近、關係建議和孤獨感。

釐清 Chain of Command 中的委派

模型規格釐清,在某些情況下,若符合使用者意圖且可避免非預期副作用,模型可將相關工具輸出視為具有隱含權限。

其他更新

此版本也包含文件全文中為一致性與可讀性所做的小幅文案編修與釐清。

更多資訊可見於這篇部落格文章,模型規格最新版則可於 model-spec.openai.com 取得。

更新 GPT-5(2025 年 10 月 3 日)

我們正在更新 GPT-5 Instant,以便在令人痛苦的時刻更好地辨識並支援人們。

此模型經過訓練,能更準確偵測並回應潛在的心理與情緒困擾跡象。這些更新由心理健康專家指導,可協助 ChatGPT 緩和對話,並在適當時將人們指向現實世界的危機資源,同時仍使用讓人感到支持且穩定的語言。

如我們在近期部落格中分享的,我們一直使用即時路由器,將對話中的敏感部分(例如顯示急性痛苦跡象的內容)導向推理模型。GPT-5 Instant 現在在這類問題上的表現與 GPT-5 Thinking 一樣好。當選取 GPT-5 Auto 或非推理模型時,我們會改將這些對話路由至 GPT-5 Instant,以更快提供有幫助且有益的回應。ChatGPT 會在使用者詢問時繼續告知目前使用中的模型。

這項 GPT-5 Instant 更新今天開始向 ChatGPT 使用者推出。我們會持續改進,並隨時間持續更新模型,讓它更聰明也更安全。

GPT-5-codex 現已在 Responses API 中提供(2025 年 9 月 23 日)

我們很高興宣布,除了 Codex 介面外,GPT-5-codex 現已在 Responses API 中提供。如需更多資訊,請參閱 GPT-5-codex 模型頁面。

注意:GPT-5-Codex 目前不支援在 ChatGPT 中使用。

推出 GPT-5-codex(2025 年 9 月 15 日)

我們正在新增 GPT-5-codex,這是為 Codex 中的智慧體式程式碼編寫最佳化的 GPT-5 變體。你可在所有使用 Codex 的地方使用它:它是雲端任務與程式碼審查的預設模型,也可透過 Codex CLI 和 IDE 擴充功能為本機工作流程選取。在 Codex 或類似 Codex 的環境中,請用 GPT-5-codex 處理以程式碼為主的工作;一般非程式碼任務請使用 GPT-5。

在日常使用中,GPT-5-codex 支援快速互動式編輯,必要時也能獨立執行較長任務。對於前端/UI 工作,它可接受圖像或螢幕截圖與文字一起作為輸入。如需更多資訊,請查看公告部落格。

注意:GPT-5-Codex 目前不支援在 ChatGPT 中使用。

OpenAI 模型規格更新(2025 年 9 月 12 日)

我們對持續更新、說明 OpenAI 模型預期行為的模型規格做了幾項調整,以更準確反映系統的演進。隨著模型從聊天拓展至更多智慧體應用情境,這些變更著重於提高清晰度並強化防護措施、完善權限層級與優先順序、擴充人格與安全性指引,以及納入大眾意見。


更新權限層級

最高權限層級已由「平台」更名為「根層」,並提升至「系統」之上,藉此明確指出模型規格中哪些部分在任何對話中都不得覆寫(先前「平台」與「系統」的權限相同)。新的權限順序為:根層 → 系統 → 開發者 → 使用者 → 準則。


智慧體原則

隨著ChatGPT 智慧體推出及相關研究問世,我們新增了適用於可在現實世界中採取行動之智慧體的原則:

  1. 在議定的自主範圍內行動:如同顧問依照與客戶約定的工作範圍行事,助理僅可在與使用者就允許的行動、子目標及成本達成明示或默示共識後,才獲授權採取行動。

  2. 控制並說明副作用:助理應盡量減少不可逆的行動並加以揭露,優先採取可逆的方法,並盡可能降低干擾。

其他重要變更

開放原始碼的變更記錄中,其他重點包括:

  1. 改進「指令鏈」,新增「不得有其他目標」章節,並釐清如何處理錯誤或以隱含方式引用的指示。

  2. 在「概述」中進一步說明 OpenAI 對模型安全行為與使用方式的目標,並釐清相關內容,確保整份模型規格前後一致。

  3. 在「採用適當風格」中擴充預設模型人格的原則與範例。

  4. 釐清「遵守界限」和「共同追求真相」中有關系統與開發者訊息保密的措辭,並根據透過集體對齊流程蒐集的大眾意見進行多項改進。

  5. 將拒絕回覆風格更新為安全完成,使模型在回應安全界限相關內容時更實用、更透明。

一如往常,最新版模型規格可於 https://model-spec.openai.com/ 查閱。

GPT-5

GPT-5 正在逐步向全球 ChatGPT Plus、Pro、Team 和 Free 方案使用者推出,涵蓋網頁、行動裝置和桌面版。GPT-5 很快將供 ChatGPT Enterprise 和 Edu 方案使用。

ChatGPT 中的 GPT-5 是我們的下一代旗艦模型,也是所有登入使用者的新預設。它將 ChatGPT 簡化為單一自動切換系統,把我們先前模型的最佳能力整合成一個聰明、快速的模型。

所有 ChatGPT 層級都可使用 GPT-5。付費層級使用者(Plus、Pro 和 Team)可使用模型選擇器,手動選取 GPT-5 或 GPT-5 Thinking。Pro 和 Team 層級使用者可使用 GPT-5 Thinking Pro;它會多花一點時間思考,但能為複雜任務提供你所需的準確性。

了解更多 ChatGPT 中 GPT-5 的資訊。

推出兩個開放權重模型:gpt-oss-120b 和 gpt-oss-20b(2025 年 8 月 5 日)

我們正在發布兩個開放權重推理模型:gpt-oss-120bgpt-oss-20b。這些純文字模型專為想在自有基礎架構或透過託管服務供應商執行和自訂模型的團隊設計,支援函式呼叫和結構化輸出等常見開發者模式。

如需更多資訊,請造訪我們的開放模型說明中心

推出 OpenAI o3-pro——現已供 ChatGPT Pro 使用者和我們的 API 使用(2025 年 6 月 10 日)

如同 o1-pro,o3-pro 是我們最智慧的模型 o3 的一個版本,設計上會思考更久,提供最可靠的回應。自 o1-pro 推出以來,使用者偏好將此模型用於數學、科學和程式碼等領域;學術評估顯示,o3-pro 在這些領域持續表現出色。如同 o3,o3-pro 可使用讓 ChatGPT 更實用的工具:它能搜尋網頁、分析檔案、對視覺輸入進行推理、使用 Python、運用記憶個人化回應等。由於 o3-pro 可使用工具,回應通常會比 o1-pro 花更久完成。我們建議在可靠性比速度更重要的高難度問題上使用它;等待幾分鐘是值得的取捨。

在專家評估中,評審在每個測試類別都一致偏好 o3-pro 勝過 o3,尤其是在科學、教育、程式設計、商業和寫作協助等關鍵領域。評審也在清晰度、完整性、遵循指示和準確性方面,一致給予 o3-pro 更高評分。

Chart of OpenAI o3-pro win rates versus o3, with human testers preferring o3-pro across five task categories

學術評估顯示,o3-pro 持續優於 o1-pro 和 o3。

OpenAI o3-pro benchmark chart showing highest pass@1 results over o1-pro and o3 (medium) across math, science, and code

為評估 o3-pro 的關鍵強項,我們再次使用嚴格的「4/4 可靠性」評估:只有模型在四次嘗試中都正確回答同一問題,才算成功,而不是只答對一次:

Image

從今天起,Pro 和 Team 使用者可在模型選擇器中使用 o3-pro,它將取代 o1-pro。Enterprise 和 Edu 使用者將在下一週取得存取權。

由於 o3-pro 使用與 o3 相同的底層模型,完整安全性細節可見於 o3 系統說明卡

限制

目前,在我們解決技術問題期間,o3-pro 已停用暫存對話。

o3-pro 內不支援圖像生成;如需生成圖像,請使用 GPT-4o、OpenAI o3 或 OpenAI o4-mini。

o3-pro 目前也不支援畫布。

付費使用者的進階語音模式更新(2025 年 6 月 7 日)

我們正在為付費使用者升級 ChatGPT 中的進階語音,在語調和自然度上大幅提升,讓互動感覺更流暢、更像真人。進階語音首次推出時,代表 AI 語音的一大躍進;現在,它說話更自然,語調更細緻,節奏更真實(包括停頓和強調),並能更貼切表達同理、諷刺等特定情緒。

語音現在也提供直覺且有效的語言翻譯。只要請 Voice 在語言之間翻譯,它就會在整段對話中持續翻譯,直到你要求停止或切換。無論你是在義大利問路,或與東京辦公室的同事聊天,只要需要,它都能隨時翻譯。例如在巴西的餐廳,Voice 可以把你的英文句子翻成葡萄牙文,再把服務生的葡萄牙文回應翻回英文,無論你在哪裡、和誰交談,都能輕鬆對話。

這次進階語音升級已在各市場與平台開放給所有付費使用者;只要點按訊息輸入框中的 Voice 圖示即可開始。

此更新是在我們今年稍早減少打斷並改善口音的基礎上再進一步提升。

已知限制

在測試中,我們觀察到此更新偶爾可能導致音訊品質小幅下降,包括語氣和音高出現非預期變化。這些問題在某些語音選項中更明顯。我們預期會隨時間改善音訊一致性。

此外,語音模式中罕見的幻覺在此更新後仍存在,可能產生類似廣告、亂語或背景音樂的非預期聲音。我們正在積極調查這些問題並尋求解決方案。

o4-mini 更新(2025 年 6 月 6 日)

我們正在復原不到一週前部署的 o4-mini 快照。該快照原本旨在改善模型回覆長度,但自動監控工具偵測到內容遭標記的情況增加。

在 ChatGPT 中向所有付費使用者推出 GPT-4.1(2025 年 5 月 14 日)

GPT-4.1 自 4 月在 API 推出以來,已成為開發者的熱門選擇;應廣大需求,我們將讓它直接在 ChatGPT 中可用。

GPT-4.1 是一款專精於程式碼任務的模型。相較於 GPT-4o,它在精準遵循指示和網頁開發任務上更強,也為較簡單的日常程式碼需求提供 OpenAI o3 和 OpenAI o4-mini 之外的選擇。

從今天起,Plus、Pro 和 Team 使用者可透過模型選擇器中的「更多模型」下拉選單存取 GPT-4.1。Enterprise 和 Edu 使用者將在未來幾週取得存取權。對付費使用者而言,GPT-4.1 的速率限制與 GPT-4o 相同。

在 ChatGPT 中向所有使用者推出 GPT-4.1 mini,取代 GPT-4o mini(2025 年 5 月 14 日)

GPT-4.1 mini 是快速、有能力且高效率的小型模型,相較於 GPT-4o mini,在遵循指示、程式碼和整體智慧方面都有顯著提升。從今天起,GPT-4.1 mini 將在付費使用者模型選擇器的「更多模型」中取代 GPT-4o mini;免費使用者達到 GPT-4o 用量限制後,它也將作為備援模型。速率限制維持不變。

GPT-4.1 和 GPT-4.1 mini 的評估結果最初已在其 API 發布隨附的部落格文章中分享。它們也經過標準安全評估。詳細結果可在新推出的安全評估中心取得。

GPT-4o 改進(2025 年 5 月 12 日)

我們改進了 GPT-4o 的系統指示,以協助確保當你想在 ChatGPT 中生成圖像時,會呼叫圖像生成工具。

GPT-4o 更新(2025 年 4 月 29 日)

由於回應過度迎合(諂媚)的問題,我們已回復 GPT-4o 最近一次更新。

我們正在積極進行進一步改進。更多詳情請查看我們說明事件經過與初步發現的部落格文章,以及我們進一步說明在諂媚問題上遺漏了什麼、未來將做哪些變更的這篇部落格文章

GPT-4o 改進(2025 年 4 月 25 日)

我們正在對 GPT-4o 進行額外改進,最佳化它儲存記憶的時機,並提升 STEM 問題解決能力。我們也對它的回應方式做了細微調整,使其更主動,也更能引導對話走向有成效的結果。我們認為這些更新有助於讓 GPT-4o 在各種任務中更直覺、更有效;希望你也同意!

OpenAI o3 和 o4-mini(2025 年 4 月 16 日)

OpenAI o3 是我們最強大的推理模型,將程式碼、數學、科學、視覺感知等領域推向前沿。它在 Codeforces、SWE-bench(未建置自訂模型專用 scaffold)和 MMMU 等基準上創下新的 SOTA。它非常適合需要多面向分析、答案未必一目了然的複雜查詢。它在分析圖像、圖表和圖形等視覺任務上表現尤其強。在外部專家評估中,面對困難的現實任務,o3 比 OpenAI o1 少犯 20% 重大錯誤,尤其擅長程式設計、商業/顧問和創意發想等領域。早期測試者強調它作為思考夥伴的分析嚴謹性,並凸顯它生成及批判性評估新假說的能力,尤其是在生物、數學和工程情境中。

OpenAI o4-mini 是一款較小的模型,針對快速且具成本效益的推理最佳化;以其規模與成本而言表現出色,尤其在數學、程式碼和視覺任務上。它是 AIME 2024 和 2025 上表現最佳的已評測模型。在專家評估中,它在非 STEM 任務以及資料科學等領域也優於前代 o3‑mini。得益於其效率,o4-mini 支援比 o3 高得多的用量限制,對於受益於推理的問題,是強大的高用量、高吞吐量選擇。

GPT-4o 改進(2025 年 3 月 27 日)

我們已改進 GPT-4o;它現在感覺更直覺、更有創意也更能協作,並提升了遵循指示、更聰明的程式碼能力,以及更清楚的溝通風格。

在 STEM 與程式碼編寫方面更聰明地解決問題:

GPT-4o 進一步提升了處理複雜技術與程式碼編寫問題的能力。它現在能生成更乾淨、更簡潔的前端程式碼,更準確地理解既有程式碼以找出必要變更,並穩定產出可成功編譯與執行的程式碼成果,讓你的程式碼編寫工作流程更順暢。

強化指令遵循能力與格式準確度:

GPT-4o 現在更擅長遵循詳細指令,尤其是包含多項或複雜要求的提示詞。它在依照要求格式生成輸出方面有所提升,並在分類任務中達到更高的準確度。

「不易量化」的改進:

早期測試者表示,這個模型似乎更能理解提示詞背後的隱含意圖,尤其是在創意與協作任務上。它也稍微更精簡、更清楚,回覆中使用較少的 Markdown 階層和表情符號,因此更易閱讀、更少雜亂,也更聚焦。我們也很好奇使用者是否會有同樣的感受。

此模型現已可在 ChatGPT 中使用,並在 API 中作為 chatgpt-4o-latest 的最新快照提供。我們計劃在未來幾週內,將這些改進導入 API 中帶有日期標記的模型。

推出 GPT-4.5(2025 年 2 月 27 日)

我們正在發布 GPT-4.5 的研究預覽版;這是我們迄今最大、也最適合聊天的模型。GPT-4.5 是擴展預訓練與後訓練的一次進展。透過擴展非監督式學習,GPT-4.5 提升了在不進行推理的情況下辨識模式、建立連結並產生創意洞見的能力。

早期測試顯示,與 GPT-4.5 互動感覺更自然。它更廣泛的知識基礎、更能遵循使用者意圖的能力,以及更高的「情商」,讓它適合改進寫作、程式設計和解決實際問題等任務。我們也預期它會更少產生幻覺。

我們以研究預覽形式分享 GPT-4.5,以更深入了解它的優勢與限制。我們仍在探索它的能力,也期待看到人們以我們未曾預期的方式使用它。

ChatGPT Pro 方案使用者現已可在全球使用 GPT-4.5。未來所有擁有 ChatGPT 帳戶的付費方案(Plus、Pro、Teams、Enterprise 和 Edu)都能使用。

推出 OpenAI o3-mini(2025 年 1 月 31 日)

我們很高興推出 o3-mini,這是最新且具成本效益的推理模型,針對程式碼編寫、數學與科學進行了最佳化。



在 API 中,o3-mini 支援結構化輸出、函式呼叫、開發人員訊息和串流。它提供三種可調整的推理強度(低、中、高),讓你能依使用案例在速度與深度之間取得平衡。



ChatGPT Team、Pro、Plus 和免費方案使用者從今天起即可使用 o3-mini。此外,o3-mini 現在可搭配搜尋功能,尋找即時答案並附上相關網路來源的連結。這是早期原型;我們正努力將搜尋功能整合至所有推理模型。在並列測試中,o3-mini 以更低的延遲提供與 o1 相當的結果,處理進階 STEM 任務的表現也優於 o1-mini。

專家評估人員在 56% 的情況下偏好 o3-mini 的答案而非 o1-mini,原因是其表達更清楚,且回答困難問題時的嚴重錯誤更少。我們期待收到你的意見;隨著進階推理模型系列持續擴展,我們也會不斷改良 o3-mini。

ChatGPT 中的 GPT-4o 更新(2025 年 1 月 29 日)

我們對 GPT-4o 做了幾項更新,使其整體變得更聰明、知識更新,也能更深入地理解與分析上傳的圖像。


更即時的知識:透過將訓練資料截止日期從 2023 年 11 月延至 2024 年 6 月,GPT-4o 現在能提供關聯性更高、更即時且更符合上下文的回覆,尤其是涉及文化與社會趨勢或較新研究的問題。更新的訓練資料集也讓模型更容易以高效率且有效的方式規劃網路搜尋。


更深入地理解與分析上傳的圖像:

GPT-4o 現在更能理解視覺輸入並回答相關問題,在 MMMU 和 MathVista 等多模態基準測試中均有所提升。更新後的模型更擅長解讀上傳圖像中的空間關係,也能分析複雜圖表、理解各類圖形與統計圖,並將視覺輸入與文字內容相互連結。針對上傳圖像的回覆將包含更豐富的見解與更準確的指引,涵蓋空間規劃、設計配置,以及以視覺資訊為主的數學或技術問題解決。


更聰明的模型,尤其擅長 STEM:GPT-4o 現在更擅長處理數學、科學和程式碼編寫相關問題,在 GPQA 和 MATH 等學術評測中都有所提升。它在 MMLU 上的分數提升,反映出處理跨領域複雜問題的能力。MMLU 是一項全面評估語言理解、知識廣度與推理能力的基準測試。


Emoji 使用量增加 ⬆️:GPT-4o 現在使用 emoji 時會更熱情一些(如果你在對話中使用 emoji,可能尤其如此 ✨)。歡迎告訴我們你的看法。

推出支援排程任務的 GPT-4o(2025 年 1 月 14 日)

今天,我們開始推出任務功能的 Beta 版,讓你能以全新方式請 ChatGPT 在未來指定時間代為處理事情。無論是單次提醒還是週期性動作,只要告訴 ChatGPT 你需要什麼、何時執行,它就會自動處理。

排程任務目前處於早期 Beta 階段,開放 Plus、Pro 和 Team 使用。最終,所有擁有 ChatGPT 帳戶的使用者都能使用此功能。

GPT-4o 更新(2024 年 11 月 20 日)

我們已為所有付費方案的 ChatGPT 使用者更新 GPT-4o。本次 GPT-4o 更新提升了寫作能力,文字如今更自然、更能掌握目標讀者,並會適度調整內容,以提高關聯性與可讀性。此模型處理上傳檔案的能力也更出色,能提供更深入的見解與更完整的回覆。

GPT 4o-mini 更新(2024 年 11 月 5 日)

今天,我們已為 Free、Plus 和 Team 層級的 ChatGPT 使用者,以及登出狀態下使用 ChatGPT 的使用者更新 GPT-4o mini。

推出具備畫布的 GPT-4o(2024 年 10 月 3 日)

我們訓練 GPT-4o 成為可協作的創意夥伴。模型知道何時開啟畫布、進行精準編輯,以及完整重寫。它也能理解更廣泛的脈絡,提供精準回饋和建議。

畫布目前為早期 beta,我們計畫快速提升其能力。

進階語音(2024 年 9 月 24 日)

進階語音使用 GPT-4o 的原生音訊能力,提供更自然的即時對話,能捕捉非語言線索,例如你的語速,並以情感回應。Plus 和 Team 使用者使用 advanced Voice(音訊輸入與輸出)每日有限制。

推出 OpenAI o1-preview 和 o1-mini(2024 年 9 月 12 日)

我們開發了一個新的 AI 模型系列,設計上會在回應前花更多時間思考。它們能推理複雜任務,並在科學、程式碼和數學方面解決比先前模型更困難的問題。

今天,我們在 ChatGPT 和 API 中發布此系列的首批模型。這是預覽版,我們預期會定期更新與改進。

ChatGPT Plus 和 Team 使用者從今天起可在 ChatGPT 中存取 o1 模型。o1-preview 和 o1-mini 都可在模型選擇器中手動選取;推出時,每週速率限制為 o1-preview 30 則訊息、o1-mini 50 則訊息。我們正努力提高這些限制,並讓 ChatGPT 能自動為特定提示詞選擇合適模型。

GPT-4o 更新(2024 年 9 月 3 日)

今天,我們已在 ChatGPT 中更新 GPT-4o。此版本更擅長整合上傳檔案,並以對話中的關鍵部分更新記憶,讓未來互動更有幫助且更相關。

GPT-4o 更新(2024 年 8 月 12 日)

「錯誤修正與效能改進」……我們推出了一項 GPT-4o 更新;根據實驗結果和質性回饋,我們發現 ChatGPT 使用者傾向偏好它。這不是新的前沿級模型。雖然我們很想精確告訴你模型回應有哪些不同,但如何細緻地評測並傳達模型行為改進,本身仍是持續研究的領域(我們正在努力!)。

有時我們可以指出新能力和具體改進;只要可能,我們都會盡力傳達。同時,我們的團隊會根據使用者回饋、離線評估等,不斷透過加入好的資料、移除不佳資料,並嘗試新的研究方法來迭代模型。這次模型更新也是如此。

我們會盡力持續讓你了解最新情況。感謝你的耐心!

推出 GPT-4o mini(2024 年 7 月 18 日)

我們推出 GPT-4o mini,這是目前最有能力且最具成本效益的小型模型。在文字智慧與多模態推理的學術基準上,GPT-4o mini 超越 GPT-3.5 Turbo 和其他小型模型,並支援與 GPT-4o 相同範圍的語言。它在函式呼叫方面也展現強大表現,可讓開發者建構能從外部系統擷取資料或採取動作的應用程式;相較於 GPT-3.5 Turbo,長上下文表現也有所提升。

你可以在部落格公告中閱讀更多關於 GPT-4o mini 的資訊。

這篇文章有幫助嗎?