返回資訊
AI趨勢入門

GPT-5.6 Sol 官方 API 連降三個月:輸入 4 美元、輸出 20 美元,訂閱方案不算

2026年8月22日
易賺Ai團隊
10 分鐘閱讀
#OpenAI#API#Codex#定價#GPT-5.6
GPT-5.6 Sol 官方 API 連降三個月:輸入 4 美元、輸出 20 美元,訂閱方案不算

OpenAI 自己的帳號寫:接下來三個月,把 GPT-5.6 Sol 的 API 與點數價降逾 20%。官方模型頁與價目表對得上:標準檔每百萬 Token 輸入 4 美元、輸出 20 美元。促銷「至少」走到 11 月 21 日。這不是 OpenRouter 側的徽章,是廠商自己改價卡。

對照七月正式供應時反覆被引用的 5 / 30,輸入少 20%,輸出少 33%。OpenAI 對外用「逾 20%」概括;代理、長文、帶工具的推理,輸出 token 才是帳單主體,所以實務降幅更接近輸出那一欄。explainx.ai、Build Fast with AI、開發者文件互相對過同一組新價。

降了什麼,沒降什麼

官方回覆把界線劃死:API 現已生效,ChatGPT Work 與 Codex 點數在符合條件的方案上滾動套用;Pro、Plus、Business 訂閱用量不變。月費吃配額的人,這則公告改不了你付的錢。按量計費、或從點數池扣 Sol 的人,下一張發票才會動。

檔位輸入/百萬快取輸入/百萬輸出/百萬
標準4.000.4020.00
Batch2.000.2010.00
Fast mode8.000.8040.00

長上下文(報導寫超過約 272K token 的請求)仍按舊規則加倍,這次折扣幾乎只動基礎單價,不動長窗乘數。Fast mode 以前叫 Priority processing,七月底改名;它現在是標準檔的兩倍,不是「促銷也一起砍半」。開發者文件把 gpt-5.6 別名指到 Sol,推理力檔有 none、low、medium(預設)、high、xhigh、max。價降了,檔位還在;把 effort 開到 max,輸出 token 會把 20 美元那一欄再放大。

四天前 OpenRouter 出現過 Sol「五折」徽章,實際是路由層對非自帶金鑰流量的促銷,OpenAI 價卡當時沒動。兩件事不要併成一則。預算請對官方價目表,不要對聚合器上可能明天就撤的標籤。

和旁邊幾張價卡怎麼比

同月 DeepSeek V4-Pro 已走峰谷價,離峰輸出仍到每百萬 1.98、峰值 3.96 美元,細節見站內 峰谷價一文。Grok 4.6 在 Artificial Analysis 智力指數上被拿來對 Sol Max,公開標價常見每百萬 2 / 6。Anthropic 的 Claude Opus 5 仍常見 5 / 25。Google Gemini 3.7 Flash 導入價 0.75 / 3.75 收到年底,之後翻倍,見 Flash 半價檔

Sol 從 5 / 30 降到 4 / 20,仍比上述多數工作馬貴一截。它降的是「旗艦推理檔相對中國開源 API 與 Grok 的倍數」,不是變成便宜模型。三個月窗口被多家分析寫成價格測試:十一月若沒延,等於收回折扣;若轉正,才是新常態。OpenAI 自己把這次和七月 Luna 砍 80%、Terra 砍 20% 的效率敘事放在一起——Sol 那輪沒被砍,這次是它第一次直接改自己的 API 單價,而不是在旁邊加一個更快的檔。

開發者 Kien Pham 在討論串把 Sol 限額罵成可怕,並懷疑有人把週限看成五小時窗。這句抱怨和降價是正交的:單價變便宜,不增加你被 5 小時窗或週窗卡住的次數。只把花費當瓶頸的團隊,這三個月值得重跑一次成本模型;已經先撞限額的團隊,這則公告只讓你「用完配額時少付一點」,不讓你「多跑幾輪」。

代理帳單怎麼重算

假設一條帶工具的長任務產出 80 萬輸出 token、12 萬輸入 token,不計快取。舊標準檔大約 12×5 + 80×30 = 2460 美元/千次這類量級的粗算;新價是 12×4 + 80×20 = 1648。輸出權重讓降幅接近三分之一,而不是「逾 20%」聽起來那麼溫和。快取命中會把輸入再壓到 0.40;沒打中快取、又開長窗加倍,數字會往回爬。

這對 AI代理 車隊比對聊天框更重要。聊天框可以被訂閱方案吃掉;車隊走 API 或 Work/Codex 點數。OpenAI 把折扣正好鋪在這兩條計量管線上,等於在旗艦推理需求最容易比價出走的地方擋人。它沒有把折扣給 Plus 用戶——那些人不是在比每百萬 token,他們在比月費裡能問幾次。

把快取放進同一張草稿纸。官方把快取輸入標成 0.40 美元/百萬,是新標準輸入的十分之一。代理車隊若提示詞穩定、工具說明很少改,打中快取後輸入幾乎從帳單消失,輸出 20 美元才是主體。這也是為什麼「逾 20%」對聊天型工作負載偏保守、對長推理偏進取:聊天輸入占比高,降 20% 剛剛好對上標題;代理輸出占比高,實際更接近三分之一。Batch 檔 2 / 10 給得起隔夜的離線評測與資料標註;它不給得起人在迴圈裡等的產品。Fast mode 8 / 40 是給延遲敏感的互動,等於用兩倍錢買隊列優先,不是買更聰明的權重。

競爭結構是一根槓鈴。DeepSeek 同月把 V4 往上調峰谷價,中國 API 不再無條件「永遠更便宜」;OpenAI 把旗艦推理檔往下調,封閉模型不再無條件「永遠貴好幾倍」。中間那截,才是企業採購現在要重新跑模型的地方。Grok 4.6 若在你已有的雲合約裡可呼叫,2 / 6 對智力指數接近的檔,仍可能比 4 / 20 更像預設工作馬。Opus 5 的 5 / 25 在 Sol 降價後,帳面上第一次變成「日常企業模型比 OpenAI 旗艦貴」——Anthropic 會用「少重試、長任務比較穩」來翻案,這只能用你自己的倉庫測量,不能用價目表翻案。

開發者社群的分裂很乾脆。一邊是終於能把 Sol 從「太貴所以只開給最終審核」放進常規路由;一邊是限額窗已經先爆,降價像是在已經客滿的餐廳打折。後者不會因為 4 / 20 而多出吞吐量。OpenAI 若真的想把代理工作負載留在自家 API,最終要動的是速率與週限,不是只動單價。這次沒動。

計價頁還有兩個容易漏的註腳。區域處理(資料駐留)端點對 3 月 5 日以後符合資格的模型加收 10%;Amazon Bedrock 上的 OpenAI 模型走 AWS 帳單,不一定等於這張直連價卡。你若已經把 Sol 放在 Bedrock 或區域端點,不要假設 4 / 20 自動生效。快取折扣只在快取真的命中時存在;系統提示每天改、工具 JSON 每天改的代理,快取命中率會很難看,帳單會回到 4 + 20。

把「三個月」寫進日曆。8 月 22 日起算的九十天,和價目表「至少到 11 月 21 日」大致對上,但「至少」不是「保證到那天仍是 4 / 20」。OpenAI 可以提前結束促銷,也可以延長。任何把 4 / 20 寫成年度單價的財務模型,都在賭延期。比較穩的做法是做兩欄:促銷欄用 4 / 20,常態欄用 5 / 30,專案通過門檻用常態欄。

知識截點仍寫 2026 年 2 月 16 日,這次改的是價不是權重。不要把降價讀成「Sol 又升級了」。要驗證的是發票、用量儀表板、長窗請求有沒有仍被加倍、Bedrock/區域端點是不是另一張價、以及 11 月 21 日那天價卡有沒有改回 5 / 30。能跑工作負載比對的人,這三個月是重測 Sol 對 Opus 5、對 V4-Pro、對 Grok 4.6 的窗口;測的應是成功完成任務的成本(含重試與 Fast mode 加價),不是價目表上的兩個數字。促銷窗是測試,不是合約。把 4 / 20 寫進 2027 年預算,等於預支一筆還沒批准的折扣。