GPT-6.1 Sol:規格、價格與 Modelflare 接入

依據 OpenAI 2026 年 9 月 29 日的發布頁和模型頁,整理 gpt-6.1-sol 的規格、短上下文與長上下文標價和基準讀法,並記錄 2026 年 9 月 30 日 Modelflare 價格介面中的公開群組與使用者價格。

OpenAI 於 2026 年 9 月 29 日發布 GPT-6.1 Sol。API 模型 ID 是 gpt-6.1-sol。發布頁把它寫成 gpt-6-sol 的升級:在複雜程式設計、電腦操作和專業工作上接近 gpt-6-astra,標準輸入和輸出標價是 Astra 的五分之一。快取讀取是每百萬 token $0.10,是標準輸入的 5%,也是 gpt-6-sol 快取讀取的一半。最難的科學研究,發布頁仍建議用 Astra。gpt-6-sol 繼續可用。

本文把三層分開。規格和價格來自 OpenAI 的發布頁和模型頁。基準比較抄自發布頁寫明的差值、成本和條件,Modelflare 沒有重跑。群組和使用者價格來自 2026 年 9 月 30 日讀取的 GET https://modelflare.dev/api/pricing。廠商的“大約五分之一成本”描述的是他們自己的測試裝置。

核查後的結論

短上下文的官網標價是每百萬 token 輸入 $2、快取讀取 $0.10、快取寫入 $2.50、輸出 $10。輸入超過 272,000 token 時,輸入和快取按 2 倍、輸出按 1.5 倍,覆蓋整次請求,也就是 $4 / $0.20 / $5 / $15。同一天的 Modelflare 價格行用兩檔 pricing_rules 寫出了同一組數字。這一行的 request_rules 是空的,所以目錄單位價格不再乘 Fast、Batch、Flex 或區域加價。

公開可選群組是 openai-award(0.03)和 openai-stable(0.08)。openai-premium 是公開群組,但這條模型沒有掛上。模型行還列出 openai-enterprise 和未公開的 openai-first-topup。公開響應沒有給出 enterprise 的倍率,本文不寫它的使用者價格。

已經公開的規格

項目 GPT-6.1 Sol
模型 ID gpt-6.1-sol
發布 2026 年 9 月 29 日,OpenAI API
上下文視窗 1,050,000 tokens
最大輸入 922,000 tokens
最大輸出 128,000 tokens
輸入 → 輸出 文字和圖片 → 文字
知識截止 2026 年 4 月 30 日
reasoning.effort low、medium(預設)、high、xhigh、max
不接受的 effort none、minimal
工具呼叫 Responses API
Chat Completions 支援,不帶工具
列出的端點 Chat Completions、Responses、Batch
模型頁寫明不支援 Realtime、Assistants、微調、Embeddings、圖片生成、影片、語音

模型頁還寫明支援美國和歐盟資料駐留,並寫明 Fast 不能和歐盟資料駐留一起用。Modelflare 這次讀到的價格行沒有駐留開關。按模型頁的說明來理解駐留,不要把它當成閘道器上的一個參數。

最大輸入 922,000 與上下文 1,050,000、最大輸出 128,000 對得上:1,050,000 − 128,000 = 922,000。推理 token 佔用上下文,並按輸出 token 計費。max_output_tokens 限制的是推理 token、可見輸出和格式 token 的合計。頂滿時,響應狀態是 incomplete,原因是 max_output_tokens。

官網價格

短上下文和長上下文

單位是美元 / 每百萬 tokens。短檔來自模型頁。長檔是模型頁寫明的規則:輸入超過 272,000 token 時,輸入和快取 2 倍、輸出 1.5 倍,整次請求都按長檔計算。Sol 和 Astra 兩列來自同一天 Modelflare 價格介面裡這兩款的 pricing_rules,短檔與已經公開的官網標價一致。

每 1M tokens 6.1 短 6.1 長 Sol 短 Sol 長 Astra 短 Astra 長
輸入 $2 $4 $2 $4 $10 $20
快取讀取 $0.10 $0.20 $0.20 $0.40 $1 $2
快取寫入 $2.50 $5 $2.50 $5 $12.50 $25
輸出 $10 $15 $10 $15 $50 $75

272,000 這個整數落在短檔:價格行的條件是 input_context_tokens <= 272000。從 272,001 起用長檔,而且前 272,000 token 也改按長檔單價計算。6.1 的快取讀取是 Sol 的一半。標準輸入和輸出是 Astra 的五分之一。快取讀取不是 Astra 的五分之一,Astra 短檔快取讀取是 $1。

官方文件裡的其他檔位

模型頁另寫了三檔官方乘數:Fast 是標準價格的 2 倍,Batch 和 Flex 比標準價格低 50%,可用的區域處理加 10%。發布頁還說,隨後幾天會在 Codex 裡提供 Ultrafast,token 生成最多比標準速度高 8 倍。2026 年 9 月 30 日的 Modelflare 價格行裡,request_rules 為空,has_request_rules 為 false,也沒有 Ultrafast 這個模型 ID。做 Modelflare 預算時用上面兩檔。官方乘數是否已經進帳單,以用量記錄為準。

基準應該怎麼讀

發布頁給出的是差值和成本,不是一張可以抄絕對分數的表。下表只保留頁面寫明的比較。成本句描述的是 OpenAI 的測試裝置。Modelflare 沒有重跑。

評測 發布頁寫明的比較 條件
DeepSWE v1.1 與 Astra 持平;比 Sol 的最好成績高 6.4 個百分點 更低的 reasoning effort,成本大約是五分之一
GDP.pdf 高於帶 fallback 的 Opus 5.5;接近 Astra 測過的 reasoning 檔;相對 Opus 不到一半成本,相對 Astra 大約五分之一
AutomationBench 比 Opus 5.5 高 2.2 個百分點;比同一檔的 Sol 高 4.8 個百分點 medium;相對 Opus 大約三分之一成本
OSWorld 2.0 離線集 比 Sol 高 7 個百分點;與 Astra 相差 2.1 個百分點以內 max;partial reward,v2026.08.08;相對 Sol 不到一半成本,相對 Astra 大約七分之一
Terminal-Bench Science 0.1 把 Sol 的分數提高到兩倍以上;Astra 仍是最高分,68.1% max;6.1 平均每任務 $5.47,Opus 5.5 為 $23.21,Astra 為 $23.80
事實性 含至少一處事實錯誤的回答,從 11.4% 降到 7.7% low;與 Astra 的差距不超過 1.9 個百分點

事實性樣本是使用者曾經標出錯誤的脫敏對話。發布頁寫明,這些提示是故意挑難的,不代表普通流量。Terminal-Bench Science 的美元是 OpenAI 公佈的單任務平均成本,不是 Modelflare 的群組價格。科學任務的最高分仍是 Astra 的 68.1%,發布頁建議最難的科學研究繼續用 Astra。

同一頁的對齊測試也寫了一組故意挑難的失敗率。搜尋工具已經壞掉時,max effort 下沒有向用戶說明的比例是 6.1 的 2.1%、Sol 的 4.9%、Astra 的 1.5%、Luna 的 28.7%。發布頁寫明沒有觀察到繞過自動安全審查的嘗試,這一點與 Astra 和 Sol 相同。細節在 GPT-6.1 Sol 的系統卡附錄裡。這些失敗率不是普通流量的故障率。

Modelflare 的價格和群組

2026 年 9 月 30 日,gpt-6.1-sol 的 input_price 是 2,completion_ratio 是 5,cache_ratio 是 0.05,create_cache_ratio 是 1.25。billing_mode 是 tiered_expr。短檔單位價格是輸入 $2、快取讀取 $0.10、快取寫入 $2.50、輸出 $10。長檔是 $4 / $0.20 / $5 / $15。端點型別是 openai、openai-response 和 openai-response-compact。

公開可選、並且掛了這個模型的群組是下面兩個。群組寫在金鑰上,兩個群組呼叫同一個模型 ID。

價格表

群組 倍率 檔 輸入 / 1M 快取讀取 / 1M 快取寫入 / 1M 輸出 / 1M
openai-award 0.03 輸入不超過 272,000 $0.06 $0.003 $0.075 $0.30
openai-award 0.03 輸入超過 272,000,整單 $0.12 $0.006 $0.15 $0.45
openai-stable 0.08 輸入不超過 272,000 $0.16 $0.008 $0.20 $0.80
openai-stable 0.08 輸入超過 272,000,整單 $0.32 $0.016 $0.40 $1.20

openai-award 的目錄說明是價格優先,適合預算敏感、可以重試的開發、測試和彈性任務,並為符合條件的請求寫了每日 65% 的快取命中保護,不足部分補償。openai-stable 的說明是看重穩定性的個人開發、較長期專案和生產應用,對應的保護是每日 75%。這兩句是群組定義裡的文字。本文沒有另測命中率。

模型行還列出 openai-enterprise。同一份公開響應的 group_definitions 和 group_ratio 沒有這個群組的倍率,所以上表不寫它。未公開的 openai-first-topup 倍率是 0.015,定義寫成單筆充值達到 20 美元後解鎖。它不在公開可選群組裡。金鑰如果還配置了回退群組,請求離開活動群組之後,按實際承接的群組計費。openai-premium 的公開倍率是 0.13,這條模型的 enable_groups 裡沒有它。

三個算例

前兩行落在短檔。第三行是 28 萬輸入 token,整單用長檔。快取行假定用量記錄把這些輸入計為快取命中。

請求 官網標價 openai-award openai-stable
10 萬未快取輸入,5,000 輸出 $0.2500 $0.0075 $0.0200
10 萬快取讀取,5,000 輸出 $0.0600 $0.0018 $0.0048
28 萬未快取輸入,10,000 輸出 $1.2700 $0.0381 $0.1016

第一行是 0.1 × $2 + 0.005 × $10 = $0.25。第二行是 0.1 × $0.10 + 0.005 × $10 = $0.06。第三行是 0.28 × $4 + 0.01 × $15 = $1.27,群組列再乘 0.03 或 0.08。如果誤用短檔單價去乘這 28 萬 token,award 會得到 $0.0198,那不是這一行的價格。實時頁面是 gpt-6.1-sol 價格頁。總表是模型與價格。

可以重試的開發和測試用 openai-award。日常生產和較長期專案,目錄把 openai-stable 寫成那一類預設。兩個倍率是短檔和長檔目錄價的 3% 和 8%。它們不是 Fast、Batch、Flex 或區域加價之後的 3% 和 8%。

在 Modelflare 上怎麼呼叫

建立金鑰時選擇 openai-award 或 openai-stable。模型 ID 必須精確傳送 gpt-6.1-sol。規範基址是 https://modelflare.dev/v1。同一套 API 也在 https://cf.modelflare.dev/v1 和 https://origin.modelflare.dev/v1。根域名是規範站點。

工具呼叫用 Responses。預設 effort 已是 medium,下面把它寫明。

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/responses \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning": {"effort": "medium"},
    "input": "審這份遷移計畫,列出最需要補測試的三個假設。"
  }'

Chat Completions 可以發不帶工具的文字。欄位名是 reasoning_effort。

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning_effort": "medium",
    "messages": [
      {
        "role": "user",
        "content": "審這份遷移計畫,列出最需要補測試的三個假設。"
      }
    ]
  }'

POST /v1/responses/compact 列在這個模型上。它是對 gpt-6.1-sol 的壓縮操作,不是另一個模型 ID。圖片輸入使用使用者訊息上的內容陣列。兩種入口的差別見 Responses API 與 Chat Completions 對比。用量怎麼對上帳單,見 AI API 成本追蹤。

和 GPT-6 Sol 的請求差別

短檔的輸入和輸出標價與 gpt-6-sol 相同,快取讀取從 $0.20 降到 $0.10。長檔的輸出兩款都是 $15,長檔快取讀取從 $0.40 降到 $0.20。gpt-6-sol 仍在目錄裡,這次的公開群組比 6.1 多 openai-premium。換成 6.1 時要固定返回的模型名,完成結果落在別的 ID 上就不算這次切換。

會失敗的寫法

reasoning.effort: none
reasoning.effort: minimal
Chat Completions 請求裡攜帶 tools

none 和 minimal 返回 HTTP 400。從支援 none 的 gpt-6-sol 或 gpt-6-luna 遷過來時,用 low 重新比較,不要把 none 留在請求裡。工具、計算機操作、檔案搜尋和網頁搜尋走 Responses。Chat Completions 只承擔沒有工具的請求。

切換流量前要核對的事

  1. 固定 gpt-6.1-sol。完成結果裡的模型名也要是這個 ID。
  2. 公開價格按 openai-award 或 openai-stable 估算,並按失敗成本來選金鑰群組。
  3. 用同一份不含敏感資訊的集合,分別在 low、medium、high、xhigh 和 max 上回放。none 和 minimal 會返回 400。
  4. 工具放在 Responses 上。Chat Completions 的例子不帶工具。
  5. 分別給 272,000 和 272,001 個輸入 token 的提示計價。後者整單使用長檔單價。
  6. 預算使用目錄裡的兩檔。模型頁上的 Fast、Batch、Flex 和區域加價,以用量記錄裡實際出現的金額為準。
  7. 先看用量記錄裡的快取 token,再使用上面的快取算例。
  8. 最難的科學研究繼續用 gpt-6-astra。gpt-6-sol 繼續可用。

來源

核對日期:2026 年 9 月 30 日。Modelflare 沒有獨立復現基準。