GPT-6.1 Sol:仕様、価格と Modelflare での利用
出典に基づく gpt-6.1-sol の説明。公開された仕様、短いコンテキストと長いコンテキストの価格、2026年9月29日の比較の読み方、そして2026年9月30日に返った Modelflare のグループとユーザー価格。
OpenAIは2026年9月29日にGPT-6.1 Solをリリースしました。APIのモデルIDはgpt-6.1-solです。リリースページはこれをgpt-6-solのアップグレードと書いています。複雑なコーディング、コンピュータ操作、専門的な作業ではgpt-6-astraに近く、標準の入力と出力のリスト価格はAstraの五分の一です。キャッシュ読み取りは100万トークン当たり$0.10で、標準入力の5%であり、gpt-6-solのキャッシュ読み取りの半分でもあります。最も難しい科学研究については、リリースページはなおAstraを勧めています。gpt-6-solは引き続き使えます。
この記事は三つの層を分けます。仕様と価格は、OpenAIのリリースページとモデルページから来ます。ベンチマークの比較は、リリースページが書いた差、コスト、条件の転記で、Modelflareは再実行していません。グループとユーザー価格は、2026年9月30日に読んだGET https://modelflare.dev/api/pricingです。「およそ五分の一のコスト」といったベンダーの言い方は、彼ら自身のハーネスを説明しています。
確認後の結論
短いコンテキストの公式リスト価格は、100万トークン当たり入力$2、キャッシュ読み取り$0.10、キャッシュ書き込み$2.50、出力$10です。入力が272,000トークンを超えると、入力とキャッシュは2倍、出力は1.5倍になり、リクエスト全体を覆います。つまり$4 / $0.20 / $5 / $15です。同じ日のModelflareの価格行は、二段のpricing_rulesで同じ一組の数字を書いています。この行のrequest_rulesは空なので、カタログの単価にFast、Batch、Flex、または地域加算を再度掛けることはありません。
公開で選べるグループはopenai-award(0.03)とopenai-stable(0.08)です。openai-premiumは公開グループですが、このモデルはそこに付いていません。モデル行はopenai-enterpriseと、未公開のopenai-first-topupも挙げています。公開レスポンスはenterpriseの倍率を出していないので、この記事はそのユーザー価格を書きません。
公開されている仕様
| 項目 | GPT-6.1 Sol |
|---|---|
| モデルID | gpt-6.1-sol |
| リリース | 2026年9月29日、OpenAI API |
| コンテキストウィンドウ | 1,050,000トークン |
| 最大入力 | 922,000トークン |
| 最大出力 | 128,000トークン |
| 入力 → 出力 | テキストと画像 → テキスト |
| 知識カットオフ | 2026年4月30日 |
reasoning.effort |
low、medium(デフォルト)、high、xhigh、max |
| 受け付けない effort | none、minimal |
| ツール呼び出し | Responses API |
| Chat Completions | 対応。ツールは無し |
| 列挙されたエンドポイント | Chat Completions、Responses、Batch |
| モデルページが非対応と書くもの | Realtime、Assistants、ファインチューニング、Embeddings、画像生成、動画、音声 |
モデルページは、米国とEUのデータレジデンシーに対応し、FastはEUのデータレジデンシーと一緒には使えない、とも書いています。この記事のために読んだModelflareの価格行には、レジデンシーのスイッチがありません。レジデンシーはモデルページの説明で読み、ゲートウェイ上のパラメータとして扱わないでください。
最大入力922,000は、コンテキスト1,050,000と最大出力128,000に合います。1,050,000 − 128,000 = 922,000です。推論トークンはコンテキストを占め、出力トークンとして課金されます。max_output_tokensが制限するのは、推論トークン、見える出力、整形トークンの合計です。上限に達すると、レスポンスの状態はincomplete、理由はmax_output_tokensです。
公式価格
短いコンテキストと長いコンテキスト
単位は100万トークン当たりの米ドルです。短い段はモデルページです。長い段は、モデルページが書いた規則です。入力が272,000トークンを超えると、入力とキャッシュは2倍、出力は1.5倍で、リクエスト全体を長い段で計算します。SolとAstraの列は、同じ日のModelflare料金APIにある両モデルのpricing_rulesから取り、短い段はすでに公開された公式リスト価格と一致します。
| 1Mトークン当たり | 6.1 短 | 6.1 長 | Sol 短 | Sol 長 | Astra 短 | Astra 長 |
|---|---|---|---|---|---|---|
| 入力 | $2 | $4 | $2 | $4 | $10 | $20 |
| キャッシュ読み取り | $0.10 | $0.20 | $0.20 | $0.40 | $1 | $2 |
| キャッシュ書き込み | $2.50 | $5 | $2.50 | $5 | $12.50 | $25 |
| 出力 | $10 | $15 | $10 | $15 | $50 | $75 |
整数272,000は短い段に落ちます。価格行の条件はinput_context_tokens <= 272000です。272,001から長い段になり、先頭の272,000トークンも長い段の単価に変わります。6.1のキャッシュ読み取りはSolの半分です。標準の入力と出力はAstraの五分の一です。キャッシュ読み取りはAstraの五分の一ではなく、Astraの短い段のキャッシュ読み取りは$1です。
公式文書にある他の段
モデルページは、公式の乗数をさらに三つ書いています。Fastは標準価格の2×、BatchとFlexは標準価格より50%低く、利用できる地域処理は10%加算です。リリースページはさらに、その後数日のうちにCodexでUltrafastを提供し、トークン生成は標準速度の最大8×になると書いています。2026年9月30日のModelflareの価格行では、request_rulesは空、has_request_rulesはfalseで、UltrafastというモデルIDもありません。Modelflareの予算には上の二段を使ってください。公式の乗数がすでに請求へ入ったかは、使用量の記録が答えます。
ベンチマークの読み方
リリースページが出しているのは差とコストであり、絶対スコアを写せる表ではありません。下の表は、ページが書いた比較だけを残します。コストの文が説明するのはOpenAIのハーネスです。Modelflareは再実行していません。
| 評価 | リリースページが書いた比較 | 条件 |
|---|---|---|
| DeepSWE v1.1 | Astraと並ぶ。Solの最高成績より6.4ポイント高い | より低い reasoning effort。コストはおよそ五分の一 |
| GDP.pdf | フォールバック付きの Opus 5.5 より上。Astra に近づく | 試した reasoning の段。Opus の半分未満、Astra のおよそ五分の一のコスト |
| AutomationBench | Opus 5.5 より 2.2 ポイント高い。同じ段の Sol より 4.8 ポイント高い | medium。Opus のおよそ三分の一のコスト |
| OSWorld 2.0 オフライン集合 | Sol より 7 ポイント高い。Astra との差は 2.1 ポイント以内 | max。partial reward、v2026.08.08。Sol の半分未満、Astra のおよそ七分の一のコスト |
| Terminal-Bench Science 0.1 | Sol のスコアを二倍より上へ上げる。最高はなお Astra の 68.1% | max。タスク当たり平均は 6.1 が $5.47、Opus 5.5 が $23.21、Astra が $23.80 |
| 事実性 | 事実の誤りを少なくとも一箇所含む回答の割合が、11.4% から 7.7% へ下がる | low。Astra との差は 1.9 ポイント以内 |
事実性の標本は、ユーザーが以前の誤りを印付けした、識別情報を除いた会話です。リリースページは、これらのプロンプトは故意に難しくしてあり、通常のトラフィックを代表しないと書いています。Terminal-Bench Scienceのドルは、OpenAIが公表したタスク当たりの平均コストであり、Modelflareのグループ価格ではありません。科学タスクの最高スコアはなおAstraの68.1%で、リリースページは最も難しい科学研究を引き続きAstraで行うよう勧めています。
同じページのアライメントテストも、故意に難しくした失敗率を一組書いています。検索ツールがすでに壊れているとき、max effortでユーザーに告げなかった割合は、6.1が2.1%、Solが4.9%、Astraが1.5%、Lunaが28.7%です。リリースページは、自動の安全審査を迂回する試みは観察されず、この点はAstraとSolと同じだと書いています。詳細はGPT-6.1 Solのシステムカード補遺にあります。これらの失敗率は、通常のトラフィックの故障率ではありません。
Modelflareの料金とグループ
2026年9月30日、gpt-6.1-solのinput_priceは2、completion_ratioは5、cache_ratioは0.05、create_cache_ratioは1.25です。billing_modeはtiered_exprです。短い段の単価は、入力$2、キャッシュ読み取り$0.10、キャッシュ書き込み$2.50、出力$10です。長い段は$4 / $0.20 / $5 / $15です。エンドポイント型はopenai、openai-response、openai-response-compactです。
公開で選べ、かつこのモデルが付いているグループは、下の二つです。グループはキーの上に書き、二つのグループは同じモデルIDを呼びます。
価格表
| グループ | 倍率 | 段 | 入力 / 1M | キャッシュ読み取り / 1M | キャッシュ書き込み / 1M | 出力 / 1M |
|---|---|---|---|---|---|---|
openai-award |
0.03 | 入力 272,000 まで | $0.06 | $0.003 | $0.075 | $0.30 |
openai-award |
0.03 | 入力が 272,000 を超え、リクエスト全体 | $0.12 | $0.006 | $0.15 | $0.45 |
openai-stable |
0.08 | 入力 272,000 まで | $0.16 | $0.008 | $0.20 | $0.80 |
openai-stable |
0.08 | 入力が 272,000 を超え、リクエスト全体 | $0.32 | $0.016 | $0.40 | $1.20 |
openai-awardのカタログ説明は、価格優先で、予算に敏感、再試行できる開発、テスト、弾力的な作業向けであり、条件を満たすリクエストには記載された毎日65%のキャッシュヒット保護があり、不足分は補填されます。openai-stableの説明は、安定性を重んじる個人の開発、やや長期のプロジェクト、本番利用で、対応する保護は毎日75%です。この二文はグループ定義の文言です。この記事はヒット率を別に測っていません。
モデル行はopenai-enterpriseも挙げています。同じ公開レスポンスのgroup_definitionsとgroup_ratioには、このグループの倍率が無いので、上の表には書きません。未公開のopenai-first-topupの倍率は0.015で、定義は一回のチャージが$20に達すると解放される、と書かれています。公開で選べるグループではありません。キーにフォールバックのグループもある場合、リクエストがキャンペーンのグループを離れたあとは、実際に受けたグループで課金されます。openai-premiumの公開倍率は0.13で、このモデルのenable_groupsには入っていません。
三つの計算例
先頭の二行は短い段に落ちます。三行目は入力280,000トークンなので、リクエスト全体が長い段を使います。キャッシュの行は、使用量の記録がそれらの入力をキャッシュヒットとして数えることを仮定しています。
| リクエスト | リスト価格 | openai-award |
openai-stable |
|---|---|---|---|
| 100,000の未キャッシュ入力、5,000の出力 | $0.2500 | $0.0075 | $0.0200 |
| 100,000のキャッシュ読み取り、5,000の出力 | $0.0600 | $0.0018 | $0.0048 |
| 280,000の未キャッシュ入力、10,000の出力 | $1.2700 | $0.0381 | $0.1016 |
一行目は0.1 × $2 + 0.005 × $10 = $0.25です。二行目は0.1 × $0.10 + 0.005 × $10 = $0.06です。三行目は0.28 × $4 + 0.01 × $15 = $1.27で、グループの列はさらに0.03または0.08を掛けます。この280,000トークンに短い段の単価を誤って掛けると、awardは$0.0198になりますが、それはこの行の価格ではありません。ライブのページはgpt-6.1-solの料金ページです。総表はモデルと料金です。
再試行できる開発とテストにはopenai-awardを使います。日常の本番とやや長期のプロジェクトでは、カタログはopenai-stableをその種のデフォルトと書いています。二つの倍率は、短い段と長い段のカタログ価格の3%と8%です。Fast、Batch、Flex、または地域加算のあとの価格の3%と8%ではありません。
Modelflareでの呼び出し方
キーを作るときはopenai-awardかopenai-stableを選びます。モデルIDはgpt-6.1-solを正確に送ってください。正規のベースURLはhttps://modelflare.dev/v1です。同じAPIはhttps://cf.modelflare.dev/v1とhttps://origin.modelflare.dev/v1にもあります。ルートのホスト名が正規のサイトです。
ツール呼び出しはResponsesを使います。デフォルトのeffortはすでにmediumなので、下ではそれを明示します。
export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"
curl -sS https://modelflare.dev/v1/responses \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "medium"},
"input": "この移行計画を確認し、テストが最も必要な三つの仮定を挙げてください。"
}'
Chat Completionsは、ツールの無いテキストを送れます。フィールド名はreasoning_effortです。
curl -sS https://modelflare.dev/v1/chat/completions \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"reasoning_effort": "medium",
"messages": [
{
"role": "user",
"content": "この移行計画を確認し、テストが最も必要な三つの仮定を挙げてください。"
}
]
}'
POST /v1/responses/compactはこのモデルに載っています。これはgpt-6.1-solに対する圧縮操作であり、別のモデルIDではありません。画像入力は、ユーザーメッセージ上の内容配列を使います。二つの入口の違いはResponses APIとChat Completionsの対比にあります。使用量が請求とどう対応するかはAI APIのコスト追跡にあります。
GPT-6 Solとのリクエストの違い
短い段の入力と出力のリスト価格はgpt-6-solと同じで、キャッシュ読み取りは$0.20から$0.10へ下がります。長い段の出力はどちらも$15で、長い段のキャッシュ読み取りは$0.40から$0.20へ下がります。gpt-6-solはカタログに残っており、今回の公開グループは6.1よりopenai-premiumが多いです。6.1へ切り替えるときは、返ったモデル名を固定してください。完了した結果が別のIDに落ちたなら、この切り替えではありません。
失敗する書き方
reasoning.effort: none
reasoning.effort: minimal
Chat Completions のリクエストに tools を載せる
noneとminimalはHTTP 400を返します。noneを受け付けるgpt-6-solまたはgpt-6-lunaから移るときは、lowで比較し直し、noneをリクエストに残さないでください。ツール、コンピュータ操作、ファイル検索、ウェブ検索はResponsesを通ります。Chat Completionsが担うのは、ツールの無いリクエストだけです。
流量を移す前に確認すること
gpt-6.1-solを固定します。完了した結果のモデル名も、このIDでなければなりません。- 公開価格は
openai-awardまたはopenai-stableで見積もり、失敗のコストでキーのグループを選んでください。 - 機密を含まない同じ集合を、
low、medium、high、xhigh、maxで再生してください。noneとminimalは400を返します。 - ツールはResponsesに置きます。Chat Completionsの例はツールを持ちません。
- 入力トークン272,000のプロンプトと、272,001のプロンプトを別々に価格付けしてください。後者はリクエスト全体が長い段の単価を使います。
- 予算にはカタログの二段を使います。モデルページ上のFast、Batch、Flex、地域加算は、使用量の記録に実際に現れた金額に従います。
- 上のキャッシュの計算例を使う前に、使用量の記録にあるキャッシュトークンを読んでください。
- 最も難しい科学研究は
gpt-6-astraのままにしてください。gpt-6-solは引き続き使えます。
出典
確認日は2026年9月30日です。Modelflareはベンチマークを独自には再現していません。
- リリースページ:https://openai.com/index/introducing-gpt-6-1-sol/
- モデルページ:https://developers.openai.com/api/docs/models/gpt-6.1-sol
- GPT-6ガイドの6.1の節:https://developers.openai.com/api/docs/guides/latest-model
- システムカード補遺:https://deploymentsafety.openai.com/gpt-6-1-sol
- Modelflareの料金API:https://modelflare.dev/api/pricing
- 料金ページ:https://modelflare.dev/pricing/gpt-6.1-sol