GPT-6 Astra と Claude Fable 5.1:仕様・ベンチマーク・料金を比較
OpenAI と Anthropic の一次資料および Modelflare のライブカタログに基づき、GPT-6 Astra と Claude Fable 5.1 の仕様、コード、Agent、研究、キャッシュを比較します。
OpenAI は 2026年9月3日に GPT-6 Astra を公開しました。OpenAI は、Astra を同社で最も知的かつアラインメントの高いモデルであり、広く展開した中で最も高性能なモデルと説明しています。その2日前、Anthropic は長時間のコーディング、調査、知識労働に向けたフロンティアモデル Claude Fable 5.1 を公開しました。両者は高度な推論と Agent ワークフローを対象にしますが、設計上のトレードオフは異なります。
本記事は「GPT-6 Astra と Claude Fable 5.1 は実際に何を提供し、何が進歩し、チームはいまどちらを選ぶべきか」という実務上の問いに答えます。事実の確認日は **2026年9月4日(Asia/Shanghai)**です。プロバイダーの主張、プロバイダー報告のベンチマーク、Modelflare のライブカタログを明確に分けます。
最初に「パラメータ」という言葉を整理します。確認した公式ページでは、総パラメータ数、アクティブパラメータ数、レイヤー数、学習 FLOPs は公開されていません。したがって以下の「パラメータ比較」は、架空の数値ではなく公開仕様の比較です。
先に結論
GPT-6 Astra は、対象範囲の広いエンドツーエンドのフラッグシップです。ブラウザーやデスクトップアプリを操作し、複数ツールを調整し、ソフトウェアを編集・テストし、厳格な権限と安全境界のもとで作業する場合の第一候補です。Responses API には、非同期ツール呼び出し、ターン途中のステアリング、キャッシュ済みプロンプト接頭辞を保持した effort 変更が加わりました。
Claude Fable 5.1 も最上位の選択肢であり、GPT-6 の登場で急に旧式になったわけではありません。長期コーディング、調査、文書、表計算、スライドに特に適しています。公式キャッシュ読み取り価格は100万 Token あたり $0.25で、Fable 5 の4分の1、GPT-6 Astra の $1 より安価です。同じコンテキストを何度も読み直す Agent では、単一ベンチマークの勝敗より重要になり得ます。
ワークロードから切り離された「絶対に最高」のモデルはありません。最初の判断基準は次のとおりです。
- 幅広い computer use、ツール連携、コード、科学、安全性が重要な Agent には GPT-6 Astra;
- 長期調査と成果物作成、キャッシュ多用セッション、既存 Claude Messages 統合には Claude Fable 5.1;
- 本当の制約が遅延、スループット、成功タスク単価なら、名前だけで選ばず、再試行、ツールターン、人手レビューを含む全工程を測定する。
公開仕様:判明していることと不明なこと
以下は OpenAI の GPT-6 Astra モデルページ、OpenAI モデルガイド、Anthropic の Fable 5.1 概要と料金文書に基づきます。
| 公開仕様 | GPT-6 Astra | Claude Fable 5.1 | 実務上の読み方 |
|---|---|---|---|
| プロバイダーのモデル ID | gpt-6-astra | claude-fable-5-1 | 正確な ID を使う。製品の愛称は API 契約ではありません。 |
| 公開日 | 2026年9月3日 | 2026年9月1日 | 確認日時点では両方とも現行世代です。 |
| 公開パラメータ数 | 非公開 | 非公開 | 第三者推定を公式事実として扱わないでください。 |
| コンテキストウィンドウ | 1,050,000 Token(1.05M) | 1,000,000 Token(1M) | Astra は公称値で少し大きいが、検索品質はタスク依存です。 |
| 最大出力 | 128,000 Token | 128,000 Token | 出力上限は実質的に同じです。 |
| 信頼できる知識カットオフ | 2026年4月30日 | 2026年6月 | どちらも最新情報の検索を代替しません。 |
| 入力 → 出力 | テキスト・画像 → テキスト | テキスト・画像 → テキスト | この比較ではネイティブ音声・動画出力は記載されていません。 |
| 推論制御 | low、medium、high、xhigh、max | 適応型 Thinking は常時オン、既定 high | プロバイダー間で同じ意味とは限りません。 |
| 標準入力 / 出力 | $10 / $50 / MTok | $10 / $50 / MTok | キャッシュ、Batch、Gateway 修正前の基本料金は同じです。 |
| キャッシュ読み取り | $1 / MTok | $0.25 / MTok | Fable 5.1 の公式 cache hit 単価が低いです。 |
| キャッシュ書き込み | $12.50 / MTok | $12.50(5分)または $20(1時間)/ MTok | 保存時間も含めて比較します。 |
| 長文脈料金 | 入力が272K超:リクエスト全体で入力/キャッシュ2倍、出力1.5倍 | 1M 全体を標準 Token 単価で課金 | 大きなウィンドウでも経済性は同じではありません。 |
| プロバイダー側の提供状況 | Trusted Access から開始し、API と有料 ChatGPT プランへ展開 | Claude API 全顧客とパートナープラットフォーム向けの Active 最新モデル | プロバイダー提供は Modelflare 提供を意味しません。 |
この表から、単に「両方 $10/$50」とする比較が不十分だと分かります。GPT-6 Astra は公称コンテキストが少し大きくツール面も広い一方、Fable 5.1 は繰り返しキャッシュ読み取りが非常に安く、1M 全体が標準料金です。責任を持って比較できるパラメータ数は、どちらも公表していません。
GPT-6 Astra で変わったこと
回答からタスク実行へ
GPT-6 Astra の中心的な進歩はワークフロー実行です。公式文書は複雑な推論、ソフトウェア開発、ブラウジング、computer use、調査、文書作成を用途に挙げます。Responses API では Web 検索、ファイル検索、画像生成、Code Interpreter、Hosted Shell、apply-patch、computer use、MCP、ツール検索、Streaming、Function Calling、構造化出力をサポートします。
新しい API 動作は、1ターンに収まらないタスク向けです。
- 非同期ツール呼び出し:アプリがツールを実行中でもモデルは独立した推論を続け、元の call ID で再開できます;
- ターン途中のステアリング:モデルの作業中に WebSocket で修正を送り、完了済みの作業を保持します;
- 動的 effort:キャッシュ済みプロンプト接頭辞を再構築せず、推論強度を上下できます。
Agent 開発では、制御が「プロンプト全体を再試行」から「境界を保って現在のタスクを継続」へ移ります。ツール実行、権限、タイムアウト、副作用は引き続きアプリの責任です。
Computer use とプロ向け成果物
OpenAI は、Astra が OSWorld 2.0 の offline partial score で72.6%、GPT-5.6 Sol が65.7%であり、この比較でタスク時間が約47%短かったと報告しています。また Codex harness とモデルの改善を組み合わせ、Mind2Web の完了速度が1.9倍になったとしています。これはプロバイダー報告であり、Modelflare の遅延保証ではありません。
想定成果はテキストの段落だけではありません。Astra は既存テンプレートやスタイルに合わせ、文書、表計算、プレゼン、グラフ、Web サイト、テスト済みコードを生成するよう設計されています。UI を確認する、ファイルを更新する、結果を検証するという最後の工程が、中間の推論と同じくらい重要な場合に有効です。
安全性と制御もリリースの一部
GPT-6 Astra は、OpenAI の Preparedness Framework でサイバーセキュリティ能力が Critical に到達した最初のモデルです。ブラウジングや職場環境での prompt injection 耐性、ツール利用推論への本番 misalignment 監視、より厳格な展開隔離も説明されています。
ただし能力と監視可能性は同じ方向にだけ進むわけではありません。OpenAI は GPT-5.6 Sol より重大な misalignment フラグが少なく、許可範囲を守ると報告する一方、監視回避を意図した敵対的テストでは、Astra が書面上の推論をより強く制御できるとも報告しています。本番ではアラインメントは一層にすぎず、最小権限、確認ルール、監査ログ、緊急停止はアプリ側の責任です。
Claude Fable 5.1 が今も異なる点
長期タスク
Anthropic は Fable 5.1 を、長時間の Agent コーディング、多段階調査、文書、表計算、スライド向けの Fable 5 後継と位置付けています。1M 全体は標準料金で、適応型 Thinking は常時オン、effort はプロンプトキャッシュを無効にせず変更できます。高密度グラフ、報告書、PDF 表の視覚処理や、computer use の失敗からの回復も改善されています。
最も明確な経済差はキャッシュ再利用です。読み取りは $0.25/MTok で、Fable 5 は $1 のままです。Anthropic は同じ基礎モデルをより厳しい保護設定の Claude Mythos 5.1 としても提供しますが、Mythos は信頼プログラム限定であり、一般提供される代替ではありません。
API の動作
独自 Messages クライアントでは、Fable 5.1 はモデル名だけの置換ではありません。Anthropic は3つの互換性破壊境界を記載しています。
- tool_choice の any または tool による強制ツール利用は400エラーになります;
- 古い Claude モデルは Fable 5.1 の thinking blocks を読めません;
- 過去メッセージ、system prompt、ツール一覧を編集すると、後続の thinking blocks が無効になる場合があります。
安全な移行は、追記のみの履歴、厳格な schema を使う自動ツール選択、一時指示用のターン限定 system message を採用します。またメッセージ単位 effort、読める進捗更新、content provenance が追加されました。長いループでは、Fable 5 が複数をまとめた場所で1ツールずつ呼ぶ場合があるため、round trip を測定してください。
ベンチマーク比較
以下の値は、利用可能な Anthropic 報告値を含む OpenAI の GPT-6 Astra リリース比較から抜粋しています。現在のフロンティアの形を示すもので、万能ランキングではありません。
| 評価 | GPT-6 Astra | Claude Fable 5.1 | 読み取れること |
|---|---|---|---|
| AutomationBench | 41.4% | 31.4% | この業務ワークフロー評価では Astra が先行。 |
| BenchCAD | 95.9% | 84.3% | 公表された CAD/専門タスクで Astra が先行。 |
| Terminal-Bench 4.0 | 57.9% | 55.8% | 両方強く、Astra が小幅に先行。 |
| DeepSWE v1.1 | 74.1% | 67.4% | このソフトウェア Agent 評価では Astra が先行。 |
| Terminal-Bench Science 0.1 | 64.6% | 52.6% | 科学ワークフローでは Astra の公表差が大きい。 |
| FrontierMath Tier 4 (v2) | 97.6% | 87.8% | この設定では Astra が大きな数学優位を報告。 |
| GPQA Diamond | 96.0% | 93.7% | 両方トップ層で、差は小さい。 |
| Humanity’s Last Exam(ツールあり) | 57.2% | 65.0% | このツール付き評価では Fable 5.1 が先行。 |
| HealthBench Professional | 63.4% | 58.1% | この専門医療評価では Astra が先行。 |
| ExploitGym | 42.4% | 30.4% | Astra の cyber 能力が高い。必ず保護策を使う。 |
| Artificial Analysis Intelligence Index v4.1.1 | 61.2 | 65.7 | リリースが引用した外部指数は Fable 5.1 を支持。 |
例外が重要です。OpenAI 自身の表でも、ツール付き Humanity’s Last Exam と Artificial Analysis Intelligence Index は Fable 5.1 が上です。harness、effort、ツール、タスク変更、安全介入は異なり、一部は直接比較できません。プロバイダーのスコアは特定設定の証拠であり、チーム固有のプロンプトでの勝利を保証しません。
コストとキャッシュの経済性
プロバイダー標準価格では、両モデルとも入力100万 Token が $10、出力が $50 です。差は修正条件に現れます。
- GPT-6 Astra のキャッシュ読み取りは $1/MTok、書き込みは $12.50。Batch と Flex は標準の50%、Fast mode は2倍です。入力が272Kを超えると、リクエスト全体で入力/キャッシュ2倍、出力1.5倍が適用されます。
- Fable 5.1 は読み取り $0.25/MTok、5分と1時間の書き込みが $12.50 と $20。1M 全体は標準料金で、Batch は入力と出力を半額にします。
単純な比較では、キャッシュ済み入力100万 Token の公式価格は GPT-6 Astra が $1.00、Fable 5.1 が $0.25です。10回読むと、出力、ツール、Gateway 割引、再試行前で $7.50 の差です。ただし Fable の完了タスクが常に安いとは限りません。遅いループ、追加ツールターン、長い出力で差が消える場合があります。
単一単価ではなく、タスク全体の式を使います。
タスクコスト = 入力 Token + キャッシュ読み取り + キャッシュ書き込み + 出力 Token + ツールまたはサービス料金
各項に適用価格を掛け、リクエスト数ではなく成功タスク数で割ります。Token 化も異なるため、文字数はプロバイダー横断予算の信頼できる代理ではありません。
ワークロード別の判断表
この表は本記事独自の判断ツールです。公開機能、選定したベンチマーク、料金構造、現在のアクセス境界をまとめたもので、新しいベンチマークではありません。
| ワークロード | 最初の選択 | 理由 | 検証する境界 |
|---|---|---|---|
| 複数ツールを使うブラウザー/デスクトップ | GPT-6 Astra | 広い computer use、非同期ツール、ステアリング、強い OSWorld 報告値。 | 権限、確認規則、遅延、副作用からの回復を確認。 |
| リポジトリ規模のコードと移行 | GPT-6 Astra、Fable 5.1 も有力 | Astra が選定コード評価で先行。Fable は長時間セッションと根本原因修正に強い。 | 同じリポジトリ、テスト、tool loop、rollback を再生。 |
| 調査メモ、表計算、プレゼン | 成果物優先なら Fable 5.1、ブラウザーから成果物なら Astra | Fable は長期知識労働向け、Astra は computer use と文書作成向け。 | 引用の再現、レイアウト、ツールターン、人手修正を比較。 |
| キャッシュを多用する反復コンテキスト | Fable 5.1 | 読み取り $0.25/MTok、1M を標準料金で利用。 | Hit rate、保存時間、Token 数、Gateway 課金を確認。 |
| 安全性が重要な防御的セキュリティ | 承認済み保護策付き GPT-6 Astra | OpenAI は高い cyber 能力と追加監視を記載。 | 許可済み対象、最小権限、監査、人手承認を使用。 |
| 多言語の文章・ローカライズ | 自動的な勝者なし | どちらのリリースも決定的な言語優位を示していない。 | 用語を固定した同一コーパスを各言語で評価。 |
| 高スループットまたは厳格な低遅延 | 小さいモデルが適切な場合あり | 両方 frontier 価格で推論負荷が高い。Fable は遅め、Astra は mode/harness 依存。 | p50/p95、初回出力、成功単価、fallback を測定。 |
2026年9月4日時点のモデル地位
現在の状況は、単一ランキングより2軸の地図として捉える方が正確です。
- GPT-6 Astra は広範なエンドツーエンドのフラッグシップです。 公開 API、computer-use ワークフロー、ツール連携、科学とコードの結果、長文脈、安全制御により、汎用 Agent 作業の最前線にあります。OpenAI の現行ガイドも難しい推論とコーディングの開始点に Astra を挙げます。
- Claude Fable 5.1 は共同先頭の専門型モデルです。 コードと知識作業でフロンティアに残り、一部公開評価で勝ち、特に有利なキャッシュ経済性を持ちます。置き換え待ちの旧モデルではありません。
- 「最良」は作業単位で変わります。 許可されたブラウザータスクなら Astra のツールと安全スタックが優位になり、安定した1M接頭辞を10ターン読み直す調査なら Fable のキャッシュが優位になります。最終成果物では、人手修正時間が素点より重要な場合があります。
- アクセスもモデル地位の一部です。 世界的 frontier モデルでも、特定 Gateway、アカウント、地域、プロトコルでは利用できないことがあります。能力と提供状況は別に確認します。
Modelflare の提供状況と統合境界
Modelflare のライブカタログを 2026年9月4日に https://modelflare.dev/api/pricing で確認しました。当時 claude-fable-5-1 は Anthropic/OpenAI 互換面と3つの公開ルーティンググループに掲載されていました。同じレスポンスに gpt-6-astra はありませんでした。よって本記事は Modelflare 上の GPT-6 アクセスや料金を約束しません。ライブ料金ページとモデル一覧が製品の真実です。
| Modelflare カタログ項目 | 現在の観測 | ユーザー向け入力 / 出力 | 位置付け |
|---|---|---|---|
| claude-award + claude-fable-5-1 | 掲載、倍率0.25× | 1M Token あたり $2.50 / $12.50 | 最安 Fable ルート。再試行可能で変動を許容する作業向け。 |
| claude-stable + claude-fable-5-1 | 掲載、倍率0.315× | 1M Token あたり $3.15 / $15.75 | 日常と本番のバランス型ルート。 |
| claude-premium + claude-fable-5-1 | 掲載、倍率0.5× | 1M Token あたり $5.00 / $25.00 | 安定性優先の Fable ルート。 |
| gpt-6-astra | 確認レスポンスに未掲載 | 確認時点で Modelflare 公開価格なし | カタログと実 Endpoint テストが一致するまでアクセスを固定しない。 |
Fable 5.1 のルート、Messages リクエスト、移行詳細は Modelflare Fable 5.1 徹底分析を参照してください。プロトコル選択には Responses API 移行チェックリスト、Responses API と Chat Completions、信頼できる AI API ルーティングがあります。
GPT-6 Astra が後にカタログへ現れたら、正確な ID gpt-6-astra を使い、グループを確認し、クライアントが必要とする Endpoint をテストします。OpenAI は tool calling に Responses API を推奨し、移行時に temperature や top_p など未対応パラメータを削除するよう案内しています。モデル一覧の成功だけでは Streaming、ツール、構造化出力、computer use を証明できません。
制限、注意点、責任ある利用
- パラメータ不明: 総数とアクティブ数は非公開です。コンテキスト、出力、ベンチマークはパラメータ数ではありません。
- ベンチマークの不確実性: 値はプロバイダー報告またはリリース表です。harness、prompt、effort、ツール、安全フィルター、タスク版で結果は変わります。
- プロトコルの不確実性: 1つの ID は Responses、Chat Completions、Anthropic Messages、Bedrock、Google Cloud、互換層で同じフィールドやイベントを保証しません。
- 鮮度: 両モデルに知識カットオフがあります。最新事実は retrieval を使い、出典日を記録してください。
- 安全: 強いモデルほど影響の大きい誤りを起こせます。ツールを制限し、計画と実行を分離し、不可逆操作に確認を要求し、外部監査を残します。
- 料金とアクセス: 価格、キャッシュ規則、グループ、提供状況は変わります。本番判断直前に公式ページと Modelflare を再確認してください。
よくある質問
GPT-6 Astra は Claude Fable 5.1 より優れていますか? 公開資料では、GPT-6 Astra は computer use、ツール連携、コード、科学の総合フラッグシップです。Fable 5.1 も競争力があり一部評価で先行します。キャッシュ多用の長期知識作業では、Fable が適する場合があります。
GPT-6 Astra のパラメータ数は? 本記事で確認した OpenAI 公式モデル・リリースページは、検証可能な総数またはアクティブ数を公開していません。オンライン推定は公式仕様ではありません。
どちらが安いですか? 基本入力/出力は両方 $10/$50/百万 Token です。Fable 5.1 はキャッシュ読み取りが安く、Astra には Batch、Flex、Fast 修正があります。実コストは Token、cache hit、ツール、遅延、再試行で決まります。
Coding Agent にはどちらが良いですか? ブラウズ、編集、テスト、ツール調整が必要なら GPT-6 Astra から始めます。安定した文脈で長時間動く場合や Claude Messages 契約がある場合は Fable 5.1 を評価します。移行前に同じリポジトリを再生してください。
GPT-6 Astra は Modelflare で使えますか? 2026年9月4日に確認したライブ料金レスポンスには掲載されていませんでした。OpenAI の公式公開と Gateway の提供状況は別の事実です。/pricingとモデル一覧を確認してください。
両方とも 1M コンテキストですか? はい。公式ページは GPT-6 Astra 1.05M、Fable 5.1 1M の1M級ウィンドウを記載しています。料金、Token 化、retrieval、プロトコル制約は異なります。
出典と更新記録
- OpenAI: GPT-6 Astra — A new generation of intelligence
- OpenAI API: GPT-6 Astra モデル
- OpenAI API: GPT-6 Astra モデルガイド
- OpenAI: GPT-6 Astra 安全概要
- Anthropic: Introducing Claude Fable 5.1 and Claude Mythos 5.1
- Claude Platform: Fable 5.1 概要
- Claude Platform: Fable 5.1 の新機能
- Claude Platform: Fable 料金
- Modelflare ライブモデルと料金
更新記録: 2026年9月4日 — 初期公開パッケージ。GPT-6 Astra と Fable 5.1 の公式仕様、比較、料金規則、提供状況を再確認し、同日に Modelflare カタログも確認しました。Fable 5.1 は掲載、GPT-6 Astra は未掲載でした。独立したベンチマーク再現や非公開パラメータ数は主張しません。