Claude Fable 5.1 vs OpenAI Astra(GPT-6候補)|頂上対決を3ラウンドで予想
みやっち🧑💻の予想は「性能の頂上はAstraが取り、財布と手元の頂上はFable 5.1が守る」です。 2026年9月1日(米国時間)、AnthropicがClaude Fable 5.1を発表した2時間半後に、OpenAIが「Astraをまもなく提供する」と公式に表明しました。同じ日に、片方は「今日から使える」、もう片方は「まもなく」という形で、両社の最上位モデルが正面から並びました。この記事では、両社の公式資料・海外の独立評価・予測市場を実際に読んだ上で、性能・提供時期・実務コストの3ラウンドに分けて勝敗を予想します。予想は予想として、公式に確認できた事実・報道・みやっち🧑💻の見立てを文中で分けて書きます。
Claude Fable 5.1とOpenAI Astraの違い: Claude Fable 5.1は、Anthropicが2026年9月1日に一般提供を始めた最上位モデルで、料金は100万トークンあたり入力10ドル・出力50ドル、Pro・Max・Team・Enterpriseの各プランで当日から使える。OpenAI Astraは、OpenAIが「次のメジャーモデル」と位置づける未公開モデルで、2026年9月1日に「まもなく提供する」と公式表明されたが、提供日・料金・製品名(GPT-6になるかどうか)は未発表。公開されている性能数値はサイバーセキュリティと数学の分野に限られる。
同じ日に起きた「一騎打ち」
まず、この2日間に何が起きたかを日本時間で並べます。
| 日本時間 | 出来事 |
|---|---|
| 9月2日 03:03 | Anthropicが Claude Fable 5.1・Mythos 5.1 を発表。「コーディングと知識労働で世界最先端のモデル」と表明 |
| 9月2日 05:30 | OpenAIが公式Xで公式ブログ「Path to Astra」を告知(ブログ本文は05:00頃に公開)。Astraが同社の安全基準で最上位の「Critical」級サイバー能力に達した最初のモデルだと結論づけ、「まもなく提供する」と表明 |
| 9月2日 08:45 | サム・アルトマンCEOがXに投稿。「次のモデルをまもなく出す」「Astraの訓練はしばらく前に終わっている」 |
みやっち🧑💻は7月、OpenAIがGPT-5.6の公開日を予告したときにDiscordで「相手に合わせてられないなというところで、木曜公開ですね。(中略)一騎打ちだ!」と書きました。今回はその再戦です。Anthropicが出した朝、OpenAIが「うちも出す」と重ねる。9月2日の昼にはDiscordに「サム・アルトマンが対抗心むき出しで、Astraそろそろ出すぞと言っております」と書きました。同じ日の午前には、Discordにこうも書きました。「OpenAIとAnthropicの発表は大体深夜2時か3時にあるのですが、これを速報として出すために、30分おきにポーリングしてブログが自動で投稿される仕組みを作りました」。初回の実運用はこれからですが、次の一撃は寝ている間に来ると分かったからです。
対戦カード
| 項目 | Claude Fable 5.1 | OpenAI Astra |
|---|---|---|
| 状態(2026年9月2日) | 一般提供中 | 未公開。公式は「まもなく」 |
| 位置づけ | Fable 5の後継(点更新) | GPT-5.6系とは別の「次のメジャーモデル」 |
| 製品名 | 確定 | 未定(報道ではGPT-6かGPT-5.7系) |
| 提供範囲 | Pro・Max・Team・Enterprise。地域制限の記載なし | 未発表。高度なサイバー機能は当初テスター限定 |
| API料金 | 入力10ドル/出力50ドル、キャッシュ読み取り0.25ドル | 未発表 |
| 公開されている強み | コーディング・科学タスク・長時間のエージェント作業 | 数学の未解決問題、サイバー能力、複数エージェント協調(報道) |
| 安全上の位置づけ | 同社基準で「次のリスク段階には未達」 | 同社基準で「Critical」級(最初の指定) |
| 限定版の有無 | Mythos 5.1(米国の承認組織のみ) | 最上位サイバー機能はテスター→防御者向け段階開放 |
これだけ見ると、片方は「今日使える製品」、片方は「予告」です。だからこそ、ラウンドを分けないと比較になりません。
ラウンド1: 性能。今日測れる頂上はFable 5.1、公開後はAstra優勢と予想
Fable 5.1は、独立評価機関の計測で「これまでで最も高い点」を取っています。 評価機関Artificial Analysisの総合指標では、Fable 5.1(最大思考)が66点で、Claude Opus 5の63点、Fable 5の62点、GPT-5.6 Solの61点を上回り、同社が計測した中で最高点でした。評価機関Vals AIの総合指標でも51モデル中1位です。Anthropic自身の資料では、実務に近いベンチマークでGPT-5.6 Solとの差が大きく開いています。
| ベンチマーク | Fable 5.1 | GPT-5.6 Sol |
|---|---|---|
| SWE-bench Pro(実務のコード修正) | 81.2 | 64.6 |
| Terminal-Bench 4.0(端末操作の自律作業) | 55.8% | 37.3% |
| Terminal-Bench-Science 0.1(科学の複合作業) | 52.6% | 22.4% |
| ARC-AGI-2(未知のパズルへの推論) | 90.0% | 92.5% |
(出典: Anthropicのシステムカード。GPT-5.6 Sol側の値はOpenAI公表値・公開リーダーボードの転記で、Terminal-Bench 4.0のSolはCodex CLIでの計測値)
ただし、全部で勝っているわけではありません。同じAnthropicの表で、ARC-AGI-2はGPT-5.6 Solのほうが上です。「点更新の5.1が、現行のOpenAI最上位に全面勝ち」ではなく、「実務のエージェント作業で大きく引き離し、純粋な推論パズルでは互角以下」と読むのが正確です。
一方Astraは、一般的なベンチマークの数字を1つも出していません。 公開されているのは2種類だけです。1つは8月1日の「長年未解決だった数学・理論計算機科学の10問を内部版が解いた」という発表(当初は「10年以上」と説明されていましたが、一部の数学者から先行研究の扱いに批判が出て、OpenAIは表現を改めました)。もう1つは9月1日のサイバー能力で、既知の脆弱性から攻撃コードを作る評価で100%、評価の途中で未知の脆弱性を2件見つけたと公式が書いています。米TIME誌が8月26日に報じた顧客向けデモでは、16体のエージェントが分担して数学の証明を組み立てる様子が披露されたとされ、アルトマンCEOは「モデルが意味のある形で新しいものを発明する最初のモデルになると期待している」と語っています。
ここからは、みやっち🧑💻の見立てです。Astraが公開されれば、ベンチマークの見出しはAstraが取ると予想します。 理由は3つ。Fable 5.1は「5から5.1」への点更新で総合指標の伸びは4点にとどまること。Astraは「次のメジャーモデル」として世代が1つ違うこと。そしてOpenAIが公式ブログでAstraを「これまでで最もアラインメントの取れたモデル」と書き、アルトマンCEOが「能力とアラインメントの両方で大きな前進」「訓練はしばらく前に終わっている」と明かしていること。訓練を終えたモデルを寝かせてから出す会社が、現行より弱いものを出すとは考えにくい。ただし、AstraとFable 5.1を同じベンチマークで比べたデータは2026年9月2日時点で1つも存在しません。ラウンド1の判定は「今日はFable 5.1、公開後はAstra」です。
ラウンド2: 提供時期と提供範囲。今日使えるFable 5.1の勝ち
Fable 5.1は発表当日から、Claude API・Amazon Bedrock・Google Cloud・Microsoft Foundryのすべてで全顧客に提供されています。 地域制限の記載はなく、Fable 5と同じく日本からも使えます。 Cursor・GitHub Copilot・Google Agent Platformも発売日に対応しました。同じ能力を持つMythos 5.1だけが、サイバー防御と生命科学の承認済み米国組織に限定されています。
Astraは「まもなく」です。 予測市場Polymarketでは、9月1日の公式発表を受けて「9月15日までにAstraを一般提供」が91%、「9月30日まで」が93%まで上がりました(9月2日昼に確認。この市場は一般提供が条件で、テスター限定の提供では「公開」に数えません。別の予測市場Kalshiでも「9月18日まで」が約9割)。一方で同じPolymarketの「GPT-6という名前で9月末までに出る」は57%にとどまり、市場は「Astraは近い」と「GPT-6と名乗るかは別」を分けて織り込んでいます。
ただし、出たとしても「全員に全部」ではないことが公式に書かれています。
- 最上位のサイバー能力は、まず少数のテスター(米フォーチュン誌の報道では米国政府・OpenAIの信頼済みアクセス計画の参加企業・重要インフラを守る組織)に開放し、その後に防御者向けプログラム「Daybreak Blue」経由で広げる
- 公開後は、モデルの思考過程を監視する仕組みが本番で動き、疑わしい動きを検知すると作業を一時停止する。OpenAIは「サイバーと無関係に見える作業や、長時間動くエージェントの作業でも誤って止まることがある」と明記し、ChatGPTやCodexでは再開前にユーザーに確認を求めることがあり、API経由では作業そのものが止まると説明している
- 米政府による公開前レビューの有無は、9月1日の公式文書に記述がなく、米TechCrunchも「不明」としている。米国では2026年6月2日の大統領令で、開発者がモデルを他の信頼できるパートナーへ提供する最大30日前に政府へアクセスを提供する任意の枠組みが作られており、報道ではAstraがその最初の対象になるとされてきたが、一次情報での確認は取れていない
Fable 5.1にも同じ種類の話はあります。Anthropicは安全装置の誤検知をFable 5の発売時と比べてサイバー分野で6割、生物分野で85%減らしたと発表しています(生物分野の改善はFable 5にも8月に適用済み)が、システムカードには「Opus 5の安全装置より作動しやすい」とも書かれています。それでも「今日使える」と「まもなく」の差は埋まりません。ラウンド2は、Fable 5.1です。
ラウンド3: 実務コスト。今日はFable 5.1、公開後は価格勝負と予想
Fable 5.1の料金は入力10ドル・出力50ドル(100万トークンあたり)でFable 5と同額、キャッシュ読み取りだけが1ドルから0.25ドルへ下がりました。 Anthropicは「典型的な作業で約25%、エージェント作業で最大45%のコスト減」と説明しています。Claude Codeで同じファイル群を何度も読み返す長時間作業ほど効く値下げです。Maxプランでは週の利用上限の50%までFable系を追加課金なしで使え、Proプランは従量課金クレジットで使います(Fable 5.1の記事に整理してあります)。
ここで注意が要るのは、「安くなった」の条件です。Artificial Analysisの実測では、最大思考でFable 5.1に1タスク解かせると3.76ドルで、Fable 5より20%高くなりました。出力トークンを約1.7倍使うためです。思考の深さを1段下げた「high」なら1タスク1.43ドルまで下がります。つまりFable 5.1は「深く考えさせるほど高く、キャッシュを使い回すほど安い」モデルで、Anthropic自身が公式ドキュメントで「ほとんどの作業はまずOpus 5から始め、Fable 5.1は要求水準の高い推論と長時間のエージェント作業に使う」と書いているのは、この構造に正直だからです。
Astraの料金は未発表です。 比較の材料は、OpenAIの過去の動き方だけです。OpenAIは7月30日にLunaを80%・Terraを20%値下げし、8月21日には最上位のSolも入力5→4ドル・出力30→20ドルへ期間限定(少なくとも11月21日まで)で下げました。安い階層から順に、最上位にまで値下げが及んでいます。法人カードの支出データを集計する米Ramp社の8月のレポート(7月分)では、米国企業のAI採用率はAnthropic 43.5%・OpenAI 39.7%とAnthropicが先行する一方、Fable 5はAnthropic向け支出の11.4%にとどまり、同社のエコノミストは米TechCrunchの取材に「GPT-5.6 Solは開発者の選択肢になりつつある。Fable 5は価格と、規制当局が課したデータ保持要件のせいで、採用でも実用でも期待外れだった」と述べています。Fable 5.1のキャッシュ値下げ・企業向けのデータ保持の見直し・誤検知削減は、この批判への回答だと、みやっち🧑💻は読んでいます。
みやっち🧑💻の見立てはこうです。OpenAIはAstraを、価格でFable 5.1に競り勝てる形で出す。 OpenAIは8月に最上位のSolまで値下げしており、Fable 5が高さゆえに使われなかったという前例を両社とも見ています。ラウンド3は「今日はFable 5.1、公開後は価格勝負」です。
番外ラウンド: 体力。売上と企業採用はAnthropic、利用者数はOpenAI
モデルの勝負は、次のモデルを作る体力の勝負でもあります。海外報道で確認できた2026年夏時点の数字を並べます。
| 項目 | Anthropic | OpenAI | 出典 |
|---|---|---|---|
| 売上の年換算ランレート | 650億ドル(7月末) | 400億ドル超(8月) | 米TechCrunch(8月17日)・米Bloomberg(8月13日、転載で確認) |
| 直近の企業評価額 | 9,650億ドル(5月) | 8,520億ドル(3月) | 米TechCrunch |
| 米国企業の有料採用率 | 43.5% | 39.7% | Ramp AI Index(8月12日・7月データ) |
| 消費者アプリの月間利用者 | Claude 2.45億人 | ChatGPT 11億人 | Sensor Tower(2026年6月発表・TechCrunch経由) |
計算資源は互角に近づいています。半導体アナリストのディラン・パテル氏は8月25日の対談で「年初はOpenAIが2ギガワット、Anthropicが2ギガワット未満。年末には両社とも5ギガワット超」と見立てています。Anthropicは9月1日にも、Nvidia製GPUのクラスターを借りる350億ドル規模の契約を結んだと報じられました(米WSJ・AFP。契約年数はAFPが6年と報道)。
体力面は、企業向けの売上と採用でAnthropic、一般利用者の数でOpenAI、という分かれ方です。 読者の実務に近いのは前者で、そこではAnthropicが先行しています。ただしRampのデータを一言でいえば、Fable 5は高くて使われなかった。体力があることと、最上位モデルが使われることは別の話です。
予想のまとめと、外れる条件
3ラウンドを通した予想を3行にします。
- Astraは9月中に出る。公式の「まもなく」、訓練完了済み、予測市場の約9割が根拠。出れば、ベンチマークの1位はAstraに移る
- ただし9月中は、Fable 5.1が「今日使える最上位」として独走する。名前が決まっていないモデルを待って仕事を止める理由はない
- 公開後の勝負は価格と「止まらなさ」で決まる。Astraは監視で作業が止まりうると公式が予告しており、Fable 5.1は深く考えさせると高い。読者の業務ではどちらの弱点が痛いかで勝者が変わる
正直に書いておくと、この予想には反対の材料もあります。予測市場Polymarketの「2026年末に最良のAIモデルを持つ企業は?」は、9月2日時点でAnthropic 72%・OpenAI 11%です。市場は「Astraが出てもAnthropicが年末まで頂上を守る」と見ている。ただしこの市場は、利用者の投票で順位が決まるArena(旧LMArena)のテキスト部門で判定されます。そこでは9月1日時点でClaude Fable 5が1位、OpenAIの現行最上位GPT-5.6 Solは16位で、投票型の順位表はもともとClaudeに有利です。みやっち🧑💻はそれでもAstra優勢と予想しますが、次のどれかが起きたら、この予想は外れです。
- 10月に入ってもAstraの一般提供が始まらない
- Astra公開後、Artificial AnalysisやArena(LMArena)などの独立評価でFable 5.1を上回れない
- Astraの料金がFable 5.1より高く設定される
- 逆に、Anthropicが9月中にFable 5.1より上のモデルを出す
両社が同じ方向を向いている: 「減速」を公式に語り始めた
勝敗より大事だと思う変化が1つあります。両社とも、最上位モデルを「出せるだけ速く、全員に」配ることをやめ、減速を公式に語り始めました。
OpenAIは7月、社内のサイバー評価中に社内限定の研究モデルが隔離環境を抜け出し、外部企業のシステムに侵入する事故を起こしました(Astraは関与していないと公式に明記)。これを受けて一部の訓練を2週間止め、監視体制を組み直してから8月28日に大規模な訓練を再開しています。アルトマンCEOは9月1日の投稿で「Astraの後のモデルは、安全とアラインメントの作業が十分にできるよう必要に応じて減速している」と書きました。8月7日には「強力なモデルを選ばれた少数だけに留めるのは良い戦略ではない」とも書いており、それでも当初は限定提供になるところに、この会社の揺れが出ています。
Anthropic側も、8月のリスク報告で自社モデルのアラインメント上の総合リスク評価を「非常に低い」から「低い」へ引き上げ、Fable 5.1のシステムカードでもその評価を維持しています。Mythos 5.1は前世代と同じく承認組織限定のまま。同日に、ゼロデータ保持と悪用検知を組み合わせた企業向けの仕組み(Enterprise Frontier Safeguards・今秋から段階提供)も発表しました。
8月1日のAstra速報で「最上位のAIは作ってすぐ全員に配るものではなくなってきた」と見立てとして書きましたが、1か月で両社の公式行動が裏づけました。恐れる話ではありません。読者の実務にとっては、「使えるモデルの性能は上がり続けるが、最上位モデルは止まったり制限されたりする前提で業務を組む」という事実として受け取るのが正確です。
経営者・個人事業主は今日どうするか
みやっち🧑💻がこの対決から引き出す行動は3つです。
- 乗り換えを待たない。Fable 5.1は今日使えます。ただしAnthropic自身が「まずOpus 5から」と言っている以上、日常の業務はOpus 5、諦めていた難問や数時間かかる作業だけFable 5.1、という使い分けは変えなくていい
- どちらが勝っても動く形にしておく。一騎打ちの勝者を当てても、仕事は速くなりません。効くのは、Claude Code・Codexのどちらでも同じ業務が回る設計です。みやっち🧑💻はファイル操作中心の自動化はClaude Code、画面操作と画像生成はCodexと振り分けていて、片方のモデルが止まっても業務は止まりません。Fable 5が輸出規制で3週間止まったときに、この設計の価値を身をもって知りました
- 新しいモデルが跳ねたときに試すことを、今のうちに棚卸ししておく。Fable 5が出た3日間、みやっち🧑💻は目先のホームページ制作に使ってしまい、本当に試すべきだった「解けないと思っていた課題」に手をつけなかった反省があります。Astraが出た日に同じ後悔をしないよう、「これができたら事業が変わる」という問いを先に書き出しておく
みやっち🧑💻自身の体感も1つ書いておきます。8月18日のDiscordに「こんなこと言いたくはないが、日に日にFable 5は劣化していますね。3週間前みたいな、あの感動はもうないですね。OpenAIのAstraに期待しましょう」と書きました。これはあくまで使い手としての印象で、Anthropicが性能を下げたという事実ではありません。ただ、発表直後の感動が薄れるのは毎回のことで、だからこそ「感動」ではなく「どの業務を任せられるようになったか」で新モデルを測る習慣が要る、というのが今の結論です。
よくある質問
AstraはGPT-6のことですか?
決まっていません。OpenAIの公式文書は一貫して「Astra」と表記し、GPT-6という名前は使っていません。GPT-6として出すかGPT-5.7のようなGPT-5系の名前で出すかは未定という報道(The Information)があり、予測市場も「Astraの提供時期」と「GPT-6という名前で出るか」を別の市場として扱っています。
Astraはいつから使えますか?
公式は「まもなく」としか言っていません。9月2日時点の予測市場では9月中の提供が約9割と見られています。ただし最上位のサイバー機能は当初テスター限定で、一般向けにも監視による一時停止がありうると公式が予告しています。
Fable 5.1とMythos 5.1はどちらが賢いのですか?
同じモデルです。違いは安全装置の設定と提供先で、Mythos 5.1はサイバー防御・生命科学分野の承認済み米国組織に限定されています。経営者・個人事業主・士業・会社員が実務で使えるのはFable 5.1のほうです。詳しくはClaude 5ファミリーの記事にまとめてあります。
いまFable 5.1に乗り換えるべきですか?
claude.aiやClaude Codeで使っている分には、モデルの切り替えに特別な作業は要りません(Claude Codeはバージョン2.1.250以上が必要です)。ただしAnthropic自身が「まずOpus 5から」と案内しているとおり、すべての作業をFable 5.1に移す必要はありません。深く考えさせるほど費用が上がるモデルなので、難問と長時間のエージェント作業に絞るのが実務的です。
一騎打ちの勝者が誰であれ、9月のうちに「今日使える最上位モデル」が1段上がり、まもなくもう1段上がります。そのとき差がつくのは、どちらのモデルを選んだかではなく、自分の業務のどこを任せるかが先に決まっているかどうかです。AI Crewでは、経営者・個人事業主・士業・会社員がClaude Code・Codexのどちらでも回る業務の設計を扱っています。まず無料セミナーでお会いしましょう。




