2026年9月の第1週に、AIの最上位モデルが2つ出ました。9月1日にAnthropicのClaude Fable 5.1、9月3日にOpenAIのGPT-6 Astraです。Xでは「どっちが強いか」の投稿が飛び交っていますが、多くは特定のタスクの一発勝負で、全体像は見えにくい状態です。
この記事では、公式資料と独立した評価機関の数字を軸に、2つのモデルを同じ物差しで並べます。前提として、Anthropic自身はFable 5.1の発表時にAstraと比較していません。比較しているのは9月3日以降の第三者の評価で、数字は評価元によってぶれます。その点を踏まえて読んでください。
情報
GPT-6 Astraそのものの解説は別記事「GPT-6 Astraとは何か」にまとめています。この記事は比較に絞ります。
基本スペックはほぼ同じ
まず公式の仕様を並べます。
| 項目 | Claude Fable 5.1 | GPT-6 Astra |
|---|---|---|
| 発表日 | 2026年9月1日 | 2026年9月3日 |
| 文脈の長さ | 100万トークン | 105万トークン |
| 一回の出力上限 | 12万8千トークン | 12万8千トークン |
| 知識の区切り | 2026年6月 | 2026年4月30日 |
| 入力 | テキスト、画像 | テキスト、画像 |
| 出力 | テキストのみ | テキストのみ |
| 思考の深さの調整 | low から max の5段階、常に思考オン | low から max の5段階 |
長い資料を丸ごと読ませる用途では差がありません。どちらも音声や動画の生成はモデル本体の機能ではなく、ツールを呼び出して行います。
料金は同じ、割引の効き方が違う
開発者向けのAPI価格は、驚くほど同じです。
| 項目 | Claude Fable 5.1 | GPT-6 Astra |
|---|---|---|
| 入力 100万トークン | 10ドル | 10ドル |
| 出力 100万トークン | 50ドル | 50ドル |
| キャッシュ済み入力 | 0.25ドル | 1ドル |
| バッチ処理 | 半額 | 半額 |
違いはキャッシュです。同じ前置き(システムプロンプトや資料)を繰り返し送る使い方では、Fable 5.1のキャッシュ読み取りがAstraの4分の1の価格です。Anthropicは、エージェント的に長く動かす作業なら前モデル比で最大45%安くなるとしています。
一般ユーザーの月額は、どちらも入口が20ドルです。
- ChatGPT Plus 20ドル。Astraは対象だが、提供当初はチャット画面ではなくWorkとCodexから。Astraのメッセージ回数は前モデルの半分程度という報道あり
- Claude Pro 20ドル。Fable 5.1は使えるが、週の利用上限の50%までという条件つき
- 上位は ChatGPT Pro(200ドル)と Claude Max(100ドルから)
どちらも「最上位モデルは使えるが、たっぷりは使えない」設計です。円建ての公式価格は両社ともありません。
得意分野ははっきり分かれる
ここが本題です。公式の数字と独立評価を、勝っている側で分けます。
Astraが明確に強い領域
- 数学。FrontierMath Tier 4で98%と、ほぼ満点
- 抽象推論。ARC-AGI-2でAstra 95.0%、Fable 5.1 90.0%(ARC Prize公式)。ARC-AGI-3の「99.9%」は新方式の数字で、従来方式では63%前後とARC Prize側が公表しています
- セキュリティ。ExploitBenchで100%
- パソコン操作の自動化。OSWorld 2.0で72.6%。ただしAnthropicは別の条件で77.9%を公表していて、測り方が違うので直接は比べられません
- エージェント型コーディングの一部。DeepSWE v1.1でAstra 74.1%、Fable 5.1 67.4%(第三者集計)
Fable 5.1が強い領域
- 総合指標。Artificial AnalysisのIntelligence IndexでFable 5.1が上位。数字は集計時点で変わるので順位だけ参考に
- コーディングエージェント指標。同じくArtificial Analysisで Fable 5.1 70、Astra 67
- 難問集。Humanity's Last Exam(ツールあり)でFable 5.1 65.0%、Astra 57.2%
- 科学系の端末操作。Terminal-Bench-Scienceは公式発表でFable 5.1 52.6%(前モデル比で倍増)。ただし後日の別テストでAstra 64.6%という報道もあり、条件が違います
結局どっちが賢いんですか?
「難問を一発で解く力」はAstra、「長い作業を安定して回す力」はFable、というのが独立評価の大まかな結論です。総合点は僅差で、集計サイトによって順位が入れ替わります。
速度と体感
Artificial Analysisの計測では、出力速度はほぼ同じ(Fable 5.1が毎秒68トークン、Astraが63トークン)で、最初の応答までの時間はFable 5.1の方が短いとされています。実際の利用者からは、Astraは確認の質問を返しすぎて作業が止まる、Fable 5.1は思考を深くすると料金が跳ね上がる、という不満がそれぞれ出ています。
注意
日本語の文章品質については、どちらのモデルも体系的な評価が見つかりませんでした。個人ブログの感想はありますが、断定できる材料はありません。日本語で使う人は自分の用途で試すのが確実です。
安全対策の考え方が対照的
性能以上に差が出るのが安全性の設計です。
Fable 5.1は、Claude Mythos 5.1と同じモデルに安全分類器を重ねたものです。サイバー攻撃や生物学の危険な依頼を検知すると、断るのではなく一段下のOpus 5に静かに切り替えて答えます。誤検知は前モデル比でセキュリティ分野が60%減、基礎的な生物や医学の質問が85%減とされています。分類器を外したMythos 5.1は、審査を通った米国の組織にだけ提供されます。
GPT-6 Astraは、OpenAIの基準で「サイバー能力が重大」と判定された初のモデルで、高度なセキュリティ機能は審査済みの利用者に限定されます。さらにOpenAIは、モデルの思考過程が以前より監視しにくくなったと自ら公表しました。監視されていると分かると振る舞いを変える傾向がテストで見つかったためです。
どちらも「危険な能力は選ばれた人にだけ」という点は同じで、違うのは公開している弱点です。Anthropicは分類器の誤検知率を、OpenAIは監視のしにくさを、それぞれ数字で出しています。
-
Claude Fable 5.1 / Mythos 5.1 発表
Fableは一般提供、Mythosは審査制。キャッシュ読み取り価格を75%引き下げ。
-
GPT-6 Astra 発表
サイバー能力「重大」の初のモデル。思考過程の監視性低下をシステムカードで公表。
-
第三者の比較が出そろう
Artificial Analysis、ARC Prize、各メディアが両モデルを同じ条件で計測し始める。
初心者はどう選ぶか
用途で決めるのがいちばん失敗しません。
- 文章作成、調べもの、日常の相談が中心なら、どちらでも差はありません。すでに契約している方を続けてください
- コーディングをAIに任せたいなら、Claude Codeという専用ツールがある分、Claude側の環境が整っています。ただしFable 5.1は上限に当たりやすいので、普段はOpus 5、難所だけFableという使い分けをAnthropic自身が勧めています
- 数学の難問や、パソコンの画面操作を自動化したいなら、Astraの得意領域です
- 両方を20ドルずつ契約して、行き詰まったら片方に投げる。開発者の間ではこの使い方が最も多く報告されています
ヒント
「Fableが飽きられてAstraに移った」という空気はSNSの温度感で、報道や評価機関の数字には現れていません。選択肢が2つに増えただけで、乗り換えの義務はありません。
よくある質問
無料で使えるのはどちらですか?
どちらも無料プランでは使えません。ChatGPTの無料とGo、Claudeの無料プランは対象外です。
APIで安く使うコツはありますか?
同じ前置きを繰り返す処理はキャッシュが効くFable 5.1が有利です。一括で処理できる作業はどちらもバッチ処理で半額になります。
ベンチマークの数字が記事ごとに違うのはなぜですか?
測定方式、思考の深さの設定、評価した日付が違うためです。この記事では公式発表とARC Prize、Artificial Analysisの数字を優先し、条件が違う場合はその旨を書いています。
Mythos 5.1は一般の人でも使えますか?
使えません。サイバーや生命科学の審査を通った米国の組織向けで、Anthropicは国際展開を政府と調整中としています。
まとめ
Claude Fable 5.1とGPT-6 Astraは、仕様も基本料金もほぼ同じで、得意分野だけが違う2つのモデルです。難問と自動操作ならAstra、長い作業とコーディングエージェントならFable 5.1。安全対策はどちらも厳しく、公開している弱点の種類が違います。
AIを使い始めたばかりなら、いま契約している方をそのまま使い、行き詰まったときにもう片方を試すくらいの距離感で十分です。
公式の一次情報
Anthropic の Claude Fable 5.1 発表と、OpenAI の GPT-6 Astra 発表。ベンチマークの条件はそれぞれの公式ページで確認できます。
Claude Fable 5.1 の発表を見る


