GPT-6 Astraが登場。Fable 5.1・GPT-5.6 SOLと比べて期待していること

明るい木の机で、複数の星から一つの明るい星へ針を向ける真鍮の天体観測器と3枚の作業カードを描いた水彩イラスト

OpenAIは2026年9月3日、新しい最上位モデル「GPT-6 Astra」を発表しました。

僕が気になっているのは、調べものやコードの修正、資料作りといった作業を、どこまで続けて任せられるのかという点です。

発表では、一部の組織から提供を始め、Plus・Pro・Business・EnterpriseやAPIなどへ数日かけて広げると案内されています。僕はまだAstraを使えていませんが、公開された仕様や評価を見ながら、Fable 5.1・GPT-5.6 SOLとの違いを見ていきます。

GPT-6 Astraは、複数の作業を続けて進めるモデル

OpenAIは、Astraを同社で最も高性能なモデルと紹介しています。Webで調べた内容を資料にまとめたり、コードを書いて動作を確かめたりと、いくつもの手順がある仕事を得意とするモデルです。

文書・表・スライドを、既存のテンプレートや文体に合わせて作れる点も特徴です。

APIに加わった「Async tool calling」は、外部ツールの結果を待っている間に、別の作業を進められる機能です。たとえば、一つのツールが処理をしている間も、ほかのツールを呼んだり、先に考えられる部分に取りかかったりできます。

もう一つの「Mid-turn steering」では、AIが作業している途中でも追加の指示を送れます。それまでの作業や最初の目的を踏まえて、続きを進められる仕組みです。

作業を見ているうちに「ここは変えたい」と思うこともあります。そこで希望を伝えられるのは助かりそうです。

GPT-5.6 SOLと比べると、料金は2.5倍

まずは、GPT-5.6 SOLとの違いから。

AstraとSOLは、どちらも105万トークンのコンテキストと12.8万トークンの最大出力に対応しています。扱える情報量と、一度に出せる回答の上限は同じです。

大きく違うのはAPI料金で、Astraは入力・出力ともにSOLの2.5倍になります。

項目 GPT-6 Astra GPT-5.6 SOL
入力料金 10ドル 4ドル
キャッシュ読み取り 1ドル 0.40ドル
出力料金 50ドル 20ドル
コンテキスト 105万トークン 105万トークン
最大出力 12.8万トークン 12.8万トークン
思考量 low・medium・high・xhigh・max none・low・medium・high・xhigh・max

※料金は100万トークンあたり。GPT-5.6 SOLの入力4ドル/出力20ドルは、少なくとも2026年11月21日までのプロモーション料金です。AstraとSOLは、入力が27.2万トークンを超えると、そのリクエスト全体の入力料金などが上がります。

OpenAIが公開した性能テスト(ベンチマーク)では、次のような差が出ています。

評価 GPT-6 Astra GPT-5.6 SOL
AutomationBench 41.4% 18.1%
Terminal-Bench 4.0 57.9% 37.3%
DeepSWE v1.1 74.1% 72.7%
Terminal-Bench Science 0.1 64.6% 22.4%

DeepSWEではSOLも近いスコアですが、複数の工程を進めるAutomationBenchや、科学分野の作業を測るTerminal-Bench Scienceでは差が開いています。

気になるのは、この差でやり直しや人の修正がどれくらい減るのかです。単価が高くても、少ないやり取りで仕上がれば、かかる時間や料金を抑えられるかもしれません。

この考え方は「AIモデル選びを『仕事が終わるまで』で考える」でも紹介しています。

Claude Fable 5.1とは、キャッシュの料金に差がある

Claude Codeを使っているなら、AnthropicのClaude Fable 5.1との違いも気になるところです。

AstraとFable 5.1は、APIの入力・出力料金が同じです。扱える情報量や最大出力にも、大きな差はありません。

違いがあるのは、以前に入力した内容を再利用する「キャッシュ」の読み取り料金です。Fable 5.1はAstraの4分の1なので、APIで同じ資料を何度も使い、キャッシュが効く場面では、この単価の安さが役立ちそうです。

項目 GPT-6 Astra Claude Fable 5.1
入力料金 10ドル 10ドル
キャッシュ読み取り 1ドル 0.25ドル
出力料金 50ドル 50ドル
コンテキスト 105万トークン 100万トークン
最大出力 12.8万トークン 12.8万トークン

OpenAIが公開した評価では、以下の4項目すべてでAstraがFable 5.1を上回りました。

評価 GPT-6 Astra Claude Fable 5.1
AutomationBench 41.4% 31.4%
Terminal-Bench 4.0 57.9% 55.8%
DeepSWE v1.1 74.1% 67.4%
Terminal-Bench Science 0.1 64.6% 52.6%

Terminal-Bench 4.0では僅差ですが、自動化や長時間のソフトウェア開発を測るテストでは、もう少し差が出ています。

ただ、これはOpenAIが公開した数字です。各スコアは思考量の設定を変えた中での最大値で、研究環境やAPIでの結果を含みます。ChatGPTCodex・Claude Codeで使うときには、こちらの指示や使えるツール、作業環境によっても結果が変わります。

Astraが使えるようになったら試したいこと

まず試したいのは、SOLで何度も修正が必要だったコードの実装です。Astraならどこまで進められるのか、同じ作業を任せて比べてみたいです。

途中で方針を変えたくなるような、大きな作業も試したいですね。追加の希望を伝えたときに、すでにできている部分を生かしながら、最初に頼んだことも忘れずに進めてくれるかが気になります。

PC操作にも期待しています。OpenAIがOSWorld 2.0で行った時間のシミュレーションでは、AstraはSOLより高い成績を出しながら、1件あたりの時間を約47%短縮しました。

ブラウザで設定を変えたあと、正しく反映されたかを確認し、必要ならやり直す。こうした一連の操作を、実際にどのくらい速く進められるのか見てみたいです。

資料作りやWebサイト制作では、既存の形式に合わせて、見た目と内容を確認するところまで任せられるかも確かめたいと思っています。提出や公開の直前まで仕上げてくれるなら、自分で手を入れる時間を減らせそうです。

SOLやFable 5.1も、作業に合わせて使い分けたい

普段のコード修正や調べものがSOLで進んでいるなら、引き続きSOLを使う選び方もあります。扱える情報量の上限はAstraと同じで、APIの入力・出力単価は60%安く済みます。

同じ資料を繰り返し使い、キャッシュを多く利用するなら、Fable 5.1の読み取り料金の安さも魅力です。実際にかかる金額は、キャッシュがどれだけ使われるかや、入出力の量によって変わります。Fable 5.1の変更点は「Claude Fable 5.1がリリース」で紹介しています。

使えるようになったら、完成までの時間と、こちらから修正を頼む回数を比べてみたいです。そのあたりを見ながら、Astraを使う場面を考えていこうと思います。

参考リンク

※仕様・料金・提供状況は2026年9月4日時点の情報です。性能評価はOpenAIが公開した数値であり、実際の結果は利用環境や設定によって異なります。

サイト内検索