目次
GPT-6 Astraとは、OpenAIが2026年9月3日に公開した最上位のAIモデルで、公式には「もっとも困難な、最初から最後まで通しの仕事のために作られた、当社でもっとも高性能なモデル」と位置づけられています。 単価は100万トークンあたり入力10ドル・出力50ドルで、これは前世代の上位モデルGPT-5.6 Solの約2.5倍にあたります。公開初日の提供は限定的で、公式は「Trusted Access Programに参加する企業向けに本日ロールアウトを開始し、APIとPlus・Pro・Business・Enterpriseプランでの提供は今後数日以内」と記載しています。この記事では、OpenAIの公式ドキュメント・変更履歴と、同日公開されたMicrosoftのFoundry向け告知を一次情報として、料金・スペック・できること/できないこと・使えるようになる時期・競合モデルとの違いを整理します。
GPT-6 Astraとは何か — 「答えを返す」から「仕事を仕上げる」へ
OpenAIがこのモデルの説明で前に出しているのは、賢さそのものより通しでやり切る力です。公式ドキュメントは用途として「複雑な推論・コーディング・コンピュータ操作・リサーチ・文書作成」を挙げ、Microsoftの告知は「解決策の定まっていない課題を受け取り、複数のステップで考え、計画を立て、仕上がった成果物を出す」ように設計されたモデルだと説明しています。
つまり従来の大規模言語モデルの使い方——質問し、答えをもらい、その答えを人間が実行に移す——ではなく、調査から資料作成までを1本の依頼で通すことを想定した製品です。ツール利用とコンピュータ操作(画面を見て操作する機能)がその中核にあたります。
料金はいくらか
OpenAIのAPI標準価格は次のとおりです(いずれも100万トークンあたり・米ドル)。
| モデル | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| GPT-6 Astra | 10 | 1 | 50 |
| GPT-5.6 Sol | 4 | 0.4 | 20 |
| GPT-5.6 Terra | 2 | 0.2 | 12 |
| GPT-5.6 Luna | 0.20 | 0.02 | 1.20 |
キャッシュ入力が入力の10分の1である点は、どのモデルでも共通で、実務では効きます。システムプロンプトや参照ドキュメントのように毎回同じ内容を送る部分はプロンプトキャッシュの対象になるため、入力側の実効単価は設計次第で大きく変わります(なおキャッシュへの書き込みは、キャッシュなしの入力単価の1.25倍=100万トークンあたり12.50ドルで課金されます)。
公式の価格表には標準以外の区分もあります。バッチ処理(Batch)とFlexは標準単価の50%、逆に高速モード(Fast mode)は該当する単価の2倍です。急がない集計・要約・分類はBatchに回し、人が待っている対話だけ標準で動かすと、同じモデルでも実効単価を大きく下げられます。
なお表のGPT-5.6 Solの単価は、公式に「少なくとも2026年11月21日まで有効」と注記されたプロモーション価格です。それ以降の比較は改定後の単価で引き直す必要があります。
27.2万トークンを超えると単価が上がる
見落としやすいのが長いプロンプトへの割増です。公式ドキュメントは「入力27万2,000トークンを超えるプロンプトは、リクエスト全体について入力とキャッシュの単価が2倍、出力の単価が1.5倍で課金される」と明記しています。GPT-6 Astraなら入力20ドル・出力75ドルに跳ね上がる計算です。この規定はGPT-5.6系にも共通で、105万トークンという文脈の広さを使い切る前提の設計にすると、単価表の見た目より請求が膨らみます。
Microsoft Foundry経由は「文脈の長さ」で単価が変わる
同じ2026年9月3日、MicrosoftもFoundryでのGPT-6 Astra提供を告知しました。こちらの価格表は、上の割増ルールをあらかじめ「短い文脈」「長い文脈」という別区分の単価として掲示しているのが特徴で、さらにデータの置き場所(Data Zone)でも単価が変わります。
| 提供区分 | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| Standard Global(短い文脈) | 10.00 | 1.00 | 50.00 |
| Standard Global(長い文脈) | 20.00 | 2.00 | 75.00 |
| Standard Data Zone 米国(短い文脈) | 11.00 | 1.10 | 55.00 |
| Standard Data Zone 米国(長い文脈) | 22.00 | 2.20 | 82.50 |
Microsoftの告知には短い文脈と長い文脈を分ける具体的なトークン数の記載がなく、本記事の執筆時点(2026年9月4日)では未確認です。ただし長い文脈の単価(入力20ドル・出力75ドル)はOpenAI直販の割増(入力2倍・出力1.5倍)を適用した値と一致するため、境界も27万2,000トークンである可能性が高いと見ておくのが自然です。長い資料をまるごと渡す使い方を前提に見積もるなら、入力20ドル・出力75ドルのほうで概算しておくのが安全側です。月額の試算は生成AI API料金計算ツールに単価と利用量を入れると出せます。単価表の全体像と削減の定石は生成AI APIのコスト管理入門にまとめています。
主要スペック
| 項目 | 値 |
|---|---|
| モデル名(API) | gpt-6-astra |
| コンテキストウィンドウ | 105万トークン |
| 最大入力 | 92万2,000トークン |
| 最大出力 | 12万8,000トークン |
| 知識のカットオフ | 2026年4月30日 |
| 推論の深さ | low / medium / high / xhigh / max |
コンテキストの広さはGPT-5.6系(いずれも105万トークン)と同じで、Astraの差分は文脈量ではなく中身の処理能力という設計です。知識のカットオフが2026年4月30日である以上、それ以降の製品情報や法改正は必ず外から与える必要があります。この点はRAGや検索ツールの併用で補います。
できること・できないこと
公式ドキュメントが対応・非対応を明記しているので、そのまま整理します。
| 内容 | |
|---|---|
| 対応 | 推論の深さの指定、ストリーミング、構造化出力、関数呼び出し、ファイル検索、画像入力、Web検索、プロンプトキャッシュ |
| 非対応 | リアルタイム系エンドポイント、Assistants API、ファインチューニング、埋め込み、画像の生成・編集、音声処理、モデレーション、旧completionsエンドポイント |
加えて、GPT-5.6までと挙動が変わる制約が3つあります。
- 推論の深さに
none(考えずに即答する設定)を指定できない temperature・top_p・対数確率のカスタム値を渡せない- ツール呼び出しはResponses APIのみ。Chat Completionsからは使えない
既存の実装をそのまま差し替えると、この3点で動かなくなる可能性があります。同日には「長時間かかる作業のための新しい制御」もResponses APIに追加されており、非同期のツール呼び出し・途中での方向修正・会話の途中で推論の深さを変える操作ができるようになりました。長く走らせるAIエージェントとしての使い方を前提にした更新です。ツール接続の共通規格であるMCPを含め、外部システムとつなぐ設計が実用性を左右します。
いつから使えるか
公式の記載を、意訳せずそのまま引きます。
GPT-6 Astra is rolling out today for enterprises in our Trusted Access Program, with access through API and our Plus, Pro, Business and Enterprise plans coming in the coming days.
日本語にすると「Trusted Access Programに参加する企業向けに本日ロールアウトを開始し、APIおよびPlus・Pro・Business・Enterpriseプランでの提供は今後数日以内」です。一般提供の日付は明示されていません。Microsoft Foundryも同様に「Foundry限定アクセスプログラムを通じて本日ロールアウトを開始し、参加顧客へ今後数日で拡大」としています。
つまり2026年9月4日時点では、一般の法人が申し込んですぐ使える状態ではありません。導入検討は「今すぐ移行」ではなく「提供開始に備えた見積もりと検証計画づくり」の段階です。
9月5日時点の続報
公開から2日たった9月5日時点でも、一般提供は始まっていません。OpenAIの製品ページは提供経路を次のように書いており、AWS Bedrockが3つ目の経路として明記されています。
GPT‑6 Astra is rolling out today to a limited set of organizations and over the coming days will become available to all ChatGPT Plus, Pro, Business, and Enterprise users, as well as through the OpenAI API, Microsoft Azure, and AWS Bedrock.
ChatGPT側のリリースノート(9月3日付)も「Access is rolling out to a limited set of organizations. Astra is not yet generally available. Broader availability is planned over the coming days.」と、限定提供のままであることを明記しています。
同じリリースノートには運用上見落とせない一文があります。Astraには指示の解釈ミスを検知する追加の安全監視が組み込まれており、疑わしいケースが検知されると「会話が一時停止または停止されることがある(the conversation may be paused or stopped as a precaution)」と書かれています。業務フローに組み込むなら、途中で止まったときに人が確認して再開する手順まで含めて設計しておく必要があります。本記事は一般提供が始まった時点で更新します。
最小の呼び出しコード(Responses API)
一般提供後に最初に動かすコードは、次の形になります。GPT-5.6までのコードと違うのは、推論の深さに none を渡せないこと、temperature などのサンプリング設定を渡さないこと、ツールを使うならResponses APIで呼ぶことの3点です。
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6-astra",
reasoning={"effort": "medium"}, # low / medium / high / xhigh / max。none は不可
input="添付の議事録から、決定事項と担当者と期限を表にまとめてください",
)
print(response.output_text)
Web検索やコンピュータ操作を使わせるときは、同じ responses.create に tools を渡します(公式ドキュメントの対応ツールは web_search・code_interpreter・computer_use など)。Chat Completions側でもテキストの応答は返りますが、ツール呼び出しは使えないため、エージェント用途ならResponses APIに寄せて実装するのが近道です。
Claude Fable 5.1との違い
同じ最上位帯にAnthropicのClaude Fable 5.1がいます。単価は入力10ドル・出力50ドルで完全に同額のため、価格では差がつきません。
| GPT-6 Astra | Claude Fable 5.1 | |
|---|---|---|
| 入力 / 出力(100万トークン) | 10ドル / 50ドル | 10ドル / 50ドル |
| コンテキスト | 105万トークン | 100万トークン |
| 最大出力 | 12万8,000トークン | 12万8,000トークン |
| 提供状況(2026年9月5日) | 限定提供(一般提供前) | 提供中 |
比較軸になるのは単価ではなく、①コンピュータ操作をどこまで任せられるか ②既存のコードや業務システムとの接続のしやすさ ③今使えるかどうか、の3点です。OpenAIが製品ページで公表している比較値は次のとおりです。いずれもOpenAI自身の報告値で、比較対象と設定はOpenAIが選んだものです。
| ベンチマーク(内容) | GPT-6 Astra | 比較対象 |
|---|---|---|
| Terminal-Bench Science 0.1(コードと端末で研究作業を完了できるか) | 64.6% | Claude Fable 5.1: 52.6% |
| Agents’ Last Exam(実際の業務ソフトでの専門タスク) | 59.3% | Claude Opus 5: 55.5% / GPT-5.6 Sol: 53.6% |
| OSWorld 2.0(コンピュータ操作。所要時間の推定込み) | 72.6%・約40分/タスク | GPT-5.6 Sol: 65.7%・約75分/タスク |
Microsoftの告知自体が「性能はタスク・ツール・設定・安全機構によって変わる」と注記しているため、自社の業務での検証が前提になります。
導入を判断する手順
- 現行モデルでの失敗率とやり直し回数を測る。ここが小さいなら乗り換える理由はありません
- 通しでやり切らせたい仕事だけを切り出す。分類・要約・抽出はGPT-5.6 Terraなどの中位モデルで足ります
- 月額差を計算する。入力2,000・出力500トークンの処理を月1万回動かす場合、Astraは入力200ドル+出力250ドルで月450ドル、Solなら入力80ドル+出力100ドルで月180ドルです
- キャッシュ対象を洗い出す。毎回同じシステムプロンプトを送っているなら、その分は10分の1になります。単価が上がるほど自社運用との比較も現実味が出るため、量が多い処理はローカルLLMとAPIの損益分岐点も併せて検討してください
- 提供開始後に小さくPoCを回す。知識カットオフ以降の情報を扱う業務では、検索や社内文書の接続まで含めて検証します
よくある失敗
- 「最上位だから全部これで」で置き換える。分類や定型応答まで移すと、単価だけ4〜40倍になって効果は変わりません。用途ごとにモデルを分けるのが基本です
- 短い文脈の単価だけで見積もる。Foundry経由で長い資料を渡す使い方だと、入力単価が2倍になります
- 発表内容を「もう使える」と読む。2026年9月5日時点でも限定提供で、社内展開の日程を発表日基準で引くと確実にずれます
- 止まらない前提で自動化する。安全監視で会話が一時停止・停止されることがあると公式に書かれているため、無人のバッチ処理に組み込むなら停止時の再開手順が要ります
- 既存コードの差し替えだけで済むと考える。ツール呼び出しがResponses API限定のため、プロンプトの作りより先に接続方式の見直しが要ります
- 知識カットオフを確認しない。2026年5月以降の生成AI関連の動きは、モデル自身は知りません
出典: OpenAI製品ページ(GPT-6 Astra: A new generation of intelligence)、ChatGPTリリースノート 2026年9月3日、OpenAI公式モデルドキュメント(GPT-6 Astra)、OpenAI API変更履歴 2026年9月3日、Microsoft Azureブログ(2026年9月3日)
よくある質問
GPT-6 Astraの料金はいくらですか?
OpenAIのAPI標準価格は100万トークンあたり入力10ドル・出力50ドル、キャッシュ済みの入力は1ドルです。前世代の上位モデルGPT-5.6 Sol(入力4ドル・出力20ドル)のおよそ2.5倍で、Anthropicの最上位Claude Fable 5.1(入力10ドル・出力50ドル)と同じ価格帯に並びました。ただし入力27万2,000トークンを超えるプロンプトは、リクエスト全体について入力とキャッシュが2倍・出力が1.5倍で課金されるため、実質は入力20ドル・出力75ドルになります。Microsoft Foundry経由ではこれが「短い文脈」「長い文脈」という別区分の単価として掲示されています。
いつから誰でも使えますか?
公式の表記は「Trusted Access Programに参加する企業向けに本日ロールアウトを開始し、APIおよびPlus・Pro・Business・Enterpriseプランでの提供は今後数日以内(coming days)」です。つまり2026年9月3日の公開時点では限定提供で、一般提供の具体的な日付は公表されていません。9月5日時点でもChatGPTのリリースノートは「まだ一般提供ではない(not yet generally available)」のままです。提供経路はOpenAI API・Microsoft Azure(Foundry)・AWS Bedrockの3つが公式に挙げられています。
GPT-5.6 Solから乗り換えるべきですか?
分類・要約・抽出のような定型処理は乗り換える理由が乏しく、単価だけが2.5倍になります。乗り換えが見合うのは、複数ステップを自分で計画して最後までやり切らせたい仕事(調査からレポート作成まで、画面操作を伴う作業など)です。まず現在の処理をSolのまま計測し、失敗率とやり直し回数がコスト差を上回っているかを確かめてから判断してください。
GPT-5.6までと同じコードで動きますか?
そのままでは動かない部分があります。公式が明記している制約は3つで、①推論の深さ(reasoning effort)にnoneを指定できない、②temperature・top_p・対数確率(logprobs)のカスタム値を渡せない、③ツール呼び出しはResponses APIのみでChat Completionsでは使えない、です。またリアルタイム系・Assistants API・ファインチューニング・埋め込み・画像生成・音声処理には対応していません。
コンテキストはどれくらい入りますか?
コンテキストウィンドウは105万トークンで、内訳は最大入力92万2,000トークン・最大出力12万8,000トークンです。知識のカットオフは2026年4月30日なので、それ以降の出来事は検索ツールなどで外から与える必要があります。日本語はおおむね1文字が1トークン強なので、92万トークンはおよそ70万〜80万字が目安です。