GPT-6 Astra登場:何が変わり、誰が使え、チームは何を先に試すべきか

初期提供は限定的です。まずコンピューター操作、長時間タスク、費用、承認境界を検証します。

Buda Team
ブログに戻る
GPT-6 Astra登場:何が変わり、誰が使え、チームは何を先に試すべきか

GPT-6 Astra登場:何が変わり、誰が使え、チームは何を先に試すべきか

OpenAIがGPT-6 Astraを正式に発表しました。

注目すべき点は、ベンチマークの数字だけではありません。Astraは実際のソフトウェアを操作し、長時間のタスクを追跡しながら、文書、表計算、プレゼンテーション、Webサイトなどの成果物を作る方向へ進んでいます。

ただし、発表日に全員が使えるわけではありません。まず一部の組織に提供され、ChatGPTの有料プラン、API、AWSには数日かけて展開されます。チームが最初にすべきことは、既定モデルの一括置換ではなく、実務タスクによる評価です。

GPT-6 Astraとは

OpenAIはAstraを、難しいエンドツーエンド業務向けの旗艦モデルと位置づけています。主な領域は、コンピューターとブラウザー操作、ソフトウェア開発、専門文書、科学研究、サイバーセキュリティです。

APIのモデルIDはgpt-6-astraです。テキストと画像を入力でき、function calling、Web Search、File Search、Computer Use、MCP、Skills、Shell、Apply Patchなどを利用できます。

API仕様は105万トークンのコンテキストと12.8万トークンの最大出力です。OpenAI APIのStandard価格は、100万トークンあたり入力10ドル、出力50ドル、キャッシュ入力1ドルです。

これはOpenAIの上流API価格であり、BudaのCreditsやユーザー価格ではありません。

GPT-6 Astra APIのコンテキスト、最大出力、OpenAI上流価格

回答から実行へ

OpenAIは、フォーム入力、CRM更新、カレンダー整理、Webサイトの作成とQA、データ分析、既存テンプレートに沿った文書やスライド作成を例として示しています。

OpenAIのOSWorld 2.0シミュレーションでは、Astraは72.6%を約40分で達成し、GPT-5.6 Solは65.7%を約75分で達成しました。狙いは文章品質だけでなく、実際のソフトウェアで仕事を完了する能力と速度です。

これらはOpenAIが公表した結果であり、Budaによる独立試験ではありません。権限、環境、データ、タスク設計、合格基準によって実運用の結果は変わります。

誰が利用できるのか

発表時点では一部の組織から提供が始まります。OpenAIは数日以内にChatGPT Plus、Pro、Business、Enterprise、OpenAI API、AWSへ広げるとしています。

Pro、Business、EnterpriseにはGPT-6 Astra Proも提供されます。Enterpriseでは管理者による有効化が必要で、初期状態ではオフです。

正式発表と、自分のアカウントに表示される時期は同じとは限りません。

GPT-6 Astraが一部組織から有料プラン、API、AWSへ段階展開される流れ

すべての処理をAstraにしない

AstraはClaude Fable 5.1と同じ公開10ドル/50ドル帯です。大量の抽出、整形、単純分類に常用するモデルではありません。

次のような仕事で候補に入れるのが合理的です。

  • 安価なモデルでは多段階タスクが繰り返し失敗する
  • 実際のソフトウェア上で実行と検証が必要
  • 大量の文脈と複数ツールを同時に扱う
  • モデル費用より手戻りの費用が大きい
  • 顧客、業務システム、重要な意思決定に影響する

最初に行う5つのテスト

  1. 結果が分かっている実務タスクを10〜30件用意し、初回合格率、修正回数、時間、失敗理由を測る。
  2. ファイル、Webサイト、ツール、操作の権限を明示し、送信、更新、削除、公開前の確認を検証する。
  3. 長いタスクの途中で要件を追加し、元の目的と合格条件を保持できるか確かめる。
  4. 安全確認で一時停止した場合に、状態を確認して安全に再開できるか試す。
  5. ツール、失敗、再試行、レビュー、手戻りを含む「合格タスクあたりの費用」を計算する。

合格タスクの総コスト = モデル + ツール + 失敗実行 + 再試行 + レビュー + 手戻り

GPT-6 Astraを実務タスクで評価する五つのチェック

能力が上がるほど制御が重要になる

AstraはOpenAIで初めてサイバーセキュリティ能力がCritical基準に達したモデルです。通常版は高度な攻撃用途を拒否し、一部の防御機能はDaybreakなどの管理された制度で提供されます。

同時に、システムカードは、全体的なアラインメント評価が改善する一方、監視回避を指示した対抗試験では、書かれた推論がGPT-5.6 Solより監視しにくいと報告しています。

境界違反が減ったという結果だけで、権限、確認、監査を外すべきではありません。ブラウザーやターミナル、業務システムを操作するAgentでは、周囲の運用設計が制御を担います。

GPT-6 Astraの実行能力を権限、確認、監視、人のレビューで囲む

Budaを使うチームへの意味

GPT-6 Astraは、AIがチャットから実行へ移る流れを強めます。しかしモデルだけでは、完全な作業環境にはなりません。

永続ファイル、ツール、履歴、権限、実行の可視性、人によるレビューが必要です。BudaはBrowser、Terminal、Git、Drive、Session、レビュー可能な成果物を通じて、この運用層を提供します。

GPT-6 Astraは、まだBudaでは利用できません。提供開始後の対象範囲とCreditsは、Budaのモデル一覧と公開料金ページで案内します。

関連:AI Agentに適したモデルの選び方AI Agent Workspaceとは

FAQ

GPT-6 Astraは一般提供されていますか

発表時点では限定提供です。有料ChatGPTプラン、API、AWSには数日かけて展開されます。

API価格はいくらですか

Standardの上流価格は100万トークンあたり入力10ドル、出力50ドル、キャッシュ入力1ドルです。長い入力、Fast、Batch、Flex、ツールには別の条件があります。

コンテキストはどれくらいですか

105万トークン、最大出力は12.8万トークンです。大きなコンテキストは永続メモリと同義ではありません。

Claude Fable 5.1より優れていますか

すべての用途に共通する答えはありません。自社のタスク、ツール、合格基準で比較してください。

Budaで使えますか

まだ利用できません。今後の提供状況とCreditsは、Budaのモデル一覧と公開料金ページで確認できます。

出典