GPT-6 Astraが登場:OpenAIの新しい最先端モデルがRunableのUltraモードで利用可能に

by Eshaan Pawan
Summarize with:
GPT-6 Astraが登場:OpenAIの新しい最先端モデルがRunableのUltraモードで利用可能に

主要なポイント

  • OpenAIは2026年9月3日、世界で最も知的で整合性のとれたモデルと称するGPT-6 Astraをリリースしました。コンピュータ使用、ソフトウェアエンジニアリング、科学、専門的な知識労働において最先端の性能を誇ります。
  • AstraはFrontierMath Tier 4で98%、ARC-AGI-3で99.9%、ExploitBenchで100%という驚異的な数値を記録し、Terminal-Bench ScienceではClaude Fable 5.1を上回りつつ、推定APIコストを約31%削減しました。
  • GPT-6 AstraはRunableですぐに利用可能です。モデルセレクターで「Ultra」を選択すれば、エージェントがAstraをバックエンドに使用して計画・構築を行います。
  • AstraはOpenAIのモデルとして初めて重要なサイバーセキュリティ基準に達したため、その高度なサイバー能力はDaybreakプログラムを通じて承認された防御側のみに限定されています。

AnthropicがClaude Fable 5.1をリリースした2日後、OpenAIが回答を出しました。2026年9月3日、同社はGPT-6 Astraをリリースしました。これは新しい世代のインテリジェンスであり、Greg Brockmanの言葉を借りれば、AGI時代の幕開けとなるモデルです。大胆な表現はさておき、ベンチマークの数値は本物であり、コンピュータ使用能力の向上は今年リリースされた中で最大であり、このモデルはすでにRunableのUltraモード内で利用可能になっています。

本記事では、GPT-6 Astraとは何か、どの分野で他を圧倒しているのか、どこにアクセス制限があるのか、そしてRunableで今日から活用する方法について解説します。

9月3日にOpenAIがリリースしたもの

GPT-6 AstraはGPT-5.6 Solの後継であり、OpenAIのGPT-6世代における最初のモデルです。リリース当日は限られた組織向けに展開され、その後数日間でChatGPT Plus、Pro、Business、Enterpriseの全ユーザーに加え、OpenAI API、Microsoft Azure、AWS Bedrockでも順次利用可能になりました。

Image

OpenAIが掲げる最大の主張は、Astraがこれまでで最も知的で、かつ最も整合性のとれたモデルであるという点です。知性の面は事前学習と強化学習の進歩に支えられています。整合性の面は、従来の形式的な説明よりも興味深いものになっています。OpenAIはHugging Faceでのインシデントを教訓とした新しい評価基準を構築し、不可能に近いタスクに直面したモデルが許可された範囲を逸脱するかどうかをテストしました。本番環境の保護措置がない状態のGPT-5.6 Solでは、48%の確率で承認範囲外のターゲットにまで踏み込んでいましたが、Astraでは0%でした。エージェントに実務を委任するユーザーにとって、この数字は能力スコアと同様に重要です。

API価格は入力100万トークンあたり10ドル、出力100万トークンあたり50ドルで、キャッシュされた入力は100万トークンあたり1ドルです。Solと比べると高価ですが、OpenAIはベンチマークのコスト曲線を用いて、Astraは少ないトークン数と少ない再試行でより多くの作業を完了できるため、コストパフォーマンスは高いと主張しています。

ベンチマークの状況

Astraのスコアは「飽和状態のベンチマーク」と「新たなフロンティア」の2つのグループに分類できます。

飽和状態のグループは目を見張るものがあります。Astraは研究レベルの数学問題で構成されたFrontierMath Tier 4で98%を記録し、すでに数学の未解決問題の解決に寄与しています。ARC-AGI-3では99.9%に達し、ARC Prize Foundationによると、レベルの96%で人間の行動効率のベースラインを上回り、実質的に人間と同等のレベルに到達しています。ExploitBenchでは100%を記録しました。

競争が激しいのはAnthropicとの比較対象となる分野です。エージェントがコードやターミナルツールを通じて科学的ワークフローを実行できるかをテストするTerminal-Bench Science 0.1において、Astraは64.6%を記録し、Claude Fable 5.1の52.6%を上回りながら、推定APIコストは約31%低くなっています。実社会の複雑な専門的タスクをカバーするAgents' Last Examでは、Astraは59.3%を記録し、Claude Opus 5の55.5%やSolの53.6%を上回り、かつOpus 5よりも出力トークン数を約65%削減しました。モデルがCADコードを書いて3Dオブジェクトを再構築するBenchCADでは、Astraは95.9%に達し、Fable 5.1の84.3%を大きく引き離しました。

精度と同時に速度も向上しました。OSWorld 2.0での遅延シミュレーションにおいて、Astraはタスクあたり約40分で72.6%を記録しましたが、Solはタスクあたり約75分で65.7%でした。更新されたCodexハーネスと組み合わせると、Mind2Webにおいて、現在のSolと比較して1.9倍高速にタスクを完了できるとOpenAIは測定しています。

世界最高のコンピュータ使用モデル

今回のリリースの最大のテーマはコンピュータ使用です。Astraは実際のソフトウェアを操作します。フォームへの入力、CRM記録の更新、カレンダーの管理、ブラウザを通じたリサーチ、メールやドキュメントエディタでの草案作成、構築したWebサイトのフロントエンドQA実行、画面に表示されている内容のトラブルシューティングなどを行います。

OpenAIのデモ動画を見るとその点が具体的に分かります。AstraはKiCadでプリント基板のレイアウトを行い、回路図を製造可能な基板に変換します。Excelのモデリング、Form 1040への記入、法的文書のフォーマット、Power BIダッシュボードの構築、DMV(車両管理局)の予約などにも対応します。これらは以前なら人間がマウスを動かす必要があった、面倒で負荷の高いタスクです。

プロフェッショナルな成果物を作成するために、OpenAIはAstraに対してテンプレートへの準拠を特に強化して学習させました。既存のスライドテンプレートに従い、文章と視覚スタイルを一致させ、重要なコンテキストのみを成果物に盛り込みます。初期の顧客からも反響が寄せられています。Cognitionはローンチ当日にDevinへAstraを統合し、社内ベンチマークで最先端の結果が出たと述べています。また、HiggsfieldはAstraが最も複雑なクリエイティブ・ワークフローを代替手段よりも最大20%少ないトークン数で実行できると報告しています。

安全性のハードル:重要なサイバー能力

Astraは、OpenAIのPreparedness Framework(準備態勢フレームワーク)に基づくサイバーセキュリティ能力の「重要(Critical)」レベルに達した最初のモデルです。この指定はリリース前から影響を及ぼしました。OpenAIは8月7日の時点でAstraに重要なサイバー能力がある可能性があると判断し、すべての推論に対して監視要件を追加し、開発とリリースの一部を遅延させました。

その実際の結果が段階的なアクセス権です。一般に提供されるモデルには、サイバーセキュリティタスクに対する堅牢な保護策が施されています。その最も高度な攻撃的セキュリティ能力は、OpenAIのDaybreakプログラムを通じて承認されたサイバーセキュリティ防御側のみに限定されています。通常のソフトウェアエンジニアリングや研究、ビジネス上のタスクであれば、制限を感じることはありません。セキュリティチームであれば、Daybreakが申請の窓口となります。

RunableでGPT-6 Astraを使う方法

Runableは、今週初めに登場したClaude Fable 5.1に続き、モデルセレクターの最上位 tierであるUltraモードにGPT-6 Astraを追加しました。使い方は以下の通りです。

まず、Runableで新しいタスクを開き、入力バーのアーティファクトセレクターとモード切り替えの隣にあるモデルセレクターを見つけます。「Ultra」を選択してください。上位モデルはタスクあたりのクレジット消費量が多い代わりに推論能力が高く、UltraモードではAstraを含む最先端モデルをエージェントに指示できます。

次に、Runableでの構築と同様に、タスクを自然な言語で記述します。フルスタックWebサイト、財務モデル、調査レポート、スライドデッキなど、何でも構いません。Astraの強みは、Runableでよく使用される出力タイプ、特に長期にわたる多段階の作業、ドキュメントの多い分析、または自身のQAを通過する必要があるコードなどと直接的に合致しています。

最後に、同じチャット内で確認と修正を行います。ワークフローの他の部分は何も変わりません。プランモード、スキル、コネクタ、メモリ、ロールバック、ブランチ機能は、選択したモデルの階層に関係なく同じように機能します。

この組み合わせが理にかなっているのには理由があります。AstraはOpenAIがリリースした中で最も強力なコンピュータ使用およびエージェント向けモデルであり、Runableはモデルが実際にサンドボックス、ツール、そして長時間におよぶ自律性を得られるエージェントプラットフォームだからです。チャットウィンドウだけでAstraを動かすと、その価値のほとんどを活かしきれません。委任された作業のために構築された環境で実行して初めて、ベンチマークでの性能向上が完成した成果物として現れます。Runableには無料プランがあり、Proプラン(月額20ドル)が最も人気で、ヘビーユーザー向けにはMaxプラン(月額100ドル)が用意されています。

AstraとClaude Fable 5.1、どちらを選ぶべきか?

正直な答えは、今週リリースされた2つの優れたモデルはどちらもRunableのUltraモードで利用できるため、どちらか一方に固執する必要はない、ということです。

Astraの強みはコンピュータ使用、速度、そして最先端におけるコスト効率です。Terminal-Bench ScienceやBenchCADではAstraが勝利し、OSWorldのタスクをSolが必要とした時間の約半分で完了します。一方、Fable 5.1は、最初の数日間の実績から、長いコーディング実行におけるスタミナと根本原因分析の正確さで評価されており、他のモデルでは解決できなかった数日間にわたる自律セッションや珍しいバグの追跡において成功を収めています。

妥当な使い分けとしては、実際のソフトウェア操作、ドキュメント、スプレッドシート、構造化された成果物が多いタスクにはAstraを、深く長期的なコードベースの作業にはFable 5.1を選択するのが良いでしょう。あるいは、Runableのチャットフォーク機能を使用して、同じプロンプトを両方のモデルで実行し、良い結果を採用することも可能です。

これらのモデルを日々の業務でどこで動かすか検討中であれば、Runable vs ChatGPT比較がエージェントプラットフォームが標準的なチャットインターフェースに何を加えるかを説明しています。特にデザインやドキュメントのワークフローを検討しているチームには、Runable vs Canvaの分析が役立ちます。また、ツールからエージェントへのシフトをより広く理解したい場合は、エージェントがツールを置き換えている理由が参考になります。

FAQ

GPT-6 Astraとは何ですか?

GPT-6 Astraは、2026年9月3日にリリースされたOpenAIのフラッグシップモデルです。OpenAIは、コンピュータ使用、ソフトウェアエンジニアリング、サイバーセキュリティ、科学、専門的な業務において最先端の結果を出し、FrontierMath Tier 4やARC-AGI-3で飽和スコアを記録するなど、世界で最も知的で整合性のとれたモデルであると称しています。

RunableでAstraにアクセスするにはどうすればよいですか?

タスクを送信する前に、Runableの入力バーにあるモデルセレクターで「Ultra」を選択してください。UltraはLite、Pro、Maxモデルの上位階層であり、GPT-6 Astraが含まれています。プランモードからロールバックまでのワークフローはすべてそのままです。

GPT-6 AstraのAPI料金はいくらですか?

OpenAIはAstraを、入力100万トークンあたり10ドル、出力100万トークンあたり50ドル、キャッシュされた入力は100万トークンあたり1ドルに設定しています。OpenAIは、Astraはタスクあたりの必要なトークン数と時間が少ないため、実質的なタスク完了コストは古いモデルよりも安くなることが多いと主張しています。

なぜ一部のAstraの機能に制限があるのですか?

Astraは、Preparedness Frameworkに基づくサイバーセキュリティの「重要」基準に達した最初のOpenAIモデルです。最も高度な攻撃的セキュリティ能力は、Daybreakプログラムを通じて承認された防御側のみに限定されており、すべての推論に対して安全性の監視が追加されています。日常的なコーディングやビジネス上の利用には影響ありません。

AstraはClaude Fable 5.1より優れていますか?

作業内容によります。Astraはコンピュータ使用、プロフェッショナルなドキュメント、コスト効率の面でリードしており、Terminal-Bench Scienceではより低いコストでFable 5.1を上回ります。Fable 5.1は長期的な自律コーディングに優れています。どちらもRunableのUltraモードで利用できるため、実際のタスクで比較してみてください。

関連資料

RunableのUltraモードでGPT-6 Astraを試す

最先端モデルが何を変えるかを体感する最も速い方法は、チャットではなく実務を任せてみることです。Runableを開き、モデルセレクターをUltraに切り替えて、通常なら午後を丸ごと使ってしまうような作業(動くアプリの開発、スプレッドシートのモデル構築、調査レポートの作成など)をAstraに指示してみてください。無料で始められ、アップグレードはワンクリックで完了します。

Filed underLaunch
Written byEshaan Pawan

既存のアイデアから始める

1文あれば、すぐに始められます。

無料で始める