live
10 labs · 30 models
すべての記事
約11分で読めますChatPlus Team

GPT-6 Astra:あなたの代わりにコンピューターを操作するOpenAIの新フラッグシップ

2026年9月3日、OpenAIはGPT-6 Astraを発表し、「世界で最も賢く、最もアラインされたモデル」と呼びました。宣伝文句はいったん脇に置き、Astraが実際に何をできるのか、本当に先行している領域はどこか、独立テストで熱気が冷めた点は何か、そしてChatPlusでいち早く試す方法を見ていきましょう。

モデルOpenAIGPT-6ニュース
ほぼ黒の背景に浮かぶ、青緑に光るクリスタル — GPT-6 Astra記事のカバーアート
記事を聴く00:00

2026年9月3日、OpenAIは新たなフラッグシップモデル、GPT-6 Astraをリリースしました。発表で使われた言葉は、その野心の大きさをそのまま映していました。「世界で最も賢く、最もアラインされたモデル」。さらに同社社長のGreg Brockmanは、ブリーフィングの締めくくりに、のちに誰もが引用することになる一言を残しました。「AGIの時代へようこそ」。大きな話に聞こえます。ですが、華々しい演出を取り払い、実際に何が変わったのかを見てみると、広告コピーよりもずっと興味深く、そして率直な姿が見えてきます。

要するに、Astraは「より賢く答えるGPT」ではありません。これは、あなたのコンピューター上で作業そのものを実行するモデルへの転換です。ここは、平易に掘り下げる価値があります。

中核にある考え方:答えるのではなく、行動する

これまでの世代は、質問に対して誰が最も賢い返答をできるかを競っていました。Astraが競っているのは別の点です。人間に逐一確認を求めず、タスクを最後までやり切れるかどうかです。OpenAIは率直にこう言っています。コンピューターであなたができることは、モデルがあなたの代わりにできる、と。

実際には、こう動きます。Astraは画面を見て、一連の操作を計画し、ブラウザを開き、クリックし、入力し、結果を確認します。そして目標が達成されるまで繰り返します。デモでは、フォームへの入力、CRMのレコード更新、カレンダーの整理、オンラインでの情報検索、その情報を文書やメールへ落とし込む作業などをこなしています。シンプルなWebサイトを作り、UIチェックを実行し、プログラムをインストールしてテストし、画面上に表示されているエラーをデバッグすることもできます。Power BIやエンジニアリング用エディタのようなプロ向けソフトウェアも扱えるとうたっています。

ここでのキーワードはエージェントです。モデルは、質問に対してコード片を返すだけではありません。目標を与えられると、必要なツールを自分で判断し、手順を進めていきます。「デジタルワーカー」という話が出てくるのはこのためです。Astraは、高機能なオートコンプリートというより、プロセスを任せられるオペレーターに近い存在です。

内側の仕様

スペックは堅実です。ただし、驚きがあるほどではありません。

ParameterValue
Context約1,050,000トークン
Max output最大128,000トークン
Inputテキストと画像
Knowledge cutoff2026年4月末
API identifiergpt-6-astra

100万トークンのコンテキストがあれば、リポジトリ全体や大部のレポートを一度に扱えます。興味深いことに、ローンチ前には150万トークンという噂もありましたが、実際のウィンドウはそれより控えめなものになりました。ツール面では、Web検索、ファイル操作、コード実行、先ほどのコンピューター操作、そしてMCP経由での外部サービス接続に対応します。ただし、メインのエンドポイント経由での音声・動画入力はまだ受け付けていません。対応するのはテキストと画像のみです。

Astraが本当に先行している領域

ではベンチマークを見ていきましょう。ここで大切なのは、すべてをうのみにするのではなく、本当のブレークスルーとマーケティングを切り分けることです。

明確にリードしている領域はあります。第一に、コンピューター操作とエージェント型シナリオです。まさにそのために作られたモデルであり、関連テストでははっきりと首位に立ち、しかも前世代のフラッグシップより目に見えて速く回答します。第二にサイバーセキュリティで、ここでの数字は本当に記録的です。既知の脆弱性を実際に機能するエクスプロイトへ変換できるかを調べるExploitBenchテストで、Astraは**100%**を記録しました。前世代のフラッグシップであるGPT-5.6 Solは78.5%でした。このためOpenAIは、自社モデルとして初めて、社内リスク尺度で「critical」の評価を付けました。さらにテスト中、Astraはそれまで知られていなかったゼロデイ脆弱性を2件、自力で発見したとされています。

第三の強みは数学と科学です。Astraは難関ベンチマークFrontierMath Tier 4でほぼ「天井」に達し、過酷なARC-AGI-3では99.9%を記録しています。わずか1年前には到達不能に見えた水準を考えれば、これは見事です。

そして熱気が冷めた部分

リリースの翌日、独立した測定結果が出てきました。そして雰囲気は少し落ち着きました。Artificial Analysisの総合的な汎用知能指数では、最大設定のAstraは前世代のフラッグシップであるSolとおおむね同程度のスコアで、Claude Opus 5やFable 5.1のような競合には後れを取っています。一方でコストは高く、入力100万トークンあたり約10ドル、出力100万トークンあたり50ドル。Solのおよそ2.5倍です。

そのため、多くのアナリストがたどり着いた冷静な結論はこうです。これは「すべてを上回る」万能の飛躍ではありません。 汎用知能における進歩はほとんど目立たないにもかかわらず、価格はプレミアムです。本当の改善は、コンピューター操作、サイバーセキュリティ、エンジニアリング系タスクに絞られています。久しぶりに、新世代が「賢く、かつ安く」なることはありませんでした。そしてその事実自体が、現在の可能性のフロンティアがどこにあるのかを物語っています。

別の論点として、モデルの安全性と「透明性」も議論されています。OpenAIは、専門的なテストにおいてAstraが制御しにくくなっていることを認めました。推論の連鎖において、以前のバージョンよりも開示する情報が少なくなる場合があるというのです。一方、一般公開版はエクスプロイトの作成をきっぱり拒否します。高度なサイバー能力は、審査済みのセキュリティ専門家向けの別プログラムの内側に閉じられています。言い換えれば、その能力の最も鋭い部分は、通常のユーザーから意図的に遠ざけられているのです。

では、これはAGIなのか?

Brockmanの「AGIの時代」という発言は、測定された事実ではなく、企業としての立場です。そのように読むべきです。本人も慎重に留保を付けていました。この言葉の定義は曖昧で、判断は人それぞれだ、と。独立した数値を見る限り、このモデルは「全領域で人間レベルの知能」に達してはいません。特定の種類のタスクでは強力ですが、かつて万能の優位性が期待された領域では普通です。

Astraを表すなら、スローガンよりもリストのほうが誠実です。コンピューター操作とサイバーセキュリティでのブレークスルー、汎用知能では横ばい、プレミアム価格、そして自律型エージェントへ向けた明確な一歩。これは重要なリリースです。ただし、看板文句ではなく実力によってそう言えるリリースです。

ChatPlusでGPT-6 Astraを試す方法

そして、ここからは良い知らせです。OpenAIはアクセスを段階的に、かつ条件付きで展開しています。ChatGPT本体では、このモデルはGPT-6 Proという名称でPro、Business、Enterpriseの各ティア向けに有効化されていますが、一般向けのPlusプランではまだチャットで利用できません。APIでも段階的に提供されます。さらに、プランや地域によって利用可否にばらつきが出ることもあります。

私たちはローンチ直後にGPT-6 AstraをChatPlusへ追加しました。そのため、OpenAIの新フラッグシップをいち早く試せます:GPT-6 Astraでチャットを開く。このモデルはMaxプランで利用できます。これは意図的な判断です。Astraは運用コストが高いため、ほかの最上位モデルと同じく最上位ティアに配置しました。また、GPT-5.6、Claude、Geminiと1つの画面で比較するのも簡単です。会話の中でモデルを切り替えながら、どれがあなたのタスクを最もうまくこなすか確認できます。

まとめ

GPT-6 AstraはOpenAIの新しいフラッグシップです。そして最大のポイントは、「より賢く答える」ことではなく、「コンピューターを自分で操作する」ことです。ブラウザ、フォーム、コード、長い複数ステップのタスクを扱います。コンピューター操作、サイバーセキュリティ、科学の領域では本当に先行しています(ExploitBenchで100%、難しい数学でもほぼ上限)。一方で、汎用知能については独立テストで前世代と同等とされ、価格は約2.5倍です。「AGIの時代」という話はOpenAIの立場であり、測定された事実ではありません。ChatPlusでは、AstraはすでにMaxプランで利用可能です。いち早く試すことができます。

ChatPlusで最高クラスのAIモデルを試す

GPT、Claude、Gemini、GLMなどのAIモデルをひとつの画面で使えます。