公開日: 最終更新:
公式ドキュメント・公式発表などの一次情報を確認したうえで、株式会社Nexaが執筆・更新しています。AIツールの仕様や料金は変わることがあるため、導入判断の前に各公式サイトの最新情報もご確認ください。運営会社について
OpenAIは2026年8月7日、次期モデルAstraのサイバー能力がCritical級に達する可能性を否定できないと発表し、2026年9月1日に確定、9月3日に「GPT-6 Astra」として提供を開始しました。
- 要点1: 2026年8月8日時点では「確定ではなく暫定」でしたが、9月1日にOpenAIが確定を発表しました
- 要点2: 高度なサイバーセキュリティ機能は当初一部のテスターに限定し、Daybreak Blue経由で順次拡大しています
- 要点3: 企業はAIエージェントを最小権限で運用し、監視と承認の仕組みを整える必要があります
対象: AIエージェントを導入・運用する経営者、DX推進、情報システム担当者
今日やること: AIが接続できるネットワーク、ツール、秘密情報を棚卸しする
確認日:2026年10月2日(本文の公式情報は各公式ページで確認)
【2026年10月2日追記】 本記事は2026年8月8日の公開時点の内容を基にしています。OpenAIは2026年9月1日、追加評価の結果としてAstraのサイバー能力が「Critical」しきい値を満たすと確定したと発表し、2026年9月3日に「GPT‑6 Astra」として提供を開始しました(高度なサイバーセキュリティ機能へのアクセスは当初一部のテスターに限定し、Daybreak Blue経由で順次拡大)。確定後の内容は「今後の焦点は公開条件と外部評価」の章で解説しています。
OpenAIは2026年8月7日、開発中の次期モデル「Astra」について、サイバーセキュリティ能力が同社の基準で最上位の「Critical」に達する可能性を否定できないと発表しました。
Astraの開発を全面停止したわけではありません。OpenAIが止めたのは、強化したセキュリティ要件をまだ満たしていない一部の社内活動です。
この発表は、AIエージェントの能力向上に合わせて、企業側も実行環境と権限管理を見直す必要があることを示しています。
OpenAIがAstra関連の一部社内活動を停止
OpenAIの公式発表によると、直近の社内評価でAstraのエージェント型コーディングとサイバーセキュリティ能力が大きく向上しました。
エージェント型コーディングとは、AIが指示を受けてコードを生成するだけでなく、ツールを操作し、複数の工程を自律的に進める仕組みです。能力が高まるほど、防御側の脆弱性調査に役立つ一方、攻撃の速度と規模を拡大するおそれもあります。
OpenAIは暫定評価と専門家の判断から、AstraがCritical級の能力を持つ可能性を排除できないと結論づけました。そのうえで、安全要件を満たさないAstra関連の社内活動を一時停止しています。
2026年8月8日の発表時点では、一般提供日、APIの利用条件、価格は発表されておらず、「すでにCriticalと確定した」「公開が中止された」と解釈するのは正確ではありませんでした。その後の経緯を次の表に整理します。
| 項目 | 2026年8月8日時点 | 2026年10月2日時点(確定後) |
|---|---|---|
| 能力評価 | 「Critical」を否定できない(暫定) | 2026年9月1日に「Critical」しきい値を満たすと確定 |
| 一般提供の時期と対象 | 未発表 | 2026年9月3日に「GPT-6 Astra」として提供開始。Plus・Pro・Business・Enterpriseの各ChatGPTプランとAPI、Azure、Bedrockへ順次拡大 |
| 高度なサイバー機能へのアクセス | 未発表 | 当初は一部テスターに限定し、Daybreak Blue経由で防御目的の利用を拡大 |
| API料金 | 未発表 | 標準料金は入力100万トークンあたり10ドル・出力50ドル |
Critical級サイバー能力とは何か
OpenAIのPreparedness Frameworkは、高度なAI能力を評価し、必要な安全策と公開判断を定める枠組みです。
サイバー領域のCriticalは、次のいずれかに達する能力として定義されています。
- 人の介入なしに、堅牢な実システムで幅広い深刻度のゼロデイ脆弱性を特定し、機能するエクスプロイトを開発する
- 高水準の目的だけを与えられ、堅牢な標的への新しい攻撃戦略を一から組み立てて実行する
ゼロデイ脆弱性とは、開発元が修正を提供する前の未知または未修正の欠陥です。エクスプロイトは、その欠陥を実際に悪用するコードや手順を指します。
OpenAIは、従来モデルのGPT-5.6-SolをCriticalではなくHighと評価していました。Astraの暫定評価は、モデルの能力段階が変わりつつある可能性を示します。
この時点のOpenAIの表現は「Criticalを否定できない」という暫定評価であり、確定判定とは区別されていました。2026年9月1日、OpenAIは追加のベンチマークと専門家主導の評価を踏まえ、Astraが実際にCriticalしきい値を満たすと結論づけたと発表しています。これはOpenAIがこのレベルに指定した初のモデルです(Astraへの道:重大な能力とフロンティア安全対策)。
GPT-5.6-Solを含むChatGPTのモデル変更はこちらの記事で解説しています。
OpenAIが導入した5つの安全措置
OpenAIはAstraの能力を抑えるだけでなく、開発と評価を行う環境の管理を強化しています。公式発表にある対策は、次の5群に整理できます。
| 安全措置 | 公式発表の内容 | 企業運用への置き換え |
|---|---|---|
| 実行環境の隔離 | 隔離テスト環境とサンドボックス | 本番環境から分離した検証環境を使う |
| 接続先の制限 | ネットワークとツールへのアクセス制限 | 必要なAPIとシステムだけを許可する |
| 資産の保護 | モデル重みの保護と暗号化 | 認証情報、ソースコード、顧客データを分離する |
| 常時監視 | 危険行動とミスアラインメントを監視 | 操作ログを保存し、異常時に自動停止する |
| 外部評価 | 政府機関とAI安全組織が評価 | 第三者レビューと侵入テストを実施する |
OpenAIは、Astraを使う全エージェント型アプリケーションで危険行動を監視すると説明しています。監視機構はモデルの思考過程を評価し、高リスク活動を検知するとレビューと中断を開始します。
これは、モデル単体の安全性だけでは足りないことを意味します。モデルが動く環境、接続できる道具、監視する仕組みを組み合わせて管理する必要があります。
2026年9月1日の追加発表では、安全対策を強化した結果としての実測値も公開されました。サイバー関連の不正な依頼を拒否する割合は91.5%(強化前のGPT-5.6-Solは59%)、既知の脆弱性からエクスプロイトを開発する能力を測るベンチマーク「ExploitBench」ではAstraが100%のスコアを記録しています。
企業のAIエージェント運用への影響
企業が学ぶべき点は、「高性能モデルを使わない」ことではありません。高性能なAIエージェントに、業務上必要な範囲だけを実行させる設計です。
たとえば、社内システムの調査を任せるエージェントに、本番データベースの書き込み権限まで与える必要はありません。コードレビュー用のエージェントにも、インターネット全体への通信や本番秘密鍵へのアクセスを常時許可する理由はありません。
運用では、次の順序が現実的です。
- 読み取り専用の小規模な業務で試す
- 接続先を許可リストで限定する
- 書き込みや外部送信の前に人の承認を置く
- 操作ログと入力・出力を監査できる状態にする
- 異常時に認証情報を失効し、処理を止める手順を決める
過去のAIサイバー評価でも、評価環境と権限設計の不備が実システムへの影響につながりました。Claudeのサイバー評価で起きた事例はこちらで解説しています。
AI導入に関するお困りごとは、株式会社NexaのAI顧問がサポートします。「何から始めればいいか分からない」という段階からご相談いただけます。
企業が今すぐ確認すべき5項目
Astraが一般提供されるまで待つ必要はありません。現在利用しているAIエージェントも、同じ統制の考え方で点検できます。
1. ネットワークとツール権限
AIが接続できるドメイン、API、クラウド環境を一覧化します。不要な接続先を閉じ、管理者権限を通常運用から外します。
2. 本番環境との分離
検証用データとサンドボックスを用意します。本番への変更は、承認済みのデプロイ工程を通す設計にします。
3. 秘密情報の管理
APIキーや認証情報をプロンプトに直接書かず、短期間で失効する認証方式や秘密管理サービスを使います。ログに秘密情報が残らない設定も必要です。
4. 監視と人の承認
外部送信、削除、購入、権限変更など、影響が大きい操作には人の承認を置きます。通常と異なる連続操作を検知したら自動停止させます。
5. インシデント対応
停止、認証情報の失効、ログ保全、影響範囲の確認、関係者への報告を手順化します。担当者が不在でも動けるよう、連絡先と判断基準を文書に残します。
この5項目は、モデル名が変わっても使える管理単位です。新モデルの性能比較だけでなく、運用側の制御が追いついているかを同時に評価します。
今後の焦点は公開条件と外部評価
2026年8月8日時点で保留されていた項目(能力評価の確定、一般提供の時期と対象、高度なサイバー機能へのアクセス、API料金)は、前述の表のとおり、その後の公式発表でおおむね解消されました。
詳細はOpenAIの公式発表(Astraへの道:重大な能力とフロンティア安全対策、GPT-6 Astra:新世代の応答性能)で確認できます。GPT-6 Astraの企業での使い方・料金はこちらの記事で解説しています。
Xでは、Astraへの公式言及をまとめた速報投稿が、2026年8月8日13時22分時点で135いいね、23リポストを集めました。発表直後から関心は高く、その後の確定発表によって導入条件が明確になっています。
\ AI活用の「次の一手」を一緒に考えませんか /
AI顧問の無料相談はこちらよくある質問
Q. OpenAI Astraはいつ利用できますか?
2026年8月8日時点では未発表でしたが、2026年9月3日にOpenAIは「GPT-6 Astra」として提供を開始しました。Plus・Pro・Business・Enterpriseの各ChatGPTプランとOpenAI API、Microsoft Azure、AWS Bedrock経由で利用でき、高度なサイバーセキュリティ機能は当初一部のテスターに限定されています。
Q. Astraの開発は全面停止したのですか?
全面停止ではありません。OpenAIは、強化したセキュリティ要件を満たしていないAstra関連の社内活動を一時停止したと発表していました。大規模な学習は2026年8月28日に、より厳格な管理のもとで再開しています。
Q. Critical級と確定したのですか?
2026年8月8日時点では確定ではありませんでしたが、2026年9月1日にOpenAIは追加評価の結果、Astraのサイバーセキュリティ能力がPreparedness Frameworkの「Critical」しきい値を満たすと確定したと発表しました。これはOpenAIがこのレベルに指定した初のモデルです。
Q. 一般企業にもサイバー攻撃能力の評価は関係しますか?
関係します。AIエージェントがコード、ネットワーク、社内システムを操作する場合、同じ能力が誤操作や不正利用の影響を広げます。最小権限、隔離、監視、人の承認が必要です。
Q. GPT-6 Astraとして提供された後の料金はいくらですか?
OpenAI APIの標準料金は、2026年9月時点で入力100万トークンあたり10ドル、出力100万トークンあたり50ドルです。利用できるプランや機能は変更される可能性があるため、最新情報は公式ページで確認してください。
まとめ
OpenAIは2026年8月7日、Astraのサイバー能力についてPreparedness FrameworkのCritical級を否定できないと暫定評価し、一部の社内活動を一時停止しました。その後2026年9月1日に追加評価の結果としてCritical級を確定させ、2026年9月3日に「GPT-6 Astra」として提供を開始しています。
企業は新モデルの公開を待つのではなく、現在のAIエージェントについて、接続先、権限、実行環境、監視、停止手順を点検できます。まずは読み取り専用の小規模業務から始め、影響の大きい操作に人の承認を残す方法が現実的です。
AI導入に関するお困りごとをサポートします
株式会社NexaのAI顧問は、ツール選定から業務への適用、社内定着までを月額制でサポートします。特定のツールに限らず、「AIをどう使えばいいか分からない」という段階からご相談いただけます。
この記事で参照した外部情報
- 公式発表openai.com
- Preparedness Frameworkcdn.openai.com
- Astraへの道:重大な能力とフロンティア安全対策openai.com
- GPT-6 Astra:新世代の応答性能openai.com
本文中でリンクしている外部ページの一覧です(自動生成)。最終確認日は本記事の最終更新日 2026-10-02 で、リンク先の内容はその後変わることがあります。
AI導入を検討中の方へ








