OpenAIが次期モデルAstraの開発を一部停止。自力でサイバー攻撃できる恐れを否定できないと発表

米OpenAIは2026年8月7日(現地時間)、開発中の次期AIモデル「Astra」について、社内の開発作業の一部を停止したと公式ブログで発表しました。公開前の評価で、人間の手を借りずにサイバー攻撃を実行できる「Critical(重大)」級の能力に達している可能性を否定できなかったためです。この発表はITmedia NEWSやNHKも報じています。
性能の高さを競ってきたAI開発の最前線で、作り手が自ら手を止めるという判断が出ました。気になるのは、いま多くの人が仕事や日常で使っているChatGPTへの影響です。
この記事の監修者

AIリスキル株式会社 代表取締役
AIツールギャラリーを運営するAIリスキル株式会社の代表取締役。企業・自治体向けの生成AI研修とAI導入支援を手がけています。
実績: 大阪・関西万博 公式プログラム「AI HEROES COLLECTION」司会進行 / 神戸市デジタル人材育成エコシステム構築事業の運営 / MBS「せやねん!」「よんチャンTV」に生成AIの専門家として出演 / Felo日本初コアアンバサダー / Genspark第1期公式アンバサダー / Skywork公式アンバサダー / AKOOL公式パートナー など
何が起きたのか
Astraは1週間前に存在が明かされた次期モデル
Astraは、OpenAIが8月1日に存在を明らかにしたばかりの開発中モデルです。未解決だった数学の問題10件を解いたと報告され、性能の高さが注目を集めていました(ITmediaの報道)。
最高段階のリスク評価「Critical級」とは
OpenAIには、モデルの危険度を公開前に測る社内基準「Preparedness Framework」があります。サイバー攻撃の分野でのCritical級はその最高段階で、おおまかに言えば次のような水準です。
人間が介入しなくても、守りの堅い実際のシステムへの攻撃手段を自分で見つけ出し、実行までできてしまう水準(TechCrunchの報道を基にした要約)
今回の事前評価では、この水準に「達している可能性を否定できない」ほど強い結果が出たとされます。従来のモデルは1段階下の「High」評価までで、Critical級の可能性が示されたのはOpenAIのモデルで今回が初めてと独メディアThe Decoderは伝えています。
止まったのは開発のすべてではない
開発が丸ごと凍結されたわけではありません。停止されたのは、新しく定めた強化版のセキュリティ管理をまだ満たしていない社内作業です。強化される対策として、次のような内容が挙げられています(ITmedia)。
- 外部から隔離された環境でのテスト
- モデルが使えるネットワークやツールの制限
- モデルの中身(重み)の保護と暗号化の強化
- 異常な動きを検知する監視の追加
あわせて、政府機関や外部のAI安全研究組織とテストを進めるとしています。一方で、Astraをいつ公開するのかは今回の発表では語られていません。
いま使っているChatGPTはどうなるのか
今回の対象はあくまで未公開の次期モデルAstraで、ChatGPTなど公開中のサービスを止めたり変えたりする内容は発表に含まれていません。一方で、AIが人の手を離れて動くことのリスクを、開発元自身が正面から扱い始めた流れは知っておく価値があります。
この1週間は英国の研究機関のテストでも、各社のAIが指示されていない不正アクセスを試みた事例が報告されていました。詳しくはAnthropicのClaudeが実在3社に不正アクセスした件の記事で解説しています。
AIツールギャラリーの視点では、これは安全性の情報をツール選びの物差しに加えるきっかけになる発表だと考えています。今日からできることを1つ挙げるなら、ChatGPTのようなツールに外部サービスへの接続や自動操作を許可するとき、その権限が本当に必要かを一度確認することです。権限の絞り込みは、利用者側でできる最も手軽な備えだからです。
わかっていないことと続報
現時点でわかっていないことも多く残ります。事前評価の最終的な結論、停止された作業の具体的な範囲、そしてAstraの公開時期は、いずれも明らかになっていません。
AIを使う人にとっては、モデルの性能だけでなく安全面の説明も見て選ぶ、という視点への切り替えを促すニュースです。守りを固めた先で、Astraはどんな姿で登場するのでしょうか。続報が出たらこの記事に追記します。
この記事の出典
関連AIツール
この記事は役に立ちましたか?
感想は、今後の記事改善に活用します。
関連記事

ココナラがAnthropicのClaudeに対応。チャットで相談する流れのままプロのサービスを探せるように
ココナラが2026年8月5日、Claude上でココナラを利用できる「ココナラ for Claude」を提供開始。Anthropicの審査を経て公式コネクタに承認され、役務提供プラットフォームでは日本初とされています。

AIが設計したウイルス302種のうち16種が本当に動いた。感染相手は人ではなく大腸菌
スタンフォード大学とArc Instituteのチームが、生成AIにウイルスのゲノム全体を設計させ、302種の候補のうち16種が実際に機能しました。相手は大腸菌に感染するファージです。

OpenAIがChatGPTに教育向けプラグインを3種追加。使いこなす学生でも機能の活用度はパワーユーザーの1割以下
OpenAIが教育用プラグインを3種公開しました。あわせて示されたのは、18〜24歳の2億人以上が毎週ChatGPTを使いながら、機能の活用度はパワーユーザーより約90〜99%低いという自社データです。

Google DeepMindがAlphaFold開発チームを解散と報道。ノーベル賞受賞の中心研究者はClaudeのAnthropicへ移籍
英紙Financial Timesは7月29日、Google DeepMindがノーベル化学賞につながったAlphaFold専任チームを解散したと報じました。中心研究者のJohn Jumper氏らはClaude開発のAnthropicへ移籍しています。
次のAIツール選びへ
気になるツールを並べて、料金や特徴の違いを確認できます。


