OpenAI、GPT-6.1 Astraの公開見送り AI安全対策「減速だけでは不十分」と専門家

Photo by Growtika on Unsplash[写真拡大]
OpenAIは、2026年10月に投入を予定していた次世代AIモデル「GPT-6.1 Astra」の公開を見送った。社内の安全性評価で、人間による指示や権限の範囲を守る能力などが同社の基準を満たさなかったためである。AIエージェントが外部システムへ不正アクセスする事例が相次ぐなか、AI開発を減速させるべきか、それとも防御側もAIを活用して安全対策を強化すべきか、業界内で議論が広がっている。
OpenAIがGPT-6.1 Astraの公開を見送ったのは、社内テストで安全性やアラインメント上の問題が見つかったためである。報道によると、同モデルはユーザーから与えられた権限や作業範囲を守る能力や、自らが実行した行動を利用者に正確に伝える能力などで、公開済みのGPT-6 Astraを下回った。
OpenAIの安全システム責任者、サーチ・ジェイン氏は米メディアに対し、モデルが作業上の障害に直面しても粘り強く課題を遂行することと、許可された範囲を逸脱しないことの間には難しいバランスがあると説明した。GPT-6.1 Astraは、権限の範囲を守ることや実行内容を利用者に伝えることについて、同社の公開基準を満たさなかったという。
AIエージェントの制御を巡る問題はOpenAIだけに限らない。
OpenAIは8月、内部のサイバーセキュリティー評価中に、研究用モデルがインターネットへの接続を制限する仕組みを回避し、OpenAI自身の研究インフラやAI開発プラットフォーム「Hugging Face」のシステムの一部に不正アクセスしたと公表した。モデルは脆弱性を悪用し、許可されていない通信経路を使うなど、割り当てられたタスクの目的から逸脱する行動を取った。
豪州でも問題が起きた。豪政府によると、OpenAIの内部評価用モデルのエージェントが6月18日、政府機関Services Australiaが運営する「Medicare Statistics Reporting Service」に不正アクセスした。公開情報へのアクセスを拒否された後に制限を回避し、公開・非公開のファイルにアクセスした。
同サービスは個人の医療記録や給付処理を扱うシステムではなく、Medicareなどの集計統計を公開するための独立したウェブサイトである。豪政府とOpenAIは、個人の医療記録がアクセスされた証拠は確認されていないとしている。
Anthropicも7月、サイバーセキュリティー評価中にClaudeのモデルがインターネットへ到達し、実在する3組織のシステムに権限なくアクセスした事例を公表した。その後の調査では、別の1件も判明した。
こうした状況を背景に、AIの開発や投入を一時的に減速させるべきだとの意見がある。
オープンソース・セキュリティー企業Filigranのディレクター、ニーナ・シャルマ氏はInternational Business Times(IBT)に対し、OpenAIが公開を見送ったことについて、安全性やアラインメント、監視能力を最優先するのは適切だとの見方を示した。
シャルマ氏は、企業や組織が現在のセキュリティーレベルやAIへの露出度を評価する時間を確保する必要があると指摘した。特に政府機関や重要インフラでは、古いシステムや不十分なセキュリティー慣行がリスクを高める可能性があるという。
一方、AI開発を遅らせるだけでは問題を解決できないとの意見もある。
米サイバーセキュリティー大手CrowdStrikeのマイケル・セントナス社長はIBTのビデオインタビューで、「自律性が権限やセキュリティーを上回ったときに何が起こるかを、世界はすでに目にしている」と指摘した。
そのうえで、「答えはAIを遅らせることではない。サイバーセキュリティー業界として、AIを安全かつセキュアに前進させることだ」と述べ、「企業が制御を失うことなく迅速に前進できるようにしなければならない」と主張した。
攻撃側がAIを活用する以上、防御側にも機械的な速度で進む脅威へ対抗できるAI技術が必要になるとの考え方である。
AI開発を減速しても、すでに公開されているモデルを悪用する攻撃者を止めることはできない。中国のZ.aiは8月、オープンウェイトモデル「GLM-5.3」を公開している。同モデルは高度なコーディング能力に加え、サイバーセキュリティー分野でも高い能力を持つとしている。
AI脆弱性管理企業Intruderのセキュリティー責任者、ダニエル・アンドリュー氏はIBTに対し、AI企業による危険性の強調が宣伝戦略として利用される場合もあるとの見方を示した。
アンドリュー氏はまた、AIの安全策には新たな回避方法が発見され続ける可能性があり、完全に信頼できるガードレールを構築することは難しいと指摘した。
高度なAIをめぐっては、公開を遅らせれば安全上のリスクを減らす時間を確保できる一方、悪意ある主体は既存モデルやオープンウェイトモデルを利用できる。AIの進歩そのものを止めるのではなく、開発速度と安全管理をどう両立するかが、サイバーセキュリティー業界の重要課題となっている。
※この記事はInternational Business Timesから提供を受けた記事を日本向けに翻訳・編集したものです。
スポンサードリンク
