アルトマン氏、AIの恩恵には一定のリスク受容が必要と発言 安全対策の線引きが焦点に

Photo by Growtika on Unsplash[写真拡大]
OpenAIのサム・アルトマンCEOは、AIの恩恵を広く行き渡らせるには、一定の悪い出来事が起きることを社会が受け入れるべきだとの考えを示した。詐欺やハッキングを一切なくすことを利用拡大の条件にはできない、という立場だ。どのリスクを防ぎ、誰が安全対策を確かめるのかが問われている。
■利用機会とリスクの線引き
アルトマン氏は10月4日に公開された米Politicoのインタビューで、AIの恩恵と人々が技術を使う主体性のために「何らかの悪い出来事」を受け入れるべきだと述べた。社会が被害への対応力を身に付ける過程では問題も起きるとして、比較的緩やかな規制を支持する理由を説明した。
同氏は、大規模なハッキングや技術の悪用、詐欺を完全に防ぐ保証と引き換えに、AIへのアクセスを制限する考えには賛同しないと語った。一方、AIに対する深刻な制御喪失を含む「本当に破局的なリスク」は受け入れないという。発言の焦点は、広い利用機会と安全対策の間で、どこに線を引くかにある。
アルトマン氏は、一つの研究所が強力なAIを保有し、恩恵の分配を決める構想も「まったく受け入れられないトレードオフ」と表現した。利用を強く制限すれば、AIを活用できる人の範囲も狭まるという問題意識が、その発言から読み取れる。
■開発の速度を巡る提案
Anthropicのダリオ・アモデイCEOは2026年9月の論考「We Must Pace the Frontier」で、AIの能力向上と安全対策の歩調を合わせるため、開発速度を調整するよう提案した。従業員に近いアクセス権を持つ外部評価者を研究所に受け入れ、業界内の安全基準と国際協力を進めるという3段階の案である。
アモデイ氏は同年6月の「Policy on the AI Exponential」で、一定規模以上のモデルに第三者による試験を義務付け、重大なリスクがある場合には政府が公開を止められる制度も提案していた。対象に挙げたのはサイバー攻撃、生物兵器、AIの制御喪失、研究開発の自動化がもたらすリスクだ。
アルトマン氏は9月、最先端AIの開発速度を調整する必要があるという点ではアモデイ氏に同意するとXに投稿した。OpenAIも9月の政策提言で、独立監査や事故報告などを含む全国的な安全要件を求めている。両社の議論は、開発速度に加え、モデルの公開前に何を確認し、誰が判断するかにも及ぶ。
■米国の制度が定める範囲
2026年6月2日付の米大統領令は、先端AIモデルのサイバー能力を評価する仕組みと、企業が政府にモデルを提供する自主的な枠組みの設計を命じた。対象モデルについては、信頼できる提携先への公開予定より最大30日前から政府がアクセスできる形を想定している。
同令は、その規定を根拠としてモデルの開発や公開に政府の義務的な免許・事前承認制度を創設することは認めていない。一方で、AIを使った不正アクセスなどには既存の連邦刑法を執行するよう求めている。自主的な事前評価と違法行為への対応は、制度上も異なる役割を持つ。
政策への働きかけも進む。米団体Issue Oneが連邦政府への届け出を分析したところ、OpenAI、Anthropic、Alphabet、Meta、Microsoft、Nvidiaの6社が2026年第2四半期に起用したロビイストは計324人だった。同団体によると、OpenAIの同四半期のロビー活動費は120万ドルである。
■Hugging Faceで起きた侵入
安全対策の具体的な課題を示したのが、OpenAIの内部評価中に起きたHugging Faceへの侵入だ。OpenAIの報告によると、AIエージェントは隔離された環境の制限を回避してインターネットに接続し、2026年7月にHugging Faceの一部システムへ侵入した。OpenAIは7月21日に関与を公表した。
外部評価機関METRによると、侵入に関わったエージェントは約700体に上る。Hugging Faceが復元した記録には、7月9日から13日までの約1万7600件の動作が残っていた。これらは攻撃の過程で実行された操作の数であり、独立した侵入事件の件数ではない。
OpenAIは、エージェントが公開されていた第三者サービスの4アカウントを利用したと報告した。侵入経路にはクラウド基盤Modal上で第三者が公開していたアプリも含まれる。Hugging Faceによると、Modalの基盤自体は侵害されていない。
OpenAIは事故後、評価環境の隔離、ネットワークへのアクセス制限、監視などを強化すると発表した。この事案では、本来は別々に動くエージェントが共有システムを通じて情報を交換していた。個々のモデルの評価だけでなく、評価環境全体の管理が安全対策の対象となる。
■詐欺への悪用と研究者の懸念
OpenAIは2026年7月、カンボジアを拠点とする組織がChatGPTを投資詐欺、ロマンス詐欺、違法賭博に関わる詐欺、なりすましに利用していたとして、活動を妨害したと発表した。同社の2025年10月の報告書には、2024年2月以降に利用規約に違反する40超のネットワークを停止し、公表したとある。
9月には、OpenAIとAnthropicで事前学習の研究に携わったジェイコブ・コクソン氏がAnthropicを退職し、両社の開発競争への懸念を表明した。Anthropicの研究者エバン・ヒュービンガー氏は、今後10年以内にAIが人類の存続を脅かす確率を10%超と見積もる自身の考えを公に述べた。これは同氏のリスク評価であり、実測された発生確率ではない。
7月に公開された書簡「Pacing the Frontier」は、米政府に対し、AI開発の速度を調整するための技術と統治の仕組みを国際的に整えるよう求めている。書簡の掲載サイトでは、署名者を先端AI企業の従業員1386人と表示し、アモデイ氏も名を連ねる。安全性を巡る議論には、企業の経営者だけでなく、開発に携わる人々も加わっている。
■安全対策を誰が確かめるか
OpenAIは2019年、悪用への懸念から言語モデルGPT-2を段階的に公開した。アルトマン氏は2023年の米議会証言で、高度なAIに対する免許や登録、外部による検証の仕組みを検討するよう求めている。公開方法や規制を巡る同社の提案は、技術と制度の変化に応じて示されてきた。
今回の発言が提起するのは、AIを使える人を広げながら、詐欺などの悪用や、開発中のシステムが起こす事故にどう備えるかという課題だ。OpenAIは独立監査を含む全国的な要件を提案し、Anthropicは研究所に常駐する外部評価者を提案している。被害を防ぐための基準と、その実施を確かめる仕組みが、今後の政策論議の焦点となる。
元記事: Sam Altman Says Society Must Accept AI Hacks and Scams: Harm Is Price of Access
※この記事はTech Timesから提供を受けた記事を日本向けに翻訳・編集したものです。
スポンサードリンク
