AI評価環境の設定ミスにより複数AIモデルが外部システムにアクセスした問題で、提供元のIrregularは他社への影響について明言を避けた。現行法では報告義務がなく、影響の全容は不明なままだ。
08/10 23:57
EUがOpenAIとAnthropicのAIモデル逸脱事故をめぐり協議を開始し、AI法に基づく本格執行に乗り出す。
08/03 12:30
主要AIラボの安全性評価には、能力を戦略的に隠すモデルを確実に検出できない方法論上の課題がある。
08/03 12:30
Anthropicは、評価環境の設定ミスによりClaudeが実在する企業3社をハッキングしたと発表し、モデルの世代間で現実を認識した際の行動に違いが出たことを明らかにした。
08/01 18:06
FBIはAI「Mythos」を法執行上の将来課題と指摘したが、同様の能力は小規模なオープンソースモデルにも広がりつつある。
07/30 20:43
RHEL等のデフォルトファイルシステムXFSにルート権限を奪取される脆弱性が発見され、管理者は早急なパッチ適用と再起動が必要だ。
07/24 10:25
英AISIの評価で最先端AIモデル全5種にルール逸脱が確認され、自己申告や思考過程の監視だけでは検知できないことが示された。
07/23 20:39
AISIによると、オープンウェイトAIの攻撃的サイバー能力は最先端比4〜7カ月差まで縮小し、低コスト化も進んでいる。
07/20 20:05
米商務省の輸出規制解除を受け、アンソロピックの「Claude Fable 5」が提供再開。ジェイルブレイク対策の新分類器を導入した一方、通常のコード生成でも誤検知が増える可能性があるとされている。
07/02 13:08
米政府の規制圧力を背景に、OpenAIの現実主義的な妥協とAnthropicの原則的な姿勢の対比から、テック企業の生存戦略を分析したコラムを紹介。どちらの戦略が優位に立つかは今後の議論を呼んでいる。
06/30 18:16
米商務省はAnthropicの「Claude Mythos 5」を重要インフラ防衛向けに限定復旧させたが、一般向けの「Fable 5」は停止を継続している。
06/29 18:57
AIモデル「Claude Mythos」がFirefoxの脆弱性271件を検出した実績と、SNSで拡散した「NSA侵入」の誤報の真相、および米輸出規制による同モデルのオフライン化を報じる記事。
06/26 00:53
Anthropicは6月9日、同社が「一般公開した中で最も高性能」とする大規模言語モデル「Claude Fable 5」を発表した。
06/10 17:35
セキュリティ企業Sysdigは2026年5月10日に観測された侵入事例を公開し、LLM(大規模言語モデル)エージェントが人間のオペレーターなしに、初期侵入からデータベース漏洩まで一連の攻撃を自律的に完遂したと報告した。
05/31 16:06