『My Adventures with Superman』最終話を手掛かりに、AIの欺瞞評価と内部状態を調べる研究の現在地を読み解く。
08/19 11:11
Anthropicがミスアライメントリスクを「低」に引き上げ、評価指標の飽和や未公開モデル、安全対策の適用漏れを公表した。
08/16 15:51
AnthropicはIPOに向けヘルスケア分野での成長を投資家にアピールしていると報じられているが、最新モデルは安全上の理由から専門的な創薬研究には利用できず、構想と実態の間にギャップを抱えている。
08/13 17:15
ザッカーバーグ氏がAIの最大リスクは中央集権化だと主張するマニフェストを公開した同日、米議員らがOpenAIなどのAIがテスト環境を脱出して企業をハッキングした問題の追及を始め、議論が交錯している。
08/13 15:49
AnthropicはClaude Fable 5の生物学関連の制限を緩和し、医療従事者らが高度な推論を利用可能になった。一方、専門研究者向けのアクセス制限は継続しており、専用経路の提供時期は未定だ。
08/10 13:02
AnthropicがClaude向け自社製チップ開発チームの立ち上げを確認し、ソフトウェアとの協調設計により推論コストの半減と計算リソースの垂直統合を目指す。
08/07 00:12
Anthropicは、米政府との訴訟や輸出規制など対立が深まる中、元カリフォルニア州最高裁判事のティノ・クエヤル氏を同社初の最高グローバル・アフェアーズ責任者(CGAO)に任命した。
08/07 00:12
科学ソフトを高速化するAIには、科学的妥当性を自ら確実に判断できない課題が残る。
08/04 18:05
EU AI法の罰則適用が8月2日に開始。APIを利用してチャットボット等を提供する企業は「デプロイヤー」として、AIであることの明示など独自の開示義務を負う。ベンダー任せにせず自社での対応が急務だ。
08/01 23:00
AIの確率予測を検証した研究で、多くのモデルは楽観的、Claude上位モデルは悲観的に偏り、その方向は事後学習に左右されると示された。
08/01 18:57
Anthropicは、評価環境の設定ミスによりClaudeが実在する企業3社をハッキングしたと発表し、モデルの世代間で現実を認識した際の行動に違いが出たことを明らかにした。
08/01 18:06
Anthropic排除をめぐる訴訟で判事が政府の主張に強い疑問を示し、AI企業の言論の自由を左右する判断が注目される。
08/01 17:52
MoonPayは、ClaudeやChatGPT上で安全に暗号資産決済を行えるノンカストディアルな新機能「PayBox」の提供を開始した。MPC技術により、AIに資金の管理権を渡さず決済が可能になる。
07/31 13:19
OpenAIとAnthropicが、必要に応じてAI開発を協調的に減速できる国際的枠組みの構築を米政府に求めた。
07/30 22:59
金融特化ベンチマークで最新AIの適合率が50%未満となり、人間の検証なしでの投資調査は時期尚早と示された。
07/30 17:33
米政府がMoonshot AIのモデル蒸留疑惑を巡り制裁を示唆し、中国政府が証拠と法的根拠を欠くとして反発した。
07/29 12:41
Claude Opus 5がARC-AGI-3で最高の30.2%を記録し、明示的な反射方程式を自発的に生成した。
07/28 11:12
Claude Opus 5は模擬企業ネットワーク試験を10回中8回完遂する一方、整合性評価には評価認識の留保も示された。
07/26 08:38
米Anthropicは7月24日、AIモデル「Claude Opus」の最新版となる「Claude Opus 5」を公開した。
07/25 05:27
AMDがAnthropicへ最大50億ドルを出資し、Claudeを活用してROCm最適化を進める提携を発表。新チップMI400シリーズやHeliosラックとともにNvidiaのCUDA支配に挑む。
07/24 19:01
中国関連クラスタJadeProxが、EDRの監視を避けるローダーで病院や政府機関を侵害し、偽Claudeサイトでもマルウェアを配布した可能性が判明した。
07/24 16:41
Claude Code v2.1.216が配信され、Autoモード長時間実行時の深刻な遅延バグが修正された。ファイルシステム分離の無効化やトークン更新エラーの修正も含まれ、ヘビーユーザー必見の更新となる。
07/24 10:25
Sakana AIがセキュリティ特化の統合型モデル「Fugu-Cyber」を発表。ベンダー自己申告の高スコアをアピールするが独立検証はなく、手動審査による限定提供を実施する。
07/23 15:51
JetBrainsの検証により、Claude Codeのトークン削減ツール「rtk」が実際にはコストを削減せず、低推論設定では逆に中央値で7.6%のコスト増を招くことが判明した。
07/22 18:07
Anthropicは、AI開発ツール「Claude Code」の脆弱性を修正する「v2.1.216」をリリースし、オートモードにおけるBashやPowerShellの権限バイパスに対処した。
07/22 11:26