Claudeのニュース

『My Adventures with Superman』最終話で読み解くAIアライメント、ブレイニアックの試験と現実の欺瞞評価

『My Adventures with Superman』最終話を手掛かりに、AIの欺瞞評価と内部状態を調べる研究の現在地を読み解く。
08/19 11:11

米アンソロピック、AIリスク評価を「極めて低い」から「低」に引き上げ―安全指標の飽和と未公開「Model 2」を開示

Anthropicがミスアライメントリスクを「低」に引き上げ、評価指標の飽和や未公開モデル、安全対策の適用漏れを公表した。
08/16 15:51

米アンソロピック、IPOに向け医療AIをアピールもFable 5は創薬研究に利用不可

AnthropicはIPOに向けヘルスケア分野での成長を投資家にアピールしていると報じられているが、最新モデルは安全上の理由から専門的な創薬研究には利用できず、構想と実態の間にギャップを抱えている。
08/13 17:15

【解説】ザッカーバーグ氏「AI最大のリスクは集中」―米議会はOpenAIらの「AI暴走」を追及

ザッカーバーグ氏がAIの最大リスクは中央集権化だと主張するマニフェストを公開した同日、米議員らがOpenAIなどのAIがテスト環境を脱出して企業をハッキングした問題の追及を始め、議論が交錯している。
08/13 15:49

Claude Fable 5、生物学関連の制限を大幅緩和 研究者向けアクセスは提供時期未定

AnthropicはClaude Fable 5の生物学関連の制限を緩和し、医療従事者らが高度な推論を利用可能になった。一方、専門研究者向けのアクセス制限は継続しており、専用経路の提供時期は未定だ。
08/10 13:02

Anthropicが自社製AIチップ開発チームの立ち上げを確認、Claudeの推論コスト半減へ

AnthropicがClaude向け自社製チップ開発チームの立ち上げを確認し、ソフトウェアとの協調設計により推論コストの半減と計算リソースの垂直統合を目指す。
08/07 00:12

Anthropic、初のグローバル・アフェアーズ責任者を任命 米政府との訴訟や輸出禁止措置のさなか

Anthropicは、米政府との訴訟や輸出規制など対立が深まる中、元カリフォルニア州最高裁判事のティノ・クエヤル氏を同社初の最高グローバル・アフェアーズ責任者(CGAO)に任命した。
08/07 00:12

AIは自らのエラーを見抜けない OpenAI次期モデル「Astra」が科学研究で直面する検証の壁

科学ソフトを高速化するAIには、科学的妥当性を自ら確実に判断できない課題が残る。
08/04 18:05

EU AI法のチャットボット開示義務、API利用企業にも8月2日から適用へ

EU AI法の罰則適用が8月2日に開始。APIを利用してチャットボット等を提供する企業は「デプロイヤー」として、AIであることの明示など独自の開示義務を負う。ベンダー任せにせず自社での対応が急務だ。
08/01 23:00

事後学習が決めるAIの確率バイアス、GPTは楽観的・Claude上位モデルは悲観的傾向

AIの確率予測を検証した研究で、多くのモデルは楽観的、Claude上位モデルは悲観的に偏り、その方向は事後学習に左右されると示された。
08/01 18:57

【解説】OpenAIに続きClaudeも実システムへ侵入、相次ぐAI評価事故が示すネットワーク隔離の構造的課題

Anthropicは、評価環境の設定ミスによりClaudeが実在する企業3社をハッキングしたと発表し、モデルの世代間で現実を認識した際の行動に違いが出たことを明らかにした。
08/01 18:06

アンソロピック対米国防総省の訴訟、AI企業の言論の自由を左右

Anthropic排除をめぐる訴訟で判事が政府の主張に強い疑問を示し、AI企業の言論の自由を左右する判断が注目される。
08/01 17:52

MoonPay「PayBox」を徹底解説、ClaudeとChatGPTでノンカストディアルな暗号資産決済を実現

MoonPayは、ClaudeやChatGPT上で安全に暗号資産決済を行えるノンカストディアルな新機能「PayBox」の提供を開始した。MPC技術により、AIに資金の管理権を渡さず決済が可能になる。
07/31 13:19

OpenAIとAnthropic、AI開発を意図的に遅らせる国際的枠組みの構築を米政府に要請

OpenAIとAnthropicが、必要に応じてAI開発を協調的に減速できる国際的枠組みの構築を米政府に求めた。
07/30 22:59

金融AIの実務性能に限界、投資タスク評価でClaude Fable 5も適合率49.2%

金融特化ベンチマークで最新AIの適合率が50%未満となり、人間の検証なしでの投資調査は時期尚早と示された。
07/30 17:33

【解説】Kimi K3の技術構造から検証する「モデル蒸留」疑惑──米中AI対立の争点とは

米政府がMoonshot AIのモデル蒸留疑惑を巡り制裁を示唆し、中国政府が証拠と法的根拠を欠くとして反発した。
07/29 12:41

Claude Opus 5が難関AIテスト「ARC-AGI-3」で最高記録―空間の法則を「数式化」して問題を攻略

Claude Opus 5がARC-AGI-3で最高の30.2%を記録し、明示的な反射方程式を自発的に生成した。
07/28 11:12

Claude Opus 5、英政府機関の模擬ネットワーク試験を10回中8回完遂 安全性評価は留保も

Claude Opus 5は模擬企業ネットワーク試験を10回中8回完遂する一方、整合性評価には評価認識の留保も示された。
07/26 08:38

Anthropic、「Claude Opus 5」公開 最高峰Fable 5に迫る性能を半額で

米Anthropicは7月24日、AIモデル「Claude Opus」の最新版となる「Claude Opus 5」を公開した。
07/25 05:27

AMDがAnthropicに最大50億ドル出資へ、Claude活用でNvidia「CUDA」の牙城に挑む

AMDがAnthropicへ最大50億ドルを出資し、Claudeを活用してROCm最適化を進める提携を発表。新チップMI400シリーズやHeliosラックとともにNvidiaのCUDA支配に挑む。
07/24 19:01

中国関連クラスタ「JadeProx」、新型ローダーで病院や政府機関を侵害 偽Claudeサイトでも配布か

中国関連クラスタJadeProxが、EDRの監視を避けるローダーで病院や政府機関を侵害し、偽Claudeサイトでもマルウェアを配布した可能性が判明した。
07/24 16:41

Claude Code更新、Autoモード長時間セッションの速度低下バグを修正

Claude Code v2.1.216が配信され、Autoモード長時間実行時の深刻な遅延バグが修正された。ファイルシステム分離の無効化やトークン更新エラーの修正も含まれ、ヘビーユーザー必見の更新となる。
07/24 10:25

Sakana AI、セキュリティ特化の「Fugu-Cyber」発表——評価スコア86.9%を主張も検証手法は未公開

Sakana AIがセキュリティ特化の統合型モデル「Fugu-Cyber」を発表。ベンダー自己申告の高スコアをアピールするが独立検証はなく、手動審査による限定提供を実施する。
07/23 15:51

「トークンを最大90%削減」の主張を覆す、JetBrainsがClaude Code向けプロキシ「rtk」のコスト増を検証

JetBrainsの検証により、Claude Codeのトークン削減ツール「rtk」が実際にはコストを削減せず、低推論設定では逆に中央値で7.6%のコスト増を招くことが判明した。
07/22 18:07

Claude Codeにセキュリティアップデート、オートモード時の深刻な権限バイパス脆弱性を修正

Anthropicは、AI開発ツール「Claude Code」の脆弱性を修正する「v2.1.216」をリリースし、オートモードにおけるBashやPowerShellの権限バイパスに対処した。
07/22 11:26

 1 2 3 4  次へ進む