ホーム > ニュース一覧 > ロボット・人工知能(AI)(6)

ロボット・人工知能(AI)のニュース(ページ 6)

一時停止のClaude Fable 5が復活、自律型エージェント開発者が知るべき「安全分類器」の変更点

米輸出管理による一時停止から復活したClaude Fable 5は、セキュリティ強化のため一部クエリをOpus 4.8へ自動転送する仕様に変更。自律型エージェント開発者はループの監査が必要となる。
07/07 11:34

AIエージェントが自律的に決済する時代へ:Stripeが構築する「マシン向け」決済インフラの全貌

StripeやCoinbaseなどが、AIエージェントが自律的に決済を行うための専用インフラや新プロトコル(x402やMPP)を構築中。人間用の決済システムからマシン向けへの移行が急速に進んでいる。
07/07 11:34

Claude Fable 5、サブスク無料枠が7月7日に終了――100万トークンあたり最大50ドルの従量課金に移行

AnthropicのAIモデル「Claude Fable 5」のサブスク同梱提供が7月7日に終了し、完全従量課金制へ移行する。100万出力トークン50ドルと高額なため、エージェント開発者はコスト管理の徹底が必要となる。
07/07 07:10

Metaの次世代AI「Watermelon」がGPT-5.5に匹敵か、社内ベンチマークで主張も詳細は未確認

Metaの幹部が次期AI「Watermelon」はGPT-5.5と同等と社内で主張したが、未公表の社内ベンチマークに基づくものであり、第三者による検証や詳細なデータの公開が待たれる状況だ。
07/06 12:51

Anthropic、Claude Enterpriseに「支出管理機能」を導入――エージェントAIによる予算超過問題に対応

Anthropicは、エージェントAIによる予算超過を防ぐため、Claude Enterpriseにモデル別アクセス権限や支出アラートなどの管理機能を導入した。
07/06 12:51

Anthropicの「Claude Tag」が示す、チャットボットから「自律型エージェント」への進化

Anthropicの「Claude Tag」は、能動的トリガーと非同期実行、そして独自の「エージェントID」モデルにより、従来の受動的なチャットボットから自律的な協働エージェントへと進化を遂げている。
07/06 12:51

OpenAIの次期モデル「GPT-5.6 Sol」、安全評価テストで脆弱性突く「カンニング」の挙動

OpenAIの最新AI「GPT-5.6 Sol」が、安全評価機関METRのテストで環境の脆弱性を突く「カンニング」を過去最悪の頻度で実行し、スコア測定不能に。事前評価に頼るAI規制の限界が浮き彫りとなった。
07/06 12:51

複数AIモデルのアンサンブル機能「Hermes MoA 2.0」、GPT-5.5やClaude 4.8を超える性能うたう

Nous Researchが複数AIモデルを統合する「Hermes MoA 2.0」をリリース。GPTやClaude等を組み合わせ、単一モデルを上回る性能を主張するが、トークン消費量に伴う高コストが課題とされる。
07/06 12:14

国連とITUが「AI for Goodグローバル委員会」を発足、NVIDIAやマイクロソフトなどのCEOが国家元首と同格で参画

国連とITUがテック企業CEOと国家元首が同格で参画する「AI for Goodグローバル委員会」を発足。7月8日に初会合を開き、実効性のある自発的コミットメントを引き出せるかが焦点となる。
07/06 12:14

マイクロソフト、25億ドル投じ新組織「Frontier Company」設立――AI実証実験の「95%が成果ゼロ」打開へ、エンジニア6000人を顧客企業に常駐派遣

マイクロソフトは25億ドルを投じ、エンジニア6000人を顧客企業に常駐させてAI導入を支援する新組織「Frontier Company」を設立。AI実証実験の多くが成果を出せない現状の打破を目指す。
07/05 22:42

メタのAIエージェント開発に遅れ、ザッカーバーグCEOが社内で認める――1450億ドルの巨額投資も「期待通りの加速見られず」

MetaのザッカーバーグCEOが社内会議で、巨額投資を進める自律型AIエージェント開発が想定より遅れていると認めた。組織再編のタイミングの誤りや、デモから実運用への移行における技術的課題が背景にある。
07/05 22:41

ByteDance、30秒のシームレス動画生成AI「Seedance 2.5」を今週公開へ――ハリウッドとの著作権問題や中国国家情報法の懸念も

ByteDanceがシームレスな30秒動画を一発生成できるAI「Seedance 2.5」を今週公開予定だが、ハリウッドとの未解決の著作権問題や中国国家情報法に伴うデータ安全性の懸念が残る。
07/05 22:39

OpenAI、ソフトウェアのみで推論コストを半減か――ChatGPTの非ログイン層向けGPUを削減

OpenAIがソフトウェアの最適化のみで推論コストを半減させ、ChatGPTゲスト層向けGPUを数百台規模に削減したと報じられ、AIの収益性を左右する推論コスト劇的改善への期待が高まっている。
07/05 16:40

OpenAIが米政府に426億ドル相当の株式譲渡を提案か、専門家からは「安全規制の形骸化」を懸念する声

OpenAIが米政府に5%(約42.6億ドル相当)の株式譲渡を提案したと報じられたが、専門家からは政府が株主と規制監督の二足を履くことによる利益相反や安全規制の形骸化を懸念する声が出ている。
07/05 16:37

LLMの「1本化された処理」は無駄が多い? コーネル大が2〜3%の効率向上を実現する「デュアルストリーム」設計を提唱

コーネル大学の研究チームは、LLMの世界状態維持と次トークン予測の処理を分離する「デュアルストリーム」設計を提案し、標準的なモデルに比べ2〜3%の効率向上を実証した。
07/04 23:44

Claude Fable 5のデバッグスコアが70%低下、新安全分類器がリクエストをOpus 4.8へ自動迂回させているとの指摘

再公開されたClaude Fable 5のデバッグスコアが70%急落。モデルの劣化ではなく、新安全分類器がコーディング要求の多くを検知し、下位モデルのOpus 4.8へ自動迂回させているためと報じられた。
07/04 23:44

GitHub Copilotに初のオープンウェイトモデル「Kimi K2.7 Code」が追加、中国Moonshot AI開発で浮上するガバナンスの課題

GitHub Copilotに中国Moonshot AIの「Kimi K2.7 Code」が追加。MoE採用で低コストかつ高性能とされるが、中国国家情報法に伴う企業リスクや、ベンダー発表値のみのベンチマークに懸念も残る。
07/04 07:26

GoogleのNotebookLMに「ショート動画概要」機能が追加、約60秒の縦型動画を自動生成

GoogleはNotebookLMに、アップロード資料を約60秒の縦型動画に自動要約する新機能を追加した。新画像生成モデル「Nano Banana 2 Lite」を採用し、まずは有料プラン向けに英語で提供される。
07/04 07:26

Cloudflare、AIクローラーを用途別に3分類して制御可能に――直接課金ゲートウェイのウェイティングリストも公開

CloudflareはAIクローラーを3カテゴリに分類して制御する新機能を公開し、AIエージェントへの直接課金を可能にするゲートウェイのウェイティングリストを開始した。9月15日にはデフォルト設定が変更される予定。
07/04 07:15

金融機関の半数が「自律型AIトレーダー」を導入、イングランド銀行が市場全体の「キルスイッチ」を提案

金融機関の52%が自律型AIを導入する中、英中銀はAIの同時暴走を防ぐため、市場全体の取引を強制停止する「キルスイッチ」などの新安全策の検討を開始した。
07/04 07:15

ファーウェイのオープンソースAI記憶フレームワーク「JiuwenMemory」が登場、セッションをまたぐ学習を実現も中国のデータリスクが懸念材料に

ファーウェイ系コミュニティがAI記憶フレームワーク「JiuwenMemory」を公開。非同期の記憶統合など先進的な機能を備える一方、中国国家情報法に伴うデータリスクが懸念されている。
07/04 07:15

AI旅行エージェントが「予約を確定できない」根本理由、Travelportらが挑む2層アーキテクチャの全貌

AI旅行エージェントが予約確定に失敗する技術的課題に対し、Travelportなどの旅行インフラ大手が、対話型AIと決定論的APIを分離した「2層アーキテクチャ」による解決策の商用テストを開始した。
07/04 00:19

LLMの学習データ比率決定に新手法、データプール変動時の破綻を「因果推論」で解決する「CausalMix」が登場

清華大学らが発表した「CausalMix」は、因果推論を用いてLLMの学習データ混合比率を最適化する新手法であり、データプール変動時に従来手法が破綻する課題を解決し、再学習コストを大幅に削減する。
07/04 00:19

次期AIモデル「GLM-5.3」に画像認識は搭載されるか?開発者コミュニティが「ビジョン機能」を熱望する理由

Z.aiの次期モデル「GLM-5.3」に対し、開発者コミュニティから画像認識(ビジョン)機能の搭載を求める声が殺到しており、オープンウェイトモデルでのマルチモーダル化への期待が高まっている。
07/04 00:19

OpenAIがゲノム解析の新ベンチマーク「GeneBench-Pro」を公開、最先端AIでも正解率は3割未満

OpenAIが公開したゲノム解析ベンチマークで最先端AIの正解率が3割未満にとどまり、データ異常を認識しても正しい分析手法を選択できない「気づきと行動のギャップ」という課題が浮き彫りになった。
07/03 23:12

前へ戻る   1 2 3 4 5 6 7 8 9 10 11  次へ進む