Rebellionsの推論NPU、日本で実証と導入計画が進む トーメンデバイスとai&が展開

2026年10月10日 22:33

印刷

記事提供元:Tech Times

Photo by Igor Omilaev on Unsplash

Photo by Igor Omilaev on Unsplash[写真拡大]

韓国のAI半導体企業Rebellionsの推論基盤をめぐり、日本で二つの取り組みが進んでいる。トーメンデバイスは国内企業とサーバーの実証を始め、ai&は東京のデータセンターにRebellionsのラック型システムを導入する計画を発表した。

両者は役割が異なる。トーメンデバイスは製品の取り扱いと導入に向けた評価を進め、ai&は国内で提供するAI推論サービスの計算基盤にRebellions製品を加える。

■トーメンデバイスが国内で推論基盤を実証

トーメンデバイスは2025年10月、Rebellionsと製品プロモーションや協業拡大に向けた覚書を締結した。同社の発表では、日本市場の調査と開拓、技術・マーケティング情報の共有、販売や製品開発での連携を協業内容に挙げている。当時、取り扱いの対象として説明した主力製品は推論向けのATOM-Maxだった。

2026年7月には、AIインフラの構築・運用を手がけるトゥモロー・ネットと実証実験を開始した。トーメンデバイスによると、Rebellions製アクセラレータを搭載した4Uサーバーをトゥモロー・ネットの拠点に設置し、起動と動作の確認を終えた。

実証では、実運用を想定した処理量や応答時間に加え、電力効率、コスト、運用性を評価する。トーメンデバイスがハードウェアの提供とAI製品の提案を担い、トゥモロー・ネットが利用場面の設計から運用までを支援する。両社は結果を商用導入時の構成や用途別の判断材料にする方針だ。

トーメンデバイスは、サムスン電子の半導体事業を扱っていた部門を母体に1992年に設立されたエレクトロニクス商社である。Rebellions製NPUも取り扱い製品に加えており、半導体の販売と技術支援の経験を国内での導入検討に生かす。

■ai&は東京のデータセンターにRebelRackを導入へ

Rebellionsは2026年9月、日本でAI基盤を展開するai&との提携を発表した。ai&は東京のデータセンターでラック型推論システム「RebelRack」の導入を始め、規模を最大100台以上に拡大することを目指す。発表時点で示されたのは初期購入と拡大計画であり、100台以上の導入完了ではない。

Rebellionsの発表によると、ai&はデータセンター網の整備に20億ドル超(約3160億円、1ドル=158円換算)の投資資金を確保している。2026年末までに5拠点を稼働させ、2027年末には合計40MWの設備容量を目標とする計画だ。

ai&は、処理の種類に応じて異なる計算装置を使い分ける基盤にRebellions製品を組み込む。国内の企業、政府機関、開発者向けに推論サービスを提供する構想で、ai&は既存のオープンソース環境を活用できる点も提携の理由に挙げている。

国内メディアのTECH+によると、ai&は2026年10月初めの時点で大阪と東京の計4拠点に合計12MW超のAI基盤を稼働させていた。RebelRackの導入先となる事業者の既存設備と、今後の拡張計画は区別して見る必要がある。

■Rebel100はメモリーとチップレットを組み合わせる

RebelRackの中核となる「Rebel100」は、AI推論向けに設計されたNPUである。大規模言語モデルの推論では、演算能力に加えて、モデルの重みなどのデータをメモリーから読み出す速度が処理量に影響する。Rebellionsは、このデータ移動と電力効率を重視して製品を設計している。

同社の製品資料によると、Rebel100は4つのチップレットをUCIe-Advancedで接続し、144GBのHBM3Eと512MBのオンチップSRAMを搭載する。公称メモリー帯域は毎秒4.8TB、FP8演算性能は約2ペタFLOPS、チップの消費電力は最大600Wだ。Rebellionsは2026年のISSCCで、このチップレット構成の論文と動作デモを発表した。

UCIeは、パッケージ内の小さな半導体チップ同士を接続する業界標準だ。Rebellionsはその仕組みを使って4つの演算チップレットを連携させている。Rebel100はサムスン電子の4nmプロセスで製造され、Rebellionsが公表するソフトウェア構成はPyTorch、vLLM、Tritonなどに対応する。

Rebellionsの製品仕様では、RebelRackのNPUラックはRebel100搭載カード32基を収容し、FP8演算性能は合計64ペタFLOPS、最大消費電力は28kWとなっている。これらは製品の公称仕様であり、導入先が重視する実際の処理量やコストは、使用するモデルや運用条件に沿った評価が必要になる。調査会社Jon Peddie Researchも、製品の設計を評価する一方、独立した性能比較はまだ乏しいと指摘している。

■販売事業と資金調達の背景

トーメンデバイスの2026年3月期連結決算は、売上高が6336億6800万円、営業利益が187億8400万円だった。同社は生成AI関連のデータセンター投資に伴うメモリー需要に加え、サーバー・ストレージ向けや車載向け製品の販売増、メモリー価格の上昇を業績の背景としている。

Rebellionsは2020年9月に設立された。2025年9月に発表した2億5000万ドル(約395億円)のシリーズCにはArmやSamsung Venturesが参加した。同社はサムスン電子との製造面での関係に加え、出資者にも半導体関連企業を持つ。

2026年3月には、Mirae Asset Financial Groupと韓国国家成長基金が主導するIPO前のラウンドで4億ドル(約632億円)を調達した。Rebellionsの発表では、累計調達額は8億5000万ドル(約1343億円)、当時の企業価値は約23億4000万ドル(約3697億円)で、将来の株式上場に向けた準備を進めている。

韓国では、Rebellions製NPUがSK Telecomの商用AIサービスにも使われている。同社は2026年9月、適用先が通話要約など4つのサービスに広がり、これらのサービスで1日1400万件超のAI処理を扱うと発表した。日本での実証と導入計画は、こうした商用利用に続く展開となる。

■推論用半導体の選択肢は広がる

AI推論向けの製品はRebellions以外も増えている。NVIDIAとGroqは2025年12月、Groqの推論技術について非独占のライセンス契約を発表した。Axiosは取引額を約200億ドル(約3兆1600億円)と報じている。

OpenAIとBroadcomは2026年6月に推論用チップ「Jalapeño」を発表し、OpenAIは8月に自社で測定した初期の性能結果を公表した。Intelも推論向けデータセンターGPU「Crescent Island」について、2026年後半に顧客向けのサンプル提供を始める予定だと発表している。

Rebellionsをめぐっては、Bloombergが2026年8月、NVIDIAとの技術協力、出資、買収などの可能性について初期段階の協議が行われていると報じた。日本ではトーメンデバイスによる実証とai&の導入計画が別々に進む。実際の利用条件における性能、電力、運用コストの評価が、採用規模を判断する材料となる。

元記事: Nvidia Holds 90 Percent of GPU Market; Japan’s Samsung Distributor Chose Rival Rebellions NPU

※この記事はTech Timesから提供を受けた記事を日本向けに翻訳・編集したものです。

関連キーワード