はじめに
国産の大規模言語モデル(LLM)として注目された「Rakuten AI 3.0」は、2026 年 3 月 17 日に提供が開始されました。約 7,000 億パラメータという国内最大規模をうたう一方で、公開直後にはベースモデルの出自やライセンスをめぐる議論も生まれ、「国産 AI とは何か」をあらためて問う事例にもなりました。
本記事では、インフラエンジニアの視点から、Rakuten AI 3.0 の技術的な特徴と日本語性能を客観的に整理し、後半では他の国産 LLM との使い分けや、ローカル運用時のデータ主権の実態までを扱います。
- Rakuten AI 3.0 の概要と MoE アーキテクチャの技術的な特徴
- 日本語ベンチマークでのスコアと評価の読み方
- DeepSeek V3 派生をめぐる論争の経緯とライセンス対応
- 他の国産 LLM・グローバルモデルとの使い分けの基準
- オンプレミス/閉域でローカル運用する場合のデータ主権と注意点
結論を先にまとめると、Rakuten AI 3.0 は MoE アーキテクチャを採用した約 7,000 億パラメータの日本語特化モデルで、複数の日本語ベンチマークで高いスコアを示しています。一方で、ベースには DeepSeek V3 が用いられており、国産 AI として評価する際にはこの点を踏まえた理解が求められます。API 利用とローカル運用ではデータの扱いが大きく異なり、用途に応じた選定が判断の分かれ目になります。
Rakuten AI 3.0 の概要と技術的背景
Rakuten AI 3.0 は、日本語の表現や文化的背景の理解に重点を置いて開発された大規模言語モデルです。GENIAC プロジェクトの支援を受け、約 7,000 億パラメータという規模と、効率的な推論を両立する MoE アーキテクチャを採用している点が特徴です。
約 7,000 億パラメータと MoE アーキテクチャ
本モデルは、日本語特化の LLM としては国内最大規模となる約 7,000 億パラメータを持ちます。この規模を実用的な速度で動かすために採用されているのが MoE(Mixture of Experts)です。
MoE は、モデル内部に複数の「専門家(Expert)」ネットワークを配置し、入力されたタスクの性質に応じて必要な専門家のみを部分的に稼働させる方式です。総パラメータを大きく保ちながら、推論時に実際に動くパラメータを絞ることで、計算リソースの消費を抑えつつ処理性能を確保します。Rakuten AI 3.0 の場合、総パラメータ約 7,000 億(671B)に対して、推論時に稼働するパラメータ(Activated Parameters)は 37B 程度とされ、規模と効率のバランスを取る設計になっています。

参考: 楽天グループ プレスリリース(2025 年 12 月 18 日)
「日本語に特化した LLM として(中略)最大規模となる約 7,000 億個のパラメータを持つ MoE LLM」
https://corp.rakuten.co.jp/news/press/2025/1218_01.html
GENIAC プロジェクトにおける開発の背景
開発は、経済産業省と NEDO(新エネルギー・産業技術総合開発機構)が推進する生成 AI 開発支援プログラム「GENIAC(Generative AI Accelerator Challenge)」の一環として行われました。楽天は次世代 LLM の研究開発のため 2025 年 7 月に GENIAC の第 3 期公募に採択されており、本モデルの学習費用の一部に計算資源としての補助を受けています。
国内の AI 開発基盤の強化を目的とする同プロジェクトの支援のもと、楽天は自社のバイリンガルデータと研究成果を活用してモデルを開発しています。なお、ベースモデルの出自をめぐっては公開後に議論が生じており、この点は後半の「DeepSeek V3 派生をめぐる論争」で整理します。
日本語ベンチマークでの評価と他モデルとの違い
Rakuten AI 3.0 は、日本固有の知識や推論、指示遵守などを測る複数の日本語ベンチマークで、OpenAI の gpt-4o や国内の主要なオープンモデルを上回るスコアが公表されています。ここではスコアの内容と、その読み方を整理します。
日本語性能に最適化したアプローチ
グローバルな LLM の多くは英語中心の学習データで構築されており、日本語特有の敬語表現や、日本固有の文化・歴史的文脈の扱いに課題が残る場合があります。Rakuten AI 3.0 は開発段階から日本語の文脈理解に最適化されており、日本のビジネス習慣に沿った応答の生成に向いているとされています。
ベンチマーク結果の読み方
楽天が公表した主要モデルとの比較は以下のとおりです。
| モデル名 | JamC-QA | MMLU-ProX | MATH-100 | M-IFEval |
|---|---|---|---|---|
| Rakuten AI 3.0 | 76.9 | 71.7 | 86.9 | 72.1 |
| gpt-4o | 74.7 | 64.9 | 75.8 | 67.3 |
| GPT-OSS-Swallow-120B-RL-v0.1 | 63.0 | 63.0 | 70.5 | 69.5 |
| Stockmark-2-100B-Instruct | 61.1 | 41.7 | 55.6 | 45.6 |
| ABEJA-QwQ32b-Reasoning-v1.0 | 61.1 | 61.1 | 52.7 | 61.9 |
出典: 楽天グループ プレスリリース(2026 年 3 月 17 日)
各ベンチマークが測る対象は次のとおりです。
- JamC-QA: 日本固有の文化的知識や歴史に関する問題
- MMLU-ProX: 多分野の専門知識と推論能力
- MATH-100: 競技数学レベルの数理的な推論
- M-IFEval: 指示への遵守能力
これらのスコアは、公開元である楽天の評価条件下での結果である点に留意が必要です。ベンチマークの数値は測定条件やプロンプト設計に左右されるため、実際の採用にあたっては、自社の用途に近いタスクで検証することをおすすめします。
DeepSeek V3 派生をめぐる論争の経緯
Rakuten AI 3.0 は公開直後から、ベースモデルの出自をめぐって技術コミュニティで議論を呼びました。ここでは何が指摘され、楽天がどう対応したかを整理します。
config.json で判明したアーキテクチャの一致
公開当日、Hugging Face のリポジトリを確認した技術者が、config.json のアーキテクチャ定義に deepseek_v3 の記載を見つけました。アーキテクチャ項目には DeepseekV3ForCausalLM と明記され、隠れ層サイズ 7168、61 層、256 個のルーテッドエキスパート、語彙サイズ 129,280 といった構成が DeepSeek V3 と一致していました。総パラメータ 671B・活性化パラメータ 37B という値も共通しており、Hugging Face の自動タグ付けでも deepseek_v3 が付与されていたことから、Rakuten AI 3.0 は DeepSeek V3 を基にした派生モデルであるとの見方が広がりました。
楽天は公式発表でベースを「オープンソースコミュニティ上の最良なモデル」と表現する一方、DeepSeek への言及はなく、報道機関の取材に対しても当初はベースモデルを非開示とする姿勢でした。
ライセンス表記の問題と楽天の対応
Rakuten AI 3.0 は Apache 2.0 ライセンスで公開されました。一方、派生元とされる DeepSeek V3 は MIT ライセンスで提供されており、派生モデルには NOTICE ファイルへの記載が求められます。公開当初はこの NOTICE ファイルが欠落していると指摘され、楽天は後に NOTICE ファイルを追加して対応し、現時点ではライセンス上の問題は解消されています。
「国産 AI」の定義をめぐる論点
日本政府が国産 AI の自立を目的に設けた GENIAC の支援を受けながら、中国発のベースモデルの派生版を国産 AI として打ち出した点に、エンジニアコミュニティを中心に違和感が共有されました。ただし技術的には、既存の優れたオープンモデルを基盤に独自データでファインチューニングするアプローチ自体は一般的な手法であり、それ自体が問題視されたわけではありません。論点の中心は、ベースモデルの出自に関する情報開示のあり方にありました。
インフラエンジニア視点の制約と運用上の注意点
Rakuten AI 3.0 を実務で扱う際は、その規模と出自に由来する制約を理解しておく必要があります。導入検討の判断材料となる 4 点を整理します。
ローカル運用に求められるリソース規模
Rakuten AI 3.0 は DeepSeek V3 と同じ 671B(活性化 37B)の MoE 構成を持つため、重みファイルのサイズも同等規模になります。DeepSeek V3 系のフルスペックの重みは TB 級(同系統の R1 で約 1.7TB)に達し、量子化しても数百 GB 規模となります。671B 規模のモデルは一般的なゲーミング PC の構成では動作させられず、サーバー級のメモリ構成や複数の高性能 GPU が必要になるケースが想定されます。「ローカルで動かせる」という表現は、個人向け単一 GPU での実行を意味しない点に注意が必要です。低ビット量子化版や蒸留版を用いれば必要リソースは下がりますが、その場合は精度や応答品質とのトレードオフを検討することになります。

データ主権の実態(API 利用とローカル運用の違い)
ベースが中国発のモデルであることから、データの取り扱いを懸念する声もありますが、ここは運用形態によって状況が大きく異なります。Hugging Face で公開された重みをダウンロードし、オンプレミスや閉域環境でローカル運用する場合、入力データが外部や国外のサーバーへ送信される経路は原理的に発生しません。 データ越境が論点になるのは、外部 AI サービスの API を経由して利用する場合です。閉域での自社運用を前提にできる点は、機密データを扱うインフラ・セキュリティ用途での利点になります。
参考: AI 革命株式会社メディア
「Rakuten AI 3.0 はオープンソースモデルなので、ローカル運用であれば中国へのデータ送信リスクはありません」
https://ai-revolution.co.jp/media/rakuten-ai-deepseek-rebrand/
DeepSeek V3 由来のセキュリティ特性
ベースモデルの特性は、派生モデルにも一定程度引き継がれる可能性があります。DeepSeek V3 については、第三者機関(Palo Alto Networks Unit 42 等)により、特定のプロンプトによる安全ガードレールの回避(脱獄)への耐性が他の主要モデルより弱い可能性や、有害コンテンツ出力のリスクが指摘されてきました。Rakuten AI 3.0 が同様の傾向をどの程度受け継いでいるかは公開情報だけでは判断しきれないため、業務利用にあたっては、自社のユースケースで有害出力やプロンプトインジェクションへの耐性を検証し、必要に応じて入出力のフィルタリングやガードレールを別途設けることをおすすめします。なお楽天は、バックドアや悪意ある操作がないことを確認したとしています。
ライセンス運用上の確認ポイント
商用利用の前提として Apache 2.0 は扱いやすいライセンスですが、派生元 DeepSeek V3 の MIT 条項が NOTICE を通じて引き継がれている点に留意が必要です。再配布やファインチューニング版の公開を行う場合は、NOTICE ファイルの内容と表示義務を確認し、ライセンス条項を維持したうえで配布することをおすすめします。
他の国産 LLM・グローバルモデルとの使い分け
国産 LLM には、Rakuten AI 3.0 のような大規模モデルだけでなく、軽量さとオンプレミス運用を強みとするモデルもあります。代表例として、NTT がフルスクラッチで開発した「tsuzumi 2」との対比を含めて、選定の観点を整理します。
| 項目 | Rakuten AI 3.0 | tsuzumi 2(NTT) | グローバルモデル(gpt-4o 等) |
|---|---|---|---|
| パラメータ規模 | 約 7,000 億(活性化 37B)の MoE | 30B(軽量) | 非公開・大規模 |
| 入手・ライセンス | オープンウェイト(Apache 2.0) | 商用提供(純国産) | API 提供が中心 |
| ベース | DeepSeek V3 ベースの派生 | フルスクラッチ開発 | 各社独自 |
| 運用形態 | 大規模サーバー/マルチ GPU が前提 | 1GPU(A100 級)でオンプレ運用可 | クラウド API が中心 |
| データ主権 | ローカル運用で閉域完結が可能 | オンプレ・閉域に強み | 外部送信が前提 |
| 向く用途 | 高度な推論・大規模基盤・汎用処理 | 機微情報・オンプレ業務・低コスト | 最高水準の汎用性・手軽さ |
出典: 各社公式発表(楽天 2026 年 3 月/NTT 2025 年 10 月・2026 年 5 月)
なお tsuzumi 2 は、2026 年 3 月にデジタル庁の政府 AI 基盤「源内(Gennai)」の試用 LLM にも選定されており、データ主権を重視するソブリン AI の需要に応える位置づけで展開されています。
用途別の選定基準
- 高度な推論能力や大規模な基盤モデルとしての汎用性を求める場合は、Rakuten AI 3.0 が選択肢になります。文章作成、コード生成、長文の文書解析など幅広いテキスト処理に向きますが、運用には相応のサーバーリソースが必要です。
- 機密情報を扱い、オンプレミスや閉域で低コストに運用したい場合は、tsuzumi 2 のような軽量・純国産モデルが適します。1GPU 環境で動かせるため、導入のハードルが低い点が利点です。
- 最新の汎用性能や手軽さを重視し、外部 API の利用に支障がない場合は、グローバルモデルが扱いやすい選択肢になります。
国産モデルが一律に優れているわけではなく、扱うデータの機密性、運用できるインフラ規模、求める性能の三つの軸で選び分けることが現実的です。
まとめ
本記事では、楽天の国産 AI「Rakuten AI 3.0」について、技術的な特徴と日本語性能に加え、DeepSeek V3 派生をめぐる論争と実務上の注意点を整理しました。規模と性能の高さがある一方で、ベースモデルの出自や運用形態に応じた判断が求められるモデルです。
- GENIAC の支援で開発された約 7,000 億パラメータの MoE モデル
- 複数の日本語ベンチマークで gpt-4o を上回る日本語性能
- DeepSeek V3 をベースとし、国産 AI の定義をめぐり生じた論争
- Apache 2.0 ライセンス、NOTICE 追加で解消済みのライセンス問題
- 個人向け GPU では非現実的な、サーバー級リソース前提のローカル運用
- オンプレ・閉域運用で回避できるデータ越境リスク
- 機密情報・低コスト用途で有効な tsuzumi 2 等との使い分け
以上、最後までお読みいただきありがとうございました。
