Gemini 4 Argon とは|API 料金と限定提供の条件

  • URLをコピーしました!
目次

はじめに

Google は 2026 年 9 月 30 日(米国時間)、新しいフロンティアモデル Gemini 4 Argon を発表しました。長期にわたるソフトウェア開発、法務や金融などの企業ナレッジワーク、サイバー防御を主な用途として挙げ、API の導入価格も同時に公表しています。

一方で、発表時点の提供先は Fairwind Program を通じた一部のサイバー防御組織に限られ、一般向けの提供開始日は示されていません。料金だけが先に公表されたため、「すでに使えるのか」「予算をどう見積もるか」を判断しにくい状況です。本記事では、現在の提供状況、今後の予定、公開仕様として未確認の事項を分けたうえで、費用の試算と提供開始後の評価項目を整理します。

この記事でわかること
  • Gemini 4 Argon を現在利用できる対象と今後の提供予定
  • モデル ID や提供地域など、公開仕様として確認できていない事項
  • 1M トークンの出力上限の意味と Gemini 3.8 Flash との違い
  • 公式性能表の代表的な指標と、評価条件を踏まえた読み方
  • 導入価格と導入期間終了後の価格による費用試算
  • 提供開始後に自組織のタスクで評価する項目

結論: 一般向けの提供開始はまだ案内されていない

2026 年 10 月 1 日時点で公式に確認できる提供先は、Fairwind Program を通じた一部の trusted cyber defenders(信頼されたサイバー防御組織)です。有料 API 利用者と Google AI Ultra 契約者は「最初に展開される予定の対象」であり、一般向けの提供開始を示す公式案内はまだありません。

API 料金は 100 万トークンあたり入力 $2、出力 $10 の導入価格で、導入期間の終了後は入力 $4、出力 $20 に上がります。終了日は公表されていないため、予算は両方の単価で見積もっておくことをおすすめします。

Gemini 4 Argon は今使えるか

発表本文が示しているのは、限定提供を先行させ、セーフガードを強化してから広く展開するという段階的な方針です。Google は、米国政府の自主的なリリース前モデルアクセスのプロセスに参加しながら、アクセスを徐々に拡大するとしています。

参考: Google「Gemini 4 Argon: our next era of frontier intelligence」
“starting with paid API customers and Google AI Ultra subscribers”
(有料 API 利用者と Google AI Ultra 契約者から開始)
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/

Gemini 4 Argon の提供状況の早見表

利用者の区分ごとに、2026 年 10 月 1 日時点の状態と今後の予定を整理します。「今後の予定」は Google の発表内容であり、開始時期はいずれも示されていません。

対象現在の状態今後の予定確認先
有料 Gemini API 利用者一般提供開始の公式案内なし。公開モデル一覧・料金表に未掲載一般向け展開の最初の対象。開始日は未公表Gemini API のモデル一覧、料金表、リリースノート
Google AI Ultra 契約者(Gemini アプリ)利用可能とする公式発表なし一般向け展開の最初の対象。開始日は未公表Google の公式ブログ、Gemini アプリの更新情報
無料利用者、Google AI Pro 契約者利用可能とする公式発表なし提供の有無と時期は未公表Google の公式ブログ、Gemini アプリの更新情報
Fairwind Program の対象組織一部の組織へ展開中申請を継続審査し、対象組織を順次追加Google の担当窓口

Gemini API のモデル一覧(2026 年 9 月 24 日更新)と料金表には、10 月 1 日時点で Argon の項目がありません。ただし、これは公開カタログに未掲載であることを示すもので、限定提供の経路での利用可否を示すものではありません。

公開仕様として未確認の事項

次の事項は、発表本文と Gemini API のドキュメントでは確認できませんでした。提供開始後に公式ドキュメントで確認する必要があります。

  • 公開モデル ID と提供段階(Preview、Stable など)
  • 入力コンテキスト長、対応する入力形式、対応するツール
  • 日本を含む提供地域、無料ティアや Google AI Pro での提供の有無
  • Batch、Flex、Priority、コンテキストキャッシュの保存料金などの課金条件
  • thinking token の課金区分と、一般向け提供でのデータの扱い
  • Gemini アプリでの提供開始日と利用上限

モデル ID と API 仕様が公開されていないため、本記事では呼び出しコードや移行手順を掲載していません。

Fairwind Program の参加組織でも自動的には使えない

発表本文の表現は、Fairwind Program を通じて「一部の」trusted cyber defenders へ展開中というものです。Fairwind Program の公式ページには、Argon の限定提供と、申請組織のセキュリティ履歴・倫理的な運用実績を確認する審査が記載されています。政府・国家のサイバー機関、重要インフラ事業者、基盤技術を提供する組織が優先対象として挙げられています。

参考: Google DeepMind「Fairwind Program」
“The Fairwind Program provides exclusive access to Gemini 4 Argon with cybersecurity defense capabilities”
(Fairwind Program は、サイバー防御機能を備えた Gemini 4 Argon への限定アクセスを提供する)
https://deepmind.google/fairwind-program/

参加組織には、ユーザー単位の認証、フィッシング耐性のある MFA、適切なアクセス制御が求められます。Argon へアクセスできるのは社内のサイバーセキュリティ、インシデント対応、侵入テストのチームに限られ、従業員のアクセスと利用の記録も必要です。アクセスの共有・再配布・販売は禁止されています。

データの扱いについては、Gemini Enterprise 上の managed model として直接アクセスする場合、Argon は zero data retention(データ保持なし)に対応すると公式ページに記載されています。この条件を一般向けの API や Gemini アプリにも適用できるとは限らないため、一般向け提供の条件は提供開始後に確認する必要があります。

参加組織であることだけを根拠に Argon を利用できると判断せず、Google の担当窓口で対象かどうかを確認してください。Fairwind Program の対象分野、審査、許可される用途と、Flash Cyber の位置づけは『Gemini 3.8 Flash の料金と使い分け|Cyber は限定提供』で整理しています。

また Google は、trusted defenders と社内チームに対しては、サイバー領域のガードレールを外した Argon を提供するとしています。一般向けの提供とは、セーフガードの条件が異なるということです。発表で外すとされているのはサイバー領域のガードレールであり、CBRN などその他の安全対策の扱いは記載されていません。

Gemini 4 Argon の特徴と性能の読み方

仕様面での大きな変更は出力トークン上限の拡大です。性能表は用途ごとに優劣が分かれているため、特定の指標だけで採用を判断しない読み方が必要です。

出力トークン上限は 1M、入力コンテキスト長は未公表

Google は Argon の出力トークン上限を、従来の 64K から 1M トークンへ拡大したと説明しています。1 回の実行で数十万トークン規模の推論と生成を行い、難しい問題を一度で解けるようにするためとしています。

この 1M は出力トークンの上限であり、入力コンテキスト長ではありません。入力側の上限は発表本文で公表されていません。参考として、Gemini 3.8 Flash は Gemini API のモデルページで入力 1,048,576 トークン、出力 65,536 トークンと記載されています。

Gemini 3.8 Flash、3.8 Flash Cyber との違い

項目Gemini 4 ArgonGemini 3.8 FlashGemini 3.8 Flash Cyber
位置づけ新しいフロンティアモデルFlash 系列の一般提供モデルサイバー防御向けの限定モデル
提供状況一部の組織へ限定展開中一般提供(Stable)Fairwind Program の承認組織に限定
公開モデル ID未公表gemini-3.8-flash公開されていない
入力 / 出力の単価(100 万トークン)$2 / $10(導入価格)$0.75 / $3.75(2026 年 12 月 31 日まで)公開されていない
出力トークン上限1M65,536確認できず

Google は、脆弱性の発見で Argon が 3.8 Flash Cyber から大きく向上し、Wiz の内部ベンチマーク(ソースコードなしで稼働中の Web システムを分析する侵入テスト)でも上回ったと説明しています。ただし、Flash Cyber の提供条件をそのまま Argon に当てはめることはできません。

公式性能表の代表的な指標

次の表は、Google が性能表に掲載した比較対象 3 モデルとの値から、4 つの指標を抜粋したものです。

指標(評価対象)Gemini 4 ArgonGPT-6 AstraClaude Fable 5.1Claude Opus 5.5
DeepSWE v1.1(長期のソフトウェア開発)77.9%74.1%67.4%74.2%
Terminal-Bench 4.0(ターミナル操作を伴うエージェント作業)57.4%58.2%57.9%66.4%
OSWorld-2.0(コンピューター操作、オフラインサブセットの部分点)69.2%72.6%掲載なし掲載なし
CWE-bench v1(脆弱性の修正)68%68%58%67%

出典: Google DeepMind「Gemini 4 Argon」の公式性能表(2026 年 10 月 1 日確認)

長期のコード改修を測る DeepSWE v1.1 では Argon が上位ですが、ターミナル中心の作業を測る Terminal-Bench 4.0 では Opus 5.5 が 9 ポイント上回り、PC 操作の自動化を測る OSWorld-2.0 では GPT-6 Astra が上回っています。CWE-bench v1 は GPT-6 Astra と同率の首位です。性能表からは「あらゆる用途で最も高性能」とは読み取れず、用途ごとに優劣が分かれています。

評価方法ページによると、Argon のスコアは特記がない限り pass@1 で、Gemini API の最も高い thinking 設定で実行されています。DeepSWE v1.1、Terminal-Bench 4.0、OSWorld-2.0 の Argon の値は Google による自社計測で、OSWorld-2.0 は 3 回の実行の最大値です。CWE-bench v1 の値は公式の公開リーダーボードから取得されています。

参考: Google DeepMind「Gemini 4 Argon Model evaluation」
“All the results for non-Gemini models are sourced from providers’ self reported numbers”
(Gemini 以外のモデルの結果は、すべて各提供元の自己申告値を出典とする)
https://deepmind.google/models/evals-methodology/gemini-4-argon

評価方法ページには、この原則に対する指標ごとの例外も記載されています。いずれにしても、他社モデルの値は Google が同じ環境で測り直した結果ではありません。外部のベンチマークや公開リーダーボードの値も含まれますが、どの指標を選び、どのモデルと比較するかは Google が決めたものであり、独立した第三者による検証とは異なります。また、最も高い thinking 設定での結果は、既定の設定や低い設定で利用した場合の性能や費用を示すものではありません。

Gemini 4 Argon の API 料金と導入期間終了後の費用

Argon の API 料金は発表本文で公表されていますが、Gemini API の料金表にはまだ掲載されていません。確認できている単価と、未公表の条件を分けて整理します。

項目(100 万トークンあたり)導入価格導入期間の終了後
入力$2$4
出力$10$20
キャッシュ入力$0.10(入力単価 $2 の 95% 引きから算出)未公表

導入期間の終了日は、発表本文に記載がありません。Gemini 3.8 Flash の導入価格は 2026 年 12 月 31 日までと料金表に明記されていますが、これは Flash 系の条件であり、Argon に当てはまるとは限りません。

キャッシュ入力の $0.10 は、発表本文の「入力単価から 95% 引き」を導入価格の $2 に適用して算出した値です。導入期間の終了後もこの割引率が続くかは明記されていないため、本記事では終了後のキャッシュ入力料金を確定値として扱いません。キャッシュの保存料金、Batch、Flex、Priority の料金も、Argon については未公表です。Gemini 3.8 Flash の料金表では出力料金に thinking token を含むとされていますが、Argon が同じ扱いになるかは料金表への掲載後に確認する必要があります。

同じトークン数での費用試算

条件を固定し、導入価格と終了後の価格を比較します。いずれも実測値ではなく、発表された単価から算出した試算です。キャッシュ入力、割引、グラウンディングなどの追加料金は含めていません。

試算の条件導入価格導入期間の終了後
1 タスク(入力 100,000 / 出力 20,000 トークン)$0.40$0.80
上記のタスクを月 1,000 回$400$800
1 タスクの出力が 200,000 トークンに増えた場合(入力は同じ)$2.20$4.40
1 リクエストの出力が 1M トークンに達した場合(出力分のみ)$10$20

導入期間の終了後は、同じ使い方でも費用が 2 倍になります。導入価格だけで年間予算を組むと、期間の終了後に不足する可能性があります。

参考として、同じ 1 タスクを Gemini 3.8 Flash の Standard 料金で計算すると、2026 年 12 月 31 日までは $0.15、2027 年 1 月 1 日からは $0.30 です。ただし、モデルが異なれば同じタスクでも消費トークン数と完了率は変わるため、単価の比だけでモデル間の費用差は決まりません。

出力上限の拡大と実際の消費量は別

1M トークンという出力上限は、1 回のリクエストで生成できる最大量を示すもので、毎回その量を消費するわけではありません。ただし、上限に余裕があるほど、長い推論や出力を伴うタスクで 1 回あたりの出力トークンが増える可能性があります。上の試算では、出力が 20,000 から 200,000 トークンに増えると、1 タスクの費用は 5.5 倍になります。

提供開始後は、出力トークン数の上限を指定できるかと既定値を API 仕様で確認し、タスクごとに上限を設けることをおすすめします。

予算を申請する際は、導入価格と終了後価格の 2 通りに加えて、出力トークンが想定を上回った場合の上振れ幅も示しておくと、提供開始後の見直しを減らせます。

業務での採用に向けた確認事項

提供開始後に既存のモデルから Argon へ切り替えるかは、性能表ではなく自組織のタスクで判断する必要があります。次の表は本記事からの評価項目の提案であり、Argon の対応機能や検証済みの手順を示すものではありません。

確認項目確認する内容判断の材料
既存タスクの完了率現行モデルで処理している代表的なタスクを同じ条件で実行し、完了率と出力品質を比較する現行モデルとの差が、費用の増加に見合うか
再試行を含む費用1 回の呼び出しではなく、再試行とツール呼び出しを含めたタスク完了までの総トークン数を記録する導入価格と終了後価格の両方で予算内に収まるか
応答時間長い推論や出力による処理時間の増加を計測する既存のタイムアウト値や利用者の待ち時間の許容範囲に収まるか
構造化出力・ツール連携既存の JSON スキーマ、Function calling、社内ツールとの連携が同じように動作するかを確認するArgon での対応状況が公式ドキュメントに記載されているか
データの扱い提供経路ごとの利用規約、学習への利用、保存期間、提供地域を確認する社内規程と契約条件を満たすか
操作権限エージェントに与えるファイル、コマンド、外部システムへの権限を最小限に絞る誤操作やプロンプトインジェクションの影響範囲を限定できるか
切り戻しモデル ID を設定値として管理し、現行モデルへ戻せる状態で段階的に切り替える障害や品質低下の際に短時間で戻せるか

プロンプトインジェクション耐性とサイバー防御事例の読み方

Google は Argon を、間接的なプロンプトインジェクションに対してこれまでで最も耐性の高いモデルと説明し、Gray Swan の評価で上位としています。一方で、同じ発表の中で、これらの攻撃には継続的な警戒と多層の防御が必要とも述べています。耐性の向上はプロンプトインジェクションを防げる保証ではないため、入力の検証、権限の分離、重要な操作の承認は引き続き必要です。

また発表では、Wiz が Scan for Good の取り組みで Argon を使い、世界の病院で使われる医療ソフトウェアに、機微な個人情報が露出する重大な脆弱性を発見した事例が紹介されています。製品名、CVE 番号、悪用の有無は公表されていないため、この事例は自組織への影響を判断する材料にはなりません。

まとめ

Gemini 4 Argon は、長期のコーディング、企業ナレッジワーク、サイバー防御を狙った Google の新しいフロンティアモデルですが、発表時点で利用できるのは Fairwind Program を通じた一部の組織に限られます。料金は先に公表されたものの、導入期間の終了日やモデル ID などの公開仕様はまだ確認できません。提供開始の発表を待つ間に、2 通りの単価による予算と、自組織のタスクで比較する評価計画を準備しておくことをおすすめします。

  • 現在の提供先は Fairwind Program を通じた一部の組織に限られます。
  • 有料 API 利用者と Ultra 契約者は今後の展開の最初の対象です。
  • 一般向けの提供開始日、モデル ID、入力コンテキスト長は未公表です。
  • 導入価格は入力 $2 と出力 $10 で、終了後は単価が 2 倍に上がります。
  • 1M トークンは出力の上限であり、入力コンテキスト長とは別の値です。
  • 性能表は用途ごとに優劣が分かれ、全用途での優位を示していません。
  • 採用判断は、再試行を含む費用と完了率を自社のタスクで測って行います。

以上、最後までお読みいただきありがとうございました。

よかったらシェアしてね!
  • URLをコピーしました!

この記事を書いた人

関西を拠点に活動する、現役インフラエンジニア。経験20年超。

大手通信キャリアにて、中〜大規模インフラ(ネットワーク・サーバ・クラウド・セキュリティ)の設計・構築およびプロジェクトマネジメントに従事。現場で直面した技術課題への対処や、最新の脆弱性情報への実務対応を、一次情報として発信しています。

保有資格
CCIE Lifetime Emeritus(取得から20年以上)/ VCAP-DCA / Azure Solutions Architect Expert

▶ 運営者プロフィール(詳細)

目次