本文へスキップ
株式会社オブライト
AI2026-10-01約13分で読めます

Gemini 4 Argon 徹底解説 — 料金$2/$10・1M出力・ベンチマーク比較【2026年10月】

2026年9月30日発表のGoogle製「Gemini 4 Argon」は、導入価格が入力$2・出力$10(1Mトークン)で、出力は最大100万トークンに対応する。Vals Index首位の総合性能、主要競合との料金比較、現在はFairwind限定の提供状況と未公表事項までを最速でわかりやすく整理する。


Gemini 4 Argon は、Google が2026年9月30日に発表したフロンティアモデルです。実務コーディング、金融リサーチや法務文書作成といった企業のナレッジワーク、脆弱性の自律修正を含むサイバー防御を主な用途に掲げ、料金は導入価格で入力 $2 / 出力 $10(1Mトークンあたり)、出力は最大100万トークンまで出せます。ただし現時点の提供先は信頼されたサイバー防御者向けの「Fairwind Program」に限られ、一般のAPI利用はまだ始まっていません。

ベンチマークでは Vals Index で1位(68.9%)、DeepSWE v1.1 でも77.9%と首位に立つ一方、FrontierSWE v2 と Terminal-bench 4.0 では他社モデルに後れを取ります。本コラムでは仕様・料金・ベンチマーク・提供状況を整理し、GPT-6 Astra、Claude Opus 5.5、Claude Sonnet 5.5、GPT-6.1 Sol との使い分けまでまとめます。数値は Google の発表と第三者の公表値で、独立した再現検証は未実施です。

Gemini 4 Argon の主要スペック早見表

項目内容
発表日2026年9月30日(Google公式ブログ「Gemini 4 Argon: our next era of frontier intelligence」)
位置づけGoogle のフロンティアモデル
主な用途実務コーディング、金融リサーチ・法務ドラフトなどの企業ナレッジワーク、サイバー防御(脆弱性の自律修正)
最大出力最大100万トークン(従来のGeminiは64K)
入力コンテキスト公式ブログに明記なし(第三者情報では100万トークンとの記載あり)
公開モデルID未公表
現在の提供先Fairwind Program(信頼されたサイバー防御者向けの任意の事前アクセス)
今後の提供有料APIユーザーと Google AI Ultra 加入者、その後できるだけ早く開発者・企業・一般ユーザーへ

特筆すべきは出力上限の拡大です。従来のGeminiは64Kトークンが上限でしたが、Argon は最大100万トークンの出力に対応します。大規模なコード生成、長大な報告書、リポジトリ全体にわたるリファクタリング案を1回の呼び出しで出しきれる可能性があります。一方で入力側のコンテキスト長は公式ブログでは明示されておらず、100万トークンという数字は第三者情報にとどまります。採用判断では公式ドキュメントの公開を待って確認してください。

料金:導入価格と通常価格

Argon の料金は導入価格と通常価格の2段構えです。導入価格は入力 $2 / 出力 $10、導入期間終了後の標準価格は入力 $4 / 出力 $20(いずれも1Mトークンあたり)で、導入期間の長さは公表されていません。キャッシュ入力は入力単価の95%オフです。

項目導入価格標準価格(導入期間後)概算円換算(導入価格、1ドル=約150円)
入力$2 / 1Mトークン$4 / 1Mトークン約300円
キャッシュ入力入力単価の95%オフ($0.10相当)入力単価の95%オフ($0.20相当)約15円
出力$10 / 1Mトークン$20 / 1Mトークン約1,500円

キャッシュ入力の$0.10・$0.20は「入力単価の95%オフ」から算出した目安で、公式の単価表を確認するまでは参考値として扱ってください。また、思考(thinking)トークンが別料金になるかどうかは公表されていません。推論を多用する用途では、ここが実コストを左右します。

競合モデルとの料金比較

モデル入力出力メモ
Gemini 4 Argon(導入価格)$2$10通常は$4 / $20。期間未公表
Claude Sonnet 5.5$2$10同価格帯の中位モデル
Claude Opus 5.5$4$20Argonの通常価格と同額
GPT-6.1 Sol$2$10キャッシュ入力は$0.10
GPT-6 Astra$10$50OpenAIの上位モデル

導入価格のArgonは、Claude Sonnet 5.5 や GPT-6.1 Sol とまったく同じ $2 / $10 です。導入期間が終わって $4 / $20 になると Claude Opus 5.5 と並び、GPT-6 Astra($10 / $50)の5分の2の水準になります。「導入価格が永続する」前提で長期の予算を組まないことが大切です。

Vals の評価では、1テストあたりのコストが Argon $15.68、Claude Sonnet 5.5 $21.34、Claude Opus 5.5 $32.14、Fable 5.1 $28.71と、Argon が最も低い結果でした。単価だけでなく、少ないトークンで答えにたどり着くため総額が下がるという見方もできます。ただし、長い自律タスクでは逆転します。CUA-bench では1テストあたり $193.78 と高額で、エージェント的に長時間回す用途ではコストが跳ね上がる点に注意が必要です。

ベンチマーク結果と読み方

ベンチマークGemini 4 Argon比較対象(報告値)
Vals Index68.9%(1位)Opus 5.5 67.0% / Sonnet 5.5 67.04% / Fable 5.1 65.8% / GPT-6 Astra 63.1%
DeepSWE v1.177.9%Opus 5.5 74.2% / Astra 74.1% / Fable 5.1 67.4%
FrontierSWE v255.0%Astra 65.5%(最高)/ Opus 5.5 62.3% / Fable 56.3%
Terminal-bench 4.057.4%Opus 5.5 66.4%(最高)/ Astra 58.2% / Fable 57.9%
GraphWalks 1M84.2%Astra 71.8% / Opus 66.8% / Fable 65.0%
CWE-bench v168.0%Astra 68.0%(同率)/ Opus 67.0% / Fable 58.0%
AutomationBench51.3%(1位)詳細未掲載
LVBench(長尺動画)91.7%詳細未掲載
Gemini 4 Argon、GPT-6 Astra、Claude Opus 5.5、Claude Fable 5.1 を4つのベンチマークで比べた横棒グラフ。Vals Index と GraphWalks 1M では Argon が1位、FrontierSWE v2 と Terminal-bench 4.0 では最下位。

Google は、公表されている18ベンチマークのうち13で GPT-6 Astra を上回ったとしています。強みと弱みを整理すると次のとおりです。

- 強み(総合・長文・自動化): Vals Index と AutomationBench で首位。GraphWalks 1M は84.2%で2位以下に10ポイント以上の差があり、長大な入力を横断して推論する力が高い。
- 強み(コード修正): DeepSWE v1.1 は77.9%で首位。CWE-bench v1 では Astra と並ぶ68.0%で、脆弱性修正の訴求とも整合する。
- 強み(安全性): プロンプトインジェクション耐性を測る Gray Swan IPI でトップとされる。外部データを読むエージェントには重要な指標。
- 強み(動画): 長尺動画理解の LVBench で91.7%。
- 弱み(難しいSWE): FrontierSWE v2 は55.0%で、Astra(65.5%)と10.5ポイント差、Opus 5.5(62.3%)にも及ばない。
- 弱み(ターミナル操作): Terminal-bench 4.0 は57.4%で、Opus 5.5(66.4%)に9ポイントの差。

読み方のポイントは、ベンチマークごとに首位が分かれることです。DeepSWE のような比較的素直な修正課題には強い一方、より難しい SWE 課題やシェルを多用する作業では Claude Opus 5.5 や GPT-6 Astra が優位です。自社の業務に近いベンチマークを重視して判断してください。なお上記は発表時点の数値で、独立した再現検証はまだありません。

安全性への取り組み

Google は Frontier Safety Framework に基づき、社内外のレッドチーミング、サンドボックスでのテスト、思考の連鎖(CoT)における不整合のモニタリングを実施したと説明しています。サイバーやCBRN(化学・生物・放射性物質・核)に関する有害な依頼は拒否する一方、正当なデュアルユース研究は妨げないよう調整したとされます。最初の提供先を信頼されたサイバー防御者に絞った Fairwind Program も、能力の高さを踏まえた段階的公開の一環といえます。

いつ・どこで使えるか

提供は段階的に進みます。現在は Fairwind Program(信頼されたサイバー防御者向けの任意の事前アクセス)のみで、次に有料APIユーザーと Google AI Ultra 加入者、その後は開発者・企業・一般ユーザーへ「できるだけ早く」広げる方針です。9月30日時点では、Vertex AI、OpenRouter、Gemini CLI、Cursor、GitHub Copilot のいずれでも利用できません。

提供段階対象状況
第1段階Fairwind Program(信頼されたサイバー防御者)提供中
第2段階有料APIユーザー、Google AI Ultra 加入者予定(日付は未公表)
第3段階開発者・企業・一般ユーザー「できるだけ早く」(日付は未公表)

現時点で未公表の主な事項は次のとおりです。

- 公開モデルID
- 導入価格の期間
- 思考トークンの課金方法
- 入力コンテキスト長の公式な数値
- 第2段階以降の具体的な提供日
- Vertex AI や各種ツールへの対応時期

GPT-6 Astra・Claude・GPT-6.1 Sol との違いと使い分け

モデル価格(入力/出力)得意な領域向く用途
Gemini 4 Argon$2/$10(導入)総合評価、長文推論、コード修正、自動化長大な入力の分析、出力が長い生成、脆弱性修正
GPT-6 Astra$10/$50FrontierSWE v2(65.5%)難度の高いSWE、最高性能が必要な場面
Claude Opus 5.5$4/$20Terminal-bench 4.0(66.4%)ターミナルを多用するエージェント作業
Claude Sonnet 5.5$2/$10Vals Index 67.04%、コスト効率日常的な開発・業務の標準モデル
GPT-6.1 Sol$2/$10Astraに近い知能を低価格でOpenAI系で価格を抑えたい用途

使い分けの目安は次のとおりです。長い資料を丸ごと読ませて分析する、あるいは長大な出力を一度に得たいなら Argon が有力です。ターミナル操作が中心のエージェントなら Claude Opus 5.5、難しい大規模SWEタスクなら GPT-6 Astra が現時点では強い選択肢です。日常の開発で価格と性能のバランスを重視するなら、すでに利用可能な Claude Sonnet 5.5 や GPT-6.1 Sol が現実的です。Google 系の低価格モデルを探しているなら、Gemini 3.8 Flash も比較対象になります。

ただし Argon は一般提供前で、実際に試せるのはごく限られた組織だけです。比較表の数字は発表値にすぎないため、提供開始後に自社の課題で再評価するのが前提になります。

今のうちに準備しておくこと(開発者向け)

- 評価セットを用意する: 自社の実コードや実文書から、10〜30件の代表的な課題と合否基準を作っておく。提供開始当日に、Claude Sonnet 5.5 や GPT-6.1 Sol と同条件で比較できる。
- 100万トークン出力の使いどころを洗い出す: 長大なコード生成、仕様書やレポートの一括生成、大規模なデータ変換など、従来は分割していた処理を候補にする。出力が長いほど課金も増えるため、必要な出力量の見積もりが先。
- コストを複数シナリオで見積もる: 導入価格($2/$10)と標準価格($4/$20)の両方で月額を試算する。キャッシュの活用度、思考トークンの課金方法(未公表)、長時間エージェントの高コスト(CUA-benchの例)を感度分析に入れる。
- モデルを差し替えやすくする: モデルIDやプロバイダーを設定値で切り替えられる構造にしておく。公開モデルIDが決まった時に、すぐ検証環境へ組み込める。
- セキュリティ用途は体制を確認する: 脆弱性修正の自動化を狙う場合は、人間によるレビューと承認の工程を残す。

まとめ

Gemini 4 Argon は、Vals Index と DeepSWE v1.1 で首位に立ち、1M出力と $2 / $10 の導入価格を掲げる注目のモデルです。一方で、FrontierSWE v2 や Terminal-bench 4.0 では他社に及ばず、導入期間・思考トークン課金・入力コンテキストなど重要な情報が未公表で、独立した再現検証もありません。現時点では一般には使えないため、評価セットとコスト試算を整えて提供開始を待つのが最も確実な対応です。続報があれば、本コラムを更新します。

よくある質問

Gemini 4 Argon はいつから使えますか?

2026年9月30日の発表時点では、信頼されたサイバー防御者向けの Fairwind Program のみで提供されています。その後、有料APIユーザーと Google AI Ultra 加入者、さらに開発者・企業・一般ユーザーへ「できるだけ早く」広げる方針ですが、具体的な日付は未公表です。

Gemini 4 Argon の料金はいくらですか?

導入価格は入力 $2、出力 $10(1Mトークンあたり)で、キャッシュ入力は入力単価の95%オフです。導入期間後の標準価格は入力 $4、出力 $20です。導入期間の長さと、思考トークンが別料金になるかどうかは未公表です。

Claude Opus 5.5 や GPT-6 Astra より高性能ですか?

ベンチマークによって異なります。Vals Index(68.9%)と DeepSWE v1.1(77.9%)では首位ですが、FrontierSWE v2 では GPT-6 Astra、Terminal-bench 4.0 では Claude Opus 5.5 が上回ります。独立した再現検証もまだないため、自社の課題での評価を推奨します。

出力100万トークンは何に使えますか?

従来のGeminiの出力上限は64Kでした。大規模なコード生成、長い報告書の一括作成、大量データの変換など、分割していた処理を1回で完結できる可能性があります。ただし出力が増えるぶん課金も増えるため、必要量の見積もりが重要です。

Vertex AI や Cursor、GitHub Copilot で使えますか?

2026年9月30日時点では、Vertex AI、OpenRouter、Gemini CLI、Cursor、GitHub Copilot のいずれでも利用できません。公開モデルIDも未公表です。対応は段階的な提供の進行に合わせて発表されると見込まれます。

お気軽にご相談ください

お問い合わせ