Google Gemini 4 Argon登場——「1回で100万トークン出力」と、一般公開されない理由【2026】

AI・テクノロジー

2026年9月30日、Googleは新しいフロンティアAIモデル「Gemini 4 Argon」を発表しました。ところが、発表を知ってすぐ試そうとした人は、少し戸惑ったはずです。Argonは一般には公開されていません。最初に渡されたのは、サイバー攻撃からシステムを守る「防衛側」の専門家たちでした。

私も発表当日にGeminiアプリを開きましたが、そこにArgonの姿はありませんでした。私が契約している無料プランでは、そもそも最上位モデルに触れる余地がなかったからです。高性能なモデルほど、公開の順番そのものが丁寧に設計される時代になっています。この記事では、Argonの実力と料金、そして「誰が、いつ使えるのか」を順に整理します。

Gemini 4 Argonとは——7か月ぶりの「本命」フラッグシップ

Argonは、Google DeepMindが送り出した新しい上位モデルです。発表の署名は、GoogleのチーフAIアーキテクトを務めるKoray Kavukcuoglu氏。ブログでは「次の時代のフロンティア知能」と表現されています。

このモデルはFlashクラスより上の自社モデルとしては7か月以上ぶりの登場です。前身にあたるGemini 3.5 Proは5月のGoogle I/Oで発表されたものの、結局出荷されませんでした。その間、Googleは軽量なFlash系モデルをつないできました。2025年11月のGemini 3以来、約10か月ぶりの大型更新ということになります。

狙いは明確です。GoogleはArgonの重点領域として、実務レベルのソフトウェア開発、法務や財務といった企業ナレッジワーク、サイバー防衛、そして創作的な文章の4つを挙げました。汎用のチャット相手ではなく、仕事の現場で長い工程を任せる相棒という位置づけです。短いやり取りを重ねる用途よりも、まとまった量の成果物を一度に仕上げる場面を想定しているわけです。

最大の進化は「出力100万トークン」——64Kからの大跳躍

Argonで最も目を引く数字は、出力トークン数の上限が100万になったことです。従来のGeminiモデルでは約64,000トークンでした。実に15倍以上への引き上げになります。

入力側の上限100万トークンは、最近のフロンティアモデルでは珍しくありません。しかし出力側を100万まで広げた例は多くありません。出力が長くとれるほど、モデルは一つの問題に対して長い推論を一度に走らせられます。途中で打ち切られてやり直す手間が減り、同じ仕事にかかる時間そのものも短くなっていきます。

Googleはこの拡張を「長距離の推論を途切れさせないための仕組み」と説明しています。これまで数十回の呼び出しをつないでいた作業が、一つの軌道の中で完結するわけです。長いコードの移行、分量の多い文書の生成、数時間にわたるエージェントの実行が現実的な範囲に入ります。

なぜ最初に「サイバー防衛者」へ渡すのか——Fairwindプログラム

Argonの提供先は、GoogleのFairwindプログラムに参加する信頼された防衛者たちです。このプログラムは9月2日に始まり、すでに650以上の組織が加わっています。

参加するのは政府機関や重要インフラの運営者、そしてセキュリティ企業です。名を連ねるのはCrowdStrike、Palo Alto Networks、そしてWizといった面々。医療、通信、エネルギー、金融の各分野からも参加しています。

注目すべきは、Fairwindの参加者とGoogle社内チームにはサイバーガードレールを外した状態で提供される点です。つまり検出と修正の能力を制限なく使える状態で渡されます。Googleは米国政府の自主的な事前アクセス手続きにも参加しており、安全性を確かめながら段階的に対象を広げる方針を示しています。

ベンチマークでOpenAIとAnthropicを逆転——第三者評価が示した実力

性能の主張を裏づける数字が並んでいます。Google自身の公表値では、18のベンチマーク項目のうち12〜13項目で首位または同点を取ったとされています。

代表的なスコアを見てみましょう。実務的なソフトウェア開発を測るDeepSWE v1.1では77.9%、業務自動化のAutomationBenchでは51.3%、長尺動画の理解を測るLVBenchでは91.7%、脆弱性の検出と修復を測るCWE-bench v1では68%を記録しました。256Kから100万トークンの入力を扱うGraphWalksでは84.2%と、競合に10点以上の差をつけています。

第三者の評価もこれを後押しします。Artificial Analysisの知能指数ではArgonが53を記録し、GPT-6 Astra(max)の53と並びました。GPT-6.1 Sol(max)の52は1点上回ります。Googleの従来モデルであるGemini 3.1 Pro Previewは30でしたから、実に23点の改善です。

見逃せないのが幻覚の少なさです。知能指数45以上を記録したモデルの中では、Argonの幻覚率15%が最も低い値でした。GPT-6 Astraが51%、GPT-6.1 Solが54%ですから、差は歴然としています。知らない問いに対して、無理に答えず「分からない」と言える傾向が強いということです。

料金はGPT-6 Astraの5分の1——価格の比較

価格設定も攻めています。Argonの導入価格は、入力が100万トークンあたり2ドル、出力が10ドルです。キャッシュ済みの入力は通常入力から95%引きの0.10ドルになります。

主要モデルとの比較をまとめました。単位は100万トークンあたりのドルです。

モデル入力出力
Gemini 4 Argon(導入価格)210
Gemini 4 Argon(通常価格)420
Claude Opus 5.5420
GPT-6 Astra1050

導入期間中、Argonの入力・出力はともにGPT-6 Astraの5分の1です。Claude Opus 5.5と比べても半額になります。ただし導入価格はあくまで期間限定の施策で、終了時期は明言されていません。通常価格に戻ると、Claude Opus 5.5と同じ水準に並びます。

実際の作業でどれだけ変わるかを見てみます。100万トークンの入力と20万トークンの出力を処理する場合、Argonは4ドル、Claude Opus 5.5は8ドル、GPT-6 Astraは20ドルという計算になります。同じ仕事でも料金は5倍まで開きます。

実世界での成果——Wizが見つけた「見逃されていた脆弱性」

ベンチマークの数字より、現場の成果のほうが説得力を持つこともあります。Googleが示した実例の一つが、セキュリティ企業Wizによる発見です。

WizはArgonを自社の「Scan for Good」で使いました。Googleは3月にWizを320億ドルで買収しており、いわば身内の成果ではあります。それでも、世界中の病院で使われている医療ソフトの重大な脆弱性を突き止めた事実は小さくありません。以前のフロンティアモデルが見逃していた穴でした。

Google社内でも効果が出ています。Argonを使ったコード整理で300TiB以上のメモリが解放され、大規模なコード移行も進みました。ベンチマークの点数だけでは見えにくい実務の効果が、こうした事例には表れています。守る側の作業を、守る側のAIが肩代わりする。そんな構図が見えてきました。

一般ユーザーはいつ使えるのか——段階的な公開と無料枠の変化

気になるのは、私たち一般ユーザーがArgonを触れる日です。Googleが示した順番は明確です。

  • 現在:Fairwind参加組織とGoogle社内チーム
  • 次の段階:有料のGemini API顧客とGoogle AI Ultra加入者
  • その先:広く企業と一般ユーザーへ

ただし、第2段階以降の日付は発表されていません。「できるだけ早く」という表現にとどまっています。過去のモデル公開では、防御側に数週間の猶予が与えられてから一般公開に進む例が一般的でした。今回も同じ流れをたどるとみられます。

もう一つ、見落とせない変更があります。Geminiアプリの無料ユーザーは10月9日からFlash-Liteのみが使えるようになります。FlashとProは有料プラン限定に切り替わり、「Google AI Plus」でFlashまで、ProとUltraで3モデルすべてという段階になります。

無料枠の縮小と、上位モデルの囲い込みが同時に進んでいるわけです。高性能なモデルほど無料では触れにくくなる流れは、当面続きそうです。私の周りでも、無料プランで使える範囲が少しずつ狭くなったと感じる人が増えています。

課題と展望——「首位」の裏にある検証待ちの数字

ここまで良い面を並べてきましたが、冷静に見るべき点も残ります。派手な数字の裏側にある条件を、一度は確認しておきたいところです。

第1に、公表されたベンチマークの多くはGoogle自身による測定値です。独立した第三者による再現と検証は、まだこれからです。都合のよい指標だけを選んでいる可能性は、常に残ります。

第2に、強みと弱みがはっきりしています。コーディングの一部指標では競合に譲ります。Terminal Bench 4では57%で、Claude Sonnet 5.5の64%やClaude Opus 5.5の60%に届きません。知識の正確さでも、GPT-6 Astraの63%に対してArgonは50%と13点低い結果でした。幻覚は少ないものの、知っている範囲が狭いという見方もできます。

第3に、料金です。導入価格の魅力は大きいものの、通常価格に戻れば価格面の優位は小さくなります。どの指標を、どの仕事で、いくらで使うのか。総合点だけで選ぶと判断を誤ります。用途ごとにモデルを選び分ける時代に入ったと考えたほうが、実態に近いでしょう。

【FAQ】Gemini 4 Argonに関するよくある質問

最後に、よく寄せられる疑問をまとめました。公開状況は動きが速いため、仕様は予告なく変わることがあります。最新の公式情報もあわせて確認してください。

質問回答
Gemini 4 Argonは誰でも使えますか?現時点では一般公開されていません。Fairwindプログラムの防衛者とGoogle社内が先行利用しています。
料金はいくらですか?導入価格は入力100万トークンあたり2ドル、出力10ドルです。期間終了後は4ドルと20ドルになります。
出力100万トークンとは何がすごいのですか?従来の約64,000トークンから15倍以上に増えました。長い推論を一度に走らせられ、作業を分断せずに済みます。
ベンチマークで本当に1位なのですか?Googleの公表値では18項目中12〜13項目で首位または同点です。ただし独立検証はこれからです。
無料のGeminiアプリはどう変わりますか?10月9日から無料ユーザーはFlash-Liteのみになります。FlashとProは有料プラン限定です。
なぜサイバー防衛者に最初に渡すのですか?攻撃を防ぐ側に早く届けるためです。ガードレールを外した状態で渡し、守る能力を最大限に使えるようにしています。

まとめ——「最強モデル」は、いつ私たちの手に届くのか

Gemini 4 Argonは、Googleが7か月ぶりに放った本命のフロンティアモデルです。出力100万トークンという分かりやすい進化と、GPT-6 Astraの5分の1という攻めた価格を携えています。一方で、その姿を最初に見るのは一般ユーザーではありません。防衛の現場が先です。

高性能なAIの公開は、性能の話であると同時に、順番と責任の話でもあります。誰に、どの順で、どんな制限のもとで渡すのか。モデルの優劣と同じくらい、この設計がこれからのAI競争を左右します。

まずはGoogle公式ブログとGeminiアプリの案内を確認してください。無料枠の変更は10月9日に迫っています。使えるうちに、自分の用途に合うモデルを見極めましょう。次の段階の公開が始まったら、その変化を実際に試してみてください。AIの最前線は、今日も静かに動き続けています。

コメント

タイトルとURLをコピーしました