何が出荷されたか: Google DeepMindの新しいフロンティアモデルGemini 4 Argonが、2026年9月30日に発表された。Googleによれば、実務レベルのソフトウェアエンジニアリング、法務や財務などのエンタープライズ向け知識労働、そして特にサイバーセキュリティ防御——脆弱性を自律的に発見・検証・パッチ適用することまで含む——において、フロンティアクラスの性能を発揮するという。
実際に誰が使えるか: 今のところ、ほぼ誰も使えない。Argonはまず、GoogleのFairwind Programを通じて認定されたサイバー防衛担当者の一部に展開される。Googleは開発者・企業・一般消費者にも「できるだけ早く」届けると述べ、有料APIの顧客とGoogle AI Ultra加入者から始めるとしているが、確定した日付はない。Gemini Notebookと無料版のGeminiアプリは、発表のどこにも言及がない。
料金(対象となる範囲): 発売時点で入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、後に4ドル/20ドルへ上がる予定。キャッシュされた入力は95%割引になる。出力トークンの上限は、Googleの従来のGemini 3世代モデルの64,000から100万まで跳ね上がった。
発売日の報道の多くが見落としていた差: Google自身の比較表では、公開を選んだベンチマークの大半でArgonがClaude Opus 5.5とGPT-6 Astraを上回っている。Artificial Analysisが自社の標準化された手法で行った独立テストでは、Argonは総合でGPT-6 Astraと同水準、Opus 5.5には一歩及ばない結果になった。ただしベンチマークごとの差はわずかで、劇的なものではない。完了タスクあたりのコストでは、Argonが3モデル中もっとも安い。

Argonの実体
ArgonはGoogleがGemini 4という名称で出した最初のモデルだ。Gemini 4 ProやGemini 4 Flashはまだ存在しないため、今のところArgon=Gemini 4であり、Gemini 3が複数のティアを同時に展開したようなフルラインアップのローンチではなく単発のリリースだ。Googleの発表そのものは、3つの用途に重点を置いている。実務レベルのソフトウェアエンジニアリング、法務・財務分析のようなエンタープライズ向け知識労働、そしてサイバーセキュリティ防御だ。サイバーセキュリティについては、人間が一歩ずつ指示しなくてもArgonが自律的に脆弱性を見つけ、それが本物であることを確認し、実際に機能するパッチを書けるとGoogleは述べている。
エージェント型タスクや長時間実行されるタスクにとって、おそらく最も重要な技術的変化は出力トークンの上限だ。Googleはこれを従来のGemini 3世代モデルの64,000から100万トークンへ引き上げた。1回の応答に詰め込める量が15倍になったということで、これはパッチ生成や長文ドキュメントの作成のように、途中で新しい呼び出しに切り替えずに継続して推論し続ける必要があるタスクに特に関わってくる。
Fairwindでの展開と、消費者がまだ含まれていない理由
Argonのサイバー関連機能は、まずGoogleのFairwind Programを通じて展開される。これは、政府のサイバー防衛当局やその他の信頼できる組織など、審査を受けた一部のグループに他のどこよりも先にアクセスを与えるプログラムで、米国政府がフロンティアAI向けに設けた自発的な事前公開アクセスの仕組みの一部だ。Fairwindの参加者は、ガードレールを外したバージョンのArgonも利用できる。これは、Googleが「ミスアラインメント緩和策」と呼ぶ、モデルの思考過程(chain-of-thought)を監視して自らの制限を回避しようとする兆候を検知する仕組みと組み合わされている。アクセスは、社内のサイバーセキュリティ・インシデント対応・ペネトレーションテストの担当者に限定され、参加組織には多要素認証の導入が義務付けられている。Googleはこの全体の枠組みを自社のFrontier Safety Frameworkのもとに位置づけている。すなわち、悪用可能なバグを見つけられるデュアルユースのモデルは、そのバグを書くこともできるモデルでもあるため、アクセスを広げるほどリスクも広がるという考え方だ。
それ以外の人にとって、公表されている唯一のタイムラインはGoogle自身の言葉だけだ——Argonは「開発者、企業、一般消費者」に届くとされ、「有料APIの顧客とGoogle AI Ultra加入者から始める」とされているが、日付は示されていない。無料版のGeminiアプリへの言及はなく、Google AI PlusやProの加入者への言及もなく、発表・料金ページ・それに続く報道のどこにもGemini Notebookは出てこない。有料APIの顧客でもAI Ultra加入者でもない場合、現時点でArgonを試す手段はまったく示されていない。
料金: 今は導入価格、後で倍に
APIを通じてArgonが利用できる場合、料金は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、これは導入価格であり、Googleは後に4ドル/20ドルへ上げるとしている。キャッシュされた入力は95%割引になる。これは、同じ大規模なコードベースやドキュメント群を繰り返し再処理するワークフロー——まさにArgonが想定しているタスクの種類——にとって大きな意味を持つ。導入価格がいつ終わるかについては、Googleは日付を公表していない。
Googleは「勝っている」と言うが、独立テストは「ほぼ五分五分」に近いと言う
Googleのローンチ記事は、幅広いベンチマーク表でArgonを後押ししている。長期的なソフトウェアエンジニアリングを測るDeepSWE v1.1で77.9%、長尺動画理解のLVBenchで91.7%、脆弱性検出のCWE-Bench v1で68%、そしてZapierによるエンドツーエンドの業務タスク実行ベンチマークAutomationBenchで1位の51.3%だ。Google自身の集計によれば、Claude Opus 5.5とGPT-6 Astraとの比較表にある18〜19件のベンチマークのうち、Argonはおよそ12〜13件で先行している。
企業が自ら選んだ比較表に頼らず、独自の標準化されたベンチマークスイートを運用しているArtificial Analysisは、それほど明るくない結果を示している。各社を横並びで比較するための総合指標であるIntelligence Indexでは、Argonが53、GPT-6 Astraも53(Argonと同点)、Claude Opus 5.5が58で両者を上回った。実際にターミナルを通じてコンピュータを操作する能力を測るTerminal-Bench 4.0では、Artificial AnalysisはArgonを57%、Astraを59%、Opus 5.5を60%と計測しており、大差ではなく僅差にとどまっている。このパターンは両方の指標で一貫している。Google自身の表ではほとんどの一対一比較で勝っているように見えるモデルが、中立な第三者がテストを行うと一方のライバルと同点、もう一方には一歩及ばない結果になる——もっとも、個々のベンチマークの差自体はどれも劇的なものではない。
Metric Argon GPT-6 Astra Opus 5.5
----------------------------------------------------------------------
Google-published wins 12-13 of 18-19 benchmarks (self-reported)
AA Intelligence Index 53 53 58
Terminal-Bench 4.0 57% 59% 60%
AA cost per completed task $1.99 $3.26 $5.98
Sources: Google's launch benchmark table (self-reported, tally
not independently reproduced); Artificial Analysis independent
testing (neutral methodology). Argon wins on Google's own table
and on cost. On AA's neutral Intelligence Index and Terminal-Bench
4.0, it's tied with Astra and a step behind Opus 5.5, though the
per-benchmark gaps are narrow, not dramatic.独立データの中でArgonの最も明確な強みは、純粋な知能ではなくコストだ。Artificial Analysisはその評価スイートで、Argonが完了タスクあたり1.99ドル、GPT-6 Astraが3.26ドル、Claude Opus 5.5が5.98ドルだったと計測している。これは本物の勝利だが、注意点もある。Artificial Analysisは、Argonがかなり冗長であることも発見した。タスクあたりの出力トークン数は平均およそ62,000で、GPT-6 Astraの約27,000の2倍以上になる。Argonが安いのは主にトークン単価が低いからであって、ライバルより少ないトークンで推論できる効率的なモデルだからではない。
無視するのではなく指摘しておくべき、未解決の対立も存在する。The Hacker Newsの報道はFairwindのアクセス制限について伝えており、別途Bloombergの報道は、この取り組みに直接関わった関係者の話として、Google自身のエンジニアが、Argonの実際のコーディングタスクでの性能がベンチマークが示すよりも劣っていると感じていると伝えている。特にフロントエンドのデザイン(アプリやウェブサイトの見た目や使い心地)が弱いという指摘だ。Googleはこの見方に異議を唱え、「Gemini 4がコーディングなどの分野で性能が劣っているというのは不正確だ」と述べている。どちらの主張も独立した形で裏付けられてはおらず、ベンチマークの成績と実際の使用感とのこうしたギャップは、どちらか一方の言葉をそのまま信じるのではなく、今後数週間のユーザーの報告を見て判断する価値がある。
Gemini Notebookユーザーにとっての現状
今Gemini Notebookを使っているなら、このリリースによってノートブックに変わることは何もない。Argonは、Geminiアプリ、Gemini Notebook、スプレッドシート、その他どの消費者向け機能にも届くとはGoogleの発表に書かれていない。これは、3週間前にGemini 3.8 Flashが出荷されたときに見つけたのと同じ空白だ。Argonの展開順序(まずFairwind、次に有料APIとAI Ultra、それ以外は未定)を見る限り、Gemini NotebookがそもそもGemini 4世代の出力を手に入れるとしても、それは近い将来ではなく、もっと後の段階になりそうだ。
Argonの登場を待つのではなく、今すぐ使える最高のモデル出力を求めているなら、上で見た独立データは、純粋なタスク品質においてClaude Opus 5.5を指し示している。しかもOpus 5.5は、今のArgonとは違ってすでに広く利用できる。
よくある質問
Gemini 4 Argonとは何ですか?
Google DeepMindがGemini 4という名称で出した最初のモデルで、2026年9月30日に発表された。実務レベルのソフトウェアエンジニアリング、法務・財務分析のようなエンタープライズ向け知識労働、そして脆弱性の自律的な発見とパッチ適用を含むサイバーセキュリティ防御といった、持続的な推論を要するタスクのために作られている。
Gemini 4 Argonは今すぐ使えますか?
GoogleのFairwind Program(認定されたサイバー防衛担当者)の一員であるか、有料APIの顧客であるか、Google AI Ultraの加入者である場合に限られ、それでもGoogleは確定した提供日を示していない。無料ティアやGemini Notebookからのアクセスはなく、いつ提供されるかという見通しも示されていない。
Gemini 4 Argonの料金はいくらですか?
導入価格として入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、後に4ドル/20ドルへ上がる。キャッシュされた入力は95%割引になる。導入価格がいつ終わるかはGoogleから発表されていない。
Gemini 4 ArgonはClaude Opus 5.5やGPT-6 Astraより優れていますか?
どちらの数字を信じるかによる。Google自身のベンチマーク表では、Argonが大半の比較で先行している。Artificial Analysisの独立テストでは、総合指標のIntelligence IndexでArgonはGPT-6 Astraとほぼ同点、Claude Opus 5.5には及ばないという結果だが、完了タスクあたりのコストでは3モデル中Argonが最も安い。
Gemini 4 ArgonはGemini Notebookを動かしていますか?
いいえ、近いうちにそうなる兆しもない。Googleの発表はGemini Notebookや無料版Geminiアプリについて一切言及していない。公表されている展開順序は、まずFairwind Program、次に有料APIの顧客とGoogle AI Ultra加入者であり、それ以外は未定のままだ。