Googleは2026年10月1日、新たなフロンティアAIモデル「Gemini 4 Argon」を発表しました。
Gemini 4 Argonは、複雑かつ長時間にわたる処理でも推論を維持する能力を重視したGemini 4シリーズのモデルです。
ソフトウェア開発をはじめ、財務・法務などの専門業務、サイバーセキュリティ、長時間のAIエージェント処理などを主な用途としており、OpenAIの「GPT-6 Astra」やAnthropicの「Claude Fable 5.1」と競合する最上位クラスのモデルとなります。
最大100万トークンの出力に対応
Gemini 4 Argonで特に大きな特徴となるのが、最大100万トークンという出力上限です。
従来の最大6万4,000トークンから大幅に拡大され、大規模なコード生成や長期間動作するエージェントなど、非常に長い出力を必要とするタスクへ対応しやすくなりました。
競合モデルを見ると、GPT-6 Astraは長時間のエージェント処理やコーディング、コンピューター操作を重視しており、Claude Fable 5.1も長時間のエージェント型コーディングや複数ステップのリサーチを主要用途としています。
その中でも、出力そのものを最大100万トークンまで継続できる点はArgonの大きな特徴です。
コーディングや長時間タスクを強化
Gemini 4 Argonは、特に長時間にわたるソフトウェア開発で性能を強化しています。
実世界の長期間ソフトウェアエンジニアリング能力を評価する「DeepSWE v1.1」では77.9%を記録しました。
Google社内では、C/C++で構築された大規模コードベースをRustへ移行する作業にもArgonエージェントを使用しています。
動画デコーダー「libgav1」の事例では約3万2,000行のSIMDコードを安全なRustコードへ移植し、既存のRust版と比較して2.7倍高速な処理を実現したとしています。
また、Googleのデータセンターではメモリ使用量の分析と最適化にもArgonが活用され、300TiB以上のメモリを削減。最終的には500TiB〜1PiB規模の削減が見込まれています。
こうした「長時間動き続けるAI」という方向性は、AstraやFable 5.1とも共通しています。
Astraはコーディングに加えてPCやブラウザを操作するエージェント能力を重視し、Fable 5.1も長時間の開発作業や複雑なリサーチへの対応を強化しています。
Argonも同様に、単発の質問へ回答するだけでなく、長時間にわたる作業を自律的に進めるAIを強く意識したモデルといえそうです。
財務・法務、サイバーセキュリティにも対応
コーディング以外の専門業務も強化されています。
財務・法務・税務などを評価する「Vals Index」をはじめ、財務リサーチの「Vals Finance Agent v2」、法務分野の「Harvey’s Legal Agent Benchmark」などでも高い性能を記録しました。
業務自動化能力を測定する「AutomationBench」では**51.3%**を記録しています。
さらに、サイバーセキュリティ分野では脆弱性の発見から検証、修正までを実行でき、「CWE-bench v1」で68%を記録しました。
高度なサイバー能力には悪用リスクも存在することから、Googleはまず「Fairwind Program」を通じて信頼できる専門家などに提供し、安全性を確認しながら段階的に展開します。
API価格は入力2ドル、出力10ドル
Gemini 4 ArgonのAPI価格は、100万トークンあたり入力2ドル、出力10ドルです。
一方で、GPT-6 AstraのAPIとClaude Fable 5.1はいずれも、Argonより高価格な最上位モデルとして提供されています。
そのためArgonは、性能だけでなく長時間動作するAIエージェントの運用コストも意識した価格設定とみられます。
「長時間動くAI」の競争が本格化
Gemini 4 Argonは、単純なチャットAIの性能競争からさらに踏み込み、長時間にわたって推論・コーディング・業務を継続するAIエージェントを狙ったモデルです。
OpenAIのGPT-6 Astra、AnthropicのClaude Fable 5.1、そしてGoogleのGemini 4 Argonと、主要AI企業の最上位モデルはいずれも長時間タスクやエージェント能力を重視する方向へ進んでいます。
中でもArgonは、最大100万トークンの出力と比較的低いAPI価格を武器としており、今後どのような開発ツールやAIエージェントへ採用されるのか注目されます。