
Gemini 4 Argon:Googleが次世代フロンティアモデルを発表

Googleは2026年9月30日、フロンティアAIモデル「Gemini 4 Argon」を発表した。同モデルはFairwindプログラムを通じて信頼できるサイバーディフェンダーへのロールアウトが開始され、ソフトウェアエンジニアリング、企業知識労働(法務・金融)、サイバーセキュリティディフェンスにおけるフロンティアパフォーマンスを実現する。業界最高水準の1M トークンの出力制限を備え、複数ベンチマークで最先端レベルを達成しており、入力トークンあたり$2、出力トークンあたり$10の導入価格で提供される予定である。
Googleが新しいフロンティアモデル「Gemini 4 Argon」を発表した。このモデルは、ソフトウェアエンジニアリング、法務・金融などの企業知識労働、サイバーセキュリティディフェンスといった複雑なワークフロー全体にわたって、フロンティアパフォーマンスを提供する。Googleの数千人の従業員がすでにArgonを利用した内部ワークフローで同モデルを活用している。
ベンチマークにおける性能

Argonは複数の主要ベンチマークで最先端の成績を収めている。ソフトウェアエンジニアリング評価のDeepSWE v1.1で77.9%の最先端スコアを達成し、Zapierのベンチマークである AutomationBench では51.3%のスコアで第1位にランクされた。さらに、長い動画理解を測定するLVBenchで91.7%の最先端スコアを、CWE-bench v1で68%のスコアで同点1位を達成している。Argonは金融、コーディング、法務、税務労働における経済的影響を測定するVals Indexで業界をリードしている。


ソフトウェアエンジニアリングと最適化への応用
Argonのエージェント機能は、Google内でも実際の業務改善に活用されている。量子アルゴリズム最適化のベースラインに対して40%のパフォーマンス改善を達成した。また、Argonエージェントはフリート全体のプロファイリングテレメトリを分析し、Googleのデータセンター全体にわたってメモリ最適化を特定・適用し、300 TiBを超えるメモリを解放、総メモリ削減量は500 TiBから1 PiBに達する見込みである。
Argonエージェントは、C/C++コードベースをRustに移行する作業をGoogle全体で進めている。re2やlibgav1といったコアライブラリの数万行からFuchsia Zirconカーネルの800K+行への移行に対応している。libgav1では、Argonエージェントが32K行のSIMDコードを置き換え、メモリセーフなビデオデコーダを実現した。このデコーダは、Rustポートより2.7x高速に動作しながら、動画出力は同一である。
サイバーセキュリティと安全性対策

Wizはその「Scan for Good」イニシアチブを通じてArgonをサイバーセキュリティディフェンスに活用している。Argonは有害なリクエストを拒否しながら、正当なデュアルユースの科学研究を保持する設計となっている。Gray SwanのIndirect Prompt Injection(IPI)ベンチマークにおいて、プロンプトインジェクションロバストネスで業界をリードしている。
出力トークン制限と価格設定
Argonの出力トークン制限は、従来の64K トークンから業界最高水準の1M トークンへ拡張された。導入価格は、入力トークンあたり$2、出力トークンあたり$10となり、キャッシュされた入力トークンは入力トークン価格から95%割引で提供される予定である。Argonは開発者、企業、消費者に対して可能な限り早期に利用可能になる予定とされている。Googleは米国政府の事前リリースモデルアクセスに関する自発的なプロセスに積極的に参加している。
筆者の見立て
- 「Gemini 4 Argonは根本的にGoogleでの仕事と構築のやり方を変えている」と論じている。
- 「モデルが深く考えて単一の軌跡内で数十万トークンを生成できる余裕を持つ場合、これは困難な問題を一度に解決するための推論に新しい深さのレベルを加える」と解釈している。
- 「Argonは、開発者、専門家、企業が最も困難な問題に取り組む際のパートナーとして機能する」と予想している。
この記事は元記事の事実のみに基づいて自動生成されました。
出典
Google「Gemini 4 Argon: our next era of frontier intelligence」https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/ (DeepSWE v1.1、Vals Index、Vals Finance Agent v2、Harvey's Legal Agent Benchmark、LVBench、CWE-bench v1、Gray Swan's Indirect Prompt Injection (IPI) benchmark、Wiz、Scan for Good initiative による報道)