
Googleが推論・コーディング性能を強化したGemini 3.8を発表
「3.7 Flashから3週間、6週間で3度目のFlash版」——Googleが新AI モデルを投入。
Googleは2026年9月2日、推論能力とコーディング性能を強化した新型AI モデル「Gemini 3.8 Flash」と、サイバーセキュリティに特化した「Gemini 3.8 Flash Cyber」を発表した。Gemini 3.8 Flashは入力トークンあたり $0.75/百万、出力トークンあたり $3.75/百万の入門価格で提供され、Google AI ProおよびUltra加入者とGemini Enterpriseで利用可能。Gemini 3.8 Flash Cyberは信頼できるセキュリティ防御者向けの新しいFairwind Programを通じて提供される。

「3.7 Flashから3週間前、そして過去6週間で3度目のFlash版リリースという勢いの中で、本日、Gemini 3.8(当社最高の推論・コーディングモデルであり、3.7と同じ高速・低コストを実現)を発表します」とGoogleは述べた。
推論・コーディング性能の向上
Gemini 3.8 Flashは、長期的なソフトウェアエンジニアリングタスク向けベンチマークであるDeepSWE v1.1で、ほとんどのより大規模なフロンティアモデルを上回る性能を示す。HLE-Verifiedベンチマークでは54.9%を達成した。

Gemini 3.8モデルはPrompt Injection堅牢性(Gray Swanで測定)においても向上を遂げている。これらの性能向上は、複雑なタスクでより高い勤勉さを発揮する「3.8 Flashがより努力する」という中核的な設計選択に由来するとみられる。複雑なタスクでは、追加の推論ステップを実行し、ツールを反復的に呼び出す可能性がある。より高い努力レベルでは、パフォーマンスを最大化するために、モデルがより多くのトークンを使用することがある可能性がある。
サイバーセキュリティ特化版の性能
Gemini 3.8 Flash Cyberは、20のプログラミング言語にわたる内部脆弱性検出ベンチマークで、70%を超える成功率を達成した。CWE-Benchパッチング評価では、Gemini 3.8 Flash Cyberのpass@1は47.2%であり、フロンティアモデルの47.8%と並ぶ水準にある。

Chrome Security teamは、3.8 Flash Cyberがブラウザの脆弱性に対して、商用モデルの中で最高のものと比べて2.6倍多くの正しいパッチを生成することを確認した。Wizの評価では、Gemini 3.8 Flash Cyberは他のフロンティアモデルと比較して、内部侵入テストベンチマークで7.5~9.7%高いリコールを達成し、コストは2.3~5.2倍低い。
Googleの Cloud Vulnerability Research teamは、Gemini 3.8 Flash Cyberを使用して、2時間以内に重大な基盤的脆弱性を発見した。
この記事は元記事の事実のみに基づいて自動生成されました。
出典
Google「Introducing Gemini 3.8 Flash and 3.8 Flash Cyber」 https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/