ホーム / ニュース / Google、次世代フラッグシップ「Gemini 4 Argon」を発表 出力上限を100万トークンに拡大、まずFairwind参加組織へ

Google、次世代フラッグシップ「Gemini 4 Argon」を発表 出力上限を100万トークンに拡大、まずFairwind参加組織へ

Googleは9月30日(米国時間)、次世代のフラッグシップモデル「Gemini 4 Argon」を発表した。長時間にわたるエージェント作業、実務のソフトウェア開発、法務・金融などの知識労働、サイバー防御を主な用途に掲げる。最初の提供先は一般の開発者ではなく、重要インフラの防御を目的とするGoogleの「Fairwind」プログラムに参加するサイバー防御担当者だ。

仕様面で最も大きな変更は出力トークンの上限で、従来の6万4,000トークンから100万トークンに引き上げられた。1回の推論の中で長い思考過程と大量のコード生成を続けられるようにするための変更で、入力側のコンテキスト長は今回の発表では明らかにされていない。

ベンチマークは、実在のコードベースで開発タスクを解く「DeepSWE v1.1」が77.9%、業務プロセスを最初から最後まで自動化させる「AutomationBench」が51.3%で首位、脆弱性修正を評価する「CWE-bench v1」が68%で首位タイ、長尺動画理解の「LVBench」が91.7%。金融・コーディング・法務・税務をまとめた「Vals Index」と、プロンプトインジェクション耐性を測る「Gray Swan IPI」でも首位としている。

Google社内での利用例も挙げられた。量子アルゴリズムの最適化でベースライン比40%の改善、データセンター全体で300TiB超のメモリを解放する最適化、最大80万行超のC/C++コードをRustへ移植する作業、Rust移植版より2.7倍速い動画デコーダーの最適化などだ。

API料金は導入価格が100万トークンあたり入力2ドル・出力10ドルで、キャッシュ済み入力は入力単価の95%引き。導入期間の終了後は入力4ドル・出力20ドルに上がるが、導入期間の長さは示されていない。

導入価格はGPT-6.1 Solと同額、通常価格はその2倍

導入価格の水準は、OpenAIが前日の9月29日に公開した「GPT-6.1 Sol」と完全に重なる。GPT-6.1 Solも入力2ドル・出力10ドルで、キャッシュ済み入力を95%引きにする割引率まで同じだ。OpenAIの最上位モデルGPT-6 Astraは入力10ドル・出力50ドルなので、Argonの導入価格はその5分の1にあたる。1ドル150円で換算すると、導入価格は入力約300円・出力約1,500円、通常価格は入力約600円・出力約3,000円になる。

モデル 入力 出力
Gemini 4 Argon(導入価格) $2 $10
Gemini 4 Argon(通常価格) $4 $20
GPT-6.1 Sol $2 $10
GPT-6 Astra $10 $50

価格は100万トークンあたり。導入期間が終わるとGPT-6.1 Solの2倍の単価になるため、継続運用のコストを比べるなら通常価格の側で見積もる必要がある。

DeepSWE v1.1の過去の数字を並べると、GPT-6 Solは最高設定で68.8%、AnthropicのClaude Fable 5.1は69.9%だった。GPT-6.1 Solは「GPT-6 Solの最高スコアを6.4ポイント上回った」とされており、計算上は75%前後になる。Googleの前世代では、8月の3.7 Flashが65.3%だった。Argonの77.9%はいずれも上回るが、Googleの発表は他社モデルとの直接比較を載せておらず、推論設定やタスクあたりのコストをそろえた比較ではない。AutomationBenchでもGPT-6 Sol(最高設定)の33.2%に対してArgonは51.3%と差が大きいが、同じ留保がつく。

最初の配布先がFairwindになった経緯

Fairwindは、Googleが9月2日に「Gemini 3.8 Flash Cyber」と同時に立ち上げたプログラムで、政府機関や重要インフラ事業者にセキュリティ特化モデルを限定配布する枠組みだ。3.8 Flash CyberはCWE-Benchのパッチ生成でpass@1 47.2%を記録していた。Argonの68%は評価セットが「CWE-bench v1」に更新された後の数字なので単純に差し引きはできないが、Googleは3.8 Flash Cyberの成果の上に積み上げたモデルと位置づけている。

Argonにはサイバー用のガードレールを外した派生版も用意され、信頼できる防御側組織とGoogle社内のチームだけが使える。一般向けには、米国政府の任意の事前審査プロセスを経る段階的な展開とし、有料のAPI利用者とGoogle AI Ultra加入者から順に開放する。具体的な日程は示されておらず、日本を含む提供地域や、ProなどUltra以外のプランでの提供時期も発表には含まれていない。

安全対策としては、有害な依頼は断りつつデュアルユースの研究は妨げない拒否設計、モデル内部の活性化を監視する悪用検知、思考過程を対象にしたミスアラインメント監視、隔離したサンドボックス環境での検証、社内外のレッドチーミングが挙げられた。脆弱性を自律的に修正できる能力を持つモデルを、まず防御側に渡してから一般に広げるという順序は、3.5 Flash Cyber、3.8 Flash Cyberと続けてきた限定配布の運用を、フラッグシップモデルにも当てはめた形になる。

タグ付け処理あり: