2026年10月5日(月) 海外のAIニュースを、日本語で最速に。 最終更新

海外のAI一次情報を、毎日日本語で。

AIモデル一次情報

Googleが「Gemini 4 Argon」を公開、まず信頼できるサイバー防御者だけに提供

画像はAIで生成したイメージです

3行でわかる

  1. Gemini 4 ArgonはGoogleの約7か月ぶりのフロンティアモデルで、出力上限が64,000から100万トークンに拡大
  2. 導入価格は100万トークンあたり入力2ドル・出力10ドルで、期間終了後は入力4ドル・出力20ドル
  3. サイバー能力が高いため、提供はFairwind Programの審査を通った防御組織から順に広げる

Google DeepMindは現地時間9月30日、新しいフロンティアモデル「Gemini 4 Argon」を発表しました。出力の上限を従来の64,000トークンから100万トークンへ広げた一方、サイバー攻撃に転用できる能力の高さから、提供はまず審査を通った防御組織に限られます。

何が発表されたか

Gemini 4 Argonは、実際のソフトウェア開発、法務や財務などの企業内ナレッジワーク、サイバー防御の3分野で最高水準の性能を出すとされる最上位モデルです。Googleがフロンティアモデルを出すのは、Gemini 3.1 Pro以来7か月ぶりになります。

Google DeepMind公式ブログ「Gemini 4 Argon: our next era of frontier intelligence」公式発表

Today, we’re announcing our new frontier model, Gemini 4 Argon, which is rolling out to a set of trusted cyber defenders through our Fairwind Program.

本日、新しいフロンティアモデルGemini 4 Argonを発表します。Fairwind Programを通じて、信頼できるサイバー防御者の一団に提供を始めます。

原文を読む(deepmind.google)

Fairwind Programは、政府機関や医療・通信などの重要インフラ事業者に先行してモデルを渡す枠組みで、現在650を超えるパートナーがいます。参加組織には脅威シミュレーションやマルウェア解析といった用途が許され、身元調査やフィッシング耐性のある多要素認証が条件です。Googleは信頼できる防御者と自社チームに対しては、サイバー関連の制限を外した状態でArgonを渡すとしています。

公式が示した主な評価結果は次のとおりです。いずれもGoogleの自己申告で、競合の数値は各社の公表値を引いたものです。

ベンチマーク Gemini 4 Argon GPT-6 Astra Claude Opus 5.5
Vals Index(経済的な実務の総合) 68.9% 63.1% 67.0%
DeepSWE v1.1(実務的な開発課題) 77.9% 74.1% 74.2%
AutomationBench(業務フロー) 51.3% 41.4% 42.5%
CWE-bench v1(脆弱性の修正) 68.0% 68.0% 67.0%
Terminal-bench 4.0 57.4% 58.2% 66.4%

Googleは社内での使用例も公開しました。Argonのエージェント群がデータセンターの計測データを分析して300TiB超のメモリを解放したこと、C/C++のコードをRustへ移す作業でFuchsiaのZirconカーネル80万行超に取り組んでいることなどです。動画デコーダーlibgav1では、既存のRust移植版の32,000行のSIMDコードを置き換え、2.7倍速くなったとしています。

料金は100万トークンあたり入力2ドル・出力10ドルの導入価格で、キャッシュした入力は入力単価の95%引きです。脚注では、導入期間が終わると入力4ドル・出力20ドルになると明記されています。The Informationは、この価格を競合より大幅に低いと報じています。

使えるのはいつからか

一般提供の時期は示されていません。Googleは米政府の自主的な事前提供プロセスに参加しながら段階的に広げるとし、開発者・企業・一般利用者への提供は、有料API顧客とGoogle AI Ultraの購読者から始めるとしています。前日のOpenAI DevDayではGPT-6.1 Solが即日提供されており、出し方は対照的です。

反応と論点

ピチャイCEOは、次のモデルについて憶測が出ていたため早めに見せたとXに投稿しました。

第三者評価では、Artificial AnalysisがIntelligence IndexでArgonを53点とし、GPT-6 Astra(最大設定)と同点、Claude Opus 5.5の58点には届かないと評価しました。1タスクあたりの費用は導入価格で1.99ドルと、Astraの3.26ドルの約6割です。

ただしArtificial Analysisによると、Argonは1タスクあたり平均62,000出力トークンを使い、Astraの27,000トークンの2倍以上です。単価の安さがそのまま総額の安さにはならない点は注意が必要です。人手による比較評価のArena.aiでは、Text Arenaで1,525点を取り1位になりました。

Hacker Newsの投稿は1,200ポイントを超えました。利用者の書き込みでは、社内のC/C++をRustへ大規模に移している事例を評価する声が多く出ています。一方で、誰も試せない段階で発表し、一般公開の日付も示さないことへの不満も目立ちました。Google AI Ultraを契約していても当面使えない点を問題にする書き込みもあります。

日本のビジネスへの影響

日本の開発者や一般利用者は現時点で使えません。Fairwind Programは政府機関・重要インフラ・主要な技術基盤の運営者が優先で、応募には審査があります。日本語性能についての個別の発表はありません。

関係が深いのは、社内にセキュリティチームを持つ企業の情報システム部門と、法務・財務の文書業務を自動化したい部署です。前者はCWE-bench v1で首位タイという結果が、後者はVals Indexの首位という結果が判断材料になります。

いま急いでやることはありません。導入価格は期間限定で、終了後は2倍になります。現行のGemini 3.8 Flashや他社モデルで動かしている処理の費用と品質を記録しておき、一般提供が始まった時点で同じ条件で比べられるようにしておくのが実務的です。AI API(LLM)の料金比較も合わせて確認してください。

注意点は2つあります。出力トークンを多く使う傾向があるため、単価だけで費用を見積もると外れること。そして、サイバー防御の制限を外した版は一般には出ないため、脆弱性診断の自動化を期待して待つのは現実的ではないことです。

一次情報

参考にした報道(5件)

AIデジマは、公式発表・X投稿・論文などの一次情報を起点に、複数の情報源を照合して日本語でまとめています。情報の収集・翻訳・下書き・照合にはAIを使い、編集方針と最終責任は編集長が負います(AIの活用について)。誤りを見つけた場合は訂正のご連絡をお願いします。

この記事の編集責任者

田中智大

AIデジマ編集長/株式会社ドイル 代表取締役

株式会社ドイル代表。元Googleで広告営業・コンサルティングに従事し500社以上を担当。広告運用とAIエージェント開発を手がける。