Google、「Gemini 4 Argon」をまずサイバー防御の担当者に提供 脆弱性を自分で見つけて直す性能を強調

セキュリティ監視センターの写真に、記事タイトル「Google Gemini 4 Argon まずサイバー防御の担当者に提供」を大きく重ねた画像

執筆者:

カテゴリ:

米Googleは9月30日(米国時間)、最新の大規模言語モデル「Gemini 4 Argon」を発表した。最初に使えるのは、同社が審査したサイバー防御の担当者と、Google社内のセキュリティチームに限られる。こうした利用者には、サイバー攻撃に関わる出力を抑える安全上の制限を外して提供する。同社によると、Argonはソフトウェアの重大な欠陥(脆弱性)を自分で見つけ、本当に危険かを確かめ、修正までこなせる。一般向けのAPIより先に「守る側」へ渡すという、異例の順番での公開となった。

「守る側」に先に渡す

提供先は、同社が9月初めに始めた限定の仕組み「Fairwind Program」の参加者だ。政府機関、Google Cloudの顧客、セキュリティ企業などが加わり、開始時点で650を超える組織が参加している。報道によると、米CrowdStrikeや米Palo Alto Networksも名を連ねる。

Fairwindはもともと、サイバー防御向けに調整した小型モデル「Gemini 3.8 Flash Cyber」と、脆弱性を見つけて確かめ、直すまでを自動で進める仕組み「CodeMender」を組み合わせて提供してきた。今回、その中心のモデルを最上位のArgonに置き換えた形になる。

同社は、信頼できる防御側と社内チームには「サイバー関連の制限なしで」Argonを提供すると説明した。強い攻撃能力を持つAIが悪意のある人の手に渡る前に、守る側がシステムの穴をふさぐ時間を確保する、という考え方だ。参加者の声を聞きながら、利用できる範囲を少しずつ広げる。

有料のAPI利用者や個人向け最上位プラン「Google AI Ultra」の加入者にも、後日提供するとしている。時期は示していない。広く公開する際には、サイバー攻撃や大量破壊兵器に関わる悪用を防ぐ安全策を組み込むという。同社は、米政府が進める、公開前のモデルを事前に確認してもらう自主的な仕組みにも参加している。

暗い部屋で、ソースコードの欠陥部分を修正するセキュリティ技術者の手元

脆弱性の修正力を測る指標で首位に並ぶ

脆弱性の修正力を測る指標「CWE-bench v1」で、Argonは68%の正答率を記録した。米OpenAIの「GPT-6 Astra」、米xAIの「Grok 4.7」と並ぶ首位だ。単独の首位ではない点には注意したい。

ほかの指標でも高い数値を示した。長いソフトウェア開発の作業を測る「DeepSWE v1.1」では77.9%で、同社は過去最高だとしている。記事などに隠した命令でAIを操ろうとする攻撃(プロンプトインジェクション)を試す評価では、攻撃が成功した割合は0.7%だった。GPT-6 Astraの8.5%を大きく下回る。一方、端末での作業を測る「Terminal-Bench 4.0」などでは、競合を下回った。これらの数値はいずれも同社の発表で、外部による検証は示されていない。

一度に出力できる量も増えた。報道によると、出力の上限は100万トークンで、これまでのGeminiの6万4000トークンから大きく広がった。導入時の料金は、入力100万トークンあたり2ドル、出力は同10ドルからとされる。

同社独自の脆弱性の評価でも、20のプログラミング言語すべてで従来のモデルを上回ったという。

実際の成果としては、クラウドのセキュリティ企業Wizの例を挙げた。WizはArgonを使い、世界中の病院が使う医療ソフトに重大な欠陥を見つけたという。個人の機微な情報が漏れるおそれのある欠陥で、これまでの最先端モデルでは見つけられなかったとしている。ソフトの名前は明かしていない。

制限なしで渡す範囲の広さが課題

この方式には懸念もある。制限を外したモデルを650を超える組織に渡すことは、それだけ信頼しなければならない相手が多いことを意味する。参加組織の中で情報が漏れたり、悪用されたりすれば、守るために渡した力が攻撃に転じかねない。

同社は、モデル内部の動きの監視や、プロンプトインジェクションへの耐性の強化など、安全策を重ねていると説明する。ただ、参加組織をどう審査し、使われ方をどう見守るのか、その詳しい仕組みはまだ十分に公表されていない。

AIの「攻めと守り」の主導権争い

AIがソフトウェアの欠陥を自分で見つけられるようになるほど、その力は攻撃にも防御にも使える。各社はここ数カ月、サイバー分野でのモデルの扱いを相次いで見直してきた。米Anthropicも10月、セキュリティ研究者向けの認証制度を3段階に広げると発表した。

能力の高いモデルを誰に、どの順番で、どこまで渡すのか。Argonの公開は、その判断が性能そのものと同じくらい重要になってきたことを示している。防御側が先に力を持てるかどうかが、今後の攻防を左右しそうだ。

参考

コメント

コメントを残す

メールアドレスが公開されることはありません。 ※ が付いている欄は必須項目です