グーグル「Gemini 4 Argon」発表…出力上限は100万トークン、脆弱性も自力修正(ビジネス+IT)
43 分前

米グーグルは9月30日(現地時間)、新たなフロンティアAIモデル「Gemini 4 Argon」を発表した。複雑で長時間に及ぶ推論、ソフトウェア開発、金融・法務などの知識業務、サイバー防御で高い性能をうたう。
「Gemini 4 Argon」は複雑で長時間に及ぶ推論を前提に設計し、ソフトウェア開発や金融・法務などの知識業務、サイバーセキュリティ防御で高い性能を発揮するという。まず「Fairwind Program」を通じ、信頼するサイバー防御組織への提供を始める。同社は米政府の任意の事前アクセス手続きにも参加し、安全対策を検証しながら提供範囲を広げる。
同社によると、Argonは1回の出力上限を従来の6万4,000トークンから100万トークンへ大幅に拡張した。実際の長期ソフトウェア開発能力を測る「DeepSWE v1.1」では77.9%、業務自動化を評価する「AutomationBench」では51.3%を記録。長時間動画の理解を測る「LVBench」でも91.7%だったとしている。
導入時のAPI価格は100万トークン当たり入力2ドル(約315円)、出力10ドル(約1,574円)で、導入期間終了後はそれぞれ4ドル(約630円)、20ドル(約3,148円)となる。
グーグル社内では、すでに数千人規模の従業員がArgonを業務に利用しているという。データセンターでは、複数のArgonエージェントがメモリ利用を分析し、300TiB超のメモリを解放。さらにC/C++の大規模コードをRustへ移行する作業にも投入し、FuchsiaのZirconカーネルでは80万行超を対象としている。
サイバー防御では、重大なソフトウェア脆弱性を自律的に発見、検証し、修正できると説明する。脆弱性修正能力を測る「CWE-bench v1」では68%で首位タイだった。外部の信頼済み防御組織にはサイバー関連のガードレールを外した形で提供する一方、一般提供に向けては悪用防止、間接的なプロンプトインジェクション対策、モデルの思考や行動を監視する仕組みなどを強化する。今後、まず有料API顧客とGoogle AI Ultra加入者から利用対象を広げる方針だ。
一方、米ブルームバーグは、一部従業員がベンチマーク上の成績ほど実務での性能を評価していないと報じた。グーグルは、コーディングなどでArgonの性能が劣るとする見方は不正確だと反論したという。高いベンチマーク性能を、実際の業務でどこまで再現できるかも焦点となる。
本文の著作権はYahoo!ニュースにあります。