AI・機械学習
Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表
Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber (blog.google)
要約
Googleは、AIエージェントの構築に不可欠な効率性、低遅延、信頼性を向上させた新しいGemini Flashモデルシリーズを発表しました。Gemini 3.6 Flashは、コーディングや知識作業の性能向上とトークン効率の改善を実現し、Gemini 3.5 Flash-Liteは、高速かつ低コストで高スループットなタスクに適しています。また、サイバーセキュリティに特化したGemini 3.5 Flash Cyberも登場し、CodeMenderエージェントと連携して脆弱性検出・修正を行います。
全文翻訳
Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表
2026年7月21日 | x.com Facebook LinkedIn Mail リンクをコピー
最新のGeminiモデルは、AIエージェントを大規模に構築するための効率性、遅延、信頼性を提供します。
Tulsee Doshi プロダクトマネジメント担当シニアディレクター(Geminiチームを代表して)
共有 x.com Facebook LinkedIn Mail リンクをコピー
お使いのブラウザはオーディオ要素をサポートしていません。記事を聞く [[duration]] 分
このコンテンツはGoogle AIによって生成されました。生成AIは実験的なものです。
音声 スピード 音声 スピード 0.75X 1X 1.5X 2X
開発者や顧客は、本番環境のAIエージェントを構築するために、より高いトークン効率、低遅延、そしてより信頼性の高いパフォーマンスを求めています。当社のFlashシリーズモデルは、エージェントワークフローのスケーリングを可能にするために、効率性と品質のスイートスポットを満たすように構築されています。
Gemini 3.5 Flashを基盤として、新しいGeminiモデルを導入します。
3.6 Flash:コーディング、知識作業、マルチモーダルパフォーマンスを向上させる、当社の主力モデルです。Artificial Analysis Indexによると、3.5 Flashと比較して出力トークン使用量を17%削減し、DatacurveのDeepSWEのような一部のベンチマークでは最大65%の削減を確認しており、いずれも出力トークンあたりのコストは低くなっています。
3.5 Flash-Lite:3.5クラスで最も高速かつコスト効率の高いモデルで、Artificial Analysis Indexによると毎秒350の出力トークンを提供し、エージェントワークフローにおいても以前のFlash-Lite世代を大幅に上回っています。
CodeMenderにおける3.5 Flash Cyber:サイバーセキュリティアプリケーションを成功させるには、モデルとエージェントインフラストラクチャの慎重なオーケストレーションが必要です。当社は、最先端の競争力のあるパフォーマンスを提供する、新しい高効率で専門的なサイバー特化型モデルとCodeMenderコードセキュリティエージェントの組み合わせを導入します。
今日のリリースに加えて、Gemini 3.5 Proは現在パートナーとテスト中で、準備ができ次第、広く利用可能にする予定です。並行して、当社のチームは次世代モデルの構築にすでに注力しています。私たちは、Gemini 4に向けてこれまでで最も野心的な事前トレーニングを実行しており、その進捗に興奮しています。
3.6 Flash:3.5 Flashよりも効率的で高品質
Gemini 3.6 Flashは、3.5 Flashに関する開発者や顧客からのフィードバックを直接活かしています。3.6 Flashは、コーディングや知識作業のステップアップを提供するだけでなく、トークン効率を大幅に向上させながらこれを実現しています。例えば、Artificial Analysis Indexでは、3.6 Flashは3.5 Flashよりも17%少ない出力トークンを消費することが確認されています。また、複数ステップのワークフローを達成するために必要な推論ステップやツールコールも少なくなっています。
この強化された効率性は、3.5 Flashよりも低い価格設定とも組み合わされています。入力トークン100万あたり1.50ドル、出力トークン100万あたり7.50ドルで、3.6 Flashはエージェントタスクあたりの全体的なコストを削減し、エージェントの構築と実行をよりコスト効率の良いものにします。
OSWorldで検証されたタスク(API)において、3.6 Flashは3.5 Flashよりもトークン効率が高く、冗長性が低くなっています。
より効率的でありながら、3.6 Flashはユースケース全体で3.5 Flashと比較してパフォーマンスが向上しています。
3.6 Flashは、DeepSWE(49%対37%)で見られるように、不要なコード編集や実行ループを減らし、より高い精度を提供します。また、MLE Bench(63.9%対49.7%)で見られるように、MLリサーチで大幅な改善を示しています。
OSWorld-Verified(83.0%対78.4%)で見られるように、コンピューター使用機能が向上しています。コンピューター使用は、Gemini APIおよびGemini Enterpriseを通じて、クライアントサイドの組み込みツールとして利用できるようになりました。
GDPval-AA v2(1421対1349)のようなベンチマークで示されるように、知識作業において3.5 Flashを上回っています。HebbiaやHarveyのような顧客は、ドキュメント解析、チャートおよびデータ分析、レポート作成などのマルチモーダルタスクにおいて、特にその能力を高く評価しています。
AIS上のマネージドエージェントを使用した3.6 Flashは、3.5 Flash(AIS)よりも効率的かつ正確に財務データやトランスクリプトを解析・分析できます。
AGY上のマルチエージェントオーケストレーションを使用した3.6 Flashは、3.5 Flash(AGY)よりも低遅延かつ高品質でコード移行を実行します。
3.6 Flashは、強力な視覚理解スキル(Gemini App)を使用して、3Dワークフロー用の写真テクスチャ抽出器の開発を支援します。
3.6 Flashは、AGYとtldrawオフラインエディタを使用して、インタラクティブなテーマスタジオを構築します(AGY)。
顧客は、3.6 Flashが複雑なワークフローや知識ベースのタスク全体でトークン効率、精度、速度のバランスを取り、コストと品質の両面で前進であると報告しています。
安全性に配慮して構築
3.6 Flashは、化学、生物、放射性、核(CBRN)およびサイバー攻撃の悪用ドメインにおいて、強化されたフロンティアセーフガードとともに提供されます。これらのセーフガードにより、モデルはジェイルブレイクに対する耐性が大幅に向上します。同時に、有益な用途での拒否を最小限に抑えるようにモデルはトレーニングされています。
詳細については、3.6 Flashモデルカードを参照してください。
3.5 Flash-Lite:エージェントワークフローのスケーリングのために構築
Flashに加えて、低遅延タスクと、エージェント検索やドキュメント処理のような開発者ワークフローで高スループットが重要なタスクの両方のために設計されたGemini 3.5 Flash-Liteもリリースします。
3.5 Flash-Liteは、3.5シリーズで最も高速なモデルです。Artificial Analysisの測定によると、毎秒350の出力トークンで実行されます。入力トークン100万あたり0.3ドル、出力トークン100万あたり2.5ドルで価格設定されており、3.1 Flash-Liteよりも大幅に品質が向上しているため、3.5 Flash-Liteは高スループットの本番トラフィックを実行する開発者や顧客に強力な価格対性能比を提供します。
3.5 Flash-Liteは、3.5 Flashよりも低遅延で高ボリュームのタスクを実行します。
3.5 Flash-Liteは、エージェントシステムの効率的なスケーリングを可能にします。
思考レベル全体で、モデルは3.1 Flash-Liteを大幅に上回ります。ワークロードに応じて、開発者は、最小および低思考レベルで高ボリュームタスクの低遅延、低コスト実行を優先するようにモデルを設定するか、高思考レベルをエンゲージして複数ステップのサブエージェントワークロードを処理するように構成できます。このモデルには、これらのエージェントタスクをさまざまなサーフェスで確実にサポートするためのコンピューター使用ツールも組み込まれています。
Terminal-Bench 2.1(54%対31%)でのコーディングおよびエージェントタスク、GDM-MRCR v2(72.2%対60.1%)での長文コンテキスト、GDPval-AA v2(1140対642)での実際のタスク実行において、大幅なステップアップが見られます。実際、多くのエージェントおよびコーディング評価において、3.5 Flash-Liteは3 Flashさえも上回っており、SWE-Bench Pro(54.2%対49.6%)やOSWorld-Verified(74.0%対65.1%)では、2.5および3 Flashの両方のワークロードに対して、より高速でより有能なオプションとなっています。
3.5 Flash-Liteは、大規模なeコマースデータセットから製品機能を抽出し、それを合成します。マスターエージェントとして3.6 Flashと連携し、3.5 Flash-Liteは25のユニークで探索可能なWebデザインコンセプトを即座に生成します。
3.5 Flash-Liteは、そのマルチモーダル理解能力により、レシート翻訳と要約をスケーリングできます。
3.5 Flash-Liteは、複数のオプションを即座に生成・反復することでゲームを構築します。
3.5 Flash-Liteの初期顧客は、エージェントワークフローとデータ処理タスクのスケーリングにおける、速度、インテリジェンス、コスト効率のユニークな組み合わせを強調しています。
モデルの詳細については、3.5 Flash-Liteモデルカードを参照してください。
CodeMenderにおける3.5 Flash Cyber:脆弱性を効率的に発見・修正
AIモデルは、現在のシステムが修正できるよりも速くセキュリティ脆弱性を発見できるようになりました。この増大する脅威に対処するには、非常に有能で効率的なソフトウェアセキュリティのアプローチが必要です。
Flashのパフォーマンスと効率性は、コードセキュリティの問題を大規模に検出、検証、およびパッチ適用するための理想的な基盤となります。Gemini 3.5 Flash Cyberは3.5 Flashを基盤として構築されており、より大きなモデルよりも低いトークンあたりの価格でサイバーセキュリティ脆弱性の発見と修正に特化しています。
複数の3.5 Flash Cyberエージェントが連携して単一の統合レポートを作成するCodeMender内では、3.5 Flash Cyberは人気のベンチマークであるCyberGymで最先端の競争力のあるパフォーマンスを達成しています。この技術の二重使用の性質を考慮して、当社は3.5 Flashを展開するための意図的なアプローチを採用しました。