Gemini Flash、低コストagent向けに3モデルへ分岐
Original: Google ships three Gemini Flash models for cheaper agents and cyber work View original →
Google DeepMindはGemini Flash系を、運用目的ごとに分けた3モデルとして提示した。Gemini 3.6 Flashは高品質なagent作業、Gemini 3.5 Flash-Liteは高スループット処理、Gemini 3.5 Flash CyberはCodeMender内のセキュリティ作業を担う。
投稿では3モデルを、agentを「faster, smarter, and cheaper」にする選択肢として示した。
Google DeepMindの公式アカウントは、Gemini、研究、robotics、responsible AIに関する更新を継続的に発信している。この投稿は2026年7月21日15:29 UTCに公開され、取得時点で約168万回表示されていた。リンク先のGoogle Blogは、3.6 FlashがArtificial Analysis Indexで3.5 Flashより出力token使用量を17%減らし、DeepSWEの一部タスクでは最大65%減を観測したと説明する。
価格も実運用向けの数字になっている。3.6 Flashは入力100万tokenあたり1.50ドル、出力100万tokenあたり7.50ドル。3.5 Flash-Liteは毎秒350出力token、入力100万tokenあたり0.30ドル、出力100万tokenあたり2.50ドルとされる。さらにTerminal-Bench 2.1では54%対31%、GDM-MRCR v2では72.2%対60.1%と、3.1 Flash-Liteを上回る数字も示された。
Cyberモデルは扱いが限定される。Gemini 3.5 Flash Cyberは脆弱性の検出、検証、修正を狙い、CodeMenderと組み合わせて政府機関と信頼されたpartner向けの限定pilotで提供される。次に見るべきは、API価格だけでなくworkflow全体の費用だ。agentは再試行、tool呼び出し、長い出力でコストが膨らむため、token効率と低遅延が実際の採用を左右する。元の投稿はこちら。
Related Articles
エージェント競争は、回答精度から画面上の制御へ広がっている。Google DeepMindはGemini 3.5 Flashにブラウザ、モバイル、デスクトップを扱うcomputer useを組み込んだ。
大規模コードのセキュリティ解析では、最高精度だけでなく実行単価が重くなる。Malte Ublは非公開Deepsec評価でGPT-5.6 Solが最高の再現率・精度だった一方、実行費用は次点の7倍超だったと述べた。
Google DeepMindは2026年3月26日、Gemini 3.1 Flash LiveがGoogle AI StudioのLive APIでpreview提供されると発表した。Googleブログによれば、このモデルはリアルタイムvoice・vision agent向けで、noisy環境でのtool triggeringを改善し、90超の言語でmultimodal会話を扱える。