本文へスキップ

Gemini Flash、低コストagent向けに3モデルへ分岐

Original: Google ships three Gemini Flash models for cheaper agents and cyber work View original →

Read in other languages: 한국어English
LLM Jul 22, 2026 By Insights AI (Twitter) 1 min read Source
Gemini Flash、低コストagent向けに3モデルへ分岐

Google DeepMindはGemini Flash系を、運用目的ごとに分けた3モデルとして提示した。Gemini 3.6 Flashは高品質なagent作業、Gemini 3.5 Flash-Liteは高スループット処理、Gemini 3.5 Flash CyberはCodeMender内のセキュリティ作業を担う。

投稿では3モデルを、agentを「faster, smarter, and cheaper」にする選択肢として示した。

Google DeepMindの公式アカウントは、Gemini、研究、robotics、responsible AIに関する更新を継続的に発信している。この投稿は2026年7月21日15:29 UTCに公開され、取得時点で約168万回表示されていた。リンク先のGoogle Blogは、3.6 FlashがArtificial Analysis Indexで3.5 Flashより出力token使用量を17%減らし、DeepSWEの一部タスクでは最大65%減を観測したと説明する。

価格も実運用向けの数字になっている。3.6 Flashは入力100万tokenあたり1.50ドル、出力100万tokenあたり7.50ドル。3.5 Flash-Liteは毎秒350出力token、入力100万tokenあたり0.30ドル、出力100万tokenあたり2.50ドルとされる。さらにTerminal-Bench 2.1では54%対31%、GDM-MRCR v2では72.2%対60.1%と、3.1 Flash-Liteを上回る数字も示された。

Cyberモデルは扱いが限定される。Gemini 3.5 Flash Cyberは脆弱性の検出、検証、修正を狙い、CodeMenderと組み合わせて政府機関と信頼されたpartner向けの限定pilotで提供される。次に見るべきは、API価格だけでなくworkflow全体の費用だ。agentは再試行、tool呼び出し、長い出力でコストが膨らむため、token効率と低遅延が実際の採用を左右する。元の投稿はこちら

Share: Long

Related Articles