Google DeepMind、仮想3D世界向けの汎用エージェントモデルSIMA 2を発表
Original: SIMA 2: An agent that plays, reasons and learns with you in virtual 3D worlds View original →
DeepMindがSIMA 2を次世代エージェント研究の基盤として提示
Google DeepMindは2025年11月13日、SIMA 2を公開した。発表では、特定タイトル専用のbotではなく、複数の仮想3D環境で機能するgeneralist foundation modelとして位置づけている。狙いは固定シナリオの自動実行ではなく、人と協調しながら目標を解釈し、状況変化に応じて行動を更新するエージェント能力の拡張だ。
同社によるとSIMA 2は、従来のrule-based手法で扱いにくい課題を対象としている。目標変更、曖昧な指示、長いタスク連鎖のような条件下で、play and reason with humansすることを重視している点が特徴だ。これは実業務のAI assistantに求められる条件とも重なる。
発表で示された主要ポイント
- 単一タイトル最適化ではなくgeneralist設計
- human demonstrationsを用いた学習
- 対話・操作の中で改善するin-context learningの報告
- Gemini 2.5とGenie 3由来の構成要素を統合
産業的な意義は、仮想3D世界がエージェント評価に適した高密度テスト環境を提供する点にある。instruction following、長期記憶、spatial reasoning、曖昧な目的への耐性を同時に観測できるため、ゲーム外の複雑な自動化タスクにも知見を移しやすい。
DeepMindはSIMA 2を即時量産向け製品としてではなく、研究と実装を反復するためのプラットフォームとして提示している。つまり、短期的な派手な導入よりも、制御された実験基盤の上で能力を積み上げる戦略だ。この位置づけは、エージェント領域の投資が中長期で進むことを示唆する。
要するにSIMA 2は、静的なテキスト評価中心だった競争から、動的環境で行動・推論・学習を統合する段階への移行を加速させる発表といえる。
Related Articles
企業向けAI agentは実証実験から本番運用へ移りつつある。OpenAIはPresenceが英語電話サポートで問い合わせの75%を人手なしで解決し、10日で人間への引き継ぎを15ポイント下げたとしている。
企業向けAI agentの競争軸がデモから運用指標へ移り始めた。OpenAI Presenceは英語の電話サポートで問い合わせの75%を人手なしで解決し、Codexによる改善ループで10日間に人への引き継ぎを15ポイント下げたという。
MCP protocolは2026年7月28日にstateless coreへ移る。GitHub MCP Serverは最新specを先行サポートし、Redis session削除、payload inspection削減、official conformance testの流れを示した。