Google DeepMind, Gemini 3.1 Pro 출시 — ARC-AGI-2 77.1% 달성, 추론 성능 2배 향상
Google DeepMind가 Gemini 3.1 Pro를 출시했다. 전작 대비 추론 성능이 2배 이상 향상됐으며 ARC-AGI-2에서 77.1%를 달성했다. 18개 추적 벤치마크 중 12개에서 1위를 기록하면서 API 가격은 $2/$12로 그대로 유지된다.
원문: Google DeepMind Releases Gemini 3.1 Pro: 2x Reasoning Boost and Record Benchmark Scores 원문 보기 →
개요
Google DeepMind가 2026년 2월 19일 Gemini 3.1 Pro를 출시했다. 전작 Gemini 3 Pro 대비 추론 성능이 2배 이상 향상됐으며, ARC-AGI-2에서 77.1%를 달성해 기존 31.1%에서 크게 도약했다. API 가격은 그대로 유지된다.
주요 벤치마크 성능
- ARC-AGI-2: 77.1% (기존 31.1%에서 대폭 향상)
- SWE-bench Verified: 80.6%
- GPQA Diamond: 94.3%
- LiveCodeBench Pro Elo: 2887
- Humanity's Last Exam: 44.4%
- 18개 추적 벤치마크 중 12개에서 1위
주요 기능
- 1M 토큰 컨텍스트: 텍스트, 이미지, 오디오, 비디오 모두 지원
- 세 가지 사고 레벨: Low, Medium, High — 응답 지연과 추론 깊이를 조절 가능
- 64K 출력 토큰: 긴 복잡한 작업에 적합
- 멀티모달: 텍스트, 오디오, 이미지, 비디오, 코드 레포지토리 처리 가능
가격 및 이용
API 가격은 이전 Gemini 3 Pro와 동일하게 입력 100만 토큰당 $2, 출력 100만 토큰당 $12로 유지된다. Gemini API, Vertex AI, Gemini 앱, NotebookLM을 통해 이용 가능하다.
관련 기사
Google DeepMind, Gemini 3.1 Pro 공개…복잡 문제 해결용 추론 성능 강화
Google DeepMind는 2026년 2월 19일 Gemini 3.1 Pro를 발표했다. 회사는 ARC-AGI-2에서 77.1% 검증 점수를 제시하며, 개발자·기업·일반 사용자 채널에 동시 롤아웃한다고 밝혔다.
4개월 만에 네 번째 Flash — Gemini 3.8의 추론·코딩 도약
Google이 9월 2일 추론·코딩 최강 Flash 모델 Gemini 3.8을 공개했다. 3.7 Flash 출시 3주 만에 나온 후속작으로, Gemini 3.8 Flash와 사이버보안 특화 3.8 Flash Cyber 두 가지 변형이 제공된다.
Gemini 3.8 Flash·Cyber 출시, Chrome 유효 패치 2.6배·취약점 성공률 70% 돌파
Google DeepMind이 Gemini 3.8 Flash와 보안 특화 Cyber 모델을 내놨다. Cyber는 내부 20개 언어 취약점 평가에서 성공률 70%를 넘었고, Chrome 코드에서는 대형 상용 모델보다 올바른 패치를 2.6배 더 많이 만들었다. 범용 모델의 도입 가격은 3.7과 같다.