실제 스프레드시트·문서를 다루는 독립 평가에서 Gemini 3.7 Flash가 60.0%를 기록해 Claude Opus 5의 53.8%를 6.2%포인트 앞섰다. 빠른 Flash 계열이 최고급 모델보다 반복 정확도에서 우위를 보이면서, 분석 에이전트의 비용·속도·신뢰성 조합을 다시 따져볼 근거가 생겼다.
실제 스프레드시트·문서를 다루는 독립 평가에서 Gemini 3.7 Flash가 60.0%를 기록해 Claude Opus 5의 53.8%를 6.2%포인트 앞섰다. 빠른 Flash 계열이 최고급 모델보다 반복 정확도에서 우위를 보이면서, 분석 에이전트의 비용·속도·신뢰성 조합을 다시 따져볼 근거가 생겼다.
Gemini 3.7 Flash가 Pro와 Ultra 두 유료 등급 전체에 배포됐다. Google은 수십 개 파일과 이메일의 관계를 찾아 하나의 문서로 만드는 다단계 작업의 추론 정확도를 높였다고 밝혔다.
3주 만의 후속 모델이 코딩과 업무 자동화 성능을 두 자릿수 폭으로 끌어올렸다. FrontierCode 1.1은 34.4%에서 43.6%로 상승했고, 연말까지 출력 100만 토큰당 3.75달러다. Google AI Studio와 Android Studio에서 바로 쓸 수 있다.
936점을 모은 관심의 초점은 단순한 신모델 출시가 아니라, 3주 만의 세대 교체와 연말까지 적용되는 절반 가격이다. 코딩·문서 처리·업무 자동화 지표가 함께 올랐지만, 실제 비용과 품질은 각자의 agent workflow에서 확인해야 한다.
2026-07-28 MCP specification release candidate가 transport-level session management를 제거했다. Google은 Python, TypeScript, Go, C# beta SDK가 이미 새 규격을 지원하며, GitHub MCP Server도 Redis session storage를 없앴다고 밝혔다.
Google이 Gemini 모델 개발과 앱, Frontier AI research를 Koray Kavukcuoglu에게 맡기고 Demis Hassabis를 Alphabet Chief Scientist로 이동시켰다. Gemini 앱 950M+ 월간 사용자와 Gemma 900M+ 다운로드 뒤에서, Jeff Dean과 Sanjay Ghemawat은 독립 public benefit corporation으로 빠져나간다.
Agent 품질 검증이 개발 실험과 실제 운영 트래픽을 같은 엔진에서 비교하는 단계로 넘어갔다. Google은 Gemini Enterprise Agent Platform의 평가 서비스를 GA로 전환하며 20개 이상의 사전 구축 지표, adaptive rubrics, drift 알림을 묶었다.
음악 생성 모델 경쟁이 음질보다 편집권으로 옮겨가고 있다. Google은 Lyria 3.5를 Flow Music에 적용하며 가사 품질, 보컬 표현, tempo와 duration 제어를 전면에 세웠다.
관심은 로봇이 말을 알아듣는지를 넘어, 걷고 숙이고 집고 협업하는 전신 행동을 한 모델 계열로 묶을 수 있는지에 모였다.
Google의 새 Gemini Flash 라인업에서 관심은 모델 이름보다 토큰 효율과 agent workflow 비용에 모였다. 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 줄였고, Cyber 모델은 CodeMender와 묶였다.
agentic RL 학습의 병목은 모델 계산보다 환경 대기 시간인 경우가 많다. Google Tunix는 asynchronous rollout과 producer-consumer pipeline으로 TPU idle time을 줄이는 JAX-native post-training library를 전면에 세웠다.
AI 생성물 출처 표시가 실험 단계를 넘어 대규모 배포로 이동했다. Google은 SynthID가 이미지와 영상 1000억 건, 오디오 6만 년 분량에 워터마크를 적용했고 검증은 5000만 회를 넘었다고 밝혔다.