Gemini Omni 1.1 Flash 정식 출시: 4K 업스케일·장면 확장 지원 영상 모델
원문: Google Releases Gemini Omni 1.1 Flash with 4K Upscaling, Scene Extension, and Keyframe Control 원문 보기 →
Gemini Omni 1.1 Flash 정식 공개
Google이 2026년 8월 27일 새로운 멀티모달 영상 생성·편집 모델 Gemini Omni 1.1 Flash를 Gemini API 유료 티어와 Google AI Studio에서 정식 공개했다. 이전 Omni Flash 대비 크리에이티브 제어 기능이 대폭 강화됐다.
주요 신기능
- 장면 확장: 이전 10초 콘텐츠를 맥락으로 읽어 장면을 자연스럽게 연장
- 첫/마지막 프레임 지정: 시작 및 종료 프레임을 명시해 원하는 구도로 영상 생성
- 4K 업스케일: 기존 영상을 4K 해상도로 고품질 변환
- 360p 빠른 초안: 기존 대비 약 1/3 비용으로 아이디어를 빠르게 검토
- 영상 참조 입력: 멀티모달 입력으로 참조 영상 활용 가능
Video Arena 1위
Gemini Omni 1.1 Flash는 출시와 함께 Video Arena에서 1위 모델로 등재됐다. Google AI Studio와 Gemini API를 통해 개발자가 직접 접근할 수 있으며, 향후 몇 주 안에 Gemini 앱, Flow, YouTube Shorts에도 순차 적용될 예정이다.
이번 업데이트는 Sora, Runway, Kling 등 경쟁 영상 생성 모델들에 맞서 Gemini 플랫폼의 멀티모달 역량을 한층 강화하는 행보다.
관련 기사
Google이 Gemini API와 Vertex AI를 통해 Gemini Embedding 2를 preview로 공개했다. 이 모델은 text, image, video, audio, document를 하나의 embedding space에 넣는 Google의 첫 네이티브 멀티모달 embedding 시스템이다.
Google DeepMind는 2026년 3월 26일 Gemini 3.1 Flash Live가 Gemini Live와 Google Search Live에 순차 적용되고, 개발자는 Google AI Studio에서 바로 사용할 수 있다고 밝혔다. Google은 이 모델을 자사 최고 품질의 audio model로 규정하며, 더 낮은 latency와 향상된 tonal understanding, 그리고 ComplexFuncBench Audio 90.8% 성능을 강조했다.
Google AI가 Gemini 3.1 Flash-Lite의 고용량 이미지 분류 및 비즈니스 자동화 활용 사례를 제시했다. 모델은 Gemini API, Google AI Studio, Vertex AI preview 경로로 확장되고 있다.