구글 I/O 2026: 대화 한 마디로 영상 편집하는 Gemini Omni 공개
구글이 I/O 2026 키노트(5월 19일)에서 Gemini Omni를 발표했다. Sora·Runway 등 기존 AI 영상 생성기와 달리 물리 환경의 인과관계를 이해하는 '세계 모델'로, 자연어 명령만으로 배경·조명·카메라 앵글을 실시간 수정하는 대화형 편집이 핵심이다. 발표 당일 Veo를 대체해 Google AI 구독자에게 즉시 제공됐다.
태그
#product-launch 태그가 달린 기사
구글이 I/O 2026 키노트(5월 19일)에서 Gemini Omni를 발표했다. Sora·Runway 등 기존 AI 영상 생성기와 달리 물리 환경의 인과관계를 이해하는 '세계 모델'로, 자연어 명령만으로 배경·조명·카메라 앵글을 실시간 수정하는 대화형 편집이 핵심이다. 발표 당일 Veo를 대체해 Google AI 구독자에게 즉시 제공됐다.
OpenAI가 코딩 에이전트 Codex를 ChatGPT iOS·Android 앱에 통합했다. 스마트폰이 데스크톱이나 원격 서버에서 실행 중인 Codex 세션의 제어 인터페이스가 되며, 무료 플랜 포함 전 플랜에서 미리보기로 이용 가능하다.
구글이 Android와 ChromeOS를 통합한 운영체제에 Gemini AI를 전면 탑재한 새 노트북 플랫폼 'Googlebook'을 발표했다. Acer·ASUS·Dell·HP·Lenovo가 디바이스를 개발 중이며 2026년 하반기 출시 예정이다.
Google DeepMind의 세계 모델 Project Genie가 Street View와 통합됐다. 지도 핀 하나로 실제 장소를 360도 인터랙티브 환경으로 변환하며, Waymo 자율주행 훈련에도 활용된다.
Google이 I/O 2026에서 Gemini 3.5 Flash를 공개하고 Managed Agents API를 발표했다. API 호출 한 번으로 격리 Linux 환경의 완전한 에이전트를 프로비저닝할 수 있다.
메타가 5월 13일 WhatsApp에 Private Processing 기반 Incognito Chat을 출시, 신뢰 실행 환경(TEE)을 통해 Meta AI와의 대화를 메타 직원도 접근할 수 없게 격리한다.
Anthropic과 PwC가 전략적 제휴를 확대해 Claude Code와 Cowork를 미국팀 시작으로 글로벌 전체에 배포하며, 3만 명 인증 과정과 공동 AI 센터를 설립한다. 보험 인수 주기는 10주에서 10일로 단축됐다.
구글이 5월 12일 안드로이드 쇼에서 제미나이 인텔리전스를 공개했다. Galaxy S26·Pixel 10을 시작으로 앱 간 멀티스텝 자동화, 자연어 위젯 생성, 음성-텍스트 변환 기능이 올 여름 배포된다.
영국 AI 로봇 스타트업 Humanoid가 2026년 5월 13일 글로벌 자동차 부품사 샤플러와 2032년까지 최대 2천 대의 휴머노이드 로봇을 배포하는 구속력 있는 계약을 체결했다.
OpenAI가 2026년 5월 7일 API를 통해 실시간 음성 AI 3종을 공개했다. GPT-5급 추론을 갖춘 GPT-Realtime-2, 70개 언어 실시간 번역, 스트리밍 전사 모델이 각각 출시됐다.
Google DeepMind가 2026년 5월 12일 Gemini 기반의 AI 마우스 포인터 Magic Pointer를 발표했다. 포인터를 움직이기만 해도 화면 위 콘텐츠를 Gemini가 인식해 즉각적인 AI 지원이 가능하다.
Anthropic이 2026년 5월 6일 SpaceX-xAI의 콜로서스1 데이터센터 전체 컴퓨팅을 독점 임차하는 계약을 체결했다. NVIDIA GPU 22만 개, 300MW 규모로 Claude API 한도가 대폭 상향된다.