Gemini가 Pixel 10·Galaxy S26에서 Uber 호출과 음식 주문 자동화를 시작
Original: Google Gemini can book an Uber or order food for you on Pixel 10 and Galaxy S26 View original →
Google의 모바일 AI 전략이 단순 질의응답을 넘어 실제 앱 실행 자동화 단계로 이동했다. The Verge 보도에 따르면 Google은 Pixel 10 계열과 Samsung Galaxy S26 계열 일부 기기에서 Gemini의 새로운 task automation 기능을 선보였고, 초기에는 Uber 호출과 음식 주문 같은 반복 작업을 중심으로 제공한다. 이 기능은 AI가 사용자를 대신해 앱 화면을 순차적으로 조작하지만, 최종 주문 제출은 사용자가 직접 확인하고 완료하는 구조로 설계됐다.
어떻게 동작하나
작동 흐름은 비교적 명확하다. 사용자가 Gemini에게 목적지를 말해 차량 호출을 요청하거나, 음식 주문을 요청하면 Gemini가 앱을 가상 창 형태로 열고 단계별로 옵션을 선택한다. 진행 중에는 사용자가 언제든 개입하거나 중단할 수 있고, 백그라운드에서 진행하도록 둘 수도 있다. 재고 부족이나 선택지 충돌 같은 예외가 발생하면 Gemini가 사용자 확인을 요청하는 방식이다. 즉, 완전 무인 결제보다는 "자동 준비 + 인간 최종 확인" 모델에 가깝다.
기술 스택과 확장 경로
The Verge 기사에 따르면 Google은 이 자동화를 단일 방식으로만 처리하지 않는다. Gemini 3 기반 추론으로 UI를 이해해 클릭 경로를 찾는 방식, MCP나 Android app functions 같은 명시적 연동 방식, 그리고 필요한 경우 범용적인 UI 조작 방식이 함께 사용된다. Android 생태계 총괄 Sameer Samat은 이를 Android를 "운영체제"가 아니라 "intelligence system"으로 확장하는 과정이라고 설명했으며, 해당 자동화 능력이 향후 Android의 다음 메이저 릴리스에도 반영될 것이라고 밝혔다.
초기 제약과 실무적 의미
초기 프리뷰는 지원 앱과 지역이 제한적이다. The Verge 보도 기준으로 미국과 한국에서 Galaxy S26 시리즈 및 Pixel 10, Pixel 10 Pro, Pixel 10 Pro XL을 대상으로 시작하며, 앱 범위도 Uber와 Grubhub 등 일부 파트너 중심이다. 그럼에도 의미는 크다. 모바일 AI가 더 이상 "답변 생성"에 머무르지 않고, 실제 트랜잭션 준비를 수행하는 실행 계층으로 올라왔기 때문이다. 개발사 관점에서는 MCP나 app functions 같은 표준 연동 전략을 빠르게 정리해야 하고, 사용자 경험 관점에서는 자동화 과정의 가시성, 중단 가능성, 최종 승인 경계 설계가 핵심 품질 요소가 된다.
이번 발표는 에이전트형 모바일 UX의 출발점에 가깝다. 단기적으로는 제한된 파트너 앱에서 시작하지만, 중장기적으로는 이동, 쇼핑, 예약, 일정 조정처럼 다단계 앱 흐름이 AI 중심으로 재구성될 가능성이 높다.
Related Articles
Google의 새 Gemini Flash 라인업에서 관심은 모델 이름보다 토큰 효율과 agent workflow 비용에 모였다. 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 줄였고, Cyber 모델은 CodeMender와 묶였다.
가벼운 보안 특화 모델이 V8에서 고유 취약점 55건을 찾으며 방어 자동화의 비용 구조를 흔들었다. Google DeepMind는 정부와 신뢰 파트너에게만 CodeMender 경유 파일럿을 연다.
Google DeepMind의 새 Flash 라인업은 대형 모델 경쟁의 축을 비용과 처리량으로 옮긴다. 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 줄이고, Flash-Lite는 초당 350개 출력 토큰을 내세운다.