본문으로 건너뛰기

Gemini 3.8 Flash·Cyber 출시, Chrome 유효 패치 2.6배·취약점 성공률 70% 돌파

Google DeepMind이 Gemini 3.8 Flash와 보안 특화 Cyber 모델을 내놨다. Cyber는 내부 20개 언어 취약점 평가에서 성공률 70%를 넘었고, Chrome 코드에서는 대형 상용 모델보다 올바른 패치를 2.6배 더 많이 만들었다. 범용 모델의 도입 가격은 3.7과 같다.

원문: Gemini 3.8 Flash and Flash Cyber improve reasoning and autonomous patching 원문 보기 →

LLM X/Twitter 작성자 Insights AI (Twitter) 2분 소요 출처

Flash 속도에 장기 추론과 보안 패치를 결합

Gemini 3.8은 빠르고 저렴한 Flash 계열을 장기 에이전트 작업과 실제 코드 수리까지 끌어올린 모델이다. Google DeepMind은 범용 Gemini 3.8 Flash와 방어 조직용 Gemini 3.8 Flash Cyber를 함께 공개했다. 3.8 Flash의 도입 가격은 3.7 Flash와 같은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러다. 2027년 1월부터는 각각 1.50달러와 7.50달러로 오를 예정이다.

“Two new Gemini models are here to help scale your AI agents and secure code.”

원문 게시물은 3.8 Flash가 소프트웨어 공학, 에이전트 작업, 여러 단계 추론에서 3.7 Flash를 크게 앞섰고 Cyber가 취약점 탐지와 자동 패치에 집중한다고 적었다. Google DeepMind 계정은 Gemini 연구와 제품 전환을 함께 다루는 공식 채널이다. 이 게시물은 답글 묶음의 첫 글이지만 자체로 모델 두 종과 용도를 완결해 설명하는 독립 원문이다. 게시 시점 반응은 조회 약 37만 회와 좋아요 2천 건을 넘어 기술 출시로서 충분한 관심을 모았다.

70% 탐지와 47.2% 패치 성능

Google의 기술 소개에서 3.8 Flash는 HLE-Verified 54.9%를 기록했다. Cyber는 20개 프로그래밍 언어를 포괄하는 내부 취약점 평가에서 성공률 70%를 넘겼다. 외부 패치 평가인 CWE-Bench에서는 pass@1 47.2%로 선도 모델의 47.8%에 근접했다. Chrome 보안팀 시험에서는 훨씬 큰 상용 모델보다 올바른 패치를 2.6배 더 많이 만들었고, Google 연구팀은 보통 수개월이 걸리는 기반 취약점 하나를 2시간 이내에 찾았다고 밝혔다.

보안 모델은 누구나 호출할 수 있는 공개 API가 아니다. Google은 Fairwind Program을 통해 정부 사이버 기관, 핵심 인프라 운영자, 소프트웨어 유지관리자 등 검증된 방어자에게 우선 제공한다. 이 프로그램은 Gemini 3.8 Flash Cyber와 패치 검증 도구 CodeMender를 묶고, 참여 조직에는 다중 인증과 내부 보안 인력으로의 접근 제한을 요구한다. 초기 참여 파트너는 전 세계 650곳 이상이다.

다음 확인 지점

가장 중요한 검증 대상은 내부 70% 수치가 공개 코드베이스와 다양한 언어에서도 재현되는지 여부다. 패치가 만들어지는 속도보다 컴파일, 회귀 시험, 실제 배포 뒤 안전성까지 포함한 유효 패치 비율이 더 중요하다. 12월 31일 이후 두 배가 되는 가격이 에이전트의 반복 추론 비용에 미치는 영향과 Fairwind의 접근 심사 기준, 공격 능력을 억제하면서 방어 성능을 유지하는 운영 방식도 후속 관찰 지점이다.

공유: 긴글

관련 기사

LLM X/Twitter

OpenAI Astra, 제로데이 2건 찾아 사상 첫 ‘치명적’ 사이버보안 역량 기준 통과

Astra가 OpenAI 모델 최초로 사이버보안 ‘Critical’ 기준을 넘고, 최신 V8 취약점 평가에서 제로데이 2건을 찾아냈다. ExploitBench에서는 100%를 기록해 공개 범위와 안전장치가 출시의 핵심 변수가 됐다. 가장 강한 기능은 소수 시험자에게 먼저 제공된다.

2분 소요 2 조회