본문으로 바로가기

07/22/2026 · zyss

구글 딥마인드, Gemini 3.6 Flash 등 신규 모델 출시

구글 딥마인드, Gemini 3.6 Flash 등 신규 모델 출시

이미지 출처: Pixabay / 작가: BCStrike

 

구글, Gemini 3.6 Flash 공개…속도·비용·보안 특화 모델로 라인업 확대

구글은 2026년 7월 21일 Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite, 사이버 보안에 특화된 Gemini 3.5 Flash Cyber를 발표했다.

이번에 공개된 모델들은 인공지능 에이전트를 대규모로 운영할 때 필요한 성능과 응답 속도, 비용 효율성을 강화한 것이 특징이다. 구글은 작업의 복잡성과 목적에 따라 적합한 모델을 선택할 수 있도록 Gemini Flash 제품군을 세분화했다.

성능과 효율성 높인 Gemini 3.6 Flash

Gemini 3.6 Flash는 코딩과 지식 기반 업무, 멀티모달 처리 성능을 강화한 범용 모델이다.

구글에 따르면 Gemini 3.6 Flash는 기존 Gemini 3.5 Flash보다 출력 토큰 사용량을 17% 줄였다. 여러 단계로 구성된 작업을 수행할 때 필요한 추론 과정과 도구 호출 횟수도 감소해 AI 에이전트 운영 효율을 높였다.

가격은 입력 토큰 100만 개당 1.50달러, 출력 토큰 100만 개당 7.50달러로 책정됐다. 기존 모델보다 출력 토큰당 비용을 낮춰 복잡한 에이전트 작업을 보다 경제적으로 운영할 수 있도록 했다.

코딩 벤치마크인 DeepSWE에서는 Gemini 3.5 Flash의 37%보다 높은 49%를 기록했으며, 컴퓨터 사용 능력을 측정하는 OSWorld-Verified에서는 83.0%의 성능을 보였다.

속도와 비용에 초점 맞춘 Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite는 빠른 처리 속도와 낮은 운영 비용이 필요한 대규모 작업을 겨냥한 경량 모델이다.

인공지능 모델 분석기관 Artificial Analysis의 측정 결과에 따르면 초당 약 350개의 출력 토큰을 생성하며, Gemini 3.5 시리즈 가운데 가장 빠른 모델로 소개됐다.

가격은 입력 토큰 100만 개당 0.30달러, 출력 토큰 100만 개당 2.50달러다. 검색 에이전트와 문서 처리, 상품 정보 추출, 영수증 번역·요약처럼 반복적으로 많은 데이터를 처리해야 하는 서비스에 적합하다.

사용자는 작업 성격에 따라 모델의 추론 수준을 조절할 수 있다. 단순하고 반복적인 작업에서는 처리 속도와 비용을 우선하고, 여러 단계의 판단이 필요한 작업에서는 더 높은 추론 수준을 적용할 수 있다.

취약점 탐지에 특화된 Gemini 3.5 Flash Cyber

Gemini 3.5 Flash Cyber는 소프트웨어의 보안 취약점을 탐지하고 검증하며 수정하는 작업에 특화된 경량 사이버 보안 모델이다.

Gemini 3.5 Flash를 기반으로 추가 학습했으며, 구글의 코드 보안 에이전트인 CodeMender와 함께 작동한다. 여러 개의 Flash Cyber 에이전트가 동시에 코드 경로를 분석한 뒤 하나의 종합 보고서를 생성하는 방식이다.

구글은 이 모델이 Chrome과 Android, Google Cloud, Ads, YouTube 등 자사 내부 코드베이스의 보안 취약점을 찾고 수정하는 데 이미 활용되고 있다고 밝혔다.

다만 사이버 보안 기술이 공격 목적으로도 사용될 수 있다는 점을 고려해 일반 사용자에게 즉시 공개하지는 않는다. 초기에는 정부 기관과 신뢰할 수 있는 파트너를 대상으로 CodeMender를 통한 제한적 파일럿 프로그램으로 제공할 예정이다.

Gemini 앱과 API에서 이용 가능

Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite는 발표 당일부터 Google AI Studio와 Gemini API, Android Studio에서 사용할 수 있다.

기업 고객은 Gemini Enterprise Agent Platform에서 두 모델을 이용할 수 있으며, Gemini 3.6 Flash는 Gemini Enterprise 앱과 Google Antigravity에도 적용된다. 일반 사용자는 Gemini 앱에서 이용할 수 있고, Gemini 3.5 Flash-Lite는 구글 검색에도 순차적으로 도입된다.

이번 발표는 하나의 고성능 모델로 모든 작업을 처리하기보다 범용 성능과 대량 처리, 사이버 보안 등 목적에 따라 모델을 구분하려는 구글의 전략을 보여준다. 기업과 개발자는 처리 속도와 비용, 보안 수준을 고려해 필요한 모델을 선택할 수 있게 됐다.

댓글 (0)