본문 바로가기

인공지능

Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 출시: 더 빠르고 효율적인 AI 에이전트 개발을 위한 새로운 모델

728x90
반응형
728x170

AI 에이전트 개발을 위한 Gemini Flash 시리즈의 새로운 진화

AI 에이전트를 실제 서비스에 적용하기 위해서는 높은 성능뿐만 아니라 비용 효율성, 빠른 응답 속도, 안정적인 실행이 함께 요구됩니다. 특히 대규모 AI 서비스를 운영하는 환경에서는 토큰 사용량과 지연 시간(Latency)이 서비스 운영 비용과 사용자 경험에 직접적인 영향을 미칩니다.

Google은 이러한 요구사항을 반영하여 Gemini Flash 시리즈의 새로운 모델인 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber를 공개했습니다.

이번 업데이트는 단순히 성능 향상에 그치지 않고, 토큰 효율성 개선, 비용 절감, AI 에이전트 실행 성능 향상, 멀티모달 처리 능력 강화에 초점을 맞추고 있습니다. 또한 보안 분야에 특화된 Cyber 모델까지 함께 발표하면서 다양한 AI 활용 환경을 지원하는 모델 라인업을 완성했습니다.

이번 글에서는 각 모델의 특징과 개선 사항, 활용 분야를 중심으로 살펴보겠습니다.

반응형

Gemini Flash 시리즈란?

Gemini Flash 시리즈는 AI 에이전트 개발에 최적화된 Gemini 모델 계열입니다.

Flash 시리즈는 다음과 같은 특징을 목표로 설계되었습니다.

  • 높은 응답 속도(Low Latency)
  • 우수한 토큰 효율성(Token Efficiency)
  • 낮은 운영 비용
  • 안정적인 AI 에이전트 실행
  • 다양한 멀티모달 작업 지원

이번 발표에서는 이러한 장점을 더욱 강화한 세 가지 새로운 모델이 공개되었습니다.

  • Gemini 3.6 Flash
  • Gemini 3.5 Flash-Lite
  • Gemini 3.5 Flash Cyber

Gemini 3.6 Flash: 성능과 효율성을 모두 개선한 주력 모델

Gemini 3.6 Flash는 기존 Gemini 3.5 Flash를 기반으로 개발된 차세대 주력 모델입니다.

가장 큰 특징은 더 적은 토큰으로 더 높은 품질의 결과를 생성한다는 점입니다.

주요 개선 사항은 다음과 같습니다.

  • 출력 토큰 사용량 약 17% 감소
  • 일부 벤치마크에서는 최대 65%까지 토큰 절감
  • 추론 단계(Reasoning Step) 감소
  • Tool Call 횟수 감소
  • 출력 토큰당 비용 절감

즉, 동일한 작업을 수행하더라도 더 적은 리소스를 사용하여 결과를 생성할 수 있으므로 AI 에이전트 운영 비용을 줄이는 데 도움이 됩니다.


향상된 코딩 및 지식 작업 성능

Gemini 3.6 Flash는 다양한 벤치마크에서 기존 3.5 Flash보다 향상된 결과를 보여주었습니다.

대표적인 개선 영역은 다음과 같습니다.

코드 생성 및 수정

  • 불필요한 코드 수정 감소
  • 실행 반복(Execution Loop) 감소
  • 더욱 정확한 코드 생성

머신러닝 연구 지원

ML Research 관련 벤치마크에서 향상된 성능을 기록했습니다.

컴퓨터 사용 능력

OSWorld-Verified 벤치마크에서 성능이 향상되었으며, 컴퓨터 사용 기능이 Gemini API와 Gemini Enterprise의 기본 도구로 제공됩니다.

지식 기반 업무

문서 분석, 차트 해석, 데이터 분석, 보고서 초안 작성과 같은 업무에서 더욱 우수한 성능을 제공합니다.


비용까지 낮아진 Gemini 3.6 Flash

Gemini 3.6 Flash는 성능뿐 아니라 가격 경쟁력도 함께 개선되었습니다.

가격은 다음과 같습니다.

  • 입력 토큰: 100만 토큰당 1.50달러
  • 출력 토큰: 100만 토큰당 7.50달러

출력 토큰 자체를 줄여주는 모델 특성과 함께 토큰 단가까지 낮아져 AI 에이전트 운영 비용 절감 효과를 기대할 수 있습니다.


강화된 안전성

Gemini 3.6 Flash는 보안성도 함께 개선되었습니다.

특히 다음 영역에서 Frontier Safety 보호 기능이 강화되었습니다.

  • 화학(Chemical)
  • 생물학(Biological)
  • 방사능(Radiological)
  • 핵(CBRN)
  • 사이버 공격(Cyber Offense)

이를 통해 탈옥(Jailbreak) 공격에 대한 저항성을 높이는 동시에 정상적인 활용 사례에서는 불필요한 응답 거부를 최소화하도록 설계되었습니다.


Gemini 3.5 Flash-Lite: 빠르고 경제적인 AI 모델

Gemini 3.5 Flash-Lite는 속도와 비용 효율성을 중점으로 설계된 모델입니다.

특히 다음과 같은 환경에 적합합니다.

  • 대규모 문서 처리
  • AI 검색 시스템
  • 데이터 분석
  • 대량 요청 처리
  • 고속 AI 에이전트 실행

Artificial Analysis 기준으로 초당 350개의 출력 토큰을 생성할 수 있어 Gemini 3.5 계열 중 가장 빠른 모델입니다.


높은 처리량을 위한 최적의 선택

Gemini 3.5 Flash-Lite는 다양한 작업 특성에 맞춰 추론 수준(Thinking Level)을 조정할 수 있습니다.

예를 들어,

  • 최소 추론 수준에서는 빠른 응답과 낮은 비용을 우선
  • 높은 추론 수준에서는 다단계 작업 수행을 지원

이를 통해 개발자는 서비스 특성에 맞는 성능과 비용의 균형을 선택할 수 있습니다.

또한 컴퓨터 사용 기능도 기본 제공되어 다양한 AI 에이전트 작업을 지원합니다.


이전 Flash-Lite 대비 향상된 성능

Gemini 3.5 Flash-Lite는 기존 3.1 Flash-Lite 대비 여러 영역에서 성능이 향상되었습니다.

대표적으로

  • 코딩 작업
  • 장문(Long Context) 처리
  • 실제 업무 수행 능력
  • AI 에이전트 실행

뿐만 아니라 일부 AI 에이전트 및 코딩 벤치마크에서는 기존 Gemini 3 Flash보다도 높은 성능을 기록했습니다.

이는 빠른 속도뿐 아니라 실질적인 작업 수행 능력도 함께 개선되었음을 보여줍니다.


Gemini 3.5 Flash Cyber: 보안 특화 AI 모델

Gemini 3.5 Flash Cyber는 사이버 보안 업무를 위해 특화된 모델입니다.

기존 Gemini 3.5 Flash를 기반으로 보안 취약점 탐지와 수정 작업에 맞춰 추가 학습(Fine-tuning)되었습니다.

CodeMender 플랫폼에서는 여러 개의 Flash Cyber 에이전트가 협업하여 하나의 통합 보안 분석 결과를 생성합니다.

주요 활용 분야는 다음과 같습니다.

  • 코드 취약점 탐지
  • 취약점 검증
  • 보안 패치 생성
  • 코드 보안 분석

CyberGym 벤치마크에서도 경쟁력 있는 성능을 제공하는 것으로 소개되었습니다.


제한된 환경에서 제공되는 Cyber 모델

Gemini 3.5 Flash Cyber는 이중 용도(Dual-use) 기술이라는 특성을 고려하여 일반 공개되지 않습니다.

초기에는 정부 기관과 신뢰할 수 있는 파트너를 대상으로 CodeMender를 통해 제한적으로 제공될 예정입니다.

이를 통해 실제 보안 담당자가 취약점을 신속하게 발견하고 대응할 수 있도록 지원하는 것이 목표입니다.


Gemini Flash 시리즈 활용 예시

새롭게 공개된 Flash 시리즈는 다양한 AI 업무에 활용할 수 있습니다.

대표적인 활용 사례는 다음과 같습니다.

  • 금융 데이터 및 회의록 분석
  • 코드 마이그레이션 자동화
  • 3D 워크플로우용 이미지 분석
  • 대규모 전자상거래 데이터 처리
  • 영수증 번역 및 요약
  • 웹 디자인 초안 생성
  • 게임 프로토타입 제작
  • 문서 분석 및 보고서 작성
  • 보안 취약점 탐지 및 수정

특히 멀티모달 이해 능력을 기반으로 텍스트뿐 아니라 문서, 차트, 이미지 등 다양한 형태의 데이터를 함께 처리할 수 있도록 설계되었습니다.


간단한 활용 예시

개발자는 작업 목적에 따라 적합한 모델을 선택할 수 있습니다.

예를 들어,

  • Gemini 3.6 Flash는 복잡한 문서 분석, 코드 생성, 데이터 분석 등 높은 정확도가 필요한 AI 에이전트에 적합합니다.
  • Gemini 3.5 Flash-Lite는 대량 문서 처리, 검색, 번역, 요약과 같이 빠른 처리 속도가 중요한 서비스에 적합합니다.
  • Gemini 3.5 Flash Cyber는 코드 보안 분석과 취약점 탐지 환경에서 활용할 수 있도록 설계되었습니다.

Gemini Flash 시리즈 제공 대상

이번에 발표된 모델은 다양한 환경에서 사용할 수 있습니다.

  • 개발자는 Gemini API, Google AI Studio, Android Studio에서 사용할 수 있습니다.
  • 기업은 Gemini Enterprise Agent Platform과 Gemini Enterprise 앱에서 활용할 수 있습니다.
  • 일반 사용자는 Gemini 앱을 통해 이용할 수 있으며, Gemini 3.5 Flash-Lite는 Google Search에도 순차적으로 적용될 예정입니다.

728x90

이번 Gemini Flash 시리즈 업데이트는 단순한 성능 향상이 아니라 AI 에이전트 운영 효율성을 크게 높이는 데 초점을 맞추고 있습니다.

Gemini 3.6 Flash는 더 적은 토큰으로 높은 품질의 결과를 제공하며, 비용과 성능을 동시에 개선한 주력 모델입니다. Gemini 3.5 Flash-Lite는 빠른 응답 속도와 높은 처리량을 바탕으로 대규모 AI 서비스에 적합한 선택지를 제공합니다. 또한 Gemini 3.5 Flash Cyber는 보안 취약점 탐지와 수정에 특화된 모델로, 전문적인 사이버 보안 환경을 지원합니다.

Google은 이와 함께 Gemini 3.5 Pro의 공개를 준비 중이며, 차세대 모델인 Gemini 4의 사전 학습도 진행하고 있다고 밝혔습니다. 앞으로 AI 에이전트 개발 환경은 더욱 빠르고 효율적인 방향으로 발전할 것으로 기대됩니다.

300x250

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/?fbclid=IwY2xjawTM7XlleHRuA2FlbQIxMABicmlkETE4RUk2eWFMUVlTM2hIMnIzc3J0YwZhcHBfaWQQMjIyMDM5MTc4ODIwMDg5MgABHnzCm9jkvj_xP260TLyTYMFOYJVw9WbcbplEBQp_oT7UCobHYUeU0oISHlnu_aem_Oj2fIA81BFMckLTv_XX77g

 

Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

We’re introducing new Gemini models, including Gemini 3.6 Flash, 3.5 Flash-Lite and 3.5 Flash Cyber.

blog.google

728x90
반응형
그리드형