본문 바로가기

IT & AI

제미나이 Flash 3종 공개, 속도·비용·보안으로 역할을 나눴어요

728x90

제미나이 Flash 3종 공개, 속도·비용·보안으로 역할을 나눴어요

AI 뉴스 썸네일
AI 뉴스 썸네일

구글이 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 함께 공개했어요. 하나의 모델로 모든 작업을 처리하기보다 품질과 처리량, 보안 작업에 맞는 모델을 골라 쓰는 구성이에요. 1

핵심 요약

모델맡은 역할확인할 점
Gemini 3.6 Flash코딩·지식 작업·멀티모달 처리3.5 Flash보다 출력 토큰을 17% 적게 썼다는 구글 측 측정치가 나왔어요
Gemini 3.5 Flash-Lite검색·문서 처리 같은 대량 작업초당 출력 토큰 350개와 낮은 단가를 앞세웠어요
Gemini 3.5 Flash Cyber취약점 탐지·검증·패치CodeMender 안에서 정부와 신뢰할 수 있는 파트너에게만 제한 제공해요

1. 제미나이 Flash가 용도별 3개 모델로 갈라졌어요

3.6 Flash는 에이전트 작업 비용을 줄이는 주력 모델이에요

Gemini 3.6 Flash는 코딩과 지식 작업, 이미지·문서 같은 멀티모달 입력을 다루는 주력 모델이에요. 구글은 Artificial Analysis Index에서 3.5 Flash보다 출력 토큰을 17% 적게 사용했다고 밝혔어요. DeepSWE 일부 측정에서는 토큰 사용량이 최대 65% 줄었다고 설명했어요. 입력 100만 토큰은 1.50달러, 출력 100만 토큰은 7.50달러로 책정됐어요. 2

에이전트 서비스는 한 번의 답변보다 여러 차례의 추론과 도구 호출에 비용이 쌓여요. 출력 토큰과 호출 횟수가 함께 줄면 같은 예산으로 더 많은 작업을 처리할 수 있어요. 구글이 공개한 수치는 자사 발표와 특정 벤치마크를 바탕으로 해요. 실제 비용은 입력 길이와 도구 구성, 재시도 횟수에 따라 달라질 수 있어요.

728x90

성능 수치도 함께 공개됐어요. DeepSWE는 49%로 3.5 Flash의 37%를 앞섰고, OSWorld-Verified는 83.0%로 78.4%보다 높았어요. 모델 비교가 필요하다면 점수만 보지 말고, 현재 서비스의 작업 성공률과 평균 토큰 수를 같은 조건에서 재는 편이 안전해요. 2

3.5 Flash-Lite는 대량 요청을 빠르게 처리해요

Gemini 3.5 Flash-Lite는 검색과 문서 처리, 번역·요약처럼 요청이 많이 들어오는 작업을 겨냥해요. Artificial Analysis 측정 기준 초당 출력 토큰은 350개예요. 가격은 입력 100만 토큰당 0.30달러, 출력 100만 토큰당 2.50달러예요. 2

사고 수준을 조절할 수 있어서 단순 작업은 지연 시간과 비용을 낮추고, 여러 단계를 거치는 작업에는 더 많은 추론을 배정할 수 있어요. 컴퓨터 사용 기능도 내장 도구로 제공해요. 고객 문의 분류나 영수증 처리처럼 건당 가치보다 처리량이 중요한 서비스에서 먼저 시험해 볼 만해요.

Flash Cyber는 CodeMender 안에서만 제한적으로 써요

Gemini 3.5 Flash Cyber는 코드 취약점을 찾고 검증한 뒤 패치하는 보안 특화 모델이에요. 여러 Flash Cyber 에이전트가 각각 분석한 결과를 CodeMender가 하나의 보고서로 합치는 구조예요. 구글은 이 구성이 CyberGym에서 최전선 모델과 경쟁할 만한 성능을 냈다고 밝혔어요. 2

보안 모델은 방어와 공격에 모두 쓰일 수 있어요. 그래서 일반 API로 바로 풀지 않아요. 정부와 신뢰할 수 있는 파트너를 대상으로 CodeMender 제한 접근 시범 프로그램에서 제공할 예정이에요. 보안 자동화 도입을 검토하는 팀이라면 모델 점수보다 수정 제안의 재현성, 사람이 승인하는 단계, 변경 기록이 남는지를 함께 봐야 해요.

지금 쓸 수 있는 범위가 서로 달라요

3.6 Flash와 3.5 Flash-Lite는 Gemini API, Google AI Studio, Android Studio에서 이용할 수 있어요. 기업용 Gemini Enterprise Agent Platform과 일반 Gemini 앱에도 들어가요. 3.6 Flash는 Google Antigravity에서도 제공되고, 3.5 Flash-Lite는 Google Search에 순차 적용돼요. Flash Cyber는 제한 접근 시범 프로그램이라 일반 개발자가 바로 선택할 수 없어요. 2

구글은 Gemini 3.5 Pro를 파트너와 시험하고 있어요. Gemini 4를 위한 사전 학습도 시작했다고 밝혔어요. 구체적인 공개 시점과 가격은 이번 발표에 담기지 않았어요.

왜 중요한가요

이번 발표는 모델 선택 기준을 더 구체적으로 만들어요. 복잡한 코딩과 문서 분석은 3.6 Flash, 대량 검색과 분류는 3.5 Flash-Lite처럼 한 서비스 안에서도 작업별 라우팅을 구성할 수 있어요. 모든 요청을 가장 비싼 모델로 보내지 않아도 돼서 지연 시간과 비용을 함께 관리하기 쉬워져요. 2

도입 전에는 실제 요청 표본으로 비교해야 해요. 작업 성공률, 요청당 입력·출력 토큰, 응답 시간, 도구 호출 실패율을 같은 조건에서 기록해 보세요. 보안 작업은 자동 패치 비율보다 잘못된 수정이 배포되지 않도록 승인과 감사 기록을 갖추는 일이 먼저예요.

참고 자료

  1. 구글 제미나이 새 모델 3종 출시 — GeekNews
  2. Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber — Google
728x90