/ 뉴스 / 가격은 그대로지만 작업당 비용 40% 증가한 Gemini 3.8 Flash
Gemini

가격은 그대로지만 작업당 비용 40% 증가한 Gemini 3.8 Flash

2026년 9월 3일5 분 소요
가격은 그대로지만 작업당 비용 40% 증가한 Gemini 3.8 Flash

뉴스 요약

구글은 2026년 9월 2일 Gemini 3.8 Flash를 출시하며, 이를 요청마다 의도적으로 더 많은 연산을 수행해 소프트웨어 엔지니어링 및 다단계 추론 작업을 처리하도록 설계된 역대 가장 강력한 "실무형" 모델로 소개했습니다. 이와 함께 구글은 신뢰할 수 있는 정부 및 인프라 파트너를 대상으로 자동화된 취약점 발견 및 패치를 목표로 하는 특화 파생 모델 Gemini 3.8 Flash Cyber도 공개했습니다. 이번 출시는 약 4개월 만의 네 번째 Flash 등급 출시로, 경쟁사들이 계속 경쟁력 있는 시스템을 내놓는 가운데 구글이 개발자와 기업 고객에게 자사의 모델 출시 주기가 여전히 안정적임을 안심시키기 위한 행보로 풀이됩니다.

"더 열심히 일한다"는 것의 실제 의미

구글의 설명은 의도적인 설계 선택에 초점을 맞추고 있습니다. 순수하게 속도나 최소한의 토큰 사용량만을 최적화하는 대신, Gemini 3.8 Flash는 작업이 요구할 때 추가적인 추론 단계를 실행하고 외부 도구를 반복적으로 호출하도록 조정되었습니다. 높은 "노력" 설정에서는 모델이 더 철저하거나 정확한 답변을 얻기 위해 더 많은 토큰을 소모하는데, 구글은 이러한 절충안이 단순한 벤치마크 점수가 아닌 실제 작업 완료율을 높여준다고 설명합니다. 개발자는 지연 시간이나 비용에 민감한 워크로드의 경우 낮은 노력 수준을 선택해 이러한 동작을 줄이거나, 효율성을 최우선으로 하는 사용 사례에 대해 구글이 전폭적으로 지원한다고 밝힌 기존 Gemini 3.7 Flash 모델을 계속 사용할 수 있습니다.

가격 정책과 숨겨진 비용 증가

명목상 Gemini 3.8 Flash는 이전 버전과 동일한 초기 토큰당 가격으로 출시되었습니다. 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러이며, 이는 미국 동부 시간 기준 2026년 12월 31일까지 적용되고 이후 2027년 1월부터 표준 가격이 각각 1.50달러와 7.50달러로 인상됩니다. 그러나 이 모델이 자율 에이전트로 작동할 때 더 많은 출력 토큰을 생성하고 더 많은 대화 턴을 거치는 경향이 있어, 모델을 테스트한 여러 매체는 실제 작업 비용이 이전 Flash 모델보다 약 40% 더 높다고 추정합니다. 이는 주로 추가 추론으로 인해 작업당 출력 토큰이 거의 30% 더 많이 소모되기 때문입니다. 결과적으로 표시 가격은 그대로 유지되었지만, 모델이 목표 달성을 위해 더 많은 작업을 수행하고 그에 대해 과금하므로 특정 작업의 총 청구액은 늘어날 수 있습니다.

벤치마크 성능

구글은 Gemini 3.8 Flash가 DeepSWE v1.1 소프트웨어 엔지니어링 벤치마크에서 여러 대형 프론티어 모델보다 뛰어난 성능을 보이면서도 구동 비용은 그 일부에 불과하다고 밝혔으며, STEM, 인문학, 전문 추론 작업을 아우르는 벤치마크인 HLE-Verified에서 54.9%의 점수를 기록했다고 덧붙였습니다. Artificial Analysis의 독립적인 평가에 따르면, 이 모델은 고추론 모드로 실행했을 때 지능 지수(Intelligence Index) 59점을 기록해 이전 Flash 버전보다 3점 상승했으며, 이는 경쟁 연구소들이 최근 출시한 다른 중형 프론티어 모델들과 같은 등급에 해당하지만 해당 지수에서 최상위권에 있는 플래그십 모델들에는 여전히 미치지 못합니다. 비용 효율성 측면에서 Artificial Analysis는 Gemini 3.8 Flash의 지능 지수 작업당 비용을 약 0.58달러로 산출했으며, 이는 해당 기관이 추적하는 모델 중 동급 성능대에서 가장 저렴한 옵션 중 하나입니다.

사이버 보안 파생 모델

정부 및 핵심 인프라 파트너를 위한 구글의 Fairwind Program을 통해 신뢰할 수 있는 테스터들에게 제공되는 Gemini 3.8 Flash Cyber는 취약점 탐지 및 자동 패치 생성에 특화되어 있습니다. 구글은 이 모델이 취약점 발견 벤치마크인 CyberGym에서 이전 버전을 능가했으며, 약 20개의 프로그래밍 언어에 걸쳐 실제 취약점을 식별하는 데 70% 이상의 성공률을 보였고, CWE-Bench 패치 생성 벤치마크에서는 47.2%의 통과율을 기록하면서 유사한 상용 도구보다 훨씬 낮은 구동 비용을 달성했다고 보고했습니다. 구글은 또한 자체 Chrome Security 팀의 피드백을 인용했는데, 해당 팀은 Cyber 모델이 기존에 사용하던 최고의 상용 대안보다 2.6배 더 많은 올바른 패치를 생성했다고 보고했습니다.

가용성 및 배포

Gemini 3.8 Flash는 개발자 및 소비자 대상 구글 플랫폼 전반에 순차적으로 배포되고 있습니다. 여기에는 개발자를 위한 Google AI Studio, Android Studio, Google Antigravity 코딩 환경, 기업 고객을 위한 Gemini Enterprise, 그리고 소비자용 Gemini 앱, Google Search의 AI Mode, Google AI Pro 및 Ultra 구독자를 위한 Google Sheets 내 Gemini가 포함됩니다. Cyber 파생 모델은 현재 Fairwind Program 참가자로 제한되어 있으며, 더 넓은 범위의 제공 시점은 아직 발표되지 않았습니다.

출시 주기가 중요한 이유

업계 관찰자들은 이번 출시가 불과 몇 주 만에 이루어진 구글의 세 번째 또는 네 번째 Flash 등급 모델 출시라는 점에 주목합니다. 일부에서는 이러한 속도를 다른 주요 AI 연구소들의 빠른 출시 속도에 보조를 맞추고, 최근 내부 리더십 변화 이후에도 구글 딥마인드의 모델 로드맵이 연속성을 유지하고 있음을 보여주기 위한 노력으로 해석합니다. 구글은 올해 초 더 큰 규모의 Gemini 3.5 Pro 출시를 예고했지만 아직 실현되지 않았으며, 소규모 Flash 업데이트의 꾸준한 주기는 부분적으로 그 대규모 출시가 보류된 상태에서 Gemini의 개발자 및 기업 생태계의 관심을 유지하기 위한 것으로 보입니다.

Gemini구글 AI