제미나이 3.8 플래시 출시…코딩 강화, 현재 API 가격은 연말까지
제미나이 3.8 플래시가 일반 제공에 들어갔다. 코딩 평가 점수는 올랐지만 과제 비용도 증가했다. 연말까지 유지되는 도입 가격과 제한 제공되는 Flash Cyber의 차이를 짚었다.
읽는 시간 약 8분
AI는 자료 조사와 초안 정리에 보조적으로 사용했으며, 편집부가 출처와 사실을 확인했습니다.
구글이 2026년 9월 2일 ‘제미나이 3.8 플래시(Gemini 3.8 Flash)’와 보안 특화 모델 ‘3.8 플래시 사이버(Flash Cyber)’를 발표했다. 범용 Flash는 일반 제공(GA)에 들어갔고, Cyber는 승인된 보안 파트너에게 제한적으로 제공된다. 공식 출시 발표와 Gemini API 릴리스 노트에서 확인되는 이번 출시 대상은 두 Flash 모델이다.
직전 3.7 플래시 출시 이후 약 3주 만의 업데이트다. 구글은 코딩과 장기 에이전트 작업의 성능을 높이면서 3.7의 도입 가격을 유지했다. 다만 이 가격은 올해 말까지다. 외부 평가에서도 성능 개선이 확인되지만, 더 많은 토큰을 쓰면서 과제당 비용이 늘어난 결과가 함께 나왔다.
일반 Flash는 GA, 앱과 API의 이용 조건은 다르다
API 모델 문서에 적힌 모델 ID는 gemini-3.8-flash다. 입력 한도는 1,048,576토큰, 출력 한도는 65,536토큰이다. 텍스트·이미지·동영상·오디오·PDF를 입력받지만 출력은 텍스트다. 이미지나 음성을 생성하는 전용 모델과는 구분해야 한다.
구글은 Google AI Pro·Ultra 구독자에게 Gemini 앱, 검색 AI Mode, Google Sheets를 통한 제공을 안내했다. 개발자는 Gemini API와 AI Studio, Antigravity 등에서 접근할 수 있다. 앱의 유료 구독 조건을 API에 그대로 적용하면 안 된다. API 가격표에는 별도의 무료 사용 구간도 있으며, 무료·유료 구간은 이용 데이터의 제품 개선 사용 여부가 다르다.
AI Studio·Gemini API 제공 국가에는 한국이 포함돼 있다. 다만 서비스 제공 국가 목록이 한국 내 데이터 처리나 모든 계정의 즉시 노출을 보장하는 것은 아니다. 이번 조사에서는 한국 계정의 실제 모델 선택 화면까지 확인하지 않았다.
장기 코딩 평가에서 개선, 과제당 비용도 함께 확인해야
9월 3일 확인한 Datacurve의 DeepSWE v1.1 공개 결과에서는 3.8 Flash가 3.7 Flash보다 높은 해결률을 기록했다. 두 모델 모두 high 설정이며, 113개 과제에 공통 실행 도구인 mini-swe-agent를 사용한 평가다.
| DeepSWE v1.1 공개판 | Gemini 3.7 Flash high | Gemini 3.8 Flash high |
|---|---|---|
| 표시 해결률·오차범위 | 65% ±2%p | 74% ±1%p |
| 평균 과제 비용 | 2.18달러 | 2.36달러 |
해결률은 올라갔지만 비용이 내려간 결과는 아니다. 평가 방법론에 따르면 제출된 커밋의 패치를 별도 컨테이너에서 검증한다. 이 수치는 해당 코딩 과제와 실행 환경의 결과이며, 모든 저장소에서 같은 성공률을 기대할 근거는 아니다.
Artificial Analysis의 9월 2일 분석에서도 high의 Intelligence Index는 3.7의 56에서 3.8의 59로 올랐다. 반면 지수를 구성하는 과제당 비용은 0.40달러에서 0.58달러로 늘었다. 해당 평가는 평균 출력 토큰이 약 30% 증가하고 에이전트의 반복 작업도 늘어난 점을 함께 짚었다.
두 평가의 달러 값을 서로 비교해 어느 쪽 작업이 더 경제적인지 판단할 수는 없다. 과제와 집계 방식이 다르기 때문이다. 각 평가 안에서 읽을 수 있는 공통점은 코딩·추론 성능 향상과 작업 비용 절감이 같은 말은 아니라는 것이다.
현재 API 단가는 연말까지, 내년 표준 단가는 두 배
아래는 Gemini Developer API 가격표에 공지된 Standard 유료 요금이다. Gemini 앱 구독료나 Flash Cyber의 요금표가 아니다.
| 100만 토큰당 요금 | 2026년 12월 31일까지 | 2027년 1월 1일부터 |
|---|---|---|
| 입력 | 0.75달러 | 1.50달러 |
| 출력·thinking 토큰 | 3.75달러 | 7.50달러 |
현재는 3.7 Flash와 같은 도입 가격이지만, 공지된 내년 단가는 두 배다. 예를 들어 입력 1,000만 토큰과 출력 200만 토큰을 쓰면 기본 토큰 비용은 현재 15달러, 내년에는 30달러다. 캐시·도구 호출·별도 할인·세금은 제외한 단순 계산이다.
기업용 경로는 가격 범위도 따로 봐야 한다. Google Cloud 가격표의 Non-global 요금은 Global보다 10% 높다. 따라서 앱 구독, Developer API, Cloud의 특정 엔드포인트를 하나의 ‘제미나이 가격’으로 묶으면 실제 청구액과 어긋날 수 있다.
Flash Cyber는 Fairwind 승인 조직에 제한 제공
Flash Cyber는 취약점 탐지와 패치 작업에 초점을 맞춘 별도 모델이다. Fairwind 공식 안내는 정부·국가 사이버 기관, 주요 인프라와 핵심 기술 플랫폼 등을 우선 대상으로 제시한다. 일반 Flash의 GA 출시를 Cyber까지 누구나 호출할 수 있다는 뜻으로 읽어서는 안 된다.
구글은 Cyber에 사이버보안 작업을 위한 더 유연한 안전 조치를 적용하되, 승인된 방어·연구 용도로 접근을 제한한다. 프로그램 발표는 CodeMender와 결합해 취약점을 찾고 검증하고 수정하는 사용 방식을 설명한다. 이번 조사에서는 Cyber의 공개 Gemini API 모델 ID나 별도 공개 요금표를 확인하지 못했으므로, 일반 Flash 단가를 Cyber에 대입하지 않았다.
이전할 때는 thinking 설정과 작업당 사용량부터 비교
최신 모델 가이드는 복잡한 장기 작업에서 추론 단계와 도구 호출, 검증이 늘면서 토큰 사용량도 커질 수 있다고 설명한다. 기존 연동을 옮길 때는 다음 항목을 확인할 필요가 있다.
- thinking은
low·medium·high를 지원하며 기본값은medium이다.minimal은 지원하지 않는다. 이는 3.7에도 있던 제한이지 3.8에서 처음 생긴 변경은 아니다. - 오래된 연동은
thinking_budget에서thinking_level로 옮기는 지침과 폐기된 파라미터를 확인해야 한다. Cloud 개발자 가이드는temperature·top_p·top_k는 무시되지만candidate_count등 일부 필드는 오류를 낸다고 구분한다. - 도구 호출을 직접 관리한다면 함수 응답의 ID·이름·개수가 앞선 호출과 맞는지 점검해야 한다. 기본적인 연동 구조는 스트리밍·JSON·도구 호출 API 예제를 참고하되, 3.8의 지원 조건은 최신 문서로 다시 대조하는 편이 좋다.
모델 카드는 환각과 간헐적인 지연·타임아웃, 높은 effort에서의 토큰 증가를 여전히 한계로 적고 있다. 이번 기사는 공개 문서와 외부 평가를 대조했으며, 한국어 품질이나 실제 API 지연·청구액을 직접 시험한 결과는 아니다.
3.7을 쓰는 팀이라면 실패했던 코딩 과제를 같은 조건으로 다시 실행해 볼 만한 출시다. medium과 high에서 성공률, 출력·추론 토큰, 도구 호출 수를 함께 기록하면 성능 향상이 추가 비용을 감수할 정도인지 판단할 수 있다. 장기 운영 예산에는 연말 도입 가격의 종료일도 함께 넣어야 한다.
참고한 출처
공식 출처와 보조 신호를 함께 확인했습니다. 전체 15개 중 공식 출처는 12개입니다.
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber(새 창)공식Google
- Gemini API release notes(새 창)공식Google AI for Developers
- Gemini 3.8 Flash model(새 창)공식Google AI for Developers
- Gemini API pricing(새 창)공식Google AI for Developers
- Available regions(새 창)공식Google AI for Developers
- Gemini thinking(새 창)공식Google AI for Developers
- Gemini 3.8 Flash developer guide(새 창)공식Google Cloud
- Gemini 3.8 Flash model card(새 창)공식Google DeepMind
- Agent Platform pricing(새 창)공식Google Cloud
- Fairwind Program(새 창)공식Google DeepMind
- Google's Fairwind Program(새 창)공식Google
- Latest Gemini model guide(새 창)공식Google AI for Developers
- DeepSWE v1.1 leaderboard(새 창)보조Datacurve
- DeepSWE v1.1 methodology(새 창)보조Datacurve
- Gemini 3.8 Flash analysis(새 창)보조Artificial Analysis