모델 분석 · Google

Gemini 3.8 Flash성능·벤치마크·API 가격

제미나이 3.8 플래시의 low·medium·high 성능과 응답 시간, 예비 Arena 결과, 적용 기한이 있는 API 가격을 분석합니다.

제미나이 3.8 플래시 · 코딩하는 상인 분석 · 출처별 저장일은 아래 표에 표시

Artificial Analysis 최고 순위 설정

Gemini 3.8 Flash (high)2026. 09. 07. 저장 · 전체 27
지능 지수
47
평가 작업 비용
$0.74
첫 응답
11.32 초

코딩하는 상인의 해석

지연이 중요한 서비스에서 low와 high 중 무엇부터 시험할까?

Flash의 low와 high를 비교하면 점수 차이와 응답 시간 차이를 함께 볼 수 있습니다. medium의 지능 지수에는 원본의 별표가 있고 일부 작업 비용은 비어 있습니다. 표면상 같은 점수나 빠진 비용을 ‘동일 성능’ 또는 ‘무료’로 바꾸지 않습니다.

Gemini 3.8 Flash (low)Gemini 3.8 Flash (high)

지능 지수 차이
+6점
4147
평가 작업 비용 차이
계산할 수 없음
비용 미기록 또는 기준 비용 0으로 비율 계산 불가
첫 응답 시간 차이
+10.54초
첫 출력이 시작될 때까지
전체 응답 시간 차이
+10.44초
응답을 마칠 때까지

같은 2026. 09. 07. Artificial Analysis 스냅샷의 오른쪽 설정 값에서 왼쪽 설정 값을 뺀 결과입니다. 지능 지수의 점수 차이는 정확도 개선율이 아닙니다. 비용 비율만 기준 설정의 작업 비용으로 나눠 계산합니다.

이 두 설정을 직접 비교하기 →

low·medium의 평가 작업 비용은 미기록입니다. 공식 토큰 단가를 알고 있어도 평가 당시 사용 토큰을 모르므로 빈 비용을 채울 수 없습니다. 공식 가격의 적용 기한도 함께 표시합니다.

외부 기관이 측정한 공개 결과에 대한 2차 분석입니다. 코딩하는 상인이 직접 모델을 실행한 실험 결과는 포함하지 않았습니다.

원점수와 실행 조건

Gemini 3.8 Flash의 출처별 평가 결과

모델명·체크포인트·제공사를 확인한 항목만 모았습니다. 순위는 각 원본 전체의 순위이며, 출처가 다른 점수나 순위를 평균내지 않습니다. 빈 값과 별표, 신뢰구간은 원본 표기를 유지합니다.

종합·효율

Artificial Analysis

2026. 09. 07. 저장

성능뿐 아니라 비용과 대기시간까지 고려하면 어떤 모델이 유리한가?

Gemini 3.8 Flash, Artificial Analysis, 2026. 09. 07. 저장 결과
순위모델·실행 설정지능 지수평가 작업 비용출력 속도첫 응답전체 응답컨텍스트
27Gemini 3.8 Flash (high)추론 설정47$0.74281 t/s11.32 초13.10 초1M
30Gemini 3.8 Flash (medium)추론 설정47*--246 t/s8.29 초10.32 초1M
50Gemini 3.8 Flash (low)추론 설정41--265 t/s0.78 초2.66 초1M

영어 중심의 합성 지표이며 실제 한국어 업무 성능을 직접 보장하지 않습니다. 추론 강도별 결과는 같은 모델의 별도 실행 설정입니다.

대화 선호

Arena Text

2026. 09. 03. 저장

실제 사용자는 어떤 모델의 답변을 더 선호하는가?

Gemini 3.8 Flash, Arena Text, 2026. 09. 03. 저장 결과
순위모델·실행 설정Arena 점수투표 수API 가격컨텍스트
8gemini-3.8-flash-high예비1494 ±95,125$0.75 / $3.751M

사용자 구성과 프롬프트 분포에 영향을 받는 선호도 지표입니다. 특정 전문 업무의 정확도 순위로 해석하면 안 됩니다.

표의 API 가격 열은 이 평가사의 저장 당시 표기입니다. 검증한 공식 단가와 적용 조건은 아래 API 가격 영역에서 별도로 안내합니다.

코딩 선호

Arena Code

2026. 09. 07. 저장

코딩 대화에서 사용자가 더 만족한 모델은 무엇인가?

Gemini 3.8 Flash, Arena Code, 2026. 09. 07. 저장 결과
순위모델·실행 설정Code Arena 점수투표 수API 가격컨텍스트
21gemini-3.8-flash-high예비1567+12 / -122,727$0.75 / $3.751M

코드 실행 성공률만 측정하는 테스트가 아닙니다. 에이전트 하네스가 붙은 항목은 기본 모델과 동일하게 비교하면 안 됩니다.

표의 API 가격 열은 이 평가사의 저장 당시 표기입니다. 검증한 공식 단가와 적용 조건은 아래 API 가격 영역에서 별도로 안내합니다.

에이전트 실사용

Arena Agent

2026. 09. 07. 저장

실제 도구 사용 세션에서 끝까지 일을 잘 마친 모델은 무엇인가?

Gemini 3.8 Flash, Arena Agent, 2026. 09. 07. 저장 결과
순위모델·실행 설정순 개선도확인된 성공칭찬 대 불만Bash 복구도구 환각세션 수
17Gemini 3.8 Flash (High)5.47% ±1.92%10.42% ±4.42%14.25% ±6.25%3.72% ±1.14%-0.70% ±0.15%10,104

수치는 절대 성공률이 아니라 평균 모델 대비 변화(%p)입니다. 음수는 감소를 뜻하며 도구 환각은 낮을수록 좋습니다. 다른 벤치마크와 점수를 합산할 수 없습니다.

다른 출처에 결과가 없다는 사실은 0점이나 해당 기능 미지원의 근거가 아닙니다. 동일 모델인지 확인되지 않은 항목은 연결하지 않았습니다.

평가 작업 비용과 별개

Gemini 3.8 Flash 공식 API 가격

공식 API 모델 ID gemini-3.8-flash에 연결한 표준 텍스트 단가입니다. 캐시·도구·세금·웹 앱 구독료는 포함하지 않습니다. 과금되는 추론 토큰과 도구 사용량에 따라 청구액이 달라집니다.

입력 · 100만 토큰
$0.75
출력 · 100만 토큰
$3.75

유료 Standard, 2026-12-31까지 적용. 공식표의 2027-01-01 이후 단가는 입력 $1.50, 출력 $7.50입니다.

적용 기한: 2026-12-31. 이 기한이 지난 단가는 재확인 전까지 계산에 사용하지 않습니다.

공식 자료 확인일: 2026-09-07 · 가격 원문 ↗

검증된 단가로 API 예상 비용 계산하기 →

도입 전 판단

내 작업에서는 무엇을 확인해야 할까?

자동 완성이나 짧은 안내처럼 빠른 피드백이 중요한 기능은 low를 먼저 시험하고, 실패한 과제에서 high가 실제로 결과를 개선하는지 확인하세요. 대화·코딩 선호의 예비 표시는 투표가 더 쌓이면 순위가 달라질 수 있다는 점과 함께 읽어야 합니다.

한국어 업무에 적용할 때는 실제로 반복하는 과제를 고정하고 모델 ID, 추론 설정, 입력·출력, 오류, 응답 시간과 청구 토큰을 함께 기록하세요. 이 페이지의 종합 지능 지수는 한국어 업무의 정확도나 수익 개선을 직접 측정한 결과가 아닙니다.