모델군 비교

GPT·Claude·Gemini 비교: 성능·가격·속도

서로 다른 회사의 홍보 점수를 섞지 않고, 같은 Artificial Analysis 공개 평가에 올라온 각 모델군의 최고 순위 항목만 비교합니다.

데이터 갱신 2026년 9월 7일 오전 10:22

한눈에 보기

지금 수치로 보는 빠른 답

지능 지수

Claude

Claude Fable 5.1 (max with fallback)

공개 종합 지능 평가에서 가장 높은 항목

작업 비용

Gemini

Gemini 3.8 Flash (high)

동일 평가 작업을 완료하는 비용이 가장 낮은 항목

출력 속도

Gemini

Gemini 3.8 Flash (high)

초당 출력 토큰 수가 가장 높은 항목

빠른 답은 현재 비교 대상 세 항목 안에서만 고른 결과입니다. 지능, 비용, 속도는 서로 다른 판단 기준이며 하나의 승자를 뜻하지 않습니다.

최고 점수 대신 내 성능 기준으로 비용을 비교하려면 →

같은 기준 비교

GPT vs Claude vs Gemini 벤치마크 표

Artificial Analysis 원본 ↗
모델군·대표 항목종합 순위지능 지수작업 비용출력 속도첫 응답컨텍스트
Claude Claude Fable 5.1 (max with fallback)Anthropic157$6.1268 t/s272.30 초1M
GPT GPT-6 Astra (max)OpenAI355$2.5764 t/s354.72 초1M
Gemini Gemini 3.8 Flash (high)Google2747$0.74281 t/s11.32 초1M

표 읽는 법

어떤 수치를 먼저 봐야 하나요?

  • 복잡한 추론·분석: 지능 지수를 먼저 보고 비용과 전체 응답 시간을 함께 확인합니다.
  • 대량 자동화: 작업 비용과 출력 속도를 우선하고 필요한 정확도 수준을 정합니다.
  • 대화형 제품: 첫 응답 시간과 별도의 Arena 사용자 선호 순위를 함께 봅니다.

해석할 때 주의

이 표만으로 모델을 고르면 안 되는 이유

영어 중심의 합성 지표이며 실제 한국어 업무 성능을 직접 보장하지 않습니다. 추론 강도별 결과는 같은 모델의 별도 실행 설정입니다.

한국어 문체, 사내 데이터, 도구 호출, 안전 정책 같은 실제 환경은 별도 테스트가 필요합니다. 추론 강도가 다른 항목의 비용과 지연도 그대로 비교해 판단하세요.