종합·효율
Artificial Analysis
| 모델군 | 대표 항목 | 순위 | 지능 |
|---|---|---|---|
| Grok | Grok 4.6 (high) | 6위 | 61 |
| Gemini | Gemini 3.7 Flash (high) | 15위 | 56 |
같은 출처로 비교
현재 AA 대표: Grok 4.6 (high) · Gemini 3.7 Flash (high)
그록과 제미나이는 대화, 코드, 이미지, 도구 사용에서 순위가 서로 다를 수 있습니다. 한 줄 승자 대신 실제 사용 목적과 가까운 독립 평가를 골라 읽습니다.
데이터 갱신 2026년 8월 17일
주요 수치 · 같은 실행 기준
아래 세 수치는 Artificial Analysis의 동일한 두 대표 항목입니다. 서로 다른 평가의 점수를 섞지 않으며 종합 승자를 정하지 않습니다.
| 기준 | Grok | Gemini |
|---|---|---|
| 지능 지수 | 61 | 56 |
| 평가 작업 비용 | $0.84 | $0.40 |
| 출력 속도 | 58 t/s | — |
출처별 비교
종합·효율
| 모델군 | 대표 항목 | 순위 | 지능 |
|---|---|---|---|
| Grok | Grok 4.6 (high) | 6위 | 61 |
| Gemini | Gemini 3.7 Flash (high) | 15위 | 56 |
대화 선호
| 모델군 | 대표 항목 | 순위 | 점수 |
|---|---|---|---|
| Grok | grok-4.20-beta1 | 24위 | 1475 ±5 |
| Gemini | gemini-3.7-flash-high | 9위 | 1490 ±8 |
코딩 선호
| 모델군 | 대표 항목 | 순위 | 점수 |
|---|---|---|---|
| Grok | grok-4.6-high | 5위 | 1631+17 / -17 |
| Gemini | gemini-3.7-flash-high | 8위 | 1587+13 / -13 |
에이전트 실사용
| 모델군 | 대표 항목 | 순위 | 순 개선 |
|---|---|---|---|
| Grok | Grok 4.5 | 16위 | 6.19% ±1.20% |
| Gemini | Gemini 3.7 Flash (High) | 21위 | 3.61% ±1.22% |
이미지 이해
| 모델군 | 대표 항목 | 순위 | 점수 |
|---|---|---|---|
| Grok | grok-4.5 | 13위 | 1285 ±11 |
| Gemini | gemini-3.6-flash-high | 7위 | 1295 ±18 |
어떤 표를 볼까요?
평가 방법과 한계
모델명 정규식으로 각 공개 소스에서 모델군별 최고 순위 항목 하나를 고릅니다. 양쪽 항목이 모두 있는 소스만 표시하고, 소스 사이 순위와 점수는 합산하지 않습니다.
추론 강도가 표시된 항목은 같은 모델의 별도 실행 설정입니다. 이름이 비슷해도 high·medium 같은 설정을 지우거나 평균내지 않습니다.