Gemini 3.8 Flash vs DeepSeek V4 Flash: 59 대 52, 비용은 2.6배
Artificial Analysis에서 Gemini 3.8 Flash는 59점, DeepSeek V4 Flash는 52점. 같은 인덱스를 돌리는 데 $826 대 $323이 들었습니다. 가격, 속도, 그리고 각자가 이기는 조건.
Gemini 3.8 Flash는 Artificial Analysis Intelligence Index에서 effort high로 59점, DeepSeek V4 Flash 0731은 52점입니다. 같은 인덱스를 돌리는 데 Gemini 3.8 Flash는 $825.83, DeepSeek은 $323.26이 들었습니다. 7점 차이에 비용은 2.6배입니다. low effort에서는 Gemini가 DeepSeek과 52점으로 동점이 되지만, 그 지점의 AA 작업당 비용은 $0.24 대 DeepSeek의 $0.11입니다.
Google은 2026년 9월 2일 3.7 Flash와 같은 가격으로 Gemini 3.8 Flash를 출시했고, Artificial Analysis는 이를 “그 지능 수준에서 가장 저렴한 모델”이라 불렀습니다. 대부분이 옆에 놓고 비교할 모델은 DeepSeek V4 Flash 0731입니다. 같은 체급에서 토큰 단가가 가장 낮기 때문입니다. 두 말은 모두 맞습니다. 다만 서로 다른 질문에 대한 답이고, 이 글은 둘을 분리해서 다룹니다.
요약: 무엇을 고를까
- 7점이 더 필요하면 Gemini 3.8 Flash. effort high에서 Artificial Analysis Intelligence Index 59점. DeepSeek의 현재 라인업은 최고 53점입니다. 이미지, 오디오, 파일도 받고 출력 속도는 초당 약 302 토큰입니다.
- 52점으로 충분하면 DeepSeek V4 Flash 0731. 같은 점수에서 AA 작업당 비용은 DeepSeek이 피크 요금으로 $0.11, Gemini 3.8 Flash low effort가 $0.24이며, 비피크에서는 DeepSeek이 다시 절반입니다. 대신 출력은 약 2.2배 느리고 입력은 텍스트만 됩니다.
- 정가를 비교하지 마세요. 인덱스를 완주하는 데 DeepSeek은 2억 1천만 출력 토큰을 썼고 Gemini 3.8 Flash는 1억 2천만을 썼습니다. 토큰 단가는 청구서의 작은 절반입니다.
- 2027년 1월 1일을 주시하세요. 그날 Gemini 3.8 Flash는 $1.50 / $7.50으로 두 배가 됩니다. 아래 Gemini 숫자는 모두 2026년 숫자로 읽어야 합니다.
Google이 Gemini 3.8 Flash에서 바꾼 것
Gemini 3.8 Flash는 Google이 6주 안에 내놓은 세 번째 Flash입니다. 7월 21일 3.6 Flash, 8월 13일 3.7 Flash, 그리고 이번입니다. 토큰 단가는 움직이지 않았습니다. 100만 토큰당 입력 $0.75, 출력 $3.75로 3.7 Flash와 같은 출시 기념 요금이며 2026년 12월 31일에 만료됩니다.
움직인 것은 모델이 얼마나 쓰는가입니다. Google 발표문은 이례적으로 직설적입니다(이하 인용은 번역). “3.8 Flash는 더 열심히 일합니다. 복잡한 작업에서 더 큰 성실함을 보이며 추가 추론 단계를 실행하고 도구를 반복적으로 호출합니다. 때로는, 특히 높은 effort 수준에서는 성능을 극대화하기 위해 더 많은 토큰을 쓸 수 있습니다.” 효율 우선 워크로드에 대한 Google의 조언은 effort 수준을 낮추거나 “계속 완전히 지원되는 Gemini 3.7 Flash에 계속 의존하는 것”입니다.
같은 출시에서 Gemini 3.8 Flash Cyber도 나왔습니다. 취약점 탐지용 변종으로 Google의 Fairwind Program 참여자에게만 제공됩니다. 범용 API 모델이 아니므로 여기서는 비교하지 않습니다.
스펙 한눈에 보기
| 항목 | Gemini 3.8 Flash | DeepSeek V4 Flash 0731 |
|---|---|---|
| 출시 | 2026-09-02 | 2026-07-31 |
| 컨텍스트 윈도우 | 1M 토큰 | 1M 토큰 |
| 최대 출력 | 64K 토큰 | 384K 토큰 |
| 입력 모달리티 | 텍스트, 이미지, 오디오, 비디오, 파일 | 텍스트만 |
| 추론 제어 | low / medium(기본) / high, minimal은 오류 | thinking 켬(기본) / 끔, effort는 low / high / max |
| 가중치 | 비공개 | 공개(MIT) |
| AA Intelligence Index | 59 high / 57 medium / 52 low | 52 max effort |
| AA 출력 속도 | 약 302 토큰/초 | 약 138 토큰/초 |
| AA 인덱스 완주 출력 토큰 | 1억 2천만 | 2억 1천만 |
| AA 인덱스 완주 비용 | $825.83 | $323.26 |
Intelligence Index, 토큰, 비용 수치는 2026년 9월 3일 기준 Artificial Analysis 자료입니다. DeepSeek의 비전 지원 빌드 deepseek-v4-flash-vision-exp는 별개 모델이며 이 표의 대상이 아닙니다.
Artificial Analysis의 Gemini 3.8 Flash: 59 대 52, 그리고 천장
Gemini 3.8 Flash는 Artificial Analysis Intelligence Index에서 DeepSeek V4 Flash 0731을 7점 앞섭니다(59 대 52). 단, effort high에서만 그렇습니다. Artificial Analysis는 모델과 추론 수준마다 종합 점수 하나를 공개합니다. 주변은 이렇습니다.
| 모델 | AA Intelligence Index |
|---|---|
| Gemini 3.8 Flash(high) | 59 |
| Gemini 3.8 Flash(medium, 기본) | 57 |
| Gemini 3.7 Flash(high) | 56 |
| DeepSeek V4 Pro 0813(max) | 53 |
| Gemini 3.8 Flash(low) | 52 |
| DeepSeek V4 Flash 0731(max) | 52 |
| Gemini 3.6 Flash(high) | 52 |
이 표에서 두 가지가 읽힙니다.
첫째, 제목의 7점 차이는 effort high에서만 존재합니다. 기본값인 medium으로 배포하면 차이는 5점. low까지 내리면 두 모델은 52점으로 동점입니다.
둘째, 차이보다 천장이 더 중요합니다. DeepSeek V4 Flash 0731의 52점은 DeepSeek 자체 플래그십 V4 Pro 0813의 53점보다 1점 낮을 뿐입니다. 작업에 57점이나 59점이 필요하면 손 뻗을 DeepSeek 모델이 없습니다. 이 비교는 52점 이하에서만 성립합니다.
출력 토큰: DeepSeek V4 Flash 2억 1천만 대 Gemini 3.8 Flash 1억 2천만
DeepSeek V4 Flash 0731은 Artificial Analysis 인덱스를 완주하는 데 2억 1천만 출력 토큰을 썼고, Gemini 3.8 Flash(high)는 1억 2천만을 썼습니다. DeepSeek이 1.75배 씁니다. Artificial Analysis는 각 모델이 인덱스 완주에 쓴 출력 토큰 수를 기록합니다. Gemini 3.8 Flash(high)의 1억 2천만은 비교 가능 모델 중앙값 7,100만에 비해 “매우 장황하다”고 AA가 표시합니다. DeepSeek V4 Flash 0731의 2억 1천만은 “비슷한 크기의 다른 오픈 웨이트 모델 중 높은 편(중앙값: 1억 1천만)“입니다.
둘 다 말이 많지만 DeepSeek은 그 1.75배이고, 그 토큰은 전부 출력 요금으로 청구됩니다. 속도가 이를 더 악화시킵니다. 초당 138 토큰인 DeepSeek은 같은 수의 토큰을 뽑는 데 Gemini 3.8 Flash의 약 2.2배 시간이 걸리고, 게다가 더 많이 뽑습니다.
3.8 Flash만 보면, AA는 작업당 평균 출력 토큰이 3.7 Flash 대비 30% 늘어 4만 8천이 됐고, high effort 작업당 비용이 $0.40에서 $0.58로 올랐다고 측정했습니다. 같은 가격표에 청구액은 약 45% 증가(AA의 반올림으로는 약 40%). Google이 경고한 숫자가 이것입니다.
Gemini 3.8 Flash 가격 vs DeepSeek V4 Flash 가격: 정가, 그다음 청구서
먼저 정가. 100만 토큰당 달러입니다.
| $ / 1M 토큰 | Gemini 3.8 Flash(2026-12-31까지) | Gemini 3.8 Flash(2027-01-01부터) | DeepSeek V4 Flash 피크 | DeepSeek V4 Flash 비피크 |
|---|---|---|---|---|
| 입력 | 0.75 | 1.50 | 0.44 | 0.22 |
| 캐시 입력 | 0.075 | 0.15 | 0.014 | 0.007 |
| 출력 | 3.75 | 7.50 | 1.32 | 0.66 |
DeepSeek의 피크 시간대는 월요일부터 금요일 UTC 01:0004:00와 06:0010:00입니다. 그 외는 모두 비피크로 정확히 절반입니다. 이 구간은 평일 하루 7시간이라 일정을 잡을 수 있는 배치 작업은 피크 열을 거의 내지 않습니다. 이 요금은 DeepSeek의 2026년 8월 13일 변경 로그에서 공지되어 8월 16일 16:00 UTC에 발효됐으며, DeepSeek은 “피크/비피크 요금제를 채택하고 비피크 가격은 피크 시간대 가격의 절반으로 설정한다”고 밝혔습니다. 그 전 V4 Flash는 입력 $0.14, 출력 $0.28이었으므로 비피크 열조차 출시 가격의 1.6~2.4배입니다.
이제 청구서. Artificial Analysis가 Intelligence Index 전체를 돌리는 데 Gemini 3.8 Flash(high)는 $825.83, DeepSeek V4 Flash 0731은 피크 요금 $0.44 / $1.32 기준 $323.26이 들었습니다. 같은 작업 세트에서 7점에 2.6배 차이입니다.
AA는 인덱스 총액과 별도로 작업당 비용(Cost per Task)도 공개합니다. Gemini 3.8 Flash는 high $0.58, medium $0.41, low $0.24, DeepSeek V4 Flash 0731은 피크 요금 $0.44 / $1.32에서 $0.11입니다. 비피크는 DeepSeek의 모든 줄을 절반으로 만드니 약 $0.055. 이 마지막 숫자는 우리 계산이고 AA가 인쇄한 숫자가 아닙니다. AA의 두 지표는 배율이 일치하지 않습니다. 인덱스 총액으로는 2.6배, 작업당 비용으로는 5.3배입니다. 워크로드 전체 총액이든 호출당 평균이든, 자기 구매 방식에 맞는 쪽을 인용하세요.
52점 모델을 나란히 놓으면 이렇습니다.
| AA 점수 52 | 작업당 비용 |
|---|---|
| Gemini 3.8 Flash(low) | $0.24 |
| DeepSeek V4 Flash 0731, 피크 또는 피크 고정 호스트 | $0.11(AA) |
| DeepSeek V4 Flash 0731, 비피크 | 약 $0.055(추산) |
같은 지능에서 DeepSeek은 피크 요금으로도 작업당 약 절반, 비피크에서는 약 4분의 1입니다. Gemini 3.8 Flash low effort가 추가 $0.13으로 사는 것은 약 2.2배 빠른 출력과 이미지, 오디오, 비디오, 파일 입력입니다.
캐싱과 2027년 가격 인상
캐싱. Gemini 3.8 Flash는 캐시 입력을 $0.075에 읽습니다. 신규 입력의 10분의 1입니다. DeepSeek은 캐시 히트를 피크 $0.014에 읽고, 미스의 31분의 1입니다. 프롬프트가 긴 공통 접두사를 공유하면 DeepSeek의 캐시가 두 가격표 중 가장 싼 입력 토큰입니다. 공유하지 않으면 이 열은 무관합니다.
2027년 절벽. 2027년 1월 1일 Gemini 3.8 Flash 요금이 두 배가 되므로, 토큰 수가 그대로라면 $0.58 / $0.41 / $0.24의 작업당 비용은 대략 $1.16 / $0.82 / $0.48이 됩니다. DeepSeek 요금 페이지가 약속하는 것은 “제품 가격은 변동될 수 있으며 DeepSeek은 조정 권리를 보유한다”는 한 문장뿐입니다. 12개월 비용 모델에는 이 두 줄이 모두 필요합니다.
Gemini 3.8 Flash를 고를 때
- 작업에 53점 이상이 필요하다. 그 선 위에는 DeepSeek 선택지가 없다.
- 입력에 이미지, 오디오, 비디오, PDF가 있다.
- 지연이 중요하다. 초당 약 302 토큰, AA 작업당 시간은 low 0.8분, high 2.5분.
- 트래픽을 UTC 7시간 구간에 맞춰 조정할 수 없다.
DeepSeek V4 Flash 0731을 고를 때
- 52점으로 충분하고 비피크에 돌릴 수 있거나, 프롬프트가 긴 캐시 접두사를 공유한다.
- 한 번 호출에 384K 출력 토큰이 필요하다.
- 나중에 직접 호스팅할 수 있는 오픈 웨이트가 필요하다.
- 텍스트만으로 충분하다. 비전 빌드는 별개의 실험 모델이다.
둘 다 답이 아닐 때
이미 Gemini 3.7 Flash를 쓰고 있고 일이 되고 있다면 Google 스스로 남으라고 합니다. 3.7 Flash는 AA 작업당 $0.40에 56점, 3.8 Flash medium은 $0.41에 57점입니다. 그 1점은 거의 무료지만 59점을 위해 high로 올리는 것은 무료가 아니고, 3.7 Flash는 계속 완전히 지원됩니다. effort 수준별 가격 세부는 Gemini 3.7 Flash API 가이드(영어)를 참고하세요.
DeepSeek V4 Flash와 Gemini 3.6 Flash 사이에서 고민했다면 이전 비교(영어)는 52점 수준에서 여전히 유효합니다. 3.8 Flash low effort는 자체 $0.75 / $3.75로 그 동점에 합류하며, AA에 따르면 3.6 Flash high보다 작업당 비용이 약 30% 낮습니다.
Ofox로 둘 다 써보기: 엔드포인트 하나, 키 하나
DeepSeek V4 Flash 0731은 Ofox 카탈로그에 deepseek/deepseek-v4-flash-0731로 등재되어 있으며 100만 토큰당 입력 $0.44, 출력 $1.32, 캐시 읽기 $0.014입니다. DeepSeek 피크 요금과 같은 숫자를 고정으로 청구합니다. Ofox에는 비피크 구간이 없습니다. 즉 바로 그 요금으로 AA가 측정한 작업당 $0.11이 해당되는 줄이고, 비피크 줄은 해당되지 않습니다.
Gemini 3.8 Flash는 2026년 9월 3일 기준 Ofox 카탈로그에 없습니다. google/gemini-3.7-flash는 있으며 Google 제공자 경로로 입력 $0.75, 출력 $3.75입니다(같은 모델 페이지의 CloudVertex 경로는 $1.50 / $7.50이고, /v1/models의 pricing 필드가 현재 반환하는 값은 후자). 3.8 Flash와 같은 토큰 단가입니다. 아래 루프는 오늘 DeepSeek 대 3.7 Flash를 돌립니다. 3.8 Flash가 올라오면 문자열 하나만 바꾸면 됩니다. 무엇을 호출할 수 있는지의 최종 기준은 GET /v1/models의 라이브 카탈로그입니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.ofox.ai/v1", api_key="YOUR_OFOX_API_KEY")
MODELS = [
"deepseek/deepseek-v4-flash-0731",
"google/gemini-3.7-flash", # 3.8 Flash가 등재되면 google/gemini-3.8-flash로 교체
]
prompt = "이 함수를 리팩터링해서 중첩 루프를 제거해 주세요. 코드만 반환하세요."
for model in MODELS:
r = client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": prompt}],
)
u = r.usage
print(f"{model:36} in={u.prompt_tokens:6} out={u.completion_tokens:6}")
지연만 아니라 completion_tokens를 기록하세요. 이 글에서 정가가 아닌 모든 것은 결국 여러분 트래픽의 이 열로 귀결됩니다.
출처
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
- https://ai.google.dev/gemini-api/docs/pricing
- https://ai.google.dev/gemini-api/docs/latest-model
- https://artificialanalysis.ai/articles/gemini-3-8-flash
- https://artificialanalysis.ai/models/gemini-3-8-flash
- https://artificialanalysis.ai/models/deepseek-v4-flash
- https://artificialanalysis.ai/models/releases/deepseek-v4-flash
- https://api-docs.deepseek.com/quick_start/pricing
- https://api-docs.deepseek.com/updates
- https://ofox.ai/models/deepseek/deepseek-v4-flash-0731
가격, 인덱스 점수, 토큰 수는 2026년 9월 3일에 확인했습니다. Ofox 카탈로그 등재 여부는 같은 날 라이브 /v1/models 엔드포인트로 확인했고, Ofox 가격은 모델 페이지에서 가져왔습니다.
자주 묻는 질문
- Gemini 3.8 Flash가 DeepSeek V4 Flash보다 나은가요?
- Artificial Analysis Intelligence Index 기준으로는 그렇습니다. Gemini 3.8 Flash는 effort high에서 59점, 기본값인 medium에서 57점, low에서 52점입니다. DeepSeek V4 Flash 0731은 max effort에서 52점입니다. DeepSeek의 현재 라인업 중 59점에 닿는 모델은 없고, V4 Pro 0813이 53점입니다. low effort에서는 Gemini 3.8 Flash와 DeepSeek V4 Flash가 이 인덱스에서 동점입니다.
- Gemini 3.8 Flash와 DeepSeek V4 Flash의 요금은 얼마나 차이 나나요?
- 정가 기준으로 Gemini 3.8 Flash는 100만 토큰당 입력 $0.75, 출력 $3.75이며 2026년 12월 31일까지 적용되고, 2027년 1월 1일부터 $1.50과 $7.50이 됩니다. DeepSeek V4 Flash는 피크 시간대에 입력 $0.44(캐시 미스), 캐시 히트 $0.014, 출력 $1.32이고 비피크에는 절반입니다. Artificial Analysis가 Intelligence Index 전체를 돌리는 데 Gemini 3.8 Flash(high)는 $825.83, DeepSeek V4 Flash 0731은 $323.26이 들어 2.6배 차이입니다.
- 실제 비용 차이가 정가 차이보다 작은 이유는 무엇인가요?
- AA 인덱스 총액 기준 차이는 2.6배로, 출력 단가 비율 2.8배보다 작습니다. DeepSeek V4 Flash 0731이 훨씬 많은 토큰을 쓰기 때문입니다. Artificial Analysis 기록에 따르면 인덱스 전체에서 DeepSeek은 2억 1천만 출력 토큰, Gemini 3.8 Flash는 1억 2천만으로 1.75배입니다. AA가 별도로 산출하는 작업당 비용에서는 차이가 5.3배($0.58 대 $0.11)로 벌어집니다.
- Gemini 3.8 Flash는 3.7 Flash보다 토큰을 더 쓰나요?
- 그렇습니다. Google은 3.8 Flash가 '더 열심히 일한다'고 하며 '특히 높은 effort 수준에서는 성능을 극대화하기 위해 더 많은 토큰을 쓸 수 있다'고 밝혔습니다. Artificial Analysis는 작업당 평균 출력 토큰이 30% 늘어 4만 8천이 됐고, high effort에서 인덱스 작업당 비용이 3.7 Flash의 $0.40에서 3.8 Flash의 $0.58로 올랐다고 측정했습니다. 토큰 단가는 동일합니다.
- 두 모델을 지금 Ofox로 호출할 수 있나요?
- DeepSeek V4 Flash 0731은 Ofox 카탈로그에 deepseek/deepseek-v4-flash-0731로 등재되어 있으며 100만 토큰당 입력 $0.44, 출력 $1.32, 캐시 읽기 $0.014입니다. DeepSeek 피크 요금과 같은 숫자이고 비피크 구간은 없습니다. Gemini 3.8 Flash는 2026년 9월 3일 기준 카탈로그에 없습니다. google/gemini-3.7-flash는 있으며 3.8 Flash와 같은 $0.75 / $3.75입니다.


