영상, 오디오 녹음, 대형 PDF 문서를 직접 분석하는 멀티모달 파이프라인이나 대량 트래픽 서비스를 다루는 실무자에게 적합한 모델입니다. 다양한 미디어가 혼합된 백엔드 처리에 투입할 수 있습니다.

서비스 구축 전에는 1,048,576 토큰의 문맥 지원과 함께 2026년 12월 31일까지 적용되는 도입기 프로모션 요금(입력 $0.75 / 출력 $3.75)의 적용 기한을 확인해야 합니다. 프로모션 종료 이후의 요금 정책을 예산에 반영해야 합니다.

한 줄 결론

100만 토큰 문맥과 멀티모달 직접 입력을 제공하며, 연말까지 유지되는 프로모션 요율을 활용해 대용량 미디어 파이프라인을 구성하기에 유리합니다.

바뀐 점

  • 사양 및 식별자: API ID gemini-3.8-flash로 정식 제공되며 1,048,576 토큰 컨텍스트와 65,536 토큰 출력을 지원합니다.
  • 멀티모달 네이티브 처리: 비디오 프레임, 오디오 스트림, 고해상도 이미지, 대형 PDF 문서를 공식 파일 형식과 크기 제한 안에서 입력받아 처리합니다.
  • 도입기 가격 정책: 2026년 12월 31일까지 100만 토큰당 입력 0.75달러, 출력 3.75달러의 프로모션 요율이 적용됩니다.

가격과 조건

항목 공식 확인 사양
공식 제품명 / API ID Gemini 3.8 Flash (gemini-3.8-flash)
서비스 상태 정식 출시 (Generally available)
컨텍스트 윈도우 1,048,576 토큰
최대 출력 한도 65,536 토큰
프로모션 입력 가격 $0.75 / 1M 토큰 (2026년 12월 31일까지)
프로모션 출력 가격 $3.75 / 1M 토큰 (2026년 12월 31일까지)
지원 미디어 모달리티 텍스트, 이미지, 오디오, 비디오, PDF

본 프로모션 요율은 2026년 12월 31일까지 유효하며 이후 표준 요율 적용 여부를 점검해야 합니다.

공개 평가에서 읽을 것

  • LiveBench (2026-06-25 release): gemini-3.8-flash-high 모델이 75.83점(7개 카테고리 평균)을 기록했습니다.
  • Artificial Analysis Intelligence Index (v4.2 · 2026-09-04): high 모드 기준 47.07점을 기록했습니다.
  • GPQA Diamond (Artificial Analysis · GPQA Diamond): high 모드 95.25%, medium 모드 93.54%의 정답률을 나타냈습니다.
  • Terminal-Bench 4.0 (Terminal-Bench 4.0 · official leaderboard): Gemini 3.8 Flash · mini-SWE-agent · high 환경에서 19.09% 해결률을 기록했습니다.

Google · 공개 평가 결과. Artificial Analysis Intelligence Index · Intelligence Index v4.2

도표 크게 보기

평가 버전: v4.2 · 2026-09-04.

모델·실행 설정 공개 점수
Gemini 3.8 Flash (high) 47.07

전체 결과와 평가 조건

같은 평가 안에서 공개된 실행 설정을 구분했습니다. 추론 강도와 평가 버전이 달라지면 점수를 직접 비교하지 않습니다.

도표의 공개 원문

추천하는 사용법

  • 장시간 회의 녹음 파일이나 강의 영상, 다중 PDF 문서 분석 파이프라인에 오디오 및 비디오 파일을 직접 입력하는 구성을 권장합니다.
  • 100만 토큰 범위 문서를 다룰 때도 특정 사실의 인출 정확도가 보장되는 것은 아니므로, 샘플 데이터셋으로 문서 내 세부 항목 검색 일관성을 검증하는 절차를 권장합니다.

요청 한 건의 비용으로 바꿔 보면

회의록에서 결정 사항을 추출하는 작업이라면 입력 파일 종류와 발언자 구분 여부를 먼저 정합니다. Flash의 요금표는 입력 유형별 조건을 구분해야 합니다. 텍스트 토큰만 계산한 예시를 그대로 오디오 파일이나 동영상 처리 비용으로 사용하면 안 됩니다.

Gemini 3.8 Flash 기준의 아래 계산은 입력 10,000토큰과 청구 대상 출력 1,000토큰을 사용하는 텍스트 요청을 가정한 예시입니다. 실제 사용량을 측정한 결과가 아니며, 캐시가 없는 표준 호출에서 본문의 단가를 곱했습니다. 입력과 출력의 가격이 다르므로 두 항목을 더해 계산합니다.

모델 입력 비용 USD 출력 비용 USD 합계 USD
Gemini 3.8 Flash 0.0075 0.00375 0.01125

이 요청을 1,000회 처리한다면 Gemini 3.8 Flash의 예시 합계는 11.25 USD입니다. 재시도, 검색과 도구 사용료, 세금, 멀티모달 입력 비용은 포함하지 않았습니다. 추론 과정이 출력으로 청구되는 제품에서는 화면에 보이는 답변의 길이보다 청구 토큰 수가 많을 수 있습니다. 실제 청구량은 API 사용량 기록을 기준으로 확인하세요.

Gemini 3.8 Flash의 도입 여부는 이 예시 금액만으로 결정하지 않는 편이 좋습니다. 같은 요청 묶음에서 정확히 완료한 건수와 사람이 다시 처리한 건수를 함께 기록하세요. 단가가 낮아도 재시도가 많으면 최종 작업 비용이 커집니다. 반대로 상위 모델이 수정 횟수를 줄여 준다면 추가 비용을 낼 요청 범위를 구체적으로 정할 수 있습니다.

출처