터미널 도구 연동과 장기 에이전트 개발 워크플로를 구축하려는 엔지니어는 Grok 4.6을, 개발 환경 내부 빌드 및 프로토타이핑을 진행하려는 팀은 Grok Build를 검토할 수 있습니다. 강화학습 기반 추론 설정을 작업 성격에 맞게 조정해야 합니다.

실행 전에는 500,000 토큰 컨텍스트 조건에서 표준 모드(입력 $2.00 / 출력 $6.00)와 Fast 모드(입력 $4.00 / 출력 $12.00) 사이의 2배 요금 차이를 확인해야 합니다. 지속적인 호출이 발생하는 IDE 연동 환경에서는 캐싱 단가 관리가 필요합니다.

한 줄 결론

다단계 코드 수정과 터미널 제어에는 Grok 4.6 표준 모드를 기본으로 적용하고, 빠른 반응이 필요한 경우에만 Fast 모드를 선택하는 구성이 경제적입니다.

바뀐 점

  • Grok 4.6 정식 출시: grok-4.6 식별자로 500,000 토큰 문맥을 지원합니다. 최대 출력 한도는 확인한 공식 페이지에 별도 명시되어 있지 않습니다. reasoning_effort 매개변수로 low, medium, high, xhigh 4단계 사고 강도를 제어할 수 있습니다.
  • 과금 요율 이원화: 일반 처리를 위한 Standard 요율($2/$6)과 지연 시간을 줄인 Fast 요율($4/$12)이 제공됩니다. 표준 모드 프롬프트 캐시 읽기는 100만 토큰당 0.50달러입니다.
  • 개발 도구 연동: Grok Build 0.1(256K 컨텍스트, $1/$2)과 Cursor IDE 연동 환경이 지원됩니다.

가격과 조건

모델명 API ID 컨텍스트 최대 출력 입력(1M) 출력(1M) 캐시 읽기
Grok 4.6 (Standard) grok-4.6 500,000 별도 미확인 $2.00 $6.00 $0.50
Grok 4.6 (Fast) 공식 Fast 변형 문서 확인 500,000 별도 미확인 $4.00 $12.00 미공개
Grok 4.5 grok-4.5 500,000 미공개 $2.00 $6.00 미공개
Grok 4.3 grok-4.3 1,000,000 미공개 $1.25 $2.50 미공개
Grok Build 0.1 grok-build-0.1 256,000 미공개 $1.00 $2.00 미공개

Grok 4.6 Fast 모드는 표준 요금 대비 2배의 단가가 적용되므로, 실시간 대화형 환경과 비동기 백엔드 워크플로를 분리하여 엔드포인트를 지정해야 합니다.

표준 요금도 입력 200K를 초과하면 입력 $4 / 출력 $12, 캐시 읽기 $1(100만 토큰당)로 달라집니다. 이 장문 할증과 발표에 언급된 Fast 변형의 추가 요금은 서로 다른 조건입니다.

공개 평가에서 읽을 것

  • Grok 4.6: LiveBench(2026-06-25 release, grok-4.6) 78.04점, Artificial Analysis Intelligence Index(v4.2 · 2026-09-04, high) 50.58점, GPQA Diamond high 94.95%, medium 93.54%, Terminal-Bench 4.0(공식 리더보드, Grok 4.6 · Grok Build · high) 20.30%입니다.
  • 이전 세대 비교: Grok 4.5는 LiveBench 71.39점, GPQA Diamond high 91.41%, Terminal-Bench 4.0(high) 12.42%였으며, Grok Build 0.1은 LiveBench 67.78점, GPQA Diamond 89.49%를 나타냈습니다.

xAI · 모델별 API 단가. 100만 토큰당 USD · 입력과 출력은 별도 과금

도표 크게 보기

모델 입력 USD / 1M 출력 USD / 1M
Grok 4.6 2 6
Grok 4.5 2 6
Grok 4.3 1.25 2.5
Grok Build 0.1 1 2

단가 비교이며 성능 순위가 아닙니다. 캐시·장문·도구 과금과 제공 조건은 본문 및 원문을 확인하세요.

도표의 공개 원문

추천하는 사용법

  • 코드베이스 리팩터링 및 자동화 스크립트 작성에는 Grok 4.6 표준 모드를 기본으로 적용하고 캐시를 활용해 비용을 절감하는 방식을 권장합니다.
  • 대화형 개발 보조 환경에는 Fast 모드를 선별 적용하고, 사고 강도를 medium과 high로 변경해가며 소모 토큰 대비 품질을 비교하는 실험을 추천합니다.

요청 한 건의 비용으로 바꿔 보면

Grok 제품군의 기본 단가를 비교할 때는 짧은 입력과 장문 요청을 나누세요. 아래 예시는 입력 10,000토큰과 출력 1,000토큰을 쓰는 표준 호출입니다. Grok 4.6의 입력 200K 초과 할증이나 Fast 변형은 계산에 넣지 않았습니다.

모델 입력 비용 USD 출력 비용 USD 합계 USD
Grok 4.6 0.02 0.006 0.026
Grok 4.5 0.02 0.006 0.026
Grok 4.3 0.0125 0.0025 0.015
Grok Build 0.1 0.01 0.002 0.012

Xai 모델을 고를 때는 표의 금액과 함께 작업 완료율을 확인하세요. 이 표는 실측 결과가 아닌 단가 계산 예시이며, 도구 사용료와 재시도 비용은 제외했습니다. 상위 모델을 모든 요청에 적용하기 전에 어려운 작업에만 선택적으로 사용하는 구성을 비교할 수 있습니다.

출처