Grok 4.5를 지금 검토할 때는 공개 당시의 평가나 순위보다 현재 xAI API 문서에 남아 있는 제품 조건을 먼저 보는 편이 안전하다. xAI는 이 모델을 코딩, 에이전트형 소프트웨어, 엔지니어링, 워크플로 작업용으로 설명한다. 텍스트와 이미지를 입력받고 텍스트를 출력하며, 함수 호출·구조화된 출력·추론을 지원한다.

제품 사양만 보면 50만 토큰 컨텍스트가 먼저 눈에 들어오지만 비용을 크게 바꾸는 기준은 20만 토큰이다. xAI 가격표는 프롬프트가 20만 토큰에 도달하면 그 요청의 모든 토큰에 장문 요율을 적용한다고 명시한다. Grok 4.5를 장기 에이전트나 큰 코드베이스에 연결하려면 최대 용량보다 이 경계선을 먼저 관리해야 한다.

정확히 어떤 모델인가

항목 xAI 공식 문서상 내용
공식 제품명 Grok 4.5
API ID grok-4.5
별칭 grok-4.5-latest, grok-build-latest
API 공개 2026년 7월 8일
EU API 콘솔 제공 2026년 7월 17일
컨텍스트 윈도우 500,000 토큰
입력·출력 텍스트·이미지 입력, 텍스트 출력
기능 함수 호출, 구조화된 출력, 추론
추론 노력 low, medium, high; 기본값 high
리전 us-east-1, us-west-2
Batch API 지원하지 않음
문서 표기 한도 초당 150요청, 분당 50,000,000토큰

xAI 릴리스 노트는 Grok 4.5가 xAI API에서 코딩·에이전트 작업·지식 노동용으로 제공된다고 설명한다. 모델 페이지는 과학·공학·수학을 아우르는 새 데이터셋으로 학습됐다고 적고 있지만, 그 문장만으로 특정 벤치마크 우위나 실제 코딩 성공률을 계산할 수는 없다. 이 글은 공식 문서 세 곳에 없는 점수와 체감 성능을 추가하지 않는다.

최대 출력 토큰 수는 제공된 Grok 4.5 모델 페이지와 릴리스 노트에 수치로 적혀 있지 않다. 50만 토큰은 입력 맥락을 포함하는 컨텍스트 윈도우이며, 같은 수치를 출력 한도로 읽어서는 안 된다. 대량 출력이 필요한 시스템은 배포 전에 API 응답 한도와 계정별 제한을 별도로 확인해야 한다.

벤치마크에서 확인되는 위치

제공된 세 공식 문서에는 Grok 4.5의 벤치마크 점수나 경쟁 모델과 같은 조건으로 실행한 품질 평가가 없다. 따라서 이 글은 외부 리더보드 수치나 xAI가 공식 문서에 싣지 않은 순위를 인용하지 않는다. 아래 비교는 같은 가격표와 릴리스 노트에서 직접 맞출 수 있는 제품 조건만 다룬다.

가장 가까운 대안

현재 가격표와 릴리스 노트에서 Grok 4.5, Grok 4.6, Grok 4.3을 같은 항목으로 맞춰 보면 다음과 같다. 이 표는 성능 순위가 아니라 공개된 컨텍스트·요금·추론 설정만 비교한다.

항목 Grok 4.5 Grok 4.6 Grok 4.3
컨텍스트 500,000 500,000 1,000,000
20만 토큰 미만 입력 $2.00 / 1M $2.00 / 1M $1.25 / 1M
20만 토큰 미만 캐시 입력 $0.30 / 1M $0.50 / 1M $0.20 / 1M
20만 토큰 미만 출력 $6.00 / 1M $6.00 / 1M $2.50 / 1M
20만 토큰 이상 입력 $4.00 / 1M $4.00 / 1M $2.50 / 1M
20만 토큰 이상 캐시 입력 $0.60 / 1M $1.00 / 1M $0.40 / 1M
20만 토큰 이상 출력 $12.00 / 1M $12.00 / 1M $5.00 / 1M
이 자료에서 확인한 추론 노력 low·medium·high, 기본 high low·medium·high·xhigh, 기본 high 확인하지 못함

Grok 4.6은 Grok 4.5와 컨텍스트 크기 및 일반 입력·출력 단가가 같고, xhigh 추론 단계를 추가로 제공한다. 반면 Grok 4.5의 캐시 입력 단가는 짧은 구간과 긴 구간 모두 Grok 4.6보다 낮다. 반복되는 시스템 프롬프트나 고정 코드 맥락의 캐시 적중 비율이 높은 서비스라면 이 차이를 월별 호출량에 대입해 볼 이유가 있다.

Grok 4.3은 가격표상 더 큰 컨텍스트와 더 낮은 토큰 단가를 제공한다. 그러나 제공된 세 공식 문서에는 Grok 4.3과 Grok 4.5를 같은 품질 평가로 비교한 결과가 없다. 따라서 가격표만 보고 4.3의 코딩 품질이 더 높다거나 4.5가 더 빠르다고 결론낼 수 없다. 실제 교체 판단에는 같은 프롬프트·도구·추론 설정으로 자체 회귀 평가가 필요하다.

가격과 실제 선택 조건

Grok 4.5의 표준 요금은 100만 토큰당 입력 $2.00, 캐시 입력 $0.30, 출력 $6.00이다. 프롬프트가 200,000토큰 이상이면 입력 $4.00, 캐시 입력 $0.60, 출력 $12.00의 장문 요율이 요청 전체에 적용된다. 초과분만 비싸지는 구조가 아니다.

공식 단가를 캐시 미적중 요청에 단순 적용하면 경계 효과를 확인할 수 있다.

예시 요청 계산 토큰 비용
입력 199,000 + 출력 10,000 199,000 × $2/1M + 10,000 × $6/1M $0.458
입력 200,000 + 출력 10,000 200,000 × $4/1M + 10,000 × $12/1M $0.920

두 번째 예시는 입력이 1,000토큰 늘었지만 장문 요율이 전체 요청에 적용돼 토큰 비용이 약 두 배가 된다. 실제 청구액에는 사용한 서버 측 도구 비용이 더해질 수 있다. xAI 가격표상 웹 검색, X 검색, 코드 실행은 각각 1,000회당 $5이며, 모델이 도구를 몇 번 호출하는지에 따라 총비용이 달라진다.

Batch API를 지원하지 않는다는 점도 대량 비동기 처리 비용에 영향을 준다. 가격 페이지에는 일반적인 Batch API 할인 설명이 있지만 Grok 4.5 모델 페이지는 이 모델의 Batch API를 지원하지 않는다고 표시한다. 따라서 실시간 호출 단가를 그대로 두고 배치 할인까지 가정하면 예산이 어긋난다.

먼저 답하면

  • 추천 작업: 반복 프롬프트 캐시를 활용하면서 20만 토큰 아래에서 운영하는 코딩·엔지니어링 에이전트
  • 비추천 작업: 20만 토큰 이상 프롬프트를 상시 유지하거나 Batch API 할인이 필요한 대량 처리
  • 현재 판단: 기존 Grok 4.5 시스템은 낮은 캐시 입력 단가 때문에 유지할 근거가 있다. 신규 시스템은 같은 일반 입력·출력 단가와 컨텍스트 크기에 xhigh 추론 단계를 제공하는 Grok 4.6도 함께 평가해야 한다. 성능 우열은 세 공식 문서만으로 정할 수 없다.

추천 대상 / 비추천 대상

추천

  • 텍스트와 이미지 입력, 함수 호출, 구조화된 출력을 한 모델에서 연결하려는 코딩·엔지니어링 에이전트 팀
  • 추론 노력 low·medium·high만으로 충분하고, 반복 프롬프트의 캐시 적중률을 높여 Grok 4.6보다 낮은 캐시 단가를 활용할 수 있는 서비스
  • 프롬프트를 20만 토큰 아래로 유지하거나, 장문 구간 진입 전에 맥락 압축·분할 정책을 적용할 수 있는 운영팀

비추천

  • 최대 출력 길이를 공식 수치로 확정해야 배포할 수 있는 시스템
  • 20만 토큰 이상 프롬프트를 자주 보내면서 요청 전체의 장문 요율을 예산에 반영하기 어려운 서비스
  • Batch API 할인이나 Grok 4.6의 xhigh 추론 단계를 필수 조건으로 두는 신규 프로젝트

판단

기존 Grok 4.5 통합을 유지할 이유는 분명하다. 코딩·에이전트 작업에 맞춘 공식 포지션, 50만 토큰 컨텍스트, 함수 호출과 구조화된 출력, 그리고 Grok 4.6보다 낮은 캐시 입력 단가가 있다. 반복 맥락을 많이 재사용하고 high 이하의 추론 설정으로 충분한 팀이라면 바로 교체할 필요는 없다.

신규 도입이라면 Grok 4.6도 함께 평가하는 편이 합리적이다. 일반 입력·출력 가격과 컨텍스트 크기가 같으면서 xhigh 설정을 제공하기 때문이다. 다만 캐시 입력은 Grok 4.5가 더 저렴하다. 반대로 비용과 컨텍스트 크기가 우선이면 가격표상 Grok 4.3이 더 유리하지만, 공식 자료만으로 품질 우열을 정할 수 없으므로 자체 테스트 없이 대체 모델로 확정해서는 안 된다.

어느 선택이든 운영 설계의 기준선은 20만 토큰이다. 이 선을 넘는 요청을 자동으로 감지하고 압축·분할·예산 상한 중 하나를 적용할 수 없다면, 50만 토큰 컨텍스트를 모두 쓰는 설계는 비용 예측성이 낮다.

아직 공식 문서에서 확인되지 않은 부분

  • Grok 4.5의 최대 출력 토큰 수
  • Grok 4.5와 Grok 4.6·Grok 4.3의 동일 조건 성능 비교
  • 실제 업무별 지연 시간, 도구 호출 성공률, 한국어 품질
  • 계정 등급과 지역에 따른 실제 처리량 차이

함께 읽을 글

근거와 출처

  • Grok 4.5 모델 문서 — API ID, 입출력 형식, 50만 토큰 컨텍스트, 기능, 기본·캐시 단가, 별칭, 리전, Batch API와 처리량 표기. xAI 개발자 문서, 확인일 2026-08-25
  • xAI API 릴리스 노트 — 2026년 7월 8일 API 공개, 7월 17일 EU 제공, 추론 노력 설정과 Grok 4.6 비교 항목. xAI 개발자 문서, 확인일 2026-08-25
  • xAI API 가격표 — Grok 4.5·4.6·4.3의 컨텍스트와 단문·장문 요율, 장문 요율의 요청 전체 적용, 서버 측 도구 호출 가격. xAI 개발자 문서, 확인일 2026-08-25

게시: 2026-08-25 23:05 KST 작성 방식: 직접 사용기가 아닌 xAI 공식 문서 분석