OpenAI는 GPT-5.4 Mini를 코딩, 컴퓨터 사용, 서브에이전트에 강한 mini 모델이자 고처리량 작업을 위한 빠르고 효율적인 선택지로 설명한다. 40만 토큰 컨텍스트와 12만8천 토큰 최대 출력, 넓은 Responses API 도구 지원을 갖추고 있으며 입력·캐시 입력·출력 가격은 100만 토큰당 각각 $0.75·$0.075·$4.50이다.
다만 현재 OpenAI의 모델 선택 안내는 비용 민감형 대량 작업에 GPT-5.6 Luna, 지능과 비용의 균형에는 GPT-5.6 Terra를 시작점으로 제시한다. Luna는 GPT-5.4 Mini보다 토큰 단가가 낮고 컨텍스트는 더 크다. Terra는 공식 문서에서 이전 GPT-5 계열의 mini 등급에 대응한다고 명시한다.
따라서 GPT-5.4 Mini를 새 프로젝트의 자동 기본값으로 두기는 어렵다. 이미 gpt-5.4-mini-2026-03-17 스냅샷으로 품질과 도구 호출을 검증한 운영 환경, 또는 Luna보다 높은 작업 성공률을 자체 평가로 확인한 경우에 유지 근거가 생긴다. 이 글은 직접 사용기가 아니라 사용자가 지정한 OpenAI 공식 문서와 그 문서가 연결한 모델 페이지로 선택 조건을 나눈 분석이다.
먼저 답하면
- 추천 작업: 고정 스냅샷으로 회귀 평가를 마친 기존 코딩 보조·컴퓨터 사용·서브에이전트 파이프라인
- 비추천 작업: 가장 낮은 단가와 긴 컨텍스트를 우선하는 신규 대량 처리, 별도 평가 없이 최신 mini 등급을 원하는 프로젝트
- 현재 판단: GPT-5.4 본체보다 토큰 비용을 70% 낮추면서 같은 최대 출력과 넓은 도구 지원을 유지한다. 그러나 새 대량 작업은 더 저렴한 GPT-5.6 Luna를 먼저 평가하고, mini 등급의 현행 선택지가 필요하면 GPT-5.6 Terra와 성공률·지연·총비용을 비교해야 한다.
공식 문서에서 확인되는 사양
| 항목 | OpenAI 공식 문서상 내용 |
|---|---|
| 공식 제품명·API ID | GPT-5.4 Mini · gpt-5.4-mini |
| 공식 용도 | 코딩, 컴퓨터 사용, 서브에이전트, 고처리량 워크로드 |
| 컨텍스트·최대 출력 | 400,000토큰 · 128,000토큰 |
| 지식 기준일 | 2025-08-31 |
| 추론 강도 | none(기본), low, medium, high, xhigh |
| 입출력 | 텍스트 입력·출력, 이미지 입력 |
| 미지원 입출력 | 오디오·비디오 |
| 응답 기능 | 스트리밍, 함수 호출, 구조화 출력 지원 · 파인튜닝 미지원 |
| 고정 스냅샷 | gpt-5.4-mini-2026-03-17 |
| 입력·캐시 입력·출력 | $0.75 · $0.075 · $4.50 / 1M 토큰 |
| 지역 처리 | data residency 엔드포인트 10% 할증 |
Responses API에서는 웹 검색, 파일 검색, 이미지 생성, 코드 인터프리터, hosted shell, apply patch, skills, computer use, MCP, tool search를 지원한다. 작은 모델로 비용을 낮추더라도 검색·코드 실행·파일 수정까지 한 API 흐름에 묶을 수 있다는 뜻이다.
지원 목록이 실제 완료 품질을 보장하는 것은 아니다. 도구를 사용할 수 있다는 사실과 올바른 도구를 고르고 인수를 정확히 채우며 실패 뒤 복구하는 능력은 별도로 측정해야 한다. 특히 파일 수정이나 컴퓨터 사용처럼 한 번의 오류가 뒤 단계까지 번지는 작업은 모델별 최종 완료율을 기준으로 비교해야 한다.
고처리량 모델로 볼 근거
모델 페이지의 사용량 티어 표에서 GPT-5.4 Mini는 Tier 5 기준 분당 요청 30,000회, 분당 토큰 180,000,000개, Batch 대기열 15,000,000,000토큰을 제공한다. GPT-5.6 Luna의 Tier 5 한도도 같은 수치다. 계정의 실제 한도는 사용량 티어에 따라 달라지므로 이 상한을 모든 프로젝트에 그대로 적용할 수는 없다.
처리량 상한이 같아도 경제성은 다르다. Mini는 입력과 출력 모두 Luna의 3.75배 가격이다. 반대로 GPT-5.6 Terra의 Tier 5 한도는 분당 요청 15,000회와 분당 토큰 40,000,000개로 더 낮지만, 공식 문서는 Terra를 이전 세대 mini 등급에 대응하는 지능·비용 균형형으로 분류한다.
이 차이는 모델명을 세대별로 단순 치환하면 안 된다는 뜻이다. 가장 싼 고처리량 실행 계층은 Luna와 비교하고, mini 등급의 품질 역할은 Terra와 비교해야 한다.
공식 문서만으로는 성능 차이를 계산할 수 없다
지정된 모델 목록·최신 모델 가이드·가격표에는 GPT-5.4 Mini, GPT-5.6 Terra, GPT-5.6 Luna를 동일한 프롬프트·도구 환경·추론 강도로 실행한 점수표가 없다. OpenAI는 각 모델의 용도와 세대 위치를 설명하지만, 특정 코드 수정이나 컴퓨터 사용 작업의 성공률 차이는 수치로 제시하지 않는다.
따라서 “Luna가 더 싸니 Mini보다 낫다”거나 “Terra가 현행 mini 등급이니 모든 작업에서 더 정확하다”고 단정할 수 없다. 공식 자료로 직접 비교할 수 있는 범위는 가격, 컨텍스트, 최대 출력, 지식 기준일, 추론 설정, 도구 지원과 처리 한도다. 품질 판단에는 같은 입력·성공 기준·도구 권한을 고정한 자체 평가가 필요하다.
GPT-5.4·GPT-5.6 Terra·Luna와 비교
| 모델 | 공식 문서상 위치 | 컨텍스트·최대 출력 | 지식 기준일 | 추론 강도 | 입력·캐시 입력·출력 / 1M |
|---|---|---|---|---|---|
| GPT-5.4 Mini | 코딩·컴퓨터 사용·서브에이전트용 이전 mini | 400,000 · 128,000 | 2025-08-31 | none~xhigh | $0.75 · $0.075 · $4.50 |
| GPT-5.4 | 복잡한 전문 업무용 이전 플래그십 | 1,050,000 · 128,000 | 2025-08-31 | none~xhigh | $2.50 · $0.25 · $15.00 |
| GPT-5.6 Terra | 지능과 비용의 균형, 현행 mini 대응 등급 | 1,050,000 · 128,000 | 2026-02-16 | none~max | $2.00 · $0.20 · $12.00 |
| GPT-5.6 Luna | 비용 민감형 고처리량, 현행 nano 대응 등급 | 1,050,000 · 128,000 | 2026-02-16 | none~max | $0.20 · $0.02 · $1.20 |
GPT-5.4 Mini는 GPT-5.4와 지식 기준일과 최대 출력이 같고, 입력·출력 단가는 70% 낮다. 대신 컨텍스트가 105만 토큰에서 40만 토큰으로 줄어든다. 큰 저장소나 장기 도구 실행에서 40만 토큰을 넘긴다면 낮은 단가만으로 대체할 수 없다.
GPT-5.6 Terra는 Mini보다 입력·출력이 약 2.67배 비싸지만 105만 토큰 컨텍스트, 더 늦은 지식 기준일, max 추론 강도와 GPT-5.6 기능을 제공한다. 최신 모델 가이드는 GPT-5.6에 Programmatic Tool Calling, multi-agent 베타, 명시적 프롬프트 캐싱, 이전 턴 추론 재사용과 pro mode가 추가됐다고 안내한다.
GPT-5.6 Luna는 Mini보다 입력·출력이 약 73% 저렴하고 컨텍스트는 2.625배 크다. 하지만 공식 분류상 Luna는 이전 nano 등급에 대응한다. 비용과 규격은 Luna가 유리해도 Mini와 같은 작업 성공률을 낸다는 보장은 없으므로, 신규 고처리량 작업의 첫 후보로 두되 대표 업무 평가를 통과한 뒤 전환해야 한다.
가격과 실제 월 비용
캐시, 장문 할증, 지역 처리와 도구 비용을 제외하고 월간 비캐시 입력 1,000만 토큰과 출력 200만 토큰을 처리한다고 가정하면 다음과 같다. GPT-5.4와 GPT-5.6 모델은 한 요청의 입력이 272,000토큰을 넘지 않는 구간을 기준으로 계산했다.
| 모델 | 계산 | 토큰 비용 |
|---|---|---|
| GPT-5.4 Mini | 10 × $0.75 + 2 × $4.50 | $16.50 |
| GPT-5.4 | 10 × $2.50 + 2 × $15.00 | $55.00 |
| GPT-5.6 Terra | 10 × $2.00 + 2 × $12.00 | $44.00 |
| GPT-5.6 Luna | 10 × $0.20 + 2 × $1.20 | $4.40 |
Mini를 GPT-5.4 대신 쓰면 이 예시에서 월 $38.50을 줄인다. Luna가 Mini와 같은 성공 기준을 만족한다면 추가로 $12.10을 줄일 수 있다. 반대로 Luna의 실패를 다시 Mini나 Terra가 처리하면 재시도 입력·출력과 도구 호출이 더해지므로 모델 단가만으로 총비용을 판단하면 안 된다.
도구 비용은 토큰 비용과 별도로 청구된다. 공식 가격표에서 웹 검색은 1,000회당 $10이며 검색 콘텐츠 토큰은 선택한 모델 단가로 다시 청구된다. 파일 검색은 1,000회당 $2.50이고, 계정당 무료 1GB를 넘는 저장 공간은 하루 GB당 $0.10이다. 위 예시에서 웹 검색 1,000회만 추가해도 Mini 토큰 비용의 절반을 넘기므로 호출 수를 별도 계측해야 한다.
가장 가까운 대안
| 선택지 | 대안이 나은 상황 | GPT-5.4 Mini를 유지할 이유 |
|---|---|---|
| GPT-5.6 Luna | 신규 분류·추출·코드 보조·서브 작업에서 낮은 단가와 105만 토큰 컨텍스트를 먼저 검증할 때 | Luna가 대표 업무의 완료율이나 도구 복구 기준을 통과하지 못하고 Mini가 비용 차이를 상쇄할 만큼 안정적일 때 |
| GPT-5.6 Terra | 현행 mini 대응 등급, 더 긴 컨텍스트와 GPT-5.6의 추론·캐싱·도구 조율 기능이 필요할 때 | 이미 승인된 Mini 스냅샷의 동작을 유지해야 하고 Terra의 추가 품질이 높은 단가를 정당화하지 못할 때 |
| GPT-5.4 | 복잡한 전문 업무와 105만 토큰 컨텍스트가 필요하고 같은 GPT-5.4 세대 안에서 운영하려 할 때 | 작업을 40만 토큰 안에 제한할 수 있고 최종 판단보다 반복 실행 비용이 중요할 때 |
추천 대상 / 비추천 대상
추천
gpt-5.4-mini-2026-03-17로 출력 형식·도구 호출·안전 경계를 이미 승인한 운영팀- GPT-5.4 본체가 맡던 반복 코드 보강과 서브 작업을 분리하고, 40만 토큰 안에서 실패를 상위 모델로 넘길 수 있는 파이프라인
- Luna·Terra와 같은 평가 세트를 돌린 결과 Mini의 완료율 우위가 추가 토큰 비용보다 크다고 확인한 서비스
비추천
- OpenAI가 현재 안내하는 GPT-5.6 제품군을 바로 평가할 수 있는 신규 프로젝트
- 가장 낮은 단가, 105만 토큰 컨텍스트와 최신 지식 기준일을 동시에 원하는 대량 처리
max추론, Programmatic Tool Calling, multi-agent, 명시적 캐싱이나 이전 턴 추론 재사용이 필요한 에이전트- 모델 단가만 보고 검색·파일·컨테이너 비용과 재시도율을 기록하지 않는 운영 환경
판단
GPT-5.4 Mini는 여전히 분명한 제품이다. 40만 토큰 컨텍스트와 12만8천 토큰 출력을 제공하고, 코딩·컴퓨터 사용·서브에이전트에 필요한 Responses API 도구를 폭넓게 지원한다. GPT-5.4 본체보다 입력·출력이 70% 저렴하며 고정 스냅샷도 있다.
그러나 2026년 8월의 신규 대량 작업에서 가격만으로 선택할 모델은 아니다. 공식 모델 선택 안내는 고처리량 비용형에 GPT-5.6 Luna, mini 대응 균형형에 GPT-5.6 Terra를 배치한다. Luna는 훨씬 저렴하고 Terra는 최신 mini 등급의 기능과 더 큰 컨텍스트를 제공한다.
운영 전환은 현재 Mini 설정을 기준선으로 고정하고 Luna와 Terra에서 같은 추론 강도와 한 단계 낮은 강도를 비교하는 방식이 적합하다. Mini의 기본값이 none이라면 Luna·Terra의 none을 지연 기준선으로 두고 low도 함께 시험한다. 작업 완료율, 형식 준수, 도구 오류, 재시도 횟수, 총 토큰, 지연시간과 도구비를 합친 총비용이 기준을 넘는 모델만 채택하면 된다.
아직 공식 문서에서 확인되지 않은 부분
- GPT-5.4 Mini·GPT-5.6 Terra·Luna의 동일 조건 한국어·코딩·컴퓨터 사용 성공률
- 모델과 추론 강도별 실제 첫 응답 지연, 전체 완료 시간과 추론 토큰 사용량
- 기존 Mini 스냅샷을 GPT-5.6 모델로 바꿀 때 서비스별로 발생하는 회귀율
- 개별 계정의 사용량 티어, 지역과 처리 방식에 따른 실제 가용 한도
함께 읽을 글
근거와 출처
- OpenAI 전체 모델 목록 — 현재 GPT-5.6 Sol·Terra·Luna의 작업별 선택 기준. OpenAI Developers, 확인일 2026-08-26
- GPT-5.4 Mini 모델 페이지 — 모델 용도, 사양, 가격, 기능, Responses API 도구, 스냅샷과 사용량 티어. OpenAI Developers, 확인일 2026-08-26
- OpenAI 최신 모델 가이드 — GPT-5.4에서 GPT-5.6으로 옮길 때의 추론 강도 비교 방법과 GPT-5.6 추가 기능. OpenAI Developers, 확인일 2026-08-26
- OpenAI API 가격표 — GPT-5.6 처리 방식별 토큰 요금과 웹 검색·파일 검색 비용. OpenAI Developers, 확인일 2026-08-26
게시: 2026-08-26 02:26 KST 작성 방식: 직접 사용기가 아닌 OpenAI 공식 문서 분석
독자 의견
댓글 0
글에 대한 생각과 경험을 남겨 주세요. 서로를 존중하는 표현을 부탁드립니다.