다국어 비즈니스 처리와 엔지니어링 파이프라인을 운영하는 개발팀은 Qwen3.8 Max를, 비용 대비 고밀도 추론 성능이 필요한 서비스에는 Qwen3.8 27B나 Flash를 선택할 수 있습니다. 작업 규모에 맞춘 라인업 분기 설정이 필요합니다.

서비스 설계 시에는 고정 USD 요율이 아닌 알리바바 클라우드 Model Studio의 공식 CNY(위안화) 과금 체계를 확인해야 합니다. 또한 기존 Qwen3 Coder Plus의 퇴역 일정을 파악해 마이그레이션을 준비해야 합니다.

한 줄 결론

2026년 9월 2일 출시된 Qwen3.8 Max(0902)와 27B를 중심으로 라인업이 재편되었으며, 10월 10일 예정된 구형 코더 모델 지원 종료에 맞춘 이전 계획이 요구됩니다.

바뀐 점

  • Qwen3.8 Max 및 27B 출시: 2026년 9월 2일 출시된 qwen3.8-max-0902 스냅샷과 qwen3.8-27b는 1,000,000 토큰 문맥을 지원합니다. Max 모델은 비사고 모드와 사고 모드를 모두 제공합니다.
  • 구형 모델 퇴역 일정: qwen3-coder-plus 모델의 공식 지원 종료(Deprecation)가 2026년 10월 10일로 공지되었습니다.
  • 벤치마크 관측 모델 구분: 리더보드에 등장한 qwen3.8-flash-next는 독립 출시 문서가 확인되지 않은 벤치마크 관측 모델이며, 공식 서비스 중인 모델은 qwen3.8-flash입니다.

가격과 조건

모델명 API ID 컨텍스트 글로벌 요금 (CNY / 1M) 지원 조건
Qwen3.8 Max qwen3.8-max (0902) 1,000,000 입력 12.0 / 출력 36.0 사고/비사고 모드, 배치 50% 할인 (인터내셔널 14.988 / 44.965)
Qwen3.8 27B qwen3.8-27b 1,000,000 입력 3.0 / 출력 12.0 고밀도 모델, 캐싱 할인 (인터내셔널 3.646 / 21.875)
Qwen3.8 Flash qwen3.8-flash 1,000,000 입력 0.8 / 출력 2.7 고속 추론, 배치 50% 할인 (인터내셔널 1.094 / 3.427)
Qwen3.7 Max qwen3.7-max 1,000,000 입력 16.0 / 출력 48.0 구형 플래그십
Qwen3 Coder Plus qwen3-coder-plus 1,000,000 서비스 중 2026-10-10 지원 종료 예정

이 글의 요금표는 확인한 공식 문서의 CNY 표기를 따릅니다. 지역별 청구 조건을 확인하고 통화를 임의 환산하지 않습니다.

공개 평가에서 읽을 것

  • Qwen3.8 Max: LiveBench(2026-06-25 release, qwen3.8-max) 78.46점, Artificial Analysis Intelligence Index(v4.2 · 2026-09-04) 46.91점, GPQA Diamond 92.73%를 기록했습니다.
  • Qwen3.8 27B: LiveBench 75.27점, Artificial Analysis Intelligence Index(xhigh) 41.41점, GPQA Diamond xhigh 90.51%, medium 84.55%를 나타냈습니다.
  • Qwen3.8-Flash-Next (리더보드 관측): LiveBench 76.19점, GPQA Diamond 92.32%를 기록했습니다. 본 모델은 벤치마크 등장 기록이며 독립 API 정식 출시는 별도로 확인되지 않았습니다.

Qwen · 공개 평가 결과. Artificial Analysis Intelligence Index · Intelligence Index v4.2

도표 크게 보기

평가 버전: v4.2 · 2026-09-04.

모델·실행 설정 공개 점수
Qwen3.8 Max 46.91
Qwen3.8 27B (xhigh) 41.41

전체 결과와 평가 조건

같은 평가 안에서 공개된 실행 설정을 구분했습니다. 추론 강도와 평가 버전이 달라지면 점수를 직접 비교하지 않습니다.

도표의 공개 원문

추천하는 사용법

  • 기존에 Qwen3 Coder를 사용하던 시스템은 지원 종료일(2026년 10월 10일) 이전에 Qwen3.8 Max 또는 27B로 엔드포인트를 이전하는 검증 작업을 권장합니다.
  • 대용량 비동기 데이터 처리에는 Model Studio의 배치 50% 할인 옵션을 활성화하여 운영 비용을 통제하는 구성을 추천합니다.

지역과 모델을 먼저 고정하기

Qwen을 고를 때는 모델 이름만 메모하지 말고 실제 호출할 지역, API ID, 사고 모드, 요금표 통화를 한 줄에 적어 두세요. 같은 이름의 제품이 있어도 글로벌 제공과 국제 제공의 조건이 같다고 단정할 수 없습니다. 이 글의 CNY 금액을 달러로 읽지 않는 것이 첫 단계입니다. 환산이 필요하면 결제 통화와 환율 기준일을 별도로 기록해야 비교가 가능합니다.

예를 들어 한국어 상담 기록에서 질문 유형을 분류하는 서비스라면 Max와 27B에 같은 질문 묶음을 전달합니다. 모델별로 정답을 맞힌 요청 수, 사람이 고친 요청 수, 출력 토큰 수를 각각 적으세요. 사고 모드가 더 긴 답변을 만들더라도 분류 결과가 같다면 그 작업에서 추가 비용을 낼 이유는 줄어듭니다. 반대로 중요한 항목의 누락이 줄면 상위 모델에 맡길 요청 유형을 정할 수 있습니다.

기존 Coder 제품을 옮기는 팀은 새로운 모델이 같은 도구 호출 구조를 반환하는지도 확인해야 합니다. 모델명을 교체한 호출이 성공했다는 사실만으로 이전 작업 전체가 호환된다고 판단하기 어렵습니다. 예약 작업과 배치 처리는 기존 모델과 새 모델을 일정 기간 나란히 실행해 결과를 비교하는 방법이 있습니다.

출처