DeepSeek V4.1-Flash: 새 요금표와 9월 14일 API 전환에서 확인할 것
DeepSeek V4.1-Flash의 새 요금표와 구형 API 전환 일정을 확인했다. 입력 8B·출력 16B의 의미, 캐시 적중에 따른 비용 차이, 실제 업무 도입 전 비교할 항목을 공식 문서 기준으로 정리한다.
자료실
모델을 검색하고, 회사별 공식 사양과 분석을 함께 살펴보세요.
긴 작업에 투입할 조건과 실제 요금
분석 읽기공개 평가와 캐시 비용으로 읽는 선택 기준
분석 읽기문서·영상 입력과 프로모션 요금
분석 읽기긴 문맥과 지역별 가격 조건
분석 읽기OpenAI 공식 문서만으로 GPT-5.6 Sol·Terra·Luna의 API ID, 105만 토큰 컨텍스트, 장문·캐시 요금과 작업별 가격값을 비교한다.
분석 읽기OpenAI 공식 문서만으로 GPT-5.6 Sol·Terra·Luna의 API ID, 105만 토큰 컨텍스트, 장문·캐시 요금과 작업별 가격값을 비교한다.
분석 읽기OpenAI 공식 문서만으로 GPT-5.6 Sol·Terra·Luna의 API ID, 105만 토큰 컨텍스트, 장문·캐시 요금과 작업별 가격값을 비교한다.
분석 읽기OpenAI 공식 모델 목록·최신 모델 가이드·가격표만으로 GPT-5.5의 105만 토큰 컨텍스트, 장문 할증, GPT-5.6·GPT-5.4 대비 비용과 유지 조건을 정리한다.
분석 읽기OpenAI 공식 문서만으로 GPT-5.5 Pro의 Responses 전용 구조, 105만 토큰 컨텍스트, 장문·Batch 요금과 기본 호출 적합성을 판단한다.
분석 읽기1.05M 긴 컨텍스트와 Tool Preamble, Compaction을 탑재해 개발과 비즈니스 판단의 표준 메인 모델로 자리잡은 GPT-5.4의 실전 성능과 비용 최적화 분업 구조를 심층 분석한다.
분석 읽기텍스트 입출력, 이미지 입력
공식 문서OpenAI 공식 모델 문서와 가격표만으로 GPT-5.4 Mini의 40만 토큰 컨텍스트, 도구 지원, 처리 한도와 비용을 확인한다. GPT-5.4·GPT-5.6 Terra·Luna와 비교해 기존 운영 유지와 신규 도입의 경계를 정리한다.
분석 읽기OpenAI 공식 모델 문서와 가격표만으로 GPT-5.4 Nano의 40만 토큰 컨텍스트, 도구 제한과 비용을 확인한다. GPT-5 nano·GPT-5.4 Mini·GPT-5.6 Luna와 비교해 기존 운영 유지와 신규 도입의 경계를 정리한다.
분석 읽기Claude Fable 5의 가격, 접근성, LiveBench 공식 방식 종합 점수 80.79, 장기 에이전트와 코딩 활용, 데이터 보존과 안전 제한을 공식 자료로 검증했다.
분석 읽기대규모 코드베이스 분석과 엔터프라이즈 업무용 Claude Opus 5의 1M 컨텍스트, Message Batches 300K 출력 한도 및 가격 조건을 분석합니다.
분석 읽기공식 문서에서 입력·출력 유형 확인
공식 문서Anthropic 공식 문서만으로 Claude Opus 4.8의 Legacy 상태, 1M 컨텍스트, 캐시·Batch 가격과 같은 단가의 Opus 5 대신 유지할 조건을 정리한다.
분석 읽기Claude Sonnet 5는 Claude Fable 5와 같은 컨텍스트·최대 출력 한도를 더 낮은 가격에 제공한다. 다만 제공된 비교 자료만으로 두 모델의 업무별 품질 차이까지 판단할 수는 없다.
분석 읽기텍스트·이미지 입력, 텍스트 출력
공식 문서텍스트·이미지 입력, 텍스트 출력
공식 문서추론 강도 설정 아키텍처 기반 Grok 4.6의 500K 컨텍스트, 표준·패스트 과금 구조 및 터미널 벤치마크 평가를 정리합니다.
분석 읽기xAI 공식 모델 문서·릴리스 노트·가격표만으로 Grok 4.5의 50만 토큰 컨텍스트, 추론 설정, 캐시 단가, 장문 요금과 세대 간 선택 조건을 정리한다.
분석 읽기xAI 공식 모델 문서·가격표·전환 안내만으로 Grok 4.3의 100만 토큰 컨텍스트, 추론 설정, 20만 토큰 장문 요금, 배치 할인과 Grok 4.5·4.6 대비 선택 조건을 정리한다.
분석 읽기xAI 공식 릴리스 노트·모델 문서·가격표로 Grok Build 0.1의 early access 지위, 256K 컨텍스트, 에이전트 기능, Grok 4.3 대비 단가와 운영 제약을 정리한다.
분석 읽기1.6T 총 파라미터 MoE 구조의 DeepSeek-V4-Pro(0813)의 1M 컨텍스트, 384K 최대 출력 및 피크·오프피크 과금 조건을 분석합니다.
분석 읽기284B MoE 아키텍처 기반 DeepSeek-V4-Flash(0731)의 1M 컨텍스트, 384K 출력, 오프피크·피크 요율 및 Vision 확장성을 분석합니다.
분석 읽기284B MoE 아키텍처 기반 DeepSeek-V4-Flash(0731)의 1M 컨텍스트, 384K 출력, 오프피크·피크 요율 및 Vision 확장성을 분석합니다.
분석 읽기텍스트·이미지·문서 입력, 텍스트 출력
공식 문서텍스트·이미지·문서 입력, 텍스트 출력
공식 문서공식 문서에서 입력·출력 유형 확인
공식 문서공식 미공개 (출처 확인: 2026-07-11)
공식 문서공식 미공개 (출처 확인: 2026-07-11)
공식 문서Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
분석 읽기Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
분석 읽기Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
분석 읽기Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
분석 읽기Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
분석 읽기사전학습 없이 추론 알고리즘 개선으로 DeepSWE를 65.3%까지 끌어올린 Gemini 3.7 Flash의 성능과 2026년 말까지 한시 적용되는 반값 프로모션의 실전 도입 조건을 분석한다.
분석 읽기Google 공식 최신 모델 가이드·가격표·모델 목록만으로 Gemini 3.6 Flash의 현재 세대 위치, 2026년 한시 요금, 3.5·3.7 Flash 대비 선택 조건과 운영 비용을 정리한다.
분석 읽기Google 공식 모델 목록·개별 사양·최신 모델 가이드·가격표로 Gemini 3.5 Flash의 Stable 지위, 100만 토큰 컨텍스트, 도구 지원, 3.7 이전 조건과 운영 비용을 정리한다.
분석 읽기Google 공식 모델 목록·개별 사양·최신 모델 가이드·가격표로 Gemini 3.5 Flash-Lite의 Stable 지위, 멀티모달 입력, 처리 방식별 비용과 적합한 작업을 정리한다.
분석 읽기Flash 입력은 100만 토큰당 $0.75, Pro Preview는 20만 토큰 이하에서도 $2다. Flash가 한 번에 끝내지 못할 때만 올리고, 200k를 넘기면 입력 $4·출력 $18이다.
분석 읽기복합 소프트웨어 엔지니어링과 보안 분석을 위한 GLM-5.3의 1M 컨텍스트, 128K 출력, 상시 사고 모드 및 가격 체계를 정리합니다.
분석 읽기대규모 트래픽 처리를 위한 GLM-5.3-Flash의 1M 컨텍스트, 128K 출력, 50% 프로모션 할인 요율 및 정가 환원 일정을 분석합니다.
분석 읽기입력 맥락과 기능 연결을 중심으로 코딩 에이전트의 비용 선택지를 살핀다. DeepSeek-V4-Pro와 GPT-5.4를 가격, 입력 방식, 확인된 벤치마크 범위에서 함께 비교한다.
분석 읽기독자적 MSA 아키텍처 기반 MiniMax M3의 1M 컨텍스트, 멀티모달 코딩, OpenAI·Anthropic 호환 엔드포인트 및 토큰 플랜 과금을 정리합니다.
분석 읽기공식 문서에서 입력·출력 유형 확인
공식 문서공식 문서에서 입력·출력 유형 확인
공식 문서오픈 가중치와 상용 API로 제공되는 Kimi K3의 1M 컨텍스트, 시각·텍스트 통합 네이티브 인코딩, 상시 추론 체계를 분석합니다.
분석 읽기Moonshot 공식 모델 카드·설정·API·가격 문서로 Kimi K2.7 Code의 256K 컨텍스트, 1T MoE, 강제 thinking, 영상 입력, 비교 점수와 운영 비용을 검토한다.
분석 읽기알리바바의 2026년 고밀도 모델 Qwen3.8 27B의 1M 컨텍스트 지원, 공식 CNY 단가 체계 및 실무 엔지니어링 배치 조건을 분석합니다.
분석 읽기공식 문서에서 입력·출력 유형 확인
공식 문서공식 문서에서 입력·출력 유형 확인
공식 문서Qwen3.7 Max는 긴 컨텍스트와 텍스트 입출력을 중심으로 검토할 수 있는 글로벌 API 모델이다. 공식 CNY 가격과 LiveBench의 범주 평균 지표를 GPT-5.4, Gemini 3.1 Pro와 함께 살펴 실제 선택 조건을 정리한다.
분석 읽기텍스트·이미지·비디오 입력, 텍스트 출력
공식 문서텍스트·이미지·비디오 입력, 텍스트 출력
공식 문서싱가포르 입력은 256K 이하 $0.50, 넘기면 $2다. 베이징은 $0.276에서 $1.101로 뛰고, 구간이 바뀌면 그 요청의 모든 토큰에 상위 단가가 적용된다.
분석 읽기텍스트·이미지·비디오 입력, 텍스트 출력
공식 문서텍스트·이미지·오디오·비디오 입력, 텍스트·음성 출력
공식 문서텍스트·이미지·비디오 입력, 텍스트 출력
공식 문서텍스트·이미지·비디오 입력, 텍스트 출력
공식 문서텍스트 입출력
공식 문서텍스트 입출력
공식 문서30B 단일 GPU 오픈 모델 Muse Glimmer와 Meta Model API 프리뷰 Spark 1.1, 리더보드 관측 모델 1.3의 사실 관계와 배포 조건을 분석합니다.
분석 읽기30B 단일 GPU 오픈 모델 Muse Glimmer와 Meta Model API 프리뷰 Spark 1.1, 리더보드 관측 모델 1.3의 사실 관계와 배포 조건을 분석합니다.
분석 읽기30B 단일 GPU 오픈 모델 Muse Glimmer와 Meta Model API 프리뷰 Spark 1.1, 리더보드 관측 모델 1.3의 사실 관계와 배포 조건을 분석합니다.
분석 읽기모델명을 짧게 입력하거나 다른 회사를 선택해 보세요.
전체 글에서 검색하기상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
상태: 2026-09-07 공식 자료 확인 · 확인:
모델별 제공 상태와 요금 조건을 함께 확인하세요. 공개 가중치와 호스팅 API 과금은 별개입니다.
DeepSeek V4.1-Flash의 새 요금표와 구형 API 전환 일정을 확인했다. 입력 8B·출력 16B의 의미, 캐시 적중에 따른 비용 차이, 실제 업무 도입 전 비교할 항목을 공식 문서 기준으로 정리한다.
9월 9일 공개된 Anthropic의 추가 조사와 Mythos 5 실행 기록을 확인했다. 사건 발생일과 발표일, 회사의 조사와 독립 검증을 구분하고 자동화 운영에 적용할 판단 기준을 정리한다.
ChatGPT Images 2.5의 Sketch·댓글 편집과 Flare·Sunburst API를 구분해 살펴봅니다. 두 모델의 같은 토큰 단가, 실제 비용 계산법, 최대 50% 지연 단축 발표의 의미와 도입 전 확인할 항목을 정리했습니다.
Google이 9월 4일 Lyria 3.5를 Gemini 앱과 API에 공개했습니다. 공식 자료로 30초 클립과 긴 곡의 구분, 44.1kHz 출력, 프리뷰 상태와 API 예제의 모델명 차이를 확인하고 활용 순서를 정리합니다.
OpenAI의 9월 6일 연구 가속 보고서를 읽고 에이전트 가동 시간과 실제 성과의 차이를 짚습니다. 내부 사용액의 의미, 과업별 측정 방법, 작은 팀에서 확인할 지표를 정리했습니다.
30B 단일 GPU 오픈 모델 Muse Glimmer와 Meta Model API 프리뷰 Spark 1.1, 리더보드 관측 모델 1.3의 사실 관계와 배포 조건을 분석합니다.
독자적 MSA 아키텍처 기반 MiniMax M3의 1M 컨텍스트, 멀티모달 코딩, OpenAI·Anthropic 호환 엔드포인트 및 토큰 플랜 과금을 정리합니다.
대규모 트래픽 처리를 위한 GLM-5.3-Flash의 1M 컨텍스트, 128K 출력, 50% 프로모션 할인 요율 및 정가 환원 일정을 분석합니다.
복합 소프트웨어 엔지니어링과 보안 분석을 위한 GLM-5.3의 1M 컨텍스트, 128K 출력, 상시 사고 모드 및 가격 체계를 정리합니다.
오픈 가중치와 상용 API로 제공되는 Kimi K3의 1M 컨텍스트, 시각·텍스트 통합 네이티브 인코딩, 상시 추론 체계를 분석합니다.
알리바바의 2026년 고밀도 모델 Qwen3.8 27B의 1M 컨텍스트 지원, 공식 CNY 단가 체계 및 실무 엔지니어링 배치 조건을 분석합니다.
알리바바의 2026년 9월 플래그십 Qwen3.8 Max(0902)의 1M 컨텍스트, 비사고·사고 모드, 공식 CNY 요율 및 배치 할인 조건을 분석합니다.
284B MoE 아키텍처 기반 DeepSeek-V4-Flash(0731)의 1M 컨텍스트, 384K 출력, 오프피크·피크 요율 및 Vision 확장성을 분석합니다.
1.6T 총 파라미터 MoE 구조의 DeepSeek-V4-Pro(0813)의 1M 컨텍스트, 384K 최대 출력 및 피크·오프피크 과금 조건을 분석합니다.
추론 강도 설정 아키텍처 기반 Grok 4.6의 500K 컨텍스트, 표준·패스트 과금 구조 및 터미널 벤치마크 평가를 정리합니다.
Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
Google의 2026년 9월 정식 모델 Gemini 3.8 Flash의 1M 컨텍스트, 64K 출력, 비디오·오디오 직접 처리 및 프로모션 가격 체계를 정리합니다.
대규모 코드베이스 분석과 엔터프라이즈 업무용 Claude Opus 5의 1M 컨텍스트, Message Batches 300K 출력 한도 및 가격 조건을 분석합니다.
장기 에이전트 특화 모델 Claude Fable 5.1의 1M 컨텍스트, 상시 적응형 추론, 공식 캐시 읽기 요율과 벤치마크 평가를 정리합니다.
OpenAI의 최상위 모델 GPT-6 Astra의 105만 토큰 컨텍스트, 5단계 사고 강도, 272K 초과 할증 요금 체계 및 벤치마크 결과를 분석합니다.
배포 조건을 직접 확인해야 하는 30B 공개 모델 Muse Glimmer와 클라우드 프리뷰 Muse Spark 1.1 및 리더보드 관측 모델 1.3의 현황을 정리합니다.
Mistral Medium 3.5와 Small 4의 오픈 가중치 및 상용 API 조건과 구형 모델 퇴역 이후의 전문 모델 라인업을 분석합니다.
독자적 MSA 아키텍처 기반 100만 토큰 멀티모달 코딩 모델 MiniMax M3의 사양과 토큰 플랜 과금 체계를 분석합니다.
소프트웨어 엔지니어링 특화 플래그십 GLM-5.3과 한시적 50% 프로모션 요금의 GLM-5.3-Flash의 사양, 요금 체계 및 벤치마크 결과를 정리합니다.