Google Gemma 4: 자체 호스팅 환경을 위한 256K 오픈 가중치 모델
Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
카테고리
Gemini, DeepMind, Veo, AI 검색, AI Studio 업데이트
Google DeepMind의 최신 오픈 가중치 Gemma 4 패밀리(31B Dense, 26B A4B MoE, 12B Unified)의 사양과 온프레미스 실행 조건을 분석합니다.
Google의 2026년 9월 정식 모델 Gemini 3.8 Flash의 1M 컨텍스트, 64K 출력, 비디오·오디오 직접 처리 및 프로모션 가격 체계를 정리합니다.
도입기 프로모션 요금의 Gemini 3.8 Flash와 온프레미스 인프라 구축용 오픈 모델 Gemma 4 패밀리의 사양과 실행 조건을 분석합니다.
Flash 입력은 100만 토큰당 $0.75, Pro Preview는 20만 토큰 이하에서도 $2다. Flash가 한 번에 끝내지 못할 때만 올리고, 200k를 넘기면 입력 $4·출력 $18이다.
Google 공식 모델 목록·개별 사양·최신 모델 가이드·가격표로 Gemini 3.5 Flash-Lite의 Stable 지위, 멀티모달 입력, 처리 방식별 비용과 적합한 작업을 정리한다.
Google 공식 모델 목록·개별 사양·최신 모델 가이드·가격표로 Gemini 3.5 Flash의 Stable 지위, 100만 토큰 컨텍스트, 도구 지원, 3.7 이전 조건과 운영 비용을 정리한다.
Google 공식 최신 모델 가이드·가격표·모델 목록만으로 Gemini 3.6 Flash의 현재 세대 위치, 2026년 한시 요금, 3.5·3.7 Flash 대비 선택 조건과 운영 비용을 정리한다.
사전학습 없이 추론 알고리즘 개선으로 DeepSWE를 65.3%까지 끌어올린 Gemini 3.7 Flash의 성능과 2026년 말까지 한시 적용되는 반값 프로모션의 실전 도입 조건을 분석한다.