추론 인프라·서빙Google
Gemma 3 QAT int4
Gemma 3 QAT int4 — 27B가 54GB에서 14.1GB로
왜 중요한가
양자화 인식 학습이 오픈 웨이트 배포의 표준 절차가 됨
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
공식 발표developers.googleblog.comhttps://developers.googleblog.com/en/gemma-3-quantized-aware-trained-state-of-the-art-ai-to-consumer-gpus/2026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각04.16o3 / o4-mini 정식 출시, thinking with images공식 발표04.15Preparedness Framework v2공식 발표04.15Embed 4 출시공식 발표04.15Embed v4 출시공식 발표