온디바이스·로컬 추론Google (AI Edge)
LiteRT-LM 정식 출시(GA)
LiteRT-LM 정식 출시(GA) — iOS 네이티브 Swift API와 WebGPU 가속 JavaScript API 추가. Android CPU·OpenCL GPU·NPU, iOS Metal, 브라우저 WebGPU 지원. Gemma 4 기준 Android GPU 디코드 52 tok/s, iOS GPU 56 tok/s, MacBook Pro M4 Max 웹 76 tok/s, Multi-Token Prediction 최대 2.2배, iOS 메모리 607MB
왜 중요한가
온디바이스 런타임이 모바일 OS를 넘어 브라우저까지 같은 스택으로 덮는 단계. 수치는 벤더 자체 측정
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
공식 발표developers.googleblog.comhttps://developers.googleblog.com/blazing-fast-on-device-genai-with-litert-lm/2026년 8월 31일에 더한 조각 · 그 주 보기
같은 주에 나온 조각05.24맥락적 충실성과 파라메트릭 충실성이 비대칭적으로만 상관됨을 실증논문05.22Faithfulness as Information Flow 발표논문05.21AI 기본법 시행령 개정안 입법예고보도05.20Command A+ 공개공식 발표