한국어EN
온디바이스·로컬 추론Apple

M5 GPU Neural Accelerator + MLX 벤치마크 공개

M5 GPU Neural Accelerator + MLX 벤치마크 공개 — LLM 추론 첫 토큰 시간(TTFT) M4 대비 최대 4배 가속, 메모리 대역폭 153GB/s

왜 중요한가

소비자용 실리콘 세대 교체를 로컬 LLM 추론 성능으로 직접 내세우기 시작한 자료

출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요 공식 발표machinelearning.apple.comhttps://machinelearning.apple.com/research/exploring-llms-mlx-m52026년 8월 24일에 더한 조각 · 그 주 보기