기타 — 다른 장에 자리가 없는 원문

기타 대시보드

긴 원문 한 편을 장마다 보고서로 옮겨 담습니다. 지금은 JAX 스케일링 북 열세 장 중 3장입니다.

정리일 2026-09-03 수록 3편 소스 jax-ml.github.io/scaling-book

How To Scale Your Model
칩을 늘린 만큼 처리량이 늘어나려면 통신과 메모리부터 잡아야 한다
저자들은 이 책에서 트랜스포머 모델을 대규모 하드웨어에 얹을 때 무엇이 속도를 정하는지를 원리로 풀어낸다. 강한 스케일링(칩을 늘린 만큼 처리량이 비례해서 늘어나는 것)이 무너지는 자리는 칩 사이…
2025-02-04How To Scale Your Model Part 0
How To Scale Your Model
계산이 아니라 통신이 가속기 시간을 정할 때가 더 많다
저자들은 H100의 bf16 처리량 9.89e14 FLOPs/s와 TPU v6e의 9.1e14 FLOPs/s를 놓고 계산 시간(T_math)과 통신 시간(T_comms) 중 큰 값이 실행 시간의…
2025-02-04How To Scale Your Model Part 1
How To Scale Your Model
TPU는 행렬곱 기계다 — 속도는 대역폭 네 층이 정한다
저자들은 TPU를 행렬곱 전용 회로(TensorCore)와 고대역폭 메모리(HBM)를 붙인 단순한 기계로 그린다. TPU v5e는 칩당 `2e14` bf16 FLOPs/s를 내고 VMEM은…
2025-02-04How To Scale Your Model Part 2

다른 장에 자리가 없는 원문을 싣는 곳입니다. 지금은 구글 딥마인드 팀이 쓴 How To Scale Your Model(JAX 스케일링 북) 열세 장 중 3장이 서 있습니다. 원문 한 장이 카드 한 장이고, 책의 순서대로 서 있습니다 — 1부 루프라인부터 읽으면 뒤 장의 수식이 따라옵니다.

맨 위 「한줄 코멘트」가 판단이고 그 아래가 거기까지 가는 걸음입니다. 숫자는 책에 적힌 것만 싣고, 칩 사양은 책이 인용한 공표치입니다.