LLMSO
[1주차-LLMSO]LLM 기초 동작 원리 (2026.08.02)
LLM 기초 · 동작 원리 들어가며 1 가중치 2 역전파 3 GPU 4 Transformer 5 텐서·임베딩 6 GPT-2 해부 7 입력 만들기 8 Attention 9 Head·MLP 10 Residual·LN 11 출력 12 Gradient 13 dtype·양자화 14 정리 마치며 LLM 서빙 스터디 1주차 · LLM 기초 학습자료 숫자 몇 개가말을 하게 되기까지. 가중치 하나짜리 신경에서 시작해서, GPT-2 Small의 124,439,808개 숫자가 다음 단어 하나를 고르는 순간까지 — 중간을 건너뛰지 않고 이어서 봅니다. 수식은 전부 실었습니다. 다만 본문에는 두지 않고 접는 상자 안에 넣었고, 기호 하나하나를 한국어로 읽는 법까지 붙였습니다. 맨 끝에 수..
[1주차-LLMSO]CH2. Large Language Model Serving (2026.08.02)
CH2 · LLM Serving 들어가며 1 LLM 발전 2 자기회귀 3 Decoder-only 4 Attention 5 생성 루프 6 KV Cache 7 Prefill·Decode 8 vLLM 9 PagedAttention 10 Streaming 11 Batching 12 정리 마치며 LLM 서빙 스터디 1주차 · CH2 학습자료 토큰 하나가 나오기까지안에서 벌어지는 일. Large Language Model Serving — Transformer 안을 열어보고, 토큰 생성 루프를 직접 돌려보고, KV Cache · PagedAttention · streaming · batching이 왜 그렇게 생겼는지까지. 수학은 거의 안 나옵니다. 나오는 것은 전부 접는 상자 안에..