Skip to content

warpspaceinc/efficient-ml-practice

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

7 Commits
 
 
 
 
 
 

Repository files navigation

efficient-ml-practice

효율적 딥러닝(신경망 양자화 등) 실습 노트북 모음. Google Colab에서 바로 실행할 수 있습니다.

노트북

노트북 내용 열기
notebooks/kmeans-quantization.ipynb K-Means 양자화 (scikit-learn, 비균등) — 비슷한 값을 대표값으로 묶기 Open In Colab
notebooks/linear-quantization.ipynb Linear 양자화 (torch.fake_quantize, 균등) — 아핀 매핑 r = S(q − Z) Open In Colab
notebooks/pruning.ipynb 프루닝(가지치기) — OBD saliency vs magnitude, 재학습으로 압축, 2:4 structured sparsity Open In Colab
notebooks/low-bit-quantization.ipynb 저비트 양자화 PTQ 심화 — FP4·MXFP4 그룹 양자화(micro-tensor scaling), outlier 실험, KL clipping, AdaRound, Hadamard 회전 Open In Colab
notebooks/qat.ipynb QAT(양자화 인지 학습) — fake quantization, STE(autograd.Function), PTQ vs QAT 비교 Open In Colab

Open in Colab 배지를 누르면 Colab에서 바로 열립니다. 별도 설치 없이 상단부터 순서대로 실행하면 됩니다 (런타임 → 모두 실행).

About

효율적 딥러닝(신경망 양자화 등) 실습 노트북 모음

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

No releases published

Packages

 
 
 

Contributors