Quantization(양자화)
5 posts
[AI] 양자화 트리거 백도어: FP16에선 무해하던 모델이 INT8에서 오작동하는 이유
[AI] 모델은 의도적으로 더 멍청해지고 있다 — 추론과 사실 지식의 트레이드오프
[On-Device AI] 00. Introduction: On-Device AI 경량화
[On-Device AI] 02. Quantization — 비트 수를 줄이는 법
[On-Device AI] 05. LLM Quantization — SmoothQuant와 AWQ
Home