LLM Reference
Concepts & capability filters

Activation-aware Weight Quantization

AWQ (Activation-aware Weight Quantization) quantizes LLM weights based on activation statistics, preserving the most important weights for model performance.

Category
Not classified
Difficulty
Not classified
Aliases
None tracked
Last reviewed
2026-07-02

Key facts

  • It achieves higher accuracy than uniform quantization at lower bit-widths by adapting quantization granularity to activation patterns.