GPTQModel
LLM model quantization (compression) toolkit with HW acceleration support for Nvidia, AMD, Intel GPU and Intel/AMD/Apple CPU via HF, vLLM, and SGLang.
Activity
- Latest release
- 2h ago
- Total releases
- 63
- Cadence
- ~5 days
- Last 12 months
- 24
Reach
- Stars
- 1.3k
Details
- License
- Apache-2.0
- First release
- Aug 15, 2024
Releases
| Version | Released | |
|---|---|---|
7.5.0
minor
| ||
7.4.0
minor
| ||
7.3.6
patch
| ||
7.3.5
patch
| ||
7.3.4
patch
| ||
7.3.2
patch
| ||
7.3.1
minor
| ||
7.2.0
minor
| ||
7.1.0
minor
| ||
7.0.0
major
| ||
6.0.3
patch
| ||
6.0.0
major
| ||
5.8.0
minor
| ||
5.7.0
minor
| ||
5.6.12
patch
| ||
5.6.10
patch
| ||
5.6.8
patch
| ||
5.6.6
patch
| ||
5.6.2
patch
| ||
5.6.0
minor
| ||
5.4.2
patch
| ||
5.4.0
minor
| ||
5.2.0
minor
| ||
5.0.0
major
| ||
4.2.5
patch
| ||
4.2.0
minor
| ||
4.1.0
minor
| ||
4.0.0
major
| ||
2.2.0
minor
| ||
2.1.0
minor
| ||
2.0.0
major
| ||
1.9.0
minor
| ||
1.8.1
patch
| ||
1.8.0
minor
| ||
1.7.4
patch
| ||
1.7.3
patch
| ||
1.7.2
patch
| ||
1.7.0
minor
| ||
1.6.0
minor
| ||
1.5.1
patch
| ||
1.5.0
minor
| ||
1.4.5
patch
| ||
1.4.4
patch
| ||
1.4.3
patch
| ||
1.4.2
patch
| ||
1.4.1
patch
| ||
1.4.0
minor
| ||
1.3.1
patch
| ||
1.3.0
minor
| ||
1.2.3
patch
|
1–50 of 63