
ddh0andSigbjørn Skjæret
492bc31978
quantize : add --dry-run option (#19526)
* clean slate for branch
* use 6 characters for tensor dims
* add --dry-run to llama-quantize
* use 6 characters for tensor dims (cont.)
* no need to re-calculate ggml_nbytes for tensor
* fix indent
* show model and quant BPW when quant completes
* add example to --help
* new function `tensor_requires_imatrix`, add courtesy warning about imatrix
* missing __func__, move imatrix flag set
* logic error
* fixup tensor_requires_imatrix
* add missing `GGML_TYPE`s
* simplify and rename `tensor_type_requires_imatrix`
* simplify for style
* add back Q2_K edge case for imatrix
* guard ftype imatrix warning
* comment ref #12557
* remove per @compilade
* remove unused `params` parameter
* move `bool dry_run` per GG
* move `bool dry_run` per GG
* Update src/llama-quant.cpp
Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>
* Update src/llama-quant.cpp
Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>
* Update src/llama-quant.cpp
Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>
---------
Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>
2026-02-20 09:20:16 +01:00
..
2025-12-22 11:00:37 +01:00
2026-02-13 12:49:10 +01:00
2026-02-04 05:43:28 +01:00
2026-02-02 08:38:55 +02:00
2026-02-02 08:38:55 +02:00
2026-01-24 22:13:08 +01:00
2025-12-10 15:28:59 +01:00
2025-12-14 10:11:13 +02:00
2026-01-16 09:46:51 +01:00
2026-02-19 17:05:25 +01:00
2026-02-16 18:44:44 +02:00
2026-02-20 09:20:16 +01:00
2026-02-14 09:47:01 +01:00
2026-02-19 22:53:42 +01:00
2025-09-16 09:54:44 +07:00
2026-02-11 07:52:20 +02:00
2026-01-09 16:43:26 +01:00