HPC-Quantize / hexstate_quantize.c

Commit History

optimizations for normal llama
ef5ecbc
verified

CompressedGemma commited on

Fold baked into standard Q2K codebook
0415704
verified

CompressedGemma commited on

DC cancellation buff
b57acee
verified

CompressedGemma commited on

I prefer Q2 honestly.. but leaving IQ1 staging in for posterity
3ba66cb
verified

CompressedGemma commited on

Lower RMSE, improve error shaping
bc08931
verified

CompressedGemma commited on

Exponential speed-up
2e643f2
verified

CompressedGemma commited on

--analog-imatrix: Reduce error in output by 15%
c3e59d2
verified

CompressedGemma commited on

Replace Shor's with accelerated sieve
ae547e6
verified

CompressedGemma commited on

Update hexstate_quantize.c
a034f4d
verified

CompressedGemma commited on

Update hexstate_quantize.c
4384a45
verified

CompressedGemma commited on

Update hexstate_quantize.c
57f4b1d
verified

CompressedGemma commited on

Experimental support for other LLMs
5c1c396
verified

CompressedGemma commited on

It's only calibrated for Gemma, atm.
07b428c
verified

CompressedGemma commited on