Commit History

Fix quantization metadata: top-level bits 2 (matches tensor data)
b22a977
verified

majentik commited on

Add MLX quantized model with KV cache compression
303f12f
verified

majentik commited on