INFO:hf-to-gguf:Exporting model...
Traceback (most recent call last):
File "/usr/src/llama.cpp/convert_hf_to_gguf.py", line 296, in <module>
main()
~~~~^^
File "/usr/src/llama.cpp/convert_hf_to_gguf.py", line 290, in main
model_instance.write()
~~~~~~~~~~~~~~~~~~~~^^
File "/usr/src/llama.cpp/conversion/base.py", line 1025, in write
self.prepare_tensors()
~~~~~~~~~~~~~~~~~~~~^^
File "/usr/src/llama.cpp/conversion/kimi_linear.py", line 144, in prepare_tensors
super().prepare_tensors()
~~~~~~~~~~~~~~~~~~~~~~~^^
File "/usr/src/llama.cpp/conversion/base.py", line 857, in prepare_tensors
self.dequant_model()
~~~~~~~~~~~~~~~~~~^^
File "/usr/src/llama.cpp/conversion/base.py", line 538, in dequant_model
raise NotImplementedError(f"Quant format {quant_format!r} for method {quant_method!r} is not yet supported")
NotImplementedError: Quant format 'mxfp4-pack-quantized' for method 'compressed-tensors' is not yet supported
Anyone have a link to the branch that can convert the mxfp4-pack-quantized source tensors?