diff --git a/utils/convert-bitnet-embedding-to-gguf.py b/utils/convert-bitnet-embedding-to-gguf.py index 3a9e48924..fe479d25f 100644 --- a/utils/convert-bitnet-embedding-to-gguf.py +++ b/utils/convert-bitnet-embedding-to-gguf.py @@ -535,7 +535,7 @@ def main(): elif args.outtype == "f16": ftype = 1 # GGML F16 else: # i2_s - ftype = 40 # LLAMA_FTYPE_MOSTLY_I2_S + ftype = 41 # LLAMA_FTYPE_MOSTLY_I2_S logger.info(f"Converting {dir_model.name} (arch={arch}) to GGUF ({args.outtype})") diff --git a/utils/convert-hf-to-gguf-bitnet.py b/utils/convert-hf-to-gguf-bitnet.py index b11e831b9..3d3e795a9 100644 --- a/utils/convert-hf-to-gguf-bitnet.py +++ b/utils/convert-hf-to-gguf-bitnet.py @@ -156,7 +156,7 @@ def set_gguf_parameters(self): # Map ggml tensor type to llama ftype for general.file_type metadata ftype_val = self.ftype if self.ftype == gguf.GGMLQuantizationType.I2_S: - ftype_val = 40 # LLAMA_FTYPE_MOSTLY_I2_S (matches official model) + ftype_val = 41 # LLAMA_FTYPE_MOSTLY_I2_S self.gguf_writer.add_file_type(ftype_val) logger.info(f"gguf: file type = {ftype_val}")