diff --git a/conversion/nemotron.py b/conversion/nemotron.py index e5d16718511..19892ad902b 100644 --- a/conversion/nemotron.py +++ b/conversion/nemotron.py @@ -298,6 +298,10 @@ def filter_tensors(cls, item: tuple[str, Callable[[], Tensor]]) -> tuple[str, Ca ) if not keep: return None + # PEFT names adapter tensors using model.layers.*, while Nemotron-H checkpoints + # and the GGUF tensor map use backbone.layers.* + if name.startswith("model.layers.") and ".mixer." in name: + name = name.replace("model.layers.", "backbone.layers.", 1) return super().filter_tensors((name, gen)) def prepare_metadata(self, vocab_only: bool):