diff --git a/megatron/post_training/utils.py b/megatron/post_training/utils.py index cbfb54b2cde..a8a55919c38 100644 --- a/megatron/post_training/utils.py +++ b/megatron/post_training/utils.py @@ -3,10 +3,7 @@ import inspect import os -import modelopt -import modelopt.torch.quantization as mtq import torch -from modelopt.torch.quantization.utils import is_quantized from packaging.version import Version @@ -32,6 +29,8 @@ def maybe_enable_modelopt(args): def modelopt_version_higher_than(target_version: str): """Check if Model-Optimizer is greater than this version.""" + import modelopt + info = "rank {:3}/{:3} checking if nvidia-modelopt-{} is higher than {}".format( torch.distributed.get_rank(), torch.distributed.get_world_size(), @@ -43,6 +42,8 @@ def modelopt_version_higher_than(target_version: str): def modelopt_version_at_least(target_version: str): """Check if Model-Optimizer is greater or equal than this version.""" + import modelopt + info = "rank {:3}/{:3} checking if nvidia-modelopt-{} is at least {}".format( torch.distributed.get_rank(), torch.distributed.get_world_size(), @@ -116,6 +117,9 @@ def _empty_like_if_meta(tensor: torch.Tensor, *, device: torch.device): def print_distributed_quant_summary(model, msg=""): + import modelopt.torch.quantization as mtq + from modelopt.torch.quantization.utils import is_quantized + from megatron.core import parallel_state from megatron.core.utils import unwrap_model from megatron.training import print_rank_0 diff --git a/pyproject.toml b/pyproject.toml index 49d014a0489..5d5e7d1c82d 100644 --- a/pyproject.toml +++ b/pyproject.toml @@ -13,6 +13,8 @@ include = [ "megatron.core.*", "megatron.training", "megatron.training.*", + "megatron.post_training", + "megatron.post_training.*", ] [tool.setuptools.dynamic]