diff --git a/megatron/core/tensor_parallel/layers.py b/megatron/core/tensor_parallel/layers.py index 4ab2aa0f639..225cdb3b465 100644 --- a/megatron/core/tensor_parallel/layers.py +++ b/megatron/core/tensor_parallel/layers.py @@ -1119,7 +1119,7 @@ def get_extra_state(self) -> None: def extra_repr(self) -> str: """Extra context to add to the module's string representation.""" tp = self.output_size // self.output_size_per_partition - use_bias = self.bias is not None and self.bias is True + use_bias = self.bias is not None return ( f"in_features={self.input_size}, " f"out_features={self.output_size}, " @@ -1381,7 +1381,7 @@ def get_extra_state(self) -> None: def extra_repr(self) -> str: """Extra context to add to the module's string representation.""" tp = self.input_size // self.input_size_per_partition - use_bias = self.bias is not None and self.bias is True + use_bias = self.bias is not None return ( f"in_features={self.input_size}, " f"out_features={self.output_size}, "