Use enum.value to check against str

2025-12-11 03:46:03 +00:00 · 2024-10-25 12:53:32 -07:00 · 2024-10-25 12:53:32 -07:00 · d0b6894a41
commit d0b6894a41
parent 8e0a4e2885
1 changed files with 7 additions and 8 deletions
--- a/llama_stack/providers/impls/meta_reference/inference/quantization/loader.py
+++ b/llama_stack/providers/impls/meta_reference/inference/quantization/loader.py
@ -20,18 +20,17 @@ from llama_models.datatypes import CheckpointQuantizationFormat
 from llama_models.llama3.api.args import ModelArgs
 from llama_models.llama3.reference_impl.model import Transformer, TransformerBlock
 from llama_models.sku_list import resolve_model
-
-from llama_stack.apis.inference import QuantizationType
-from llama_stack.apis.inference.inference import Int4QuantizationConfig
-
-from llama_stack.providers.impls.meta_reference.inference.config import (
-    MetaReferenceQuantizedInferenceConfig,
-)
 from termcolor import cprint
 from torch import nn, Tensor

 from torchao.quantization.GPTQ import Int8DynActInt4WeightLinear

+from llama_stack.apis.inference import QuantizationType
+
+from llama_stack.providers.impls.meta_reference.inference.config import (
+    MetaReferenceQuantizedInferenceConfig,
+)
+

 def swiglu_wrapper(
    self,
@ -314,7 +313,7 @@ def convert_to_int4_quantized_model(

    quantization_args = model_args.quantization_args

-    if quantization_args.scheme != "int4_weight_int8_dynamic_activation":
+    if quantization_args.scheme.value != "int4_weight_int8_dynamic_activation":
        raise NotImplementedError(
            "Only int4 quantization with 'int4_weight_int8_dynamic_activation' scheme is supported."
        )