From 38175e429990d63a681187bfbb5eb768740a67a4 Mon Sep 17 00:00:00 2001 From: xyf5432 Date: Fri, 28 Aug 2026 12:39:50 +0800 Subject: [PATCH] Replace deprecated torch_dtype with dtype torch_dtype is deprecated in transformers >= 4.56.0 (huggingface/transformers#39782) in favor of dtype. Co-Authored-By: Claude --- llmc/models/llava_hf.py | 22 ++++++++++++++++------ 1 file changed, 16 insertions(+), 6 deletions(-) diff --git a/llmc/models/llava_hf.py b/llmc/models/llava_hf.py index 6a794a3b..f1a53f9e 100644 --- a/llmc/models/llava_hf.py +++ b/llmc/models/llava_hf.py @@ -27,12 +27,22 @@ def build_model(self): if not self.use_cache: self.vlm_model_config.text_config.use_cache = False logger.info(f'self.vlm_model_config : {self.vlm_model_config}') - self.vlm_model = LlavaForConditionalGeneration.from_pretrained( - self.model_path, - config=self.vlm_model_config, - torch_dtype=self.torch_dtype, - low_cpu_mem_usage=True, - ) + try: + # transformers >= 4.56: `dtype` is the replacement for `torch_dtype` + self.vlm_model = LlavaForConditionalGeneration.from_pretrained( + self.model_path, + config=self.vlm_model_config, + dtype=self.torch_dtype, + low_cpu_mem_usage=True, + ) + except TypeError: + # transformers < 4.56: `dtype` is not accepted yet + self.vlm_model = LlavaForConditionalGeneration.from_pretrained( + self.model_path, + config=self.vlm_model_config, + torch_dtype=self.torch_dtype, + low_cpu_mem_usage=True, + ) self.eval_name = 'LlavaHfEval' self.mm_model = self.vlm_model logger.info(f'self.vlm_model : {self.vlm_model}')