Image-Text-to-Text
Transformers
Safetensors
English
nanbeige_vlm
vlm
nanbeige
siglip
conversational
custom_code
SkyAsl commited on
Commit
a7afeba
·
verified ·
1 Parent(s): 47650fe

Upload modeling_nanbeige_vlm.py with huggingface_hub

Browse files
Files changed (1) hide show
  1. modeling_nanbeige_vlm.py +3 -1
modeling_nanbeige_vlm.py CHANGED
@@ -82,7 +82,7 @@ class NanbeigeVLMModel(PreTrainedModel):
82
 
83
  # ── Vision tower (frozen at Stage 1) ──────────────────────────────
84
  self.vision_tower = SiglipVisionModel.from_pretrained(
85
- config.vision_model_id, torch_dtype=torch.bfloat16
86
  )
87
  self.vision_tower.requires_grad_(False)
88
  vision_hidden_size = self.vision_tower.config.hidden_size
@@ -94,12 +94,14 @@ class NanbeigeVLMModel(PreTrainedModel):
94
  trust_remote_code=True,
95
  torch_dtype=torch.bfloat16,
96
  attn_implementation="flash_attention_2",
 
97
  )
98
  except (ImportError, ValueError):
99
  self.language_model = AutoModelForCausalLM.from_pretrained(
100
  config.llm_model_id,
101
  trust_remote_code=True,
102
  torch_dtype=torch.bfloat16,
 
103
  )
104
  self.language_model.requires_grad_(False)
105
  llm_hidden_size = self.language_model.config.hidden_size
 
82
 
83
  # ── Vision tower (frozen at Stage 1) ──────────────────────────────
84
  self.vision_tower = SiglipVisionModel.from_pretrained(
85
+ config.vision_model_id, torch_dtype=torch.bfloat16, device_map=None
86
  )
87
  self.vision_tower.requires_grad_(False)
88
  vision_hidden_size = self.vision_tower.config.hidden_size
 
94
  trust_remote_code=True,
95
  torch_dtype=torch.bfloat16,
96
  attn_implementation="flash_attention_2",
97
+ device_map=None
98
  )
99
  except (ImportError, ValueError):
100
  self.language_model = AutoModelForCausalLM.from_pretrained(
101
  config.llm_model_id,
102
  trust_remote_code=True,
103
  torch_dtype=torch.bfloat16,
104
+ device_map=None
105
  )
106
  self.language_model.requires_grad_(False)
107
  llm_hidden_size = self.language_model.config.hidden_size