Instructions to use tencent/HY-MT1.5-1.8B-GPTQ-Int4 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use tencent/HY-MT1.5-1.8B-GPTQ-Int4 with Transformers:
# Use a pipeline as a high-level helper # Warning: Pipeline type "translation" is no longer supported in transformers v5. # You must load the model directly (see below) or downgrade to v4.x with: # pip install "transformers<5.0.0" from transformers import pipeline pipe = pipeline("translation", model="tencent/HY-MT1.5-1.8B-GPTQ-Int4")# pip install -U transformers accelerate # Load model directly from transformers import AutoTokenizer, AutoModelForCausalLM tokenizer = AutoTokenizer.from_pretrained("tencent/HY-MT1.5-1.8B-GPTQ-Int4") model = AutoModelForCausalLM.from_pretrained("tencent/HY-MT1.5-1.8B-GPTQ-Int4", device_map="auto") - Notebooks
- Google Colab
- Kaggle
optimum 'QuantizeConfig' is not defined
File "M:\python_embeded\Lib\site-packages\transformers\quantizers\quantizer_gptq.py", line 52, in init
self.optimum File "M:\python_embeded\Lib\site-packages\transformers\quantizers\quantizer_gptq.py", line 52, in init
self.optimum_quantizer = GPTQQuantizer.from_dict(self.quantization_config.to_dict_optimum())
^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
File "M:\python_embeded\Lib\site-packages\optimum\gptq\quantizer.py", line 251, in from_dict
return cls(**config_dict)
^^^^^^^^^^^^^^^^^^
File "M:\python_embeded\Lib\site-packages\optimum\gptq\quantizer.py", line 168, in init
self.quantizeConfig = QuantizeConfig(
^^^^^^^^^^^^^^
NameError: name 'QuantizeConfig' is not defined
_quantizer = GPTQQuantizer.from_dict(self.quantization_config.to_dict_optimum())
^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
File "M:\python_embeded\Lib\site-packages\optimum\gptq\quantizer.py", line 251, in from_dict
return cls(**config_dict)
^^^^^^^^^^^^^^^^^^
File "M:\python_embeded\Lib\site-packages\optimum\gptq\quantizer.py", line 168, in init
self.quantizeConfig = QuantizeConfig(
^^^^^^^^^^^^^^
NameError: name 'QuantizeConfig' is not defined
感谢回复,第一次用这个量化,貌似windows不支持。两个包都没法装,有torch也提示找不到torch
transformers\quantizers\quantizer_gptq.py", line 67, in validate_environment
raise ImportError(
ImportError: Loading a GPTQ quantized model requires gptqmodel (pip install gptqmodel) or auto-gptq (pip install auto-gptq) library.