# Load quantize config, model and tokenizerquantize_config = BaseQuantizeConfig( bits=4, group_size=128, damp_percent=0.01, desc_act=False,)model = AutoGPTQForCausalLM.from_pretrained(model_id, quantize_config)tokenizer = AutoTokenizer.from_pretrained(model_id)