SAIFIINDUSTRIES's picture
Duplicate from RedHatAI/Qwen2.5-VL-72B-Instruct-quantized.w4a16
5634f73
Raw
History Blame Contribute Delete
423 Bytes
DEFAULT_stage:
DEFAULT_modifiers:
GPTQModifier:
sequential_targets: [Qwen2_5_VLDecoderLayer]
dampening_frac: 0.03
config_groups:
config_group:
targets: [Linear]
weights: {num_bits: 4, type: int, symmetric: true, group_size: 128, strategy: group,
dynamic: false, actorder: weight, observer: minmax}
targets: Linear
ignore: [lm_head, 're:visual.*']