Error when load gguf file with vllm

#10
by tientitmu - opened

I get error:
(EngineCore pid=27366) ValueError: There is no module or parameter named 'embed_tokens.qweight_type' in Lfm2Model. The available parameters belonging to embed_tokens (VocabParallelEmbedding) are: {'embed_tokens.weight'}

When I trying to load gguf q4_0 variant to vllm with command:
vllm serve /home/xltt/models/LFM2.5-2.6B-Q4_0.gguf
--tokenizer LiquidAI/LFM2.5-2.6B
--enable-auto-tool-choice
--tool-call-parser lfm2
--enable-prefix-caching
--enforce-eager true
--max_num_seqs 32 \

It seems there are some differents from LFM2.5-2.6B to LFM2.5-2.6B-GGUF in name of weight

Sign up or log in to comment