Commit History

Quantized MTP draft head (INT4/g64 affine, all 8 head matrices)
c984b29
verified

Youssofal commited on

fix: restore vision tower dropped by the forge convert lane
a94e812
verified

Youssofal commited on

Model card: FP16 sibling for M1 and M2 Macs
6de390f
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00003-of-00004.safetensors
390f3a8
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00001-of-00004.safetensors
8611d7e
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00002-of-00004.safetensors
7fd078b
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00004-of-00004.safetensors
6b1f078
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: mtp.safetensors
c41eee2
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: tokenizer.json
f62ba69
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: MTPLX_FP16_CONVERSION_MANIFEST.json
94e8d9e
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model.safetensors.index.json
2341c73
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: config.json
522ebd8
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: chat_template.jinja
ac6e704
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: mtplx_runtime.json
8f99ced
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: tokenizer_config.json
53512f0
verified

Youssofal commited on

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: generation_config.json
8192841
verified

Youssofal commited on

initial commit
23ce6d7
verified

Youssofal commited on