Add vLLM NVFP4 lm_head patch (ParallelLMHead -> ReplicatedLinear) bacdce3 verified demon-zombie commited on Jun 12
Add model card (all-FP4 max-speed variant; quality note; serve + lm_head patch) 5e50c1e verified demon-zombie commited on Jun 12
Add ParallelLMHead to quantization targets for vLLM compat 02083ec verified demon-zombie commited on May 17