Commit History

Add Serving mode on Blackwell section — clarify weight-only FP4 reality on GB10+vLLM
e026a52
verified

Kaleto commited on

Remove misleading W4A16 quality claim — measured no-op in modelopt+MARLIN path
051e394
verified

Kaleto commited on

Update model card for NVFP4A16 (W4A16) switch + re-bench numbers
7d9fe44
verified

Kaleto commited on

Switch to NVFP4A16 (W4A16) — weight-only quant, 2-4x better KLD than W4A4 per community feedback
aa41a75
verified

Kaleto commited on

Add special_tokens_map.json (missed during merge)
bc1c0cd
verified

Kaleto commited on

Add model-00008-of-00008.safetensors
bd28e3f
verified

Kaleto commited on

Add model-00007-of-00008.safetensors
6522e48
verified

Kaleto commited on

Add model-00006-of-00008.safetensors
b1cd55e
verified

Kaleto commited on

Add model-00005-of-00008.safetensors
a158993
verified

Kaleto commited on

Add model-00004-of-00008.safetensors
d1fa2a0
verified

Kaleto commited on

Add model-00003-of-00008.safetensors
0bfadfb
verified

Kaleto commited on

Add model-00002-of-00008.safetensors
8e3b64a
verified

Kaleto commited on

Add model-00001-of-00008.safetensors
363912a
verified

Kaleto commited on

Add tokenizer.json
3fc38e7
verified

Kaleto commited on

Add tokenizer_config.json
7b21465
verified

Kaleto commited on

Add model.safetensors.index.json
cfcf600
verified

Kaleto commited on

Add hf_quant_config.json
9bb9f7a
verified

Kaleto commited on

Add generation_config.json
a192f7a
verified

Kaleto commited on

Add config.json
7d9c9f0
verified

Kaleto commited on

Initial release: Llama-3.3-70B-Instruct-NVFP4
4b70d9d
verified

Kaleto commited on

initial commit
c71087c
verified

Kaleto commited on