Text Generation
Transformers
Safetensors
PyTorch
nemotron_h
nvidia
nemotron-3
latent-moe
mtp
conversational
Eval Results
Chris-Alexiuk commited on
Commit
6f253ff
·
verified ·
1 Parent(s): cec7f2d

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +1 -1
README.md CHANGED
@@ -391,7 +391,7 @@ docker run -d --name nemotron-ultra-sglang \
391
  -e SAFETENSORS_FAST_GPU=1 \
392
  -e NVIDIA_TF32_OVERRIDE=1 \
393
  -e SGLANG_DISABLE_DEEP_GEMM=1 \
394
- lmsysorg/sglang:v0.5.11 \
395
  python3 -m sglang.launch_server \
396
  --model-path /model \
397
  --host 0.0.0.0 \
 
391
  -e SAFETENSORS_FAST_GPU=1 \
392
  -e NVIDIA_TF32_OVERRIDE=1 \
393
  -e SGLANG_DISABLE_DEEP_GEMM=1 \
394
+ lmsysorg/sglang:v0.5.12.post1 \
395
  python3 -m sglang.launch_server \
396
  --model-path /model \
397
  --host 0.0.0.0 \