Sign inSign up

elkaioptimization/vllm-nvfp4-cuda-13

By elkaioptimization

•Updated 10 months ago

vLLM NVFP4 CUDA 13 - Blackwell-optimized vLLM for NVFP4/FP8 serving

Image
0

2.6K

Tags for elkaioptimization/vllm-nvfp4-cuda-13

Sort by

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:qwen3-vl-8b-thinking-nvfp4-1.0
DigestOS/ARCHCompressed size

704c2cdeb48d

linux/arm64

17.09 GB

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:qwen3-vl-4b-thinking-nvfp4-1.0
DigestOS/ARCHCompressed size

7e0054c6ed63

linux/arm64

13.97 GB

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:qwen3-vl-2b-thinking-nvfp4-1.0
DigestOS/ARCHCompressed size

7ab530d687c5

linux/arm64

12.75 GB

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:nemotron3-30b-nvfp4-1.0
DigestOS/ARCHCompressed size

d2135f8a51d5

linux/arm64

27.27 GB

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:latest
DigestOS/ARCHCompressed size

d2135f8a51d5

linux/arm64

27.27 GB

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:1.1.0
DigestOS/ARCHCompressed size

d2135f8a51d5

linux/arm64

27.27 GB

TAG

Last pushed 10 months by mutazai

docker pull elkaioptimization/vllm-nvfp4-cuda-13:nemotron3-30b
DigestOS/ARCHCompressed size

d2135f8a51d5

linux/arm64

27.27 GB