docker build -t oc9-tritonserver:2.70.0 .
如果本地网络访问 GitHub release 资产不稳定,可以通过构建参数临时指定 GitHub 代理:
docker build \
--build-arg GITHUB_PROXY=https://gh-proxy.com/ \
-t oc9-tritonserver:2.70.0 .
也可以通过构建参数指定版本:
docker build \
--build-arg TRITON_VERSION=2.70.0 \
--build-arg NGC_VERSION=26.06 \
-t oc9-tritonserver:2.70.0 .
查看 Triton Server 命令行帮助:
docker run --rm oc9-tritonserver:2.70.0 tritonserver --help
查看版本环境变量:
docker run --rm oc9-tritonserver:2.70.0 bash -lc 'echo ${TRITON_VERSION}'
启动服务时需要挂载模型仓库:
docker run --rm --gpus all \
-p 8000:8000 \
-p 8001:8001 \
-p 8002:8002 \
-v /path/to/model_repository:/models \
oc9-tritonserver:2.70.0 \
tritonserver --model-repository=/models
bash test.sh oc9-tritonserver:2.70.0
测试内容包括:
tritonserver --help 可正常执行并包含 model-repository 参数Triton Inference Server 的完整推理服务需要模型仓库和对应后端依赖。GPU 推理需要宿主机安装 NVIDIA 驱动和 NVIDIA Container Toolkit,并通过 --gpus all 运行容器。
Content type
Image
Digest
sha256:7e10c4c30…
Size
1021.7 MB
Last updated
3 months ago
docker pull ocpub/oc9-tritonserver:2.70.0