NVIDIA Triton系列06-安装用户端软件

最新推荐文章于 2025-09-09 00:21:06 发布

原创最新推荐文章于 2025-09-09 00:21:06 发布 · 1.3k 阅读

12 ·

CC 4.0 BY-SA版权

文章标签：

#Triton #nvidia

NVIDIA Triton 专栏收录该内容

15 篇文章

订阅专栏

NVIDIA Triton系列06-安装用户端软件

B站：肆十二-的个人空间-肆十二-个人主页-哔哩哔哩视频 (bilibili.com)

博客：肆十二-优快云博客

问答：(10 封私信 / 72 条消息) 肆十二 - 知乎 (zhihu.com)

在前面的文章中，已经带着读者创建好 Triton 的模型仓、安装并执行 Triton 推理服务器软件，接下来就是要安装 Triton 用户端软件，对服务器提出推理请求（requests），才能触发服务器执行推理计算的任务。

由于用户端的功能是在向服务器提出推理需求，本身并不参与计算，因此不用考虑设备性能或者是否装载 GPU 设备，即便是一台最基本的 Windows 上网本都能使用，只要安装合适的用户端软件就可以。

为了适应更多种使用场景，Triton 用户端支持 C++/Python/Java/GO 等通用性高的在编程语言，底层还支持 HTTP/REST 与 gRPC 通讯协议，甚至还支持 SSL/TLS 加密选项，以及多种在线压缩（on-wire compression）算法，内容是相当丰富并且多元化，完整的内容可以在 https://github.com/triton-inference-server/client 开源仓里找到，本文只先提供 Python 用户端的部分。

与服务器的安装方式类似，NVIDIA 提供以下 4 种安装方式：

1. 源代码编译

这种方式需要从 https://github.com/triton-inference-server/client 下载源代码，执行步骤在 https://github.com/triton-inference-server/client#build-using-cmake 环节，通常会遇到的麻烦是步骤繁琐，并且出错率较高，因此并不推荐使用这个方法。

2. 可执行文件

Triton 开发团队为使用者提供编译好的可执行文件，包括 Ubuntu 20.04、Jetpack 与 Windows 平台，可以在 https://github.com/triton-inference-server/server/releases/ 上获取，每个版本都会提供对应 NGC 容器的版本，如下图：

然后到下面的“Assets”选择合适的版本：

以装载 Jetpack 5 的 Orin 为例，就下载 tritonserver2.26.0-jetpack5.0.2.tgz(1.13GB) 压缩文件到本机上，然后解压缩到指定目录下就可以，例如 ${HOME}/triton 目录，会生成、、、、、等 6 个目录，用户端的可执行文件在目录下，目前有将近 30 个终端功能。

现在要使用 image_client 这个最基础的识别终端软件，对 qa/images/mug.jpg（下图）这张图片进行推理。

请先确认 Triton 服务器软件已经启动并且处于等待请求的状态，现在请开启另一个命令终端，输入以下指令提交推理请求：

cd ${HOME}/triton./clients/bin/image_client -m densenet_onnx -c 3 -s INCEPTION qa/images/mug.jpg

这道指令使用 clients/bin/image_client 终端，请求服务器使用 densenet_onnx 推理模型，对 qa/images/mug.jpg（下图）进行识别。这里的参数“-c 3”是要求识别的分类最多可以到 3 项，指令执行结果如下，表示正确识别图像的 3 个可能分类：

其他终端软件会在后面文章中说明。

3. Docker容器版用户端

在安装 Triton 服务器软件一文中已经提过，可以在 NGC 服务器上可以找到 Triton 的相关镜像，其中 year-xy-py3-sdk 里就有提供用户端软件。这里同样在 Jetson AGX Orin 上用 22.09-py3-sdk 镜像做示范，请先执行以下指令下载这个镜像并进入这个容器：

docker pull nvcr.io/nvidia/tritonserver:22.09-py3-sdkdocker run -it --rm --net=host nvcr.io/nvidia/tritonserver:22.09-py3-sdk

进入容器之后，执行以下指令进行图像推理任务：

./install/bin/image_client -m densenet_onnx -c 3 -s INCEPTION ./images/mug.jpg

执行结果应该会看到如下截屏的内容，表示在这里对 Triton 服务器提出的推理请求，得到正确的计算结果。