NVIDIA Triton
Open-source inference server for deploying models at scale across hardware.
https://developer.nvidia.com/triton-inference-serverOpen-source inference server for deploying models at scale across hardware.
https://developer.nvidia.com/triton-inference-server