StackFollow on WhatAreYouBuilding.AI

NVIDIA Triton

Open-source inference server for deploying models at scale across hardware.

https://developer.nvidia.com/triton-inference-server