NVIDIA NIM
GPU-optimized inference microservices for deploying AI models
Freemium
DevTools
// about NVIDIA NIM
NVIDIA NIM provides containerized, GPU-optimized inference microservices for deploying AI models. It packages models, runtimes, and optimized inference engines so developers can run generative AI services through standard APIs in cloud, data-center, and workstation environments.