Run serverless GPU workloads with fast cold starts on bare-metal
Open standard for machine learning interoperability
A toolkit to optimize ML models for deployment for Keras & TensorFlow
Set of comprehensive computer vision & machine intelligence libraries
C++ library for high performance inference on NVIDIA GPUs
Deep Learning API and Server in C++14 support for Caffe, PyTorch
A scalable inference server for models optimized with OpenVINO
Guide to deploying deep-learning inference networks