Search Results for "rest api"
Sort By:
Low-latency REST API for serving text-embeddings
Simplifies the local serving of AI models from any source
The Triton Inference Server provides an optimized cloud
Unified Model Serving Framework
Openai style api for open large language models