Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
Deploy, manage and monitor Gen AI workloads in minutes in your own tenancy and GPU infrastructure resources.