ONNX Runtime
- Cross-platform inference engine for ONNX graphs on CPU and GPU.
- Execution providers plug in CUDA, TensorRT, DirectML, and more.
- One exported model targets many devices without op rewrites.
- Common behind mobile, edge, and server ONNX deployments.