onnxruntime
★ 22KCross-platform ML inference and training accelerator. Runs models from PyTorch, TensorFlow, and classical ML libraries via ONNX, applying graph optimizations and hardware acceleration on CPU, GPU, or NPU. Widely used runtime for deploying fast, low-cost model inference.
AI Frameworks | C++ · onnx · inference-engine
View Project →