Marketplace

By Use Case Marketplace

Compare By Use Case products across curated subcategories and trusted providers

Products
15,460
Subcategories
699

Selected subcategory

Model Deployment

Compare By Use Case products across curated subcategories and trusted providers

Explore By Use Case with structured category paths, practical filters, and independent product data

Showing 13–24 of 76

Active filtersOpen sourceClear all

PicoLM

by RightNow

Run a 1-billion parameter LLM on a $10 board with 256MB RAM

Model DeploymentMLOps & Experiment TrackingOpen Source

torch2trt

by NVIDIA AI IOT

An easy to use PyTorch to TensorRT converter

Model DeploymentMLOps & Experiment TrackingOpen Source

Ao

by PyTorch

PyTorch native quantization for training and inference

Model DeploymentMLOps & Experiment TrackingOpen Source

NNPACK

by Maratyszcza

Acceleration package for neural networks on multi-core CPUs

Model DeploymentMLOps & Experiment TrackingOpen Source

Sonar

by dphnAI

Large-scale LLM inference engine

Model DeploymentMLOps & Experiment TrackingOpen Source

Claudex Loop

by chaseai-yt

Claudex Loop facilitates independent code reviews and inspections within a structured workflow.

Model DeploymentMLOps & Experiment TrackingOpen Source

Agibot X1 Infer

by AgibotTech

The inference module for AgiBot X1.

Model DeploymentMLOps & Experiment TrackingOpen Source

TurboQuant

by 0xSero

TurboQuant: Near-optimal KV cache quantization for LLM inference (3-bit keys, 2-bit values) with Triton kernels + vLLM integration

Model DeploymentMLOps & Experiment TrackingOpen Source

Once For All

by MIT HAN Lab

[ICLR 2020] Once for All: Train One Network and Specialize it for Efficient Deployment

Model DeploymentMLOps & Experiment TrackingOpen Source

AICI

by Microsoft

AICI: Prompts as (Wasm) Programs

Model DeploymentMLOps & Experiment TrackingOpen Source

Optimum

by Hugging Face

🚀 Accelerate inference and training of 🤗 Transformers, Diffusers, TIMM and Sentence Transformers with easy to use hardware optimization tools

Model DeploymentMLOps & Experiment TrackingOpen Source

XNNPACK

by Google

High-efficiency floating-point neural network inference operators for mobile, server, and Web

Model DeploymentMLOps & Experiment TrackingOpen Source

Frequently asked questions