meta-llama/llama-3.2-3b-instruct
meta-llama· 131K ctx· llama3.2
open weights quant: unknown
spread (output)
17×
$0.020 – $0.335 · 9 providers
9 providers priced
| Provider | Input | Output | Cache rd | Blended |
|---|---|---|---|---|
Nvidia relay router | free/— | free/— | — | free/— |
Inference relay router | $0.020 | $0.020 | — | $0.020* |
NanoGPT relay router | $0.031 | $0.049 | $0.015 | $0.023 |
LLM Gateway relay router | $0.030 | $0.050 | — | $0.032* |
DevPass (LLM Gateway) relay router | $0.030 | $0.050 | — | $0.032* |
NovitaAI relay router | $0.030 | $0.050 | — | $0.032* |
Kilo Gateway relay router | $0.050 | $0.330 | — | $0.075* |
OpenRouter unknown | $0.050 | $0.330 | — | $0.075* |
Pioneer relay router | $0.100 | $0.335 | $0.100 | $0.130 |
Cloudflare Workers AI relay router | $0.051 | $0.335 | — | $0.077* |
Data: models.dev (MIT), snapshot 2026-09-20. Prices are vendor-published; verify before purchase. Methodology.