inferenstack — the market read on AI inference · last observation 2026-09-20. See the boards
Price spread

modelsdev/qwen3235ba22bthinking2507

modelsdev· 262K ctx
API onlytool callreasoning quant: unknown

spread (output)

5.8×

$0.600 – $3.50 · 13 providers

13 providers priced · 1 omitted (stale)
ProviderInputOutputCache rdBlended
iFlow
relay router
free/—free/——free/—
ModelScope
relay router
free/—free/——free/—
NanoGPTstale
relay router
$0.300$0.500$0.150$0.223
SiliconFlow
relay router
$0.130$0.600—$0.173*
IO.NET
relay router
$0.110$0.600$0.055$0.138
submodel
relay router
$0.200$0.600—$0.236*
SiliconFlow (China)
relay router
$0.130$0.600—$0.173*
Chutes
relay router
$0.299$1.20$0.030$0.209
OpenRouter
unknown
$0.230$2.30—$0.418*
Kilo Gateway
relay router
$0.230$2.30—$0.418*
NovitaAI
relay router
$0.300$3.00—$0.546*
Jiekou.AI
relay router
$0.300$3.00—$0.546*
Hugging Face
relay router
$0.300$3.00—$0.546*
LLM Gateway
relay router
$0.300$3.00—$0.546*
DevPass (LLM Gateway)
relay router
$0.300$3.00—$0.546*
Venice AI
unknown
$0.450$3.50—$0.728*

Data: models.dev (MIT), snapshot 2026-09-20. Prices are vendor-published; verify before purchase. Methodology.