The Known Good Updated 16 Sep 2026 Subscribe

API providers

Who actually serves the models, what they charge for them, and how fast they answer. Prices and endpoint telemetry are ingested from OpenRouter — we do not run our own provider benchmarks.

81 hosts serving tracked models
All 81 of 81 providers
Provider Models served Mean output t/s Mean TTFT Lowest blended $/M
OpenAI · first party 101 53 9.0s $0.069
DeepInfra 83 40 1.4s $0.022
Novita 81 37 2.0s $0.000
Google · first party 59 89 3.1s $0.087
Alibaba · first party 58 55 1.0s $0.055
Azure · first party 51 55 6.3s $0.14
Parasail 46 47 0.8s $0.030
Together 43 66 0.8s $0.075
SiliconFlow 42 36 1.9s $0.075
Venice 38 43 1.5s $0.11
AtlasCloud 33 39 1.9s $0.000
Amazon Bedrock · first party 32 60 3.1s $0.061
Phala 30 47 2.2s $0.068
StreamLake 28 43 1.7s $0.084
Anthropic · first party 27 72 2.6s $1.00
CoreWeave 27 71 0.8s $0.055
GMICloud 26 38 2.9s $0.000
Google AI Studio 26 119 2.4s $0.000
Mistral · first party 25 58 0.9s $0.075
Fireworks 24 63 1.7s $0.12
DigitalOcean 23 24 1.1s $0.12
Cloudflare 19 33 1.0s $0.041
Nebius 18 42 2.2s $0.10
NextBit 17 45 1.7s $0.060
BaseTen 14 96 0.8s $0.16
Morph 14 317 11.0s $0.16
Z.AI · first party 13 31 6.5s $0.24
Baidu · first party 12 60 0.9s $0.11
Chutes 11 20 3.4s $0.18
Crusoe 11 87 0.7s $0.087
Io Net 11 32 1.9s $0.073
AkashML 10 43 1.0s $0.040
Darkbloom 10 26 2.8s $0.000
Groq 9 203 0.4s $0.058
Mancer 2 9 29 0.8s $0.14
Wafer 9 64 1.4s $0.12
Claude Platform on AWS 9 41 2.5s $4.00
Friendli 8 64 1.4s $0.20
Ionstream 8 41 1.0s $0.17
Minimax · first party 8 45 0.9s $0.42
Nvidia · first party 8 45 2.3s $0.000
Reka · first party 8 54 1.2s $0.10
Sail Research 8 36 1.3s $0.11
Makora 8 67 0.9s $0.12
DekaLLM 8 58 1.0s $0.021
Inceptron 7 37 3.5s $0.087
Relace 7 29 1.4s $0.075
SambaNova 7 79 1.4s $0.34
xAI · first party 7 121 1.7s $1.25
DeepSeek · first party 6 77 1.0s $0.26
Mara 6 104 3.0s $0.30
Poolside 6 71 1.3s $0.000
Seed · first party 6 32 1.1s $0.13
Cohere · first party 5 45 0.3s $0.000
Decart 5 85 1.1s $0.000
Meta · first party 5 126 2.7s $0.12
ModelRun 5 89 0.8s $0.81
Perplexity · first party 5 42 34.9s $1.00
Tencent · first party 5 16 1.8s $0.077
Modal 5 63 4.5s $0.53
AionLabs 4 48 1.0s $0.88
Ambient 4 29 2.7s $0.10
Moonshot AI · first party 4 27 3.5s $1.20
Nex AGI 4 62 1.6s $0.000
OpenInference 4 22 3.3s $0.055
Sakana AI 4 42 13.4s $1.71
Cerebras 3 378 0.4s $0.45
Inception 3 243 1.2s $0.068
InferenceNet 3 27 1.3s $0.060
Inflection 2 $4.38
Upstage · first party 2 26 1.7s $0.16
Xiaomi · first party 2 32 3.1s $0.17
Stealth 2 20 10.3s $0.000
Thinking Machines · first party 2 58 1.9s $0.000
AI21 · first party 1 $3.50
Arcee AI 1 76 0.2s $0.39
Perceptron 1 30 0.5s $0.49
StepFun 1 67 3.7s $0.44
Liquid 1 120 0.7s $0.000
Near AI 1 4 2.0s $0.24
Krea 1 72 0.8s $0.39
How to read this. A host appears here once we have seen it serve at least one tracked model. Mean output t/s and mean TTFT average that host's measurements across every model it serves, so a host that only serves small models will look faster than one carrying frontier models — compare hosts on a single model page for a like-for-like reading. Lowest blended $/M is the cheapest blended rate that host publishes for any model, at a 3:1 input:output blend. Figures are ingested from OpenRouter endpoint listings and telemetry, with metadata enriched from models.dev. See methodology and attribution.