Kimi API Providers

Who serves Kimi, at what price and speed.

Kimi is Moonshot AI's family of open-weight mixture-of-experts models, from Kimi K2 (1 trillion total parameters, 32 billion active) to K2.5, K2.6, the K2.7 Code variant and K3.

inference.net served 28% of the 2.22T Kimi tokens that went through a large public LLM router over Oct 3 to Oct 9, 2026. Moonshot AI's own API served 15%; 33 providers list the family.

Who serves Kimi tokens

ProviderTokens, 7dShare
inference.net571B27.7%
Moonshot AI (lab)312B15.2%
Together186B9.0%
Fireworks143B7.0%
Relace126B6.1%
Parasail122B5.9%
Modal111B5.4%
Wafer91B4.4%
Morph65B3.1%
Sail Research52B2.5%
Inceptron50B2.4%
Alibaba Cloud Int.46B2.2%
Amazon Bedrock35B1.7%
Phala32B1.5%
Baseten20B1.0%
16 others96B4.7%

All Kimi models combined, Oct 3 to Oct 9, 2026.

Kimi K3: prices and speed by provider

Output prices run from $9.90 to $22.50 per million tokens across 20 providers, median $14.90.

ProviderShareInput $/MOutput $/MCache read $/MTokens/sLatencyUptime 3dContext
inference.net29.7%$0.64$13.50$0.28670.84s100.0%1.05M
Moonshot AI15.0%$3.00$15.00$0.30214.67s100.0%1.05M
Together9.7%$2.70$13.50$0.27491.07s92.5%1.05M
Fireworks7.5%$3.00$15.00$0.30381.21s100.0%1.05M
Relace6.6%$2.00$14.00$0.30641.65s100.0%1.05M
Parasail6.3%$2.60$13.00$0.26641.46s99.5%1.05M
Modal5.8%$3.00$15.00$0.30561.33s100.0%1.05M
Wafer4.8%$2.80$14.00$0.30530.74s98.3%1.05M
Morph3.4%$0.408$14.90$0.29451.47s99.7%1.05M
Sail Research2.7%$0.84$13.50$0.30392.72s98.9%1.05M
Alibaba Cloud Int.2.4%$3.45$17.25$0.345362.62s100.0%1.05M
Amazon Bedrock1.8%$3.00$15.00$0.30631.65s98.7%1.05M
Phala1.7%$2.55$12.75$0.255471.99s99.8%1.05M
Baseten1.0%$3.00$15.00$0.302710.99s100.0%1.05M
Makora0.9%$1.53$12.75$0.204471.61s98.7%1.05M
Decart0.6%$1.98$9.90$0.198331.07s97.4%1.05M
DigitalOcean0.2%$2.55$12.95$0.255421.65s100.0%1.05M
AkashML<0.1%$1.20$14.00$1.20630.80s98.9%1.05M
Chutes<0.1%$3.00$15.00$0.30342.19s87.5%1.05M
DeepInfra-$2.85$14.25$0.285501.75s98.7%1.05M

List prices as of October 9, 2026, cheapest endpoint per provider. Tokens/s and latency are medians over 30 minutes.

Kimi K2.6: prices and speed by provider

Output prices run from $2.40 to $4.60 per million tokens across 17 providers, median $3.50.

ProviderShareInput $/MOutput $/MCache read $/MTokens/sLatencyUptime 3dContext
Inceptron29.5%$0.465$2.45$0.087660.77s99.8%262K
Moonshot AI19.0%$0.95$4.00$0.16322.48s99.9%262K
Chutes14.2%$0.50$2.85$0.05432.25s99.7%262K
Baidu Qianfan11.7%$0.95$4.00$0.16441.45s100.0%262K
CoreWeave7.2%$0.65$3.41$0.15640.55s99.8%262K
StreamLake4.9%$0.599$2.52$0.101362.07s96.5%256K
Crusoe4.3%$0.70$3.50$0.35540.65s97.0%262K
AtlasCloud1.0%$0.95$4.00$0.16561.63s99.0%262K
Cloudflare0.2%$0.95$4.00$0.16301.67s98.9%262K
DigitalOcean-$0.57$2.40$0.114470.95s98.2%262K
SiliconFlow-$0.77$3.40$0.14261.61s100.0%262K
NovitaAI-$0.80$3.40$0.16341.43s99.8%262K
DeepInfra-$0.75$3.50$0.15135.76s95.9%262K
Venice-$0.75$3.50$0.16123.73s90.4%256K
Parasail-$0.75$3.50$0.16591.18s100.0%262K
GMICloud-$0.855$3.60$0.144---262K
Phala-$1.09$4.60$0.37332.35s99.8%262K

List prices as of October 9, 2026, cheapest endpoint per provider. Tokens/s and latency are medians over 30 minutes.

All Kimi models

ModelTokens, 7dProvidersOutput $/MContextReleased
Kimi K31.97T20$9.90 to $22.501.05M2026-07-16
Kimi K2.6145B17$2.40 to $4.60262K2026-04-20
Kimi K2.7 Code48B11$3.00 to $8.00262K2026-06-12
Kimi K2.542B5$2.50 to $3.33262K2026-01-27
Kimi K2 09058B1$2.50262K2025-09-04
Kimi K2 Thinking2B2$2.50262K2025-11-06
Kimi K2 07112B1$2.30131K2025-07-11

Finance your GPUs

Serving Kimi on your own GPUs? Tell us the cluster, the models you serve and the contracts behind them, and we will share it with partner funders that fit.

Prefer email? hello@amcompute.com