Best value GLM 4.6 API providers
13 providers host GLM 4.6. Best value (SWE-bench score divided by blended cost) is SiliconFlow at $0.64/MTok blended.
What would GLM 4.6 cost you?
SiliconFlow is 45% cheaper than Io Net at this workload.
Input tokens / month150M
Output tokens / month30M
SiliconFlow
$116 /mo
Venice
$117 /mo
Venice
$117 /mo
DeepInfra
$135 /mo
DeepInfra
$135 /mo
Novita
$149 /mo
Novita
$149 /mo
BaseTen
$156 /mo
AtlasCloud
$156 /mo
Z Ai
$156 /mo
AtlasCloud
$156 /mo
Z Ai
$156 /mo
Io Net
$210 /mo
Projected monthly cost = (input price × 150M) + (output price × 30M). Drag the sliders to match your actual workload; the chart re-ranks live.
| # | Host | Context | Input $/MTok | Output $/MTok | Blended | Uptime 30m | Quant |
|---|---|---|---|---|---|---|---|
| 1 | SiliconFlow | 205k | $0.39 | $1.90 | $0.64 | 99.43% | fp8 |
| 2 | Venice | 198k | $0.43 | $1.75 | $0.65 | 99.87% | fp4 |
| 3 | Venice | 198k | $0.43 | $1.75 | $0.65 | 100.00% | fp4 |
| 4 | DeepInfra | 203k | $0.50 | $2.00 | $0.75 | 100.00% | fp4 |
| 5 | DeepInfra | 203k | $0.50 | $2.00 | $0.75 | 99.62% | fp4 |
| 6 | Novita | 205k | $0.55 | $2.20 | $0.83 | 95.05% | bf16 |
| 7 | Novita | 205k | $0.55 | $2.20 | $0.83 | 96.20% | bf16 |
| 8 | BaseTen | 200k | $0.60 | $2.20 | $0.87 | — | fp4 |
| 9 | AtlasCloud | 203k | $0.60 | $2.20 | $0.87 | — | fp8 |
| 10 | Z Ai | 203k | $0.60 | $2.20 | $0.87 | 97.16% | fp4 |
| 11 | AtlasCloud | 203k | $0.60 | $2.20 | $0.87 | — | fp8 |
| 12 | Z Ai | 203k | $0.60 | $2.20 | $0.87 | 81.04% | fp4 |
| 13 | Io Net | 131k | $0.85 | $2.75 | $1.17 | — | fp8 |