2026-08-30
51 change(s) in the model market
model price changes
- ~deepseek/deepseek-v4-flash-latest: completion price $0.1/M → $0.16/M (+60.0%)
- ~z-ai/glm-latest: prompt price $1.2/M → $1.19/M (−1.0%)
- ~z-ai/glm-latest: completion price $4/M → $4.18/M (+4.5%)
- arcee-ai/trinity-large-thinking: prompt price $0.22/M → $0.25/M (+13.6%)
- arcee-ai/trinity-large-thinking: completion price $0.85/M → $0.8/M (−5.9%)
- deepseek/deepseek-v4-flash: prompt price $0.084/M → $0.08/M (−4.3%)
- deepseek/deepseek-v4-flash: completion price $0.167/M → $0.16/M (−4.3%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.045/M → $0.065/M (+44.4%)
- deepseek/deepseek-v4-flash-0731: completion price $0.09/M → $0.18/M (+100.0%)
- deepseek/deepseek-v4-pro: prompt price $0.63/M → $0.437/M (−30.6%)
- deepseek/deepseek-v4-pro: completion price $1.26/M → $0.875/M (−30.6%)
- qwen/qwen3-next-80b-a3b-instruct: prompt price $0.1/M → $0.09/M (−10.0%)
- thinkingmachines/inkling: prompt price $0.95/M → $1/M (+5.3%)
- z-ai/glm-5.1: prompt price $1.26/M → $0.966/M (−23.3%)
- z-ai/glm-5.1: completion price $3.96/M → $3.04/M (−23.3%)
quantization changes
- OpenInference: deepseek/deepseek-v4-flash-0731 quantization fp4 → fp8
- Relace: z-ai/glm-5.3-flash quantization fp8 → fp4
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.08/M (−4.0%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.167/M → $0.16/M (−4.0%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.165/M → $0.17/M (+3.0%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.08/M (−4.3%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.167/M → $0.16/M (−4.3%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.165/M → $0.17/M (+3.0%)
- OpenInference: deepseek/deepseek-v4-flash-0731 completion price $0.1/M → $0.16/M (+60.0%)
- Phala: deepseek/deepseek-v4-flash-0731 prompt price $0.22/M → $0.44/M (+100.0%)
- Phala: deepseek/deepseek-v4-flash-0731 completion price $0.66/M → $1.32/M (+100.0%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.045/M → $0.065/M (+44.4%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.09/M → $0.18/M (+100.0%)
- Baidu: deepseek/deepseek-v4-pro prompt price $0.639/M → $0.446/M (−30.2%)
- Baidu: deepseek/deepseek-v4-pro completion price $1.28/M → $0.892/M (−30.2%)
- StreamLake: deepseek/deepseek-v4-pro prompt price $0.63/M → $0.437/M (−30.6%)
- StreamLake: deepseek/deepseek-v4-pro completion price $1.26/M → $0.875/M (−30.6%)
- Mancer 2: openai/gpt-oss-120b prompt price $0.085/M → $0.07/M (−17.6%)
- Reka: qwen/qwen3.8-27b prompt price $0.45/M → $0.25/M (−44.4%)
- Reka: qwen/qwen3.8-27b completion price $3.2/M → $3/M (−6.2%)
- Mancer 2: z-ai/glm-4.7 prompt price $0.65/M → $0.7/M (+7.7%)
- Io Net: z-ai/glm-5.3 prompt price $1.25/M → $1.19/M (−5.0%)
- Io Net: z-ai/glm-5.3 completion price $4.4/M → $4.18/M (−5.0%)
- Morph: z-ai/glm-5.3 prompt price $1.4/M → $1.25/M (−10.7%)
- Morph: z-ai/glm-5.3-flash completion price $0.5/M → $0.42/M (−16.0%)
- Relace: z-ai/glm-5.3-flash prompt price $0.075/M → $0.05/M (−33.3%)
- Relace: z-ai/glm-5.3-flash completion price $0.25/M → $0.167/M (−33.3%)
providers added
- OpenAI now serves openai/gpt-5.6-luna (unknown, 1,050,000 ctx, $0.4/M in / $2.4/M out)
- OpenAI now serves openai/gpt-5.6-luna-pro (unknown, 1,050,000 ctx, $0.4/M in / $2.4/M out)
- Darkbloom now serves qwen/qwen3-vl-30b-a3b-instruct (fp4, 131,072 ctx, $0.09/M in / $0.4/M out)
providers removed
- OpenInference no longer serves google/gemma-4-31b-it (was bf16)
- Fireworks no longer serves minimax/minimax-m2.7 (was unknown)
- Fireworks no longer serves moonshotai/kimi-k2.7-code (was unknown)
- OpenAI no longer serves openai/gpt-5.6-luna (was unknown)
- OpenAI no longer serves openai/gpt-5.6-luna-pro (was unknown)
- Makora no longer serves z-ai/glm-5.3-flash (was unknown)
openrouter catalog snapshots 2026-08-29 → 2026-08-30 · schema 1 · generated 2026-08-30T10:29:22.066Z
$ curl variables.md — this site speaks markdown to your terminal.