variables.md
the model market, diffed daily
Every day at 05:20 UTC this site snapshots the OpenRouter catalog — every model, every provider endpoint, prices, context windows, quantization labels — and diffs it against yesterday. What changed is published here as one-line facts. No commentary, no ranking.
Raw snapshots are retained from 2026-07-12 onward; every entry names the snapshot pair that produced it. The audience includes agents choosing a provider: every line is written to be quoted, and every page has a markdown twin.
Subscribe or poll:
rss ·
json feed ·
latest.json ·
latest (curl variables.md/changelog/latest speaks markdown)
2026-09-08 49 change(s)
removed from the catalog
- MiniMax: MiniMax M2.7 (free) (minimax/minimax-m2.7:free) removed from the catalog
- MiniMax: MiniMax M3 (free) (minimax/minimax-m3:free) removed from the catalog
model price changes
- ~moonshotai/kimi-latest: prompt price $2.55/M → $2.5/M (−2.0%)
- ~moonshotai/kimi-latest: completion price $12.8/M → $14/M (+9.8%)
- deepseek/deepseek-chat-v3-0324: prompt price $0.25/M → $0.29/M (+16.0%)
- deepseek/deepseek-chat-v3-0324: completion price $1/M → $1.14/M (+14.0%)
- deepseek/deepseek-chat-v3.1: prompt price $0.55/M → $0.25/M (−54.5%)
- deepseek/deepseek-chat-v3.1: completion price $1.65/M → $0.95/M (−42.4%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.14/M → $0.065/M (−53.6%)
- deepseek/deepseek-v4-flash-0731: completion price $0.28/M → $0.18/M (−35.7%)
- deepseek/deepseek-v4-flash-vision-exp: prompt price $0.22/M → $0.44/M (+100.0%)
- deepseek/deepseek-v4-flash-vision-exp: completion price $0.66/M → $1.32/M (+100.0%)
- minimax/minimax-m1: prompt price $0.55/M → $0.4/M (−27.3%)
- moonshotai/kimi-k2.7-code: prompt price $0.66/M → $0.71/M (+7.6%)
- moonshotai/kimi-k2.7-code: completion price $3.4/M → $3.5/M (+2.9%)
- qwen/qwen3-14b: prompt price $0.12/M → $0.227/M (+89.6%)
- qwen/qwen3-14b: completion price $0.24/M → $0.91/M (+279.2%)
- z-ai/glm-4.6: prompt price $0.43/M → $0.55/M (+27.9%)
- z-ai/glm-4.6: completion price $1.75/M → $2.2/M (+25.7%)
- z-ai/glm-4.7-flash: prompt price $0.06/M → $0.061/M (+0.8%)
model context changes
- mistralai/mistral-medium-3-5:batch: context length 32,768 → 262,144
quantization changes
- StreamLake: z-ai/glm-5.3-flash quantization unknown → fp8
provider price changes
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.175/M → $0.19/M (+8.6%)
- DeepSeek: deepseek/deepseek-v4-flash-0731 prompt price $0.22/M → $0.44/M (+100.0%)
- DeepSeek: deepseek/deepseek-v4-flash-0731 completion price $0.66/M → $1.32/M (+100.0%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.15/M → $0.165/M (+10.0%)
- NextBit: deepseek/deepseek-v4-flash-0731 prompt price $0.4/M → $0.352/M (−12.0%)
- NextBit: deepseek/deepseek-v4-flash-0731 completion price $1.2/M → $1.06/M (−12.0%)
- DeepSeek: deepseek/deepseek-v4-flash-vision-exp prompt price $0.22/M → $0.44/M (+100.0%)
- DeepSeek: deepseek/deepseek-v4-flash-vision-exp completion price $0.66/M → $1.32/M (+100.0%)
2026-09-07 84 change(s)
removed from the catalog
- Z.ai: GLM 5.2 (free) (z-ai/glm-5.2:free) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.045/M → $0.05/M (+11.1%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.09/M → $0.16/M (+77.8%)
- ~z-ai/glm-flash-latest: prompt price $0.075/M → $0.071/M (−5.0%)
- ~z-ai/glm-flash-latest: completion price $0.25/M → $0.237/M (−5.0%)
- ~z-ai/glm-latest: prompt price $1.17/M → $1.12/M (−4.3%)
- ~z-ai/glm-latest: completion price $3.96/M → $3.52/M (−11.1%)
- deepseek/deepseek-v4-flash: prompt price $0.081/M → $0.089/M (+9.3%)
- deepseek/deepseek-v4-flash: completion price $0.162/M → $0.177/M (+9.3%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.05/M → $0.14/M (+180.1%)
- deepseek/deepseek-v4-flash-0731: completion price $0.1/M → $0.28/M (+180.1%)
- deepseek/deepseek-v4-pro: prompt price $0.708/M → $0.955/M (+35.0%)
- deepseek/deepseek-v4-pro: completion price $1.42/M → $1.91/M (+35.0%)
- deepseek/deepseek-v4-pro-0813: prompt price $1.12/M → $1.05/M (−6.4%)
- deepseek/deepseek-v4-pro-0813: completion price $3.36/M → $3.15/M (−6.4%)
- qwen/qwen3.5-397b-a17b: prompt price $0.55/M → $0.39/M (−29.1%)
- qwen/qwen3.5-397b-a17b: completion price $3.5/M → $2.34/M (−33.1%)
- z-ai/glm-4.6: prompt price $0.55/M → $0.43/M (−21.8%)
- z-ai/glm-4.6: completion price $2.2/M → $1.75/M (−20.5%)
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.081/M → $0.14/M (+72.4%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.162/M → $0.28/M (+72.4%)
- GMICloud: deepseek/deepseek-v4-flash prompt price $0.112/M → $0.091/M (−18.8%)
- GMICloud: deepseek/deepseek-v4-flash completion price $0.224/M → $0.182/M (−18.8%)
- NextBit: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.15/M (+7.1%)
- NextBit: deepseek/deepseek-v4-flash completion price $0.28/M → $0.35/M (+25.0%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.081/M → $0.089/M (+9.3%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.162/M → $0.177/M (+9.3%)
- Baidu: deepseek/deepseek-v4-flash-0731 prompt price $0.05/M → $0.14/M (+180.1%)
- Baidu: deepseek/deepseek-v4-flash-0731 completion price $0.1/M → $0.28/M (+180.1%)
- GMICloud: deepseek/deepseek-v4-flash-0731 prompt price $0.352/M → $0.286/M (−18.7%)
2026-09-06 37 change(s)
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.05/M → $0.045/M (−10.0%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.1/M → $0.09/M (−10.0%)
- ~z-ai/glm-latest: prompt price $1.15/M → $1.17/M (+1.7%)
- ~z-ai/glm-latest: completion price $3.5/M → $3.96/M (+13.1%)
- deepseek/deepseek-v4-flash: prompt price $0.085/M → $0.081/M (−4.9%)
- deepseek/deepseek-v4-flash: completion price $0.171/M → $0.162/M (−4.9%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.065/M → $0.05/M (−23.1%)
- deepseek/deepseek-v4-flash-0731: completion price $0.18/M → $0.1/M (−44.5%)
- deepseek/deepseek-v4-pro: prompt price $0.921/M → $0.708/M (−23.1%)
- deepseek/deepseek-v4-pro: completion price $1.84/M → $1.42/M (−23.1%)
- qwen/qwen3.5-35b-a3b: prompt price $0.08/M → $0.313/M (+290.6%)
- qwen/qwen3.5-35b-a3b: completion price $0.75/M → $1.25/M (+66.7%)
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.085/M → $0.081/M (−4.9%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.171/M → $0.162/M (−4.9%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.085/M → $0.081/M (−4.9%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.171/M → $0.162/M (−4.9%)
- DeepInfra: deepseek/deepseek-v4-flash-0731 prompt price $0.08/M → $0.06/M (−25.0%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.175/M → $0.15/M (−14.3%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.065/M → $0.045/M (−30.8%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.18/M → $0.09/M (−50.0%)
- Baidu: deepseek/deepseek-v4-pro prompt price $0.919/M → $0.717/M (−22.1%)
- Baidu: deepseek/deepseek-v4-pro completion price $1.84/M → $1.43/M (−22.1%)
- StreamLake: deepseek/deepseek-v4-pro prompt price $0.921/M → $0.708/M (−23.1%)
- StreamLake: deepseek/deepseek-v4-pro completion price $1.84/M → $1.42/M (−23.1%)
- Baidu: moonshotai/kimi-k2.6 prompt price $0.548/M → $0.537/M (−2.1%)
- Baidu: moonshotai/kimi-k2.6 completion price $2.31/M → $2.26/M (−2.1%)
- Darkbloom: qwen/qwen3.8-27b prompt price $0.22/M → $0.15/M (−31.8%)
- Darkbloom: qwen/qwen3.8-27b completion price $2.42/M → $2/M (−17.4%)
- Reka: qwen/qwen3.8-27b prompt price $0.24/M → $0.214/M (−10.8%)
- Io Net: z-ai/glm-5.3 prompt price $1.25/M → $1.19/M (−5.0%)
2026-09-05 84 change(s)
added to the catalog
- inclusionAI: Ling 3.0 Flash Sante (free) (inclusionai/ling-3.0-flash-sante:free) added to the catalog: 262,144 ctx, $0/M in / $0/M out
- OpenAI: GPT-6 Astra (openai/gpt-6-astra) added to the catalog: 1,050,000 ctx, $10/M in / $50/M out
- OpenAI: GPT-6 Astra Pro (openai/gpt-6-astra-pro) added to the catalog: 1,050,000 ctx, $10/M in / $50/M out
- OpenAI: GPT-6 Astra Pro (batch) (openai/gpt-6-astra-pro:batch) added to the catalog: 1,050,000 ctx, $5/M in / $25/M out
- OpenAI: GPT-6 Astra (batch) (openai/gpt-6-astra:batch) added to the catalog: 1,050,000 ctx, $5/M in / $25/M out
- Qwen: Qwen3.8 Max (0902) (qwen/qwen3.8-max-0902) added to the catalog: 1,000,000 ctx, $2/M in / $6/M out
removed from the catalog
- IBM: Granite 4.1 8B (ibm-granite/granite-4.1-8b) removed from the catalog
- Qwen: Qwen3.8 Max (qwen/qwen3.8-max) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.05/M → $0.05/M (−0.0%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.16/M → $0.1/M (−37.5%)
- ~moonshotai/kimi-latest: prompt price $2.5/M → $2.55/M (+2.0%)
- ~moonshotai/kimi-latest: completion price $14/M → $12.8/M (−8.9%)
- deepseek/deepseek-v4-flash: prompt price $0.089/M → $0.085/M (−3.8%)
- deepseek/deepseek-v4-flash: completion price $0.177/M → $0.171/M (−3.8%)
- deepseek/deepseek-v4-flash-vision-exp: prompt price $0.44/M → $0.22/M (−50.0%)
- deepseek/deepseek-v4-flash-vision-exp: completion price $1.32/M → $0.66/M (−50.0%)
- deepseek/deepseek-v4-pro: prompt price $1.04/M → $0.921/M (−11.7%)
- deepseek/deepseek-v4-pro: completion price $2.08/M → $1.84/M (−11.7%)
- deepseek/deepseek-v4-pro-0813: prompt price $1.12/M → $1.12/M (+0.5%)
- deepseek/deepseek-v4-pro-0813: completion price $3.35/M → $3.36/M (+0.5%)
- qwen/qwen3-235b-a22b-2507: prompt price $0.087/M → $0.09/M (+2.9%)
- qwen/qwen3-235b-a22b-2507: completion price $0.35/M → $0.55/M (+57.1%)
- qwen/qwen3.5-35b-a3b: prompt price $0.25/M → $0.08/M (−68.0%)
- qwen/qwen3.5-35b-a3b: completion price $1.25/M → $0.75/M (−40.0%)
- qwen/qwen3.6-27b: prompt price $0.6/M → $0.3/M (−50.0%)
- qwen/qwen3.6-27b: completion price $3.6/M → $2/M (−44.4%)
quantization changes
- DeepInfra: z-ai/glm-5.3-flash quantization fp8 → fp4
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.085/M (−39.0%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.28/M → $0.171/M (−39.0%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.089/M → $0.085/M (−3.8%)
2026-09-04 56 change(s)
added to the catalog
- Ling 3.0 Flash Fin (inclusionai/ling-3.0-flash-fin) added to the catalog: 262,144 ctx, $0.06/M in / $0.18/M out
- NVIDIA: Nemotron 3.5 Content Safety (nvidia/nemotron-3.5-content-safety) added to the catalog: 131,072 ctx, $0.2/M in / $0.2/M out
- SpaceXAI: Grok 4.3 (batch) (x-ai/grok-4.3:batch) added to the catalog: 1,000,000 ctx, $1/M in / $2/M out
model price changes
- ~moonshotai/kimi-latest: prompt price $2.55/M → $2.5/M (−2.0%)
- ~moonshotai/kimi-latest: completion price $12.8/M → $14/M (+9.8%)
- ~z-ai/glm-latest: prompt price $1.11/M → $1.15/M (+4.0%)
- ~z-ai/glm-latest: completion price $3.48/M → $3.5/M (+0.7%)
- deepseek/deepseek-chat: prompt price $0.257/M → $0.32/M (+24.3%)
- deepseek/deepseek-chat: completion price $1.03/M → $0.89/M (−13.5%)
- deepseek/deepseek-chat-v3.1: prompt price $0.25/M → $0.55/M (+120.0%)
- deepseek/deepseek-chat-v3.1: completion price $0.95/M → $1.65/M (+73.7%)
- nvidia/nemotron-3-ultra-550b-a55b: prompt price $0.6/M → $0.625/M (+4.2%)
- nvidia/nemotron-3-ultra-550b-a55b: completion price $2.4/M → $3.13/M (+30.2%)
- qwen/qwen2.5-vl-72b-instruct: prompt price $0.25/M → $0.8/M (+220.0%)
- qwen/qwen2.5-vl-72b-instruct: completion price $0.75/M → $1/M (+33.3%)
- qwen/qwen3.8-27b: prompt price $0.425/M → $0.42/M (−1.2%)
- qwen/qwen3.8-27b: completion price $2.55/M → $3/M (+17.6%)
- undi95/remm-slerp-l2-13b: prompt price $0.45/M → $0.35/M (−22.2%)
model context changes
- mistralai/mistral-medium-3-5:batch: context length 262,144 → 32,768
quantization changes
- GMICloud: deepseek/deepseek-v4-flash-0731 quantization fp4 → fp8
provider price changes
- Morph: deepseek/deepseek-v4-flash-0731 prompt price $0.099/M → $0.123/M (+25.0%)
- Morph: deepseek/deepseek-v4-flash-0731 completion price $0.278/M → $0.348/M (+25.0%)
- Novita: deepseek/deepseek-v4-flash-0731 prompt price $0.44/M → $0.409/M (−7.0%)
- Novita: deepseek/deepseek-v4-flash-0731 completion price $1.32/M → $1.23/M (−7.0%)
- Novita: deepseek/deepseek-v4-pro-0813 prompt price $1.32/M → $1.11/M (−16.0%)
- Novita: deepseek/deepseek-v4-pro-0813 completion price $3.96/M → $3.33/M (−16.0%)
- Decart: moonshotai/kimi-k2.6 prompt price $0.519/M → $0.568/M (+9.4%)
- Decart: moonshotai/kimi-k2.6 completion price $2.45/M → $3.33/M (+36.0%)
- Inceptron: moonshotai/kimi-k2.6 prompt price $0.53/M → $0.52/M (−1.9%)
- Morph: moonshotai/kimi-k3 prompt price $2.6/M → $2.5/M (−3.8%)
2026-09-03 54 change(s)
added to the catalog
- Google: Gemini 3.8 Flash (google/gemini-3.8-flash) added to the catalog: 1,048,576 ctx, $0.75/M in / $3.75/M out
- Google: Gemini 3.8 Flash (batch) (google/gemini-3.8-flash:batch) added to the catalog: 1,048,576 ctx, $0.375/M in / $1.88/M out
- Meta: Muse Spark 1.3 (meta/muse-spark-1.3) added to the catalog: 1,048,576 ctx, $1.25/M in / $4.25/M out
- Meta: Muse Spark 1.3 Contributor (meta/muse-spark-1.3-contributor) added to the catalog: 1,048,576 ctx, $0.1/M in / $0.2/M out
removed from the catalog
- NVIDIA: Nemotron 3 Ultra (batch) (nvidia/nemotron-3-ultra-550b-a55b:batch) removed from the catalog
model price changes
- ~z-ai/glm-latest: prompt price $1.17/M → $1.11/M (−5.5%)
- ~z-ai/glm-latest: completion price $3.96/M → $3.48/M (−12.2%)
- google/gemini-3.7-flash:batch: prompt price $0.188/M → $0.375/M (+100.0%)
- google/gemini-3.7-flash:batch: completion price $0.938/M → $1.88/M (+100.0%)
- meta-llama/llama-3.3-70b-instruct: prompt price $0.71/M → $0.1/M (−85.9%)
- meta-llama/llama-3.3-70b-instruct: completion price $0.71/M → $0.32/M (−54.9%)
- meta/muse-glimmer-30b: completion price $1.2/M → $1.1/M (−8.3%)
- nvidia/nemotron-3-ultra-550b-a55b: prompt price $0.625/M → $0.6/M (−4.0%)
- nvidia/nemotron-3-ultra-550b-a55b: completion price $3.13/M → $2.4/M (−23.2%)
- qwen/qwen3.5-397b-a17b: prompt price $0.39/M → $0.55/M (+41.0%)
- qwen/qwen3.5-397b-a17b: completion price $2.34/M → $3.5/M (+49.6%)
- z-ai/glm-4.6: prompt price $0.43/M → $0.55/M (+27.9%)
- z-ai/glm-4.6: completion price $1.75/M → $2.2/M (+25.7%)
quantization changes
- AkashML: openai/gpt-oss-20b quantization bf16 → fp4
provider price changes
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.185/M → $0.175/M (−5.4%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.185/M → $0.175/M (−5.4%)
- Wafer: deepseek/deepseek-v4-flash-0731 prompt price $0.2/M → $0.1/M (−50.0%)
- Decart: moonshotai/kimi-k2.6 prompt price $0.537/M → $0.519/M (−3.3%)
- Decart: moonshotai/kimi-k2.6 completion price $2.26/M → $2.45/M (+8.3%)
- Morph: moonshotai/kimi-k3 prompt price $2.8/M → $2.6/M (−7.1%)
- Wafer: moonshotai/kimi-k3 completion price $15/M → $12.8/M (−15.0%)
- Mancer 2: openai/gpt-oss-120b prompt price $0.065/M → $0.06/M (−7.7%)
- AkashML: qwen/qwen3.8-27b prompt price $0.35/M → $0.32/M (−8.6%)
- AkashML: qwen/qwen3.8-27b completion price $2.55/M → $2.5/M (−2.0%)
- Parasail: qwen/qwen3.8-27b prompt price $0.35/M → $0.25/M (−28.6%)
2026-09-02 59 change(s)
added to the catalog
- Z.ai: GLM Flash Latest (~z-ai/glm-flash-latest) added to the catalog: 1,310,720 ctx, $0.075/M in / $0.25/M out
- Anthropic: Claude Fable 5.1 (anthropic/claude-fable-5.1) added to the catalog: 1,000,000 ctx, $10/M in / $50/M out
- Anthropic: Claude Fable 5.1 (batch) (anthropic/claude-fable-5.1:batch) added to the catalog: 1,000,000 ctx, $5/M in / $25/M out
- Inception: Mercury 2.5 Preview (inception/mercury-2.5-preview) added to the catalog: 260,000 ctx, $0.04/M in / $0.15/M out
removed from the catalog
- Anthropic: Claude Opus 4.7 (Fast) (anthropic/claude-opus-4.7-fast) removed from the catalog
- Anthropic: Claude Opus 4.8 (Fast) (anthropic/claude-opus-4.8-fast) removed from the catalog
- Claude Opus 5 (Fast) (anthropic/claude-opus-5-fast) removed from the catalog
model price changes
- deepseek/deepseek-chat-v3.1: prompt price $0.55/M → $0.25/M (−54.5%)
- deepseek/deepseek-chat-v3.1: completion price $1.65/M → $0.95/M (−42.4%)
- deepseek/deepseek-v4-flash: prompt price $0.081/M → $0.089/M (+9.5%)
- deepseek/deepseek-v4-flash: completion price $0.162/M → $0.177/M (+9.5%)
- deepseek/deepseek-v4-flash-vision-exp: prompt price $0.22/M → $0.44/M (+100.0%)
- deepseek/deepseek-v4-flash-vision-exp: completion price $0.66/M → $1.32/M (+100.0%)
- deepseek/deepseek-v4-pro: prompt price $1.6/M → $1.04/M (−34.9%)
- deepseek/deepseek-v4-pro: completion price $3.2/M → $2.08/M (−34.9%)
- deepseek/deepseek-v4-pro-0813: prompt price $0.66/M → $1.12/M (+69.0%)
- deepseek/deepseek-v4-pro-0813: completion price $1.98/M → $3.35/M (+69.0%)
- nvidia/nemotron-3-ultra-550b-a55b: prompt price $0.5/M → $0.625/M (+25.0%)
- nvidia/nemotron-3-ultra-550b-a55b: completion price $2.2/M → $3.13/M (+42.0%)
- qwen/qwen3.8-2.4t-a95b:batch: prompt price $2.5/M → $2/M (−20.0%)
- qwen/qwen3.8-2.4t-a95b:batch: completion price $6.25/M → $6/M (−4.0%)
- z-ai/glm-5.2: prompt price $1.19/M → $0.966/M (−18.8%)
- z-ai/glm-5.2: completion price $3.74/M → $3.04/M (−18.8%)
quantization changes
- GMICloud: deepseek/deepseek-v4-flash-0731 quantization fp8 → fp4
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.082/M → $0.14/M (+70.1%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.165/M → $0.28/M (+70.1%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.081/M → $0.089/M (+9.5%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.162/M → $0.177/M (+9.5%)
- DeepSeek: deepseek/deepseek-v4-flash-0731 prompt price $0.22/M → $0.44/M (+100.0%)
- DeepSeek: deepseek/deepseek-v4-flash-0731 completion price $0.66/M → $1.32/M (+100.0%)
2026-09-01 99 change(s)
added to the catalog
- IBM: Granite 4.2 8B (ibm-granite/granite-4.2-8b) added to the catalog: 131,072 ctx, $0.1/M in / $0.15/M out
- OpenAI: GPT-3.5 Turbo (batch) (openai/gpt-3.5-turbo:batch) added to the catalog: 16,385 ctx, $0.25/M in / $0.75/M out
- OpenAI: GPT-4 Turbo (batch) (openai/gpt-4-turbo:batch) added to the catalog: 128,000 ctx, $5/M in / $15/M out
- OpenAI: GPT-4.1 Mini (batch) (openai/gpt-4.1-mini:batch) added to the catalog: 1,047,576 ctx, $0.2/M in / $0.8/M out
- OpenAI: GPT-4.1 Nano (batch) (openai/gpt-4.1-nano:batch) added to the catalog: 1,047,576 ctx, $0.05/M in / $0.2/M out
- OpenAI: GPT-4.1 (batch) (openai/gpt-4.1:batch) added to the catalog: 1,047,576 ctx, $1/M in / $4/M out
- OpenAI: GPT-4o-mini (batch) (openai/gpt-4o-mini:batch) added to the catalog: 128,000 ctx, $0.075/M in / $0.3/M out
- OpenAI: GPT-4o (batch) (openai/gpt-4o:batch) added to the catalog: 128,000 ctx, $1.25/M in / $5/M out
- OpenAI: GPT-5 Mini (batch) (openai/gpt-5-mini:batch) added to the catalog: 400,000 ctx, $0.125/M in / $1/M out
- OpenAI: GPT-5 Nano (batch) (openai/gpt-5-nano:batch) added to the catalog: 400,000 ctx, $0.025/M in / $0.2/M out
- OpenAI: GPT-5 Pro (batch) (openai/gpt-5-pro:batch) added to the catalog: 400,000 ctx, $7.5/M in / $60/M out
- OpenAI: GPT-5 (batch) (openai/gpt-5:batch) added to the catalog: 400,000 ctx, $0.625/M in / $5/M out
- OpenAI: GPT-5.1 (batch) (openai/gpt-5.1:batch) added to the catalog: 400,000 ctx, $0.625/M in / $5/M out
- OpenAI: GPT-5.2 Pro (batch) (openai/gpt-5.2-pro:batch) added to the catalog: 400,000 ctx, $10.5/M in / $84/M out
- OpenAI: GPT-5.2 (batch) (openai/gpt-5.2:batch) added to the catalog: 400,000 ctx, $0.875/M in / $7/M out
- OpenAI: GPT-5.4 Mini (batch) (openai/gpt-5.4-mini:batch) added to the catalog: 400,000 ctx, $0.375/M in / $2.25/M out
- OpenAI: GPT-5.4 Nano (batch) (openai/gpt-5.4-nano:batch) added to the catalog: 400,000 ctx, $0.1/M in / $0.625/M out
- OpenAI: GPT-5.4 Pro (batch) (openai/gpt-5.4-pro:batch) added to the catalog: 1,050,000 ctx, $15/M in / $90/M out
- OpenAI: GPT-5.4 (batch) (openai/gpt-5.4:batch) added to the catalog: 1,050,000 ctx, $1.25/M in / $7.5/M out
- OpenAI: GPT-5.5 Pro (batch) (openai/gpt-5.5-pro:batch) added to the catalog: 1,050,000 ctx, $15/M in / $90/M out
- OpenAI: GPT-5.5 (batch) (openai/gpt-5.5:batch) added to the catalog: 1,050,000 ctx, $2.5/M in / $15/M out
- OpenAI: GPT-5.6 Luna Pro (batch) (openai/gpt-5.6-luna-pro:batch) added to the catalog: 1,050,000 ctx, $0.1/M in / $0.6/M out
- OpenAI: GPT-5.6 Luna (batch) (openai/gpt-5.6-luna:batch) added to the catalog: 1,050,000 ctx, $0.1/M in / $0.6/M out
- OpenAI: GPT-5.6 Sol Pro (batch) (openai/gpt-5.6-sol-pro:batch) added to the catalog: 1,050,000 ctx, $1/M in / $5/M out
- OpenAI: GPT-5.6 Sol (batch) (openai/gpt-5.6-sol:batch) added to the catalog: 1,050,000 ctx, $1/M in / $5/M out
- OpenAI: GPT-5.6 Terra Pro (batch) (openai/gpt-5.6-terra-pro:batch) added to the catalog: 1,050,000 ctx, $1/M in / $6/M out
- OpenAI: GPT-5.6 Terra (batch) (openai/gpt-5.6-terra:batch) added to the catalog: 1,050,000 ctx, $1/M in / $6/M out
- OpenAI: o3 Mini (batch) (openai/o3-mini:batch) added to the catalog: 200,000 ctx, $0.55/M in / $2.2/M out
- OpenAI: o3 (batch) (openai/o3:batch) added to the catalog: 200,000 ctx, $1/M in / $4/M out
- OpenAI: o4 Mini (batch) (openai/o4-mini:batch) added to the catalog: 200,000 ctx, $0.55/M in / $2.2/M out
2026-08-31 68 change(s)
model price changes
- deepseek/deepseek-v4-flash: prompt price $0.08/M → $0.089/M (+10.6%)
- deepseek/deepseek-v4-flash: completion price $0.16/M → $0.177/M (+10.6%)
- deepseek/deepseek-v4-pro: prompt price $0.437/M → $1.04/M (+138.3%)
- deepseek/deepseek-v4-pro: completion price $0.875/M → $2.08/M (+138.3%)
- meta-llama/llama-4-maverick: completion price $0.8/M → $0.696/M (−13.0%)
- mistralai/devstral-2512: prompt price $0.44/M → $0.4/M (−9.1%)
- mistralai/devstral-2512: completion price $2.2/M → $2/M (−9.1%)
- moonshotai/kimi-k2.5: prompt price $0.6/M → $0.45/M (−25.0%)
- moonshotai/kimi-k2.5: completion price $3/M → $2.25/M (−25.0%)
quantization changes
- DeepInfra: z-ai/glm-5.3 quantization fp8 → fp4
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.08/M → $0.14/M (+74.5%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.16/M → $0.28/M (+74.5%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.17/M → $0.18/M (+5.9%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.08/M → $0.089/M (+10.6%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.16/M → $0.177/M (+10.6%)
- AkashML: deepseek/deepseek-v4-flash-0731 prompt price $0.1/M → $0.065/M (−35.0%)
- AkashML: deepseek/deepseek-v4-flash-0731 completion price $0.28/M → $0.18/M (−35.7%)
- Baidu: deepseek/deepseek-v4-flash-0731 prompt price $0.045/M → $0.14/M (+211.5%)
- Baidu: deepseek/deepseek-v4-flash-0731 completion price $0.09/M → $0.28/M (+211.5%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.17/M → $0.18/M (+5.9%)
- StreamLake: deepseek/deepseek-v4-flash-0731 prompt price $0.088/M → $0.22/M (+150.0%)
- StreamLake: deepseek/deepseek-v4-flash-0731 completion price $0.264/M → $0.66/M (+150.0%)
- Baidu: deepseek/deepseek-v4-pro prompt price $0.446/M → $1.69/M (+278.8%)
- Baidu: deepseek/deepseek-v4-pro completion price $0.892/M → $3.38/M (+278.8%)
- StreamLake: deepseek/deepseek-v4-pro prompt price $0.437/M → $1.04/M (+138.3%)
- StreamLake: deepseek/deepseek-v4-pro completion price $0.875/M → $2.08/M (+138.3%)
- StreamLake: deepseek/deepseek-v4-pro-0813 prompt price $1.12/M → $1.12/M (−0.5%)
- StreamLake: deepseek/deepseek-v4-pro-0813 completion price $3.36/M → $3.35/M (−0.5%)
- Mistral: mistralai/devstral-2512 prompt price $0.44/M → $0.4/M (−9.1%)
- Mistral: mistralai/devstral-2512 completion price $2.2/M → $2/M (−9.1%)
2026-08-30 51 change(s)
model price changes
- ~deepseek/deepseek-v4-flash-latest: completion price $0.1/M → $0.16/M (+60.0%)
- ~z-ai/glm-latest: prompt price $1.2/M → $1.19/M (−1.0%)
- ~z-ai/glm-latest: completion price $4/M → $4.18/M (+4.5%)
- arcee-ai/trinity-large-thinking: prompt price $0.22/M → $0.25/M (+13.6%)
- arcee-ai/trinity-large-thinking: completion price $0.85/M → $0.8/M (−5.9%)
- deepseek/deepseek-v4-flash: prompt price $0.084/M → $0.08/M (−4.3%)
- deepseek/deepseek-v4-flash: completion price $0.167/M → $0.16/M (−4.3%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.045/M → $0.065/M (+44.4%)
- deepseek/deepseek-v4-flash-0731: completion price $0.09/M → $0.18/M (+100.0%)
- deepseek/deepseek-v4-pro: prompt price $0.63/M → $0.437/M (−30.6%)
- deepseek/deepseek-v4-pro: completion price $1.26/M → $0.875/M (−30.6%)
- qwen/qwen3-next-80b-a3b-instruct: prompt price $0.1/M → $0.09/M (−10.0%)
- thinkingmachines/inkling: prompt price $0.95/M → $1/M (+5.3%)
- z-ai/glm-5.1: prompt price $1.26/M → $0.966/M (−23.3%)
- z-ai/glm-5.1: completion price $3.96/M → $3.04/M (−23.3%)
quantization changes
- OpenInference: deepseek/deepseek-v4-flash-0731 quantization fp4 → fp8
- Relace: z-ai/glm-5.3-flash quantization fp8 → fp4
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.08/M (−4.0%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.167/M → $0.16/M (−4.0%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.165/M → $0.17/M (+3.0%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.08/M (−4.3%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.167/M → $0.16/M (−4.3%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.165/M → $0.17/M (+3.0%)
- OpenInference: deepseek/deepseek-v4-flash-0731 completion price $0.1/M → $0.16/M (+60.0%)
- Phala: deepseek/deepseek-v4-flash-0731 prompt price $0.22/M → $0.44/M (+100.0%)
- Phala: deepseek/deepseek-v4-flash-0731 completion price $0.66/M → $1.32/M (+100.0%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.045/M → $0.065/M (+44.4%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.09/M → $0.18/M (+100.0%)
- Baidu: deepseek/deepseek-v4-pro prompt price $0.639/M → $0.446/M (−30.2%)
- Baidu: deepseek/deepseek-v4-pro completion price $1.28/M → $0.892/M (−30.2%)
2026-08-29 119 change(s)
added to the catalog
- DeepSeek: DeepSeek V4 Flash 0731 (batch) (deepseek/deepseek-v4-flash-0731:batch) added to the catalog: 1,048,576 ctx, $0.14/M in / $0.28/M out
- DeepSeek: DeepSeek V4 Pro 0813 (batch) (deepseek/deepseek-v4-pro-0813:batch) added to the catalog: 1,048,576 ctx, $1.32/M in / $3.96/M out
- Google: Gemma 4 31B (batch) (google/gemma-4-31b-it:batch) added to the catalog: 262,144 ctx, $0.39/M in / $0.97/M out
- Meta: Muse Glimmer 30B (batch) (meta/muse-glimmer-30b:batch) added to the catalog: 131,072 ctx, $0.35/M in / $1.5/M out
- MoonshotAI: Kimi K3 (batch) (moonshotai/kimi-k3:batch) added to the catalog: 1,048,576 ctx, $3/M in / $15/M out
- OpenAI: gpt-oss-120b (batch) (openai/gpt-oss-120b:batch) added to the catalog: 131,072 ctx, $0.15/M in / $0.6/M out
- OpenAI: gpt-oss-20b (batch) (openai/gpt-oss-20b:batch) added to the catalog: 131,072 ctx, $0.05/M in / $0.2/M out
- Qwen: Qwen3.5-9B (batch) (qwen/qwen3.5-9b:batch) added to the catalog: 262,144 ctx, $0.17/M in / $0.25/M out
- Thinking Machines: Inkling Small (batch) (thinkingmachines/inkling-small:batch) added to the catalog: 524,288 ctx, $0.5/M in / $1.2/M out
- Z.ai: GLM 5.3 Flash (batch) (z-ai/glm-5.3-flash:batch) added to the catalog: 1,048,575 ctx, $0.15/M in / $0.5/M out
removed from the catalog
- AllenAI: Olmo 3 32B Think (allenai/olmo-3-32b-think) removed from the catalog
- Arcee AI: Virtuoso Large (arcee-ai/virtuoso-large) removed from the catalog
model price changes
- ~google/gemini-flash-latest: prompt price $0.375/M → $0.75/M (+100.0%)
- ~google/gemini-flash-latest: completion price $1.88/M → $3.75/M (+100.0%)
- ~z-ai/glm-latest: prompt price $1.25/M → $1.2/M (−4.0%)
- ~z-ai/glm-latest: completion price $4.4/M → $4/M (−9.1%)
- deepseek/deepseek-v4-flash: prompt price $0.087/M → $0.084/M (−3.5%)
- deepseek/deepseek-v4-flash: completion price $0.174/M → $0.167/M (−3.5%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.06/M → $0.045/M (−25.0%)
- deepseek/deepseek-v4-flash-0731: completion price $0.12/M → $0.09/M (−25.0%)
- deepseek/deepseek-v4-pro: prompt price $0.762/M → $0.63/M (−17.3%)
- deepseek/deepseek-v4-pro: completion price $1.52/M → $1.26/M (−17.3%)
- google/gemini-3.7-flash: prompt price $0.375/M → $0.75/M (+100.0%)
- google/gemini-3.7-flash: completion price $1.88/M → $3.75/M (+100.0%)
- meta/muse-glimmer-30b: prompt price $0.35/M → $0.3/M (−14.3%)
- meta/muse-glimmer-30b: completion price $1.5/M → $1.2/M (−20.0%)
- nvidia/nemotron-3.5-lightning: prompt price $0.1/M → $0.08/M (−20.0%)
- nvidia/nemotron-3.5-lightning: completion price $0.25/M → $0.2/M (−20.0%)
- qwen/qwen3-vl-30b-a3b-instruct: prompt price $0.13/M → $0.15/M (+15.4%)
- qwen/qwen3-vl-30b-a3b-instruct: completion price $0.52/M → $0.6/M (+15.4%)
2026-08-28 150 change(s)
added to the catalog
- Mistral: Codestral 2508 (batch) (mistralai/codestral-2508:batch) added to the catalog: 256,000 ctx, $0.3/M in / $0.9/M out
- Mistral: Ministral 3 8B 2512 (batch) (mistralai/ministral-8b-2512:batch) added to the catalog: 262,144 ctx, $0.15/M in / $0.15/M out
- Mistral: Mistral Large 3 2512 (batch) (mistralai/mistral-large-2512:batch) added to the catalog: 262,144 ctx, $0.5/M in / $1.5/M out
- Mistral: Mistral Medium 3.5 (batch) (mistralai/mistral-medium-3-5:batch) added to the catalog: 262,144 ctx, $0.75/M in / $3.75/M out
- Mistral: Mistral Medium 3.1 (batch) (mistralai/mistral-medium-3.1:batch) added to the catalog: 131,072 ctx, $0.4/M in / $2/M out
- Mistral: Mistral Small 4 (batch) (mistralai/mistral-small-2603:batch) added to the catalog: 262,144 ctx, $0.15/M in / $0.6/M out
- Qwen: Qwen3.8 2.4T A95B (batch) (qwen/qwen3.8-2.4t-a95b:batch) added to the catalog: 1,010,000 ctx, $2/M in / $6/M out
- Tencent: Hy4 preview (tencent/hy4-preview) added to the catalog: 1,048,576 ctx, $0.834/M in / $2.5/M out
removed from the catalog
- Mistral: Ministral 8B (mistralai/ministral-8b) removed from the catalog
- MoonshotAI: Kimi K2.7 Code (batch) (moonshotai/kimi-k2.7-code:batch) removed from the catalog
- OpenAI: GPT-3.5 Turbo (batch) (openai/gpt-3.5-turbo:batch) removed from the catalog
- OpenAI: GPT-4 Turbo (batch) (openai/gpt-4-turbo:batch) removed from the catalog
- OpenAI: GPT-4.1 Mini (batch) (openai/gpt-4.1-mini:batch) removed from the catalog
- OpenAI: GPT-4.1 Nano (batch) (openai/gpt-4.1-nano:batch) removed from the catalog
- OpenAI: GPT-4.1 (batch) (openai/gpt-4.1:batch) removed from the catalog
- OpenAI: GPT-4o-mini (batch) (openai/gpt-4o-mini:batch) removed from the catalog
- OpenAI: GPT-4o (batch) (openai/gpt-4o:batch) removed from the catalog
- OpenAI: GPT-5 Codex (batch) (openai/gpt-5-codex:batch) removed from the catalog
- OpenAI: GPT-5 Mini (batch) (openai/gpt-5-mini:batch) removed from the catalog
- OpenAI: GPT-5 Nano (batch) (openai/gpt-5-nano:batch) removed from the catalog
- OpenAI: GPT-5 Pro (batch) (openai/gpt-5-pro:batch) removed from the catalog
- OpenAI: GPT-5 (batch) (openai/gpt-5:batch) removed from the catalog
- OpenAI: GPT-5.1 (batch) (openai/gpt-5.1:batch) removed from the catalog
- OpenAI: GPT-5.2 Pro (batch) (openai/gpt-5.2-pro:batch) removed from the catalog
- OpenAI: GPT-5.2 (batch) (openai/gpt-5.2:batch) removed from the catalog
- OpenAI: GPT-5.4 Mini (batch) (openai/gpt-5.4-mini:batch) removed from the catalog
- OpenAI: GPT-5.4 Nano (batch) (openai/gpt-5.4-nano:batch) removed from the catalog
- OpenAI: GPT-5.4 Pro (batch) (openai/gpt-5.4-pro:batch) removed from the catalog
- OpenAI: GPT-5.4 (batch) (openai/gpt-5.4:batch) removed from the catalog
- OpenAI: GPT-5.5 Pro (batch) (openai/gpt-5.5-pro:batch) removed from the catalog
2026-08-27 93 change(s)
added to the catalog
- Ling 3.0 Flash Fin (free) (inclusionai/ling-3.0-flash-fin:free) added to the catalog: 262,144 ctx, $0/M in / $0/M out
- Qwen: Qwen3.8 Flash (qwen/qwen3.8-flash) added to the catalog: 1,000,000 ctx, $0.15/M in / $0.47/M out
- Z.ai: GLM 5.3 Flash (z-ai/glm-5.3-flash) added to the catalog: 1,310,720 ctx, $0.075/M in / $0.25/M out
removed from the catalog
- Ox Alpha (stealth/ox-alpha) removed from the catalog
- Z.ai: GLM 5.2 (batch) (z-ai/glm-5.2:batch) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: completion price $0.075/M → $0.1/M (+33.3%)
- deepseek/deepseek-v4-flash: prompt price $0.089/M → $0.078/M (−12.0%)
- deepseek/deepseek-v4-flash: completion price $0.177/M → $0.156/M (−12.0%)
- moonshotai/kimi-k2.7-code: prompt price $0.67/M → $0.66/M (−1.5%)
- qwen/qwen3-235b-a22b-2507: prompt price $0.09/M → $0.087/M (−2.8%)
- qwen/qwen3-235b-a22b-2507: completion price $0.55/M → $0.35/M (−36.4%)
- qwen/qwen3.6-35b-a3b: prompt price $0.14/M → $0.1/M (−28.6%)
- qwen/qwen3.6-35b-a3b: completion price $1/M → $0.9/M (−10.0%)
- tencent/hy3: prompt price $0.132/M → $0.083/M (−37.5%)
- tencent/hy3: completion price $0.528/M → $0.33/M (−37.5%)
- z-ai/glm-4.6: prompt price $0.5/M → $0.43/M (−14.0%)
- z-ai/glm-4.6: completion price $2/M → $1.75/M (−12.5%)
quantization changes
- DeepInfra: xiaomi/mimo-v2.5 quantization bf16 → fp8
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.079/M (−43.3%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.28/M → $0.159/M (−43.3%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.15/M (+7.1%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.089/M → $0.078/M (−12.0%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.177/M → $0.156/M (−12.0%)
- Alibaba: deepseek/deepseek-v4-flash-0731 prompt price $0.352/M → $0.176/M (−50.0%)
- Alibaba: deepseek/deepseek-v4-flash-0731 completion price $1.06/M → $0.528/M (−50.0%)
- Baidu: deepseek/deepseek-v4-flash-0731 prompt price $0.14/M → $0.06/M (−57.2%)
- Baidu: deepseek/deepseek-v4-flash-0731 completion price $0.28/M → $0.12/M (−57.2%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.155/M → $0.15/M (−3.2%)
- Morph: deepseek/deepseek-v4-flash-0731 prompt price $0.079/M → $0.099/M (+25.0%)
- OpenInference: deepseek/deepseek-v4-flash-0731 completion price $0.075/M → $0.1/M (+33.3%)
2026-08-26 71 change(s)
added to the catalog
- MiniMax: MiniMax M3 (free) (minimax/minimax-m3:free) added to the catalog: 1,048,576 ctx, $0/M in / $0/M out
removed from the catalog
- Google: Gemma 3n 4B (google/gemma-3n-e4b-it) removed from the catalog
- Qwen: Qwen Plus 0728 (thinking) (qwen/qwen-plus-2025-07-28:thinking) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.035/M → $0.03/M (−14.3%)
- ~moonshotai/kimi-latest: prompt price $2.8/M → $2.55/M (−8.9%)
- ~moonshotai/kimi-latest: completion price $14/M → $12.8/M (−8.9%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.14/M → $0.06/M (−57.1%)
- deepseek/deepseek-v4-flash-0731: completion price $0.28/M → $0.12/M (−57.1%)
- deepseek/deepseek-v4-pro: prompt price $0.79/M → $0.87/M (+10.1%)
- deepseek/deepseek-v4-pro: completion price $1.58/M → $1.74/M (+10.1%)
- google/gemma-4-31b-it: prompt price $0.1/M → $0.09/M (−10.0%)
- meta-llama/llama-3.3-70b-instruct: prompt price $0.1/M → $0.71/M (+610.0%)
- meta-llama/llama-3.3-70b-instruct: completion price $0.32/M → $0.71/M (+121.9%)
- meta-llama/llama-4-scout: prompt price $0.1/M → $0.11/M (+10.0%)
- meta-llama/llama-4-scout: completion price $0.3/M → $0.34/M (+13.3%)
- qwen/qwen2.5-vl-72b-instruct: prompt price $0.8/M → $0.25/M (−68.8%)
- qwen/qwen2.5-vl-72b-instruct: completion price $1/M → $0.75/M (−25.0%)
- qwen/qwen3.5-397b-a17b: prompt price $0.5/M → $0.39/M (−22.0%)
- qwen/qwen3.5-397b-a17b: completion price $3.6/M → $2.34/M (−35.0%)
- qwen/qwen3.6-27b: prompt price $0.32/M → $0.6/M (+87.5%)
- qwen/qwen3.6-27b: completion price $3.2/M → $3.6/M (+12.5%)
- qwen/qwen3.8-27b: prompt price $0.4/M → $0.425/M (+6.3%)
- qwen/qwen3.8-27b: completion price $3/M → $2.55/M (−15.0%)
model context changes
- meta-llama/llama-guard-4-12b: context length 1,048,576 → 163,840
quantization changes
- GMICloud: deepseek/deepseek-v4-flash-0731 quantization fp4 → fp8
- Io Net: z-ai/glm-5.2 quantization fp8 → fp4
provider price changes
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.15/M → $0.155/M (+3.3%)
- OpenInference: deepseek/deepseek-v4-flash-0731 prompt price $0.035/M → $0.03/M (−14.3%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.04/M → $0.06/M (+50.0%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.08/M → $0.12/M (+50.0%)
$ curl variables.md — this site speaks markdown to your terminal.