YFarmX logoYFarmX
AI Desk · AI Fingerprinting

Identity watch

A model can change behind its name. The watch records what appeared, what measured differently, and what measurement placed, so a silent change stops being silent.

Price watch

What the labs charge, as listed on OpenRouter on each snapshot date, in dollars per million tokens: the median of each lab's priced text models, prompt price first and completion price second
Lab21 Aug3 Sept16 Sept5 Oct8 Oct
Every priced text model320 models on 21 Aug, 349 on 8 Oct$0.428$1.60$0.428$1.70$0.40$1.738$0.40$1.775$0.425$1.80
OpenAI65 priced models$1.75$10.00$1.75$10.00$1.75$10.00$2.00$10.00$2.00$10.00
Anthropic16 priced models$5.00$25.00$5.00$25.00$5.00$25.00$5.00$25.00$4.50$22.50
Google27 priced models$0.375$2.50$0.50$3.00$0.50$2.75$0.50$2.75$0.50$3.00
DeepSeek14 priced models$0.27$0.975$0.295$0.945$0.269$0.95$0.27$1.084$0.264$1.014
Alibaba (Qwen)53 priced models$0.22$1.162$0.21$1.125$0.20$1.125$0.20$1.10$0.21$1.10
Z.ai16 priced models$0.60$2.00$0.60$2.06$0.60$1.86$0.515$2.06$0.515$2.06
Moonshot AI7 priced models$0.60$2.50$0.60$2.50$0.60$2.50$0.60$2.50$0.60$2.50
xAI7 priced models$1.25$2.50$1.25$2.50$1.25$2.50$1.25$2.50$1.25$2.50
Mistral AI20 priced models$0.20$0.60$0.30$0.60$0.30$0.60$0.30$0.60$0.326$0.75
Meta8 priced models$0.10$0.31$0.10$0.31$0.10$0.31$0.14$0.315$0.10$0.31
MiniMax8 priced models$0.30$1.20$0.30$1.20$0.30$1.20$0.30$1.20$0.30$1.20
Xiaomi5 priced modelsunder 3 modelsunder 3 modelsunder 3 models$0.435$0.87$0.435$0.87

A lab's median moves when it adds or withdraws models as well as when it reprices one, so the list below names the individual moves.

Biggest price moves, 5 Oct to 8 Oct

39 listed prices moved in those 3 days: 16 up and 23 down. The twelve largest, by percentage:

What changed

Every row is a measured difference between two dated snapshots: the value it was, and the value it became

5 October 2026

Anthropic: Claude 3 Haikuanthropic/claude-3-haikuLeft the catalogue: none became noneRemovedAnthropic: Claude Fable 5.1anthropic/claude-fable-5.1Supported parameters: added tool_choiceAPIAnthropic: Claude Opus 4anthropic/claude-opus-4Left the catalogue: none became noneRemovedAnthropic: Claude Sonnet 4anthropic/claude-sonnet-4Context window: 1,000,000 became 200,000ContextDeepSeek: DeepSeek V3deepseek/deepseek-chatServing template: 2026-08-21: 48 of 50 rows as now became 2026-10-05: 2 rows moved (template)FingerprintDeepSeek: DeepSeek V3 0324deepseek/deepseek-chat-v3-0324Max output: 147,456 became 115,200OutputDeepSeek: DeepSeek V3 0324deepseek/deepseek-chat-v3-0324Prompt price / token: $0.25 / M tokens became $0.29 / M tokensPriceDeepSeek: DeepSeek V3 0324deepseek/deepseek-chat-v3-0324Completion price / token: $1.00 / M tokens became $1.14 / M tokensPriceDeepSeek: DeepSeek V3 0324deepseek/deepseek-chat-v3-0324Supported parameters: removed logit_bias, min_p, presence_penalty, repetition_penalty, stopAPIDeepSeek: DeepSeek V3.1 Terminusdeepseek/deepseek-v3.1-terminusMax output: 32,768 became 147,456OutputDeepSeek: DeepSeek V3.2deepseek/deepseek-v3.2Prompt price / token: $0.27 / M tokens became $0.28 / M tokensPriceDeepSeek: DeepSeek V3.2deepseek/deepseek-v3.2Completion price / token: $0.40 / M tokens became $0.42 / M tokensPriceDeepSeek: DeepSeek V3.2deepseek/deepseek-v3.2Provider accounting: 2026-08-21, via AtlasCloud: reproduced on 2026-10-05 via DigitalOcean became AtlasCloud counts 1 of 50 strings differentlyFingerprintDeepSeek: DeepSeek V3.2 Expdeepseek/deepseek-v3.2-expMax output: 65,536 became 147,456OutputDeepSeek: DeepSeek V3.2 Expdeepseek/deepseek-v3.2-expSupported parameters: removed logit_bias, logprobs, min_p, presence_penalty, repetition_penalty, seed, stop, top_logprobsAPIDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashMax output: 384,000 became 943,718OutputDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashPrompt price / token: $0.09 / M tokens became $0.03 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashCompletion price / token: $0.17 / M tokens became $1.28 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Context window: 1,310,720 became 1,048,576ContextDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Prompt price / token: $0.06 / M tokens became $0.02 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Completion price / token: $0.12 / M tokens became $1.28 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731 (batch)deepseek/deepseek-v4-flash-0731:batchLeft the catalogue: none became noneRemovedDeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expMax output: 943,718 became 262,144OutputDeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expPrompt price / token: $0.22 / M tokens became $0.22 / M tokensPriceDeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expCompletion price / token: $0.66 / M tokens became $0.65 / M tokensPriceDeepSeek: DeepSeek V4 Flash Vision Exp (batch)deepseek/deepseek-v4-flash-vision-exp:batchLeft the catalogue: none became noneRemovedDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proMax output: 393,216 became 384,000OutputDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proPrompt price / token: $1.60 / M tokens became $0.21 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proCompletion price / token: $3.20 / M tokens became $0.42 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Max output: 393,216 became 943,718OutputDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Prompt price / token: $0.58 / M tokens became $0.40 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Completion price / token: $1.74 / M tokens became $5.00 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813 (batch)deepseek/deepseek-v4-pro-0813:batchLeft the catalogue: none became noneRemovedDeepSeek: DeepSeek V4.1 Flashdeepseek/deepseek-v4.1-flashMax output: 384,000 became 943,718OutputDeepSeek: DeepSeek V4.1 Flashdeepseek/deepseek-v4.1-flashPrompt price / token: $0.15 / M tokens became $0.30 / M tokensPriceDeepSeek: DeepSeek V4.1 Flashdeepseek/deepseek-v4.1-flashCompletion price / token: $0.60 / M tokens became $1.20 / M tokensPriceDeepSeek: R1 Distill Llama 70Bdeepseek/deepseek-r1-distill-llama-70bLeft the catalogue: none became noneRemovedinclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finMax output: 235,929 became 32,768OutputinclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finPrompt price / token: $0.06 / M tokens became $0.04 / M tokensPriceinclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finCompletion price / token: $0.18 / M tokens became $0.12 / M tokensPriceinclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finSupported parameters: added logprobs, top_logprobsAPIinclusionAI: Ling 3.0 Flash Fin (free)inclusionai/ling-3.0-flash-fin:freeLeft the catalogue: none became noneRemovedinclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vlContext window: 131,072 became 262,144ContextinclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vlPrompt price / token: $0.06 / M tokens became $0.02 / M tokensPriceinclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vlCompletion price / token: $0.18 / M tokens became $0.06 / M tokensPriceinclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vlSupported parameters: added logprobs, top_logprobsAPIinclusionAI: Ling 3.0 Flash VL (free)inclusionai/ling-3.0-flash-vl:freeLeft the catalogue: none became noneRemovedInference.net: Schematron V2 Smallinference-net/schematron-v2-smallSupported parameters: added repetition_penaltyAPIInference.net: Schematron V2 Turboinference-net/schematron-v2-turboSupported parameters: added repetition_penaltyAPIKwaipilot: KAT-Coder-Pro V2kwaipilot/kat-coder-pro-v2Left the catalogue: none became noneRemovedLiquidAI: LFM2.5-2.6B (free)liquid/lfm-2.5-2.6b:freeSupported parameters: added top_pAPIMeta: Llama 3.3 70B Instructmeta-llama/llama-3.3-70b-instructPrompt price / token: $0.10 / M tokens became $0.22 / M tokensPriceMeta: Llama 3.3 70B Instructmeta-llama/llama-3.3-70b-instructCompletion price / token: $0.32 / M tokens became $0.50 / M tokensPriceMeta: Llama 4 Maverickmeta-llama/llama-4-maverickSupported parameters: removed min_pAPIMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bSupported parameters: removed logprobs, top_logprobsAPIMeta: Muse Glimmer 30B (batch)meta/muse-glimmer-30b:batchLeft the catalogue: none became noneRemovedMiniMax: MiniMax M1minimax/minimax-m1Prompt price / token: $0.40 / M tokens became $0.55 / M tokensPriceMiniMax: MiniMax M2minimax/minimax-m2Max output: 131,072 became 176,947OutputMiniMax: MiniMax M2minimax/minimax-m2Prompt price / token: $0.26 / M tokens became $0.30 / M tokensPriceMiniMax: MiniMax M2minimax/minimax-m2Completion price / token: $1.02 / M tokens became $1.20 / M tokensPriceMiniMax: MiniMax M2.7minimax/minimax-m2.7Max output: 131,072 became 176,947OutputMiniMax: MiniMax M2.7minimax/minimax-m2.7Prompt price / token: $0.30 / M tokens became $0.21 / M tokensPriceMiniMax: MiniMax M2.7minimax/minimax-m2.7Completion price / token: $1.20 / M tokens became $0.84 / M tokensPriceMiniMax: MiniMax M2.7minimax/minimax-m2.7Supported parameters: removed logprobs, structured_outputs, top_logprobsAPIMiniMax: MiniMax M3 (batch)minimax/minimax-m3:batchLeft the catalogue: none became noneRemovedMistral: Mistral Small 3.1 24Bmistralai/mistral-small-3.1-24b-instructSupported parameters: added structured_outputs, tool_choice, toolsAPIMistral: Mistral Small 4mistralai/mistral-small-2603Supported parameters: removed top_kAPIMoonshotAI: Kimi K2 Thinkingmoonshotai/kimi-k2-thinkingMax output: 98,304 became 235,929OutputMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codePrompt price / token: $0.71 / M tokens became $0.67 / M tokensPriceMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codeCompletion price / token: $3.21 / M tokens became $3.35 / M tokensPriceMoonshotAI: Kimi K3moonshotai/kimi-k3Prompt price / token: $2.65 / M tokens became $0.67 / M tokensPriceMoonshotAI: Kimi K3moonshotai/kimi-k3Completion price / token: $13.3 / M tokens became $14.0 / M tokensPriceMoonshotAI: Kimi K3 (batch)moonshotai/kimi-k3:batchMax output: 943,718 became 16,384OutputMoonshotAI: Kimi K3 (batch)moonshotai/kimi-k3:batchPrompt price / token: $3.00 / M tokens became $2.28 / M tokensPriceMoonshotAI: Kimi K3 (batch)moonshotai/kimi-k3:batchCompletion price / token: $15.0 / M tokens became $11.4 / M tokensPriceMoonshotAI: Kimi K3 (batch)moonshotai/kimi-k3:batchSupported parameters: added seedAPINex AGI: Nex-N2.5-Mini (free)nex-agi/nex-n2.5-mini:freeLeft the catalogue: none became noneRemovedNex AGI: Nex-N2.5-Pro (free)nex-agi/nex-n2.5-pro:freeLeft the catalogue: none became noneRemovedNVIDIA: Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55bMax output: 182,520 became 16,384OutputNVIDIA: Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55bPrompt price / token: $0.60 / M tokens became $0.50 / M tokensPriceNVIDIA: Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55bCompletion price / token: $2.40 / M tokens became $2.20 / M tokensPriceNVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightningMax output: 131,072 became 32,768OutputNVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightningPrompt price / token: $0.08 / M tokens became $0.06 / M tokensPriceNVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightningCompletion price / token: $0.20 / M tokens became $0.16 / M tokensPriceOpenAI: GPT-5openai/gpt-5Supported parameters: added verbosityAPIOpenAI: GPT-5 (batch)openai/gpt-5:batchSupported parameters: added verbosityAPIOpenAI: GPT-5 Imageopenai/gpt-5-imageSupported parameters: added verbosity; removed frequency_penalty, logit_bias, presence_penalty, stopAPIOpenAI: GPT-5 Image Miniopenai/gpt-5-image-miniSupported parameters: added verbosity; removed frequency_penalty, logit_bias, presence_penalty, stopAPIOpenAI: GPT-5 Miniopenai/gpt-5-miniSupported parameters: added verbosityAPIOpenAI: GPT-5 Mini (batch)openai/gpt-5-mini:batchSupported parameters: added verbosityAPIOpenAI: GPT-5 Nanoopenai/gpt-5-nanoSupported parameters: added verbosityAPIOpenAI: GPT-5 Nano (batch)openai/gpt-5-nano:batchSupported parameters: added verbosityAPIOpenAI: GPT-5 Proopenai/gpt-5-proSupported parameters: added verbosityAPIOpenAI: GPT-5 Pro (batch)openai/gpt-5-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.1openai/gpt-5.1Supported parameters: added verbosityAPIOpenAI: GPT-5.1 (batch)openai/gpt-5.1:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.1-Codexopenai/gpt-5.1-codexSupported parameters: added verbosityAPIOpenAI: GPT-5.1-Codex-Maxopenai/gpt-5.1-codex-maxSupported parameters: added verbosityAPIOpenAI: GPT-5.1-Codex-Miniopenai/gpt-5.1-codex-miniSupported parameters: added verbosityAPIOpenAI: GPT-5.2openai/gpt-5.2Supported parameters: added verbosityAPIOpenAI: GPT-5.2 (batch)openai/gpt-5.2:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.2 Chatopenai/gpt-5.2-chatSupported parameters: added verbosityAPIOpenAI: GPT-5.2 Proopenai/gpt-5.2-proSupported parameters: added verbosityAPIOpenAI: GPT-5.2 Pro (batch)openai/gpt-5.2-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.2-Codexopenai/gpt-5.2-codexSupported parameters: added verbosityAPIOpenAI: GPT-5.3-Codexopenai/gpt-5.3-codexSupported parameters: added verbosityAPIOpenAI: GPT-5.4openai/gpt-5.4Supported parameters: added verbosityAPIOpenAI: GPT-5.4 (batch)openai/gpt-5.4:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.4 Image 2openai/gpt-5.4-image-2Supported parameters: added verbosity; removed frequency_penalty, logit_bias, presence_penalty, stopAPIOpenAI: GPT-5.4 Miniopenai/gpt-5.4-miniSupported parameters: added verbosityAPIOpenAI: GPT-5.4 Mini (batch)openai/gpt-5.4-mini:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.4 Nanoopenai/gpt-5.4-nanoSupported parameters: added verbosityAPIOpenAI: GPT-5.4 Nano (batch)openai/gpt-5.4-nano:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.4 Proopenai/gpt-5.4-proSupported parameters: added verbosityAPIOpenAI: GPT-5.4 Pro (batch)openai/gpt-5.4-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.5openai/gpt-5.5Supported parameters: added verbosityAPIOpenAI: GPT-5.5 (batch)openai/gpt-5.5:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.5 Proopenai/gpt-5.5-proSupported parameters: added verbosityAPIOpenAI: GPT-5.5 Pro (batch)openai/gpt-5.5-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Lunaopenai/gpt-5.6-lunaSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Luna (batch)openai/gpt-5.6-luna:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Luna Proopenai/gpt-5.6-luna-proSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Luna Pro (batch)openai/gpt-5.6-luna-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Solopenai/gpt-5.6-solSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Sol (batch)openai/gpt-5.6-sol:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Sol Proopenai/gpt-5.6-sol-proSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Sol Pro (batch)openai/gpt-5.6-sol-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Terraopenai/gpt-5.6-terraSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Terra (batch)openai/gpt-5.6-terra:batchSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Terra Proopenai/gpt-5.6-terra-proSupported parameters: added verbosityAPIOpenAI: GPT-5.6 Terra Pro (batch)openai/gpt-5.6-terra-pro:batchSupported parameters: added verbosityAPIOpenAI: GPT-6 Astraopenai/gpt-6-astraSupported parameters: added verbosityAPIOpenAI: GPT-6 Astra (batch)openai/gpt-6-astra:batchSupported parameters: added verbosityAPIOpenAI: GPT-6 Astra Proopenai/gpt-6-astra-proSupported parameters: added verbosityAPIOpenAI: GPT-6 Astra Pro (batch)openai/gpt-6-astra-pro:batchSupported parameters: added verbosityAPIOpenAI: gpt-oss-120b (batch)openai/gpt-oss-120b:batchPrompt price / token: $0.15 / M tokens became $0.03 / M tokensPriceOpenAI: gpt-oss-120b (batch)openai/gpt-oss-120b:batchCompletion price / token: $0.60 / M tokens became $0.14 / M tokensPriceOpenAI: gpt-oss-120b (batch)openai/gpt-oss-120b:batchSupported parameters: added seedAPIOpenAI: gpt-oss-20bopenai/gpt-oss-20bMax output: 117,964 became 32,768OutputOpenAI: gpt-oss-20bopenai/gpt-oss-20bPrompt price / token: $0.03 / M tokens became $0.02 / M tokensPriceOpenAI: gpt-oss-20bopenai/gpt-oss-20bCompletion price / token: $0.13 / M tokens became $0.09 / M tokensPriceQwen: Qwen3 32Bqwen/qwen3-32bSupported parameters: added logprobs, top_a, top_logprobsAPIQwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructMax output: 16,384 became 235,929OutputQwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructPrompt price / token: $0.09 / M tokens became $0.10 / M tokensPriceQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructMax output: 32,768 became 16,384OutputQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructPrompt price / token: $0.13 / M tokens became $0.15 / M tokensPriceQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructCompletion price / token: $0.52 / M tokens became $0.60 / M tokensPriceQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bMax output: 65,536 became 235,929OutputQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bPrompt price / token: $0.16 / M tokens became $0.15 / M tokensPriceQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bCompletion price / token: $1.30 / M tokens became $1.00 / M tokensPriceQwen: Qwen3.5-9Bqwen/qwen3.5-9bMax output: 235,929 became 32,768OutputQwen: Qwen3.5-9B (batch)qwen/qwen3.5-9b:batchLeft the catalogue: none became noneRemovedQwen: Qwen3.6 27Bqwen/qwen3.6-27bMax output: 65,536 became 262,140OutputQwen: Qwen3.6 27Bqwen/qwen3.6-27bPrompt price / token: $0.30 / M tokens became $0.32 / M tokensPriceQwen: Qwen3.6 27Bqwen/qwen3.6-27bCompletion price / token: $2.00 / M tokens became $3.25 / M tokensPriceQwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bPrompt price / token: $0.10 / M tokens became $0.15 / M tokensPriceQwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bCompletion price / token: $0.90 / M tokens became $1.00 / M tokensPriceQwen: Qwen3.8 2.4T A95B (batch)qwen/qwen3.8-2.4t-a95b:batchLeft the catalogue: none became noneRemovedQwen: Qwen3.8 27Bqwen/qwen3.8-27bPrompt price / token: $0.21 / M tokens became $0.42 / M tokensPriceQwen: Qwen3.8 27Bqwen/qwen3.8-27bTokenizer fingerprint: 2026-08-21: 45 of 50 rows as now became 2026-10-05: 5 rows moved (changed)FingerprintQwen2.5 Coder 32B Instructqwen/qwen-2.5-coder-32b-instructSupported parameters: added response_formatAPIStepFun: Step 3.7 Flashstepfun/step-3.7-flashSupported parameters: removed logit_bias, min_pAPITencent: Hy3tencent/hy3Prompt price / token: $0.13 / M tokens became $0.08 / M tokensPriceTencent: Hy3tencent/hy3Completion price / token: $0.53 / M tokens became $0.33 / M tokensPriceTencent: Hy4 previewtencent/hy4-previewPrompt price / token: $0.83 / M tokens became $0.75 / M tokensPriceTencent: Hy4 previewtencent/hy4-previewCompletion price / token: $2.50 / M tokens became $2.25 / M tokensPriceTencent: Hy4 previewtencent/hy4-previewSupported parameters: added frequency_penalty, logit_bias, min_p, presence_penalty, repetition_penalty, seed, top_k, top_pAPIThinking Machines: Inklingthinkingmachines/inklingContext window: 1,048,576 became 524,288ContextThinking Machines: Inklingthinkingmachines/inklingMax output: 471,859 became 262,144OutputThinking Machines: Inklingthinkingmachines/inklingPrompt price / token: $1.00 / M tokens became $0.95 / M tokensPriceThinking Machines: Inkling (batch)thinkingmachines/inkling:batchLeft the catalogue: none became noneRemovedThinking Machines: Inkling Smallthinkingmachines/inkling-smallContext window: 1,048,576 became 524,288ContextThinking Machines: Inkling Smallthinkingmachines/inkling-smallSupported parameters: removed logprobs, top_logprobsAPIUnion Alphastealth/union-alphaLeft the catalogue: none became noneRemovedUpstage: Solar Pro 3upstage/solar-pro-3Supported parameters: added reasoning_effortAPIUpstage: Solar Pro 4upstage/solar-pro4Supported parameters: added reasoning_effortAPIXiaomi: MiMo-V2.5xiaomi/mimo-v2.5Supported parameters: removed logit_bias, min_pAPIXiaomi: MiMo-V2.5-Proxiaomi/mimo-v2.5-proSupported parameters: removed logit_bias, min_pAPIXiaomi: MiMo-V2.5-Proxiaomi/mimo-v2.5-proToken overhead: 2026-08-22: 0 of 50 rows as now became 2026-10-05: 50 rows moved (baseline)FingerprintZ.ai: GLM 4.7z-ai/glm-4.7Prompt price / token: $0.40 / M tokens became $0.60 / M tokensPriceZ.ai: GLM 4.7z-ai/glm-4.7Completion price / token: $1.75 / M tokens became $2.20 / M tokensPriceZ.ai: GLM 5.1z-ai/glm-5.1Max output: 128,000 became 131,072OutputZ.ai: GLM 5.1z-ai/glm-5.1Prompt price / token: $0.97 / M tokens became $1.40 / M tokensPriceZ.ai: GLM 5.1z-ai/glm-5.1Completion price / token: $3.04 / M tokens became $4.40 / M tokensPriceZ.ai: GLM 5.1z-ai/glm-5.1Provider accounting: 2026-09-03, via Friendli: reproduced on 2026-10-05 via Friendli became AtlasCloud counts 9 of 49 strings differentlyFingerprintZ.ai: GLM 5.2z-ai/glm-5.2Max output: 128,000 became 131,072OutputZ.ai: GLM 5.2z-ai/glm-5.2Prompt price / token: $1.40 / M tokens became $0.02 / M tokensPriceZ.ai: GLM 5.2z-ai/glm-5.2Completion price / token: $4.40 / M tokens became $16.0 / M tokensPriceZ.ai: GLM 5.2 (batch)z-ai/glm-5.2:batchLeft the catalogue: none became noneRemovedZ.ai: GLM 5.2 (free)z-ai/glm-5.2:freeLeft the catalogue: none became noneRemovedZ.ai: GLM 5.3z-ai/glm-5.3Context window: 1,310,720 became 1,048,576ContextZ.ai: GLM 5.3z-ai/glm-5.3Max output: 943,717 became 943,718OutputZ.ai: GLM 5.3z-ai/glm-5.3Prompt price / token: $1.40 / M tokens became $0.05 / M tokensPriceZ.ai: GLM 5.3z-ai/glm-5.3Completion price / token: $4.40 / M tokens became $7.00 / M tokensPriceZ.ai: GLM 5.3 (batch)z-ai/glm-5.3:batchMax output: 943,718 became 131,072OutputZ.ai: GLM 5.3 (batch)z-ai/glm-5.3:batchPrompt price / token: $0.70 / M tokens became $0.45 / M tokensPriceZ.ai: GLM 5.3 (batch)z-ai/glm-5.3:batchCompletion price / token: $2.20 / M tokens became $2.00 / M tokensPriceZ.ai: GLM 5.3 (batch)z-ai/glm-5.3:batchSupported parameters: added min_p, seed; removed logprobs, top_logprobsAPIZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashContext window: 1,310,720 became 1,048,576ContextZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashMax output: 131,072 became 943,717OutputZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashPrompt price / token: $0.09 / M tokens became $0.15 / M tokensPriceZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashCompletion price / token: $0.30 / M tokens became $0.50 / M tokensPriceZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchMax output: 943,718 became 131,072OutputZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchPrompt price / token: $0.07 / M tokens became $0.06 / M tokensPriceZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchCompletion price / token: $0.25 / M tokens became $0.20 / M tokensPriceZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchSupported parameters: added seed; removed logprobs, top_logprobsAPI

16 September 2026

DeepSeek: DeepSeek V3deepseek/deepseek-chatMax output: 16,384 became 16,000OutputDeepSeek: DeepSeek V3deepseek/deepseek-chatPrompt price / token: $0.32 / M tokens became $0.26 / M tokensPriceDeepSeek: DeepSeek V3deepseek/deepseek-chatCompletion price / token: $0.89 / M tokens became $1.03 / M tokensPriceDeepSeek: DeepSeek V3.1deepseek/deepseek-chat-v3.1Max output: 144,900 became 32,768OutputDeepSeek: DeepSeek V3.1deepseek/deepseek-chat-v3.1Prompt price / token: $0.55 / M tokens became $0.25 / M tokensPriceDeepSeek: DeepSeek V3.1deepseek/deepseek-chat-v3.1Completion price / token: $1.65 / M tokens became $0.95 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashPrompt price / token: $0.08 / M tokens became $0.09 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashCompletion price / token: $0.16 / M tokens became $0.17 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Prompt price / token: $0.07 / M tokens became $0.06 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Completion price / token: $0.18 / M tokens became $0.12 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731 (batch)deepseek/deepseek-v4-flash-0731:batchPrompt price / token: $0.14 / M tokens became $0.11 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731 (batch)deepseek/deepseek-v4-flash-0731:batchCompletion price / token: $0.28 / M tokens became $0.33 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731 (batch)deepseek/deepseek-v4-flash-0731:batchSupported parameters: added logprobs, top_logprobsAPIDeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expMax output: 384,000 became 943,718OutputDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proMax output: 384,000 became 393,216OutputDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proPrompt price / token: $1.03 / M tokens became $1.60 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proCompletion price / token: $2.06 / M tokens became $3.20 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Max output: 384,000 became 393,216OutputDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Prompt price / token: $0.66 / M tokens became $0.58 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Completion price / token: $1.98 / M tokens became $1.74 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813 (batch)deepseek/deepseek-v4-pro-0813:batchPrompt price / token: $1.32 / M tokens became $0.66 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813 (batch)deepseek/deepseek-v4-pro-0813:batchCompletion price / token: $3.96 / M tokens became $1.98 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813 (batch)deepseek/deepseek-v4-pro-0813:batchSupported parameters: added logprobs, top_logprobsAPIDeepSeek: R1deepseek/deepseek-r1Supported parameters: removed structured_outputsAPIGoogle: Gemini 2.5 Pro Preview 05-06google/gemini-2.5-pro-preview-05-06Left the catalogue: none became noneRemovedGoogle: Gemma 4 26B A4B google/gemma-4-26b-a4b-itMax output: 16,384 became 235,929OutputGoogle: Gemma 4 26B A4B google/gemma-4-26b-a4b-itPrompt price / token: $0.07 / M tokens became $0.09 / M tokensPriceGoogle: Gemma 4 26B A4B google/gemma-4-26b-a4b-itCompletion price / token: $0.34 / M tokens became $0.30 / M tokensPriceGoogle: Gemma 4 31B (batch)google/gemma-4-31b-it:batchLeft the catalogue: none became noneRemovedIBM: Granite 4.1 8Bibm-granite/granite-4.1-8bLeft the catalogue: none became noneRemovedIBM: Granite 4.2 8Bibm-granite/granite-4.2-8bPrompt price / token: $0.10 / M tokens became $0.06 / M tokensPriceIBM: Granite 4.2 8Bibm-granite/granite-4.2-8bCompletion price / token: $0.15 / M tokens became $0.25 / M tokensPriceInception: Mercury 2.5 Previewinception/mercury-2.5-previewLeft the catalogue: none became noneRemovedinclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finSupported parameters: removed response_formatAPILiquidAI: LFM2.5-2.6B (free)liquid/lfm-2.5-2.6b:freeSupported parameters: removed top_pAPIMeta: Llama 3.1 70B Instructmeta-llama/llama-3.1-70b-instructSupported parameters: removed logprobs, top_logprobsAPIMeta: Llama 4 Maverickmeta-llama/llama-4-maverickMax output: 115,200 became 16,384OutputMeta: Llama 4 Maverickmeta-llama/llama-4-maverickPrompt price / token: $0.20 / M tokens became $0.19 / M tokensPriceMeta: Llama 4 Maverickmeta-llama/llama-4-maverickCompletion price / token: $0.70 / M tokens became $0.65 / M tokensPriceMeta: Llama Guard 4 12Bmeta-llama/llama-guard-4-12bSupported parameters: removed response_formatAPIMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bPrompt price / token: $0.30 / M tokens became $0.35 / M tokensPriceMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bCompletion price / token: $1.10 / M tokens became $1.50 / M tokensPriceMeta: Muse Glimmer 30B (batch)meta/muse-glimmer-30b:batchPrompt price / token: $0.35 / M tokens became $0.17 / M tokensPriceMeta: Muse Glimmer 30B (batch)meta/muse-glimmer-30b:batchCompletion price / token: $1.50 / M tokens became $0.75 / M tokensPriceMeta: Muse Glimmer 30B (batch)meta/muse-glimmer-30b:batchSupported parameters: added logprobs, top_logprobsAPIMiniMax: MiniMax M1minimax/minimax-m1Prompt price / token: $0.55 / M tokens became $0.40 / M tokensPriceMiniMax: MiniMax M2.7 (free)minimax/minimax-m2.7:freeLeft the catalogue: none became noneRemovedMiniMax: MiniMax M3 (free)minimax/minimax-m3:freeLeft the catalogue: none became noneRemovedMistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructContext window: 131,072 became 256,000ContextMistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructPrompt price / token: $0.07 / M tokens became $0.09 / M tokensPriceMistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructCompletion price / token: $0.20 / M tokens became $0.25 / M tokensPriceMoonshotAI: Kimi K2 0711moonshotai/kimi-k2Max output: 100,352 became 98,304OutputMoonshotAI: Kimi K2 0905moonshotai/kimi-k2-0905Max output: 100,352 became 98,304OutputMoonshotAI: Kimi K2 Thinkingmoonshotai/kimi-k2-thinkingMax output: 100,352 became 98,304OutputMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codePrompt price / token: $0.66 / M tokens became $0.71 / M tokensPriceMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codeCompletion price / token: $3.40 / M tokens became $3.21 / M tokensPriceMoonshotAI: Kimi K3moonshotai/kimi-k3Prompt price / token: $3.00 / M tokens became $2.65 / M tokensPriceMoonshotAI: Kimi K3moonshotai/kimi-k3Completion price / token: $15.0 / M tokens became $13.3 / M tokensPriceMythoMax 13Bgryphe/mythomax-l2-13bPrompt price / token: $0.06 / M tokens became $0.08 / M tokensPriceMythoMax 13Bgryphe/mythomax-l2-13bCompletion price / token: $0.06 / M tokens became $0.11 / M tokensPriceNex AGI: Nex-N2-Mininex-agi/nex-n2-miniLeft the catalogue: none became noneRemovedNex AGI: Nex-N2-Pronex-agi/nex-n2-proLeft the catalogue: none became noneRemovedNous: Hermes 3 70B Instructnousresearch/hermes-3-llama-3.1-70bSupported parameters: removed response_formatAPINous: Hermes 4 70Bnousresearch/hermes-4-70bLeft the catalogue: none became noneRemovedNVIDIA: Nemotron 3 Supernvidia/nemotron-3-super-120b-a12bContext window: 1,000,000 became 262,144ContextNVIDIA: Nemotron 3 Supernvidia/nemotron-3-super-120b-a12bMax output: 16,384 became 235,929OutputNVIDIA: Nemotron 3 Supernvidia/nemotron-3-super-120b-a12bPrompt price / token: $0.08 / M tokens became $0.08 / M tokensPriceNVIDIA: Nemotron 3 Supernvidia/nemotron-3-super-120b-a12bCompletion price / token: $0.40 / M tokens became $0.45 / M tokensPriceOpenAI: GPT-4 Turbo Previewopenai/gpt-4-turbo-previewLeft the catalogue: none became noneRemovedOpenAI: gpt-oss-20b (batch)openai/gpt-oss-20b:batchLeft the catalogue: none became noneRemovedQwen: Qwen3 30B A3Bqwen/qwen3-30b-a3bSupported parameters: added structured_outputsAPIQwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructMax output: 235,929 became 16,384OutputQwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructPrompt price / token: $0.10 / M tokens became $0.09 / M tokensPriceQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructMax output: 16,384 became 32,768OutputQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructPrompt price / token: $0.15 / M tokens became $0.13 / M tokensPriceQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructCompletion price / token: $0.60 / M tokens became $0.52 / M tokensPriceQwen: Qwen3.5-122B-A10Bqwen/qwen3.5-122b-a10bMax output: 81,920 became 65,536OutputQwen: Qwen3.5-122B-A10Bqwen/qwen3.5-122b-a10bPrompt price / token: $0.29 / M tokens became $0.26 / M tokensPriceQwen: Qwen3.5-122B-A10Bqwen/qwen3.5-122b-a10bCompletion price / token: $2.40 / M tokens became $2.08 / M tokensPriceQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bMax output: 235,929 became 65,536OutputQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bPrompt price / token: $0.25 / M tokens became $0.16 / M tokensPriceQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bCompletion price / token: $1.25 / M tokens became $1.30 / M tokensPriceQwen: Qwen3.6 27Bqwen/qwen3.6-27bMax output: 235,929 became 65,536OutputQwen: Qwen3.6 27Bqwen/qwen3.6-27bPrompt price / token: $0.60 / M tokens became $0.30 / M tokensPriceQwen: Qwen3.6 27Bqwen/qwen3.6-27bCompletion price / token: $3.60 / M tokens became $2.00 / M tokensPriceQwen: Qwen3.8 2.4T A95Bqwen/qwen3.8-2.4t-a95bMax output: 262,144 became 131,072OutputQwen: Qwen3.8 27Bqwen/qwen3.8-27bPrompt price / token: $0.42 / M tokens became $0.21 / M tokensPriceQwen: Qwen3.8 27Bqwen/qwen3.8-27bCompletion price / token: $3.00 / M tokens became $2.55 / M tokensPriceQwen: Qwen3.8 27Bqwen/qwen3.8-27bSupported parameters: added top_aAPIQwen: Qwen3.8 Maxqwen/qwen3.8-maxLeft the catalogue: none became noneRemovedReMM SLERP 13Bundi95/remm-slerp-l2-13bMax output: 4,096 became 5,529OutputReMM SLERP 13Bundi95/remm-slerp-l2-13bPrompt price / token: $0.45 / M tokens became $0.35 / M tokensPriceSao10K: Llama 3.1 Euryale 70B v2.2sao10k/l3.1-euryale-70bSupported parameters: removed response_formatAPITencent: Hy3tencent/hy3Prompt price / token: $0.08 / M tokens became $0.13 / M tokensPriceTencent: Hy3tencent/hy3Completion price / token: $0.33 / M tokens became $0.53 / M tokensPriceTheDrummer: UnslopNemo 12Bthedrummer/unslopnemo-12bMax output: 26,214 became 819,200OutputTheDrummer: UnslopNemo 12Bthedrummer/unslopnemo-12bSupported parameters: removed response_format, tool_choice, toolsAPIThinking Machines: Inklingthinkingmachines/inklingSupported parameters: removed response_formatAPIThinking Machines: Inkling Small (batch)thinkingmachines/inkling-small:batchLeft the catalogue: none became noneRemovedUpstage: Solar Pro 3upstage/solar-pro-3Supported parameters: added parallel_tool_callsAPIUpstage: Solar Pro 4upstage/solar-pro4Prompt price / token: $0.03 / M tokens became $0.09 / M tokensPriceUpstage: Solar Pro 4upstage/solar-pro4Completion price / token: $0.12 / M tokens became $0.36 / M tokensPriceUpstage: Solar Pro 4upstage/solar-pro4Supported parameters: added parallel_tool_callsAPIZ.ai: GLM 4.6z-ai/glm-4.6Max output: 131,072 became 16,384OutputZ.ai: GLM 4.6z-ai/glm-4.6Prompt price / token: $0.55 / M tokens became $0.43 / M tokensPriceZ.ai: GLM 4.6z-ai/glm-4.6Completion price / token: $2.20 / M tokens became $1.75 / M tokensPriceZ.ai: GLM 4.7 Flashz-ai/glm-4.7-flashContext window: 202,752 became 200,000ContextZ.ai: GLM 4.7 Flashz-ai/glm-4.7-flashMax output: 16,384 became 117,964OutputZ.ai: GLM 4.7 Flashz-ai/glm-4.7-flashPrompt price / token: $0.06 / M tokens became $0.06 / M tokensPriceZ.ai: GLM 5z-ai/glm-5Supported parameters: removed logit_bias, min_pAPIZ.ai: GLM 5.2z-ai/glm-5.2Max output: 131,072 became 128,000OutputZ.ai: GLM 5.2z-ai/glm-5.2Prompt price / token: $0.97 / M tokens became $1.40 / M tokensPriceZ.ai: GLM 5.2z-ai/glm-5.2Completion price / token: $3.04 / M tokens became $4.40 / M tokensPriceZ.ai: GLM 5.2 (free)z-ai/glm-5.2:freeContext window: 256,000 became 32,768ContextZ.ai: GLM 5.2 (free)z-ai/glm-5.2:freeMax output: 230,400 became 29,491OutputZ.ai: GLM 5.2 (free)z-ai/glm-5.2:freeSupported parameters: removed response_format, structured_outputs, tool_choice, toolsAPIZ.ai: GLM 5.3z-ai/glm-5.3Max output: 262,144 became 943,717OutputZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashPrompt price / token: $0.07 / M tokens became $0.09 / M tokensPriceZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashCompletion price / token: $0.25 / M tokens became $0.30 / M tokensPriceZ.ai: GLM 5.3 Flashz-ai/glm-5.3-flashSupported parameters: added parallel_tool_callsAPIZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchContext window: 1,048,575 became 1,048,576ContextZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchMax output: 943,717 became 943,718OutputZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchPrompt price / token: $0.15 / M tokens became $0.07 / M tokensPriceZ.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchCompletion price / token: $0.50 / M tokens became $0.25 / M tokensPrice

3 September 2026

AionLabs: Aion-RP 1.0 (8B)aion-labs/aion-rp-llama-3.1-8bMax output: 32,768 became 29,491OutputAllenAI: Olmo 3 32B Thinkallenai/olmo-3-32b-thinkLeft the catalogue: none became noneRemovedAnthropic: Claude Opus 4.7 (Fast)anthropic/claude-opus-4.7-fastLeft the catalogue: none became noneRemovedAnthropic: Claude Opus 4.8 (Fast)anthropic/claude-opus-4.8-fastLeft the catalogue: none became noneRemovedArcee AI: Trinity Large Thinkingarcee-ai/trinity-large-thinkingMax output: 262,144 became 80,000OutputArcee AI: Trinity Large Thinkingarcee-ai/trinity-large-thinkingPrompt price / token: $0.22 / M tokens became $0.25 / M tokensPriceArcee AI: Trinity Large Thinkingarcee-ai/trinity-large-thinkingCompletion price / token: $0.85 / M tokens became $0.80 / M tokensPriceArcee AI: Trinity Large Thinkingarcee-ai/trinity-large-thinkingSupported parameters: removed frequency_penalty, logit_bias, logprobs, presence_penalty, repetition_penalty, response_format, seed, stop, structured_outputs, top_logprobsAPIArcee AI: Virtuoso Largearcee-ai/virtuoso-largeLeft the catalogue: none became noneRemovedByteDance Seed: Seed 2.1 Turbobytedance-seed/seed-2-1-turboMax output: 262,144 became 235,929OutputClaude Opus 5 (Fast)anthropic/claude-opus-5-fastLeft the catalogue: none became noneRemovedDeep Cogito: Cogito v2.1 671Bdeepcogito/cogito-v2.1-671bLeft the catalogue: none became noneRemovedDeepSeek: DeepSeek V3deepseek/deepseek-chatMax output: 16,000 became 16,384OutputDeepSeek: DeepSeek V3deepseek/deepseek-chatPrompt price / token: $0.26 / M tokens became $0.32 / M tokensPriceDeepSeek: DeepSeek V3deepseek/deepseek-chatCompletion price / token: $1.03 / M tokens became $0.89 / M tokensPriceDeepSeek: DeepSeek V3 0324deepseek/deepseek-chat-v3-0324Max output: 163,840 became 147,456OutputDeepSeek: DeepSeek V3.1deepseek/deepseek-chat-v3.1Max output: 32,768 became 144,900OutputDeepSeek: DeepSeek V3.1deepseek/deepseek-chat-v3.1Prompt price / token: $0.25 / M tokens became $0.55 / M tokensPriceDeepSeek: DeepSeek V3.1deepseek/deepseek-chat-v3.1Completion price / token: $0.95 / M tokens became $1.65 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashPrompt price / token: $0.08 / M tokens became $0.08 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashCompletion price / token: $0.16 / M tokens became $0.16 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Max output: 384,000 became 943,718OutputDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Prompt price / token: $0.08 / M tokens became $0.07 / M tokensPriceDeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expSupported parameters: added logit_bias, min_p, repetition_penalty, seed, structured_outputs, top_kAPIDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proMax output: 393,216 became 384,000OutputDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proPrompt price / token: $1.60 / M tokens became $1.03 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proCompletion price / token: $3.20 / M tokens became $2.06 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Max output: none became 384,000OutputDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Prompt price / token: $1.19 / M tokens became $0.66 / M tokensPriceDeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813Completion price / token: $3.56 / M tokens became $1.98 / M tokensPriceDeepSeek: R1 Distill Llama 70Bdeepseek/deepseek-r1-distill-llama-70bMax output: 8,192 became 7,372OutputDots Studio: Dots3-Note Preview (free)dots-studio/dots-3-note-preview:freeMax output: 512,000 became 460,800OutputGoogle: Gemini 3.7 Flashgoogle/gemini-3.7-flashPrompt price / token: $0.38 / M tokens became $0.75 / M tokensPriceGoogle: Gemini 3.7 Flashgoogle/gemini-3.7-flashCompletion price / token: $1.88 / M tokens became $3.75 / M tokensPriceGoogle: Gemini 3.7 Flash (batch)google/gemini-3.7-flash:batchPrompt price / token: $0.19 / M tokens became $0.38 / M tokensPriceGoogle: Gemini 3.7 Flash (batch)google/gemini-3.7-flash:batchCompletion price / token: $0.94 / M tokens became $1.88 / M tokensPriceGoogle: Gemma 3 27Bgoogle/gemma-3-27b-itContext window: 262,144 became 131,072ContextGoogle: Gemma 3 27Bgoogle/gemma-3-27b-itMax output: 131,072 became 117,964OutputGoogle: Gemma 3n 4Bgoogle/gemma-3n-e4b-itLeft the catalogue: none became noneRemovedGoogle: Gemma 4 31Bgoogle/gemma-4-31b-itMax output: 262,144 became 16,384OutputGoogle: Gemma 4 31Bgoogle/gemma-4-31b-itPrompt price / token: $0.10 / M tokens became $0.09 / M tokensPriceGoogle: Nano Banana 2 (Gemini 3.1 Flash Image Preview)google/gemini-3.1-flash-image-previewMax output: 65,536 became 58,982OutputGoogle: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)google/gemini-3.1-flash-lite-imageMax output: 65,536 became 58,982OutputIBM: Granite 4.0 Microibm-granite/granite-4.0-h-microMax output: 131,000 became 117,900OutputIBM: Granite 4.1 8Bibm-granite/granite-4.1-8bMax output: 131,072 became 117,964OutputinclusionAI: Ling-2.6-1Tinclusionai/ling-2.6-1tLeft the catalogue: none became noneRemovedinclusionAI: Ling-2.6-flashinclusionai/ling-2.6-flashLeft the catalogue: none became noneRemovedinclusionAI: Ring-2.6-1Tinclusionai/ring-2.6-1tLeft the catalogue: none became noneRemovedKwaipilot: KAT-Coder-Air V2.5kwaipilot/kat-coder-air-v2.5Left the catalogue: none became noneRemovedKwaipilot: KAT-Coder-Pro V2kwaipilot/kat-coder-pro-v2Max output: 80,000 became 144,000OutputKwaipilot: KAT-Coder-Pro V2kwaipilot/kat-coder-pro-v2Supported parameters: removed logprobs, top_logprobsAPIKwaipilot: KAT-Coder-Pro V2.5kwaipilot/kat-coder-pro-v2.5Context window: 256,000 became 262,144ContextKwaipilot: KAT-Coder-Pro V2.5kwaipilot/kat-coder-pro-v2.5Max output: 80,000 became 235,929OutputKwaipilot: KAT-Coder-Pro V2.5kwaipilot/kat-coder-pro-v2.5Supported parameters: added frequency_penalty, logit_bias, min_p, repetition_penalty, seed, top_k; removed logprobs, top_logprobsAPIMagnum v4 72Banthracite-org/magnum-v4-72bPrompt price / token: $3.00 / M tokens became $2.50 / M tokensPriceMancer: Weaver (alpha)mancer/weaverPrompt price / token: $0.50 / M tokens became $0.40 / M tokensPriceMeta: Llama 3.1 8B Instructmeta-llama/llama-3.1-8b-instructMax output: 131,072 became 117,964OutputMeta: Llama 3.2 1B Instructmeta-llama/llama-3.2-1b-instructMax output: 60,000 became 54,000OutputMeta: Llama 3.2 3B Instructmeta-llama/llama-3.2-3b-instructMax output: 131,072 became 117,964OutputMeta: Llama 4 Maverickmeta-llama/llama-4-maverickMax output: 16,384 became 115,200OutputMeta: Llama 4 Maverickmeta-llama/llama-4-maverickCompletion price / token: $0.80 / M tokens became $0.70 / M tokensPriceMeta: Llama Guard 4 12Bmeta-llama/llama-guard-4-12bContext window: 1,048,576 became 163,840ContextMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bMax output: 131,072 became 117,964OutputMeta: Muse Spark 1.1meta/muse-spark-1.1Max output: none became 943,718OutputMeta: Muse Spark 1.2meta/muse-spark-1.2Max output: none became 943,718OutputMicrosoft: Phi 4microsoft/phi-4Max output: 16,384 became 14,745OutputMiniMax: MiniMax M2.5minimax/minimax-m2.5Max output: 32,768 became 128,000OutputMiniMax: MiniMax M2.5minimax/minimax-m2.5Completion price / token: $0.95 / M tokens became $1.08 / M tokensPriceMiniMax: MiniMax M3 (batch)minimax/minimax-m3:batchMax output: none became 471,859OutputMiniMax: MiniMax-01minimax/minimax-01Max output: 1,000,192 became 900,172OutputMistral Largemistralai/mistral-largeMax output: none became 102,400OutputMistral Large 2407mistralai/mistral-large-2407Max output: none became 104,857OutputMistral: Codestral 2508mistralai/codestral-2508Max output: none became 204,800OutputMistral: Ministral 3 14B 2512mistralai/ministral-14b-2512Max output: none became 209,715OutputMistral: Ministral 3 3B 2512mistralai/ministral-3b-2512Max output: none became 104,857OutputMistral: Ministral 3 8B 2512mistralai/ministral-8b-2512Max output: none became 209,715OutputMistral: Ministral 8Bmistralai/ministral-8bLeft the catalogue: none became noneRemovedMistral: Mistral Large 3 2512mistralai/mistral-large-2512Max output: none became 209,715OutputMistral: Mistral Medium 3mistralai/mistral-medium-3Max output: none became 104,857OutputMistral: Mistral Medium 3.1mistralai/mistral-medium-3.1Max output: none became 104,857OutputMistral: Mistral Medium 3.5mistralai/mistral-medium-3-5Max output: none became 209,715OutputMistral: Mistral Small 3.1 24Bmistralai/mistral-small-3.1-24b-instructMax output: 128,000 became 102,400OutputMistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructContext window: 256,000 became 131,072ContextMistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructPrompt price / token: $0.09 / M tokens became $0.07 / M tokensPriceMistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructCompletion price / token: $0.25 / M tokens became $0.20 / M tokensPriceMistral: Mistral Small 4mistralai/mistral-small-2603Max output: none became 209,715OutputMistral: Mixtral 8x22B Instructmistralai/mixtral-8x22b-instructMax output: none became 52,428OutputMistral: Sabamistralai/mistral-sabaMax output: none became 26,214OutputMistral: Voxtral Small 24B 2507mistralai/voxtral-small-24b-2507Context window: 32,000 became 32,768ContextMistral: Voxtral Small 24B 2507mistralai/voxtral-small-24b-2507Max output: none became 26,214OutputMoonshotAI: Kimi K2.5moonshotai/kimi-k2.5Max output: 262,144 became 235,929OutputMoonshotAI: Kimi K2.6moonshotai/kimi-k2.6Max output: 262,144 became 235,929OutputMoonshotAI: Kimi K2.6moonshotai/kimi-k2.6Prompt price / token: $0.58 / M tokens became $0.95 / M tokensPriceMoonshotAI: Kimi K2.6moonshotai/kimi-k2.6Completion price / token: $2.44 / M tokens became $4.00 / M tokensPriceMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codeMax output: 262,144 became 235,929OutputMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codePrompt price / token: $0.67 / M tokens became $0.66 / M tokensPriceMoonshotAI: Kimi K2.7 Code (batch)moonshotai/kimi-k2.7-code:batchLeft the catalogue: none became noneRemovedMoonshotAI: Kimi K3moonshotai/kimi-k3Max output: none became 943,718OutputMythoMax 13Bgryphe/mythomax-l2-13bMax output: 4,096 became 3,686OutputNex AGI: Nex-N2-Mininex-agi/nex-n2-miniMax output: 262,144 became 235,929OutputNex AGI: Nex-N2-Pronex-agi/nex-n2-proMax output: 262,144 became 235,929OutputNous: Hermes 4 405Bnousresearch/hermes-4-405bMax output: none became 117,964OutputNous: Hermes 4 70Bnousresearch/hermes-4-70bMax output: none became 117,964OutputNVIDIA: Nemotron 3 Nano 30B A3Bnvidia/nemotron-3-nano-30b-a3bMax output: 262,144 became 235,929OutputNVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:freeLeft the catalogue: none became noneRemovedNVIDIA: Nemotron 3 Super (free)nvidia/nemotron-3-super-120b-a12b:freeMax output: 262,144 became 235,929OutputNVIDIA: Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55bContext window: 512,288 became 262,144ContextNVIDIA: Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55bMax output: none became 182,520OutputNVIDIA: Nemotron 3 Ultranvidia/nemotron-3-ultra-550b-a55bCompletion price / token: $3.60 / M tokens became $2.40 / M tokensPriceNVIDIA: Nemotron 3 Ultra (batch)nvidia/nemotron-3-ultra-550b-a55b:batchLeft the catalogue: none became noneRemovedNVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:freeLeft the catalogue: none became noneRemovedNVIDIA: Nemotron Nano 9B V2 (free)nvidia/nemotron-nano-9b-v2:freeLeft the catalogue: none became noneRemovedOpenAI: GPT-3.5 Turbo (older v0613)openai/gpt-3.5-turbo-0613Max output: 4,096 became 3,685OutputOpenAI: GPT-3.5 Turbo Instructopenai/gpt-3.5-turbo-instructMax output: 4,096 became 3,685OutputOpenAI: GPT-5 Codex (batch)openai/gpt-5-codex:batchLeft the catalogue: none became noneRemovedOpenAI: GPT-5.6 Solopenai/gpt-5.6-solPrompt price / token: $2.50 / M tokens became $2.00 / M tokensPriceOpenAI: GPT-5.6 Solopenai/gpt-5.6-solCompletion price / token: $15.0 / M tokens became $10.0 / M tokensPriceOpenAI: GPT-5.6 Sol (batch)openai/gpt-5.6-sol:batchPrompt price / token: $1.25 / M tokens became $1.00 / M tokensPriceOpenAI: GPT-5.6 Sol (batch)openai/gpt-5.6-sol:batchCompletion price / token: $7.50 / M tokens became $5.00 / M tokensPriceOpenAI: GPT-5.6 Sol Proopenai/gpt-5.6-sol-proPrompt price / token: $2.50 / M tokens became $2.00 / M tokensPriceOpenAI: GPT-5.6 Sol Proopenai/gpt-5.6-sol-proCompletion price / token: $15.0 / M tokens became $10.0 / M tokensPriceOpenAI: GPT-5.6 Sol Pro (batch)openai/gpt-5.6-sol-pro:batchPrompt price / token: $1.25 / M tokens became $1.00 / M tokensPriceOpenAI: GPT-5.6 Sol Pro (batch)openai/gpt-5.6-sol-pro:batchCompletion price / token: $7.50 / M tokens became $5.00 / M tokensPriceOpenAI: gpt-oss-120bopenai/gpt-oss-120bMax output: 131,072 became 117,964OutputOpenAI: gpt-oss-120bopenai/gpt-oss-120bPrompt price / token: $0.03 / M tokens became $0.04 / M tokensPriceOpenAI: gpt-oss-20bopenai/gpt-oss-20bMax output: 131,072 became 117,964OutputOpenAI: gpt-oss-20b (free)openai/gpt-oss-20b:freeLeft the catalogue: none became noneRemovedOpenAI: o1 (batch)openai/o1:batchLeft the catalogue: none became noneRemovedOpenAI: o1-pro (batch)openai/o1-pro:batchLeft the catalogue: none became noneRemovedOpenAI: o3 Mini High (batch)openai/o3-mini-high:batchLeft the catalogue: none became noneRemovedOpenAI: o3 Pro (batch)openai/o3-pro:batchLeft the catalogue: none became noneRemovedOpenAI: o4 Mini High (batch)openai/o4-mini-high:batchLeft the catalogue: none became noneRemovedOx Alphastealth/ox-alphaLeft the catalogue: none became noneRemovedPerplexity: Sonarperplexity/sonarMax output: none became 114,364OutputPerplexity: Sonar Deep Researchperplexity/sonar-deep-researchMax output: none became 115,200OutputPerplexity: Sonar Reasoning Properplexity/sonar-reasoning-proMax output: none became 115,200OutputQwen: Qwen Plus 0728 (thinking)qwen/qwen-plus-2025-07-28:thinkingLeft the catalogue: none became noneRemovedQwen: Qwen2.5 7B Instructqwen/qwen-2.5-7b-instructMax output: 32,768 became 29,491OutputQwen: Qwen2.5 7B Instructqwen/qwen-2.5-7b-instructSupported parameters: removed logit_biasAPIQwen: Qwen2.5 VL 72B Instructqwen/qwen2.5-vl-72b-instructMax output: 128,000 became 115,200OutputQwen: Qwen3 235B A22B Instruct 2507qwen/qwen3-235b-a22b-2507Max output: 16,384 became 235,929OutputQwen: Qwen3 235B A22B Instruct 2507qwen/qwen3-235b-a22b-2507Prompt price / token: $0.09 / M tokens became $0.09 / M tokensPriceQwen: Qwen3 235B A22B Instruct 2507qwen/qwen3-235b-a22b-2507Completion price / token: $0.55 / M tokens became $0.35 / M tokensPriceQwen: Qwen3 235B A22B Thinking 2507qwen/qwen3-235b-a22b-thinking-2507Context window: 262,144 became 131,072ContextQwen: Qwen3 235B A22B Thinking 2507qwen/qwen3-235b-a22b-thinking-2507Max output: none became 117,964OutputQwen: Qwen3 235B A22B Thinking 2507qwen/qwen3-235b-a22b-thinking-2507Supported parameters: removed logit_bias, min_pAPIQwen: Qwen3 30B A3Bqwen/qwen3-30b-a3bMax output: 8,192 became 16,384OutputQwen: Qwen3 30B A3Bqwen/qwen3-30b-a3bPrompt price / token: $0.13 / M tokens became $0.12 / M tokensPriceQwen: Qwen3 30B A3Bqwen/qwen3-30b-a3bCompletion price / token: $0.52 / M tokens became $0.50 / M tokensPriceQwen: Qwen3 32Bqwen/qwen3-32bSupported parameters: removed logprobs, top_logprobsAPIQwen: Qwen3 Coder 30B A3B Instructqwen/qwen3-coder-30b-a3b-instructMax output: 262,144 became 235,929OutputQwen: Qwen3 Coder Nextqwen/qwen3-coder-nextMax output: 262,144 became 235,929OutputQwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructMax output: 16,384 became 235,929OutputQwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructPrompt price / token: $0.09 / M tokens became $0.10 / M tokensPriceQwen: Qwen3 Next 80B A3B Thinkingqwen/qwen3-next-80b-a3b-thinkingSupported parameters: removed logit_biasAPIQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructMax output: 32,768 became 16,384OutputQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructPrompt price / token: $0.13 / M tokens became $0.15 / M tokensPriceQwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructCompletion price / token: $0.52 / M tokens became $0.60 / M tokensPriceQwen: Qwen3.5 397B A17Bqwen/qwen3.5-397b-a17bMax output: 65,536 became 235,929OutputQwen: Qwen3.5 397B A17Bqwen/qwen3.5-397b-a17bPrompt price / token: $0.39 / M tokens became $0.55 / M tokensPriceQwen: Qwen3.5 397B A17Bqwen/qwen3.5-397b-a17bCompletion price / token: $2.34 / M tokens became $3.50 / M tokensPriceQwen: Qwen3.5-122B-A10Bqwen/qwen3.5-122b-a10bMax output: 262,144 became 81,920OutputQwen: Qwen3.5-122B-A10Bqwen/qwen3.5-122b-a10bPrompt price / token: $0.26 / M tokens became $0.29 / M tokensPriceQwen: Qwen3.5-122B-A10Bqwen/qwen3.5-122b-a10bCompletion price / token: $2.08 / M tokens became $2.40 / M tokensPriceQwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bMax output: 262,144 became 235,929OutputQwen: Qwen3.5-9Bqwen/qwen3.5-9bMax output: 262,144 became 235,929OutputQwen: Qwen3.6 27Bqwen/qwen3.6-27bMax output: 262,144 became 235,929OutputQwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bMax output: 262,144 became 235,929OutputQwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bPrompt price / token: $0.14 / M tokens became $0.10 / M tokensPriceQwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bCompletion price / token: $1.00 / M tokens became $0.90 / M tokensPriceQwen: Qwen3.8 2.4T A95Bqwen/qwen3.8-2.4t-a95bMax output: 131,072 became 262,144OutputQwen: Qwen3.8 27Bqwen/qwen3.8-27bPrompt price / token: $0.45 / M tokens became $0.42 / M tokensPriceQwen: Qwen3.8 27Bqwen/qwen3.8-27bCompletion price / token: $3.20 / M tokens became $3.00 / M tokensPriceQwen: Qwen3.8 27Bqwen/qwen3.8-27bSupported parameters: added min_pAPIQwen2.5 Coder 32B Instructqwen/qwen-2.5-coder-32b-instructMax output: 32,768 became 29,491OutputReka Edgerekaai/reka-edgeMax output: 16,384 became 14,745OutputReka Flash 3rekaai/reka-flash-3Max output: 65,536 became 58,982OutputReMM SLERP 13Bundi95/remm-slerp-l2-13bMax output: 6,144 became 4,096OutputSao10K: Llama 3 8B Lunarissao10k/l3-lunaris-8bMax output: 16,384 became 7,372OutputSpaceXAI: Grok 4.20x-ai/grok-4.20Max output: none became 1,800,000OutputSpaceXAI: Grok 4.20 Multi-Agentx-ai/grok-4.20-multi-agentMax output: none became 1,800,000OutputSpaceXAI: Grok 4.3x-ai/grok-4.3Max output: none became 900,000OutputSpaceXAI: Grok 4.5x-ai/grok-4.5Max output: none became 450,000OutputSpaceXAI: Grok 4.6x-ai/grok-4.6Max output: none became 450,000OutputSpaceXAI: Grok 4.6x-ai/grok-4.6Supported parameters: added stop, top_kAPISpaceXAI: Grok Build 0.1x-ai/grok-build-0.1Max output: none became 230,400OutputStepFun: Step 3.7 Flashstepfun/step-3.7-flashMax output: 256,000 became 230,400OutputTencent: Hunyuan A13B Instructtencent/hunyuan-a13b-instructMax output: 131,072 became 117,964OutputTencent: Hy3tencent/hy3Prompt price / token: $0.13 / M tokens became $0.08 / M tokensPriceTencent: Hy3tencent/hy3Completion price / token: $0.53 / M tokens became $0.33 / M tokensPriceTencent: Hy3 previewtencent/hy3-previewMax output: none became 235,929OutputTheDrummer: Cydonia 24B V4.1thedrummer/cydonia-24b-v4.1Max output: 131,072 became 117,964OutputTheDrummer: Rocinante 12Bthedrummer/rocinante-12bLeft the catalogue: none became noneRemovedTheDrummer: Skyfall 36B V2thedrummer/skyfall-36b-v2Max output: 32,768 became 29,491OutputTheDrummer: UnslopNemo 12Bthedrummer/unslopnemo-12bMax output: 1,024,000 became 26,214OutputThinking Machines: Inklingthinkingmachines/inklingMax output: 262,144 became 471,859OutputThinking Machines: Inklingthinkingmachines/inklingPrompt price / token: $0.95 / M tokens became $1.00 / M tokensPriceThinking Machines: Inkling (batch)thinkingmachines/inkling:batchMax output: none became 471,859OutputThinking Machines: Inkling (free)thinkingmachines/inkling:freeContext window: 262,144 became 1,048,576ContextThinking Machines: Inkling Smallthinkingmachines/inkling-smallSupported parameters: removed structured_outputsAPIThinking Machines: Inkling Small (free)thinkingmachines/inkling-small:freeContext window: 262,144 became 1,048,576ContextUpstage: Solar Pro 3upstage/solar-pro-3Max output: 131,072 became 117,964OutputXiaomi: MiMo-V2.5xiaomi/mimo-v2.5Supported parameters: removed logprobs, top_logprobsAPIZ.ai: GLM 4.6z-ai/glm-4.6Prompt price / token: $0.50 / M tokens became $0.55 / M tokensPriceZ.ai: GLM 4.6z-ai/glm-4.6Completion price / token: $2.00 / M tokens became $2.20 / M tokensPriceZ.ai: GLM 4.7z-ai/glm-4.7Supported parameters: removed logprobs, top_logprobsAPIZ.ai: GLM 5.2 (batch)z-ai/glm-5.2:batchLeft the catalogue: none became noneRemovedZ.ai: GLM 5.2 (free)z-ai/glm-5.2:freeMax output: 256,000 became 230,400OutputZ.ai: GLM 5.3z-ai/glm-5.3Context window: 1,048,576 became 1,310,720ContextZ.ai: GLM 5.3z-ai/glm-5.3Max output: 131,072 became 262,144OutputZ.ai: GLM 5.3z-ai/glm-5.3Supported parameters: added frequency_penalty, logit_bias, logprobs, min_p, parallel_tool_calls, presence_penalty, repetition_penalty, seed, stop, structured_outputs, top_logprobsAPI

21 August 2026

DeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashPrompt price / token: $0.08 / M tokens became $0.08 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashCompletion price / token: $0.16 / M tokens became $0.16 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Max output: 393,216 became 384,000OutputDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Prompt price / token: $0.14 / M tokens became $0.08 / M tokensPriceDeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731Completion price / token: $0.28 / M tokens became $0.18 / M tokensPriceGoogle: Gemma 4 31Bgoogle/gemma-4-31b-itMax output: 16,384 became 262,144OutputGoogle: Gemma 4 31Bgoogle/gemma-4-31b-itPrompt price / token: $0.09 / M tokens became $0.10 / M tokensPriceLiquidAI: LFM2.5-2.6B (free)liquid/lfm-2.5-2.6b:freeContext window: 128,000 became 65,536ContextMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bMax output: none became 131,072OutputMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bPrompt price / token: $0.35 / M tokens became $0.30 / M tokensPriceMeta: Muse Glimmer 30Bmeta/muse-glimmer-30bCompletion price / token: $1.50 / M tokens became $1.10 / M tokensPriceMiniMax: MiniMax M2.5minimax/minimax-m2.5Max output: none became 32,768OutputMiniMax: MiniMax M2.5minimax/minimax-m2.5Prompt price / token: $0.22 / M tokens became $0.27 / M tokensPriceMiniMax: MiniMax M2.5minimax/minimax-m2.5Completion price / token: $0.90 / M tokens became $0.95 / M tokensPriceMoonshotAI: Kimi K2.6moonshotai/kimi-k2.6Prompt price / token: $0.54 / M tokens became $0.58 / M tokensPriceMoonshotAI: Kimi K2.6moonshotai/kimi-k2.6Completion price / token: $2.28 / M tokens became $2.44 / M tokensPriceMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codePrompt price / token: $0.71 / M tokens became $0.67 / M tokensPriceMoonshotAI: Kimi K2.7 Codemoonshotai/kimi-k2.7-codeCompletion price / token: $3.50 / M tokens became $3.40 / M tokensPriceQwen: Qwen3.8 2.4T A95Bqwen/qwen3.8-2.4t-a95bMax output: 262,144 became 131,072Output

Sourced from the frozen catalogue snapshots of 20 August 2026 and 21 August 2026 and 3 September 2026 and 16 September 2026 and 5 October 2026. As more snapshots freeze, this timeline grows one dated interval at a time.

New in the catalogue

Entries that appeared between the snapshots of 16 September 2026 and 8 October 2026. Catalogue appearance is not a release date: a model can join the catalogue long after it shipped.
inclusionAI: Ling 3.1 Flashinclusionai/ling-3.1-flashno family on the label yetNewApodex: Apodex 1.1 Mini (free)apodex/apodex-1.1-mini:freeBuilt on the Qwen tokenizer · high confidenceNewPareto 26.10 Previewunbiased/pareto-26.10-previewBuilt on the Llama3 tokenizer · moderate confidenceNewOpenAI: GPT-6.1 Sol Proopenai/gpt-6.1-sol-prolabel: GPTNewOpenAI: GPT-6.1 Solopenai/gpt-6.1-solBuilt on the GPT tokenizer · moderate confidenceNewAnthropic: Claude Sonnet 5.5anthropic/claude-sonnet-5.5Built on the Claude tokenizer · high confidenceNewAnthropic: Claude Sonnet 5.5 (batch)anthropic/claude-sonnet-5.5:batchBuilt on the Claude tokenizer · high confidenceNewTypeSafe: Jev Routertypesafe/jev-routerlabel: RouterNewPerceptron: Perceptron Mk1.5perceptron/perceptron-mk1.5Built on the Qwen tokenizer · high confidenceNewFireworks: Ember-1fireworks/ember-1Built on the Moonshot AI tokenizer · high confidenceNewZ.ai: GLM 5.3 Primez-ai/glm-5.3-primeIts own Z.ai tokenizer group · high confidenceNewQwen: Qwen3.8 Max Primeqwen/qwen3.8-max-primeBuilt on the Qwen tokenizer · very high confidenceNewAionLabs: Aion 3.5 Miniaion-labs/aion-3.5-miniIts own Aion Labs tokenizer group · very high confidenceNewAionLabs: Aion 3.5aion-labs/aion-3.5Its own Aion Labs tokenizer group · very high confidenceNewUpstage: Solar Mini 4upstage/solar-mini4Its own Upstage tokenizer group · very high confidenceNewCohere: Command A+cohere/command-a-plusIts own Cohere tokenizer group · high confidenceNewOpenAI: GPT-6 Luna Proopenai/gpt-6-luna-prolabel: GPTNewOpenAI: GPT-6 Luna Pro (batch)openai/gpt-6-luna-pro:batchlabel: GPTNewOpenAI: GPT-6 Lunaopenai/gpt-6-lunaBuilt on the GPT tokenizer · very high confidenceNewOpenAI: GPT-6 Luna (batch)openai/gpt-6-luna:batchBuilt on the GPT tokenizer · very high confidenceNewOpenAI: GPT-6 Sol Proopenai/gpt-6-sol-prolabel: GPTNewOpenAI: GPT-6 Sol Pro (batch)openai/gpt-6-sol-pro:batchlabel: GPTNewOpenAI: GPT-6 Solopenai/gpt-6-solBuilt on the GPT tokenizer · very high confidenceNewOpenAI: GPT-6 Sol (batch)openai/gpt-6-sol:batchBuilt on the GPT tokenizer · very high confidenceNewAnthropic: Claude Opus 5.5anthropic/claude-opus-5.5Built on the Claude tokenizer · moderate confidenceNewAnthropic: Claude Opus 5.5 (batch)anthropic/claude-opus-5.5:batchBuilt on the Claude tokenizer · moderate confidenceNewNVIDIA: Switchyardnvidia/switchyardlabel: RouterNewXiaomi: MiMo-V2.6-Pro-UltraSpeedxiaomi/mimo-v2.6-pro-ultraspeedBuilt on the Qwen tokenizer · high confidenceNewXiaomi: MiMo-V2.6-Flashxiaomi/mimo-v2.6-flashBuilt on the Qwen tokenizer · high confidenceNewXiaomi: MiMo-V2.6-Proxiaomi/mimo-v2.6-proBuilt on the Qwen tokenizer · high confidenceNewSpaceXAI: Grok 4.7x-ai/grok-4.7Built on the Grok tokenizer · high confidenceNewQwen: Qwen3.8 Omni Flashqwen/qwen3.8-omni-flashBuilt on the Qwen tokenizer · moderate confidenceNewPrismML: Ternary Bonsai 2 27Bprism-ml/ternary-bonsai-2-27bBuilt on the Qwen tokenizer · high confidenceNewZ.ai: GLM 5.3 FlashXz-ai/glm-5.3-flashxIts own Z.ai tokenizer group · very high confidenceNewParetounbiased/paretono family on the label yetNewDeepSeek: DeepSeek V4.1 Flash (batch)deepseek/deepseek-v4.1-flash:batchIts own DeepSeek tokenizer group · high confidenceNewNex AGI: Nex-N2.5-Mininex-agi/nex-n2.5-miniBuilt on the Qwen tokenizer · high confidenceNewNex AGI: Nex-N2.5-Pronex-agi/nex-n2.5-proBuilt on the Qwen tokenizer · high confidenceNewQwen: Qwen3.8 27B (free)qwen/qwen3.8-27b:freeBuilt on the Qwen tokenizer · high confidenceNewOpenAI: gpt-oss-20b (batch)openai/gpt-oss-20b:batchBuilt on the GPT tokenizer · high confidenceNewTypeSafe: Jev 1.13typesafe/jev-1.13no family on the label yetNewSpace Bunny Alphastealth/space-bunny-alphaLikely MiniMax family · high confidenceNewAnthropic: Claude Haiku 5.5anthropic/claude-haiku-5.5Built on the Claude tokenizer · high confidenceNewAnthropic: Claude Haiku 5.5 (batch)anthropic/claude-haiku-5.5:batchBuilt on the Claude tokenizer · high confidenceNewMistral: Mistral Large 4mistralai/mistral-large-4-0label: MistralNewStepFun: Step 5 Previewstepfun/step-5-previewBuilt on the DeepSeek tokenizer · high confidenceNewGoogle: Nano Banana 2.1google/gemini-nano-banana-2.1Built on the Gemini tokenizer · high confidenceNew

Gone from the catalogue

59 entries the catalogue no longer lists. Their records and measurements stay published: a model disappearing is a change worth keeping.
Union Alphastealth/union-alphameasured as likely pareto (multi-model blend) family · last listed 5 October 2026WithdrawninclusionAI: Ling 3.0 Flash VL (free)inclusionai/ling-3.0-flash-vl:freemeasured as its own inclusionai tokenizer group · last listed 5 October 2026WithdrawnNex AGI: Nex-N2.5-Mini (free)nex-agi/nex-n2.5-mini:freemeasured as built on the qwen tokenizer · last listed 5 October 2026WithdrawnNex AGI: Nex-N2.5-Pro (free)nex-agi/nex-n2.5-pro:freemeasured as built on the qwen tokenizer · last listed 5 October 2026WithdrawninclusionAI: Ling 3.0 Flash Fin (free)inclusionai/ling-3.0-flash-fin:freemeasured as its own inclusionai tokenizer group · last listed 5 October 2026WithdrawnDeepSeek: DeepSeek V4 Flash Vision Exp (batch)deepseek/deepseek-v4-flash-vision-exp:batchmeasured as its own deepseek tokenizer group · last listed 5 October 2026WithdrawnQwen: Qwen3.8 2.4T A95B (batch)qwen/qwen3.8-2.4t-a95b:batchmeasured as built on the qwen tokenizer · last listed 5 October 2026WithdrawnDeepSeek: DeepSeek V4 Pro 0813 (batch)deepseek/deepseek-v4-pro-0813:batchmeasured as its own deepseek tokenizer group · last listed 5 October 2026WithdrawnMeta: Muse Glimmer 30B (batch)meta/muse-glimmer-30b:batchmeasured as built on the llama4 tokenizer · last listed 5 October 2026WithdrawnDeepSeek: DeepSeek V4 Flash 0731 (batch)deepseek/deepseek-v4-flash-0731:batchmeasured as its own deepseek tokenizer group · last listed 5 October 2026WithdrawnThinking Machines: Inkling (batch)thinkingmachines/inkling:batchmeasured as built on the gpt tokenizer · last listed 5 October 2026WithdrawnZ.ai: GLM 5.2 (batch)z-ai/glm-5.2:batchmeasured as its own z.ai tokenizer group · last listed 5 October 2026WithdrawnZ.ai: GLM 5.2 (free)z-ai/glm-5.2:freemeasured as its own z.ai tokenizer group · last listed 5 October 2026WithdrawnMiniMax: MiniMax M3 (batch)minimax/minimax-m3:batchmeasured as its own minimax tokenizer group · last listed 5 October 2026WithdrawnKwaipilot: KAT-Coder-Pro V2kwaipilot/kat-coder-pro-v2measured as built on the qwen tokenizer · last listed 5 October 2026WithdrawnQwen: Qwen3.5-9B (batch)qwen/qwen3.5-9b:batchmeasured as built on the qwen tokenizer · last listed 5 October 2026WithdrawnAnthropic: Claude Opus 4anthropic/claude-opus-4never measured before it went · last listed 5 October 2026WithdrawnDeepSeek: R1 Distill Llama 70Bdeepseek/deepseek-r1-distill-llama-70bmeasured as its own deepseek tokenizer group · last listed 5 October 2026WithdrawnAnthropic: Claude 3 Haikuanthropic/claude-3-haikumeasured as built on the claude tokenizer · last listed 5 October 2026WithdrawnInception: Mercury 2.5 Previewinception/mercury-2.5-previewnever measured before it went · last listed 16 September 2026WithdrawnQwen: Qwen3.8 Maxqwen/qwen3.8-maxmeasured as built on the qwen tokenizer · last listed 16 September 2026WithdrawnThinking Machines: Inkling Small (batch)thinkingmachines/inkling-small:batchmeasured as built on the gpt tokenizer · last listed 16 September 2026WithdrawnNex AGI: Nex-N2-Mininex-agi/nex-n2-minimeasured as built on the qwen tokenizer · last listed 16 September 2026WithdrawnNex AGI: Nex-N2-Pronex-agi/nex-n2-promeasured as built on the qwen tokenizer · last listed 16 September 2026WithdrawnMiniMax: MiniMax M3 (free)minimax/minimax-m3:freemeasured as its own minimax tokenizer group · last listed 16 September 2026WithdrawnIBM: Granite 4.1 8Bibm-granite/granite-4.1-8bmeasured as built on the openai cl100k tokenizer · last listed 16 September 2026WithdrawnOpenAI GPT Latest~openai/gpt-latestnever measured before it went · last listed 16 September 2026WithdrawnGoogle: Gemma 4 31B (batch)google/gemma-4-31b-it:batchmeasured as built on the gemma tokenizer · last listed 16 September 2026WithdrawnMiniMax: MiniMax M2.7 (free)minimax/minimax-m2.7:freemeasured as its own minimax tokenizer group · last listed 16 September 2026WithdrawnNous: Hermes 4 70Bnousresearch/hermes-4-70bmeasured as built on the llama3 tokenizer · last listed 16 September 2026WithdrawnGoogle: Gemini 2.5 Pro Preview 05-06google/gemini-2.5-pro-preview-05-06measured as built on the gemini tokenizer · last listed 16 September 2026WithdrawnOpenAI: GPT-4 Turbo Previewopenai/gpt-4-turbo-previewnever measured before it went · last listed 16 September 2026WithdrawnOx Alphastealth/ox-alphameasured as likely z.ai glm family · last listed 3 September 2026WithdrawnClaude Opus 5 (Fast)anthropic/claude-opus-5-fastnever measured before it went · last listed 3 September 2026WithdrawnKwaipilot: KAT-Coder-Air V2.5kwaipilot/kat-coder-air-v2.5measured as built on the qwen tokenizer · last listed 3 September 2026WithdrawnMoonshotAI: Kimi K2.7 Code (batch)moonshotai/kimi-k2.7-code:batchmeasured as its own moonshot ai tokenizer group · last listed 3 September 2026WithdrawnNVIDIA: Nemotron 3 Ultra (batch)nvidia/nemotron-3-ultra-550b-a55b:batchmeasured as built on the mistral tokenizer · last listed 3 September 2026WithdrawnAnthropic: Claude Opus 4.8 (Fast)anthropic/claude-opus-4.8-fastnever measured before it went · last listed 3 September 2026WithdrawnAnthropic: Claude Opus 4.7 (Fast)anthropic/claude-opus-4.7-fastnever measured before it went · last listed 3 September 2026WithdrawninclusionAI: Ring-2.6-1Tinclusionai/ring-2.6-1tmeasured as its own inclusionai tokenizer group · last listed 3 September 2026WithdrawninclusionAI: Ling-2.6-1Tinclusionai/ling-2.6-1tmeasured as its own inclusionai tokenizer group · last listed 3 September 2026WithdrawninclusionAI: Ling-2.6-flashinclusionai/ling-2.6-flashmeasured as its own inclusionai tokenizer group · last listed 3 September 2026WithdrawnNVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:freemeasured as built on the mistral tokenizer · last listed 3 September 2026WithdrawnAllenAI: Olmo 3 32B Thinkallenai/olmo-3-32b-thinknever measured before it went · last listed 3 September 2026WithdrawnDeep Cogito: Cogito v2.1 671Bdeepcogito/cogito-v2.1-671bnever measured before it went · last listed 3 September 2026WithdrawnNVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:freemeasured as built on the mistral tokenizer · last listed 3 September 2026WithdrawnOpenAI: GPT-5 Codex (batch)openai/gpt-5-codex:batchnever measured before it went · last listed 3 September 2026WithdrawnQwen: Qwen Plus 0728 (thinking)qwen/qwen-plus-2025-07-28:thinkingmeasured as built on the qwen tokenizer · last listed 3 September 2026WithdrawnNVIDIA: Nemotron Nano 9B V2 (free)nvidia/nemotron-nano-9b-v2:freemeasured as built on the mistral tokenizer · last listed 3 September 2026WithdrawnOpenAI: gpt-oss-20b (free)openai/gpt-oss-20b:freemeasured as built on the gpt tokenizer · last listed 3 September 2026WithdrawnOpenAI: o3 Pro (batch)openai/o3-pro:batchnever measured before it went · last listed 3 September 2026WithdrawnGoogle: Gemma 3n 4Bgoogle/gemma-3n-e4b-itmeasured as built on the gemini tokenizer · last listed 3 September 2026WithdrawnArcee AI: Virtuoso Largearcee-ai/virtuoso-largenever measured before it went · last listed 3 September 2026WithdrawnOpenAI: o4 Mini High (batch)openai/o4-mini-high:batchmeasured as built on the gpt tokenizer · last listed 3 September 2026WithdrawnOpenAI: o1-pro (batch)openai/o1-pro:batchnever measured before it went · last listed 3 September 2026WithdrawnOpenAI: o3 Mini High (batch)openai/o3-mini-high:batchmeasured as built on the gpt tokenizer · last listed 3 September 2026WithdrawnOpenAI: o1 (batch)openai/o1:batchnever measured before it went · last listed 3 September 2026WithdrawnMistral: Ministral 8Bmistralai/ministral-8bnever measured before it went · last listed 3 September 2026WithdrawnTheDrummer: Rocinante 12Bthedrummer/rocinante-12bnever measured before it went · last listed 3 September 2026Withdrawn

Stealth watch

Undeclared models, measured while their identity stays hidden

Ox Alpha

stealth/ox-alpha · Z.aiConfirmed by its maker
Confirmed family
Z.ai GLM
Confirmed as
GLM-5.3-Flash
Confirmed by Z.ai
26 August 2026
Entered catalogue
20 August 2026
Last tested
21 August 2026
Family attribution confidence
Very high

Why very high: Z.ai confirmed Ox Alpha as GLM-5.3-Flash on 26 August 2026, five days after the measurement matched it to GLM-5.3 on all fifty strings.

Evidence
  • ✓ exact tokenizer signature shared with 8 models
  • ✓ API-surface contract identical to a group member
  • ✓ confirmed as GLM-5.3-Flash by Z.ai, 26 August 2026

New lineage placements

Models whose catalogue entry names no family, placed for the first time by measurement

How the watch works

Each sweep freezes a dated catalogue snapshot and appends new measurements; nothing is overwritten. A new entry is fingerprinted and compared against the whole corpus, a fingerprint change is re-tested before it is published, and a model that leaves the catalogue keeps its record. When identity alerts open, a watched model will be able to notify you; until then, this board and each model's history carry the changes.