2026-08-20

Every AI model price, context and end-of-life change detected on 2026-08-20.

ChangeModelDetail
END OF LIFEinclusionai/ling-2.6-1tshuts down 2026-08-24 · 4 days left
END OF LIFEinclusionai/ling-2.6-flashshuts down 2026-08-24 · 4 days left
END OF LIFEinclusionai/ring-2.6-1tshuts down 2026-08-24 · 4 days left
END OF LIFEnvidia/nemotron-3-nano-30b-a3b:freeshuts down 2026-08-24 · 4 days left
END OF LIFEnvidia/nemotron-nano-12b-v2-vl:freeshuts down 2026-08-24 · 4 days left
END OF LIFEnvidia/nemotron-nano-9b-v2:freeshuts down 2026-08-24 · 4 days left
END OF LIFEdots-studio/dots-3-note-preview:freeshuts down 2026-09-30 · 41 days left
END OF LIFEz-ai/glm-4.5shuts down 2026-12-31 · 133 days left
END OF LIFE ANNOUNCEDdots-studio/dots-3-note-preview:free- -> 2026-09-30
END OF LIFE ANNOUNCEDnvidia/nemotron-3-nano-30b-a3b:free- -> 2026-08-24
END OF LIFE ANNOUNCEDnvidia/nemotron-nano-9b-v2:free- -> 2026-08-24
PRICE CHANGEdeepseek/deepseek-v3.1-terminuscache read now charged
PRICE CHANGEdeepseek/deepseek-v4-flashoutput -5.1% · cache read -5.1% · input -5.1%
PRICE CHANGEdeepseek/deepseek-v4-prooutput +11.1% · cache read +11.1% · input +11.1%
PRICE CHANGEdeepseek/deepseek-v4-pro-0813output +80.0% · cache read +80.0% · overrides no longer charged · input +80.0%
PRICE CHANGEmoonshotai/kimi-k2.6output +3.5% · cache read +3.5% · input +3.5%
PRICE CHANGEqwen/qwen3.6-27boutput +80.0% · cache read +300.0% · input +100.0%
PRICE CHANGE~deepseek/deepseek-v4-flash-latestoutput -8.5% · cache read -8.5% · input -15.0%
NEW MODELmistralai/ministral-8bcontext 128,000
NEW MODELtencent/hy-mt2-1.8bcontext 8,192
NEW MODELtencent/hy-mt2-30b-a3bcontext 8,192
MODEL REMOVEDmancer/weaver
FROM THE SOURCETibo @thsottiauxMore context, better help https://t.co/WGsen4asEE
FROM THE SOURCETibo @thsottiaux@_clarktang It's a good model
FROM THE SOURCEOpenAI @OpenAIComputer History in the Mac desktop app is now available to Pro, Business, and Enterprise users in the EEA, UK, and Switzerland.
FROM THE SOURCEOpenAI @OpenAIWe will continue to offer Zero Data Retention for frontier models. As AI takes on longer, more autonomous work and delivers greater value to businesses, safety systems also need to identify risks across related interactions. To help address
OUTAGEElevated errors on Google connectors
RELEASEv0.125.0
RELEASEv2.1.237
RELEASEb10517
RELEASEv0.32.15
RELEASEv2.19.0
ANNOUNCEMENTCodeQL 2.26.3 improves GitHub Actions queries and JavaScript modeling
ANNOUNCEMENTCode scanning adds a mitigated alert dismissal reason
ANNOUNCEMENTSeparate GitHub Actions path for GitHub Code Quality
ANNOUNCEMENTTrack GitHub Code Quality enablement changes in the audit log
ANNOUNCEMENTWindows 11 arm64 VS2026 image generally available
ANNOUNCEMENTThe August 17 outage, and the work ahead
OUTAGEIntermittent failures creating agent tasks
WEIGHT_RELEASEgoogle/tipsv1-b14
WEIGHT_RELEASEgoogle/tipsv1-g14
WEIGHT_RELEASEgoogle/tipsv1-g14-lowres
WEIGHT_RELEASEgoogle/tipsv1-l14
WEIGHT_RELEASEgoogle/tipsv1-so400m14
ANNOUNCEMENTUp to 3.2x Faster Inference with LFM2.5-DSpark
ANNOUNCEMENTThinking of ACE? We Can Do It with Fewer Tokens
ANNOUNCEMENTOffering Zero Data Retention for frontier models
ANNOUNCEMENTHow ChatGPT Work helps Stampli move ideas to market
OUTAGEChatgpt.com is down - all signups and logins are down as of right now
OUTAGEElevated Errors for Thinking mode in ChatGPT
OUTAGEElevated Codex API authentication errors
PARAMETERS CHANGEDgoogle/gemma-4-26b-a4b-it:freeremoved frequency_penalty, logprobs, presence_penalty, repetition_penalty, stop, structured_outputs, top_k, top_logprobs
CONTEXT CHANGEDnvidia/nemotron-3.5-lightning1000000 -> 262144
CONTEXT CHANGEDqwen/qwen3.8-27b262144 -> 1000000
PARAMETERS CHANGEDqwen/qwen3.8-27badded logit_bias

Previous 2026-08-19