2026-08-25에 감지된 AI 모델 가격·컨텍스트·종료일 변경 전체입니다.
| 변경 | 모델 | 내용 |
|---|---|---|
| 종료 예정 | moonshotai/kimi-k2.5 | 2026-08-31 종료 · D-6 남음 |
| 종료 예정 | dots-studio/dots-3-note-preview:free | 2026-09-30 종료 · D-36 남음 |
| 종료 예정 | z-ai/glm-4.5 | 2026-12-31 종료 · D-128 남음 |
| 종료일 변경 | z-ai/glm-4.5v | 2026-12-31 -> - |
| 가격 변경 | deepseek/deepseek-v4-flash | 출력 +47.5% · 캐시 읽기 +47.5% · 입력 +47.5% |
| 가격 변경 | deepseek/deepseek-v4-flash-0731 | 출력 -39.2% · 캐시 읽기 -39.2% · 입력 -39.2% |
| 가격 변경 | deepseek/deepseek-v4-flash-vision-exp | overrides 과금 시작 |
| 가격 변경 | deepseek/deepseek-v4-pro | 출력 +9.7% · 캐시 읽기 +9.7% · 입력 +9.7% |
| 가격 변경 | qwen/qwen3.8-27b | 출력 -15.0% |
| 가격 변경 | thinkingmachines/inkling | 캐시 읽기 -5.9% · 입력 -5.0% |
| 가격 변경 | z-ai/glm-5.1 | 출력 +30.4% · 캐시 읽기 +30.4% · 입력 +30.4% |
| 가격 변경 | z-ai/glm-5.2 | 출력 +23.2% · 캐시 읽기 +14.4% · 입력 +23.2% |
| 가격 변경 | ~deepseek/deepseek-v4-flash-latest | 출력 +25.0% · 입력 -12.5% |
| 가격 변경 | ~moonshotai/kimi-latest | 출력 +7.7% · 입력 +7.7% |
| 신규 모델 | minimax/minimax-m2.7:free | 컨텍스트 196,608 |
| 신규 모델 | minimax/minimax-m3:free | 컨텍스트 1,048,576 |
| 모델 삭제 | qwen/qwen-plus-2025-07-28:thinking | |
| 당사자 발언 | OpenAI @OpenAI | Jalapeño는 더 빠른 ChatGPT 응답, 더 빠르게 반응하는 Codex 세션과 에이전트, 그리고 수요가 계속 증가하는 가운데 안정적인 액세스를 의미합니다. https://t.co/QgBKRa3Xz6 || Jalapeño means faster ChatGPT responses, more responsive Codex sessions and agents, and reliable access as demand continues to grow. https://t.co/QgBKRa3Xz6 |
| 당사자 발언 | OpenAI @OpenAI | 당사의 첫 번째 맞춤형 추론 칩인 Jalapeño를 발표한 이후, 당사는 이 칩과 이를 둘러싼 시스템을 테스트해 왔습니다. 그 결과는 중대한 진전을 보여줍니다. 즉, 모든 watt에서 더 많은 지능과 더 빠른 응답을 제공하며, 하나의 아키텍처에서 더 높은 처리량과 더 낮은 지연 시간을 모두 제공하면서도 없이 https://t.co/vj7VOrA8pP || Since announcing Jalapeño, our first custom inference chip, we’ve been testing it and the system around it. The results show a major advance: more intelligence from every watt and faster responses, de |
| OUTAGE | Issues logging into Claude.ai | |
| RELEASE | v2.1.245 | |
| RELEASE | v0.3.0 | |
| ANNOUNCEMENT | Push rules in rulesets now support path exceptions | |
| ANNOUNCEMENT | Your alt text passes automated checks. That doesn’t mean it’s any good. | |
| ANNOUNCEMENT | Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision original | |
| ANNOUNCEMENT | Wire It, Run It, Deploy It: AI Workflows in Gradio | |
| ANNOUNCEMENT | Granite 4.2 LLMs: How They're Built | |
| ANNOUNCEMENT | How Hugging Face Inference Endpoints, Jobs, and Buckets Power Search on Papers with Code | |
| ANNOUNCEMENT | Disrupting a new covert influence campaign from Russia | |
| ANNOUNCEMENT | Introducing the Admin plugin for ChatGPT Work and Codex | |
| ANNOUNCEMENT | Jalapeño’s first results show industry-leading speed and efficiency in AI inference | |
| ANNOUNCEMENT | The full stack behind abundant intelligence | |
| 컨텍스트 변경 | thinkingmachines/inkling-small:free | 262144 -> 1048576 |
| 컨텍스트 변경 | thinkingmachines/inkling:free | 262144 -> 1048576 |
| 파라미터 변경 | x-ai/grok-4.6 | 추가 stop, top_k |
| 파라미터 변경 | ~x-ai/grok-latest | 추가 stop, top_k |