IA pour Devs : Claude Code atteint v2.1.251, Codex passe de v0.150 à v0.151, et le mystère Ox Alpha de Zhipu se révèle être GLM-5.3-Flash
v2.1.251: streaming de subagentes y barra de límite de gasto
Suma eventos de hook PreModelSwitch/PostModelSwitch, streaming en vivo de llamadas a herramientas de subagentes, una barra de límite de gasto en /usage, línea de caché por sesión en /cost, y varias correcciones de seguridad (symlinks, traversal de rutas de plugins).
v2.1.248: modo --restricted y mensajería entre sesiones en Bedrock/Vertex/Foundry
Agrega el modo --restricted, experimental.cacheTtl en el frontmatter de agentes, diagnósticos de configuración administrada por servidor, y mensajería entre sesiones ahora disponible en Amazon Bedrock, Google Vertex y Microsoft Foundry.
v2.1.245–v2.1.246: aviso de wildcards en bash y pestaña de modo Auto
Suma un aviso al iniciar cuando se detectan comodines en bash, una pestaña de modo Auto en /permissions, y corrige un crash al arrancar en Linux con glibc 2.44.
v0.151.0: periodo de gracia configurable para servidores MCP opcionales
Agrega un periodo de gracia configurable para descubrir herramientas de servidores MCP opcionales, y permite a las extensiones inspeccionar o reemplazar resultados de herramientas MCP antes de que lleguen al modelo.
v0.150.1: extensiones de navegador para Edge, Brave, Opera y Vivaldi
La compactación remota ahora cuenta las imágenes retenidas en su presupuesto de tokens por defecto. Codex suma soporte de extensión de navegador ChatGPT en Edge, Brave, Opera y Vivaldi, además de herramientas de sitio (WebMCP) en el navegador integrado.
GPT-5.4 y GPT-5.4 mini se retiran de Codex
A partir del 31 de agosto, GPT-5.4 y GPT-5.4 mini dejan de estar disponibles en Codex para usuarios conectados con ChatGPT; OpenAI recomienda migrar a gpt-5.6-terra y gpt-5.6-luna respectivamente.
Copilot en Visual Studio: agentes de organización y revisión Git previa al PR
Los dueños de organización pueden publicar agentes personalizados para todos sus repositorios; Visual Studio los detecta automáticamente. Suma controles de esfuerzo de razonamiento (Bajo/Medio/Alto), fijado de modelos preferidos, y un agente Git que revisa cambios sin commitear antes del PR.
Weekly releases: sesiones de agente en Slack/Teams y soporte WSL experimental
Mencionar a @GitHub en Slack o Microsoft Teams convierte una conversación de equipo en una sesión de agente compartida. La pestaña Customize (MCP, plugins, skills, canvases) llega a disponibilidad general, con soporte WSL experimental y VS Code 1.135 sumando continuidad de sesión entre aplicaciones.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-08-26 | GLM-5.3-Flash | Z.ai / Zhipu | A | Abierto | El modelo anónimo viral «Ox Alpha» se confirmó como GLM-5.3-Flash: 320B parámetros (18B activos), licencia MIT, contexto multimodal de 1M tokens, precio de $0.15/$0.50 por M tokens. Alcanzó el #1 en el leaderboard de OpenRouter y superó el doble de uso de DeepSeek en su primera semana. |
Tendencias Destacadas
Semana de mantenimiento más que de titulares: Claude Code y Codex CLI siguen su cadencia de releases casi diarias, sumando hooks, streaming y correcciones de seguridad en vez de features grandes.
El caso Ox Alpha/GLM-5.3-Flash muestra un patrón nuevo: labs chinos lanzan modelos de forma anónima en OpenRouter para generar hype antes de revelar la marca — Zhipu solo confirmó la autoría tras ser identificado por fingerprinting técnico.
v2.1.251: subagent tool-call streaming and spend-limit bar
Adds PreModelSwitch/PostModelSwitch hook events, live streaming of subagent tool calls, a spend-limit bar in /usage, a per-session prompt-cache line in /cost, and several security fixes (symlink following, plugin path traversal).
v2.1.248: --restricted mode and cross-session messaging on Bedrock/Vertex/Foundry
Adds --restricted mode, experimental.cacheTtl agent frontmatter, server-managed settings diagnostics, and cross-session messaging now available on Amazon Bedrock, Google Vertex, and Microsoft Foundry.
v2.1.245–v2.1.246: bash-wildcard startup warning and Auto-mode tab
Adds a startup warning when bash wildcards are detected, an Auto-mode tab in /permissions, and fixes a startup crash on Linux distros running glibc 2.44.
v0.151.0: configurable grace period for optional MCP servers
Adds a configurable grace period for discovering tools from optional MCP servers, and lets extensions inspect or replace MCP tool results before they reach the model.
v0.150.1: browser extension support for Edge, Brave, Opera, and Vivaldi
Remote compaction now counts retained images toward its token budget by default. Codex adds ChatGPT browser extension support in Edge, Brave, Opera, and Vivaldi, plus site tools (WebMCP) in the built-in browser.
GPT-5.4 and GPT-5.4 mini retire from Codex
Starting August 31, GPT-5.4 and GPT-5.4 mini stop being available in Codex for ChatGPT-signed-in users; OpenAI recommends migrating to gpt-5.6-terra and gpt-5.6-luna respectively.
Copilot in Visual Studio: org-wide custom agents and pre-PR Git review
Organization owners can publish custom agents across all their repositories; Visual Studio auto-detects them. Adds Low/Medium/High reasoning-effort controls, pinning preferred models, and a Git agent that reviews uncommitted changes before a PR.
Weekly releases: shared agent sessions in Slack/Teams and experimental WSL support
Mentioning @GitHub in Slack or Microsoft Teams turns a team conversation into a shared agent session. The Customize tab (MCP servers, plugins, skills, canvases) reaches general availability, with experimental WSL support and VS Code 1.135 adding cross-application session continuity.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-08-26 | GLM-5.3-Flash | Z.ai / Zhipu | A | Open | The viral anonymous "Ox Alpha" model was confirmed as GLM-5.3-Flash: 320B parameters (18B active), MIT license, 1M-token multimodal context, priced at $0.15/$0.50 per M tokens. It reached #1 on OpenRouter's leaderboard and reportedly more than doubled DeepSeek's usage in its first week. |
Notable Trends
A maintenance week more than a headline week: Claude Code and Codex CLI keep their near-daily release cadence, layering in hooks, streaming, and security fixes rather than big new features.
The Ox Alpha / GLM-5.3-Flash episode reveals a new pattern: Chinese labs are launching models anonymously on OpenRouter to build hype before revealing the brand — Zhipu only confirmed authorship after being identified via technical fingerprinting.
v2.1.251 : streaming des appels d'outils des sous-agents et barre de limite de dépense
Ajoute les événements de hook PreModelSwitch/PostModelSwitch, le streaming en direct des appels d'outils des sous-agents, une barre de limite de dépense dans /usage, une ligne de cache par session dans /cost, et plusieurs correctifs de sécurité.
v2.1.248 : mode --restricted et messagerie inter-sessions sur Bedrock/Vertex/Foundry
Ajoute le mode --restricted, le frontmatter d'agent experimental.cacheTtl, des diagnostics de paramètres gérés par serveur, et la messagerie inter-sessions désormais disponible sur Amazon Bedrock, Google Vertex et Microsoft Foundry.
v2.1.245–v2.1.246 : avertissement au démarrage pour les wildcards bash et onglet mode Auto
Ajoute un avertissement au démarrage lorsque des wildcards bash sont détectés, un onglet mode Auto dans /permissions, et corrige un plantage au démarrage sur les distributions Linux avec glibc 2.44.
v0.151.0 : période de grâce configurable pour les serveurs MCP optionnels
Ajoute une période de grâce configurable pour découvrir les outils des serveurs MCP optionnels, et permet aux extensions d'inspecter ou de remplacer les résultats des outils MCP avant qu'ils n'atteignent le modèle.
v0.150.1 : support d'extension de navigateur pour Edge, Brave, Opera et Vivaldi
La compaction distante compte désormais les images conservées dans son budget de tokens par défaut. Codex ajoute le support de l'extension de navigateur ChatGPT dans Edge, Brave, Opera et Vivaldi, ainsi que des outils de site (WebMCP) dans le navigateur intégré.
GPT-5.4 et GPT-5.4 mini se retirent de Codex
À partir du 31 août, GPT-5.4 et GPT-5.4 mini ne sont plus disponibles dans Codex pour les utilisateurs connectés via ChatGPT ; OpenAI recommande de migrer vers gpt-5.6-terra et gpt-5.6-luna respectivement.
Copilot dans Visual Studio : agents personnalisés d'organisation et revue Git avant PR
Les propriétaires d'organisation peuvent publier des agents personnalisés pour tous leurs dépôts ; Visual Studio les détecte automatiquement. Ajoute des contrôles d'effort de raisonnement (Faible/Moyen/Élevé), l'épinglage de modèles préférés, et un agent Git qui examine les changements non commités avant un PR.
Weekly releases : sessions d'agent partagées dans Slack/Teams et support WSL expérimental
Mentionner @GitHub dans Slack ou Microsoft Teams transforme une conversation d'équipe en session d'agent partagée. L'onglet Customize (serveurs MCP, plugins, skills, canvases) atteint la disponibilité générale, avec un support WSL expérimental et VS Code 1.135 ajoutant la continuité de session inter-applications.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-08-26 | GLM-5.3-Flash | Z.ai / Zhipu | A | Ouvert | Le modèle anonyme viral « Ox Alpha » a été confirmé comme étant GLM-5.3-Flash : 320B paramètres (18B actifs), licence MIT, contexte multimodal de 1M tokens, tarifé à $0.15/$0.50 par M tokens. Il a atteint la #1 place du classement OpenRouter et aurait plus que doublé l'usage de DeepSeek en sa première semaine. |
Tendances Notables
Une semaine de maintenance plus que de gros titres : Claude Code et Codex CLI maintiennent leur cadence de sortie quasi quotidienne, en ajoutant hooks, streaming et correctifs de sécurité plutôt que de grandes nouvelles fonctionnalités.
L'épisode Ox Alpha / GLM-5.3-Flash révèle un nouveau schéma : les labos chinois lancent des modèles de manière anonyme sur OpenRouter pour créer du buzz avant de révéler la marque — Zhipu n'a confirmé la paternité qu'après avoir été identifié par empreinte technique.