Copilot ships Agent Plugins 1.0, Claude Code adds subagent forking, and Grok 4.6 matches GPT-5.6 Sol
v2.1.229: grupos de sesión en VS Code
La extensión de VS Code suma grupos de sesión en la barra lateral (crear, renombrar, borrar, mover con selección múltiple). Los marketplaces de plugins ahora pueden apuntar a un comando local que resuelve el catálogo dinámicamente, y el streaming SSE gana keepalive para evitar cortes por timeout en Vertex/Bedrock.
v2.1.232: forking de subagentes por defecto + soporte GitLab
El forking de subagentes queda habilitado por defecto. Ahora se puede escribir @ para mencionar otra sesión de Claude Code activa y llegar a ella vía SendMessage. Se agrega soporte de GitLab en los marketplaces de plugins con redacción de secretos para tokens de GitLab, y Fable 5 vuelve como opción de /advisor.
Preview de modo Ultrafast para GPT-5.6 Sol
Nuevo nivel de servicio en la API, impulsado por Cerebras, que corre GPT-5.6 Sol hasta 14x más rápido (750 tokens de salida por segundo). Preview limitado, pensado para casos sensibles a la latencia como agentes de desarrollo.
Copilot en la web: minimizar el chat y ver gasto de tokens
Copilot on web suma controles de conversación: minimizar el chat y retomarlo después, más indicadores de gasto de tokens en la sesión.
Copilot memory + Ollama en Copilot para JetBrains
Ollama se suma como proveedor BYOK en Copilot para JetBrains, con auto-instalación de Copilot CLI desde las terminales de JetBrains.
Agent Plugins 1.0 llega a GA
Agent Plugins 1.0 sale de GA en VS Code, Copilot CLI y la app de Copilot: un estándar abierto (con AWS, Anysphere, Microsoft, OpenAI, Vercel y Google) para empaquetar skills de agentes + servidores MCP en un plugin portable e independiente de proveedor.
VS Code 1.133: Agent Host desacopla a los agentes del editor
Nuevo proceso «Agent Host» desacopla a los agentes de IA del editor (nueva especificación Agent Host Protocol, junto a LSP/DAP). El agente de Copilot ahora corre sobre el Copilot SDK, y se puede cambiar de proveedor a mitad de sesión en sesiones de Claude.
Gemini 3.7 Flash disponible en GitHub Copilot
Gemini 3.7 Flash ya está disponible como modelo en GitHub Copilot para los planes Pro, Pro+, Max, Business y Enterprise.
Compliance API se extiende a Cowork y Claude Code
La Claude Compliance API ahora cubre auditoría para Claude Cowork (desktop/web/mobile) y Claude Code (CLI/desktop) a través de la Compliance Access Key existente. Beta para clientes Enterprise.
Zed v1.15.0: diff contra merge-base y Emmet en JSX
Nuevo ajuste git.diff_base para diffear contra HEAD o contra el merge-base de la rama, soporte para arrastrar archivos fuera del editor en macOS/Wayland, edición vinculada para elementos personalizados en JSX/TSX, y autocompletado Emmet dentro de cuerpos de funciones flecha/return.
Cloud Agents "builds": arranque hasta 10x más rápido
Los agentes en la nube ahora arrancan sobre snapshots de entorno ya preparados («builds») en vez de configurarse desde cero, con hasta 10x más velocidad de arranque y 3x en tiempo hasta el primer token, historial de builds y fallback al último build funcional.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash | A | Propietario | GA del modelo workhorse de codificación/agentes de Google, con mejoras sustanciales en ingeniería de software y flujos agénticos. | |
| 2026-08-13 | DeepSeek-V4-Pro | DeepSeek | A+ | Propietario | GA orientada a agentes: HLE 42.7/60.0 (sin/con tools), Terminal-Bench 2.1 en 87.9, contexto de 1M de tokens, soporte nativo de la Responses API de OpenAI. |
| 2026-08-13 | Qwen3.8-2.4T-A95B | Alibaba / Qwen | A+ | Abierto | Pesos abiertos del modelo base detrás de la API Qwen3.8-Max: MoE de 2.4T total / 95B activos, contexto nativo de 262K (extensible a 1.01M), GPQA Diamond 92.6, SWE-bench Pro 67.7. |
| 2026-08-12 | Grok 4.6 | xAI | S | Propietario | Refinamiento de 1.5T parámetros sobre la base de Grok 4.5 (ganancias por SFT/RL, no por escala), contexto de 500K, AA Intelligence Index 61 (a la par de GPT-5.6 Sol), SWE-bench (Vals) 95.6%. |
| 2026-08-10 | GPT-5.6-Cyber | OpenAI | A | Propietario | Modelo especializado en ciberseguridad construido sobre GPT-5.6 Sol, con acceso restringido vía el nivel "Daybreak Red" para partners de seguridad verificados. |
| 2026-08-10 | Muse Glimmer (30B) | B+ | Abierto | Modelo abierto (Apache 2.0), transformer denso de 29.6B + encoder de visión de 1.8B, contexto de 131K, destilado de Muse Spark 1.2, corre en una sola GPU de consumo (menos de 20GB en 4-bit). | |
| 2026-11 | OpenAI "Doug" | OpenAI | S | Próximo | El mayor pre-entrenamiento de OpenAI desde 2024, presentado el 9 de agosto; sin plan de lanzamiento ni API confirmados, apuntando a noviembre de 2026. |
| 2026-08 | GLM-5.5 | Z.ai / Zhipu | A | Próximo | Proyectado para agosto de 2026 por analistas (JPMorgan/Reuters); Zhipu aún no lo confirma, canales oficiales siguen promocionando GLM-5.2. |
| 2026-08 | Grok 4.7 | xAI | S+ | Próximo | Modelo mayor de 2.1T reportado como sucesor de Grok 4.6 "unas semanas después"; sin fecha firme. |
| 2026-08-15 | Qwen3.8-27B | Alibaba / Qwen | A | Próximo | Hermano menor en open weights de Qwen3.8-Max, repetidamente retrasado; el countdown de ModelScope apunta ahora al 15 de agosto de 2026. |
| 2026-08-06 | GPT-5.6 Sol | OpenAI | S | Propietario | Referencia previa (fuera de ventana): la actualización de ChatGPT del 6 de agosto contra la que se comparan Grok 4.6 y el modo Ultrafast de esta semana. |
Tendencias Destacadas
La agenda de esta semana fue de infraestructura para agentes más que de features aisladas: Agent Plugins 1.0 (Copilot) y el nuevo Agent Host de VS Code apuntan al mismo problema — desacoplar agentes de IA del editor y estandarizar cómo se empaquetan skills y servidores MCP entre proveedores. Claude Code sigue la misma línea con forking de subagentes por defecto y menciones entre sesiones vía SendMessage.
En modelos, la carrera de benchmarks se intensificó: Grok 4.6 dice igualar a GPT-5.6 Sol, y tanto Qwen3.8 como Meta liberaron pesos abiertos de gran escala (2.4T y 30B respectivamente) casi el mismo día que DeepSeek sacaba su GA orientada a agentes — señal de que el open weight compite cada vez más de cerca con los modelos propietarios de punta.
v2.1.229: session groups in VS Code
The VS Code extension adds session groups in the sidebar (create, rename, delete, multi-select move). Plugin marketplaces can now point to a local command source that re-resolves the catalog dynamically, and SSE streaming gets keepalive pings to avoid idle-timeout drops on Vertex/Bedrock.
v2.1.232: subagent forking on by default + GitLab support
Subagent forking is now on by default. Type @ to mention another live Claude Code session and reach it via SendMessage. GitLab support lands in plugin marketplaces with secret redaction for GitLab token families, and Fable 5 is back as an /advisor option.
Ultrafast mode preview for GPT-5.6 Sol
New API service tier, powered by Cerebras, running GPT-5.6 Sol up to 14x faster — 750 output tokens per second. Limited preview aimed at latency-sensitive use cases, including developer agents.
Copilot on web: minimize chat and token-spend indicators
Copilot on web expands conversation controls: minimize chat and return to it later, plus token-spend indicators for the session.
Copilot memory and Ollama in Copilot for JetBrains
Ollama joins as a BYOK provider in GitHub Copilot for JetBrains, plus auto-install of Copilot CLI from JetBrains terminals.
Agent Plugins 1.0 reaches GA
Agent Plugins 1.0 reaches GA in VS Code, Copilot CLI, and the Copilot app: an open standard (with AWS, Anysphere, Microsoft, OpenAI, Vercel, and Google) packaging agent skills + MCP servers into one portable, vendor-independent plugin.
VS Code 1.133: Agent Host decouples agents from the editor
New "Agent Host" process decouples AI agents from the editor (new Agent Host Protocol spec, alongside LSP/DAP). Copilot's agent now runs on the Copilot SDK, with mid-session provider switching for Claude sessions.
Gemini 3.7 Flash now available in GitHub Copilot
Gemini 3.7 Flash is now available as a model in GitHub Copilot for Pro, Pro+, Max, Business, and Enterprise plans.
Compliance API extends to Cowork and Claude Code
The Claude Compliance API now covers audit trails for Claude Cowork (desktop/web/mobile) and Claude Code (CLI/desktop) through the existing Compliance Access Key. Beta for Enterprise customers.
Zed v1.15.0: diff-against-merge-base and Emmet in JSX
New git.diff_base setting to diff against HEAD or the branch merge-base, drag-file-out support on macOS/Wayland, linked editing for custom elements in JSX/TSX, and Emmet completions inside return/arrow-function bodies.
Cloud Agents "builds": up to 10x faster startup
Cloud agents now boot into pre-warmed environment snapshots ("builds") instead of setting up from scratch, claiming up to 10x faster startup and 3x faster time-to-first-token, with build history and fallback to the last good build.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash | A | Proprietary | GA release of Google's coding/agent workhorse, with substantial gains across software engineering and agentic workflows. | |
| 2026-08-13 | DeepSeek-V4-Pro | DeepSeek | A+ | Proprietary | Agent-focused GA: HLE 42.7/60.0 (no-tools/tools), Terminal-Bench 2.1 at 87.9, 1M-token context, native OpenAI Responses API support. |
| 2026-08-13 | Qwen3.8-2.4T-A95B | Alibaba / Qwen | A+ | Open | Open-weight release of the base model behind the Qwen3.8-Max API: 2.4T total/95B active MoE, 262K native context (extensible to 1.01M), GPQA Diamond 92.6, SWE-bench Pro 67.7. |
| 2026-08-12 | Grok 4.6 | xAI | S | Proprietary | 1.5T-parameter refinement of the Grok 4.5 foundation (SFT/RL gains, not scale), 500K context, AA Intelligence Index 61 (matching GPT-5.6 Sol), SWE-bench (Vals) 95.6%. |
| 2026-08-10 | GPT-5.6-Cyber | OpenAI | A | Proprietary | Cybersecurity-specialized model built on GPT-5.6 Sol, launched via the restricted "Daybreak Red" access tier for vetted security partners. |
| 2026-08-10 | Muse Glimmer (30B) | B+ | Open | Open-weight (Apache 2.0), 29.6B dense transformer + 1.8B vision encoder, 131K context, distilled from Muse Spark 1.2, runs on a single consumer GPU (under 20GB at 4-bit). | |
| 2026-11 | OpenAI "Doug" | OpenAI | S | Upcoming | OpenAI's largest pre-training run since 2024, unveiled Aug 9; no confirmed release plan or API yet, targeted for November 2026. |
| 2026-08 | GLM-5.5 | Z.ai / Zhipu | A | Upcoming | Analyst-projected for August 2026 (JPMorgan/Reuters); not yet confirmed by Zhipu, whose official channels still promote GLM-5.2. |
| 2026-08 | Grok 4.7 | xAI | S+ | Upcoming | Larger 2.1T model reported to follow Grok 4.6 "a few weeks later"; no firm date. |
| 2026-08-15 | Qwen3.8-27B | Alibaba / Qwen | A | Upcoming | Smaller open-weight sibling to Qwen3.8-Max, repeatedly delayed; ModelScope's countdown currently points to Aug 15, 2026. |
| 2026-08-06 | GPT-5.6 Sol | OpenAI | S | Proprietary | Prior reference (outside this week's window): the Aug 6 ChatGPT update that Grok 4.6 and this week's Ultrafast mode are benchmarked against. |
Notable Trends
This week leaned heavily on agent infrastructure over one-off features: Agent Plugins 1.0 (Copilot) and VS Code's new Agent Host both target the same problem — decoupling AI agents from the editor and standardizing how skills and MCP servers get packaged across vendors. Claude Code moved the same direction with subagent forking on by default and cross-session mentions via SendMessage.
On the model side, the benchmark race intensified: Grok 4.6 claims parity with GPT-5.6 Sol, while both Qwen3.8 and Meta shipped large-scale open weights (2.4T and 30B respectively) almost the same day DeepSeek pushed its agent-focused GA — a sign open-weight releases are closing in on frontier proprietary models.
v2.1.229 : groupes de sessions dans VS Code
L'extension VS Code ajoute des groupes de sessions dans la barre latérale (créer, renommer, supprimer, déplacer en sélection multiple). Les marketplaces de plugins peuvent pointer vers une command locale qui recalcule le catalogue, et le streaming SSE gagne des keepalive pour éviter les coupures par timeout sur Vertex/Bedrock.
v2.1.232 : forking de sous-agents par défaut + support GitLab
Le forking de sous-agents est désormais activé par défaut. Tapez @ pour mentionner une autre session Claude Code active et l'atteindre via SendMessage. Le support GitLab arrive dans les marketplaces de plugins avec rédaction des secrets pour les tokens GitLab, et Fable 5 revient comme option /advisor.
Aperçu du mode Ultrafast pour GPT-5.6 Sol
Nouveau niveau de service API, propulsé par Cerebras, faisant tourner GPT-5.6 Sol jusqu'à 14x plus vite — 750 tokens de sortie par seconde. Aperçu limité pensé pour les cas sensibles à la latence, dont les agents de développement.
Copilot sur le web : réduire le chat et voir la consommation de tokens
Copilot sur le web étend les contrôles de conversation : réduire le chat et y revenir plus tard, avec des indicateurs de consommation de tokens pour la session.
Copilot memory et Ollama dans Copilot pour JetBrains
Ollama rejoint comme fournisseur BYOK dans GitHub Copilot pour JetBrains, avec auto-installation de Copilot CLI depuis les terminaux JetBrains.
Agent Plugins 1.0 en GA
Agent Plugins 1.0 atteint la GA dans VS Code, Copilot CLI et l'app Copilot : un standard ouvert (avec AWS, Anysphere, Microsoft, OpenAI, Vercel et Google) qui empaquette des skills d'agents + serveurs MCP dans un plugin portable et indépendant du fournisseur.
VS Code 1.133 : Agent Host découple les agents de l'éditeur
Nouveau processus « Agent Host » qui découple les agents IA de l'éditeur (nouvelle spécification Agent Host Protocol, aux côtés de LSP/DAP). L'agent de Copilot tourne désormais sur le Copilot SDK, avec changement de fournisseur en cours de session pour les sessions Claude.
Gemini 3.7 Flash disponible dans GitHub Copilot
Gemini 3.7 Flash est désormais disponible comme modèle dans GitHub Copilot pour les plans Pro, Pro+, Max, Business et Enterprise.
Compliance API s'étend à Cowork et Claude Code
La Claude Compliance API couvre désormais l'audit pour Claude Cowork (desktop/web/mobile) et Claude Code (CLI/desktop) via la Compliance Access Key existante. Bêta pour les clients Enterprise.
Zed v1.15.0 : diff contre merge-base et Emmet en JSX
Nouveau réglage git.diff_base pour diffuser contre HEAD ou le merge-base de la branche, support du glisser-déposer de fichiers hors de l'éditeur sur macOS/Wayland, édition liée pour éléments personnalisés en JSX/TSX, et complétions Emmet dans les corps de fonctions return/flèche.
Cloud Agents « builds » : démarrage jusqu'à 10x plus rapide
Les agents cloud démarrent désormais sur des snapshots d'environnement préchauffés (« builds ») au lieu de tout configurer à zéro, avec un démarrage jusqu'à 10x plus rapide et un temps jusqu'au premier token 3x plus rapide, plus un historique des builds et un repli sur le dernier build fonctionnel.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-08-13 | Gemini 3.7 Flash | A | Propriétaire | Sortie GA du modèle workhorse de codage/agents de Google, avec des gains substantiels en ingénierie logicielle et flux agentiques. | |
| 2026-08-13 | DeepSeek-V4-Pro | DeepSeek | A+ | Propriétaire | GA axée agents : HLE 42.7/60.0 (sans/avec outils), Terminal-Bench 2.1 à 87.9, contexte de 1M tokens, support natif de la Responses API d'OpenAI. |
| 2026-08-13 | Qwen3.8-2.4T-A95B | Alibaba / Qwen | A+ | Ouvert | Sortie en poids ouverts du modèle de base derrière l'API Qwen3.8-Max : MoE 2.4T total/95B actifs, contexte natif de 262K (extensible à 1.01M), GPQA Diamond 92.6, SWE-bench Pro 67.7. |
| 2026-08-12 | Grok 4.6 | xAI | S | Propriétaire | Raffinement à 1.5T paramètres de la base Grok 4.5 (gains SFT/RL, pas d'échelle), contexte de 500K, AA Intelligence Index 61 (à égalité avec GPT-5.6 Sol), SWE-bench (Vals) 95.6%. |
| 2026-08-10 | GPT-5.6-Cyber | OpenAI | A | Propriétaire | Modèle spécialisé en cybersécurité construit sur GPT-5.6 Sol, lancé via le niveau d'accès restreint « Daybreak Red » pour partenaires de sécurité vérifiés. |
| 2026-08-10 | Muse Glimmer (30B) | B+ | Ouvert | Poids ouverts (Apache 2.0), transformeur dense de 29.6B + encodeur visuel de 1.8B, contexte de 131K, distillé de Muse Spark 1.2, tourne sur un seul GPU grand public (moins de 20 Go en 4-bit). | |
| 2026-11 | OpenAI "Doug" | OpenAI | S | À venir | Le plus grand pré-entraînement d'OpenAI depuis 2024, dévoilé le 9 août ; aucun plan de sortie ni API confirmés, visé pour novembre 2026. |
| 2026-08 | GLM-5.5 | Z.ai / Zhipu | A | À venir | Projeté pour août 2026 par des analystes (JPMorgan/Reuters) ; pas encore confirmé par Zhipu, dont les canaux officiels promeuvent toujours GLM-5.2. |
| 2026-08 | Grok 4.7 | xAI | S+ | À venir | Modèle plus grand de 2.1T annoncé comme successeur de Grok 4.6 « quelques semaines après » ; aucune date ferme. |
| 2026-08-15 | Qwen3.8-27B | Alibaba / Qwen | A | À venir | Petit frère en poids ouverts de Qwen3.8-Max, plusieurs fois retardé ; le compte à rebours ModelScope pointe actuellement vers le 15 août 2026. |
| 2026-08-06 | GPT-5.6 Sol | OpenAI | S | Propriétaire | Référence antérieure (hors de la fenêtre de cette semaine) : la mise à jour ChatGPT du 6 août à laquelle Grok 4.6 et le mode Ultrafast de cette semaine sont comparés. |
Tendances Notables
Cette semaine a beaucoup misé sur l'infrastructure agentique plutôt que sur des features isolées : Agent Plugins 1.0 (Copilot) et le nouvel Agent Host de VS Code ciblent le même problème — découpler les agents IA de l'éditeur et standardiser l'empaquetage des skills et serveurs MCP entre fournisseurs. Claude Code va dans la même direction avec le forking de sous-agents par défaut et les mentions inter-sessions via SendMessage.
Côté modèles, la course aux benchmarks s'est intensifiée : Grok 4.6 revendique la parité avec GPT-5.6 Sol, tandis que Qwen3.8 et Meta ont livré des poids ouverts à grande échelle (2.4T et 30B respectivement) presque le même jour que la GA axée agents de DeepSeek — signe que les modèles à poids ouverts se rapprochent des modèles propriétaires de pointe.