IA pour coder : GPT-5.6 et Grok 4.5 sortent à 24h d'intervalle, Claude Code renforce la sécurité des agents
/doctor ahora sugiere recortar CLAUDE.md
v2.1.206 (9 jul): /doctor agrega una revisión que propone recortar archivos CLAUDE.md versionados eliminando contenido que Claude ya puede deducir del código. También suma sugerencias de rutas a /cd y hace que los agentes en segundo plano se actualicen apenas sale una nueva versión, en vez de pagar el costo al reconectarse.
Auto mode pide confirmación antes de rm -rf riesgosos
v2.1.205 (8 jul): el modo auto ahora pregunta antes de ejecutar rm -rf sobre una variable que no puede resolver desde el contexto, y bloquea manipular archivos de transcripción de sesión. /doctor pasa a ser un chequeo completo de configuración (alias /checkup) capaz de diagnosticar y arreglar problemas.
Nuevo control de tamaño para workflows dinámicos
v2.1.202 (6 jul): /config suma «Dynamic workflow size» para controlar cuántos agentes usa Claude en un workflow dinámico (chico/medio/grande). /review <pr> vuelve a ser un pase rápido de una sola pasada; el multi-agente ahora vive en /code-review <nivel> <pr#>.
Modo writes con aprobación y auth MCP interactiva
v0.144.0 (9 jul) introduce un modo de aprobación writes para operaciones de escritura controladas, permite que las herramientas MCP pidan autenticación interactiva sin flags experimentales, y suma ruteo por proxy del sistema (PAC/WPAD) en macOS y Windows. v0.144.1 corrige instalaciones standalone que fallaban con metadata de releases reordenada de GitHub.
Plugins remotos activados por defecto y modelos Bedrock GPT-5.6
v0.143.0 (8 jul) activa los plugins remotos por defecto con un catálogo enriquecido y fuentes npm, agrega los modelos GPT-5.6 Sol, Terra y Luna vía Amazon Bedrock con soporte de esfuerzo de razonamiento máximo, y hace que las herramientas MCP usen tool search por defecto.
GPT-5.6 Sol, Terra y Luna ya están disponibles
OpenAI lanzó la familia GPT-5.6 el 9 de julio: Sol (buque insignia para razonamiento y trabajo agéntico de largo alcance), Terra (rendimiento equivalente a GPT-5.5 al doble de eficiencia) y Luna (la más rápida y económica). Disponibles en ChatGPT, ChatGPT Work, Codex y la API, con despliegue global en 24 horas. Precios: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 por millón de tokens.
Navegación agéntica GA y sesiones en paralelo
La entrega de VS Code de julio (8 jul) hace que las herramientas de navegación agéntica pasen a disponibilidad general por defecto, permitiendo a los agentes navegar páginas, capturar screenshots y validar apps web. Suma sesiones de agente en paralelo con múltiples chats por sesión, un dashboard de visibilidad de costos y un editor unificado de proveedores de modelos en el marketplace.
Kimi K2.7 Code llega a Business y Enterprise
Desde el 7 de julio, Kimi K2.7 Code de Moonshot AI está disponible en los planes Copilot Business y Enterprise, tras su debut en planes Pro/Pro+/Max el 1 de julio. Es el primer modelo de pesos abiertos seleccionable en el selector de modelos de Copilot.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-07-09 | GPT-5.6 Sol | OpenAI | S+ | Propietario | Buque insignia para razonamiento de frontera y trabajo agéntico de largo alcance, con modo de aceleración Ultra. |
| 2026-07-09 | GPT-5.6 Terra | OpenAI | S | Propietario | Rendimiento equivalente a GPT-5.5 al doble de eficiencia en costo. |
| 2026-07-09 | GPT-5.6 Luna | OpenAI | A+ | Propietario | El miembro más rápido y económico de la familia GPT-5.6. |
| 2026-07-08 | Grok 4.5 | xAI | S+ | Propietario | Primer modelo de xAI pensado para coding y tareas agénticas, entrenado en parte junto a Cursor. 4º en el Artificial Analysis Intelligence Index, por encima de todos los modelos Gemini y ~60% más barato que Claude Opus 4.8. |
| 2026-07-01 | Kimi K2.7 Code | Moonshot AI | A | Abierto | Sucesor de K2.6 enfocado en coding, 256K de contexto y modo de razonamiento forzado. Primer modelo de pesos abiertos en el selector de GitHub Copilot. |
| 2026-07-15 | DeepSeek V4 (official) | DeepSeek | A | Abierto | Pasaje de preview a lanzamiento oficial a mediados de julio, con contexto de 1M de tokens en toda la línea y nuevo pricing pico/valle. Variantes V4-Pro (1.6T/49B activos) y V4-Flash (284B/13B activos). |
| 2026-07-17 | Gemini 3.5 Pro | S | Propietario | Google la reconstruyó desde cero tras detectar debilidades en coding y razonamiento de largo alcance; fecha reportada (no confirmada oficialmente) del 17 de julio. |
Tendencias Destacadas
Tres laboratorios de frontera se solaparon en 48 horas: Grok 4.5 (8 jul) y GPT-5.6 (9 jul) salieron casi espalda con espalda, ambos posicionados explícitamente para coding y trabajo agéntico, y ambos con precios muy por debajo de Claude Opus.
Claude Code sigue endureciendo la higiene de agentes autónomos: confirmación antes de rm -rf riesgosos, bloqueo de manipulación de transcripciones de sesión y un /doctor que ya diagnostica y arregla, no solo reporta.
Los modelos de pesos abiertos siguen colándose en herramientas propietarias: GitHub Copilot ya lleva Kimi K2.7 Code a Business/Enterprise, mientras DeepSeek V4 (mediados de julio) y Gemini 3.5 Pro (17 de julio, aún no confirmado) se perfilan como el próximo capítulo de la carrera de benchmarks de coding.
/doctor now proposes trimming CLAUDE.md
v2.1.206 (Jul 9): /doctor adds a check that proposes trimming checked-in CLAUDE.md files by cutting content Claude could already derive from the codebase. Also adds directory path suggestions to /cd, and background agents now upgrade right after a Claude Code update instead of paying a slow upgrade cost on reattach.
Auto mode confirms before risky rm -rf calls
v2.1.205 (Jul 8): auto mode now asks before running rm -rf on a variable it cannot resolve from context, and blocks tampering with session transcript files. /doctor becomes a full setup checkup (alias /checkup) that can diagnose and fix issues, not just report them.
New size control for dynamic workflows
v2.1.202 (Jul 6): /config adds a «Dynamic workflow size» setting to control how many agents Claude uses in a dynamic workflow (small/medium/large). /review <pr> goes back to a fast single-pass review; the multi-agent review now lives at /code-review <level> <pr#>.
Writes approval mode and interactive MCP auth
v0.144.0 (Jul 9) introduces a writes app-approval mode for controlled write operations, lets MCP tools request interactive authentication without experimental flags, and adds system proxy routing (PAC/WPAD) on macOS and Windows. v0.144.1 fixes standalone installs failing on reordered GitHub release metadata.
Remote plugins on by default, Bedrock GPT-5.6 models
v0.143.0 (Jul 8) enables remote plugins by default with a richer catalog and npm marketplace sources, adds Amazon Bedrock GPT-5.6 Sol, Terra and Luna models with first-class max reasoning effort support, and switches MCP tools to use tool search by default.
GPT-5.6 Sol, Terra and Luna are now available
OpenAI shipped the GPT-5.6 family on July 9: Sol (flagship for frontier reasoning and long-horizon agentic work), Terra (GPT-5.5-competitive performance at 2x lower cost) and Luna (fastest, most affordable). Live in ChatGPT, ChatGPT Work, Codex and the API, rolling out globally over 24 hours. Pricing: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 per million tokens.
Agentic browser tools GA and parallel sessions
The July VS Code release (Jul 8) makes agentic browser tools generally available by default, letting agents navigate pages, capture screenshots and validate web apps directly in the editor. Adds side-by-side parallel agent sessions with multiple chats per session, a cost-visibility dashboard, and a unified model-provider marketplace editor.
Kimi K2.7 Code reaches Business and Enterprise
As of July 7, Moonshot AI's Kimi K2.7 Code is available on Copilot Business and Enterprise plans, following its July 1 debut on Pro/Pro+/Max plans. It remains the first open-weight model selectable in Copilot's model picker.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-07-09 | GPT-5.6 Sol | OpenAI | S+ | Proprietary | Flagship for frontier reasoning and long-horizon agentic work, with an Ultra acceleration mode. |
| 2026-07-09 | GPT-5.6 Terra | OpenAI | S | Proprietary | GPT-5.5-competitive performance at roughly half the cost. |
| 2026-07-09 | GPT-5.6 Luna | OpenAI | A+ | Proprietary | The fastest, most affordable member of the GPT-5.6 family. |
| 2026-07-08 | Grok 4.5 | xAI | S+ | Proprietary | xAI's first model built for coding and agentic tasks, trained in part alongside Cursor. Ranks 4th on the Artificial Analysis Intelligence Index, above every Gemini model and ~60% cheaper than Claude Opus 4.8. |
| 2026-07-01 | Kimi K2.7 Code | Moonshot AI | A | Open | Coding-focused successor to K2.6 with 256K context and forced thinking mode. First open-weight model in GitHub Copilot's model picker. |
| 2026-07-15 | DeepSeek V4 (official) | DeepSeek | A | Open | Moves from preview to official release in mid-July, with a 1M-token context window across the lineup and new peak/off-peak pricing. Ships as V4-Pro (1.6T/49B active) and V4-Flash (284B/13B active). |
| 2026-07-17 | Gemini 3.5 Pro | S | Proprietary | Google rebuilt it from scratch after flagging weaknesses in coding and long-horizon reasoning; reported (not officially confirmed) target date of July 17. |
Notable Trends
Three frontier labs collided in a 48-hour window: Grok 4.5 (Jul 8) and GPT-5.6 (Jul 9) landed almost back to back, both explicitly positioned for coding and agentic work, and both priced well under Claude Opus.
Claude Code keeps hardening autonomous-agent hygiene: confirmation before risky rm -rf calls, blocking tampering with session transcripts, and a /doctor that now diagnoses and fixes issues instead of just reporting them.
Open-weight models keep working their way into proprietary tools: GitHub Copilot now ships Kimi K2.7 Code to Business/Enterprise, while DeepSeek V4 (mid-July) and Gemini 3.5 Pro (Jul 17, still unconfirmed) loom as the next chapter in the coding-benchmark race.
/doctor propose désormais d'alléger CLAUDE.md
v2.1.206 (9 juil.) : /doctor ajoute une vérification qui propose d'alléger les fichiers CLAUDE.md versionnés en retirant ce que Claude peut déjà déduire du code. Ajoute aussi des suggestions de chemins à /cd, et les agents en tâche de fond se mettent à jour juste après une mise à jour de Claude Code au lieu de payer le coût au rattachement.
Le mode auto confirme avant un rm -rf risqué
v2.1.205 (8 juil.) : le mode auto demande désormais confirmation avant un rm -rf sur une variable qu'il ne peut pas résoudre depuis le contexte, et bloque toute altération des fichiers de transcription de session. /doctor devient un contrôle complet de configuration (alias /checkup) capable de diagnostiquer et corriger les problèmes.
Nouveau contrôle de taille pour les workflows dynamiques
v2.1.202 (6 juil.) : /config ajoute un réglage « Dynamic workflow size » pour contrôler le nombre d'agents utilisés dans un workflow dynamique (petit/moyen/grand). /review <pr> redevient une revue rapide en une passe ; la revue multi-agents vit désormais dans /code-review <niveau> <pr#>.
Mode writes avec approbation et auth MCP interactive
v0.144.0 (9 juil.) introduit un mode d'approbation writes pour les opérations d'écriture contrôlées, permet aux outils MCP de demander une authentification interactive sans flags expérimentaux, et ajoute le routage par proxy système (PAC/WPAD) sur macOS et Windows. v0.144.1 corrige les installations standalone qui échouaient sur des métadonnées de release GitHub réordonnées.
Plugins distants activés par défaut, modèles Bedrock GPT-5.6
v0.143.0 (8 juil.) active les plugins distants par défaut avec un catalogue enrichi et des sources npm, ajoute les modèles GPT-5.6 Sol, Terra et Luna via Amazon Bedrock avec prise en charge de l'effort de raisonnement maximal, et fait passer les outils MCP à la recherche d'outils par défaut.
GPT-5.6 Sol, Terra et Luna sont désormais disponibles
OpenAI a lancé la famille GPT-5.6 le 9 juillet : Sol (modèle phare pour le raisonnement de pointe et le travail agentique long), Terra (performance comparable à GPT-5.5 à un coût deux fois moindre) et Luna (le plus rapide et le plus abordable). Disponibles sur ChatGPT, ChatGPT Work, Codex et l'API, déploiement mondial sur 24 heures. Tarifs : Sol 5$/30$, Terra 2,50$/15$, Luna 1$/6$ par million de tokens.
Navigation agentique GA et sessions en parallèle
La livraison VS Code de juillet (8 juil.) rend les outils de navigation agentique disponibles par défaut en GA, permettant aux agents de naviguer sur des pages, capturer des captures d'écran et valider des applis web directement dans l'éditeur. Ajoute des sessions d'agents en parallèle avec plusieurs chats par session, un tableau de bord de visibilité des coûts, et un éditeur unifié de fournisseurs de modèles dans le marketplace.
Kimi K2.7 Code arrive sur Business et Enterprise
Depuis le 7 juillet, Kimi K2.7 Code de Moonshot AI est disponible sur les plans Copilot Business et Enterprise, après ses débuts le 1er juillet sur les plans Pro/Pro+/Max. Il reste le premier modèle à poids ouverts sélectionnable dans le sélecteur de modèles de Copilot.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-07-09 | GPT-5.6 Sol | OpenAI | S+ | Propriétaire | Modèle phare pour le raisonnement de pointe et le travail agentique long, avec un mode d'accélération Ultra. |
| 2026-07-09 | GPT-5.6 Terra | OpenAI | S | Propriétaire | Performance comparable à GPT-5.5 pour environ moitié moins cher. |
| 2026-07-09 | GPT-5.6 Luna | OpenAI | A+ | Propriétaire | Le membre le plus rapide et le plus abordable de la famille GPT-5.6. |
| 2026-07-08 | Grok 4.5 | xAI | S+ | Propriétaire | Premier modèle xAI pensé pour le code et les tâches agentiques, entraîné en partie avec Cursor. 4e à l'Artificial Analysis Intelligence Index, devant tous les modèles Gemini et environ 60% moins cher que Claude Opus 4.8. |
| 2026-07-01 | Kimi K2.7 Code | Moonshot AI | A | Ouvert | Successeur de K2.6 axé code, contexte de 256K et mode de réflexion forcée. Premier modèle à poids ouverts dans le sélecteur de GitHub Copilot. |
| 2026-07-15 | DeepSeek V4 (official) | DeepSeek | A | Ouvert | Passage de la préversion au lancement officiel mi-juillet, avec une fenêtre de contexte d'1M de tokens sur toute la gamme et une nouvelle tarification heures pleines/creuses. Se décline en V4-Pro (1,6T/49B actifs) et V4-Flash (284B/13B actifs). |
| 2026-07-17 | Gemini 3.5 Pro | S | Propriétaire | Google l'a reconstruit de zéro après avoir identifié des faiblesses en code et en raisonnement long ; date cible rapportée (non confirmée officiellement) au 17 juillet. |
Tendances Notables
Trois laboratoires de pointe se sont télescopés en 48 heures : Grok 4.5 (8 juil.) et GPT-5.6 (9 juil.) sont sortis quasi coup sur coup, tous deux explicitement positionnés pour le code et le travail agentique, et tous deux nettement moins chers que Claude Opus.
Claude Code continue de renforcer l'hygiène des agents autonomes : confirmation avant un rm -rf risqué, blocage de toute altération des transcriptions de session, et un /doctor qui diagnostique désormais et corrige au lieu de simplement rapporter.
Les modèles à poids ouverts continuent de s'inviter dans les outils propriétaires : GitHub Copilot livre désormais Kimi K2.7 Code sur Business/Enterprise, tandis que DeepSeek V4 (mi-juillet) et Gemini 3.5 Pro (17 juillet, encore non confirmé) se profilent comme le prochain chapitre de la course aux benchmarks de code.