Daily AI Coding Tools Brief — May 13, 2026
v2.1.140: estabilidad enterprise y corrección de subagent_type
v2.1.140 (12 may 2026, 21:09 UTC) mejora el matching de subagent_type en el tool Agent — ahora insensible a mayúsculas y separadores — y actualiza la paleta de colores de agentes. Corrige múltiples problemas enterprise críticos: inicio del servicio en background con EDR, hot-reload para settings enlazados simbólicamente, reintento de autenticación 401 en managed settings remotos, y el bloqueo silencioso de /goal cuando disableAllHooks está activo.
v0.129.0: goal workflows, hook browser y edición Vim modal
Codex CLI 0.129.0 (7 may 2026) añade goal workflows con duración multi-día y controles TUI para crear, pausar, reanudar y borrar; un hook browser con gestión de ciclo de vida; edición Vim modal en el compositor con defaults configurables; y el selector rediseñado de resume/fork de workflows. También incluye plugin sharing con controles de workspace y modo raw scrollback.
Auto-review: documentación expandida del ciclo de vida del revisor
El 11 may 2026, OpenAI publicó documentación expandida para Codex Auto-review, cubriendo ciclo de vida del revisor, condiciones de disparo, comportamiento en fallos y configuración local o managed. Facilita la integración enterprise del proceso de revisión automática de PRs en pipelines CI/CD existentes.
Google I/O 2026 (19-20 may): Gemini 4 y Antigravity IDE en camino
Google I/O 2026 arranca en 6 días (19-20 may) con fuerte énfasis en IA agéntica. Se esperan: Gemini 4 como sucesor de Gemini 3.1 Pro (94.3% GPQA Diamond), la Gemini Enterprise Agent Platform para flujos multi-agente corporativos, y Google Antigravity — el nuevo IDE agéntico para prototipar y construir aplicaciones de IA. Suscriptores de Google AI Pro y Ultra ya tienen créditos Cloud adicionales como anticipo.
Code Review: mejoras en la experiencia de comentarios y reportes de abril
El 12 may 2026, GitHub mejoró la experiencia de comentarios en Copilot Code Review con una interfaz más clara y flujo de revisión más intuitivo. Simultáneamente, los reportes de uso de abril ya están disponibles para preparar la transición al modelo GitHub AI Credits — efectivo el 1 de junio. Los usuarios pueden auditar su consumo antes del cambio de billing.
Grok Code Fast 1 eliminado de Copilot el 15 de mayo
El 8 may 2026, GitHub anunció que Grok Code Fast 1 se eliminará de todas las experiencias de Copilot el 15 may 2026. Alternativas recomendadas: GPT-5 mini y Claude Haiku 4.5. Esta es la tercera eliminación importante de la semana, tras Claude Sonnet 4 y GPT-4.1 (ambos el 7 may). La aceleración en la rotación del catálogo prepara el terreno para el billing por AI Credits.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-05-06 | Grok 4.3 | xAI | A+ | Propietario | Última versión de Grok. Mejoras en razonamiento y codificación. |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | A+ | Propietario | Variante ligera y de alta velocidad de GPT-5.5 para alto volumen. |
| 2026-04-27 | Qwen3.6-Max-Preview | Alibaba / Qwen | S | Propietario | El modelo propietario más potente de Qwen. Lidera 6 benchmarks de codificación. Disponible via Qwen Studio y API Alibaba Cloud. |
| 2026-04-23 | GPT-5.5 Pro | OpenAI | S+ | Propietario | Primera arquitectura base completamente reentrenada desde GPT-4.5. Terminal-Bench 2.0: 82.7%, SWE-bench Verified: 88.7%. |
| 2026-04-23 | GPT-5.5 | OpenAI | S | Propietario | Base GPT-5.5. SWE-bench Pro: 58.6%, SWE-bench Verified: 88.7%. |
| 2026-04-24 | DeepSeek-V4-Pro | DeepSeek | S | Abierto | MoE de 1.6T parámetros, ventana de 1M tokens. Orientado a codificación compleja y agentes. |
| 2026-04-24 | DeepSeek-V4-Flash | DeepSeek | A+ | Abierto | 284B parámetros MoE, contexto 1M tokens. Variante rápida y económica de V4-Pro. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | S | Abierto | Dense open-weight. SWE-bench Verified: 77.2%. Supera al MoE de 397B en benchmarks agénticos. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Abierto | MoE de 1T parámetros, 32B activos. Agent Swarm: 300 sub-agentes, 4000 pasos coordinados. Licencia MIT. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | SWE-bench Pro: 64.3% (#1 mundial). Nivel de esfuerzo xhigh, resolución de imagen 3x. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | A+ | Abierto | Open source desde el 8 abr. Modelo frontera de Z.ai, primera empresa china de IA en bolsa. |
| 2026-02-01 | Gemini 3.1 Pro | S | Propietario | GPQA Diamond: 94.3%, ARC-AGI-2: 77.1% (doble que su predecesor). Líder en razonamiento científico. |
Tendencias Destacadas
<strong>Claude Code v2.1.140</strong> (lanzado a las 21:09 UTC del 12 de mayo) es una señal inequívoca de endurecimiento enterprise: los fixes apuntan directamente a EDR (Endpoint Detection and Response), managed settings remotos y configs enlazadas simbólicamente — exactamente los puntos de fricción de despliegues corporativos a gran escala. Anthropic no está esperando a que I/O de Google o Build de Microsoft; está consolidando su posición en el segmento enterprise ahora.
Copilot está acelerando la rotación de su catálogo de modelos — Grok Code Fast 1 (15 may), Claude Sonnet 4 y GPT-4.1 (ambos el 7 may) — mientras prepara la migración al billing por AI Credits (1 jun). La señal es doble: simplificar el catálogo para facturación por token y forzar a los usuarios exigentes hacia modelos más nuevos. El umbral de acceso a Opus 4.7 sube a Pro+ — lo que podría beneficiar a Claude Code y Codex como alternativas de alto rendimiento.
Google I/O 2026 (19-20 mayo) está a 6 días y es el evento técnico más anticipado del año. Con Gemini 3.1 Pro liderando benchmarks científicos y Gemma 4 como el open-weight más capaz de Google, la presión es enorme. <strong>Gemini 4</strong> como respuesta directa a Claude Opus 4.7 y GPT-5.5 Pro, <strong>Google Antigravity</strong> como el IDE agéntico nativo, y la <strong>Gemini Enterprise Agent Platform</strong> completarían un golpe estratégico que podría reordenar el ecosistema dev en la segunda mitad de 2026.
v2.1.140: enterprise stability and subagent_type fix
v2.1.140 (May 12, 2026, 21:09 UTC) improves subagent_type matching in the Agent tool — now case- and separator-insensitive — and updates the agent color palette. Fixes several enterprise-critical issues: background service startup on EDR-protected machines, settings hot-reload for symlinked config files, remote managed settings 401 retry logic, and silent /goal hang when disableAllHooks or allowManagedHooksOnly is set.
v0.129.0: goal workflows, hook browser, and Vim modal editing
Codex CLI 0.129.0 (May 7, 2026) adds goal workflows with multi-day duration and TUI controls for create, pause, resume, and clear; a hook browser with lifecycle management; Vim modal editing in the composer with configurable defaults; and a redesigned workflow resume/fork picker. Also includes plugin sharing with workspace controls and raw scrollback mode.
Auto-review: expanded reviewer lifecycle documentation
On May 11, 2026, OpenAI published expanded Auto-review documentation covering reviewer lifecycle, trigger conditions, failure behavior, and local vs. managed configuration — making it easier to integrate automated PR review into existing enterprise CI/CD pipelines.
Google I/O 2026 (May 19-20): Gemini 4 and Antigravity IDE incoming
Google I/O 2026 kicks off in 6 days (May 19-20) with a heavy emphasis on agentic AI. Expected: Gemini 4 as successor to Gemini 3.1 Pro (94.3% GPQA Diamond), the Gemini Enterprise Agent Platform for corporate multi-agent workflows, and Google Antigravity — the new agentic IDE for prototyping and building AI applications. Google AI Pro and Ultra subscribers already have additional Cloud credits as a preview perk.
Code Review: comment experience improvements and April billing reports
On May 12, 2026, GitHub improved the comment experience in Copilot Code Review with a cleaner interface and more intuitive review flow. Simultaneously, April usage reports are now available to help users audit consumption ahead of the GitHub AI Credits billing transition — effective June 1.
Grok Code Fast 1 deprecated from Copilot on May 15
On May 8, 2026, GitHub announced Grok Code Fast 1 will be removed from all Copilot experiences on May 15, 2026. Recommended alternatives: GPT-5 mini and Claude Haiku 4.5. This is the third major model removal this week, after Claude Sonnet 4 and GPT-4.1 (both May 7). Catalog rotation is accelerating ahead of the AI Credits billing switch.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-06 | Grok 4.3 | xAI | A+ | Proprietary | Latest Grok release. Improved reasoning and coding capabilities. |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | A+ | Proprietary | Lightweight, high-throughput variant of GPT-5.5 optimized for high-volume use. |
| 2026-04-27 | Qwen3.6-Max-Preview | Alibaba / Qwen | S | Proprietary | Qwen's most powerful proprietary model. Tops 6 coding benchmarks. Available via Qwen Studio and Alibaba Cloud API. |
| 2026-04-23 | GPT-5.5 Pro | OpenAI | S+ | Proprietary | First fully retrained base since GPT-4.5. Terminal-Bench 2.0: 82.7%, SWE-bench Verified: 88.7%. |
| 2026-04-23 | GPT-5.5 | OpenAI | S | Proprietary | Base GPT-5.5 release. SWE-bench Pro: 58.6%, SWE-bench Verified: 88.7%. |
| 2026-04-24 | DeepSeek-V4-Pro | DeepSeek | S | Open | 1.6T parameter MoE, 1M token context. Built for complex coding and agent tasks. |
| 2026-04-24 | DeepSeek-V4-Flash | DeepSeek | A+ | Open | 284B parameter MoE, 1M token context. Faster, cheaper companion to V4-Pro. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | S | Open | Dense open-weight. SWE-bench Verified: 77.2%. Outperforms the 397B MoE on agentic coding benchmarks. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Open | 1T parameter MoE, 32B active. Agent Swarm: 300 sub-agents, 4,000 coordinated steps. MIT license. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | SWE-bench Pro: 64.3% (global #1). New xhigh effort level, 3x image resolution. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | A+ | Open | Open sourced Apr 8. Coding-first frontier from Z.ai, China's first public AI company. |
| 2026-02-01 | Gemini 3.1 Pro | S | Proprietary | GPQA Diamond: 94.3%, ARC-AGI-2: 77.1% (double its predecessor). Leads scientific reasoning benchmarks. |
Notable Trends
<strong>Claude Code v2.1.140</strong> (shipped 21:09 UTC May 12) signals deliberate enterprise hardening: fixes target EDR-protected machines, remote managed settings auth, and symlinked config files — exactly the friction points of large corporate deployments. Anthropic is not waiting for Google I/O or Microsoft Build to compete; it is consolidating enterprise position now.
Copilot is aggressively pruning its model catalog — Grok Code Fast 1 (May 15), Claude Sonnet 4 and GPT-4.1 (both May 7) — while preparing the AI Credits billing shift (June 1). The signal is twofold: simplify the catalog for per-token billing, and push power users toward newer models. With Opus 4.7 gated behind Pro+, Claude Code and Codex stand to benefit as high-performance alternatives for users unwilling to upgrade.
Google I/O 2026 (May 19-20) is 6 days away and is the most anticipated technical event of the year. With Gemini 3.1 Pro leading scientific reasoning benchmarks and Gemma 4 as Google's strongest open-weight, the stakes are enormous. <strong>Gemini 4</strong> as a direct response to Claude Opus 4.7 and GPT-5.5 Pro, <strong>Google Antigravity</strong> as a native agentic IDE, and the <strong>Gemini Enterprise Agent Platform</strong> would complete a strategic punch capable of reshaping the dev ecosystem in the second half of 2026.
v2.1.140 : stabilité enterprise et correction subagent_type
v2.1.140 (12 mai 2026, 21:09 UTC) améliore le matching de subagent_type (insensible à la casse et aux séparateurs), met à jour la palette de couleurs, et corrige des problèmes enterprise critiques : démarrage sur machines avec EDR, hot-reload pour les configs liées symboliquement, retry 401 pour les managed settings distants, et blocage silencieux de /goal avec disableAllHooks.
v0.129.0 : workflows goal, navigateur de hooks et édition Vim modale
Codex CLI 0.129.0 (7 mai 2026) ajoute les workflows goal multi-jours avec contrôles TUI, un navigateur de hooks avec gestion de cycle de vie, l'édition Vim modale dans le compositeur, et un sélecteur de reprise/fork repensé. Inclut également le partage de plugins avec contrôles workspace et le mode raw scrollback.
Auto-review : documentation étendue du cycle de vie du réviseur
Le 11 mai 2026, OpenAI a publié la documentation étendue d'Auto-review couvrant le cycle de vie du réviseur, les conditions de déclenchement, le comportement en cas d'échec et la configuration locale ou managed — facilitant l'intégration dans les pipelines CI/CD enterprise.
Google I/O 2026 (19-20 mai) : Gemini 4 et Antigravity IDE en approche
Google I/O 2026 commence dans 6 jours (19-20 mai) avec un fort accent sur l'IA agentique. Attendus : Gemini 4 comme successeur de Gemini 3.1 Pro (94,3% GPQA Diamond), la Gemini Enterprise Agent Platform pour les workflows multi-agents corporate, et Google Antigravity — le nouvel IDE agentique pour prototyper des applications IA. Les abonnés AI Pro et Ultra ont déjà des crédits Cloud supplémentaires.
Code Review : améliorations de l'expérience de commentaires et rapports avril
Le 12 mai 2026, GitHub a amélioré l'expérience de commentaires dans Copilot Code Review avec une interface plus claire. Simultanément, les rapports d'utilisation d'avril sont disponibles pour préparer la transition vers GitHub AI Credits — effective le 1er juin.
Grok Code Fast 1 supprimé de Copilot le 15 mai
Le 8 mai 2026, GitHub a annoncé la suppression de Grok Code Fast 1 de toutes les expériences Copilot le 15 mai 2026. Alternatives recommandées : GPT-5 mini et Claude Haiku 4.5. C'est la troisième suppression majeure de la semaine, après Claude Sonnet 4 et GPT-4.1 (tous deux le 7 mai).
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-06 | Grok 4.3 | xAI | A+ | Propriétaire | Dernière version Grok. Améliorations en raisonnement et codage. |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | A+ | Propriétaire | Variante légère et haute débit de GPT-5.5 pour les cas d'usage à fort volume. |
| 2026-04-27 | Qwen3.6-Max-Preview | Alibaba / Qwen | S | Propriétaire | Le modèle propriétaire le plus puissant de Qwen. Domine 6 benchmarks de codage. Via Qwen Studio et API Alibaba Cloud. |
| 2026-04-23 | GPT-5.5 Pro | OpenAI | S+ | Propriétaire | Première base entièrement réentraînée depuis GPT-4.5. Terminal-Bench 2.0 : 82,7%, SWE-bench Verified : 88,7%. |
| 2026-04-23 | GPT-5.5 | OpenAI | S | Propriétaire | GPT-5.5 de base. SWE-bench Pro : 58,6%, SWE-bench Verified : 88,7%. |
| 2026-04-24 | DeepSeek-V4-Pro | DeepSeek | S | Ouvert | MoE 1,6T paramètres, contexte 1M tokens. Optimisé pour le codage complexe et les agents. |
| 2026-04-24 | DeepSeek-V4-Flash | DeepSeek | A+ | Ouvert | 284B paramètres MoE, contexte 1M tokens. Variante rapide et économique de V4-Pro. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | S | Ouvert | Dense open-weight. SWE-bench Verified : 77,2%. Dépasse le MoE 397B sur les benchmarks agentiques. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Ouvert | MoE 1T paramètres, 32B actifs. Agent Swarm : 300 sous-agents, 4000 étapes coordonnées. Licence MIT. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | SWE-bench Pro : 64,3% (#1 mondial). Nouveau niveau xhigh, résolution image 3x. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | A+ | Ouvert | Open source depuis le 8 avr. Modèle frontier de Z.ai, première IA chinoise cotée en bourse. |
| 2026-02-01 | Gemini 3.1 Pro | S | Propriétaire | GPQA Diamond : 94,3%, ARC-AGI-2 : 77,1% (double du prédécesseur). Leader en raisonnement scientifique. |
Tendances Notables
<strong>Claude Code v2.1.140</strong> (publié à 21h09 UTC le 12 mai) signale un durcissement enterprise délibéré : les correctifs ciblent les machines avec EDR, l'authentification des managed settings distants et les fichiers de config liés symboliquement — exactement les points de friction des grands déploiements corporate.
Copilot accélère la rotation de son catalogue — Grok Code Fast 1 (15 mai), Claude Sonnet 4 et GPT-4.1 (tous deux le 7 mai) — en préparant la migration vers les AI Credits (1er juin). Le signal est double : simplifier le catalogue pour la facturation par token, et pousser les utilisateurs vers les modèles récents. Avec Opus 4.7 réservé au plan Pro+, Claude Code et Codex pourraient en bénéficier.
Google I/O 2026 (19-20 mai) est dans 6 jours et est l'événement technique le plus attendu de l'année. Avec Gemini 3.1 Pro en tête des benchmarks de raisonnement scientifique et Gemma 4 comme open-weight le plus capable de Google, les enjeux sont énormes. <strong>Gemini 4</strong> comme réponse directe à Claude Opus 4.7 et GPT-5.5 Pro, <strong>Google Antigravity</strong> comme IDE agentique natif, et la <strong>Gemini Enterprise Agent Platform</strong> compléteraient un coup stratégique majeur.