Brief IA para Developers — 18 de mayo de 2026
v2.1.143: Enforcement de dependencias de plugins, costo de contexto proyectado y worktree.bgIsolation
claude plugin disable ahora se niega si otro plugin habilitado depende del objetivo, con un hint copiable para la cadena de desactivación. Se agregó estimación de costo de contexto (por turno y por invocación) al panel del mercado /plugin. El nuevo parámetro worktree.bgIsolation: none permite a las sesiones en background editar directamente la copia de trabajo sin usar EnterWorktree, para repos donde los worktrees son impracticables.
0.131.0-alpha: Ciclo de desarrollo alpha activo con 22+ builds pre-release esta semana
El repositorio de Codex en GitHub muestra una cadencia de release intensa: más de 22 builds alpha pre-release desde el 11 de mayo (del alpha.6 al alpha.22). No se publicaron notas de release detalladas para este período. El canal estable sigue en 0.130.x mientras 0.131.0-alpha madura.
Google I/O 2026 mañana (19-20 mayo): grandes anuncios de Gemini esperados
Google I/O 2026 se celebra mañana y el miércoles. Se esperan actualizaciones importantes de Gemini Code Assist, incluyendo posiblemente Gemini 3.x para desarrolladores, mejoras en el modo agente y novedades de Google Antigravity (el IDE agentique lanzado en noviembre 2025, actualmente en public preview). Las versiones actuales de Code Assist (VS Code 2.82.0 e IntelliJ 1.51.1) solo contienen correcciones de mantenimiento esta semana: todo el esfuerzo apunta a I/O.
Copilot App en Technical Preview: cliente de escritorio autónomo para desarrollo agentic
La Copilot App — app nativa para macOS, Windows y Linux — ya está en technical preview para planes de pago. Funcionalidades clave: sesiones paralelas cada una con su propio worktree git y rama; interfaz tipo Inbox que prioriza issues, PRs y CI checks entre repos; y tres modos de sesión. Los modelos son configurables por organización (Anthropic, OpenAI y modelos propios de GitHub) y las sesiones corren del lado de la nube. Los usuarios Pro y Pro+ pueden solicitar acceso anticipado.
GPT-5.3-Codex reemplaza GPT-4.1 como modelo base en Copilot Business y Enterprise
A partir del 17 de mayo, GPT-5.3-Codex es el nuevo modelo base para completaciones de código y chat en planes Business y Enterprise — reemplazando a GPT-4.1. Es el mismo modelo especializado en coding que OpenAI lanzó como Codex Spark, optimizado para seguimiento de instrucciones y desarrollo de software.
Copilot Memory: guarda preferencias de trabajo para Pro y Pro+ en early access
Copilot puede ahora almacenar preferencias personales declaradas o inferidas sobre cómo trabajás — en early access para usuarios Pro y Pro+. La memoria persiste entre sesiones para dar respuestas más coherentes a lo largo del tiempo. Acceso empresarial llegará más adelante.
Lanzamiento: Claude para Pequeñas Empresas — 15 workflows agentic preconfigurados
Anthropic lanzó Claude para Pequeñas Empresas el 13 de mayo: un paquete de conectores, workflows agentic y skills reutilizables. Incluye 15 workflows preconfigurados para finanzas, operaciones, ventas, marketing, RRHH y atención al cliente, con conectores para QuickBooks, PayPal, HubSpot, Canva, DocuSign, Google Workspace y Microsoft 365. Acompaña un tour por 10 ciudades de EE.UU. con talleres gratuitos para 100 líderes empresariales en cada parada.
Claude para Legal: 20+ conectores MCP y 12 plugins para despachos y departamentos jurídicos
Anthropic anunció el 12 de mayo una suite de más de 20 conectores MCP y 12 plugins específicos por rol para incrustar Claude en los flujos de trabajo de bufetes, departamentos legales corporativos y litigantes pro se. Señal de que Anthropic está transitando de chatbot de propósito general a herramientas de IA específicas por industria.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Propietario | Nuevo modelo predeterminado de ChatGPT (reemplaza GPT-5.3 Instant). 52.5% menos alucinaciones en prompts de alto riesgo (medicina, derecho, finanzas). Más conciso y con mejor personalización. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Abierto | Modelos MoE con ventana de contexto de 1M tokens. V4 Pro: 1.6T parámetros (49B activos), el modelo open-weight más grande disponible. V4 Flash desde $0.14/M tokens entrada. Cierra la brecha con modelos frontier cerrados. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propietario | Modelo frontier de OpenAI. Mejor razonamiento multi-paso, uso de herramientas y coding. 35% menos consumo de tokens que GPT-5.4 para calidad equivalente. Disponible en API desde el 24 de abril. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Abierto | Modelo denso open-weight. 77.2% en SWE-bench Verified, 59.3% en Terminal-Bench 2.0 (igual que Claude Opus 4.5). Supera modelos MoE de 397B en benchmarks agentic de coding. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Abierto | 1T parámetros MoE, 32B activos, contexto 262K tokens, MIT modificado. 58.6% SWE-Bench Pro (iguala GPT-5.5), #1 en Humanity's Last Exam con herramientas (54.0%). Sistema de 300 sub-agentes, entrada de video nativo. Aproximadamente 1/5 del costo de modelos cerrados comparables. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Propietario | Preview con ventana de contexto 256K tokens. N.°1 en SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench y SciCode — 6 benchmarks de coding y tareas agentic. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | 64.3% SWE-bench Pro (nuevo N.°1 global), 87.6% SWE-bench Verified. Mayor salto single-version en SWE-bench Pro de 2026 (+10.9 pts vs Opus 4.6). Nuevo nivel de esfuerzo xhigh. Precio: $5/$25 por MTok. |
| 2026-04-16 | Qwen3.6-35B-A3B | Alibaba/Qwen | A | Abierto | Variante MoE de Qwen3.6: 35B parámetros totales, 3B activos por token. Alta eficiencia para inferencia local y despliegue en hardware restringido. |
| 2026-04-08 | GLM-5.1 | Z.ai/Zhipu | A+ | Abierto | Versión open-source lanzada el 8 de abril. Llegó a suscriptores en late-marzo; open-sourced semanas después. Basado en la arquitectura de GLM-5 (744B MoE, 40B activos por token). |
Tendencias Destacadas
El desarrollo agentic desde el escritorio se convierte en la apuesta central de la industria: la Copilot App (GitHub), el Agent View de Claude Code y Google Antigravity apuntan al mismo paradigma — agentes autónomos trabajando en paralelo mientras el desarrollador supervisa. Esta semana, GitHub da el paso más concreto con una app nativa multiplataforma y sesiones aisladas en la nube.
Anthropic pivota de herramienta horizontal a plataforma vertical. En una sola semana lanzó bundles específicos para pequeñas empresas y el sector legal — señal de que la IA general se está commoditizando y la competencia se libra en profundidad de integración, no en capacidad del modelo base.
La guerra de modelos open-weight se intensifica: Kimi K2.6 iguala a GPT-5.5 en SWE-Bench Pro a aproximadamente 1/5 del costo, y DeepSeek V4 Pro es ahora el modelo open-weight más grande (1.6T parámetros) con contexto de 1M tokens. Los modelos de código cerrado ya no tienen monopolio en la frontera del coding.
v2.1.143: Plugin dependency enforcement, projected context cost, and worktree.bgIsolation
claude plugin disable now refuses when another enabled plugin depends on the target, with a copy-pasteable disable-chain hint. Projected context cost (per-turn and per-invocation token estimates) added to the /plugin marketplace browse pane. New worktree.bgIsolation: none setting lets background sessions edit the working copy directly without EnterWorktree, for repos where worktrees are impractical.
0.131.0-alpha: Active alpha development cycle with 22+ pre-release builds this week
The Codex GitHub repository shows an intense release cadence: over 22 alpha pre-release builds since May 11 (alpha.6 through alpha.22). No detailed release notes were published for this period. The stable channel remains at 0.130.x while 0.131.0-alpha matures.
Google I/O 2026 tomorrow (May 19-20): major Gemini announcements expected
Google I/O 2026 takes place tomorrow and Wednesday. Major Gemini Code Assist updates are expected, potentially including Gemini 3.x for developers, agent mode enhancements, and updates for Google Antigravity (the agentic IDE launched in November 2025, currently in public preview). Current Code Assist releases (VS Code 2.82.0 and IntelliJ 1.51.1) contain only maintenance fixes this week — all effort is pointing at I/O.
Copilot App in Technical Preview: standalone desktop client for agentic development
The Copilot App — a native desktop client for macOS, Windows, and Linux — launched in technical preview for paid plans. Key features: parallel sessions each with their own git worktree and branch; an Inbox-style interface surfacing issues, PRs, and CI checks across repos; and three session modes. Models are configurable per organization (Anthropic, OpenAI, and GitHub's own) and sessions run cloud-side. Pro and Pro+ users can sign up for early access.
GPT-5.3-Codex replaces GPT-4.1 as base model in Copilot Business and Enterprise
As of May 17, GPT-5.3-Codex is the new base model for code completions and chat in Copilot Business and Enterprise plans — replacing GPT-4.1. It is the same coding-specialized model OpenAI launched as Codex Spark, optimized for instruction-following and software development tasks.
Copilot Memory: stores work preferences for Pro and Pro+ users in early access
Copilot can now store stated or inferred personal preferences about how you like to work — in early access for Pro and Pro+ users. Memory persists across sessions to deliver more consistent responses over time. Enterprise access will follow later.
Launch: Claude for Small Business — 15 pre-built agentic workflows
Anthropic launched Claude for Small Business on May 13: a packaged set of connectors, agentic workflows, and reusable skills. Includes 15 pre-built workflows across finance, operations, sales, marketing, HR, and customer service, with connectors for QuickBooks, PayPal, HubSpot, Canva, DocuSign, Google Workspace, and Microsoft 365. Accompanied by a 10-city US promotional tour offering free AI training workshops for 100 local business leaders at each stop.
Claude for Legal: 20+ MCP connectors and 12 plugins for law firms and legal departments
Anthropic announced on May 12 a suite of over 20 MCP connectors and 12 role-specific plugins designed to embed Claude directly into the workflows of law firms, corporate legal departments, and pro se litigants. A clear signal of a strategic shift from general-purpose chatbots to industry-specific AI tools.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Proprietary | New ChatGPT default model replacing GPT-5.3 Instant. 52.5% fewer hallucinated claims on high-stakes prompts (medicine, law, finance). Smarter, more concise, improved personalization controls. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Open | MoE models with 1M-token context window. V4 Pro: 1.6T parameters (49B active), largest open-weight model available. V4 Flash from $0.14/M input tokens ($0.28/M output). Claims to close the gap with closed frontier models on reasoning benchmarks. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Proprietary | OpenAI frontier model. Stronger multi-step reasoning, tool use, and coding. 35% less token quota than GPT-5.4 for equivalent quality output. Available in API from Apr 24. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Open | Dense open-weight model. 77.2% SWE-bench Verified, 59.3% Terminal-Bench 2.0 (matches Claude Opus 4.5). Outperforms 397B MoE models on agentic coding benchmarks. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Open | 1T-parameter MoE, 32B active, 262K-token context, modified MIT license. 58.6% SWE-Bench Pro (ties GPT-5.5), #1 on Humanity's Last Exam with tools (54.0%). 300-agent swarm system, native video input. Roughly 1/5 the cost of comparable closed models. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Proprietary | Preview with 256K-token context window. Ranks #1 on SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench, and SciCode — top of leaderboard on 6 coding and agentic task benchmarks. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | 64.3% SWE-bench Pro (new global #1), 87.6% SWE-bench Verified. Biggest single-version jump on SWE-bench Pro in 2026 (+10.9 pts from Opus 4.6). New xhigh effort level. Same pricing $5/$25 per MTok. |
| 2026-04-16 | Qwen3.6-35B-A3B | Alibaba/Qwen | A | Open | Qwen3.6 MoE variant: 35B total parameters, 3B active per token. High efficiency for local inference and deployment on constrained hardware. |
| 2026-04-08 | GLM-5.1 | Z.ai/Zhipu | A+ | Open | Open-source release on April 8. First shipped to subscribers in late March; open-sourced weeks later. Built on GLM-5 architecture (744B MoE, 40B active parameters). |
Notable Trends
Agentic development from the desktop is becoming the industry's central bet: the Copilot App (GitHub), Claude Code's Agent View, and Google Antigravity all point to the same paradigm — autonomous agents working in parallel while the developer supervises, not types. This week GitHub made the most concrete move with a native cross-platform app and cloud-isolated parallel sessions.
Anthropic is pivoting from horizontal tool to vertical platform. In a single week it shipped industry-specific bundles for small businesses and the legal sector — a signal that general-purpose AI is commoditizing and competition is now fought on integration depth, not base model capability.
The open-weight model war is intensifying: Kimi K2.6 ties GPT-5.5 on SWE-Bench Pro at roughly one-fifth the cost, and DeepSeek V4 Pro is now the largest open-weight model (1.6T parameters) with a 1M-token context window. Closed-source models no longer have a monopoly at the coding frontier.
v2.1.143: Enforcement des dépendances de plugins, coût de contexte projeté et worktree.bgIsolation
claude plugin disable refuse désormais si un autre plugin activé dépend de la cible, avec un indice copiable pour la chaîne de désactivation. Estimation du coût de contexte projeté (par tour et par invocation) ajoutée au panneau du marché /plugin. Nouveau paramètre worktree.bgIsolation: none permettant aux sessions en arrière-plan d'éditer directement la copie de travail sans EnterWorktree.
0.131.0-alpha: Cycle de développement alpha actif avec 22+ builds pre-release cette semaine
Le dépôt GitHub Codex montre une cadence de release intense: plus de 22 builds alpha pre-release depuis le 11 mai (alpha.6 jusqu'à alpha.22). Aucune note de release détaillée n'a été publiée pour cette période. Le canal stable reste à 0.130.x pendant que 0.131.0-alpha mûrit.
Google I/O 2026 demain (19-20 mai): grandes annonces Gemini attendues
Google I/O 2026 a lieu demain et mercredi. Des mises à jour majeures de Gemini Code Assist sont attendues, incluant potentiellement Gemini 3.x pour les développeurs, des améliorations du mode agent et des nouveautés pour Google Antigravity (l'IDE agentique lancé en novembre 2025, actuellement en prévisualisation publique). Les versions actuelles de Code Assist (VS Code 2.82.0 et IntelliJ 1.51.1) ne contiennent que des corrections de maintenance cette semaine.
Copilot App en Prévisualisation Technique: client de bureau autonome pour le développement agentique
La Copilot App — un client de bureau natif pour macOS, Windows et Linux — est disponible en prévisualisation technique pour les plans payants. Fonctionnalités clés: sessions parallèles avec leur propre worktree git et branche; interface de type Inbox affichant issues, PRs et CI checks entre dépôts; et trois modes de session. Les modèles sont configurables par organisation et les sessions s'exécutent côté cloud.
GPT-5.3-Codex remplace GPT-4.1 comme modèle de base dans Copilot Business et Enterprise
À partir du 17 mai, GPT-5.3-Codex est le nouveau modèle de base pour les complétions de code et le chat dans les plans Business et Enterprise — remplaçant GPT-4.1. C'est le même modèle spécialisé en coding qu'OpenAI a lancé sous le nom de Codex Spark, optimisé pour le suivi d'instructions et le développement logiciel.
Copilot Memory: mémorise les préférences de travail pour Pro et Pro+ en accès anticipé
Copilot peut désormais mémoriser les préférences personnelles déclarées ou inférées sur votre façon de travailler — en accès anticipé pour les utilisateurs Pro et Pro+. La mémoire persiste entre les sessions pour des réponses plus cohérentes dans le temps. L'accès Enterprise suivra plus tard.
Lancement: Claude pour les PME — 15 workflows agentiques préconfigurés
Anthropic a lancé Claude pour les PME le 13 mai: un ensemble de connecteurs, workflows agentiques et compétences réutilisables. Comprend 15 workflows préconfigurés pour la finance, les opérations, les ventes, le marketing, les RH et le service client, avec des connecteurs pour QuickBooks, PayPal, HubSpot, Canva, DocuSign, Google Workspace et Microsoft 365.
Claude pour le Juridique: 20+ connecteurs MCP et 12 plugins pour cabinets et services juridiques
Anthropic a annoncé le 12 mai une suite de plus de 20 connecteurs MCP et 12 plugins spécifiques par rôle pour intégrer Claude dans les flux de travail des cabinets d'avocats, des services juridiques d'entreprise et des plaideurs pro se. Signal d'un passage des chatbots généralistes aux outils d'IA spécifiques à l'industrie.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Propriétaire | Nouveau modèle par défaut de ChatGPT remplaçant GPT-5.3 Instant. 52,5% moins d'hallucinations sur les prompts à enjeux élevés. Plus concis, avec une meilleure personnalisation. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Ouvert | Modèles MoE avec fenêtre de contexte 1M tokens. V4 Pro: 1,6T paramètres (49B actifs), le plus grand modèle open-weight disponible. V4 Flash à partir de $0,14/M tokens en entrée. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propriétaire | Modèle frontier d'OpenAI. Meilleur raisonnement multi-étapes, utilisation d'outils et coding. 35% moins de tokens que GPT-5.4 pour une qualité équivalente. Disponible en API depuis le 24 avril. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Ouvert | Modèle dense open-weight. 77,2% SWE-bench Verified, 59,3% Terminal-Bench 2.0 (égale Claude Opus 4.5). Surpasse les modèles MoE de 397B sur les benchmarks de coding agentique. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Ouvert | MoE 1T paramètres, 32B actifs, contexte 262K tokens, licence MIT modifiée. 58,6% SWE-Bench Pro (égale GPT-5.5), #1 sur Humanity's Last Exam avec outils (54,0%). Système de 300 sous-agents, entrée vidéo native. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Propriétaire | Prévisualisation avec fenêtre de contexte 256K tokens. N°1 sur SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench et SciCode — 6 benchmarks de coding et tâches agentiques. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | 64,3% SWE-bench Pro (nouveau #1 mondial), 87,6% SWE-bench Verified. Plus grand saut single-version sur SWE-bench Pro en 2026 (+10,9 pts depuis Opus 4.6). Nouveau niveau d'effort xhigh. Prix: $5/$25 par MTok. |
| 2026-04-16 | Qwen3.6-35B-A3B | Alibaba/Qwen | A | Ouvert | Variante MoE de Qwen3.6: 35B paramètres totaux, 3B actifs par token. Haute efficacité pour l'inférence locale et le déploiement sur matériel contraint. |
| 2026-04-08 | GLM-5.1 | Z.ai/Zhipu | A+ | Ouvert | Sortie open-source le 8 avril. D'abord livré aux abonnés fin mars; open-sourcé quelques semaines plus tard. Basé sur l'architecture GLM-5 (744B MoE, 40B paramètres actifs). |
Tendances Notables
Le développement agentique depuis le bureau devient le pari central de l'industrie: la Copilot App (GitHub), l'Agent View de Claude Code et Google Antigravity pointent tous vers le même paradigme — des agents autonomes travaillant en parallèle pendant que le développeur supervise. Cette semaine, GitHub fait le pas le plus concret avec une app native multiplateforme et des sessions parallèles isolées dans le cloud.
Anthropic passe d'outil horizontal à plateforme verticale. En une seule semaine, il a lancé des bundles spécifiques pour les petites entreprises et le secteur juridique — signal que l'IA généraliste se commoditise et que la concurrence se joue désormais sur la profondeur d'intégration.
La guerre des modèles open-weight s'intensifie: Kimi K2.6 égale GPT-5.5 sur SWE-Bench Pro à environ un cinquième du coût, et DeepSeek V4 Pro est le plus grand modèle open-weight (1,6T paramètres) avec une fenêtre de contexte 1M tokens. Les modèles closed-source n'ont plus le monopole à la frontière du coding.