Brief IA para Developers — 21 de mayo de 2026
v2.1.146: /code-review reemplaza /simplify + correcciones críticas de MCP y PowerShell
El comando /simplify fue renombrado a /code-review y acepta un nivel de esfuerzo opcional (por ejemplo /code-review high). Correcciones importantes: el error command line is invalid en PowerShell de Windows (regresión desde v2.1.124), paginación de MCP que descartaba items a partir de la página 2, y parpadeo de pantalla completa en sesiones en background de Windows Terminal. El renderizado de diffs mejora en rendimiento para ediciones de archivos grandes. El auto-actualizador ahora reintenta en fallos transitorios.
OpenAI + Dell: Codex llega a entornos empresariales on-premise e híbridos
OpenAI y Dell Technologies anunciaron el 18 de mayo una colaboración para desplegar Codex en los entornos donde viven los datos empresariales más críticos. Codex se integrará con el Dell AI Data Platform (infraestructura on-premise) y el Dell AI Factory para cargas de trabajo de IA — permitiendo preparar datos, gestionar sistemas de registro, ejecutar tests y desplegar aplicaciones integradas con infraestructura híbrida o local. Con más de 4 millones de desarrolladores usando Codex semanalmente, OpenAI expande Codex más allá del coding hacia preparación de reportes, ruteo de feedback de producto y coordinación de trabajo entre sistemas de negocio.
Recordatorio: migración a Antigravity — Gemini CLI y Code Assist IDE cierran el 18 jun
Las extensiones IDE de Gemini Code Assist y la Gemini CLI para cuentas individuales, Google AI Pro y Google AI Ultra dejarán de procesar solicitudes el 18 de junio de 2026. Google está unificando estas herramientas en Antigravity, su nueva plataforma desktop agent-first presentada en Google I/O 2026. Quienes usen gemini CLI o las extensiones de VS Code/IntelliJ bajo plan individual deben migrar a Antigravity o a Antigravity CLI antes de esa fecha. Las cuentas Enterprise y Business no se ven afectadas por este cambio.
Auto mode en VS Code: enrutamiento de modelos por tipo de tarea y salud del sistema
La selección automática de modelos en VS Code ahora usa métricas de utilización y salud para enrutar cada turno al modelo óptimo según el tipo de tarea — código largo frente a chat corto, razonamiento frente a completación rápida. El sistema elige dinámicamente sin intervención del usuario y registra qué modelo fue seleccionado en cada turno para depuración.
Copilot Chat: búsqueda semántica de issues con lenguaje natural
Copilot Chat ya incluye búsqueda semántica de issues: describí en lenguaje natural qué problema estás buscando y Copilot encuentra issues relevantes con resultados contextuales. Va más allá de la búsqueda por palabras clave — entiende el intent y relaciona issues similares aunque usen terminología diferente. Disponible en Copilot Chat del repositorio y del pull request.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | S | Propietario | GA en Google I/O 2026. Supera Gemini 3.1 Pro en todos los benchmarks, 4x más rápido. $1.50/$9 por 1M tokens. 76.2% en Terminal-Bench 2.1. | |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Propietario | Nuevo modelo predeterminado de ChatGPT (reemplaza GPT-5.3 Instant). 52.5% menos alucinaciones en prompts de alto riesgo. Más conciso con mejor personalización. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Abierto | Dos variantes MoE con contexto de 1M tokens. V4-Pro: 1.6T parámetros (49B activos), el open-weight más grande disponible. V4-Flash desde $0.14/M tokens entrada. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propietario | Arquitectura base completamente reentrenada. 35% menos cuota de tokens que GPT-5.4 para calidad equivalente. Disponible en API desde el 24 de abril. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Abierto | Modelo denso open-weight. 77.2% SWE-bench Verified, 59.3% Terminal-Bench 2.0. Supera modelos MoE de 397B en coding agéntico. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Abierto | MoE 1T parámetros, 32B activos, contexto 262K tokens, licencia MIT modificada. SWE-Bench Pro: 58.6%. Serie kimi-k2 original se depreca el 25 mayo 2026. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Propietario | Preview con contexto 256K tokens. N.1 en SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench y SciCode. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | Mayor salto en SWE-bench Pro de 2026: +10.9 puntos (53.4% → 64.3%). Modelo predeterminado del Fast mode en Claude Code. |
| 2026-04-08 | GLM-5.1 (Open Source) | Z.ai / Zhipu | A | Abierto | Versión open-source de GLM-5.1. Basado en GLM-5 (744B MoE, 40B activos), contexto 200K tokens. Z.ai completó su IPO en Hong Kong en enero 2026. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | S | Propietario | Familia de modelos fundacionales con 4 variantes (Pro/Lite/Mini/Code). Seed 2.0 Pro: 98.3% AIME 2025, 3020 Codeforces. ~3.7x más barato que GPT-5.2 en input. |
| 2026-Q3 | Gemini 3.5 Pro | S+ | Próximo | En pruebas internas. Anunciado en Google I/O 2026 como próxima entrega de la familia Gemini 3.5. |
Tendencias Destacadas
Claude Code mantiene una cadencia de publicación sin precedentes: 5 releases en 7 días (v2.1.142 a v2.1.146), con el release de hoy centrado en calidad de vida del desarrollador — la transición de /simplify a /code-review con niveles de esfuerzo y correcciones críticas de regresión para usuarios de Windows y MCP.
OpenAI está reposicionando Codex como plataforma empresarial general: la asociación con Dell —que lleva Codex a infraestructura on-premise y centros de datos híbridos— señala que OpenAI quiere que Codex maneje flujos de trabajo completos de negocio (reportes, ruteo de feedback, coordinación entre sistemas), no solo tareas de coding.
GitHub Copilot entregó 8+ entradas de changelog en 3 días durante la semana de Google I/O, con enrutamiento de modelos basado en tareas en VS Code y búsqueda semántica de issues que muestran una madurez creciente en orquestación multi-modelo. La fecha límite del 18 de junio para migrar de Gemini CLI a Antigravity crea una ventana de 4 semanas de acción inmediata para los desarrolladores que usen las herramientas individuales de Google.
v2.1.146: /code-review replaces /simplify + critical MCP and PowerShell fixes
The /simplify command is renamed to /code-review and accepts an optional effort level (e.g. /code-review high). Notable fixes: Windows PowerShell command line is invalid error (regression since v2.1.124), MCP pagination dropping items past page 1, and full-screen strobing in Windows Terminal background sessions. Improved diff rendering performance for large file edits. Auto-updater now retries on transient failures.
OpenAI + Dell: Codex arrives in enterprise on-premises and hybrid environments
OpenAI and Dell Technologies announced on May 18 a partnership to deploy Codex in environments where critical enterprise data already lives. Codex will connect with the Dell AI Data Platform (on-premises infrastructure) and the Dell AI Factory for AI workloads — letting Codex prepare data, manage systems of record, run tests, and deploy applications integrated with hybrid or on-premises infrastructure. With more than 4 million developers using Codex weekly, OpenAI is expanding Codex beyond coding into report preparation, product feedback routing, and cross-business-system coordination.
Migration reminder: Antigravity cutover — Gemini CLI and Code Assist IDE end Jun 18
The Gemini Code Assist IDE extensions and Gemini CLI for individuals, Google AI Pro, and Google AI Ultra tiers will stop serving requests on June 18, 2026. Google is unifying these tools into Antigravity, its new agent-first desktop platform announced at Google I/O 2026. Developers using the gemini CLI or the VS Code/IntelliJ extensions under individual plans must migrate to Antigravity or the Antigravity CLI before that date. Enterprise and Business accounts are not affected by this change.
Auto mode in VS Code: model routing by task type and system health
Auto model selection in VS Code now uses utilization and health metrics to route each turn to the optimal model based on task type — long code generation vs. short chat, reasoning vs. fast completion. The system selects dynamically without user intervention and logs which model was chosen per turn for debugging.
Copilot Chat: natural language semantic issue search
Copilot Chat now includes semantic issue search: describe what problem you're looking for in natural language and Copilot finds relevant issues with context-aware results. Goes beyond keyword search — understands intent and surfaces related issues even when they use different terminology. Available in repository and pull request Copilot Chat.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | S | Proprietary | GA at Google I/O 2026. Outperforms Gemini 3.1 Pro across all benchmarks, 4x faster output. $1.50/$9 per 1M tokens. 76.2% Terminal-Bench 2.1. | |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Proprietary | New ChatGPT default model replacing GPT-5.3 Instant. 52.5% fewer hallucinated claims on high-stakes prompts. Smarter, more concise, improved personalization. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Open | Two MoE variants with 1M-token context. V4-Pro: 1.6T parameters (49B active), largest open-weight available. V4-Flash from $0.14/M input tokens. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Proprietary | Fully retrained base architecture. 35% less token quota than GPT-5.4 for equivalent quality. Available in API from Apr 24. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Open | Dense open-weight model. SWE-bench Verified: 77.2%, Terminal-Bench 2.0: 59.3% (matches Claude Opus 4.5). Outperforms 397B MoE models on agentic coding. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Open | 1T-parameter MoE, 32B active, 262K-token context, modified MIT license. SWE-Bench Pro: 58.6%. Original kimi-k2 series deprecated May 25, 2026. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Proprietary | Preview with 256K-token context window. Ranks #1 on SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench, and SciCode. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | Biggest SWE-bench Pro jump of 2026: +10.9 points (53.4% to 64.3%). Default model for Claude Code Fast mode. |
| 2026-04-08 | GLM-5.1 (Open Source) | Z.ai / Zhipu | A | Open | Open-source release of GLM-5.1. Based on GLM-5 (744B MoE, 40B active), 200K-token context. Z.ai completed its Hong Kong IPO in Jan 2026. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | S | Proprietary | Foundation model family with 4 variants (Pro/Lite/Mini/Code). Seed 2.0 Pro: 98.3% AIME 2025, 3020 Codeforces rating. ~3.7x cheaper than GPT-5.2 on input. |
| 2026-Q3 | Gemini 3.5 Pro | S+ | Upcoming | In internal testing. Announced at Google I/O 2026 as the next release in the Gemini 3.5 family. |
Notable Trends
Claude Code is maintaining an unprecedented shipping cadence: 5 releases in 7 days (v2.1.142 to v2.1.146), with today's release focused on developer quality-of-life — the /simplify to /code-review rename with effort levels and critical regression fixes for Windows and MCP users.
OpenAI is repositioning Codex as a general enterprise platform: the Dell partnership — bringing Codex to on-premises infrastructure and hybrid data centers — signals that OpenAI wants Codex handling full business workflows (reporting, feedback routing, cross-system coordination), not just coding tasks.
GitHub Copilot delivered 8+ changelog entries in 3 days during Google I/O week, with task-based model routing in VS Code and semantic issue search showing growing multi-model orchestration maturity. The June 18 deadline to migrate from Gemini CLI to Antigravity creates a 4-week immediate action window for developers using Google's individual-tier tools.
v2.1.146 : /code-review remplace /simplify + corrections critiques MCP et PowerShell
La commande /simplify est renommée /code-review et accepte un niveau d'effort optionnel (ex. /code-review high). Corrections notables: erreur PowerShell Windows command line is invalid (régression depuis v2.1.124), pagination MCP perdant des items après la page 1, et clignotement plein écran dans les sessions background de Windows Terminal. Performances de rendu des diffs améliorées pour les grandes modifications.
OpenAI + Dell : Codex arrive en entreprise on-premises et hybride
OpenAI et Dell Technologies ont annoncé le 18 mai un partenariat pour déployer Codex dans les environnements où vivent les données critiques des entreprises. Codex s'intégrera au Dell AI Data Platform et au Dell AI Factory. Avec plus de 4 millions de développeurs utilisant Codex chaque semaine, OpenAI étend Codex au-delà du coding vers la préparation de rapports et la coordination entre systèmes d'entreprise.
Rappel migration : coupure vers Antigravity — Gemini CLI et Code Assist IDE ferment le 18 juin
Les extensions IDE Gemini Code Assist et la Gemini CLI pour les comptes individuels, Google AI Pro et Google AI Ultra cesseront de traiter des requêtes le 18 juin 2026. Google unifie ces outils dans Antigravity, sa nouvelle plateforme desktop agent-first annoncée à Google I/O 2026. Les développeurs utilisant la CLI gemini ou les extensions VS Code/IntelliJ sous plans individuels doivent migrer avant cette date. Les comptes Enterprise et Business ne sont pas affectés.
Auto mode dans VS Code : routage des modèles par type de tâche et santé système
La sélection automatique de modèles dans VS Code utilise maintenant des métriques d'utilisation et de santé pour router chaque tour vers le modèle optimal selon le type de tâche — génération de code longue vs. chat court, raisonnement vs. complétion rapide. Le système sélectionne dynamiquement sans intervention de l'utilisateur.
Copilot Chat : recherche sémantique d'issues en langage naturel
Copilot Chat inclut maintenant une recherche sémantique d'issues : décrivez en langage naturel ce que vous cherchez et Copilot trouve les issues pertinentes avec des résultats contextuels. Va au-delà de la recherche par mots-clés — comprend l'intention et trouve les issues similaires. Disponible dans le chat Copilot du dépôt et des pull requests.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | S | Propriétaire | GA à Google I/O 2026. Surpasse Gemini 3.1 Pro sur tous les benchmarks, 4x plus rapide. $1,50/$9 par 1M tokens. 76,2% Terminal-Bench 2.1. | |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Propriétaire | Nouveau modèle par défaut de ChatGPT. 52,5% moins d'hallucinations sur les prompts à enjeux élevés. Plus concis, meilleure personnalisation. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Ouvert | Deux variantes MoE, contexte 1M tokens. V4-Pro: 1,6T paramètres (49B actifs). V4-Flash à partir de $0,14/M tokens. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propriétaire | Architecture entièrement ré-entraînée. 35% moins de tokens que GPT-5.4. Disponible en API depuis le 24 avril. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Ouvert | Modèle dense open-weight. SWE-bench Verified: 77,2%, Terminal-Bench 2.0: 59,3%. Surpasse les MoE 397B en coding agentique. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Ouvert | MoE 1T paramètres, 32B actifs, contexte 262K tokens, licence MIT modifiée. SWE-Bench Pro: 58,6%. Série kimi-k2 originale deprecated le 25 mai 2026. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Propriétaire | Aperçu avec contexte 256K tokens. N.1 sur SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench et SciCode. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | Plus grand saut SWE-bench Pro de 2026: +10,9 points (53,4% → 64,3%). Modèle par défaut du Fast mode Claude Code. |
| 2026-04-08 | GLM-5.1 (Open Source) | Z.ai / Zhipu | A | Ouvert | Version open-source de GLM-5.1. Basé sur GLM-5 (744B MoE, 40B actifs), contexte 200K tokens. Z.ai a réalisé son IPO à Hong Kong en jan. 2026. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | S | Propriétaire | Famille de modèles fondamentaux avec 4 variantes. Seed 2.0 Pro: 98,3% AIME 2025, 3020 Codeforces. ~3,7x moins cher que GPT-5.2 en entrée. |
| 2026-Q3 | Gemini 3.5 Pro | S+ | À venir | En tests internes. Annoncé à Google I/O 2026 comme prochaine livraison de la famille Gemini 3.5. |
Tendances Notables
Claude Code maintient une cadence de publication sans précédent: 5 releases en 7 jours (v2.1.142 à v2.1.146), avec la release d'aujourd'hui centrée sur la qualité de vie du développeur — le renommage de /simplify en /code-review avec niveaux d'effort et des corrections de régressions critiques pour les utilisateurs Windows et MCP.
OpenAI repositionne Codex comme plateforme d'entreprise générale: le partenariat Dell — amenant Codex dans les infrastructures on-premises et les data centers hybrides — signale qu'OpenAI veut que Codex gère des flux de travail d'entreprise complets, pas seulement des tâches de coding.
GitHub Copilot a livré 8+ entrées de changelog en 3 jours pendant la semaine Google I/O, avec le routage de modèles par tâche dans VS Code et la recherche sémantique d'issues montrant une maturité croissante en orchestration multi-modèles. La date limite du 18 juin pour migrer de Gemini CLI vers Antigravity crée une fenêtre d'action immédiate de 4 semaines pour les développeurs utilisant les outils individuels de Google.