Brief IA para Developers — 20 de mayo de 2026
v2.1.145: claude agents --json y fallback de lectura parcial de archivos
claude agents --json habilita listar todas las sesiones activas en formato JSON para scripting y automatizacion. El atributo agent_id se añadio al rastreo de trazas para mejor depuracion de agentes. La herramienta Read ahora devuelve vistas parciales cuando un archivo excede el limite de tokens, en vez de fallar completamente. Correcciones: bypass de permisos en spans, problemas de entrada de voz y rastreo de estado de PRs.
v2.1.144: /resume para sesiones background y startup MCP más rápido
Las sesiones iniciadas con claude --bg o desde agent view ahora aparecen en el selector de /resume junto a las interactivas. Startup de MCP y SDK mas rapido. Corregidos: problemas de acceso completo al disco en macOS, paginacion de MCP y scroll en Windows. La version 2.1.143 (15 mayo) habia añadido cumplimiento de dependencias de plugins y estimaciones de costo de contexto en el marketplace, mas ajuste worktree.bgIsolation: none.
Codex CLI v0.132.0: auth Python SDK de primera clase y salida JSON estructurada
Autenticacion de primera clase en el Python SDK: flujos de login por clave API, ChatGPT browser y device-code. Turn APIs mejoradas para flujos solo-texto y automatizaciones reanudadas con soporte de salida JSON estructurada. El paquete Python SDK migra a openai-codex. La version anterior 0.131.0 (18 mayo) introdujo TUI enriquecida con controles de sesion, sistema unificado de menciones para archivos/directorios/plugins/skills y comandos de marketplace de plugins.
Gemini 3.5 Flash en GA: supera 3.1 Pro en benchmarks, 4x mas rápido
Anunciado en Google I/O 2026 (19 mayo), Gemini 3.5 Flash supera a Gemini 3.1 Pro en practicamente todos los benchmarks mientras corre cuatro veces mas rapido que modelos frontier comparables. Ya disponible en la app Gemini, Google Search y la API. Precio: $1.50/$9 por 1M tokens (entrada/salida), contexto de 1M tokens, 76.2% en Terminal-Bench 2.1. Gemini Spark — agente personal proactivo — llegara la semana que viene para suscriptores de Google AI Ultra ($100/mes con limites 5x mayores). Gemini 3.5 Pro esta en pruebas y se espera el mes siguiente.
Managed Agents en API de Gemini + Google AI Studio con soporte móvil nativo
Managed Agents en la API de Gemini permite lanzar agentes con razonamiento y uso de herramientas con un solo API call, en entornos Linux persistentes y aislados para sesiones multi-turno. Plantillas de agentes personalizados disponibles en el playground de Google AI Studio — ideal para flujos de codificacion agentica sin gestionar infraestructura. Google AI Studio añade: app movil (pre-registro disponible), soporte nativo Android con generacion de Kotlin/Jetpack Compose, exportacion directa a Antigravity y API de Google Workspace integrada.
Gemini 3.5 Flash disponible en Copilot + GPT-5.3-Codex reemplaza GPT-4.1 como base
Gemini 3.5 Flash ya esta disponible en todos los planes de GitHub Copilot, ofreciendo calidad de codificacion cercana a Pro con velocidad y costo de Flash. Desde el 17 de mayo, GPT-5.3-Codex reemplaza a GPT-4.1 como modelo base predeterminado para Copilot Business y Enterprise — con capacidades agenticas significativamente mejoradas y comprension de repositorios mas profunda. Ademas, Fix with Copilot ya esta disponible en revisiones de codigo: aplica sugerencias de revision directamente desde la interfaz de comentarios sin salir del diff.
Google Antigravity 2.0: nueva app desktop para creación de agentes en producción
Presentada en Google I/O 2026 (19 mayo), Google Antigravity 2.0 es la nueva aplicacion desktop de Google para desarrollo agente-first: unifica creacion de agentes con sub-agentes dinamicos, tareas programadas e integraciones con el ecosistema Google. Incluye una CLI y SDK de Antigravity para creacion ligera de agentes por linea de comandos o acceso programatico a la infraestructura. Señal estrategica clave: Google esta unificando Gemini Code Assist IDE Extensions y Gemini CLI (para individuos) en Antigravity a partir del 18 de junio de 2026. Los suscriptores de Google AI Ultra reciben $100 en creditos promocionales (expiran el 25 mayo).
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | S | Propietario | GA en Google I/O 2026. Supera Gemini 3.1 Pro en todos los benchmarks, 4x mas rapido. $1.50/$9 por 1M tokens. 76.2% en Terminal-Bench 2.1. | |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Propietario | Nuevo modelo predeterminado de ChatGPT (reemplaza GPT-5.3 Instant). 52.5% menos alucinaciones en prompts de alto riesgo. Mas conciso con mejor personalizacion. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Abierto | Dos variantes MoE con contexto de 1M tokens. V4-Pro: 1.6T parametros (49B activos), el open-weight mas grande disponible. V4-Flash desde $0.14/M tokens entrada. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propietario | Arquitectura base completamente reentrenada. 35% menos cuota de tokens que GPT-5.4 para calidad equivalente. Disponible en API desde el 24 de abril. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Abierto | Modelo denso open-weight. 77.2% SWE-bench Verified, 59.3% Terminal-Bench 2.0 (iguala Claude Opus 4.5). Supera modelos MoE de 397B en coding agentico. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Abierto | MoE 1T parametros, 32B activos, contexto 262K tokens, licencia MIT modificada. SWE-Bench Pro: 58.6%. La serie kimi-k2 original se depreca el 25 mayo 2026. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Propietario | Preview con contexto 256K tokens. N.1 en SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench y SciCode. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | Mayor salto en SWE-bench Pro de 2026: +10.9 puntos (53.4% a 64.3%). Modelo predeterminado del Fast mode en Claude Code. |
| 2026-04-08 | GLM-5.1 (Open Source) | Z.ai / Zhipu | A | Abierto | Version open-source de GLM-5.1. Basado en GLM-5 (744B MoE, 40B activos), contexto 200K tokens. Z.ai completo su IPO en Hong Kong en enero 2026. |
| 2026-02-19 | Gemini 3.1 Pro | S+ | Propietario | GPQA Diamond: 94.3%. 60% mas barato que Claude Opus 4.7 en input. Superado en velocidad por Gemini 3.5 Flash. | |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | S | Propietario | Potencia la app Doubao (155M WAU). Razonamiento complejo y ejecucion multi-paso al ~10x menor costo que GPT-5.2. |
| 2026-06-01 | Gemini 3.5 Pro | S+ | Próximo | En fase de pruebas. Lanzamiento previsto el proximo mes segun anuncio en Google I/O 2026. |
Tendencias Destacadas
Google I/O 2026 llego con un mensaje estrategico inequivoco para los desarrolladores: la plataforma de agentes ya no es un producto experimental — es la apuesta principal. Antigravity 2.0 unifica creacion de agentes, Managed Agents simplifica el acceso desde la API, y Gemini Spark lleva la capacidad proactiva al usuario final. La señal mas importante es la migracion forzada de Gemini Code Assist IDE Extensions y Gemini CLI hacia Antigravity a partir del 18 de junio: Google no quiere competir en el espacio de extensiones de editor, sino en el de plataformas de agentes completas.
Gemini 3.5 Flash siendo 4x mas rapido que modelos frontier comparables mientras supera a Gemini 3.1 Pro marca un punto de inflexion en la ecuacion velocidad-calidad. El precio — $1.50/$9 por 1M tokens — lo posiciona directamente contra los modelos Flash de Claude y los modelos mini de OpenAI. Si los 76.2% de Terminal-Bench 2.1 se sostienen en produccion, redistribuye el mapa de eleccion de modelos para flujos de codificacion agentica donde la latencia importa tanto como la precision.
La consolidacion de modelos en GitHub Copilot es significativa: GPT-5.3-Codex reemplazando a GPT-4.1 como base para Business y Enterprise, sumado a la llegada de Gemini 3.5 Flash, convierte a Copilot en un marketplace multi-modelo serio. El patron del mercado es claro: ninguna plataforma de coding puede depender de un solo proveedor de modelos — la capacidad de intercambiar backends rapidamente se vuelve ventaja competitiva. La presion sobre Cursor y Windsurf aumenta.
v2.1.145: claude agents --json and partial file read fallback
claude agents --json enables listing all active sessions in JSON format for scripting and automation. The agent_id attribute was added to trace tracking for better agent debugging. The Read tool now returns partial views when a file exceeds the token limit, instead of failing entirely. Fixes: span permission bypass, voice input issues, and PR state tracking.
v2.1.144: /resume for background sessions and faster MCP startup
Sessions started with claude --bg or from agent view now appear in the /resume picker alongside interactive sessions. Faster MCP and SDK startup. Fixed: macOS Full Disk Access issues, MCP pagination, and scrolling on Windows. v2.1.143 (May 15) had added plugin dependency enforcement, context cost estimates in the plugin marketplace, and the worktree.bgIsolation: none setting.
Codex CLI v0.132.0: first-class Python SDK auth and structured JSON output
First-class authentication in the Python SDK: API key login, ChatGPT browser, and device-code flows. Enhanced turn APIs for text-only workflows and resumed automations with structured JSON output support. Python SDK migrates to the openai-codex package. Previous v0.131.0 (May 18) added richer TUI session controls, unified mentions system for files/dirs/plugins/skills, and plugin marketplace commands.
Gemini 3.5 Flash goes GA: beats 3.1 Pro on benchmarks, 4x faster
Announced at Google I/O 2026 (May 19), Gemini 3.5 Flash surpasses Gemini 3.1 Pro across nearly all benchmarks while running four times faster than comparable frontier models. Now available in the Gemini app, Google Search, and the API. Pricing: $1.50/$9 per 1M tokens (in/out), 1M-token context, 76.2% on Terminal-Bench 2.1. Gemini Spark — a proactive personal agent — arrives next week for Google AI Ultra subscribers ($100/month with 5x higher limits). Gemini 3.5 Pro is in testing and arrives next month.
Managed Agents in Gemini API + Google AI Studio with native mobile support
Managed Agents in the Gemini API lets you launch reasoning agents with tool use via a single API call, in persistent isolated Linux environments for multi-turn sessions. Custom agent templates available in the Google AI Studio playground — ideal for agentic coding workflows without managing execution infrastructure. Google AI Studio adds: mobile app (pre-registration available), native Android support with Kotlin/Jetpack Compose code generation, direct Antigravity export, and integrated Google Workspace API.
Gemini 3.5 Flash available in Copilot + GPT-5.3-Codex replaces GPT-4.1 as base
Gemini 3.5 Flash is now available across all GitHub Copilot plans, delivering near-Pro coding quality at Flash-tier speed and cost. Since May 17, GPT-5.3-Codex has replaced GPT-4.1 as the default base model for Copilot Business and Enterprise — with significantly improved agentic capabilities and deeper repository understanding. Additionally, Fix with Copilot is now available in code reviews: apply review suggestions directly from the comment interface without leaving the diff view.
Google Antigravity 2.0: new desktop app for production agent development
Unveiled at Google I/O 2026 (May 19), Google Antigravity 2.0 is Google's new desktop application for agent-first development: it unifies agent creation with dynamic sub-agents, scheduled tasks, and Google ecosystem integrations. Includes an Antigravity CLI and SDK for lightweight agent creation from the command line or programmatic infrastructure access. Key strategic signal: Google is unifying Gemini Code Assist IDE Extensions and Gemini CLI (for individuals) into Antigravity starting June 18, 2026. Google AI Ultra subscribers receive $100 in promotional credits (expiring May 25).
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | S | Proprietary | GA at Google I/O 2026. Outperforms Gemini 3.1 Pro across all benchmarks, 4x faster output. $1.50/$9 per 1M tokens. 76.2% Terminal-Bench 2.1. | |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Proprietary | New ChatGPT default model replacing GPT-5.3 Instant. 52.5% fewer hallucinated claims on high-stakes prompts. Smarter, more concise, improved personalization. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Open | Two MoE variants with 1M-token context. V4-Pro: 1.6T parameters (49B active), largest open-weight available. V4-Flash from $0.14/M input tokens. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Proprietary | Fully retrained base architecture. 35% less token quota than GPT-5.4 for equivalent quality. Available in API from Apr 24. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Open | Dense open-weight model. SWE-bench Verified: 77.2%, Terminal-Bench 2.0: 59.3% (matches Claude Opus 4.5). Outperforms 397B MoE models on agentic coding benchmarks. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Open | 1T-parameter MoE, 32B active, 262K-token context, modified MIT license. SWE-Bench Pro: 58.6%. Original kimi-k2 series deprecated May 25, 2026. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Proprietary | Preview with 256K-token context window. Ranks #1 on SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench, and SciCode. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | Biggest SWE-bench Pro jump of 2026: +10.9 points (53.4% to 64.3%). Default model for Claude Code Fast mode. |
| 2026-04-08 | GLM-5.1 (Open Source) | Z.ai / Zhipu | A | Open | Open-source release of GLM-5.1. Based on GLM-5 (744B MoE, 40B active), 200K-token context. Z.ai completed its Hong Kong IPO in Jan 2026. |
| 2026-02-19 | Gemini 3.1 Pro | S+ | Proprietary | GPQA Diamond: 94.3%. 60% cheaper than Claude Opus 4.7 on input pricing. Now outpaced in speed by Gemini 3.5 Flash. | |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | S | Proprietary | Powers the Doubao app (155M weekly active users). Complex reasoning and multi-step execution at roughly 10x lower cost than GPT-5.2. |
| 2026-06-01 | Gemini 3.5 Pro | S+ | Upcoming | Currently in testing phase. Launch expected next month per Google I/O 2026 announcement. |
Notable Trends
Google I/O 2026 delivered an unambiguous strategic message to developers: the agent platform is no longer experimental — it is the main bet. Antigravity 2.0 unifies agent creation, Managed Agents simplifies API-level access, and Gemini Spark brings proactive capability to end users. The most important signal is the forced migration of Gemini Code Assist IDE Extensions and Gemini CLI into Antigravity starting June 18: Google is not trying to compete in the editor extension space, but in the full agent platform space.
Gemini 3.5 Flash being 4x faster than comparable frontier models while outperforming Gemini 3.1 Pro marks an inflection point in the speed-quality equation. Pricing at $1.50/$9 per 1M tokens positions it directly against Claude Flash models and OpenAI mini models. If the 76.2% Terminal-Bench 2.1 score holds in production, it reshuffles the model-selection map for agentic coding workflows where latency matters as much as accuracy.
The model consolidation in GitHub Copilot is significant: GPT-5.3-Codex replacing GPT-4.1 as the base for Business and Enterprise, combined with Gemini 3.5 Flash availability, turns Copilot into a serious multi-model marketplace. The market pattern is clear: no coding platform can afford to depend on a single model provider — the ability to swap backends quickly becomes a competitive advantage. Pressure on Cursor and Windsurf increases.
v2.1.145 : claude agents --json et fallback de lecture partielle de fichiers
claude agents --json permet de lister toutes les sessions actives en JSON pour le scripting. L'attribut agent_id a ete ajoute au suivi des traces. L'outil Read retourne maintenant des vues partielles quand un fichier depasse la limite de tokens. Corrections: bypass de permissions, entree vocale et suivi d'etat des PRs.
v2.1.144 : /resume pour les sessions en arriere-plan et demarrage MCP plus rapide
Les sessions demarrees avec claude --bg ou depuis agent view apparaissent maintenant dans le selecteur /resume. Demarrage MCP et SDK plus rapide. Corrections: macOS Full Disk Access, pagination MCP et defilement Windows. La v2.1.143 (15 mai) avait ajoute l'application des dependances de plugins et les estimations de cout de contexte.
Codex CLI v0.132.0 : auth Python SDK de premiere classe et sortie JSON structuree
Authentification de premiere classe dans le SDK Python: cle API, ChatGPT browser et device-code. APIs de tour ameliorees avec sortie JSON structuree. Migration du SDK Python vers le paquet openai-codex. La v0.131.0 (18 mai) avait ajoute un TUI enrichi, un systeme de mentions unifie et des commandes de marketplace de plugins.
Gemini 3.5 Flash en GA : surpasse 3.1 Pro sur les benchmarks, 4x plus rapide
Annonce a Google I/O 2026 (19 mai), Gemini 3.5 Flash surpasse Gemini 3.1 Pro sur presque tous les benchmarks, 4x plus rapide. Disponible dans l'app Gemini, Google Search et l'API. Prix: $1,50/$9 par 1M tokens, contexte 1M tokens, 76,2% Terminal-Bench 2.1. Gemini Spark arrive la semaine prochaine pour Google AI Ultra ($100/mois).
Managed Agents dans l'API Gemini + Google AI Studio avec support mobile natif
Managed Agents dans l'API Gemini permet de lancer des agents avec raisonnement en un seul appel API, dans des environnements Linux persistants. Templates d'agents personnalises dans Google AI Studio. Google AI Studio ajoute: app mobile, support Android natif avec Kotlin/Jetpack Compose, export Antigravity et API Google Workspace integree.
Gemini 3.5 Flash disponible dans Copilot + GPT-5.3-Codex remplace GPT-4.1 comme base
Gemini 3.5 Flash est maintenant disponible dans tous les plans Copilot. Depuis le 17 mai, GPT-5.3-Codex remplace GPT-4.1 comme modele de base pour Copilot Business et Enterprise. Fix with Copilot est aussi disponible dans les revisions de code pour appliquer les suggestions directement depuis l'interface de commentaires.
Google Antigravity 2.0 : nouvelle app desktop pour le developpement d'agents en production
Presentee a Google I/O 2026 (19 mai), Google Antigravity 2.0 est la nouvelle app desktop de Google pour le developpement agent-first: elle unifie la creation d'agents avec sous-agents dynamiques, taches planifiees et integrations ecosysteme Google. Inclut une CLI et SDK Antigravity. Signal strategique: Google unifie Gemini Code Assist IDE Extensions et Gemini CLI dans Antigravity a partir du 18 juin 2026.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | S | Propriétaire | GA a Google I/O 2026. Surpasse Gemini 3.1 Pro sur tous les benchmarks, 4x plus rapide. $1,50/$9 par 1M tokens. 76,2% Terminal-Bench 2.1. | |
| 2026-05-05 | GPT-5.5 Instant | OpenAI | S | Propriétaire | Nouveau modele par defaut de ChatGPT. 52,5% moins d'hallucinations sur les prompts a enjeux eleves. Plus concis, meilleure personnalisation. |
| 2026-04-24 | DeepSeek V4 Flash / V4 Pro | DeepSeek | S | Ouvert | Deux variantes MoE, contexte 1M tokens. V4-Pro: 1,6T parametres (49B actifs). V4-Flash a partir de $0,14/M tokens. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propriétaire | Architecture entierement reentrainee. 35% moins de tokens que GPT-5.4. Disponible en API depuis le 24 avril. |
| 2026-04-22 | Qwen3.6-27B | Alibaba/Qwen | A+ | Ouvert | Modele dense open-weight. SWE-bench Verified: 77,2%, Terminal-Bench 2.0: 59,3%. Surpasse les modeles MoE de 397B en coding agentique. |
| 2026-04-20 | Kimi K2.6 | Moonshot/Kimi | S+ | Ouvert | MoE 1T parametres, 32B actifs, contexte 262K tokens, licence MIT modifiee. SWE-Bench Pro: 58,6%. Serie kimi-k2 originale deprecated le 25 mai 2026. |
| 2026-04-20 | Qwen3.6-Max Preview | Alibaba/Qwen | S | Propriétaire | Apercu avec contexte 256K tokens. N.1 sur SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenWebBench et SciCode. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | Plus grand saut SWE-bench Pro de 2026: +10,9 points (53,4% vers 64,3%). Modele par defaut du Fast mode Claude Code. |
| 2026-04-08 | GLM-5.1 (Open Source) | Z.ai / Zhipu | A | Ouvert | Version open-source de GLM-5.1. Base sur GLM-5 (744B MoE, 40B actifs), contexte 200K tokens. Z.ai a realise son IPO a Hong Kong en jan. 2026. |
| 2026-02-19 | Gemini 3.1 Pro | S+ | Propriétaire | GPQA Diamond: 94,3%. 60% moins cher que Claude Opus 4.7 en entree. Desormais depasse en vitesse par Gemini 3.5 Flash. | |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | S | Propriétaire | Alimente l'app Doubao (155M utilisateurs hebdomadaires). Raisonnement complexe a environ 10x moins cher que GPT-5.2. |
| 2026-06-01 | Gemini 3.5 Pro | S+ | À venir | En phase de test. Lancement prevu le mois prochain selon l'annonce de Google I/O 2026. |
Tendances Notables
Google I/O 2026 a envoye un message strategique inequivoque aux developpeurs: la plateforme d'agents n'est plus experimentale — c'est le pari principal. Antigravity 2.0 unifie la creation d'agents, Managed Agents simplifie l'acces API, et Gemini Spark apporte des capacites proactives aux utilisateurs finaux. Le signal le plus important est la migration forcee de Gemini Code Assist et Gemini CLI vers Antigravity a partir du 18 juin: Google ne veut pas concourir dans les extensions d'editeur, mais dans les plateformes d'agents completes.
Gemini 3.5 Flash etant 4x plus rapide tout en surpassant Gemini 3.1 Pro marque un point d'inflexion dans l'equation vitesse-qualite. Le prix — $1,50/$9 par 1M tokens — le positionne directement contre les modeles Flash de Claude et mini d'OpenAI. Si les 76,2% de Terminal-Bench 2.1 tiennent en production, cela redistribue la carte de selection de modeles pour le coding agentique.
La consolidation des modeles dans GitHub Copilot est significative: GPT-5.3-Codex remplacant GPT-4.1 comme base pour Business et Enterprise, combine a Gemini 3.5 Flash, transforme Copilot en un vrai marketplace multi-modele. Le pattern du marche est clair: aucune plateforme de coding ne peut dependre d'un seul fournisseur de modeles — la capacite a switcher rapidement devient un avantage concurrentiel.