AI Coding Tools Daily Brief — May 25, 2026
v2.1.149: Insights de uso por categoria y navegacion diff por teclado
El nuevo panel muestra el desglose de uso por skills, subagentes, plugins y servidores MCP. La navegacion de diff ahora responde a j/k, flechas, PgUp/PgDn, Space, Home/End. Las listas de tareas Markdown renderizan checkboxes GFM en lugar de bullets planos. Nueva configuracion enterprise para conectores MCP de Claude.ai cloud.
v2.1.147: Sesiones de fondo ancladas y /code-review con reporte de esfuerzo
Las sesiones de fondo ancladas permanecen activas en reposo y se reinician automaticamente para aplicar actualizaciones. El comando /simplify pasa a llamarse /code-review con reporte de nivel de esfuerzo. Mejoras en rendimiento de diff para archivos grandes y extensas correcciones de terminal y Windows/PowerShell.
Anthropic adquiere Stainless por mas de $300M
Stainless — la startup que automatiza la creacion y mantenimiento de SDKs, usada por OpenAI, Google y Cloudflare — pasa a ser parte de Anthropic. La empresa cerrara sus productos alojados (generador de SDKs) pero los clientes conservan los SDKs generados con todos los derechos. Stainless ya potenciaba todos los SDKs oficiales de Anthropic desde los primeros dias de la API.
Project Glasswing: 10,000+ vulnerabilidades criticas en 1 mes con Claude Mythos Preview
La primera actualizacion de Glasswing revela que ~50 socios usando Claude Mythos Preview (modelo no publicado optimizado para descubrimiento de vulnerabilidades) encontraron mas de 10,000 bugs criticos en un mes. Cloudflare encontro ~2,000 bugs (400 criticos) con menos falsos positivos que el testing manual. Mozilla identifico 271 vulnerabilidades en Firefox 150. De 23,019 issues totales en proyectos open-source, el 90.6% de los clasificados como criticos fueron confirmados por firmas de seguridad independientes. Anthropic advierte que ningun empresa tiene aun salvaguardas para el uso malicioso de modelos con capacidades Mythos.
Goal Mode ahora es GA en app, IDE y CLI
Goal mode sale de la fase experimental. Codex puede trabajar durante horas o dias hasta alcanzar un objetivo especifico en el entorno de desarrollo. Disponible en la app Codex, extension de IDE y CLI.
codex doctor: diagnosticos completos de entorno para soporte
Nuevo comando codex doctor ejecuta diagnosticos completos de runtime, auth, terminal, red, configuracion y estado local — generando un reporte listo para enviar a soporte y facilitar el debugging de entorno.
Codex puede operar el navegador integrado para servidores de desarrollo locales
La app Codex ahora puede operar su navegador integrado para paginas locales y servidores de desarrollo. Permite reproducir bugs visuales, verificar fixes locales y hacer click en UIs renderizadas sin salir del entorno de desarrollo. Util para development-loop workflows.
GPT-5.5 Instant es el nuevo modelo por defecto en ChatGPT
GPT-5.5 Instant reemplaza a GPT-5.3 Instant como modelo por defecto para todos los usuarios. Mejor precision, respuestas mas concisas, busqueda web mejorada, ayuda con STEM e imagenes, y mayor contexto para usuarios Plus y Pro en web. GPT-5.5 Pro y GPT-5.5 Thinking disponibles en planes de pago.
Verificacion de contenido: C2PA + watermarking SynthID en imagenes generadas
OpenAI habilita senales de procedencia C2PA para que otras plataformas identifiquen el origen del contenido generado por IA. Ademas, integra el watermarking SynthID de Google en imagenes — una colaboracion inter-lab para verificacion cruzada de contenido IA. Se incluye herramienta publica para verificar si imagenes provienen de OpenAI.
Gemini 3.5 Flash GA — supera a Gemini 3.1 Pro a 4x velocidad
Lanzado en Google I/O 2026, Gemini 3.5 Flash supera a Gemini 3.1 Pro en casi todos los benchmarks mientras corre 4x mas rapido. Terminal-Bench 2.1: 76.2%, GDPval-AA Elo: 1656, MCP Atlas: 83.6%, CharXiv: 84.2%. Precio: $1.50/$9 por 1M tokens. Contexto: 1M tokens. Disponible globalmente en Gemini app, AI Studio, Antigravity y Code Assist. Gemini 3.5 Pro en pruebas — llega el proximo mes.
Antigravity 2.0 — app de escritorio + CLI para workflows de agentes
Antigravity 2.0 es la nueva app de escritorio de Google para interaccion con agentes: subagentes dinamicos, tareas programadas en background, sandboxing cross-platform, enmascaramiento de credenciales y politicas de Git reforzadas. El nuevo Antigravity CLI + SDK permite crear agentes desde linea de comandos con infraestructura optimizada para Gemini. Aviso: Gemini Code Assist IDE para individuos migra a Antigravity el 18 de junio de 2026.
Managed Agents en Gemini API + Google AI Ultra ($100/mes) + Android Studio nativo
La nueva Interactions API permite desplegar agentes con razonamiento, uso de herramientas y ejecucion de codigo en entornos aislados con una sola llamada. Google AI Studio gana soporte nativo para apps Android: codigo Kotlin con Jetpack Compose, emulador en navegador y publicacion directa a Google Play. Nuevo plan Google AI Ultra ($100/mes) con limites de uso 5x mayores en Antigravity y $100 en creditos de bienvenida hasta el 25 de mayo.
Busqueda semantica de issues con lenguaje natural en Copilot Chat web
Copilot Chat en la web ahora puede encontrar, agrupar y analizar issues usando lenguaje natural. El nuevo indice semantico de issues entiende el intent de la consulta y muestra issues relacionados semanticamente — no solo coincidencias exactas de palabras clave.
Enrutamiento automatico de modelos en VS Code + seleccion de modelos web simplificada
Copilot en VS Code ahora enruta automaticamente al mejor modelo segun la tarea, usando metricas de utilizacion y salud. El selector de modelos web fue reducido a modelos OpenAI y Claude — se eliminaron todos los modelos Gemini, GPT-5.2 Codex y GPT-5.4 nano para garantizar respuestas mas consistentes.
GitHub Copilot para Eclipse es open-source bajo licencia MIT
La extension de Copilot para Eclipse ahora es open-source bajo licencia MIT, con el codigo disponible en GitHub. Esto abre la puerta a contribuciones de la comunidad y permite a las organizaciones auditar e integrar Copilot en sus workflows Java/Eclipse a medida.
Debug de Actions con un clic + staged publishing GA + Fix with Copilot
Los jobs fallidos en GitHub Actions muestran un boton para que el agente cloud de Copilot los corrija en un clic. Staged publishing alcanza disponibilidad general con nuevos flags --allow-* para controlar fuentes de instalacion de npm. La accion de code review Implement suggestion pasa a llamarse Fix with Copilot con controles de UI mejorados.
Planes individuales pausados y transicion a facturacion por uso (GitHub AI Credits)
GitHub pauso nuevas suscripciones individuales de Copilot para proteger la experiencia de clientes existentes. Se migra a facturacion basada en consumo con la nueva unidad GitHub AI Credits (por tokens). Los modelos Opus ya no estan disponibles en planes Pro — permanecen en Pro+. Todas las features excepto code completions y Next Edit Suggestions seran medidas por consumo.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-05-20 | Qwen 3.7 Max | Alibaba / Qwen | S | Propietario | API-only. Contexto 1M tokens (vs 256K en 3.6 Max). #1 modelo chino en Intelligence Index v4.0 (56.6) — primer modelo chino en top 5 global. Supera a Claude Opus 4.6 Max en Apex Math (44.5 vs 34.5). Demostro 35h de operacion autonoma ejecutando 1,158 llamadas a herramientas sin intervencion humana. |
| 2026-05-20 | Qwen 3.7 Plus | Alibaba / Qwen | S | Propietario | Variante multimodal con vision del Qwen 3.7. API-only. Anunciada junto al Max en el Alibaba Cloud Summit de Hangzhou. |
| 2026-05-19 | Gemini 3.5 Flash | S | Propietario | GA en Google I/O 2026. 4x mas rapido que modelos frontier comparables. Terminal-Bench 2.1: 76.2%. $1.50/$9 por 1M tokens. Contexto 1M tokens. Disponible globalmente. | |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propietario | Mejor en workflows terminal complejos, resolucion de issues GitHub y tareas multi-step. Intelligence Index: 60.24 (esfuerzo alto). GPT-5.5 Instant es el nuevo default de ChatGPT desde el 5 may. GPT-5.5 Pro y Thinking disponibles en planes pagos. |
| 2026-04-24 | DeepSeek V4-Pro | DeepSeek | S | Propietario | 1.6T parametros MoE, contexto 1M tokens. Solo 27% de FLOPs de inferencia por token vs V3. Supera a V3 en mas del 40% en SWE-bench y Terminal-bench. |
| 2026-04-24 | DeepSeek V4-Flash | DeepSeek | A | Propietario | 284B parametros MoE, contexto 1M tokens. Version rapida y economica de la familia V4. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Abierto | Open-source (Modified MIT). 1T parametros MoE, 32B activos por token. Agent Swarm hasta 300 sub-agentes y 4,000 pasos coordinados. Paridad con GPT-5.5 en coding segun benchmarks. GA en Kimi.com, app, API y Kimi Code CLI. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | Mejor modelo Anthropic para coding complejo y trabajo financiero. Lider en Intelligence Index hasta el 23 de abril. Disponible en Claude Code en fast mode (Opus 4.7 por defecto). |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | A+ | Abierto | Open-source. Basado en GLM-5 (744B MoE, 40B activos por token). Entrenado completamente en chips Huawei Ascend con MindSpore — sin dependencia de NVIDIA. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | A | Propietario | 4 tiers (Pro, Lite, Mini, Code). Pro: ~$0.47/M tokens entrada, ~$2.37/M salida — 3.7x mas barato que GPT-5.2 en entrada. Impulsa la app Doubao con 155M usuarios activos semanales. |
| 2026-06-01 | Gemini 3.5 Pro | S+ | Próximo | En pruebas — anunciado para junio de 2026 en Google I/O. Se espera que supere a Gemini 3.5 Flash en razonamiento complejo y tareas de larga duracion. |
Tendencias Destacadas
Google I/O 2026 domino la semana: Gemini 3.5 Flash llego en GA superando a su propio Pro model mientras Antigravity 2.0 reemplaza a Gemini Code Assist IDE como la plataforma principal de agentes para desarrolladores. Los usuarios individuales tienen hasta el 18 de junio para migrar antes del corte del servicio.
Anthropic realizo dos movimientos estrategicos de alto impacto: adquirio Stainless (la startup de SDKs que tambien alimenta a OpenAI y Google) por mas de $300M consolidando control sobre tooling de desarrolladores; y publico los primeros resultados de Project Glasswing donde Claude Mythos Preview encontro 10,000+ vulnerabilidades criticas en un mes, redefiniendo el concepto de auditoria de software asistida por IA.
La carrera de modelos chinos se intensifica: Qwen 3.7 se convirtio en el primer modelo chino en entrar al top 5 del Intelligence Index global con contexto de 1M tokens y autonomia demostrada de 35 horas. Mientras tanto, GitHub Copilot hizo un giro estructural al pausar nuevas suscripciones individuales y migrar a facturacion por consumo de tokens (GitHub AI Credits) — senalizando una madurez del mercado donde el modelo de suscripcion plana se vuelve insostenible.
v2.1.149: Per-category usage insights and keyboard diff navigation
New usage breakdown shows what drives limit consumption across skills, subagents, plugins, and MCP server costs. Diff navigation now supports j/k, arrows, PgUp/PgDn, Space, and Home/End. Markdown task lists render GFM checkboxes instead of plain bullets. New enterprise setting for Claude.ai cloud MCP connectors.
v2.1.147: Pinned background sessions and /code-review with effort reporting
Pinned background sessions stay alive when idle and restart automatically to apply updates. The /simplify command is renamed to /code-review with effort-level reporting. Improved diff rendering performance for large file edits, plus extensive terminal and Windows/PowerShell bug fixes.
Anthropic acquires Stainless for $300M+
Stainless — the startup that automates SDK creation and maintenance, used by OpenAI, Google, and Cloudflare — is now part of Anthropic. Hosted products (SDK generator) will wind down, but customers keep their generated SDKs with full rights to modify and extend them. Stainless has powered all official Anthropic SDKs since the earliest API days.
Project Glasswing: 10,000+ critical vulnerabilities in 1 month with Claude Mythos Preview
Glasswing's first update reveals that ~50 partners using Claude Mythos Preview (an unreleased model optimized for vulnerability discovery) found 10,000+ critical bugs in one month. Cloudflare uncovered ~2,000 bugs (400 critical) with fewer false positives than manual testing. Mozilla fixed 271 vulnerabilities in Firefox 150. Of 23,019 total open-source issues, 90.6% of high/critical-rated findings were confirmed by independent security firms. Anthropic warns no company yet has safeguards to prevent malicious use of Mythos-level capabilities.
Goal Mode is now GA in app, IDE, and CLI
Goal mode exits experimental status. Codex can now drive toward a specific objective for hours or even days across the Codex app, IDE extension, and CLI.
codex doctor: full environment diagnostics for support
New codex doctor command runs full diagnostics across runtime, auth, terminal, network, config, and local state — generating a support-ready report for environment debugging.
Codex can operate the in-app browser for local development servers
The Codex app can now operate its in-app browser for local development servers and file-backed pages. Allows clicking through rendered UIs, reproducing visual bugs, and verifying local fixes without leaving the development environment.
GPT-5.5 Instant becomes the new default ChatGPT model
GPT-5.5 Instant replaces GPT-5.3 Instant as the default for all users. Brings sharper accuracy, cleaner answers, better web search, stronger STEM and image help, and richer context for Plus and Pro users on web. GPT-5.5 Pro and GPT-5.5 Thinking available on paid plans.
Content verification: C2PA provenance + SynthID watermarking on generated images
OpenAI enables C2PA provenance signals so other tools and platforms can recognize AI-generated content origins. Also adds durable cross-platform SynthID watermarking to images via a Google partnership, plus a public tool to verify if images came from OpenAI.
Gemini 3.5 Flash GA — beats Gemini 3.1 Pro at 4x the speed
Launched at Google I/O 2026, Gemini 3.5 Flash outperforms Gemini 3.1 Pro on nearly all benchmarks at 4x the speed. Terminal-Bench 2.1: 76.2%, GDPval-AA Elo: 1656, MCP Atlas: 83.6%, CharXiv: 84.2%. Priced at $1.50/$9 per 1M tokens. 1M-token context. Available globally via Gemini app, AI Studio, Antigravity, and Code Assist. Gemini 3.5 Pro in testing — arriving next month.
Antigravity 2.0 — desktop app + CLI for agent workflows
Antigravity 2.0 is Google's new desktop application for agent interaction: dynamic subagents, scheduled background tasks, cross-platform terminal sandboxing, credential masking, and hardened Git policies. The new Antigravity CLI + SDK enables rapid agent creation from the command line with Gemini-optimized infrastructure. Notice: Gemini Code Assist IDE for individuals migrates to Antigravity on June 18, 2026.
Managed Agents in Gemini API + Google AI Ultra ($100/mo) + native Android Studio
The new Interactions API lets developers deploy reasoning agents with tool use and code execution in isolated environments via a single API call. Google AI Studio gains native Android app building: Kotlin + Jetpack Compose, in-browser emulator, and direct Google Play publishing. New Google AI Ultra plan at $100/month with 5x higher Antigravity usage limits and $100 bonus credits through May 25.
Semantic issue search with natural language in Copilot Chat web
Copilot Chat on web can now find, group, and analyze issues using natural language. A new semantic issues index understands query intent and surfaces semantically related issues, not just keyword matches.
Auto model routing in VS Code + trimmed web model selector
Copilot in VS Code now automatically routes to the best model for each task using utilization and health metrics. The web model selector was trimmed to OpenAI and Claude models only — all Gemini models and GPT-5.2 Codex and GPT-5.4 nano were removed to ensure more consistent responses.
GitHub Copilot for Eclipse goes open-source under MIT license
The Copilot extension for Eclipse is now open-source under the MIT license, with code available on GitHub. Opens the door to community contributions and allows organizations to audit and customize Copilot integration in Java/Eclipse workflows.
Actions one-click debug + staged publishing GA + Fix with Copilot
Failed GitHub Actions jobs now show a button to have the Copilot cloud agent fix them in one click. Staged publishing reaches GA with new --allow-* npm install source flags. The code review action Implement suggestion is renamed to Fix with Copilot with an enhanced UI dialog.
Individual plans paused and transition to usage-based billing (GitHub AI Credits)
GitHub paused new Copilot Individual sign-ups to protect existing customer experience. Transitioning to consumption-based billing with the new GitHub AI Credits unit (token-based). Opus models removed from Pro plans — remain in Pro+. All features except code completions and Next Edit Suggestions will be token-metered.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-20 | Qwen 3.7 Max | Alibaba / Qwen | S | Proprietary | API-only. 1M-token context (up from 256K in 3.6 Max). #1 Chinese model on Intelligence Index v4.0 (56.6) — first Chinese model in global top 5. Outperforms Claude Opus 4.6 Max on Apex Math (44.5 vs 34.5). Demonstrated 35-hour autonomous operation with 1,158 tool calls without human intervention. |
| 2026-05-20 | Qwen 3.7 Plus | Alibaba / Qwen | S | Proprietary | Multimodal vision variant of Qwen 3.7. API-only. Announced alongside Max at the Alibaba Cloud Summit in Hangzhou. |
| 2026-05-19 | Gemini 3.5 Flash | S | Proprietary | GA at Google I/O 2026. 4x faster than comparable frontier models. Terminal-Bench 2.1: 76.2%. $1.50/$9 per 1M tokens. 1M-token context. Available globally. | |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Proprietary | Strongest at complex terminal workflows, real-world GitHub issue resolution, and multi-step tasks. Intelligence Index: 60.24 at high effort. GPT-5.5 Instant became ChatGPT default on May 5. GPT-5.5 Pro and Thinking available on paid plans. |
| 2026-04-24 | DeepSeek V4-Pro | DeepSeek | S | Proprietary | 1.6T-parameter MoE, 1M-token context. Only 27% of single-token inference FLOPs vs V3. Outperforms V3 by 40%+ on SWE-bench and Terminal-bench. |
| 2026-04-24 | DeepSeek V4-Flash | DeepSeek | A | Proprietary | 284B-parameter MoE, 1M-token context. Fast and economical variant of the V4 family. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Open | Open-source (Modified MIT). 1T-parameter MoE, 32B active per token. Agent Swarm scaling to 300 sub-agents and 4,000 coordinated steps. GPT-5.5 coding parity on benchmarks. GA across Kimi.com, app, API, and Kimi Code CLI. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | Best Anthropic model for complex coding and financial work. Led the Intelligence Index until April 23. Available in Claude Code via fast mode (Opus 4.7 default). |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | A+ | Open | Open-source. Based on GLM-5 (744B MoE, 40B active per token). Trained entirely on Huawei Ascend chips using MindSpore — zero NVIDIA dependency. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | A | Proprietary | 4 tiers (Pro, Lite, Mini, Code). Pro: ~$0.47/M input tokens, ~$2.37/M output — 3.7x cheaper than GPT-5.2 on input. Powers the Doubao app with 155M weekly active users. |
| 2026-06-01 | Gemini 3.5 Pro | S+ | Upcoming | In testing — announced for June 2026 at Google I/O. Expected to surpass Gemini 3.5 Flash on complex reasoning and long-horizon tasks. |
Notable Trends
Google I/O 2026 dominated the week: Gemini 3.5 Flash launched GA outperforming its own Pro model while Antigravity 2.0 replaces Gemini Code Assist IDE as the primary developer agent platform. Individual users have until June 18 to migrate before service cut-off.
Anthropic made two high-impact strategic moves: it acquired Stainless (the SDK startup powering OpenAI and Google too) for $300M+, consolidating control over developer tooling infrastructure; and published Project Glasswing's first results where Claude Mythos Preview found 10,000+ critical vulnerabilities in one month, redefining AI-assisted software security auditing.
Chinese model competition intensifies: Qwen 3.7 became the first Chinese model to break into the global Intelligence Index top 5, with 1M-token context and demonstrated 35-hour autonomous operation. Meanwhile, GitHub Copilot made a structural pivot by pausing new individual sign-ups and moving to token-consumption billing (GitHub AI Credits) — signaling market maturity where flat subscription models become unsustainable.
v2.1.149 : Insights d'usage par categorie et navigation diff clavier
Le nouveau panneau affiche la repartition d'utilisation par skills, sous-agents, plugins et serveurs MCP. La navigation diff supporte j/k, fleches, PgUp/PgDn, Space et Home/End. Les listes de taches Markdown affichent des cases GFM au lieu de puces.
v2.1.147 : Sessions d'arriere-plan ancrees et /code-review avec rapport d'effort
Les sessions d'arriere-plan ancrees restent actives au repos et redemarrent automatiquement pour appliquer les mises a jour. La commande /simplify est renommee /code-review avec rapport de niveau d'effort. Performances de rendu diff ameliorees pour les grands fichiers.
Anthropic acquiert Stainless pour plus de $300M
Stainless — la startup qui automatise la creation de SDKs, utilisee par OpenAI, Google et Cloudflare — rejoint Anthropic. Les produits heberges seront arretes, mais les clients conservent leurs SDKs generes avec tous les droits. Stainless alimentait deja tous les SDKs Anthropic officiels.
Project Glasswing : 10 000+ vulnerabilites critiques en 1 mois avec Claude Mythos Preview
La premiere mise a jour de Glasswing revele que ~50 partenaires utilisant Claude Mythos Preview ont trouve 10 000+ bugs critiques en un mois. Cloudflare a decouvert ~2 000 bugs (400 critiques). Mozilla a corrige 271 vulnerabilites dans Firefox 150. 90,6% des resultats evalues ont ete confirmes par des firmes de securite independantes.
Le Goal Mode est desormais GA dans l'app, l'IDE et le CLI
Le mode Goal quitte la phase experimentale. Codex peut desormais travailler pendant des heures ou des jours vers un objectif specifique dans l'app, l'extension IDE et le CLI.
codex doctor : diagnostics complets d'environnement pour le support
Nouvelle commande codex doctor executant des diagnostics complets sur le runtime, l'auth, le terminal, le reseau, la config et l'etat local — generant un rapport pret pour le support.
Codex peut operer le navigateur integre pour les serveurs de developpement locaux
L'app Codex peut desormais operer son navigateur integre pour les serveurs de developpement locaux, permettant de reproduire des bugs visuels et verifier des corrections locales sans quitter l'environnement.
GPT-5.5 Instant devient le nouveau modele par defaut de ChatGPT
GPT-5.5 Instant remplace GPT-5.3 Instant comme modele par defaut pour tous les utilisateurs. Meilleure precision, reponses plus claires, meilleure recherche web. GPT-5.5 Pro et GPT-5.5 Thinking disponibles sur les plans payants.
Verification de contenu : provenance C2PA + filigrane SynthID sur les images generees
OpenAI active les signaux de provenance C2PA pour que d'autres plateformes reconnaissent l'origine du contenu IA. Ajoute aussi le tatouage SynthID de Google aux images et un outil public de verification.
Gemini 3.5 Flash GA — surpasse Gemini 3.1 Pro a 4x la vitesse
Lance a Google I/O 2026, Gemini 3.5 Flash surpasse Gemini 3.1 Pro sur presque tous les benchmarks a 4x la vitesse. Terminal-Bench 2.1 : 76,2%, GDPval-AA Elo : 1656, MCP Atlas : 83,6%. Prix : $1,50/$9 par 1M tokens. Disponible mondialement. Gemini 3.5 Pro en test — arrive le mois prochain.
Antigravity 2.0 — application de bureau + CLI pour les workflows d'agents
Antigravity 2.0 est la nouvelle application de bureau de Google pour les agents : sous-agents dynamiques, taches planifiees, sandboxing cross-platform et politiques Git renforcees. Nouveau CLI + SDK Antigravity. Avis : Gemini Code Assist IDE pour particuliers migre vers Antigravity le 18 juin 2026.
Agents geres dans l'API Gemini + Google AI Ultra ($100/mois) + Android Studio natif
La nouvelle Interactions API permet de deployer des agents raisonneurs en un seul appel API. Google AI Studio gagne le support natif Android (Kotlin + Jetpack Compose, emulateur en navigateur). Nouveau plan Google AI Ultra a $100/mois avec des limites 5x plus elevees.
Recherche semantique d'issues en langage naturel dans Copilot Chat web
Copilot Chat sur le web peut desormais trouver, regrouper et analyser des issues en langage naturel. Un nouvel index semantique comprend l'intention de la requete et remonte des issues liees semantiquement.
Routage automatique des modeles dans VS Code + selecteur de modeles web simplifie
Copilot dans VS Code route desormais automatiquement vers le meilleur modele par tache. Le selecteur de modeles web a ete reduit aux modeles OpenAI et Claude uniquement — tous les modeles Gemini et GPT-5.2 Codex ont ete supprimes.
GitHub Copilot pour Eclipse passe en open-source sous licence MIT
L'extension Copilot pour Eclipse est desormais open-source sous licence MIT sur GitHub. Ouvre la voie aux contributions communautaires et permet aux organisations d'auditer et de personnaliser l'integration dans leurs workflows Java/Eclipse.
Debogage Actions en un clic + publication par etapes GA + Fix with Copilot
Les jobs GitHub Actions en echec affichent un bouton pour que l'agent cloud Copilot les corrige en un clic. La publication par etapes atteint la GA. L'action de revue Implement suggestion devient Fix with Copilot avec une UI amelioree.
Plans individuels en pause et transition vers la facturation a l'usage (GitHub AI Credits)
GitHub a mis en pause les nouvelles inscriptions Copilot Individual. Migration vers une facturation a la consommation avec les GitHub AI Credits (tokens). Modeles Opus supprimes des plans Pro — restent en Pro+. Toutes les fonctionnalites sauf les completions de code seront messurees par tokens.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-20 | Qwen 3.7 Max | Alibaba / Qwen | S | Propriétaire | API-only. Contexte 1M tokens (contre 256K en 3.6 Max). #1 modele chinois sur Intelligence Index v4.0 (56,6) — premier modele chinois dans le top 5 mondial. Depasse Claude Opus 4.6 Max sur Apex Math. |
| 2026-05-20 | Qwen 3.7 Plus | Alibaba / Qwen | S | Propriétaire | Variante multimodale vision de Qwen 3.7. API-only. Annoncee avec le Max au sommet Alibaba Cloud de Hangzhou. |
| 2026-05-19 | Gemini 3.5 Flash | S | Propriétaire | GA a Google I/O 2026. 4x plus rapide que les modeles frontier comparables. Terminal-Bench 2.1 : 76,2%. $1,50/$9 par 1M tokens. | |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propriétaire | Plus fort sur les workflows terminal complexes et la resolution d'issues GitHub. Intelligence Index : 60,24 en effort eleve. GPT-5.5 Instant est devenu le defaut ChatGPT le 5 mai. |
| 2026-04-24 | DeepSeek V4-Pro | DeepSeek | S | Propriétaire | 1,6T parametres MoE, contexte 1M tokens. Seulement 27% des FLOPs d'inference vs V3. Depasse V3 de 40%+ sur SWE-bench. |
| 2026-04-24 | DeepSeek V4-Flash | DeepSeek | A | Propriétaire | 284B parametres MoE, contexte 1M tokens. Variante rapide et economique de la famille V4. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Ouvert | Open-source (MIT modifie). 1T parametres MoE, 32B actifs. Agent Swarm jusqu'a 300 sous-agents et 4 000 etapes. Parite GPT-5.5 en coding. GA sur Kimi.com, app, API et Kimi Code CLI. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | Meilleur modele Anthropic pour le coding complexe et le travail financier. En tete de l'Intelligence Index jusqu'au 23 avril. Disponible en fast mode dans Claude Code. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | A+ | Ouvert | Open-source. Base sur GLM-5 (744B MoE, 40B actifs). Entraine entierement sur puces Huawei Ascend avec MindSpore — aucune dependance NVIDIA. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | A | Propriétaire | 4 niveaux (Pro, Lite, Mini, Code). Pro : ~$0,47/M tokens entree — 3,7x moins cher que GPT-5.2 en entree. Alimente l'app Doubao avec 155M utilisateurs actifs par semaine. |
| 2026-06-01 | Gemini 3.5 Pro | S+ | À venir | En test — annonce pour juin 2026 a Google I/O. Attendu pour surpasser Gemini 3.5 Flash en raisonnement complexe et taches longues. |
Tendances Notables
Google I/O 2026 a domine la semaine : Gemini 3.5 Flash lance en GA surpassant son propre modele Pro tandis qu'Antigravity 2.0 remplace Gemini Code Assist IDE. Les utilisateurs individuels ont jusqu'au 18 juin pour migrer.
Anthropic a realise deux mouvements strategiques : l'acquisition de Stainless (la startup SDK alimentant aussi OpenAI et Google) pour plus de $300M, et la publication des premiers resultats de Glasswing ou Claude Mythos Preview a trouve 10 000+ vulnerabilites critiques en un mois.
La competition des modeles chinois s'intensifie : Qwen 3.7 est devenu le premier modele chinois dans le top 5 mondial de l'Intelligence Index. GitHub Copilot a realise un virage structurel en suspendant les nouvelles inscriptions individuelles et en migrant vers une facturation par tokens (GitHub AI Credits).