Herramientas de IA para Devs — 2 jun 2026
Claude Opus 4.8 — nuevo modelo por defecto con capacidades agentivas mejoradas
Anthropic lanzo Claude Opus 4.8 el 28 de mayo, convirtiendose en el modelo por defecto en Claude Code. Lidera el Artificial Analysis Intelligence Index con 61.4 puntos, por encima de GPT-5.5 (60.2) y Gemini 3.1 Pro (57). Destaca en codificacion agentiva de largo horizonte y autocorreccion en ejecuciones autonomas.
v2.1.160 — Confirmaciones de seguridad para archivos de inicio de shell y config de build
Nueva version agrega confirmacion obligatoria antes de escribir en .zshenv, .bash_login y ~/.config/git/. El modo acceptEdits tambien pide confirmacion antes de modificar .npmrc, .yarnrc, bunfig.toml, .bazelrc y configs de devcontainer. Los comandos grep/egrep de un solo archivo ahora satisfacen la verificacion de lectura previa a edicion.
v2.1.158 — Auto mode disponible en Bedrock, Vertex y Foundry para Opus 4.7 y 4.8
Auto mode se expande a Amazon Bedrock, Vertex AI y Azure AI Foundry para los modelos Opus 4.7 y Opus 4.8. Activar con la variable de entorno CLAUDE_CODE_ENABLE_AUTO_MODE=1.
v2.1.157 — Skills se cargan automaticamente desde .claude/skills sin marketplace
Plugins en directorios .claude/skills ahora se cargan automaticamente sin el marketplace. Nuevo comando claude plugin init <nombre> para inicializar plugins. EnterWorktree puede cambiar entre worktrees gestionados por Claude durante una sesion. Autocompletado para argumentos de /plugin.
Anthropic presenta S-1 confidencial ante la SEC y recauda $65B en Serie H
El 1 de junio Anthropic presento documentos de registro confidenciales ante la SEC, senalizando una posible salida a bolsa. El 28 de mayo aseguro $65B en una ronda Serie H con una valoracion post-money de $965B. La tasa de ingresos anual supera los $47B con crecimiento del 130% esperado este ano.
v0.135.0 — Diagnosticos enriquecidos, edicion vim y perfiles de permisos con nombre
Codex CLI 0.135.0 agrega diagnosticos mejorados en codex doctor, detalles de conexion remota en /status, edicion de objetos de texto al estilo vim, y perfiles de permisos con nombre para reutilizar configuraciones de seguridad entre sesiones.
Codex y GPT-5.5/5.4 en disponibilidad general en Amazon Bedrock
Desde el 1 de junio, Codex, GPT-5.5 y GPT-5.4 estan en GA en Amazon Bedrock. La inferencia hereda controles IAM, VPC, KMS y CloudTrail. Los precios igualan las tarifas directas de OpenAI sin licencias por asiento, y el uso cuenta para los compromisos de AWS. Mas de 5 millones de personas usan Codex semanalmente.
GPT-5.5 en GA en Amazon Bedrock — el modelo flagship de OpenAI disponible en AWS
GPT-5.5, el modelo insignia de OpenAI, esta en disponibilidad general en Amazon Bedrock junto con GPT-5.4. Destaca en codificacion agentiva, analisis de datos y tareas autonomas multi-paso. El AI Intelligence Index lo ubica en 60.2, justo por debajo de Claude Opus 4.8 (61.4).
GPT-4.5 se retira de ChatGPT el 27 de junio — migrar a GPT-5.5 o GPT-5.4
OpenAI confirmo que GPT-4.5 dejara de estar disponible en ChatGPT el 27 de junio de 2026 tras un periodo de transicion de 30 dias. Los equipos que dependen de este modelo deben planificar la migracion a GPT-5.5 o GPT-5.4 antes de esa fecha.
Facturacion por tokens activa — creditos de IA reemplazan el modelo de solicitudes premium
A partir del 1 de junio, GitHub Copilot cobra en funcion de los tokens de IA procesados, no de solicitudes premium. Los cargos dependen del modelo elegido, el volumen de entrada/salida, el tamano de cache y las funciones usadas. Los presupuestos a nivel de usuario son GA para organizaciones. El registro de nuevos suscriptores en planes Pro, Pro+ y Student esta en pausa.
Claude Opus 4.8 disponible en el selector de modelos para Pro+, Business y Enterprise
Claude Opus 4.8 esta ahora disponible en GitHub Copilot para suscriptores Pro+, Business y Enterprise en VS Code, Visual Studio, JetBrains, Xcode y GitHub.com — en todos los modos: chat, ask, edit y agente. Los administradores empresariales deben activar la politica de Opus 4.8 en los ajustes de Copilot.
API de metricas de uso agrega cohortes de adopcion de IA para administradores
La API de metricas de uso de Copilot incluye ahora cohortes de adopcion que muestran como los usuarios progresan de un uso centrado en codigo a uno centrado en agentes y multi-agente. Util para administradores que analizan el ROI de Copilot en organizaciones grandes.
Project Polaris — modelo de codificacion propio para reemplazar GPT-4 Turbo en Copilot desde agosto
Microsoft presento Project Polaris, su primer modelo de codificacion propio, que reemplazara a GPT-4 Turbo como modelo por defecto en GitHub Copilot a partir de agosto de 2026. Usa arquitectura MoE y supera a GPT-4 Turbo en HumanEval y MBPP, con fortalezas especiales en Rust y Haskell. Los suscriptores Pro obtendran contexto de 100.000 lineas y generacion de pruebas autonoma.
Suite MAI v2 — MAI-Image-2.5, MAI-Voice-2, MAI-Transcribe-1.5 y MAI-Thinking-1
Microsoft presento cuatro modelos MAI en Build 2026: MAI-Image-2.5 (generacion y edicion de imagenes), MAI-Voice-2 (15+ idiomas con variacion de tono emocional), MAI-Transcribe-1.5 (mejora incremental sobre el WER de v1), y MAI-Thinking-1, el primer modelo de razonamiento de Microsoft desarrollado sin destilacion de modelos externos.
Copilot Workspace en disponibilidad general con modos de flota autonoma y autopilot
Copilot Workspace alcanzo disponibilidad general en Build 2026. Los nuevos modos de flota autonoma y autopilot permiten ejecutar tareas de codificacion a gran escala sin intervencion continua del desarrollador. Se integra con Azure Agent Mesh para ejecucion federada en la nube y on-premises.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-06-02 | Project Polaris (coding) | Microsoft | A | Próximo | Modelo MoE de codificacion propio de Microsoft. Reemplaza GPT-4 Turbo en Copilot en agosto 2026. Supera GPT-4T en HumanEval y MBPP. |
| 2026-06-02 | MAI-Thinking-1 | Microsoft | A | Próximo | Primer modelo de razonamiento propio de Microsoft, sin destilacion externa. Presentado en Build 2026. |
| 2026-05-28 | Claude Opus 4.8 | Anthropic | S+ | Propietario | Lider en AI Intelligence Index (61.4). Codificacion agentiva, autocorreccion. Nuevo defecto en Claude Code y Copilot Pro+. |
| 2026-05-20 | Qwen 3.7 Max | Alibaba / Qwen | S | Propietario | Contexto 1M. AI Analysis Index 56.6 (mayor puntaje chino). SWE-Pro 60.6, GPQA Diamond 92.4. Presentado en Alibaba Cloud Summit. |
| 2026-05-19 | Gemini 3.5 Flash | S | Propietario | GA en Google I/O 2026. Supera a Gemini 3.1 Pro en benchmarks siendo 4x mas rapido. Motor de Antigravity 2.0. | |
| 2026-04-24 | DeepSeek V4 Pro / Flash | DeepSeek | S | Abierto | Contexto 1M, modos Thinking y No-Thinking. Open-source. API IDs: deepseek-v4-flash y deepseek-v4-pro. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Abierto | 1T params MoE, 32B activos/token. SWE-Bench Pro 58.6. Essaim de 300 sub-agentes, contexto 256K. Licencia MIT modificada. |
| 2026-04-08 | GLM-5.1 | Zhipu / Z.ai | A+ | Abierto | Open-source. Evolucion de GLM-5 lanzada en Hugging Face. Disponible en subscripcion desde finales de marzo. |
| 2026-04-01 | GPT-5.5 | OpenAI | S+ | Propietario | Flagship de OpenAI. AI Analysis Index 60.2. Mejor en escritura creativa. En GA en Amazon Bedrock desde junio 2026. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | A+ | Propietario | Cuatro variantes: Pro, Lite, Mini, Code. Potencia la app Doubao con 155M usuarios activos semanales. |
| 2026-02-11 | GLM-5 | Zhipu / Z.ai | S | Abierto | 744B params MoE, 40B activos. SWE-bench Verified 77.8%. Entrenado en chips Huawei Ascend. Z.ai salio a bolsa en enero 2026. |
| 2026-07-01 | DeepSeek R2 | DeepSeek | S | Próximo | Rumorado. Sin fecha oficial confirmada. R1 sigue siendo el modelo de razonamiento actual de DeepSeek. |
Tendencias Destacadas
La distribucion de IA se descentraliza del proveedor directo: Codex y GPT-5.5 en GA en Amazon Bedrock y Claude Code expandiendo Auto Mode a Bedrock, Vertex y Foundry senalan que los principales laboratorios apuestan por los ecosistemas de nube como canales de primera clase, no como integraciones secundarias.
Microsoft esta cortando activamente la dependencia de OpenAI: Project Polaris y MAI-Thinking-1 presentados en Build 2026 son el movimiento mas explicito hacia la independencia de la pila de IA. Cuando el mayor revendedor de un proveedor comienza a construir modelos competidores, el mercado entra en una nueva fase de consolidacion vertical.
El cambio de facturacion por tokens de GitHub Copilot el 1 de junio coincide con la presentacion del S-1 de Anthropic a $965B: ambos eventos sugieren que la industria esta pasando del subsidio de adopcion a la monetizacion real. Para equipos de ingenieria, esto significa que el ROI de los asistentes de IA debera justificarse en costos variables, no en suscripciones fijas.
Claude Opus 4.8 — new default model with enhanced agentic capabilities
Anthropic released Claude Opus 4.8 on May 28, becoming the default model in Claude Code. It leads the Artificial Analysis Intelligence Index at 61.4, ahead of GPT-5.5 (60.2) and Gemini 3.1 Pro (57). Excels at long-horizon agentic coding and self-correction in autonomous runs.
v2.1.160 — Security prompts for shell startup files and build config files
Adds mandatory confirmation before writing to .zshenv, .bash_login, and ~/.config/git/. acceptEdits mode now also prompts before modifying .npmrc, .yarnrc, bunfig.toml, .bazelrc, and devcontainer config. Single-file grep/egrep commands now satisfy the read-before-edit check. Also fixes WSL clipboard copy-on-select and background session history restoration.
v2.1.158 — Auto mode available on Bedrock, Vertex, and Foundry for Opus 4.7 and 4.8
Auto mode expands to Amazon Bedrock, Vertex AI, and Azure AI Foundry for Opus 4.7 and Opus 4.8 models. Enable via env variable CLAUDE_CODE_ENABLE_AUTO_MODE=1.
v2.1.157 — Skills auto-load from .claude/skills without marketplace requirement
Plugins in .claude/skills directories now auto-load without the marketplace. New claude plugin init <name> command to scaffold plugins. EnterWorktree can now switch between Claude-managed worktrees mid-session. Autocomplete for /plugin arguments.
Anthropic files confidential S-1 with the SEC and raises $65B in Series H
On June 1, Anthropic filed confidential draft registration documents with the SEC, signaling a potential IPO. On May 28, it secured $65B in a Series H round at a $965B post-money valuation. Annual run-rate revenue has crossed $47B with 130% growth expected this year.
v0.135.0 — Richer diagnostics, vim text-object editing, named permission profiles
Codex CLI 0.135.0 adds richer codex doctor diagnostics, remote connection details in /status, vim-style text-object editing, and named permission profiles for reusing security configurations across sessions.
Codex and GPT-5.5/5.4 reach general availability on Amazon Bedrock
As of June 1, Codex, GPT-5.5, and GPT-5.4 are GA on Amazon Bedrock. Inference routes through Bedrock, inheriting IAM, VPC, KMS, and CloudTrail controls. Pricing matches OpenAI direct rates with no seat licenses, and usage counts toward AWS commitments. Over 5 million people use Codex weekly.
GPT-5.5 hits GA on Amazon Bedrock — OpenAI flagship now available on AWS
GPT-5.5, OpenAI's flagship model, is generally available on Amazon Bedrock alongside GPT-5.4. Excels at agentic coding, data analysis, and multi-step autonomous tasks. The AI Intelligence Index places it at 60.2, just behind Claude Opus 4.8 (61.4).
GPT-4.5 retires from ChatGPT on June 27 — migrate to GPT-5.5 or GPT-5.4
OpenAI confirmed that GPT-4.5 will be retired from ChatGPT on June 27, 2026 following a 30-day transition period. Teams relying on this model should plan migration to GPT-5.5 or GPT-5.4 before that date.
Token-based billing live — AI Credits replace the premium requests model
Starting June 1, GitHub Copilot bills based on AI tokens processed, not premium requests. Charges depend on the chosen model, input/output volume, cache size, and features used. User-level budgets are now GA for organizations. New sign-ups for Pro, Pro+, and Student plans are paused.
Claude Opus 4.8 available in model picker for Pro+, Business, and Enterprise
Claude Opus 4.8 is now available in GitHub Copilot for Pro+, Business, and Enterprise subscribers in VS Code, Visual Studio, JetBrains, Xcode, and GitHub.com — across all modes: chat, ask, edit, and agent. Enterprise admins must activate the Opus 4.8 policy in Copilot settings.
Usage metrics API adds AI adoption cohorts for admins
Copilot's usage metrics API now includes adoption cohorts showing how users progress from code-first to agent-first and multi-agent usage. Useful for admins analyzing Copilot ROI across large organizations.
Project Polaris — in-house coding model to replace GPT-4 Turbo in Copilot from August
Microsoft unveiled Project Polaris, its first in-house coding model, which will replace GPT-4 Turbo as the default in GitHub Copilot from August 2026. Uses a mixture-of-experts architecture, outperforms GPT-4 Turbo on HumanEval and MBPP, with particular strengths in Rust and Haskell. Pro subscribers get 100K-line context and autonomous test generation.
MAI Suite v2 — MAI-Image-2.5, MAI-Voice-2, MAI-Transcribe-1.5, and MAI-Thinking-1
Microsoft introduced four MAI models at Build 2026: MAI-Image-2.5 (image generation and editing), MAI-Voice-2 (15+ languages with emotional tone variation), MAI-Transcribe-1.5 (incremental improvement on v1's WER), and MAI-Thinking-1, Microsoft's first reasoning model built without external model distillation.
Copilot Workspace hits GA with autonomous fleet and autopilot modes
Copilot Workspace reached general availability at Build 2026. New autonomous fleet and autopilot modes enable large-scale coding tasks to run without continuous developer intervention. Integrates with Azure Agent Mesh for federated execution across cloud and on-premises.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-06-02 | Project Polaris (coding) | Microsoft | A | Upcoming | Microsoft's own MoE coding model. Replaces GPT-4 Turbo in Copilot August 2026. Outperforms GPT-4T on HumanEval and MBPP. |
| 2026-06-02 | MAI-Thinking-1 | Microsoft | A | Upcoming | Microsoft's first in-house reasoning model, built without external distillation. Unveiled at Build 2026. |
| 2026-05-28 | Claude Opus 4.8 | Anthropic | S+ | Proprietary | Leader on AI Intelligence Index (61.4). Agentic coding, self-correction. New default in Claude Code and Copilot Pro+. |
| 2026-05-20 | Qwen 3.7 Max | Alibaba / Qwen | S | Proprietary | 1M context. AI Analysis Index 56.6 (highest Chinese score). SWE-Pro 60.6, GPQA Diamond 92.4. Announced at Alibaba Cloud Summit. |
| 2026-05-19 | Gemini 3.5 Flash | S | Proprietary | GA at Google I/O 2026. Outperforms Gemini 3.1 Pro across benchmarks at 4x the speed. Powers Antigravity 2.0. | |
| 2026-04-24 | DeepSeek V4 Pro / Flash | DeepSeek | S | Open | 1M context, Thinking and Non-Thinking modes. Open-source. API IDs: deepseek-v4-flash and deepseek-v4-pro. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Open | 1T param MoE, 32B active/token. SWE-Bench Pro 58.6. 300-agent swarm, 256K context. Modified MIT license. |
| 2026-04-08 | GLM-5.1 | Zhipu / Z.ai | A+ | Open | Open-source. Evolution of GLM-5 released on Hugging Face. Available on subscription since late March. |
| 2026-04-01 | GPT-5.5 | OpenAI | S+ | Proprietary | OpenAI flagship. AI Analysis Index 60.2. Best for creative writing. GA on Amazon Bedrock since June 2026. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | A+ | Proprietary | Four variants: Pro, Lite, Mini, Code. Powers the Doubao app with 155M weekly active users. |
| 2026-02-11 | GLM-5 | Zhipu / Z.ai | S | Open | 744B param MoE, 40B active. SWE-bench Verified 77.8%. Trained on Huawei Ascend chips. Z.ai IPO Jan 2026. |
| 2026-07-01 | DeepSeek R2 | DeepSeek | S | Upcoming | Rumored. No official release date confirmed. R1 remains the current DeepSeek reasoning model. |
Notable Trends
AI distribution is decoupling from direct-provider APIs: Codex and GPT-5.5 hitting GA on Amazon Bedrock, and Claude Code expanding Auto Mode to Bedrock, Vertex, and Foundry, signal that top labs are treating cloud marketplaces as first-class distribution channels, not secondary integrations.
Microsoft is actively severing its OpenAI dependency: Project Polaris and MAI-Thinking-1 unveiled at Build 2026 are the most explicit strategic move toward AI stack independence. When a vendor's largest reseller starts building competing models, the market enters a new phase of vertical consolidation.
GitHub Copilot's token billing shift on June 1 coincides with Anthropic's S-1 filing at $965B: both events suggest the industry is moving from adoption subsidies to real monetization. For engineering teams, this means AI assistant ROI will need to be justified in variable costs, not flat subscriptions.
Claude Opus 4.8 — nouveau modele par defaut avec capacites agentiques ameliorees
Anthropic a lance Claude Opus 4.8 le 28 mai, devenant le modele par defaut dans Claude Code. Il mene l'Artificial Analysis Intelligence Index avec 61,4, devant GPT-5.5 (60,2) et Gemini 3.1 Pro (57). Excelle dans le codage agentique a long horizon et l'autocorrection.
v2.1.160 — Confirmations de securite pour les fichiers de demarrage shell et config de build
Ajoute une confirmation obligatoire avant d'ecrire dans .zshenv, .bash_login et ~/.config/git/. Le mode acceptEdits demande aussi confirmation avant de modifier .npmrc, .yarnrc, bunfig.toml, .bazelrc et la config devcontainer. Les commandes grep/egrep sur un seul fichier satisfont maintenant la verification lecture-avant-edition.
v2.1.158 — Mode auto disponible sur Bedrock, Vertex et Foundry pour Opus 4.7 et 4.8
Le mode auto s'etend a Amazon Bedrock, Vertex AI et Azure AI Foundry pour les modeles Opus 4.7 et Opus 4.8. Activer via la variable d'environnement CLAUDE_CODE_ENABLE_AUTO_MODE=1.
v2.1.157 — Les skills se chargent automatiquement depuis .claude/skills sans marketplace
Les plugins dans les repertoires .claude/skills se chargent automatiquement sans le marketplace. Nouvelle commande claude plugin init <nom> pour creer des plugins. EnterWorktree peut changer de worktree en cours de session. Autocompletion pour les arguments de /plugin.
Anthropic depose un S-1 confidentiel aupres de la SEC et leve 65G$ en Serie H
Le 1er juin, Anthropic a depose des documents d'enregistrement confidentiels aupres de la SEC. Le 28 mai, il a leve 65G$ dans un tour de Serie H a une valorisation post-money de 965G$. Le revenu annualise depasse 47G$ avec une croissance de 130% prevue cette annee.
v0.135.0 — Diagnostics enrichis, edition vim et profils de permissions nommes
Codex CLI 0.135.0 ajoute des diagnostics enrichis dans codex doctor, les details de connexion distante dans /status, l'edition d'objets texte a la vim, et des profils de permissions nommes pour reutiliser les configurations de securite.
Codex et GPT-5.5/5.4 en disponibilite generale sur Amazon Bedrock
Depuis le 1er juin, Codex, GPT-5.5 et GPT-5.4 sont en GA sur Amazon Bedrock. L'inference herite des controles IAM, VPC, KMS et CloudTrail. Les tarifs correspondent aux tarifs directs d'OpenAI sans licences par siege, et l'usage compte pour les engagements AWS.
GPT-5.5 en GA sur Amazon Bedrock — le modele flagship d'OpenAI disponible sur AWS
GPT-5.5, le modele flagship d'OpenAI, est en disponibilite generale sur Amazon Bedrock aux cotes de GPT-5.4. Excelle dans le codage agentique et les taches autonomes multi-etapes. L'AI Intelligence Index le place a 60,2, juste derriere Claude Opus 4.8 (61,4).
GPT-4.5 se retire de ChatGPT le 27 juin — migrer vers GPT-5.5 ou GPT-5.4
OpenAI a confirme que GPT-4.5 sera retire de ChatGPT le 27 juin 2026 apres une periode de transition de 30 jours. Les equipes qui en dependent doivent planifier la migration vers GPT-5.5 ou GPT-5.4 avant cette date.
Facturation par tokens active — les credits IA remplacent le modele de requetes premium
A partir du 1er juin, GitHub Copilot facture en fonction des tokens IA traites, pas des requetes premium. Les frais dependent du modele, du volume entree/sortie, de la taille du cache et des fonctionnalites. Les budgets par utilisateur sont en GA pour les organisations. Les nouveaux abonnements aux plans Pro, Pro+ et Student sont en pause.
Claude Opus 4.8 disponible dans le selecteur de modeles pour Pro+, Business et Enterprise
Claude Opus 4.8 est maintenant disponible dans GitHub Copilot pour les abonnes Pro+, Business et Enterprise dans VS Code, Visual Studio, JetBrains, Xcode et GitHub.com — dans tous les modes: chat, ask, edit et agent.
L'API des metriques d'utilisation ajoute des cohortes d'adoption de l'IA pour les admins
L'API des metriques de Copilot inclut maintenant des cohortes d'adoption montrant comment les utilisateurs progressent d'un usage centre sur le code vers un usage agentique et multi-agent.
Project Polaris — modele de codage interne pour remplacer GPT-4 Turbo dans Copilot en aout
Microsoft a devoile Project Polaris, son premier modele de codage interne, qui remplacera GPT-4 Turbo comme modele par defaut dans GitHub Copilot a partir d'aout 2026. Utilise une architecture MoE, surpasse GPT-4 Turbo sur HumanEval et MBPP, avec des forces particulieres en Rust et Haskell.
Suite MAI v2 — MAI-Image-2.5, MAI-Voice-2, MAI-Transcribe-1.5 et MAI-Thinking-1
Microsoft a introduit quatre modeles MAI a Build 2026: MAI-Image-2.5 (generation et edition d'images), MAI-Voice-2 (15+ langues avec variation de ton emotionnel), MAI-Transcribe-1.5, et MAI-Thinking-1, le premier modele de raisonnement de Microsoft sans distillation externe.
Copilot Workspace en disponibilite generale avec flotte autonome et mode autopilot
Copilot Workspace a atteint la disponibilite generale a Build 2026. Les nouveaux modes de flotte autonome et autopilot permettent d'executer des taches de codage a grande echelle sans intervention continue. S'integre avec Azure Agent Mesh pour une execution federee.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-06-02 | Project Polaris (coding) | Microsoft | A | À venir | Modele MoE de codage interne de Microsoft. Remplace GPT-4 Turbo dans Copilot en aout 2026. |
| 2026-06-02 | MAI-Thinking-1 | Microsoft | A | À venir | Premier modele de raisonnement interne de Microsoft, sans distillation externe. Presente a Build 2026. |
| 2026-05-28 | Claude Opus 4.8 | Anthropic | S+ | Propriétaire | Leader sur l'AI Intelligence Index (61,4). Codage agentique, autocorrection. Nouveau defaut dans Claude Code et Copilot Pro+. |
| 2026-05-20 | Qwen 3.7 Max | Alibaba / Qwen | S | Propriétaire | Contexte 1M. AI Analysis Index 56,6 (meilleur score chinois). SWE-Pro 60,6, GPQA Diamond 92,4. |
| 2026-05-19 | Gemini 3.5 Flash | S | Propriétaire | GA a Google I/O 2026. Surpasse Gemini 3.1 Pro sur les benchmarks en etant 4x plus rapide. Alimente Antigravity 2.0. | |
| 2026-04-24 | DeepSeek V4 Pro / Flash | DeepSeek | S | Ouvert | Contexte 1M, modes Thinking et Non-Thinking. Open-source. API: deepseek-v4-flash et deepseek-v4-pro. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | A+ | Ouvert | 1T param MoE, 32B actifs/token. SWE-Bench Pro 58,6. Essaim de 300 sous-agents, contexte 256K. Licence MIT modifiee. |
| 2026-04-08 | GLM-5.1 | Zhipu / Z.ai | A+ | Ouvert | Open-source. Evolution de GLM-5 publiee sur Hugging Face. Disponible en abonnement depuis fin mars. |
| 2026-04-01 | GPT-5.5 | OpenAI | S+ | Propriétaire | Flagship OpenAI. AI Analysis Index 60,2. Meilleur pour l'ecriture creative. GA sur Amazon Bedrock depuis juin 2026. |
| 2026-02-14 | Doubao Seed 2.0 | ByteDance | A+ | Propriétaire | Quatre variantes: Pro, Lite, Mini, Code. Alimente l'app Doubao avec 155M utilisateurs actifs hebdomadaires. |
| 2026-02-11 | GLM-5 | Zhipu / Z.ai | S | Ouvert | 744B param MoE, 40B actifs. SWE-bench Verified 77,8%. Entraine sur chips Huawei Ascend. IPO de Z.ai en jan 2026. |
| 2026-07-01 | DeepSeek R2 | DeepSeek | S | À venir | Rumeur. Aucune date officielle confirmee. R1 reste le modele de raisonnement actuel de DeepSeek. |
Tendances Notables
La distribution de l'IA se decouple des API directes: Codex et GPT-5.5 en GA sur Amazon Bedrock, et Claude Code etendant l'Auto Mode a Bedrock, Vertex et Foundry, signalent que les grands laboratoires traitent les places de marche cloud comme des canaux de distribution de premier ordre.
Microsoft rompt activement sa dependance a OpenAI: Project Polaris et MAI-Thinking-1 presentes a Build 2026 sont le signal le plus explicite vers l'independance de la pile IA. Quand le plus grand revendeur d'un fournisseur commence a construire des modeles concurrents, le marche entre dans une nouvelle phase.
Le passage de GitHub Copilot a la facturation par tokens le 1er juin coincide avec le depot du S-1 d'Anthropic a 965G$: les deux evenements suggerent que l'industrie passe des subventions d'adoption a une monetisation reelle. Pour les equipes d'ingenierie, cela signifie que le ROI des assistants IA devra etre justifie en couts variables.