Récapitulatif quotidien des outils IA pour développeurs — 11 mai 2026
v2.1.136: hard_deny en auto-mode, fix crítico de MCP y OAuth
Agrega settings.autoMode.hard_deny para reglas de bloqueo incondicional en el clasificador de auto-mode (independiente de umbral). Corrige la desaparición de servidores MCP configurados en .mcp.json, plugins y conectores de claude.ai después de /clear. También soluciona una carrera crítica donde escrituras OAuth concurrentes sobrescribían refresh tokens, y el error HTTP 400 que aparecía cuando el pensamiento extendido emitía bloques redactados seguidos de tool calls.
v2.1.133: Effort level en hooks, worktree.baseRef y rutas de sandbox
Los hooks de shell ahora reciben el nivel de esfuerzo actual via el campo JSON effort.level y la variable de entorno $CLAUDE_EFFORT — útil para pipelines de CI/CD que adaptan comportamiento según el costo de inferencia. El nuevo setting worktree.baseRef controla desde qué rama se crea el worktree: fresh (desde la rama por defecto) o head (desde HEAD actual). Agrega también sandbox.bwrapPath y sandbox.socatPath para configurar rutas del sandbox en entornos Linux/WSL.
v0.130.0: Plugin sharing con controles de descubrimiento y control remoto headless
Los detalles del plugin ahora muestran los hooks incluidos, y el compartir plugins expone metadatos de enlace con controles de descubrimiento. El nuevo comando de control remoto permite gestionar sesiones de app-server headless desde el CLI. También se mejora la autenticación de AWS Bedrock para soportar credenciales de login de consola AWS, y la actualización de configuración de threads en vivo ya no requiere reinicio.
v0.131.0-alpha: Ciclo de pre-release activo
Las versiones alpha del ciclo v0.131.0 están activas en GitHub, señalizando que el próximo release estable está en proceso. Los primeros builds (alpha.2 y alpha.4) ya recibieron engagement positivo de la comunidad. Ciclo de release activo tras el lanzamiento estable v0.130.0 del 8 de mayo.
GPT-5.5 Instant: 52% menos alucinaciones, nuevo default de ChatGPT
OpenAI actualizó el modelo por defecto de ChatGPT a GPT-5.5 Instant el 5 de mayo. Produce un 52,5% menos de afirmaciones alucinadas que GPT-5.3 Instant en prompts de alto riesgo (medicina, derecho, finanzas), usa 30% menos palabras y mejora la personalización desde chats previos, archivos y Gmail conectado. Disponible también en la API como chat-latest.
v2.81.0 (VS Code): Correcciones y mejoras menores
Actualización de mantenimiento para la extensión VS Code con correcciones de estabilidad y mejoras menores de producto. La próxima actualización significativa se espera en Google I/O 2026, programado para el 19-20 de mayo, donde Google planea anunciar la plataforma Gemini Enterprise Agent, Google Antigravity IDE y mejoras al free tier de Code Assist.
GPT-5 mini y GPT-4.1 disponibles en Copilot sin consumir créditos premium
GPT-5 mini y GPT-4.1 ahora están incluidos en todos los planes de Copilot (Business y Enterprise) sin consumir el cupo de requests premium. Esto da a los equipos acceso a modelos más ligeros para tareas cotidianas de autocompletado y chat, reservando los créditos premium para tareas de agente más intensivas.
Copilot migra a modelo de facturación por uso (usage-based billing)
GitHub anunció que Copilot está migrando a un modelo de facturación por uso, reflejando la evolución de la herramienta desde el autocompletado simple hasta workflows agénticos más complejos con mayor demanda de cómputo. Los planes actuales se mantienen activos durante el período de transición.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-05-05 | GPT-5.5 Instant | OpenAI | A | Propietario | Nuevo default de ChatGPT. 52,5% menos alucinaciones vs. GPT-5.3 Instant, 30% más conciso, personalización mejorada desde historial y Gmail. |
| 2026-04-24 | DeepSeek V4 / V4-Pro | DeepSeek | S | Abierto | Ventana de contexto nativa de 1M tokens, entrenado en más de 32T tokens. V4-Pro con razonamiento extendido. Primer modelo en hacer usable en producción el contexto ultra-largo. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | A+ | Abierto | Denso de 27B. 77,2 en SWE-bench Verified, 59,3 en Terminal-Bench 2.0. Supera al MoE de 397B en varias tareas. Apache 2.0. |
| 2026-04-20 | Kimi K2.6 | Moonshot / Kimi | S | Abierto | MoE de 1T params (32B activos). Escala hasta 300 sub-agentes coordinados y 4.000 pasos autónomos. Añade entrada de video nativa. MIT modificada. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S | Propietario | Flagship propietario. Lidera 6 benchmarks de coding. Score de 52 en AA Intelligence Index (mayor de cualquier modelo chino). Arquitectura MoE, 35B totales, 3B activos. |
| 2026-04-16 | Qwen3.6-35B-A3B | Alibaba / Qwen | A+ | Abierto | MoE de 35B totales, 3B activos. Supera al Qwen3.5-397B-A17B en varios benchmarks de agentes. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | 64,3% en SWE-bench Pro (récord global #1), 87,6% en SWE-bench Verified. Nuevo nivel xhigh de esfuerzo entre high y max. Visión 3x mayor resolución. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | S | Abierto | Open-source desde el 8 de abril. 58,4 en SWE-bench Pro. MoE de 744B (40B activos). Foco en coding y tareas agenticas de largo alcance. MIT. |
| 2026-06-01 | GPT-6 | OpenAI | S+ | Próximo | Esperado mayo-julio 2026. Primer modelo GPT con arquitectura base completamente reentrenada desde GPT-4.5. |
| 2026-07-01 | Claude 5 (Fennec) | Anthropic | S+ | Próximo | Nombre clave interno: Fennec. Esperado mayo-septiembre 2026. |
| 2026-06-01 | Llama 4 | S | Próximo | Anunciado pero con retrasos. Esperado antes de agosto 2026. |
Tendencias Destacadas
Seguridad en credential management encabeza los fix lists: tanto Claude Code (v2.1.136) como Codex CLI (v0.130.0) parchearon esta semana condiciones de carrera en escrituras concurrentes de tokens OAuth. A medida que ambas plataformas ganan uso en equipos empresariales con múltiples sesiones paralelas, las race conditions en auth se están convirtiendo en el punto de falla más frecuente.
Los ecosistemas de plugins están madurando rápidamente. Codex CLI suma plugin sharing con controles de descubrimiento y visualización de hooks incluidos en la ficha del plugin; Claude Code ya soporta carga por URL. Ambas plataformas están construyendo infraestructura de marketplace que transformará cómo los equipos distribuyen configuraciones personalizadas de agentes.
Los hooks se están convirtiendo en la capa de integración CI/CD para los coding agents: con Claude Code v2.1.133 exponiendo el effort level en hooks via <code>$CLAUDE_EFFORT</code>, los pipelines pueden ahora adaptar su comportamiento (timeouts, alertas, costos) en función del nivel de inferencia solicitado, sin necesidad de instrumentación adicional.
v2.1.136: hard_deny in auto-mode, critical MCP and OAuth fixes
Adds settings.autoMode.hard_deny for unconditional classifier blocking rules in auto-mode (threshold-independent). Fixes MCP servers configured in .mcp.json, plugins, and claude.ai connectors disappearing after /clear. Also resolves a critical race where concurrent OAuth credential writes overwrote refresh tokens, and the HTTP 400 error when extended thinking emits redacted blocks followed by tool calls.
v2.1.133: Effort level in hooks, worktree.baseRef, and sandbox paths
Shell hooks now receive the current effort level via the effort.level JSON field and the $CLAUDE_EFFORT environment variable — useful for CI/CD pipelines that adapt behavior to inference cost. New worktree.baseRef setting controls the worktree base: fresh (branch from default) or head (branch from current HEAD). Also adds sandbox.bwrapPath and sandbox.socatPath managed settings for configuring sandbox paths in Linux/WSL environments.
v0.130.0: Plugin sharing with discoverability controls and headless remote control
Plugin details now display bundled hooks, and plugin sharing exposes link metadata with discoverability controls. A new remote-control command enables managing headless app-server sessions from the CLI. AWS Bedrock authentication is enhanced to support console-login credentials from aws login profiles, and live thread config changes no longer require a restart.
v0.131.0-alpha: Pre-release cycle now active
Alpha builds in the v0.131.0 cycle are live on GitHub, signaling the next stable release is in development. Early builds (alpha.2 and alpha.4) are already drawing positive community engagement. Active release cycle follows the v0.130.0 stable launch on May 8.
GPT-5.5 Instant: 52% fewer hallucinations, new ChatGPT default model
OpenAI updated ChatGPT's default model to GPT-5.5 Instant on May 5. It produces 52.5% fewer hallucinated claims than GPT-5.3 Instant on high-stakes prompts covering medicine, law, and finance, uses 30% fewer words, and improves personalization from past chats, files, and connected Gmail. Also available in the API as chat-latest.
v2.81.0 (VS Code): Bug fixes and minor enhancements
Maintenance update to the VS Code extension with stability fixes and minor product improvements. The next significant update is expected at Google I/O 2026, scheduled for May 19-20, where Google plans to announce the Gemini Enterprise Agent Platform, Google Antigravity IDE, and improvements to the Code Assist free tier.
GPT-5 mini and GPT-4.1 available in Copilot without consuming premium requests
GPT-5 mini and GPT-4.1 are now included with all Copilot subscriptions (Business and Enterprise) without consuming premium request quotas. This gives teams access to lighter models for everyday completions and chat, preserving premium credits for more intensive agentic tasks.
Copilot transitioning to usage-based billing model
GitHub announced that Copilot is moving to a usage-based billing model, reflecting the tool's evolution from simple code completion into advanced agentic workflows that require significantly more compute. Current plans remain active during the transition period.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-05 | GPT-5.5 Instant | OpenAI | A | Proprietary | New ChatGPT default. 52.5% fewer hallucinations vs. GPT-5.3 Instant, 30% more concise, enhanced personalization from history and Gmail. |
| 2026-04-24 | DeepSeek V4 / V4-Pro | DeepSeek | S | Open | Native 1M-token context window, trained on 32T+ tokens. V4-Pro with extended reasoning. First model to make ultra-long context production-ready. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | A+ | Open | Dense 27B model. 77.2 on SWE-bench Verified, 59.3 on Terminal-Bench 2.0. Outperforms the 397B MoE on several tasks. Apache 2.0. |
| 2026-04-20 | Kimi K2.6 | Moonshot / Kimi | S | Open | 1T-param MoE (32B active). Scales to 300 coordinated sub-agents and 4,000 autonomous steps. Adds native video input. Modified MIT license. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S | Proprietary | Proprietary flagship. Tops 6 coding benchmarks. Score 52 on AA Intelligence Index (highest of any Chinese model). MoE architecture, 35B total, 3B active. |
| 2026-04-16 | Qwen3.6-35B-A3B | Alibaba / Qwen | A+ | Open | MoE with 35B total, 3B active. Outperforms Qwen3.5-397B-A17B on several agentic benchmarks. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | 64.3% on SWE-bench Pro (global #1), 87.6% on SWE-bench Verified. New xhigh effort level between high and max. 3x higher resolution vision. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | S | Open | Open-sourced April 8. 58.4 on SWE-bench Pro. 744B MoE (40B active). Focused on coding and long-horizon agentic tasks. MIT license. |
| 2026-06-01 | GPT-6 | OpenAI | S+ | Upcoming | Expected May-July 2026. First GPT model with a fully retrained base architecture since GPT-4.5. |
| 2026-07-01 | Claude 5 (Fennec) | Anthropic | S+ | Upcoming | Internal codename: Fennec. Expected May-September 2026. |
| 2026-06-01 | Llama 4 | S | Upcoming | Announced but delayed. Expected before August 2026. |
Notable Trends
Credential management security tops the fix lists: both Claude Code (v2.1.136) and Codex CLI (v0.130.0) patched concurrent OAuth token write race conditions this week. As both platforms see broader enterprise adoption with parallel sessions, auth race conditions are emerging as the most frequent failure point.
Plugin ecosystems are maturing fast. Codex CLI adds plugin sharing with discoverability controls and bundled-hook display in the plugin card; Claude Code already supports URL-based loading. Both platforms are building marketplace infrastructure that will transform how teams distribute custom agent configurations.
Hooks are becoming the CI/CD integration layer for coding agents: with Claude Code v2.1.133 exposing effort level in hooks via <code>$CLAUDE_EFFORT</code>, pipelines can now adapt behavior (timeouts, alerts, cost tracking) based on the requested inference level without additional instrumentation.
v2.1.136 : hard_deny en auto-mode, correctifs MCP et OAuth critiques
Ajoute settings.autoMode.hard_deny pour des règles de blocage inconditionnel dans le classificateur auto-mode. Corrige la disparition des serveurs MCP après /clear, la course critique d'écriture OAuth concurrente, et l'erreur HTTP 400 avec les blocs redacted du mode thinking étendu.
v2.1.133 : Niveau d'effort dans les hooks, worktree.baseRef et chemins sandbox
Les hooks shell reçoivent maintenant le niveau d'effort via effort.level JSON et $CLAUDE_EFFORT — utile pour les pipelines CI/CD qui adaptent leur comportement selon le coût d'inférence. Le nouveau paramètre worktree.baseRef contrôle la base du worktree : fresh ou head. Ajoute aussi sandbox.bwrapPath et sandbox.socatPath pour Linux/WSL.
v0.130.0 : Partage de plugins avec contrôles de découverte et contrôle headless
Les détails des plugins affichent maintenant les hooks intégrés, et le partage de plugins expose les métadonnées de lien avec des contrôles de découverte. Une nouvelle commande de contrôle à distance gère les sessions app-server headless. L'auth AWS Bedrock supporte les credentials de connexion console, et les configs de thread se mettent à jour sans redémarrage.
v0.131.0-alpha : Cycle de pré-release actif
Les builds alpha du cycle v0.131.0 sont disponibles sur GitHub, signalant que le prochain release stable est en développement. Les premiers builds (alpha.2 et alpha.4) reçoivent un engagement positif de la communauté.
GPT-5.5 Instant : 52 % d'hallucinations en moins, nouveau modèle par défaut ChatGPT
OpenAI a mis à jour le modèle par défaut de ChatGPT vers GPT-5.5 Instant le 5 mai. Il produit 52,5 % de moins d'affirmations hallucinées que GPT-5.3 Instant, utilise 30 % moins de mots et améliore la personnalisation depuis les chats précédents et Gmail. Disponible aussi dans l'API en tant que chat-latest.
v2.81.0 (VS Code) : Corrections et améliorations mineures
Mise à jour de maintenance de l'extension VS Code avec des corrections de stabilité et des améliorations mineures. La prochaine mise à jour majeure est attendue lors de Google I/O 2026, prévu les 19-20 mai, avec la plateforme Gemini Enterprise Agent et Antigravity IDE.
GPT-5 mini et GPT-4.1 disponibles dans Copilot sans consommer de crédits premium
GPT-5 mini et GPT-4.1 sont maintenant inclus dans tous les abonnements Copilot (Business et Enterprise) sans consommer les quotas de requêtes premium. Cela donne aux équipes accès à des modèles légers pour les complétions et le chat quotidien, tout en préservant les crédits premium pour les tâches agentiques.
Copilot passe à un modèle de facturation à l'usage
GitHub a annoncé que Copilot migre vers un modèle de facturation à l'usage, reflétant l'évolution de l'outil depuis la complétion simple vers des workflows agentiques avancés nécessitant plus de calcul. Les plans actuels restent actifs pendant la période de transition.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-05-05 | GPT-5.5 Instant | OpenAI | A | Propriétaire | Nouveau défaut ChatGPT. 52,5 % moins d'hallucinations vs. GPT-5.3 Instant, 30 % plus concis, personnalisation améliorée. |
| 2026-04-24 | DeepSeek V4 / V4-Pro | DeepSeek | S | Ouvert | Fenêtre de contexte native de 1M tokens, entraîné sur 32T+ tokens. V4-Pro avec raisonnement étendu. Premier modèle à rendre le contexte ultra-long utilisable en production. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | A+ | Ouvert | Modèle dense 27B. 77,2 sur SWE-bench Verified, 59,3 sur Terminal-Bench 2.0. Surpasse le MoE de 397B sur plusieurs tâches. Apache 2.0. |
| 2026-04-20 | Kimi K2.6 | Moonshot / Kimi | S | Ouvert | MoE de 1T paramètres (32B actifs). Scale à 300 sous-agents coordonnés et 4 000 étapes autonomes. Ajoute l'entrée vidéo native. Licence MIT modifiée. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S | Propriétaire | Flagship propriétaire. Premier sur 6 benchmarks de coding. Score 52 sur l'AA Intelligence Index (le plus élevé de tout modèle chinois). MoE 35B total, 3B actifs. |
| 2026-04-16 | Qwen3.6-35B-A3B | Alibaba / Qwen | A+ | Ouvert | MoE 35B total, 3B actifs. Surpasse le Qwen3.5-397B-A17B sur plusieurs benchmarks agentiques. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | 64,3 % sur SWE-bench Pro (record mondial #1), 87,6 % sur SWE-bench Verified. Nouveau niveau d'effort xhigh. Vision 3x plus haute résolution. |
| 2026-04-08 | GLM-5.1 | Z.ai / Zhipu | S | Ouvert | Open-sourcé le 8 avril. 58,4 sur SWE-bench Pro. MoE 744B (40B actifs). Axé sur le coding et les tâches agentiques à long horizon. Licence MIT. |
| 2026-06-01 | GPT-6 | OpenAI | S+ | À venir | Attendu mai-juillet 2026. Premier modèle GPT avec architecture de base entièrement réentraînée depuis GPT-4.5. |
| 2026-07-01 | Claude 5 (Fennec) | Anthropic | S+ | À venir | Nom de code interne : Fennec. Attendu mai-septembre 2026. |
| 2026-06-01 | Llama 4 | S | À venir | Annoncé mais retardé. Attendu avant août 2026. |
Tendances Notables
La sécurité des credentials domine les listes de correctifs : Claude Code (v2.1.136) et Codex CLI (v0.130.0) ont tous deux corrigé cette semaine des conditions de course lors d'écritures OAuth concurrentes. Ces races conditions deviennent le point de défaillance le plus fréquent avec l'adoption enterprise croissante.
Les écosystèmes de plugins mûrissent rapidement. Codex CLI ajoute le partage de plugins avec contrôles de découverte ; Claude Code supporte déjà le chargement par URL. Les deux plateformes construisent une infrastructure de marketplace qui transformera la distribution de configurations d'agents.
Les hooks deviennent la couche d'intégration CI/CD pour les agents de coding : avec Claude Code v2.1.133 exposant le niveau d'effort via <code>$CLAUDE_EFFORT</code>, les pipelines peuvent adapter leur comportement (timeouts, alertes, coûts) selon le niveau d'inférence demandé.