Resumen IA coding — 27 abr 2026
TTL de caché de 1 hora + contexto de sesión con /recap
Claude Code añadió la variable de entorno ENABLE_PROMPT_CACHING_1H para habilitar un TTL de caché de 1 hora en API key, Bedrock, Vertex y Foundry. El nuevo comando /recap provee contexto al retomar una sesión, configurable en /config.
Modo auto para suscriptores Max + esfuerzo xhigh en Opus 4.7
El modo auto ya está disponible para suscriptores Max con Opus 4.7. El nuevo nivel de esfuerzo xhigh se ubica entre high y max, ideal para tareas agentivas largas sin pagar el costo máximo.
v0.125.0 — transporte Unix socket + reporte de reasoning tokens
Las integraciones de app-server ganan transporte Unix socket y entornos persistentes. codex exec --json ahora reporta el uso de reasoning tokens. Los perfiles de permisos persisten entre sesiones TUI, turnos de usuario y APIs de app-server.
v0.124.0 — controles de razonamiento en TUI, integración Bedrock, sesiones multi-entorno
Controles rápidos de razonamiento en la TUI: Alt+, baja la intensidad, Alt+. la sube, sin salir del terminal. Soporte multi-entorno en sesiones app-server e integración con Amazon Bedrock.
GPT-5.5 — 82.7% Terminal-Bench 2.0, el mejor coder agentivo hasta ahora
OpenAI lanzó GPT-5.5 el 23 de abril. Logra 82.7% en Terminal-Bench 2.0, el mejor resultado registrado en benchmarks de flujos de trabajo en línea de comandos. Disponible en ChatGPT y la plataforma Codex.
gpt-image-2 — primer modelo de imagen de OpenAI con razonamiento nativo
Lanzado el 21 de abril como gpt-image-2 en la API. Primer modelo de imagen de OpenAI con razonamiento nativo, ideal para pipelines de diseño a código y prototipos visuales.
Gemini 3.1 Pro + 3.0 Flash disponibles en Code Assist (Preview)
Gemini 3.1 Pro y Gemini 3.0 Flash ya están disponibles en Code Assist para VS Code e IntelliJ (Preview). Ambos modelos soportan modo agente, chat y generación de código.
VS Code 2.77.1 — logs del modo agente ahora atribuidos a Gemini Code Assist
La extensión VS Code 2.77.1 corrige los logs de uso del modo agente que se atribuían incorrectamente a Gemini CLI. Los usuarios en versiones anteriores pueden ver métricas de uso incorrectas en sus dashboards.
Pausan nuevas suscripciones Pro/Pro+/Student por costos del uso agentivo
Desde el 20 de abril, GitHub pausó nuevas suscripciones a Copilot Pro, Pro+ y Student. Las sesiones agentivas de larga duración consumen mucho más cómputo del previsto por la tarifa plana. Copilot Free sigue abierto. Los modelos Opus se eliminaron del plan Pro (siguen en Pro+).
GPT-5.5 llega a Copilot; modo agente inline en JetBrains entra en preview
GPT-5.5 se está desplegando en GitHub Copilot desde el 24 de abril. Los IDEs de JetBrains ganan modo agente inline (preview) con Next Edit Suggestions mejoradas y auto-aprobación global.
Dashboard global de PRs por defecto; debugging de stack traces en el chat web
El Dashboard global de PRs es ahora predeterminado para todos (opt-out). El chat web de Copilot mejora la identificación de causas raíz con análisis de stack traces. Las sesiones de agentes en la nube son visibles desde issues y proyectos.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-04-24 | GPT-5.5 | OpenAI | S+ | Propietario | Mejor coder agentivo; 82.7% Terminal-Bench 2.0. Disponible en ChatGPT y Codex. |
| 2026-04-24 | DeepSeek V4 Pro | DeepSeek | S | Abierto | 1.6T params MoE, 49B activos, 1M contexto. Cierra brecha con frontera. $0.145/$3.48 por MTok. |
| 2026-04-24 | DeepSeek V4 Flash | DeepSeek | A+ | Abierto | 284B params MoE, 13B activos, 1M contexto. Muy bajo costo: $0.14/$0.28 por MTok. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | S | Abierto | Denso 27B, Apache 2.0. SWE-bench Verified 77.2. Contexto 262K nativo, 1M con YaRN. |
| 2026-04-21 | Kimi K2.6 | Moonshot AI | S | Abierto | 1T MoE, 32B activos. SWE-bench Pro 58.6. 300 agentes paralelos, sesiones autónomas de 12h. Licencia MIT en HuggingFace. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S+ | Propietario | #1 en SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenClawBench, QwenWebBench y SciCode. Contexto 256K. Preview. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | 64.3% SWE-bench Pro, 87.6% SWE-bench Verified. Nuevo nivel xhigh. $5/$25 por MTok. |
| 2026-04-07 | GLM-5.1 | Z.ai / Zhipu | S | Abierto | 754B MoE, licencia MIT. 58.4 SWE-bench Pro (#1 al lanzamiento). Bucles autónomos de 8h. |
Tendencias Destacadas
Los modelos open-source alcanzan paridad con los de frontera a un ritmo récord. Kimi K2.6 (1T params), DeepSeek V4 Pro (1.6T params) y Qwen3.6-27B se lanzaron esta semana con scores en SWE-bench que igualan o superan a los modelos cerrados, a una fracción del costo de inferencia.
Los costos del cómputo agentivo están remodelando los precios SaaS. La pausa en suscripciones de GitHub Copilot es la señal más clara: las tarifas planas no pueden absorber sesiones agentivas de larga duración. La facturación por tokens o por uso será la norma en los próximos 6 meses.
Las ventanas de contexto convergen hacia 1 millón de tokens como base. Tanto DeepSeek V4 Flash como V4 Pro tienen 1M de contexto por defecto. Los desarrolladores que construyen pipelines de RAG o arquitecturas agentivas deberían revisar sus estrategias de chunking y recuperación.
1-hour prompt cache TTL + /recap session context
Claude Code added the ENABLE_PROMPT_CACHING_1H env var to opt into a 1-hour prompt cache TTL across API key, Bedrock, Vertex, and Foundry. A new /recap command provides session context when returning to an existing conversation — configurable in /config and manually invocable at any time.
Auto mode for Max subscribers + xhigh effort on Opus 4.7
Auto mode is now available for Max subscribers when using Opus 4.7. A new xhigh effort level was added sitting between high and max, offering a new performance tier for long-running agent tasks without jumping to max compute cost.
v0.125.0 — Unix socket transport + reasoning-token reporting
App-server integrations gain Unix socket transport, pagination-friendly resume/fork, and sticky environments. codex exec --json now reports reasoning-token usage for programmatic consumers. Permission profiles now persist across TUI sessions, user turns, and app-server APIs — addressing a common frustration with session resets.
v0.124.0 — TUI reasoning controls (Alt+,/.), Bedrock integration, multi-env sessions
Quick reasoning controls land in the TUI: Alt+, lowers reasoning intensity, Alt+. raises it — adjustable without leaving the terminal. Multi-environment support added to app-server sessions, plus Amazon Bedrock account state integration and hook stability improvements.
GPT-5.5 — 82.7% Terminal-Bench 2.0, strongest agentic coder yet
OpenAI released GPT-5.5 on April 23, achieving state-of-the-art 82.7% on Terminal-Bench 2.0 — the benchmark for complex command-line workflows. Available in ChatGPT and the Codex platform. Excels at writing and debugging code, researching online, analyzing data, operating software, and autonomous multi-tool task completion.
gpt-image-2 (ChatGPT Images 2.0) — first OpenAI image model with native reasoning
Released April 21 as gpt-image-2 via API. ChatGPT Images 2.0 is the first OpenAI image model with native reasoning capabilities — useful for developers building design-to-code pipelines and visual UI prototyping workflows.
Gemini 3.1 Pro + 3.0 Flash now available in Code Assist (Preview)
Gemini 3.1 Pro and Gemini 3.0 Flash are now available to Code Assist users in VS Code and IntelliJ as a preview. Both models support agent mode, chat, and code generation workflows — giving developers access to the latest Gemini generation without leaving their IDE.
VS Code 2.77.1 — agent mode logs now attributed to Gemini Code Assist (not Gemini CLI)
VS Code extension 2.77.1 fixes agent mode usage logs incorrectly attributed to Gemini CLI instead of Gemini Code Assist. Users on older versions may see skewed usage metrics in their dashboards. Update recommended for accurate billing and quota tracking.
Pro/Pro+/Student signups paused — agentic compute costs overwhelm plan economics
Effective April 20, GitHub paused new signups for Copilot Pro, Pro+, and Student plans. Agentic long-running parallelized sessions now routinely consume far more compute than the flat-rate pricing structure was built to support. Copilot Free remains open. Existing subscribers keep access; Opus models removed from Pro (still available on Pro+).
GPT-5.5 rolls out in Copilot; JetBrains inline agent mode enters preview
GPT-5.5 is rolling out across GitHub Copilot from April 24. JetBrains IDEs gain inline agent mode (preview) alongside enhanced Next Edit Suggestions and global auto-approve capabilities — bringing JetBrains feature parity closer to the VS Code experience.
Global PR Dashboard is default; Stack Trace Debugging in web Copilot Chat
The Global PR Dashboard transitions to opt-out public preview — now default for all users. Web-based Copilot Chat improves error root-cause identification via stack trace debugging. Cloud agent sessions are now viewable and controllable directly from GitHub Issues and Projects.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-04-24 | GPT-5.5 | OpenAI | S+ | Proprietary | Strongest agentic coder; 82.7% Terminal-Bench 2.0. In ChatGPT + Codex. |
| 2026-04-24 | DeepSeek V4 Pro | DeepSeek | S | Open | 1.6T params MoE, 49B active, 1M context. Closes gap with frontier. $0.145/$3.48 per MTok. |
| 2026-04-24 | DeepSeek V4 Flash | DeepSeek | A+ | Open | 284B params MoE, 13B active, 1M context. Ultra-low cost: $0.14/$0.28 per MTok. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | S | Open | Dense 27B, Apache 2.0. SWE-bench Verified 77.2, Terminal-Bench 59.3. 262K context native, 1M via YaRN. |
| 2026-04-21 | Kimi K2.6 | Moonshot AI | S | Open | 1T MoE, 32B active. SWE-bench Pro 58.6. 300 parallel agents, 12-hr autonomous sessions. MIT license on HuggingFace. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S+ | Proprietary | #1 on SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenClawBench, QwenWebBench, SciCode. 256K context. Preview. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | 64.3% SWE-bench Pro, 87.6% SWE-bench Verified. New xhigh effort level. $5/$25 per MTok. |
| 2026-04-07 | GLM-5.1 | Z.ai / Zhipu | S | Open | 754B MoE, MIT license. 58.4 SWE-bench Pro (#1 at launch). 8-hr autonomous agent loops. |
Notable Trends
Open-source models are reaching frontier parity at record pace. Kimi K2.6 (1T params), DeepSeek V4 Pro (1.6T params), and Qwen3.6-27B all shipped this week with SWE-bench scores matching or beating closed-source leaders — at a fraction of inference cost. The era of proprietary moats is compressing fast.
Agentic compute costs are reshaping SaaS pricing. GitHub Copilot's signup pause is the clearest signal yet: flat-rate subscriptions cannot absorb long-running, parallelized agent sessions. Expect token-based or usage-tiered billing to become the norm across AI coding tools in the next 6 months.
Context windows are converging toward 1 million tokens as a baseline. Both DeepSeek V4 Flash and V4 Pro ship with 1M-token context by default — a capability that was frontier-only six months ago. Developers building RAG pipelines or long-horizon agent architectures should reassess their chunking and retrieval strategies.
TTL cache 1h + contexte de session /recap
Claude Code ajoute ENABLE_PROMPT_CACHING_1H pour un TTL cache d'1 heure sur API key, Bedrock, Vertex et Foundry. La commande /recap fournit le contexte de session lors d'une reprise.
Mode auto pour abonnés Max + effort xhigh sur Opus 4.7
Le mode auto est disponible pour les abonnés Max avec Opus 4.7. Le nouveau niveau d'effort xhigh se place entre high et max.
v0.125.0 — transport Unix socket + rapport de tokens de raisonnement
Les intégrations app-server gagnent le transport Unix socket et des environnements persistants. codex exec --json rapporte désormais les tokens de raisonnement. Les profils de permissions persistent entre les sessions TUI.
v0.124.0 — contrôles raisonnement TUI (Alt+,/.), intégration Bedrock, sessions multi-env
Contrôles rapides dans le TUI : Alt+, réduit l'intensité, Alt+. l'augmente sans quitter le terminal. Support multi-environnement et intégration Amazon Bedrock.
GPT-5.5 — 82.7% Terminal-Bench 2.0, meilleur modèle agentique
OpenAI a lancé GPT-5.5 le 23 avril avec 82.7% sur Terminal-Bench 2.0, le meilleur score jamais enregistré. Disponible dans ChatGPT et la plateforme Codex.
gpt-image-2 — premier modèle image OpenAI avec raisonnement natif
Lancé le 21 avril comme gpt-image-2 via l'API. Premier modèle image OpenAI avec raisonnement natif — utile pour les pipelines design-to-code et les prototypes UI.
Gemini 3.1 Pro + 3.0 Flash disponibles dans Code Assist (Preview)
Gemini 3.1 Pro et Gemini 3.0 Flash sont disponibles dans Code Assist pour VS Code et IntelliJ (Preview). Les deux supportent le mode agent, le chat et la génération de code.
VS Code 2.77.1 — logs du mode agent correctement attribués à Gemini Code Assist
L'extension VS Code 2.77.1 corrige les logs d'utilisation du mode agent, incorrectement attribués à Gemini CLI. Les utilisateurs d'anciennes versions peuvent voir des métriques faussées.
Inscriptions Pro/Pro+/Student suspendues — les coûts agentiques débordent le modèle tarifaire
Depuis le 20 avril, GitHub suspend les nouvelles inscriptions aux plans Pro, Pro+ et Student. Les sessions agentiques longue durée consomment bien plus que prévu par le forfait. Copilot Free reste ouvert. Modèles Opus retirés du plan Pro (disponibles en Pro+).
GPT-5.5 déployé dans Copilot ; mode agent inline JetBrains en preview
GPT-5.5 se déploie dans GitHub Copilot depuis le 24 avril. Les IDEs JetBrains gagnent le mode agent inline (preview) avec des suggestions d'édition améliorées et l'auto-approbation globale.
Dashboard PR global par défaut ; débogage stack trace dans le chat web
Le tableau de bord PR global devient la valeur par défaut (opt-out). Le chat Copilot web améliore l'identification des causes d'erreurs via les stack traces. Les sessions d'agents cloud visibles depuis Issues et Projects.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-04-24 | GPT-5.5 | OpenAI | S+ | Propriétaire | Meilleur modèle agentique; 82.7% Terminal-Bench 2.0. Dans ChatGPT + Codex. |
| 2026-04-24 | DeepSeek V4 Pro | DeepSeek | S | Ouvert | 1,6T params MoE, 49B actifs, 1M tokens. Comble l'écart. $0,145/$3,48 par MTok. |
| 2026-04-24 | DeepSeek V4 Flash | DeepSeek | A+ | Ouvert | 284B params MoE, 13B actifs, 1M tokens. Prix ultra-bas : $0,14/$0,28 par MTok. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | S | Ouvert | Dense 27B, Apache 2.0. SWE-bench Verified 77.2. Contexte 262K natif, 1M via YaRN. |
| 2026-04-21 | Kimi K2.6 | Moonshot AI | S | Ouvert | 1T MoE, 32B actifs. SWE-bench Pro 58.6. 300 agents parallèles, sessions de 12h. Licence MIT sur HuggingFace. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S+ | Propriétaire | #1 sur SWE-bench Pro, Terminal-Bench 2.0, SkillsBench, QwenClawBench, QwenWebBench et SciCode. Contexte 256K. Preview. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | 64.3% SWE-bench Pro, 87.6% SWE-bench Verified. Nouveau niveau xhigh. $5/$25 par MTok. |
| 2026-04-07 | GLM-5.1 | Z.ai / Zhipu | S | Ouvert | 754B MoE, licence MIT. 58.4 SWE-bench Pro (#1 au lancement). Boucles autonomes de 8h. |
Tendances Notables
Les modèles open-source atteignent une parité avec les leaders à un rythme record. Kimi K2.6, DeepSeek V4 Pro et Qwen3.6-27B ont tous été lancés cette semaine avec des scores SWE-bench comparables aux modèles fermés, pour une fraction du coût d'inférence.
Les coûts de calcul agentique reforment les modèles SaaS. La pause des inscriptions Copilot est le signal le plus clair : les abonnements forfaitaires ne peuvent pas absorber les sessions agents longue durée. La facturation à l'usage deviendra la norme.
Les fenêtres de contexte convergent vers 1 million de tokens comme plancher. DeepSeek V4 Flash et V4 Pro embarquent tous deux 1M tokens par défaut. Les développeurs en RAG ou agents longue durée devraient réévaluer leurs stratégies de découpage et de récupération.