Synthèse Quotidienne des Outils IA pour Développeurs — 28 avril 2026
v2.1.121 — MCP alwaysLoad, plugin prune y fixes de memoria
Lanzado hoy con mejoras clave: alwaysLoad en la config de MCP para saltear el tool-search diferido; claude plugin prune para limpiar dependencias huérfanas; buscador type-to-filter en /skills; y diálogos scrollables con flechas en fullscreen. Se corrigieron memory leaks en /usage (~2 GB en transcripts largos) y un crash en bash cuando el directorio inicial se elimina en sesión. Los MCP servers con errores transitorios ahora se reintentan hasta 3 veces automáticamente.
v2.1.119 — /config persiste, --from-pr multi-plataforma, PowerShell auto-approve
Los ajustes de /config ahora se persisten en ~/.claude/settings.json con jerarquía de precedencia. --from-pr soporta GitLab, Bitbucket y GitHub Enterprise. Los comandos PowerShell se pueden auto-aprobar. Los hooks incluyen duration_ms (tiempo de ejecución de herramientas). El modo --print ahora respeta los frontmatter tools: y disallowedTools: de los agentes.
v2.1.118 — Vim visual mode, /usage unificado, custom themes JSON
Vim visual mode (v) y visual-line mode (V) con operadores completos. /cost y /stats fusionados en el nuevo /usage. Temas personalizados via /theme con soporte de archivos JSON. Los hooks ahora pueden invocar MCP tools directamente via type: "mcp_tool". Nueva variable DISABLE_UPDATES para bloquear todas las rutas de actualización. Soporte $defaults en autoMode.allow y autoMode.soft_deny.
Lanzamiento: Claude Design — visual sin herramientas de diseño
Claude Design permite crear prototipos, presentaciones, one-pagers y assets visuales mediante prompts conversacionales — sin necesitar herramientas de diseño. Corre sobre Opus 4.7, puede leer codebases y design systems para mantener consistencia visual, y exporta a PDF, URL, PPTX o Canva (donde los archivos son editables y colaborativos). Disponible en research preview para suscriptores Pro, Max, Team y Enterprise. Anthropic lo posiciona como complementario a Canva, no competitivo.
Codex CLI v0.125.0 — Unix socket, permission profiles y Bedrock GA
Unix socket transport para integraciones app-server con resume/fork paginable. Permission profiles que persisten entre sesiones TUI y estados MCP sandbox. Amazon Bedrock con AWS SigV4 y credenciales AWS (ya GA). codex exec --json ahora reporta uso de reasoning-tokens para consumidores programáticos. Las builds alpha 0.126.0 continúan llegando — la más reciente fue el 27 de abril.
Codex CLI v0.124.0 — Reasoning TUI controls, multi-env y GPT-5.5 por defecto
Quick reasoning controls en el TUI: Alt+, baja el nivel de reasoning, Alt+. lo sube; los upgrades de modelo resetean el reasoning al default del nuevo modelo. Las sesiones app-server ahora soportan múltiples entornos y permiten elegir directorio de trabajo por turno. GPT-5.5 agregado como modelo recomendado para tareas complejas. Browser use disponible en el Codex App para servidores de desarrollo locales.
GPT-5.5 — mayor inteligencia sin sacrificar velocidad
OpenAI lanzó GPT-5.5 el 23 de abril, posicionándolo como su modelo más inteligente e intuitivo. Mejora el coding agéntico, opera software, mueve datos entre herramientas y usa significativamente menos tokens para completar las mismas tareas de Codex que su predecesor — sin sacrificar velocidad (igual latencia por token que GPT-5.4). Ya está disponible en ChatGPT, Codex y GitHub Copilot (GA desde el 24 de abril en Copilot).
gpt-image-2 — primer modelo de imagen OpenAI con razonamiento nativo
Lanzado el 21 de abril via API como gpt-image-2. Soporta resolución 2K, aspect ratios de 3:1 a 1:3, y genera hasta 8 imágenes coherentes desde un solo prompt con continuidad de personajes y objetos entre el batch. Es el primer modelo de imagen de OpenAI con capacidades de razonamiento nativo integradas.
Code Assist 2.79.0 y Gemini 3.1 Pro disponible en preview
VS Code Gemini Code Assist 2.79.0 (22 abr) con bug fixes y mejoras menores. Más significativo: Gemini 3.1 Pro y Gemini 3.0 Flash ahora disponibles en preview para usuarios de Code Assist en VS Code e IntelliJ — para agent mode, chat y generación de código. Google también migró el backend de Cloud Assist a geminicloudassist.googleapis.com el 16 de abril.
Gemini 3.1 Flash-Lite — 2.5x más rápido a menor precio
Google lanzó Gemini 3.1 Flash-Lite este mes con tiempos de respuesta 2.5x más rápidos y generación de output 45% más veloz que versiones anteriores, a un precio significativamente menor. Ideal para tareas de alto volumen y baja latencia en pipelines de desarrollo. Google también consolidó su plataforma de agentes enterprise bajo Vertex AI como Gemini Enterprise Agent Platform, con soporte para más de 200 modelos incluyendo Claude de Anthropic.
GPT-5.5 GA en Copilot y cloud agent 20% más rápido
GPT-5.5 ya es generally available en GitHub Copilot desde el 24 de abril. El cloud agent de Copilot ahora arranca más de 20% más rápido usando entornos de runner de Actions optimizados (27 abr). GPT-5.3-Codex fue removido del model picker del plan Student — aunque sigue accesible via auto selection.
Inline agent mode en preview para JetBrains y mejoras en PR chat
Inline agent mode llega en preview a JetBrains IDEs junto con mejoras en Next Edit Suggestions (24 abr). Copilot Chat en pull requests ahora provee contexto más rico al revisar diffs (23 abr). Mejor debugging en la web: reconocimiento de stack traces mejorado para diagnóstico más rápido en github.com (23 abr).
Cambios de planes: Pro/Pro+ split y Opus models solo en Pro+
GitHub dividió el plan Copilot Individual en un tier esencial y uno profesional avanzado. Los nuevos registros para Pro, Pro+ y Student están pausados. Los límites de uso en Pro fueron ajustados; Pro+ ofrece más de 5x los límites. Los modelos Opus ya no están disponibles en Pro — Opus 4.7 sigue disponible en Pro+. (20 abr)
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-04-24 | DeepSeek V4 Pro | DeepSeek | S | Abierto | 1.6T params, 49B activos, MoE. Contexto 1M tokens, solo texto. Compite con GPT-5.4 en razonamiento. $0.145/$3.48 MTok. |
| 2026-04-24 | DeepSeek V4 Flash | DeepSeek | A | Abierto | 284B params, 13B activos, MoE. Contexto 1M tokens. $0.14/$0.28 MTok. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propietario | Coding agéntico mejorado. Misma latencia que GPT-5.4, menos tokens en Codex. Disponible en ChatGPT, Codex y Copilot. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | A+ | Abierto | 27B denso supera MoE de 397B en coding. SWE-bench 77.2, Terminal-Bench 59.3. Contexto 262K tokens. Apache 2.0. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | S | Abierto | 1T params, 32B activos. Contexto 256K, multimodal. 300 sub-agentes en paralelo, 4000 pasos coordinados. HuggingFace. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S+ | Propietario | #1 en 6 benchmarks (SWE-Bench Pro, Terminal-Bench 2.0, SkillsBench, QwenClawBench, QwenWebBench, SciCode). Primer Qwen flagship closed-weight. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propietario | 64.3% SWE-bench Pro (global #1 al lanzar), nivel xhigh, resolución imagen 3x. $5/$25 MTok. |
| 2026-04-07 | GLM-5.1 | Z.ai / Zhipu | S | Abierto | 754B MoE. 58.4 SWE-bench Pro. MIT license. Open-source weights en HuggingFace. |
Tendencias Destacadas
La semana estuvo dominada por GPT-5.5 de OpenAI, que llegó a Codex, ChatGPT y Copilot simultáneamente — la integración modelo-a-herramientas-de-coding más rápida en la historia de OpenAI. La barra para los modelos frontier sube constantemente: Claude Opus 4.7 ya no lidera el SWE-bench Pro tras apenas 12 días.
El open-source sigue comprimiendo la ventaja propietaria: Kimi K2.6 (1T params) escala a 300 agentes paralelos, y Qwen3.6-27B demuestra que un modelo denso de 27B puede superar a uno MoE de 397B en coding agéntico — una historia arquitectónica que redefine la noción de escala necesaria para el rendimiento.
Claude Code vive un momento de madurez de tooling: vim visual mode, custom themes JSON y la fusión de /cost+/stats en /usage señalan un producto que toma en serio el flujo de trabajo del power user — no solo la generación de código. Paralelamente, Claude Design abre un frente nuevo: prototipos visuales desde el CLI sin herramientas de diseño.
v2.1.121 — MCP alwaysLoad, plugin prune, and memory fixes
Shipped today with key improvements: alwaysLoad on MCP server config to skip tool-search deferral; claude plugin prune to clean orphaned dependencies; type-to-filter search box in /skills; and scrollable dialogs with arrow keys in fullscreen mode. Fixed memory leaks in /usage (~2 GB on large transcripts) and a bash crash when the start directory is deleted mid-session. MCP servers with transient startup errors now auto-retry up to 3 times.
v2.1.119 — /config persists, multi-platform --from-pr, PowerShell auto-approve
/config settings now persist to ~/.claude/settings.json with precedence hierarchy. --from-pr now supports GitLab, Bitbucket, and GitHub Enterprise URLs. PowerShell tool commands can now be auto-approved. Hooks now include duration_ms (tool execution time). --print mode now honors agent tools: and disallowedTools: frontmatter.
v2.1.118 — Vim visual mode, unified /usage, JSON custom themes
Vim visual mode (v) and visual-line mode (V) with full operators. /cost and /stats merged into the new /usage command. Custom themes via /theme with JSON file support. Hooks can now invoke MCP tools directly via type: "mcp_tool". New DISABLE_UPDATES env var to block all update paths. $defaults support in autoMode.allow and autoMode.soft_deny.
Launch: Claude Design — visual creation without a design tool
Claude Design lets you create prototypes, decks, one-pagers, and visual assets via conversational prompts — no design tool required. Runs on Opus 4.7, can ingest your codebase and design system for visual consistency, and exports to PDF, URL, PPTX, or Canva (where files are fully editable and collaborative). Available in research preview for Pro, Max, Team, and Enterprise subscribers. Anthropic positions it as complementary to Canva, not competitive.
Codex CLI v0.125.0 — Unix socket, permission profiles, and Bedrock GA
Unix socket transport for app-server integrations with pagination-friendly resume/fork. Permission profiles that persist across TUI sessions and MCP sandbox states. Amazon Bedrock with AWS SigV4 auth and AWS credentials (now GA). codex exec --json now reports reasoning-token usage for programmatic consumers. Alpha 0.126.0 builds continue shipping — latest was April 27.
Codex CLI v0.124.0 — Reasoning TUI controls, multi-env, GPT-5.5 default
Quick reasoning controls in the TUI: Alt+, lowers reasoning, Alt+. raises it; accepted model upgrades reset reasoning to the new model's default. App-server sessions now manage multiple environments and choose a working directory per turn. GPT-5.5 added as recommended model for complex tasks. Browser use available in the Codex App for local dev servers.
GPT-5.5 — higher intelligence without sacrificing speed
OpenAI launched GPT-5.5 on April 23, positioning it as their smartest and most intuitive model. It improves agentic coding, operates software, moves data across tools, and uses significantly fewer tokens to complete the same Codex tasks as its predecessor — without sacrificing speed (matches GPT-5.4 per-token latency). Now available in ChatGPT, Codex, and GitHub Copilot (GA on Copilot since April 24).
gpt-image-2 — OpenAI's first image model with native reasoning
Launched April 21 via API as gpt-image-2. Supports 2K resolution, aspect ratios from 3:1 to 1:3, and generates up to 8 coherent images from a single prompt with character and object continuity across the batch. It is OpenAI's first image model with native reasoning capabilities built in.
Code Assist 2.79.0 and Gemini 3.1 Pro available in preview
VS Code Gemini Code Assist 2.79.0 (Apr 22) with bug fixes and minor enhancements. More significantly: Gemini 3.1 Pro and Gemini 3.0 Flash are now available in Preview for Code Assist users in VS Code and IntelliJ — for agent mode, chat, and code generation. Google also migrated the Cloud Assist backend to geminicloudassist.googleapis.com on April 16.
Gemini 3.1 Flash-Lite — 2.5x faster at a lower price
Google released Gemini 3.1 Flash-Lite this month with 2.5x faster response times and 45% faster output generation compared to earlier Gemini versions, at a significantly lower price. Ideal for high-volume, low-latency tasks in dev pipelines. Google also consolidated its enterprise agent platform under Vertex AI as the Gemini Enterprise Agent Platform, supporting 200+ models including Anthropic's Claude.
GPT-5.5 GA on Copilot and cloud agent 20% faster launch
GPT-5.5 is now generally available on GitHub Copilot as of April 24. Copilot's cloud agent now launches over 20% faster using optimized GitHub Actions runner environments (Apr 27). GPT-5.3-Codex was removed from the Student plan model picker — though it remains accessible via auto selection.
Inline agent mode in preview for JetBrains and PR chat improvements
Inline agent mode arrives in preview for JetBrains IDEs along with Next Edit Suggestions improvements (Apr 24). Copilot Chat in pull requests now provides richer context when reviewing diffs (Apr 23). Better web debugging: stack trace recognition improved for faster error diagnosis on github.com (Apr 23).
Plan changes: Pro/Pro+ split and Opus models only on Pro+
GitHub split the Copilot Individual plan into a baseline essential tier and an advanced professional tier. New sign-ups for Pro, Pro+, and Student plans are paused. Usage limits on Pro were tightened; Pro+ offers more than 5x the limits. Opus models are no longer available on Pro — Opus 4.7 remains on Pro+. (Apr 20)
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-04-24 | DeepSeek V4 Pro | DeepSeek | S | Open | 1.6T params, 49B active, MoE. 1M-token context, text-only. Competitive with GPT-5.4 on reasoning. $0.145/$3.48 MTok. |
| 2026-04-24 | DeepSeek V4 Flash | DeepSeek | A | Open | 284B params, 13B active, MoE. 1M-token context. $0.14/$0.28 MTok. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Proprietary | Improved agentic coding. Same per-token latency as GPT-5.4, fewer tokens in Codex tasks. Available in ChatGPT, Codex, and Copilot. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | A+ | Open | 27B dense beats 397B MoE on coding. SWE-bench 77.2, Terminal-Bench 59.3. 262K context. Apache 2.0. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | S | Open | 1T params, 32B active. 256K context, multimodal. 300 parallel sub-agents, 4,000 coordinated steps. HuggingFace. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S+ | Proprietary | #1 on 6 benchmarks (SWE-Bench Pro, Terminal-Bench 2.0, SkillsBench, QwenClawBench, QwenWebBench, SciCode). First closed-weight Qwen flagship. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Proprietary | 64.3% SWE-bench Pro (global #1 at launch), xhigh effort level, 3x image resolution. $5/$25 MTok. |
| 2026-04-07 | GLM-5.1 | Z.ai / Zhipu | S | Open | 754B MoE. 58.4 SWE-bench Pro. MIT license. Open-source weights on HuggingFace. |
Notable Trends
The week was dominated by OpenAI's GPT-5.5, landing in Codex, ChatGPT, and Copilot simultaneously — the fastest model-to-coding-tool integration in OpenAI's history. The frontier bar keeps rising: Claude Opus 4.7 no longer leads SWE-bench Pro just 12 days after launch.
Open-source keeps compressing the proprietary advantage: Kimi K2.6 (1T params) scales to 300 parallel agents, and Qwen3.6-27B proves a 27B dense model can beat a 397B MoE on agentic coding — an architectural story that redefines what scale is necessary for performance.
Claude Code is in a tooling maturity moment: vim visual mode, JSON custom themes, and merging /cost+/stats into /usage signal a product taking power-user workflow seriously — not just code generation. In parallel, Claude Design opens a new front: visual prototyping from the CLI without a design tool.
v2.1.121 — MCP alwaysLoad, plugin prune et corrections mémoire
Livré aujourd'hui avec des améliorations clés : alwaysLoad dans la config MCP pour ignorer le report du tool-search ; claude plugin prune pour nettoyer les dépendances orphelines ; filtre de recherche type-to-filter dans /skills ; et dialogues défilables avec les flèches en mode plein écran. Correction des fuites mémoire dans /usage (~2 Go sur de longs transcrits) et d'un crash bash quand le répertoire de départ est supprimé en session. Les serveurs MCP avec des erreurs transitoires se réessaient automatiquement jusqu'à 3 fois.
v2.1.119 — /config persiste, --from-pr multi-plateforme, auto-approve PowerShell
Les paramètres /config sont maintenant persistants dans ~/.claude/settings.json avec hiérarchie de précédence. --from-pr supporte GitLab, Bitbucket et GitHub Enterprise. Les commandes PowerShell peuvent être auto-approuvées. Les hooks incluent maintenant duration_ms. Le mode --print respecte maintenant les frontmatter tools: et disallowedTools: des agents.
v2.1.118 — Mode visuel vim, /usage unifié, thèmes JSON personnalisés
Mode visuel vim (v) et mode visuel-ligne (V) avec opérateurs complets. /cost et /stats fusionnés dans le nouveau /usage. Thèmes personnalisés via /theme avec support JSON. Les hooks peuvent maintenant invoquer des outils MCP directement via type: "mcp_tool". Nouvelle variable DISABLE_UPDATES. Support $defaults dans autoMode.allow et autoMode.soft_deny.
Lancement : Claude Design — création visuelle sans outil de design
Claude Design permet de créer des prototypes, des présentations, des one-pagers et des assets visuels via des prompts conversationnels — sans outil de design requis. Tourne sur Opus 4.7, peut ingérer votre codebase et design system pour la cohérence visuelle, et exporte en PDF, URL, PPTX ou Canva (où les fichiers sont entièrement éditables et collaboratifs). Disponible en preview de recherche pour les abonnés Pro, Max, Team et Enterprise.
Codex CLI v0.125.0 — Socket Unix, profils de permissions et Bedrock GA
Transport Unix socket pour les intégrations app-server avec reprise/fork paginable. Profils de permissions persistants entre les sessions TUI et les états MCP sandbox. Amazon Bedrock avec auth AWS SigV4 (maintenant GA). codex exec --json rapporte maintenant l'utilisation des reasoning-tokens. Les builds alpha 0.126.0 continuent — la dernière date du 27 avril.
Codex CLI v0.124.0 — Contrôles raisonnement TUI, multi-env, GPT-5.5 par défaut
Contrôles rapides de raisonnement dans le TUI : Alt+, abaisse le raisonnement, Alt+. l'augmente ; les mises à niveau de modèle acceptées réinitialisent le raisonnement. Les sessions app-server gèrent maintenant plusieurs environnements. GPT-5.5 ajouté comme modèle recommandé. Utilisation du navigateur disponible dans l'application Codex pour les serveurs de dev locaux.
GPT-5.5 — intelligence supérieure sans sacrifier la vitesse
OpenAI a lancé GPT-5.5 le 23 avril, le positionnant comme son modèle le plus intelligent et intuitif. Il améliore le codage agentique, opère des logiciels, déplace des données entre les outils, et utilise significativement moins de tokens pour les mêmes tâches Codex — sans sacrifier la vitesse (même latence par token que GPT-5.4). Disponible dans ChatGPT, Codex et GitHub Copilot (GA depuis le 24 avril).
gpt-image-2 — premier modèle d'image OpenAI avec raisonnement natif
Lancé le 21 avril via API sous le nom gpt-image-2. Supporte la résolution 2K, des ratios d'aspect de 3:1 à 1:3, et génère jusqu'à 8 images cohérentes à partir d'un seul prompt avec continuité des personnages et objets. C'est le premier modèle d'image OpenAI avec des capacités de raisonnement natif intégrées.
Code Assist 2.79.0 et Gemini 3.1 Pro disponible en préversion
VS Code Gemini Code Assist 2.79.0 (22 avr) avec corrections de bugs et améliorations mineures. Plus significatif : Gemini 3.1 Pro et Gemini 3.0 Flash sont maintenant disponibles en Préversion pour les utilisateurs de Code Assist dans VS Code et IntelliJ. Google a également migré le backend Cloud Assist vers geminicloudassist.googleapis.com le 16 avril.
Gemini 3.1 Flash-Lite — 2,5x plus rapide à un prix inférieur
Google a lancé Gemini 3.1 Flash-Lite ce mois avec des temps de réponse 2,5x plus rapides et une génération 45% plus rapide, à un prix nettement inférieur. Idéal pour les tâches à volume élevé et faible latence. Google a également consolidé sa plateforme d'agents enterprise sous Vertex AI comme Gemini Enterprise Agent Platform, supportant plus de 200 modèles dont Claude d'Anthropic.
GPT-5.5 GA sur Copilot et agent cloud 20% plus rapide
GPT-5.5 est désormais généralement disponible sur GitHub Copilot depuis le 24 avril. L'agent cloud de Copilot démarre maintenant plus de 20% plus vite grâce aux environnements de runner Actions optimisés (27 avr). GPT-5.3-Codex a été supprimé du sélecteur de modèle du plan Étudiant — mais reste accessible via la sélection automatique.
Mode agent inline en préversion pour JetBrains et améliorations chat PR
Le mode agent inline arrive en préversion pour les IDE JetBrains avec des améliorations de Next Edit Suggestions (24 avr). Copilot Chat dans les pull requests fournit maintenant un contexte plus riche lors de la révision des diffs (23 avr). Meilleur débogage web : reconnaissance des stack traces améliorée sur github.com (23 avr).
Changements de plans : split Pro/Pro+ et modèles Opus uniquement sur Pro+
GitHub a divisé le plan Copilot Individual en un niveau essentiel de base et un niveau professionnel avancé. Les nouvelles inscriptions aux plans Pro, Pro+ et Étudiant sont suspendues. Les limites d'utilisation sur Pro ont été resserrées ; Pro+ offre plus de 5x les limites. Les modèles Opus ne sont plus disponibles sur Pro — Opus 4.7 reste sur Pro+. (20 avr)
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-04-24 | DeepSeek V4 Pro | DeepSeek | S | Ouvert | 1,6T params, 49B actifs, MoE. Contexte 1M tokens, texte seul. Compétitif avec GPT-5.4. 0,145$/3,48$ MTok. |
| 2026-04-24 | DeepSeek V4 Flash | DeepSeek | A | Ouvert | 284B params, 13B actifs, MoE. Contexte 1M tokens. 0,14$/0,28$ MTok. |
| 2026-04-23 | GPT-5.5 | OpenAI | S+ | Propriétaire | Codage agentique amélioré. Même latence que GPT-5.4, moins de tokens dans Codex. Disponible dans ChatGPT, Codex et Copilot. |
| 2026-04-22 | Qwen3.6-27B | Alibaba / Qwen | A+ | Ouvert | Dense 27B surpasse le MoE 397B. SWE-bench 77,2, Terminal-Bench 59,3. Contexte 262K. Apache 2.0. |
| 2026-04-20 | Kimi K2.6 | Moonshot AI | S | Ouvert | 1T params, 32B actifs. 256K contexte, multimodal. 300 sous-agents parallèles, 4 000 étapes coordonnées. HuggingFace. |
| 2026-04-20 | Qwen3.6-Max-Preview | Alibaba / Qwen | S+ | Propriétaire | N°1 sur 6 benchmarks (SWE-Bench Pro, Terminal-Bench 2.0, SkillsBench, QwenClawBench, QwenWebBench, SciCode). Premier Qwen flagship closed-weight. |
| 2026-04-16 | Claude Opus 4.7 | Anthropic | S+ | Propriétaire | 64,3% SWE-bench Pro (n°1 mondial au lancement), niveau d'effort xhigh, résolution image 3x. 5$/25$ MTok. |
| 2026-04-07 | GLM-5.1 | Z.ai / Zhipu | S | Ouvert | 754B MoE. 58,4 SWE-bench Pro. Licence MIT. Poids open-source sur HuggingFace. |
Tendances Notables
La semaine a été dominée par GPT-5.5 d'OpenAI, arrivant simultanément dans Codex, ChatGPT et Copilot — l'intégration modèle-outil de codage la plus rapide de l'histoire d'OpenAI. La barre frontier continue de monter : Claude Opus 4.7 ne mène plus le SWE-bench Pro seulement 12 jours après son lancement.
L'open-source continue de comprimer l'avantage propriétaire : Kimi K2.6 (1T params) passe à 300 agents parallèles, et Qwen3.6-27B prouve qu'un modèle dense de 27B peut surpasser un MoE de 397B en codage agentique — une histoire architecturale qui redéfinit l'échelle nécessaire à la performance.
Claude Code est dans un moment de maturité d'outillage : mode visuel vim, thèmes JSON personnalisés et fusion de /cost+/stats dans /usage signalent un produit prenant au sérieux le flux de travail power-user. En parallèle, Claude Design ouvre un nouveau front : prototypage visuel depuis le CLI sans outil de design.