Brief IA-Coding: seguridad en Claude Code, Codex más seguro y Qwen3.8-Max entra fuerte
v2.1.223: cierra bypass de permisos en Bash y agrega /teleport
Corrige un bypass donde un comando manipulado podía ocultar parte de sí mismo al chequeo de permisos, y otro donde tabs o Unicode invisible escondían texto en el diálogo de aprobación. Suma entradas wildcard owner/* para permitir o bloquear todos los repos de marketplace de una org, un hint /teleport para continuar sesiones cloud en local, y convierte /review en alias de /code-review.
v2.1.222: sesiones worktree ya no tocan el checkout principal
Corrige que sesiones aisladas por worktree pudieran correr comandos git destructivos contra el checkout principal, y que hooks PreToolUse de auto-allow saltearan restricciones de herramientas en tareas en background.
Codex CLI 0.146.1: auto-review más seguro con GPT-5.6 Luna
El auto-review pasa a defaults más seguros para modelos con capacidades ofensivas, corriendo ahora sobre GPT-5.6 Luna, y las explicaciones de permisos en la terminal quedan más claras. También llega una nueva Activity view en el sidebar para ver chats recientes que necesitan atención.
Nivel de razonamiento configurable en el cloud agent
Ahora se puede elegir cuánto razona un modelo compatible antes de responder en Copilot cloud agent, para balancear calidad de respuesta contra consumo de tokens. Disponible en planes Copilot de pago que incluyen cloud agent.
Copilot CLI v1.0.78: tiempos en vivo por herramienta
La CLI ahora muestra cuánto tarda cada herramienta en ejecutarse y mantiene actualizados automáticamente los paquetes first-party.
Model policy targeting por equipo en preview público
Los administradores de GitHub Enterprise con licencias Copilot Business o Enterprise pueden fijar un baseline de modelos para toda la org y otorgar modelos adicionales a usuarios específicos.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-08-03 | Qwen3.8-Max | Alibaba | S+ | Propietario | 2.4T parámetros (95B activos, MoE). Alibaba dice que empata o supera a Fable 5 en varios benchmarks de código y multimodal. Pesos abiertos prometidos «la semana próxima»; sin evaluación independiente aún. |
| 2026-08-03 | MiniMax H3 | MiniMax | A | Abierto | Modelo de video multimodal 2K con audio nativo, ~1/12 del costo por segundo de Seedance 2.5. Pesos open-source anunciados para «los próximos días». |
| 2026-07-31 | DeepSeek V4-Flash (Public Beta) | DeepSeek | A+ | Abierto | Beta pública con capacidades agentic reforzadas, Terminal-Bench 2.1 en 82.7. Soporta nativamente el formato Responses API y está adaptado para Codex. |
| 2026-07-24 | Claude Opus 5 | Anthropic | S+ | Propietario | Inteligencia cercana a frontera a mitad del precio de Fable 5. Contexto de 1M tokens, $10/$50 por Mtok en modo fast. |
| 2026-06-30 | Claude Sonnet 5 | Anthropic | S | Propietario | Rinde cerca de Opus 4.8 a menor costo; mejor resistencia a prompt injection que Sonnet 4.6. Precio de lanzamiento $2/$10 hasta el 31 ago 2026. |
| 2026-08 | GLM-5.5 (rumored) | Z.ai / Zhipu | S | Próximo | Reportado por JPMorgan/Reuters con >1T parámetros y contexto de 1M tokens. Al 6 ago 2026, Zhipu no confirmó specs ni fecha — sigue promocionando GLM-5.2. |
Tendencias Destacadas
Los laboratorios chinos siguen marcando el ritmo de lanzamientos: Alibaba, DeepSeek y MiniMax metieron modelos nuevos en la misma semana, todos con pesos abiertos (llegando) y precios agresivos frente a la competencia occidental.
En las herramientas de código, la semana fue de endurecimiento de seguridad más que de features nuevas: Claude Code cerró dos bypasses de permisos distintos y Codex CLI movió sus defaults de auto-review a un modelo más seguro para tareas cyber-capable.
v2.1.223: closes Bash permission bypass, adds /teleport
Fixes a Bash permission bypass where a crafted command could hide parts of itself from permission checks, plus a second bug where tabs or invisible Unicode hid text in the approval dialog. Adds owner/* wildcard entries to allow or block every marketplace repo under a GitHub org, a /teleport hint to continue cloud sessions locally, and makes /review an alias of /code-review.
v2.1.222: worktree sessions stop touching the main checkout
Fixes worktree-isolated sessions being able to run destructive git commands against the main checkout, and PreToolUse auto-allow hooks bypassing tool restrictions inside background tasks.
Codex CLI 0.146.1: safer auto-review on GPT-5.6 Luna
Auto-review moves to safer defaults for cyber-capable models, now running on GPT-5.6 Luna, with clearer permission explanations in the terminal. A new Activity view in the sidebar also surfaces recent chats that need attention.
Configurable reasoning level for the cloud agent
Users can now choose how much a supported model reasons before responding in Copilot cloud agent, balancing answer quality against token use. Available on paid Copilot plans that include cloud agent.
Copilot CLI v1.0.78: live per-tool timing
The CLI now shows live timing for how long each tool takes to run, and automatically keeps first-party packages up to date.
Team-level model policy targeting in public preview
GitHub Enterprise admins on Copilot Business or Enterprise licenses can set a baseline of models for the whole org and grant additional models to specific users.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-08-03 | Qwen3.8-Max | Alibaba | S+ | Proprietary | 2.4T params (95B active, MoE). Alibaba claims parity or wins over Fable 5 on several coding and multimodal benchmarks. Open weights promised "next week"; no independent evals yet. |
| 2026-08-03 | MiniMax H3 | MiniMax | A | Open | 2K multimodal video model with native audio, roughly 1/12th the per-second cost of Seedance 2.5. Open-source weights announced for "the coming days". |
| 2026-07-31 | DeepSeek V4-Flash (Public Beta) | DeepSeek | A+ | Open | Public beta with strengthened agent capabilities, Terminal-Bench 2.1 at 82.7. Natively supports the Responses API format and is tuned for Codex. |
| 2026-07-24 | Claude Opus 5 | Anthropic | S+ | Proprietary | Near-frontier intelligence at half the price of Fable 5. 1M-token context, $10/$50 per Mtok in fast mode. |
| 2026-06-30 | Claude Sonnet 5 | Anthropic | S | Proprietary | Performs close to Opus 4.8 at lower cost; better prompt-injection resistance than Sonnet 4.6. Launch pricing $2/$10 through Aug 31, 2026. |
| 2026-08 | GLM-5.5 (rumored) | Z.ai / Zhipu | S | Upcoming | Reported by JPMorgan/Reuters at >1T params with a 1M-token context. As of Aug 6, 2026, Zhipu has confirmed neither specs nor date — still promoting GLM-5.2. |
Notable Trends
Chinese labs keep setting the release cadence: Alibaba, DeepSeek, and MiniMax all shipped new models in the same week, each with open weights (arriving) and pricing aimed squarely under Western competitors.
On the tooling side, this was a security-hardening week more than a feature week: Claude Code closed two distinct permission bypasses, and Codex CLI moved its auto-review defaults to a safer model for cyber-capable tasks.
v2.1.223 : corrige un contournement de permissions Bash, ajoute /teleport
Corrige un contournement où une commande falsifiée pouvait cacher une partie d'elle-même au contrôle des permissions, ainsi qu'un second bug où des tabulations ou de l'Unicode invisible masquaient du texte dans la boîte d'approbation. Ajoute des entrées génériques owner/* pour autoriser ou bloquer tous les dépôts marketplace d'une organisation, une astuce /teleport pour reprendre une session cloud en local, et fait de /review un alias de /code-review.
v2.1.222 : les sessions worktree ne touchent plus le checkout principal
Corrige le fait que des sessions isolées par worktree pouvaient exécuter des commandes git destructives sur le checkout principal, ainsi que des hooks PreToolUse en auto-allow contournant les restrictions d'outils dans les tâches en arrière-plan.
Codex CLI 0.146.1 : revue automatique plus sûre sur GPT-5.6 Luna
La revue automatique passe à des réglages par défaut plus sûrs pour les modèles à capacités offensives, s'appuyant désormais sur GPT-5.6 Luna, avec des explications de permissions plus claires dans le terminal. Une nouvelle vue Activity dans la barre latérale signale aussi les discussions récentes nécessitant une attention.
Niveau de raisonnement configurable pour le cloud agent
Il est désormais possible de choisir le niveau de raisonnement d'un modèle compatible avant sa réponse dans le cloud agent Copilot, pour équilibrer qualité de réponse et consommation de tokens. Disponible sur les plans Copilot payants incluant le cloud agent.
Copilot CLI v1.0.78 : chronométrage en direct par outil
La CLI affiche désormais en direct la durée d'exécution de chaque outil et maintient automatiquement les paquets internes à jour.
Ciblage des politiques de modèles par équipe en préversion publique
Les administrateurs GitHub Enterprise avec licences Copilot Business ou Enterprise peuvent définir un socle de modèles pour toute l'organisation et accorder des modèles supplémentaires à des utilisateurs spécifiques.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-08-03 | Qwen3.8-Max | Alibaba | S+ | Propriétaire | 2,4T de paramètres (95B actifs, MoE). Alibaba affirme égaler ou dépasser Fable 5 sur plusieurs benchmarks de code et multimodaux. Poids ouverts promis « la semaine prochaine » ; pas encore d'évaluation indépendante. |
| 2026-08-03 | MiniMax H3 | MiniMax | A | Ouvert | Modèle vidéo multimodal 2K avec audio natif, environ 1/12 du coût par seconde de Seedance 2.5. Poids open source annoncés pour « les prochains jours ». |
| 2026-07-31 | DeepSeek V4-Flash (Public Beta) | DeepSeek | A+ | Ouvert | Bêta publique aux capacités agentiques renforcées, Terminal-Bench 2.1 à 82,7. Prend nativement en charge le format Responses API et est adapté pour Codex. |
| 2026-07-24 | Claude Opus 5 | Anthropic | S+ | Propriétaire | Intelligence proche de la frontière à moitié prix de Fable 5. Contexte de 1M tokens, 10$/50$ par Mtok en mode rapide. |
| 2026-06-30 | Claude Sonnet 5 | Anthropic | S | Propriétaire | Performances proches d'Opus 4.8 à moindre coût ; meilleure résistance à l'injection de prompt que Sonnet 4.6. Tarif de lancement 2$/10$ jusqu'au 31 août 2026. |
| 2026-08 | GLM-5.5 (rumored) | Z.ai / Zhipu | S | À venir | Rapporté par JPMorgan/Reuters avec plus de 1T de paramètres et un contexte de 1M tokens. Au 6 août 2026, Zhipu n'a confirmé ni les caractéristiques ni la date — l'entreprise met toujours en avant GLM-5.2. |
Tendances Notables
Les labos chinois continuent de dicter le rythme des sorties : Alibaba, DeepSeek et MiniMax ont tous lancé de nouveaux modèles la même semaine, chacun avec des poids ouverts (à venir) et des prix visant directement sous ceux de la concurrence occidentale.
Côté outillage, la semaine a surtout été marquée par le renforcement de la sécurité plutôt que par de nouvelles fonctionnalités : Claude Code a corrigé deux contournements de permissions distincts, et Codex CLI a fait passer ses réglages de revue automatique à un modèle plus sûr pour les tâches à capacités offensives.