Codex CLI v0.145 ajoute mémoire et import Cursor, Kimi K3 et DeepSeek V4 secouent la Chine
«/fork» copia la conversación a una sesión en segundo plano
La semana del 13-17 jul, /fork pasó a copiar toda la conversación actual en una nueva sesión en segundo plano mientras seguís trabajando en la original. Se suma screen reader mode, que reemplaza la interfaz visual de terminal por texto plano y lineal para lectores como VoiceOver y NVDA, y auto mode ya no necesita variable de opt-in en Bedrock, Google Cloud Agent Platform ni Microsoft Foundry.
Herramienta EndConversation, heartbeats de progreso y aislamiento de sandbox
v2.1.214 (18 jul) suma la herramienta EndConversation, heartbeats de progreso para tareas largas y la flag --max-budget-usd para poner un tope de gasto a subagentes en segundo plano. v2.1.216 (20 jul) agrega un control independiente para el aislamiento del sistema de archivos en el sandbox.
v0.144.6 corrige la ventana de contexto de GPT-5.6
v0.144.6 (18 jul) refresca las instrucciones incluidas para GPT-5.6 Sol, Terra y Luna, y corrige la ventana de contexto reportada a 272.000 tokens.
v0.145.0: historial de hilos paginado, import de Cursor/Claude Code y login con Bedrock
v0.145.0 (21 jul) suma historial de hilos paginado con reanudación, búsqueda, nombres persistentes y soporte de sub-agentes; expande /import para migrar configuración, servidores MCP y plugins desde Cursor y Claude Code; agrega login con Amazon Bedrock (endpoints custom) y entrada/salida de audio en conversaciones realtime. La experiencia multi-agente V2 quedó estabilizada con modelos de sub-agente configurables.
Gemini 3.6 Flash llega al selector de modelos de Copilot
Gemini 3.6 Flash (21 jul) ya está disponible en GitHub Copilot para planes Pro, Pro+, Max, Business y Enterprise, con mejor tasa de finalización de tareas y eficiencia de tokens que Gemini 3.5 Flash. Administradores de Business/Enterprise deben habilitarlo manualmente.
Copilot CLI v1.0.73 arregla subagentes con múltiples directorios
v1.0.73 (21 jul) corrige que los subagentes de Anthropic dejaran de funcionar al configurar directorios de agentes adicionales, y resuelve los enlaces relativos en instrucciones de agentes custom desde la ubicación del archivo del agente.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-07-19 | DeepSeek V4 (GA) | DeepSeek | S+ | Abierto | Disponibilidad general de V4-Pro y V4-Flash, con contexto de 1M tokens en toda la línea, licencia MIT y mejoras marcadas en tareas de agentes, razonamiento matemático y generación de código. DeepSeek estrena precios pico/valle (doble costo en horario pico) y retira los alias `deepseek-chat`/`deepseek-reasoner` el 24 de julio. |
| 2026-07-16 | Kimi K3 | Moonshot AI | S+ | Abierto | 2.7 billones de parámetros: el modelo de pesos abiertos más grande jamás lanzado. Supera a todos los rivales salvo Claude Fable 5 y GPT-5.6 en capacidad general. Ya usable gratis en la app de Kimi, kimi.com y Kimi Work; los pesos completos se publican el 27 de julio. |
| 2026-07-19 | Qwen3.8 (preview) | Alibaba / Qwen | A | Propietario | 2.4 billones de parámetros, multimodal, más del doble que su predecesor. Alibaba dice que queda apenas debajo de Claude Fable 5 en evaluaciones internas, pero sin benchmarks independientes publicados — el mismo patrón de lanzamientos previos de Qwen. Disponible en preview vía Token Plan, Qoder y QoderWork al 10% del precio estándar; iría a pesos abiertos «pronto». |
| 2026-08-01 | GLM-5.5 (rumored) | Z.ai / Zhipu | S | Próximo | Reportes sin confirmar indican que Zhipu podría saltear GLM-5.3 e ir directo a GLM-5.5 alrededor de agosto de 2026, sin fecha oficial todavía. |
Tendencias Destacadas
China tuvo su semana más cargada del año: Moonshot (Kimi K3), DeepSeek (V4 GA) y Alibaba (Qwen3.8) lanzaron o mostraron modelos de frontera en apenas cuatro días, todos posicionándose justo debajo de Claude Fable 5 y GPT-5.6 — con Kimi K3 reclamando el título de modelo de pesos abiertos más grande jamás lanzado.
Del lado de las herramientas, la tendencia es interoperabilidad: Codex CLI ahora importa configuración directamente desde Cursor y Claude Code, mientras Copilot sigue sumando modelos de terceros (Gemini 3.6 Flash) además de los propios — la competencia se está moviendo de «mi modelo es mejor» a «mi herramienta soporta cualquier modelo».
«/fork» copies your conversation into a background session
In the week of Jul 13-17, /fork started copying your entire current conversation into a new background session while you keep working in the original one. The update also adds screen reader mode, which replaces the visual terminal interface with plain, linear text for readers like VoiceOver and NVDA, and auto mode no longer needs an opt-in variable on Bedrock, Google Cloud's Agent Platform, or Microsoft Foundry.
EndConversation tool, progress heartbeats and sandbox isolation
v2.1.214 (Jul 18) adds the EndConversation tool, progress heartbeats for long-running tool calls, and a --max-budget-usd flag to cap spend on background subagents. v2.1.216 (Jul 20) adds an independent setting to control sandbox filesystem isolation.
v0.144.6 corrects GPT-5.6's context window
v0.144.6 (Jul 18) refreshes the bundled instructions for GPT-5.6 Sol, Terra and Luna, and corrects their reported context window to 272,000 tokens.
v0.145.0: paginated thread history, Cursor/Claude Code import, and Bedrock login
v0.145.0 (Jul 21) adds paginated thread history with efficient resume, search, persisted names and sub-agent support; expands /import to migrate settings, MCP servers and plugins from Cursor and Claude Code; adds Amazon Bedrock login with custom-endpoint auth, and streaming realtime audio input/output. The multi-agent V2 experience was stabilized with configurable sub-agent models.
Gemini 3.6 Flash reaches Copilot's model picker
Gemini 3.6 Flash (Jul 21) is now available in GitHub Copilot for Pro, Pro+, Max, Business and Enterprise plans, with higher task-completion rates and better token efficiency than Gemini 3.5 Flash. Business/Enterprise admins need to enable it manually.
Copilot CLI v1.0.73 fixes subagents across multiple directories
v1.0.73 (Jul 21) fixes Anthropic subagents breaking when additional agent directories are configured, and resolves relative links in custom agent instructions from the agent file's own location.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-07-19 | DeepSeek V4 (GA) | DeepSeek | S+ | Open | General availability of V4-Pro and V4-Flash, with a 1M-token context window across the lineup, an MIT license, and marked gains in agentic tasks, math reasoning and code generation. DeepSeek introduces peak/off-peak pricing (double cost at peak hours) and retires the `deepseek-chat`/`deepseek-reasoner` aliases on July 24. |
| 2026-07-16 | Kimi K3 | Moonshot AI | S+ | Open | 2.7 trillion parameters: the largest open-weight model ever released. Outperforms every rival except Claude Fable 5 and GPT-5.6 on overall capability. Already usable for free via the Kimi app, kimi.com and Kimi Work; full open weights drop on July 27. |
| 2026-07-19 | Qwen3.8 (preview) | Alibaba / Qwen | A | Proprietary | 2.4 trillion parameters, fully multimodal, more than double its predecessor's size. Alibaba claims it ranks just below Claude Fable 5 on internal evaluations, but published no independent benchmarks — the same pattern as prior Qwen releases. Available in preview via Token Plan, Qoder and QoderWork at 10% of standard pricing; the team says it will go open-weight «soon». |
| 2026-08-01 | GLM-5.5 (rumored) | Z.ai / Zhipu | S | Upcoming | Unconfirmed reports suggest Zhipu may skip GLM-5.3 and go straight to GLM-5.5 around August 2026, with no official date set yet. |
Notable Trends
China had its busiest week of the year: Moonshot (Kimi K3), DeepSeek (V4 GA) and Alibaba (Qwen3.8) all launched or previewed frontier models within four days, each positioning itself just below Claude Fable 5 and GPT-5.6 — with Kimi K3 claiming the title of largest open-weight model ever released.
On the tooling side, the trend is interoperability: Codex CLI now imports settings directly from Cursor and Claude Code, while Copilot keeps adding third-party models (Gemini 3.6 Flash) alongside its own — competition is shifting from «my model is better» to «my tool supports any model».
« /fork » copie la conversation dans une session en arrière-plan
Durant la semaine du 13-17 juillet, /fork s'est mis à copier toute la conversation en cours dans une nouvelle session en arrière-plan pendant que vous continuez à travailler dans l'originale. S'ajoute le screen reader mode, qui remplace l'interface visuelle du terminal par du texte plat et linéaire pour les lecteurs comme VoiceOver et NVDA, et l'auto mode ne nécessite plus de variable d'opt-in sur Bedrock, Google Cloud Agent Platform ou Microsoft Foundry.
Outil EndConversation, heartbeats de progression et isolation sandbox
La v2.1.214 (18 juil.) ajoute l'outil EndConversation, des heartbeats de progression pour les appels d'outils longs, et un flag --max-budget-usd pour plafonner les dépenses des sous-agents en arrière-plan. La v2.1.216 (20 juil.) ajoute un réglage indépendant pour contrôler l'isolation du système de fichiers du sandbox.
v0.144.6 corrige la fenêtre de contexte de GPT-5.6
La v0.144.6 (18 juil.) actualise les instructions embarquées pour GPT-5.6 Sol, Terra et Luna, et corrige leur fenêtre de contexte annoncée à 272 000 tokens.
v0.145.0 : historique de threads paginé, import Cursor/Claude Code et connexion Bedrock
La v0.145.0 (21 juil.) ajoute un historique de threads paginé avec reprise efficace, recherche, noms persistants et support des sous-agents ; elle étend /import pour migrer les réglages, serveurs MCP et plugins depuis Cursor et Claude Code ; elle ajoute la connexion Amazon Bedrock avec authentification par endpoint personnalisé, ainsi que l'entrée/sortie audio en temps réel. L'expérience multi-agent V2 a été stabilisée avec des modèles de sous-agents configurables.
Gemini 3.6 Flash arrive dans le sélecteur de modèles de Copilot
Gemini 3.6 Flash (21 juil.) est désormais disponible dans GitHub Copilot pour les plans Pro, Pro+, Max, Business et Enterprise, avec un meilleur taux de complétion des tâches et une meilleure efficacité en tokens que Gemini 3.5 Flash. Les administrateurs Business/Enterprise doivent l'activer manuellement.
Copilot CLI v1.0.73 corrige les sous-agents sur plusieurs répertoires
La v1.0.73 (21 juil.) corrige les sous-agents Anthropic qui cessaient de fonctionner lorsque des répertoires d'agents supplémentaires étaient configurés, et résout les liens relatifs dans les instructions d'agents personnalisés depuis l'emplacement du fichier de l'agent.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-07-19 | DeepSeek V4 (GA) | DeepSeek | S+ | Ouvert | Disponibilité générale de V4-Pro et V4-Flash, avec une fenêtre de contexte de 1M de tokens sur toute la gamme, une licence MIT, et des gains marqués sur les tâches agentiques, le raisonnement mathématique et la génération de code. DeepSeek introduit une tarification heures pleines/creuses (coût doublé aux heures de pointe) et retire les alias `deepseek-chat`/`deepseek-reasoner` le 24 juillet. |
| 2026-07-16 | Kimi K3 | Moonshot AI | S+ | Ouvert | 2,7 billions de paramètres : le plus grand modèle à poids ouverts jamais publié. Surpasse tous ses rivaux sauf Claude Fable 5 et GPT-5.6 en capacité globale. Déjà utilisable gratuitement via l'app Kimi, kimi.com et Kimi Work ; les poids complets seront publiés le 27 juillet. |
| 2026-07-19 | Qwen3.8 (preview) | Alibaba / Qwen | A | Propriétaire | 2,4 billions de paramètres, entièrement multimodal, plus du double de son prédécesseur. Alibaba affirme qu'il se classe juste en dessous de Claude Fable 5 selon des évaluations internes, mais n'a publié aucun benchmark indépendant — le même schéma que les précédentes sorties Qwen. Disponible en préversion via Token Plan, Qoder et QoderWork à 10 % du tarif standard ; l'équipe indique qu'il passera en poids ouverts « bientôt ». |
| 2026-08-01 | GLM-5.5 (rumored) | Z.ai / Zhipu | S | À venir | Des rapports non confirmés suggèrent que Zhipu pourrait sauter GLM-5.3 pour passer directement à GLM-5.5 vers août 2026, sans date officielle pour l'instant. |
Tendances Notables
La Chine a connu sa semaine la plus chargée de l'année : Moonshot (Kimi K3), DeepSeek (V4 GA) et Alibaba (Qwen3.8) ont tous lancé ou dévoilé des modèles de pointe en l'espace de quatre jours, chacun se positionnant juste en dessous de Claude Fable 5 et GPT-5.6 — Kimi K3 revendiquant le titre de plus grand modèle à poids ouverts jamais publié.
Côté outils, la tendance est à l'interopérabilité : Codex CLI importe désormais les réglages directement depuis Cursor et Claude Code, tandis que Copilot continue d'ajouter des modèles tiers (Gemini 3.6 Flash) en plus des siens — la concurrence passe de « mon modèle est meilleur » à « mon outil supporte n'importe quel modèle ».