AI for Devs: OpenAI launches GPT-6 Astra and Copilot adds Gemini 3.8 Flash
v2.1.260: panel de diffs, causas de fallo de caché en /cost
Suma un panel de diffs junto a la conversación en modo pantalla completa (/diff) que muestra los cambios sin commitear a medida que Claude edita, la causa probable de fallos de caché de prompt en /cost y la status line, /reload-plugins en sesiones headless, y la forma de texto de /advisor. Corrige reglas de permisos con paréntesis descartadas por error, fallas de descubrimiento de modelos en Bedrock por certificados corporativos, y el caching de prompt en Claude Fable 5.1 que no cubría el contexto después de resultados de herramientas.
v2.1.259: MCP administrados por organización y modo headless sin prompts
Suma la setting administrada managedMcpServers para que las organizaciones distribuyan servidores MCP HTTP/SSE a todos los usuarios, la flag --permission-prompts none para hosts headless desatendidos (deniega automáticamente cualquier acción que requeriría confirmación), reconocimiento de merge requests de GitLab, y la flag --json en claude plugin validate. Corrige sesiones concurrentes que se pisaban cambios en ~/.claude.json y reglas de deny de Bash Read() que no cubrían archivos pasados como valores de opciones.
v0.153.0: modo Vim, plugins remotos y reconexión automática
Suma deshacer/rehacer en modo Vim, gestión de plugins desde marketplaces remotos, reconexión automática de la TUI cuando el app-server se cae (preservando borradores y transcripciones), revisión Guardian que sobrevive a compactación y reinicios, avisos de uso más tempranos para Plus/Team, entrada de usuario asíncrona y un modo experimental de gestión de contexto. Los parches v0.153.1 y v0.153.2 del mismo día fueron correcciones menores, incluyendo un ajuste en la descripción del tier «Fast» de GPT-6 Astra.
OpenAI lanza GPT-6 Astra para trabajo autónomo de largo alcance
OpenAI presentó GPT-6 Astra, descrito como su modelo más capaz hasta ahora, orientado a flujos multistep de largo alcance: navegadores, hojas de cálculo, documentos y tareas de codificación autónomas. El despliegue inicial fue en preview limitada el 3 de septiembre; no soporta esfuerzo de razonamiento «none», temperatura/top_p personalizados ni logprobs. Nota: la fuente primaria de OpenAI no pudo verificarse directamente (403); la fecha y los detalles están corroborados por múltiples medios especializados.
Responses API: llamadas asíncronas a herramientas y steering en vivo
La Responses API sumó llamadas asíncronas a herramientas, «steering» a mitad de turno vía WebSocket, y ajuste del esfuerzo de razonamiento a mitad de conversación preservando el prefijo cacheado — todo publicado junto con GPT-6 Astra.
Gemini 3.8 Flash ya disponible en GitHub Copilot
Gemini 3.8 Flash de Google llega a Copilot Pro, Pro+, Max, Business y Enterprise, con foco en tareas complejas de terminal y codificación, validación rigurosa y recuperación de errores.
Reabren las altas de Business/Enterprise; deprecación de modelos
GitHub reabre gradualmente las altas de Copilot Business y Enterprise para clientes que pagan con tarjeta o PayPal, pausadas desde el 22 de abril. En paralelo anuncia la deprecación de modelos seleccionados en todas las experiencias de Copilot a partir del 2 de octubre. Además, las configuraciones administradas por empresa ahora permiten fijar cualquier modelo como predeterminado para conversaciones nuevas, y los content exclusions llegaron a disponibilidad general en la app y CLI de Copilot para clientes Business/Enterprise.
VS Code 1.136: soporte multi-root para agentes y «Agent Merge»
Suma soporte de workspaces multi-root para sesiones de agente de Copilot y Claude, «Agent Merge (Preview)» — agentes que resuelven feedback de revisión, arreglan checks fallidos y resuelven conflictos de merge — y notificaciones de sesiones de agente.
Línea de Tiempo — Lanzamientos de Modelos
| Fecha | Modelo | Proveedor | Tier | Tipo | Notas |
|---|---|---|---|---|---|
| 2026-09-03 | GPT-6 Astra | OpenAI | S+ | Propietario | Modelo insignia de OpenAI para trabajo autónomo de largo alcance (navegadores, hojas de cálculo, documentos, codificación); preview limitada, sin soporte de logprobs ni temperatura personalizada. |
| 2026-09-02 | Qwen3.8-Max-0902 | Alibaba / Qwen | S | Propietario | Refresh post-entrenamiento de Qwen3.8-Max, misma arquitectura (2.4T params, contexto 1M); mejor codificación para escala de ingeniería y orquestación multi-herramienta; reclama el #1 en Code Arena WebDev. |
Tendencias Destacadas
OpenAI respondió al lanzamiento gemelo de Anthropic (Fable 5.1/Mythos 5.1 del 1 de septiembre) con GPT-6 Astra apenas dos días después — la carrera de modelos insignia para trabajo autónomo de largo alcance se acelera semana a semana.
GitHub Copilot sigue siendo el canal de distribución más rápido para modelos de terceros: sumó Gemini 3.8 Flash el mismo día de su aparición, mientras endurece su operación comercial con la reapertura de altas Business/Enterprise y deprecaciones de modelos.
Alibaba mantiene el ritmo de refreshes incrementales sobre Qwen3.8-Max en vez de saltos de versión mayor, reclamando liderazgo en benchmarks de codificación frente a Claude Opus 5 Max y Kimi K3 Max.
v2.1.260: diff panel, prompt-cache-miss causes in /cost
Adds a diff panel beside the conversation in fullscreen mode (/diff) showing uncommitted changes as Claude edits, likely-cause detection for prompt-cache misses in /cost and the status line, /reload-plugins for headless sessions, and a text form of /advisor. Fixes permission rules with parentheses being wrongly dropped, Bedrock model discovery failing on certificate errors in corporate environments, and prompt caching on Claude Fable 5.1 not covering context after tool results.
v2.1.259: org-managed MCP servers and no-prompt headless mode
Adds the managedMcpServers managed setting so organizations can roll out HTTP/SSE MCP servers to all users, the --permission-prompts none flag for unattended headless hosts (auto-denies anything that would otherwise prompt), GitLab merge-request recognition, and a --json flag for claude plugin validate. Fixes concurrent sessions reverting each other's ~/.claude.json changes and Bash Read() deny rules not covering files passed as option values.
v0.153.0: Vim mode, remote plugins, auto-reconnect
Adds Vim-mode undo/redo, plugin management from remote marketplaces, TUI auto-reconnect when the app-server drops (preserving drafts and transcripts), Guardian review that survives compaction and restarts, earlier usage warnings for Plus/Team, async user input, and an experimental context-management mode. Same-day patches v0.153.1 and v0.153.2 were minor fixes, including a correction to the GPT-6 Astra "Fast" tier description.
OpenAI launches GPT-6 Astra for long-horizon autonomous work
OpenAI unveiled GPT-6 Astra, described as its most capable model yet, built for long-horizon multistep workflows: browsers, spreadsheets, documents, and autonomous coding tasks. Initial rollout was a limited preview on September 3; it does not support "none" reasoning effort, custom temperature/top_p, or logprobs. Note: OpenAI's primary announcement page could not be verified directly (403); the date and details are corroborated across multiple independent outlets.
Responses API: async tool calling and mid-turn steering
The Responses API gained async tool calling, mid-turn steering via WebSocket, and mid-conversation reasoning-effort adjustment that preserves the cached prefix — all shipped alongside GPT-6 Astra.
Gemini 3.8 Flash is now available in GitHub Copilot
Google's Gemini 3.8 Flash lands in Copilot Pro, Pro+, Max, Business, and Enterprise, focused on complex terminal and coding tasks with rigorous validation and error recovery.
Business/Enterprise signups reopen; model deprecations
GitHub is gradually reopening Copilot Business and Enterprise signups for credit-card and PayPal customers, paused since April 22. In parallel it announced the deprecation of selected models across all Copilot experiences starting October 2. Enterprise-managed settings now also let admins set any model as the default for new conversations, and content exclusions reached general availability in the Copilot app and CLI for Business/Enterprise customers.
VS Code 1.136: multi-root workspace support for agents, Agent Merge
Adds multi-root workspace support for Copilot and Claude agent sessions, "Agent Merge (Preview)" — agents that address review feedback, fix failed checks, and resolve merge conflicts — and agent session notifications.
Model Launches Timeline
| Date | Model | Provider | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-09-03 | GPT-6 Astra | OpenAI | S+ | Proprietary | OpenAI's flagship model for long-horizon autonomous work (browsers, spreadsheets, documents, coding); limited preview, no logprobs or custom temperature support. |
| 2026-09-02 | Qwen3.8-Max-0902 | Alibaba / Qwen | S | Proprietary | Post-training refresh of Qwen3.8-Max, same architecture (2.4T params, 1M context); improved engineering-scale coding and multi-tool orchestration; claims #1 on Code Arena WebDev. |
Notable Trends
OpenAI answered Anthropic's twin launch (Fable 5.1/Mythos 5.1 on September 1) with GPT-6 Astra just two days later — the race for flagship long-horizon autonomous-work models keeps accelerating week over week.
GitHub Copilot remains the fastest distribution channel for third-party models — it added Gemini 3.8 Flash the same day it surfaced, while tightening its commercial operation with reopened Business/Enterprise signups and model deprecations.
Alibaba keeps shipping incremental refreshes on top of Qwen3.8-Max rather than major version jumps, claiming coding-benchmark leadership over Claude Opus 5 Max and Kimi K3 Max.
v2.1.260 : panneau de diff, causes des échecs de cache dans /cost
Ajoute un panneau de diff à côté de la conversation en mode plein écran (/diff) montrant les changements non commités pendant que Claude édite, la détection de cause probable des échecs de cache de prompt dans /cost et la status line, /reload-plugins pour les sessions headless, et une forme texte de /advisor. Corrige des règles de permission avec parenthèses supprimées à tort, l'échec de découverte de modèle Bedrock sur erreurs de certificat en environnement d'entreprise, et le cache de prompt sur Claude Fable 5.1 qui ne couvrait pas le contexte après des résultats d'outils.
v2.1.259 : serveurs MCP gérés par l'organisation et mode headless sans invites
Ajoute le réglage géré managedMcpServers permettant aux organisations de déployer des serveurs MCP HTTP/SSE à tous les utilisateurs, l'option --permission-prompts none pour les hôtes headless non surveillés (refuse automatiquement toute action qui aurait nécessité une confirmation), la reconnaissance des merge requests GitLab, et une option --json pour claude plugin validate. Corrige des sessions concurrentes qui annulaient mutuellement leurs changements dans ~/.claude.json et des règles de refus Bash Read() ne couvrant pas les fichiers passés en valeurs d'options.
v0.153.0 : mode Vim, plugins distants et reconnexion automatique
Ajoute l'annuler/rétablir en mode Vim, la gestion de plugins depuis des marketplaces distants, la reconnexion automatique de la TUI en cas de panne de l'app-server (préservant brouillons et transcriptions), une revue Guardian qui survit à la compaction et aux redémarrages, des avertissements d'usage plus précoces pour Plus/Team, une saisie utilisateur asynchrone et un mode expérimental de gestion du contexte. Les correctifs v0.153.1 et v0.153.2 du même jour étaient des corrections mineures, dont un ajustement de la description du palier «Fast» de GPT-6 Astra.
OpenAI lance GPT-6 Astra pour le travail autonome de longue durée
OpenAI a dévoilé GPT-6 Astra, présenté comme son modèle le plus capable à ce jour, conçu pour des flux de travail multi-étapes de longue durée : navigateurs, tableurs, documents et tâches de codage autonomes. Le déploiement initial était une preview limitée le 3 septembre ; il ne prend pas en charge l'effort de raisonnement «none», la température/top_p personnalisés ni les logprobs. Remarque : la page d'annonce primaire d'OpenAI n'a pas pu être vérifiée directement (403) ; la date et les détails sont corroborés par plusieurs médias indépendants.
Responses API : appels d'outils asynchrones et pilotage en cours de tour
La Responses API a gagné l'appel d'outils asynchrone, le pilotage en cours de tour via WebSocket, et l'ajustement de l'effort de raisonnement en cours de conversation préservant le préfixe mis en cache — le tout publié en même temps que GPT-6 Astra.
Gemini 3.8 Flash désormais disponible dans GitHub Copilot
Gemini 3.8 Flash de Google arrive dans Copilot Pro, Pro+, Max, Business et Enterprise, axé sur les tâches complexes de terminal et de codage avec une validation rigoureuse et une récupération d'erreurs.
Réouverture des inscriptions Business/Enterprise ; dépréciation de modèles
GitHub rouvre progressivement les inscriptions Copilot Business et Enterprise pour les clients payant par carte de crédit ou PayPal, suspendues depuis le 22 avril. En parallèle, il a annoncé la dépréciation de modèles sélectionnés dans toutes les expériences Copilot à partir du 2 octobre. Les réglages gérés par l'entreprise permettent désormais aussi de définir n'importe quel modèle par défaut pour les nouvelles conversations, et les exclusions de contenu ont atteint la disponibilité générale dans l'app et la CLI Copilot pour les clients Business/Enterprise.
VS Code 1.136 : support multi-root pour les agents et « Agent Merge »
Ajoute le support des workspaces multi-root pour les sessions d'agent Copilot et Claude, « Agent Merge (Preview) » — des agents qui traitent les retours de revue, corrigent les checks échoués et résolvent les conflits de fusion — et des notifications de session d'agent.
Chronologie des Lancements de Modèles
| Date | Modèle | Fournisseur | Tier | Type | Notes |
|---|---|---|---|---|---|
| 2026-09-03 | GPT-6 Astra | OpenAI | S+ | Propriétaire | Modèle phare d'OpenAI pour le travail autonome de longue durée (navigateurs, tableurs, documents, codage) ; preview limitée, sans support de logprobs ni de température personnalisée. |
| 2026-09-02 | Qwen3.8-Max-0902 | Alibaba / Qwen | S | Propriétaire | Rafraîchissement post-entraînement de Qwen3.8-Max, même architecture (2,4T de paramètres, contexte 1M) ; meilleur codage à l'échelle ingénierie et orchestration multi-outils ; revendique la 1ère place sur Code Arena WebDev. |
Tendances Notables
OpenAI a répondu au lancement jumeau d'Anthropic (Fable 5.1/Mythos 5.1 du 1er septembre) avec GPT-6 Astra à peine deux jours plus tard — la course aux modèles phares pour le travail autonome de longue durée s'accélère semaine après semaine.
GitHub Copilot reste le canal de distribution le plus rapide pour les modèles tiers — il a ajouté Gemini 3.8 Flash le jour même de son apparition, tout en resserrant son fonctionnement commercial avec la réouverture des inscriptions Business/Enterprise et des dépréciations de modèles.
Alibaba continue de livrer des rafraîchissements incrémentaux de Qwen3.8-Max plutôt que des sauts de version majeurs, revendiquant la tête des benchmarks de codage devant Claude Opus 5 Max et Kimi K3 Max.