Le 22 août, Anthropic ouvre Claude Code Remote Control au démarrage de sessions depuis le téléphone, tandis que Google dote Antigravity d’une fonctionnalité équivalente pour piloter ses agents à distance. Côté modèles, deux comparatifs Together AI montrent le modèle ouvert GLM-5.3 égaler ou dépasser GPT-5.6 Sol et Claude Fable 5 sur le benchmark DeepSWE, pour une fraction du coût. Perplexity détaille par ailleurs l’architecture de Brain, sa mémoire agentique versionnée avec Git, et NotebookLM devient accessible à tous les utilisateurs avec une intégration dans le Mode IA de Google Search. Au menu également : Replit revoit ses modes d’agent, Runway ouvre une offre de licence de modèles, OpenAI muscle son contrôle des coûts API et sa suite de sécurité Codex, et Grok Bot élargit son accès.
Claude Code Remote Control : fiabilité renforcée et démarrage de session depuis le téléphone
22 août — Anthropic publie sur X un fil détaillant plusieurs correctifs de fiabilité pour Remote Control, la fonctionnalité qui permet de piloter une session Claude Code depuis un téléphone pendant qu’elle tourne sur un ordinateur distant. La synchronisation d’état entre téléphone et machine ne laisse plus de session fantôme affichée après la fermeture de Claude Code, les coupures réseau (changement de Wi-Fi, fermeture du capot) déclenchent désormais une reconnexion automatique, et l’ouverture des sessions volumineuses est nettement accélérée sur iOS. Trois commandes slash gagnent un comportement mobile dédié (/clear, /compact, /diff). Nouveauté produit : il devient possible de démarrer une session directement depuis le téléphone — toute machine faisant tourner claude remote-control apparaît comme une carte d’appareil dans l’onglet Code, sélectionnable pour lancer la session à distance.
Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.
🇫🇷 Votre téléphone reste désormais synchronisé avec ce qui tourne sur votre machine. Reprendre une session sur votre ordinateur portable maintient le téléphone sur la session active au lieu de l’archiver. Quand Claude Code se termine, votre téléphone l’affiche hors ligne en quelques secondes au lieu de laisser une session obsolète affichée. — @ClaudeDevs sur X
🔗 Fil complet sur X 🔗 Documentation Remote Control
Replit : Conversations, modes Agent renommés (Power/Max), Routines et Memories en bêta
22 août — Replit publie son récapitulatif hebdomadaire This Week in Replit, avec trois nouveautés inédites. Conversations permet de démarrer une idée d’application par une phase de recherche et d’idéation conversationnelle avant de basculer sur la construction, sans perdre le contexte accumulé — un problème fréquent quand cette phase démarrait dans un autre assistant IA. Les modes de l’Agent sont renommés : l’ancien mode Economy devient Power, l’ancien mode Power devient Max, à coût identique sur les deux. Enfin, Routines et Memories arrivent en bêta : les Routines programment l’exécution d’une tâche à partir d’une conversation et en restituent le résultat automatiquement, appuyées sur un système de mémoire persistante. Ces annonces ont été présentées en direct lors du Friday Showcase de Replit.
Together AI compare GLM-5.3 à GPT-5.6 Sol et Claude Fable 5 sur DeepSWE
21 août — Together AI publie le même jour deux comparatifs indépendants opposant GLM-5.3, le dernier modèle ouvert de Zhipu/Z.ai, à deux références fermées sur DeepSWE, son benchmark d’ingénierie logicielle (113 tâches, 4 essais par configuration, effort maximal, 904 lancements au total). Face à GPT-5.6 Sol, GLM-5.3 concède le premier essai mais le rejoint dès le deuxième et le dépasse au quatrième, à un coût très inférieur. Face à Claude Fable 5, l’écart initial est quasi nul et se creuse nettement en faveur de GLM-5.3 avec les essais multiples — Claude Fable 5 ressort comme la configuration la plus chère du comparatif. Une cascade GLM-5.3 vers Sol, qui n’escalade qu’en cas d’échec des tests, atteint 85,9 % de réussite à 6,61 dollars la tâche, un résultat meilleur qu’un routeur oracle parfait (83,8 %).
| Comparaison testée | Score au premier essai | Score après 4 essais | Coût par lancement |
|---|---|---|---|
| GLM-5.3 vs GPT-5.6 Sol | 69,0 % vs 72,7 % | 87,6 % vs 85,8 % | 3,99 $ vs 8,37 $ (2,1× moins cher) |
| GLM-5.3 vs Claude Fable 5 | 69,0 % vs 69,7 % | 87,6 % vs 84,1 % | 3,99 $ vs 21,63 $ (5,4× moins cher) |
Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.
🇫🇷 Ne choisissez pas un seul modèle. Faites tourner GLM-5.3 en premier, et escaladez vers GPT-5.6 Sol quand les tests échouent. Cette cascade résout 85,9 % des tâches DeepSWE à 6,61 dollars chacune. Sol seul en résout 72,7 % à 8,37 dollars. Treize points de mieux, 21 % moins cher. — Together AI, blog officiel
🔗 Comparatif GLM-5.3 vs Claude Fable 5
NotebookLM disponible pour tous les utilisateurs, intégré au Mode IA de Google Search
21 août — Le compte X de NotebookLM, renommé Gemini Notebook, annonce que l’expérience « Notebook » remaniée est désormais disponible pour l’ensemble des utilisateurs sur le web (une version mobile est annoncée à venir), après un déploiement progressif. Autre changement structurant : les notebooks sont maintenant accessibles directement depuis le Mode IA de Google Search, ce qui rapproche l’outil de synthèse documentaire du moteur de recherche principal de Google. L’annonce inclut aussi deux correctifs côté Chat : un meilleur rendu et copier-coller des équations mathématiques, et la correction d’un bug qui affichait les chiffres à l’envers dans les langues s’écrivant de droite à gauche (arabe, hébreu). D’autres nouveautés sont promises dans les prochaines semaines.
OpenAI ajoute un suivi des dépenses par clé API aux tableaux de bord Usage and Spend
21 août — OpenAI ajoute une granularité par clé API aux tableaux de bord Usage and Spend de sa plateforme développeurs. Jusqu’ici agrégé au niveau de l’organisation ou du projet, le suivi des dépenses permet désormais d’isoler la contribution de chaque clé API individuelle, pour identifier précisément quelles applications ou quels flux de travail pèsent le plus dans la facture. La fonctionnalité s’accompagne de limites de dépenses configurables au niveau de l’organisation ou du projet, avec la possibilité de fixer des limites strictes qui coupent automatiquement le trafic une fois le plafond atteint. Ces contrôles sont accessibles depuis l’interface de l’API Platform et via l’Admin API, pour les intégrer dans des flux de travail programmatiques. OpenAI présente cette mise à jour comme complémentaire à la baisse tarifaire de GPT-5.6 Sol annoncée le même jour.
Codex Security : guide pratique et CLI open source pour la défense cyber (Daybreak)
21 août — OpenAI publie un guide détaillant l’écosystème Daybreak, sa plateforme de défense cyber assistée par IA, du triage initial dans ChatGPT jusqu’à la production d’un correctif vérifié. Le point le plus concret pour les développeurs est la Codex Security CLI, un outil open source publié en package npm (@openai/codex-security), utilisable pour scanner un dépôt local (npx @openai/codex-security scan .) et intégrable en CI/CD (GitHub Actions, GitLab CI/CD) avec export au format SARIF. Nouveauté notable : le bulk-scan, qui audite un portefeuille entier de dépôts à partir d’un inventaire CSV, avec reprise sur interruption et paramètres de concurrence configurables. OpenAI distingue aussi deux niveaux d’accès : Daybreak Blue (triage de vulnérabilités, validation de correctifs) pour les défenseurs approuvés, et Daybreak Red (recherche de vulnérabilités avancée, red teaming), réservé à un nombre plus restreint d’usages autorisés. Codex Security cloud a déjà analysé plus de 30 millions de commits sur plus de 30 000 bases de code.
Grok Bot étend son accès à davantage de forfaits et devient gratuit à l’essai
21 août — Dix jours après son lancement en bêta, Grok Bot élargit son accès à un éventail plus large de forfaits : SuperGrok Plus, SuperGrok Heavy, ainsi que les offres Cursor (Pro+, Ultra et tous les plans Teams). Les utilisateurs hors de ces forfaits bénéficient désormais d’un essai gratuit à usage limité. Ces agents IA autonomes disposent de leur propre environnement cloud avec accès navigateur et terminal, pour des tâches comme la prospection commerciale, la création de sites web complets (achat de domaine et déploiement inclus), le tri de boîtes mail, le support client ou la prise de notes en réunion. Plusieurs Bots peuvent tourner en parallèle dans un même groupe, et un mode « routine » permet à un Bot d’apprendre une tâche en observant l’utilisateur l’exécuter une première fois. Une liste d’attente entreprise est ouverte pour les déploiements à plus grande échelle.
Runway détaille sa stratégie entreprise et une offre de licence de modèles
21 août — Le nouveau directeur commercial de Runway, Sean Holcombe, détaille dans un billet la stratégie entreprise de la société : chiffre d’affaires plus que doublé sur l’année, rétention nette supérieure à 300 %, et expansion internationale marquée (Europe au-dessus de 20 % de la base entreprise, Japon devenu premier marché asiatique). L’annonce la plus structurante est l’ouverture d’une offre de licence de modèles : plutôt qu’un accès facturé à l’usage via API, certains clients entreprise pourront recevoir des poids de modèles fermés et un framework d’entraînement/inférence propriétaire à héberger et affiner directement dans leur propre environnement. Runway cible quatre profils : entreprises avec une propriété intellectuelle créative propre, plateformes disposant déjà de capacité de calcul, organisations soumises à des contraintes réglementaires fortes, et acteurs à très gros volume.
Perplexity détaille Brain, le système de mémoire agentique de Computer
19 août — Perplexity détaille le fonctionnement de Brain, le système de mémoire persistante de Computer, son agent local. Plutôt qu’une base vectorielle classique, Brain organise la mémoire sous forme d’un wiki de connaissances versionné avec Git, réparti en trois couches dans le système de fichiers du bac à sable : knowledge/ (le wiki), notes/ (extraits distillés) et sessions/ (transcriptions brutes). Un « Memory Agent » dédié charge à la demande les fichiers pertinents plutôt que de copier l’arborescence entière à chaque démarrage, tandis que des agents d’arrière-plan baptisés « Dream » maintiennent le wiki hors ligne en quatre étapes, avec vérifications avant publication.
| Métrique évaluée | Sans Brain | Avec Brain |
|---|---|---|
| Justesse (benchmark interne, 640 questions) | 0,600 | 0,661 |
| Rappel des preuves (benchmark interne) | 0,573 | 0,625 |
| Justesse en production (30 derniers jours) | témoin | +9,3 points |
Brèves
- Devin (Cognition) — remise supplémentaire de 20 % sur GPT-5.6 Sol — OpenAI ajoute une baisse de 20 % au prix de GPT-5.6 Sol pour 3 mois, qui s’ajoute à la remise de 70 % déjà en place depuis le 18 août : la réduction cumulée sur Devin Desktop et CLI atteint désormais 76 % jusqu’au 3 octobre 2026. 🔗 Annonce
- Google Antigravity 2.9.1 — Remote Control pour piloter ses agents à distance — Nouvelle fonctionnalité permettant de démarrer et surveiller une session d’agent locale depuis n’importe quel navigateur, avec gains de performance et meilleure récupération après erreur. 🔗 Changelog
- Auto model selection à -30 % pour Copilot Max — Promotion sur la sélection automatique de modèle (Claude, GPT ou Microsoft AI) pour les abonnés Copilot Max, valable jusqu’au 30 septembre 2026. 🔗 Annonce · 🔗 Date de fin
- GitHub Universe 2026 — relance de la billetterie — Relance marketing de la conférence GitHub Universe 2026 via une courte vidéo, sans annonce produit associée. 🔗 Vidéo
- Midjourney — changelog majeur pour l’alpha du site — Deux semaines de correctifs UX sur alpha.midjourney.com : dossiers de projets, retour d’Upscale/Zoom/Vary, persistance des réglages et correctifs de performance. 🔗 Changelog
- MiniMax laisse entrevoir le lancement du modèle M3 sur SambaNova — En réponse à une annonce énigmatique de SambaNova, MiniMax laisse entendre l’arrivée prochaine d’un modèle M3, sans spécifications ni date de sortie communiquées. 🔗 Tweet
- Grok 4.6 disponible sur Google Enterprise Agent Platform — Le modèle rejoint Model Garden (ex-Vertex AI), avec une fenêtre de contexte de 500 000 tokens et une tarification de 2 $ / 6 $ par million de tokens en entrée/sortie. 🔗 Annonce
- Cohere active un mode local pour la dictée vocale via superwhisper — Le mode « Go Local » combine Cohere Transcribe et le modèle ouvert S1-mini (0,6 milliard de paramètres) de superwhisper, avec transcription entièrement sur l’appareil. 🔗 Annonce
Ce que ça signifie
Deux annonces indépendantes, sans lien entre elles, convergent aujourd’hui sur un même mouvement : détacher le pilotage d’un agent IA de la machine sur laquelle il tourne réellement. Chez Anthropic, Claude Code Remote Control permet désormais de démarrer une session directement depuis le téléphone, avec reconnexion automatique et synchronisation d’état entre appareils. Chez Google, Antigravity introduit sa propre fonctionnalité « Remote Control » : piloter et surveiller une session d’agent locale depuis n’importe quel navigateur. Dans les deux cas, le calcul et l’exécution restent ancrés sur le poste de travail — c’est la fenêtre de contrôle qui devient mobile. Ce découplage répond à un usage désormais courant : lancer une tâche longue sur sa machine de développement, puis en suivre et en reprendre le contrôle depuis un autre appareil, sans jamais interrompre l’exécution en cours.
Le second mouvement visible aujourd’hui touche à l’économie des modèles. Les deux comparatifs Together AI montrent GLM-5.3, un modèle ouvert de Zhipu/Z.ai, égaler ou dépasser GPT-5.6 Sol et Claude Fable 5 sur un même benchmark d’ingénierie logicielle, pour un coût 2 à 5 fois inférieur. Ce n’est pas un cas isolé : la même semaine, xAI multiplie les intégrations cloud pour Grok 4.6 (Google Enterprise Agent Platform après GitHub Copilot et Amazon Bedrock), OpenAI accorde une remise cumulée de 76 % sur GPT-5.6 Sol aux utilisateurs de Devin, et Replit élargit ses propres modes d’agent. La compétition ne se joue plus seulement sur la capacité brute des modèles, mais sur le rapport coût-efficacité et la disponibilité multiplateforme — un terrain où les modèles ouverts, combinés à des stratégies de cascade entre modèles, deviennent des arguments commerciaux à part entière face aux modèles fermés.
Un troisième fil, plus discret, traverse aussi la journée : la mémoire persistante devient une brique d’infrastructure à part entière pour les agents IA. Perplexity détaille l’architecture de Brain, un wiki de connaissances versionné avec Git qui structure la mémoire de son agent Computer plutôt que de l’empiler dans une base vectorielle classique, avec des gains mesurés de justesse et de rappel des preuves. Au même moment, Google élargit l’accès à l’expérience Notebook remaniée de NotebookLM et l’intègre directement dans le Mode IA de Google Search, rapprochant un peu plus l’outil de synthèse documentaire du moteur de recherche principal. Dans les deux cas, la valeur ajoutée ne vient plus seulement du modèle sous-jacent, mais de la manière dont l’historique et les connaissances accumulées sont organisées, retrouvées et réutilisées d’une session à l’autre.
Un dernier angle concerne la maturité des outils destinés aux équipes techniques et sécurité en entreprise. OpenAI ajoute un suivi des dépenses par clé API et des limites strictes configurables à ses tableaux de bord, au moment même où elle publie un guide détaillé sur Codex Security, avec une CLI open source capable d’auditer un portefeuille entier de dépôts. Ces deux annonces, publiées le même jour par la même équipe, dessinent une réponse cohérente à une préoccupation partagée par les organisations qui déploient des agents IA à grande échelle : garder un contrôle fin sur les coûts et la surface de sécurité, sans renoncer à la vitesse que ces outils promettent.
Sources
- Claude Code Remote Control — fil complet
- Claude Code Remote Control — citation synchronisation
- Documentation Remote Control
- Replit — This Week in Replit
- Together AI — GLM-5.3 vs GPT-5.6 Sol sur DeepSWE
- Together AI — GLM-5.3 vs Claude Fable 5 sur DeepSWE
- NotebookLM — annonce sur X
- OpenAI — Usage and Spend par clé API
- OpenAI — Codex Security et Daybreak
- Grok Bot — annonce sur X
- Grok Bot — détails x.ai
- Runway — stratégie entreprise et licence de modèles
- Perplexity — Brain, mémoire agentique de Computer
- Devin — remise supplémentaire sur GPT-5.6 Sol
- Google Antigravity — changelog 2.9.1
- GitHub — Auto model selection à -30 %
- GitHub — Auto model selection, date de fin
- GitHub Universe 2026 — relance billetterie
- Midjourney — changelog alpha
- MiniMax — annonce du modèle M3
- Grok 4.6 — Google Enterprise Agent Platform
- Cohere — mode local superwhisper