Le 17 juillet est marqué par un changement de modèle économique dans les outils de codage agentique : Amp lance ses premiers abonnements mensuels, mettant fin à son tout-paiement-à-l’usage. Claude Code publie une nouvelle version dotée de garde-fous anti-emballement pour WebSearch et les sous-agents, tandis que Perplexity, Gemini et Grok renforcent leurs plateformes d’agents autonomes en entreprise. La génération de médias reste très active chez HeyGen, ElevenLabs et Runway, et la recherche ouverte publie deux travaux qui interrogent les limites actuelles des modèles.
Amp lance ses premiers abonnements mensuels : Megawatt et Gigawatt
17 juillet — Amp (Sourcegraph / Amp Frontier Corporation) lance en bêta ses premiers abonnements mensuels, une bascule stratégique pour un produit qui fonctionnait jusqu’ici exclusivement au paiement à l’usage (tarifs API bruts) — un modèle qui le rendait plus coûteux que ses concurrents sur abonnement. Amp se décrit lui-même, dans son billet d’annonce, comme ayant été jusque-là « the Apple or Porsche of agentic coding tools ».
| Formule évaluée | Prix mensuel | Heures d’orbs incluses | Usage agent inclus | Modes disponibles |
|---|---|---|---|---|
| Megawatt | $20 | 750 h (petits orbs) | $20 | low, medium |
| Gigawatt | $200 | 1 000 h (grands orbs) | $200 | low, medium, high, ultra |
Megawatt inclut aussi la possibilité de lier son propre abonnement ChatGPT pour accéder à GPT-5.6, ou son abonnement X Premium+/SuperGrok. Une offre de lancement double l’usage inclus (orbs et agents) pour le premier mois, pour tout abonnement souscrit avant le dimanche 19 juillet. Le paiement à l’usage reste disponible pour qui ne souhaite pas s’abonner ; au-delà des limites incluses, il faut lier un abonnement ChatGPT ou ajouter des crédits payants.
Amp justifie ce virage par la baisse générale du coût des tokens de bonne qualité (l’exemple cité : GLM-5.2 dans le nouveau mode « low ») et par le déplacement du travail agentique vers des machines distantes (les « orbs ») plutôt que vers le poste de travail local — l’entreprise affirme vouloir que les utilisateurs « tuent leur environnement de développement local singleton ».
“Introducing Amp Subscriptions. $20 or $200 gets you on the agentic frontier with us.”
🇫🇷 Présentation des abonnements Amp. 20 ou 200 dollars vous donnent accès à la frontière agentique avec nous. — @sqs sur X
Claude Code et Amp : nouvelles capacités agentiques
Claude Code CLI v2.1.212 : garde-fous anti-emballement
16 juillet — Anthropic publie la version 2.1.212 de Claude Code (mise en ligne sur npm à 21h20 heure de Paris). Le changement le plus visible concerne /fork : la commande copie désormais la conversation dans une nouvelle session en arrière-plan (visible dans claude agents), tandis que l’ancien sous-agent lancé en session est renommé /subtask. Deux garde-fous anti-emballement apparaissent : une limite par session sur les appels à l’outil WebSearch (200 par défaut, ajustable via CLAUDE_CODE_MAX_WEB_SEARCHES_PER_SESSION) et un plafond sur le nombre de sous-agents pouvant être lancés (200 par défaut, CLAUDE_CODE_MAX_SUBAGENTS_PER_SESSION). Les appels d’outils MCP dépassant deux minutes basculent désormais automatiquement en arrière-plan.
Deux correctifs relèvent de la sécurité : le mode plan ne peut plus exécuter de commandes Bash modifiant des fichiers (touch, rm) sans invite de permission, et la création d’un worktree suivant un symlink commité dans .claude/worktrees ne peut plus écrire de fichiers hors du dépôt.
Amp : les agents peuvent désormais faire spawn d’autres agents
17 juillet — Amp lance « From Agent to Agent » : les agents Amp peuvent désormais faire naître (spawn) d’autres agents — dans des orbs (machines distantes), sur la machine locale, ou sur n’importe quelle autre machine — et échanger messages et fichiers entre eux.
Les cas d’usage cités par Amp : lancer un agent dans un orb pour traiter un bug secondaire pendant que l’utilisateur poursuit son travail principal, faire tourner plusieurs threads en parallèle (par exemple quatre threads en mode « low » pour tester un flux à quatre tailles d’écran différentes), récupérer les fichiers utiles d’un ancien thread abandonné, déporter une tâche sur une autre machine, ou coordonner un travail cross-projet en envoyant un agent documenter un changement d’API. Cette fonctionnalité prolonge les « Agents in Orbs » (30 juin) et les « Custom Agents » (19 juin), mais introduit pour la première fois la communication inter-agents à travers threads et machines. Le co-fondateur Thorsten Ball avait teasé la fonctionnalité sur X quelques heures avant le lancement officiel.
Agents autonomes : automatisation et productivité en entreprise
Manus (James) chez Ascendea : étude de cas productivité 90×
17 juillet — Manus publie une étude de cas mettant en avant Ascendea, une agence britannique basée au Science Park de l’université de Warwick, qui développe CRM, agents et automatisations pour de petites entreprises. Son CTO Rob Arnold a surnommé son instance Manus « James » et en a fait le chef de cabinet IA de l’entreprise, au sommet d’une architecture à trois couches : Manus pour les tâches complexes, des agents conversationnels Slack (Victor, Victoria, Ava) pour l’interface humaine du quotidien, et six agents locaux exécutant les tâches répétitives planifiées sur un serveur dédié.
Le cas d’usage phare : 303 procédures opérationnelles standardisées (SOP) générées en une seule journée, un travail estimé à environ 14 semaines pour deux personnes en méthode manuelle. Ascendea fonctionne aujourd’hui avec seulement 10 employés humains, sert 112 clients actifs et exécute 28 à 33 flux de travail IA en production coordonnés via Manus.
Perplexity lance Projects, évolution des Spaces dans Computer
17 juillet — Perplexity annonce Projects, la suite de Spaces au sein de Perplexity Computer, son environnement agentique. Projects rassemble fichiers, applications et fils de conversation dans une même session persistante : chaque nouvelle tâche démarre avec le contexte complet des sessions précédentes.
La fonctionnalité cible les équipes en entreprise : elle connecte des outils comme Drive, Notion, Linear, Salesforce, Snowflake ou Slack/Microsoft Teams (plus de 400 connecteurs annoncés), tout en isolant les données, la mémoire et les accès de chaque utilisateur. Projects s’appuie sur Brain, le système de mémoire auto-apprenante de Computer, s’intègre aux Skills, et propose un « trust panel » listant sources connectées et traçabilité des réponses. Les Spaces existants migrent automatiquement, disponible dès aujourd’hui pour tous les utilisateurs de Computer. Fait notable : la page officielle affiche une date de publication au 22 juillet, alors qu’elle est déjà en ligne et publiquement accessible depuis le 17.
Automations in Grok
16 juillet — xAI lance Automations dans Grok : décrire une tâche une seule fois, puis la laisser s’exécuter automatiquement, sur un planning (une fois, quotidien, en semaine, hebdomadaire, mensuel ou annuel) ou déclenchée par l’arrivée d’un email correspondant à des filtres définis. Chaque exécution ouvre une conversation complète avec Grok, consultable dans un historique des runs, notifiable par email, notification applicative, les deux, ou aucune.
Les automatisations sont disponibles sur grok.com et dans l’application mobile Grok (iOS, Android). Les automatisations planifiées sont accessibles à tous les utilisateurs, tandis que les déclencheurs par email sont réservés aux abonnés SuperGrok.
Google / Gemini : plateforme agent d’entreprise
Conductor devient un plugin portable, compatible Antigravity CLI et Claude
16 juillet — Conductor, l’extension de développement piloté par spécifications (Spec-Driven Development) lancée l’an dernier pour Gemini CLI, devient le Conductor Plugin, un format embarquant skills, règles, serveurs MCP et hooks dans un seul paquet. Jusqu’ici exclusivement lié à Gemini CLI, Conductor devient utilisable aussi dans Antigravity CLI et dans Claude.
L’agent dialogue désormais naturellement pour générer et faire évoluer le contexte, les spécifications (spec.md) et le plan (plan.md), conservés comme artefacts Markdown persistants et versionnés. Google indique une rétrocompatibilité avec les anciennes commandes et un taux de réussite supérieur sur le sous-ensemble de tâches les plus complexes de TerminalBench. L’installation se fait via agy plugins install https://github.com/gemini-cli-extensions/conductor pour Antigravity CLI.
Gemini Enterprise Agent Platform s’associe à Parallel Web Systems
16 juillet — Google Cloud annonce un partenariat avec Parallel Web Systems (fondée par l’ancien PDG de Twitter, Parag Agrawal) pour intégrer nativement son infrastructure de recherche comme nouveau fournisseur de grounding web sur le Gemini Enterprise Agent Platform. L’objectif : permettre aux agents de s’appuyer sur des résultats web récents et vérifiables, avec citations précises, pour des tâches comme les contrôles KYC automatisés ou l’enrichissement de catalogues produits.
La fonctionnalité est disponible via l’API Gemini, sélectionnable dans Agent Studio, et facturée à l’usage via Google Cloud Marketplace, avec une option de rétention nulle des données pour les charges sensibles. Contrairement à une recherche web classique, l’intégration autorise l’extraction et la mise en cache permanente des données pour enrichir des bases internes, ainsi que le post-traitement des résultats par d’autres LLM. Selon Parag Agrawal, les agents IA utiliseront bientôt le web bien plus que les humains ne l’ont jamais fait, ce qui nécessite une infrastructure de recherche pensée pour leur fonctionnement.
Génération de médias
HeyGen — Batch APIs en production
17 juillet — HeyGen met en ligne ses Batch APIs, permettant de soumettre en une seule requête jusqu’à 100 vidéos, traductions, synchronisations labiales (lipsyncs) ou televersements, avec un seul webhook de notification une fois le lot traité. Cette fonctionnalité vise les cas d’usage de production à grande échelle — agences, équipes marketing — qui devaient auparavant gérer des centaines d’appels API individuels pour un même volume de contenu.
🔗 Annonce sur X — voir aussi la documentation technique
HeyGen — HyperFrames obtient une médiathèque intégrée
17 juillet — HeyGen ajoute une médiathèque intégrée à HyperFrames, son outil de création de vidéos par code (write HTML, render video). Elle regroupe plus de 10 000 pistes audio, 75 000 images, des effets sonores et des logos, accessibles gratuitement avec un compte HeyGen, en plus de l’accès aux modèles génératifs maison. Les ressources utilisées sont sauvegardées localement, ce qui évite de refaire une recherche à chaque nouveau projet.
ElevenLabs — L’Odyssée narrée par la voix IA de Sir Michael Caine
17 juillet — ElevenLabs propose une lecture intégrale de L’Odyssée d’Homère narrée par une voix IA sous licence complète de l’acteur Sir Michael Caine, disponible gratuitement sur l’application ElevenReader. C’est un nouvel exemple de partenariat de voix de célébrité entièrement autorisé, dans la continuité de la stratégie d’ElevenLabs consistant à proposer du contenu audio premium via des voix IA officiellement licenciées plutôt que par simple synthèse générique.
Runway Agent 2.0 classé n°1 au benchmark indépendant Physion-Arc 1.0
16-17 juillet — Runway met en avant les résultats du benchmark indépendant Physion-Arc 1.0, publié le 16 juillet par l’évaluateur tiers Physion Labs, qui a soumis six agents vidéo IA à 30 prompts cinématographiques évalués sur 16 métriques. Runway Agent (version 2.0, lancée fin juin) arrive en tête sur les trois piliers évalués : cohérence narrative, langage cinématographique et qualité de production.
Runway a aussi publié un article technique détaillant la philosophie derrière Agent : une interface centrée sur le visuel plutôt que sur le chat, un système encodant la connaissance des forces et faiblesses de chaque modèle sous-jacent, et une couche de « compétences » combinant ces capacités en flux de travail. Les prochaines pistes évoquées : mémoire de contexte entre sessions, création par lots et planification de tâches directement dans Agent.
Recherche & modèles ouverts
Sakana AI — recherche « Diffusing Blame » : le principe de Dale appliqué au RL
17 juillet — Sakana AI publie « Diffusing Blame », une recherche explorant si un réseau de neurones peut apprendre de manière compétitive tout en respectant strictement le principe de Dale — la contrainte biologique selon laquelle un neurone ne peut être qu’excitateur ou qu’inhibiteur envers ses voisins, jamais les deux. L’article est accepté à la conférence #ALIFE2026 et disponible sur arXiv.
Dans un second post du même fil, l’équipe présente ED-PPO, une variante de l’algorithme d’apprentissage par renforcement PPO (Proximal Policy Optimization) intégrant un mécanisme de diffusion d’erreur respectant cette contrainte biologique, démontrée sur une tâche de contrôle. Ce travail s’inscrit dans la ligne de recherche de Sakana AI sur des architectures inspirées de la biologie, distincte de ses annonces produits plus commerciales.
PerceptionBench : aucun modèle ne dépasse 60 % de précision (Kimi / Moonshot AI)
16 juillet — L’équipe Kimi publie PerceptionBench, un banc d’essai qui isole la perception visuelle des grands modèles multimodaux en dix capacités atomiques : relation visuelle, comptage, attribut, profondeur et 3D, localisation, comparaison, reconnaissance fine, intégration contextuelle, OCR et hallucination. Ces catégories sont déduites de l’analyse des échecs réels de modèles frontière sur plus de 40 benchmarks existants. Le jeu de données comprend 3 000 questions vérifiées, chacune répondable par simple observation, sans raisonnement ni connaissance externe requis.
“No model we evaluate clears 60% accuracy, and models with nearly identical overall scores can exhibit very different perceptual strengths and weaknesses.”
🇫🇷 Aucun modèle évalué ne dépasse 60 % de précision, et des modèles aux scores globaux quasi identiques peuvent présenter des forces et faiblesses perceptives très différentes. — Kimi Team, PerceptionBench
Ce benchmark est également cité dans la fiche technique de Kimi K3, publiée le même jour, comme outil d’évaluation multimodale interne.
Brèves
- Fin du hackathon Built with Claude: Life Sciences — Coorganisé avec le Gladstone Institutes et Cerebral Valley, il récompense Trialign (mise en correspondance d’essais cliniques), NCypher (analyse ADN d’un cancer infantile), Extremolith (conception de protéines résistantes) et Lazarus (agent de reconstruction de code de recherche abandonné). 🔗 source
- Boris Cherny — adoption de l’IA en entreprise — Le créateur de Claude Code décrit quatre étapes qu’il observe dans l’adoption de l’IA par les équipes, contenu éditorial plutôt qu’annonce produit. 🔗 source
- Hugging Face — NeMo AutoModel de NVIDIA prend en charge Diffusers — La bibliothèque open source de fine-tuning de NVIDIA, qui couvrait déjà Transformers, prend désormais en charge Diffusers, la bibliothèque de génération d’images de Hugging Face. 🔗 source
- Antigravity 2.3.1 — Correctif corrigeant un bug de configuration malformée empêchant l’IDE agentique de Google de démarrer, aucune nouvelle fonctionnalité. 🔗 source
- GitHub Mobile : bouton Fix with Copilot sur les commentaires de PR — Le bouton, déjà présent côté web, est désormais accessible depuis la vue principale d’une pull request et depuis chaque commentaire de revue, sur iOS et Android. 🔗 source
- NVIDIA Nemotron 3 Embed 8B — n°1 également sur LMEB — Après sa première place sur RTEB, le modèle d’embeddings prend aussi la tête du leaderboard LMEB, qui évalue la mémoire de conversations longues ; le modèle 1B associé arrive deuxième. 🔗 source
- HeyGen HyperFrames — jour 12/30 : légendes dynamiques — Légendes animées et synchronisées au mot près, livrées comme composants prêts à l’emploi dans le catalogue HyperFrames. 🔗 source
- Kling AI — récap de la cérémonie NextGen Awards à Séoul — Retour sur la cérémonie récompensant des créateurs utilisant Kling AI pour la narration visuelle, dont Jo Ryeongmi pour son court-métrage The Well. 🔗 source
- Runway — étude de cas R/GA : avatar IA « Forever Founder » — L’agence R/GA a créé avec l’API Runway Characters un avatar IA en temps réel de son fondateur pour son 50ᵉ anniversaire, ayant répondu à 145 questions sur 20 conversations sans incident technique. 🔗 source
- ZCode : usage navigateur et ordinateur en préparation — Z.ai teaser une future capacité de browser use et computer use pour son environnement de développement ZCode, sans détails ni date. 🔗 source
- A scorecard for the AI age (OpenAI) — Billet de la CFO Sarah Friar sur la mesure du retour sur investissement de l’IA en entreprise (« Useful Intelligence per Dollar »), illustré par ChatGPT Work, sans nouveau produit annoncé. 🔗 source
Ce que ça signifie
Le virage d’Amp vers l’abonnement, combiné aux nouveaux garde-fous de Claude Code (limites WebSearch et sous-agents) et à la capacité des agents Amp à en faire naître d’autres, dessine une même trajectoire pour les outils de codage agentique : après une phase de croissance débridée en paiement à l’usage, l’industrie entre dans une phase de structuration économique et de gouvernance. Facturer un abonnement prévisible tout en plafonnant le nombre de sous-agents qu’une session peut engendrer répond au même problème par deux bouts : rendre soutenable, pour l’éditeur comme pour l’utilisateur, une informatique où les agents peuvent désormais en déclencher d’autres en cascade.
Perplexity Projects, l’association Gemini Enterprise-Parallel Web Systems et les Automations de Grok convergent vers un même schéma pour l’entreprise : contexte persistant, connecteurs aux outils métier existants et exécution autonome sur planning ou déclencheur. L’étude de cas Ascendea, où dix employés humains pilotent 28 à 33 flux de travail IA en production via Manus, illustre où cette logique peut mener dans une petite structure — un cas extrême qui préfigure la question que devront se poser des organisations bien plus grandes.
Du côté de la génération de médias, HeyGen étoffe son infrastructure de production (Batch APIs, médiathèque intégrée à HyperFrames) pendant qu’ElevenLabs mise sur des partenariats de voix de célébrités entièrement licenciées et que Runway fait valider ses choix de conception par un benchmark tiers indépendant. Le secteur passe ainsi d’une logique de démonstration à une logique d’infrastructure de production, où l’échelle, la licence et l’évaluation externe deviennent des arguments de vente à part entière.
Enfin, la recherche ouverte rappelle que les fondations restent perfectibles : « Diffusing Blame » de Sakana AI explore une contrainte biologique inédite pour entraîner des réseaux de neurones, tandis que PerceptionBench de Kimi révèle qu’aucun modèle multimodal actuel ne dépasse 60 % de précision sur des tâches de perception visuelle élémentaire. Ce contrepoint rappelle, derrière les annonces produits de la journée, que les capacités perceptives et architecturales des modèles continuent de receler des angles morts que la course aux fonctionnalités ne comble pas automatiquement.
Sources
- Amp Subscriptions, At Last
- @sqs sur X — Amp Subscriptions
- CHANGELOG Claude Code — v2.1.212
- Amp — From Agent to Agent
- @thorstenball sur X — teaser From Agent to Agent
- Manus — étude de cas Ascendea
- Perplexity — lancement de Projects
- xAI — Automations in Grok
- Google Developers Blog — Conductor Plugin
- Google Developers Blog — Gemini Enterprise Agent Platform et Parallel Web Systems
- @HeyGen sur X — Batch APIs
- HeyGen — documentation Batch APIs
- @HeyGen sur X — médiathèque HyperFrames
- @ElevenLabs sur X — L’Odyssée narrée par Michael Caine
- @runwayml sur X — Physion-Arc 1.0
- Runway — Inside Our Approach to Building Runway Agent
- @SakanaAILabs sur X — Diffusing Blame
- Diffusing Blame sur arXiv
- Kimi — PerceptionBench
- @claudeai sur X — fin du hackathon Life Sciences
- @bcherny sur X — adoption de l’IA en entreprise
- @NVIDIAAI sur X — NeMo AutoModel et Diffusers
- Antigravity — changelog
- GitHub Changelog — Fix with Copilot sur GitHub Mobile
- @NVIDIAAI sur X — Nemotron 3 Embed 8B sur LMEB
- @HeyGen sur X — HyperFrames jour 12/30
- @Kling_ai sur X — NextGen Awards Séoul
- Runway — étude de cas R/GA
- @zcode_ai sur X — ZCode browser/computer use
- OpenAI — A scorecard for the AI age