Rechercher

Claude Opus 5, Midjourney rachète Co-Star, Jensen Huang défend les modèles ouverts

Le 24 juillet 2026 est dominé par un seul évènement structurant : Anthropic lance Claude Opus 5, adopté le jour même par Cursor, Devin, v0 et GitHub Copilot — le cycle entre la sortie d’un modèle et son adoption dans les outils de code est désormais quasi instantané. Le même jour, Midjourney annonce sa toute première acquisition (Co-Star), Jensen Huang (NVIDIA) publie son tout premier message personnel sur X pour défendre les modèles ouverts, et xAI ajoute l’orchestration de centaines d’agents en parallèle à Grok Build. Autour de ces quatre sujets gravitent quinze nouveautés notables — de l’écosystème des outils de code à l’expansion Enterprise de Genspark — et neuf annonces mineures.


Claude Opus 5 : nouveau modèle Anthropic, adopté le jour même par Cursor, Devin, v0 et GitHub Copilot

24 juillet — Anthropic lance Claude Opus 5, nouveau modèle de la famille Claude 5 aux côtés de Sonnet 5 et Fable 5. Positionnement officiel : un modèle « réfléchi et proactif » qui se rapproche de l’intelligence frontière de Claude Fable 5 — le modèle le plus capable d’Anthropic — pour moitié prix. Il est disponible dès aujourd’hui sur tous les plans payants et via l’API (identifiant claude-opus-5), au même tarif qu’Opus 4.8 : $5 par million de tokens en entrée, $25 par million en sortie. Un mode Fast, environ 2,5× plus rapide, est facturé au double du tarif de base. Opus 5 devient le modèle par défaut sur Claude Max et le plus capable proposé sur Claude Pro.

BenchmarkRésultat Opus 5
Frontier-Bench v0.1Dépasse tous les modèles, plus du double du score d’Opus 4.8, à moindre coût par tâche
CursorBench (effort maximal)À 0,5 point du meilleur score de Fable 5, pour moitié moins cher
ARC-AGI 3 (problèmes inédits)Score environ trois fois supérieur au meilleur concurrent
OSWorld 2.0 (usage d’ordinateur)Dépasse le meilleur résultat de Fable 5 pour environ un tiers de son coût

Anthropic rapporte aussi des progrès en sciences de la vie : +10,2 points en chimie organique (inférence de structures moléculaires) et +7,7 points sur la prédiction d’effets de variations de séquences protéiques, par rapport à Opus 4.8. Nuance importante : ces résultats d’« état de l’art » concernent le code et le travail de la connaissance — sur la cybersécurité offensive, Opus 5 reste volontairement derrière Mythos 5 (modèle à accès restreint) : ses classificateurs de sécurité bloquent le scan de vulnérabilités par méthode binaire, les tests d’intrusion et la génération d’exploits, tout en autorisant la détection de vulnérabilités dans le code source. Anthropic estime que ces classificateurs interviendront environ 85 % moins souvent que sur Fable 5.

Côté alignement, Anthropic indique qu’Opus 5 est, selon son audit comportemental automatisé interne, le modèle le plus aligné à ce jour (score de 2,3 sur le comportement mal aligné global, le plus bas de ses modèles récents). Dans Claude Code, il est utilisable immédiatement via /model claude-opus-5 ou via /claude-api migrate pour basculer des charges de travail existantes, et démarre par défaut en effort élevé.

🔗 Annonce officielle — Anthropic

It’s a thoughtful and proactive model that comes close to the frontier intelligence of Fable 5 at half the price.

🇫🇷 C’est un modèle réfléchi et proactif qui se rapproche de l’intelligence frontière de Fable 5, pour moitié prix.@claudeai sur X

Adoption day-one dans les outils de code. En moins d’une demi-heure, trois outils de code annoncent l’intégration à quelques minutes d’intervalle, suivis le jour même par GitHub Copilot :

Outil intégrateurHeure d’annonce (24 juillet)Détail différenciant
Cursor19h03Égale Fable 5 sur CursorBench (66,7 vs 66,5 à l’effort par défaut), moitié prix, compatible Zero Data Retention
Devin (Cognition)19h07« Approche » le niveau de Fable 5 sur FrontierCode 1.1, pour moitié moins cher
v0 (Vercel)19h29Disponible immédiatement via v0.app/?opus5
GitHub CopilotMême jourVS Code, Visual Studio, Copilot CLI, cloud agent, JetBrains, Xcode… pour Pro+/Max/Business/Enterprise

Cursor est le plus précis, avec des chiffres exacts et un avantage additionnel : la compatibilité Zero Data Retention, que Fable 5 n’offre pas. Côté GitHub, Copilot met en avant de bons résultats sur les workflows de codage agentique — modifications autonomes, vérification de non-régression, coordination de plusieurs outils — mais prévient que le modèle embarque des garde-fous susceptibles de bloquer certaines requêtes liées à la cybersécurité, avec une recommandation de reformuler ou de choisir un autre modèle en cas de blocage. Le déploiement Copilot est progressif ; les administrateurs Enterprise et Business doivent activer la politique Claude Opus 5 pour donner accès à leurs équipes.

🔗 Cursor annonce l’intégration

🔗 Devin annonce l’intégration — @cognition

🔗 v0 annonce l’intégration

🔗 GitHub Copilot — changelog officiel


Midjourney acquiert Co-Star, première acquisition de son histoire

23 juillet — Midjourney annonce sa toute première acquisition : Co-Star, l’application d’astrologie personnalisée connue pour son ton direct et ses notifications virales. Sa fondatrice, Banu Guler, rejoint Midjourney au poste nouvellement créé de Chief Design Officer, chargée de construire une organisation transversale Produit/Design/Frontend pour l’ensemble des projets de l’entreprise. Co-Star continue de fonctionner de façon autonome, entièrement sous son contrôle et sa direction.

Le billet officiel, au ton très personnel, replace cette acquisition dans une trajectoire plus large : il évoque Midjourney Medical comme le début d’un « laboratoire de recherche inhabituel » et annonce une demi-douzaine de projets tout aussi ambitieux dans les six prochains mois. Midjourney, jusqu’ici concentré sur la génération d’images et de vidéos, signale ainsi une diversification stratégique explicite au-delà de son cœur de métier historique. Le relais sur X, publié le lendemain, a rassemblé plus de 426 000 vues, 1 300 « J’aime » et 226 reposts en quelques heures.

🔗 Relais X — 426 000 vues en quelques heures

“As an adult I find myself in the unusual position of having everything I wanted and two questions come to mind next: How can I use this opportunity to make baby David proud?”

🇫🇷 Adulte, je me retrouve dans la position inhabituelle d’avoir tout ce que je voulais, et deux questions me viennent alors : comment utiliser cette opportunité pour rendre le petit David fier ?Midjourney, changelog officiel


NVIDIA : Jensen Huang publie son premier post X, une lettre ouverte en défense des modèles ouverts

24 juillet — Jensen Huang, fondateur et PDG de NVIDIA, publie son tout premier message personnel sur X : une lettre ouverte signée par NVIDIA, intitulée « Open Weights and American AI Leadership », sur l’importance des modèles ouverts (open models). Il y affirme que l’IA « va transformer chaque industrie, alimenter chaque entreprise, et être construite par chaque pays », et que les modèles ouverts renforcent la sécurité et la cybersécurité, accélèrent l’innovation et permettent la souveraineté — une prise de position qui aligne explicitement NVIDIA, via sa propre gamme Nemotron publiée en poids ouverts, du côté de l’écosystème open-weight, face aux laboratoires fermés comme OpenAI, Anthropic ou Google.

Le post a suscité un engagement hors norme pour un tout premier message personnel : plus de 23,6 millions de vues, 98 000 « J’aime » et 23 700 reposts en quelques heures. Plusieurs acteurs de l’IA open-weight, dont MiniMax, ont publiquement remercié Jensen Huang pour cette prise de position dans la foulée.

“Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models.”

🇫🇷 Les modèles ouverts renforcent la sécurité et la cybersécurité, accélèrent l’innovation et sa diffusion, et permettent la souveraineté. Le monde a besoin à la fois de modèles frontière fermés et de modèles frontière ouverts.@JensenHuang sur X


Workflows in Grok Build : xAI orchestre des centaines d’agents en parallèle

23 juillet — xAI lance les workflows dans Grok Build, son agent de codage en ligne de commande (équivalent à Claude Code ou Codex). L’utilisateur décrit une tâche complexe en langage naturel ; Grok planifie automatiquement un script d’orchestration — les phases de travail, les agents affectés à chacune, la façon dont leurs résultats remontent — puis l’exécute en arrière-plan pendant que la session reste disponible pour autre chose.

Paramètre techniqueValeur mesurée
Agents par défaut128
Agents maximum (grosses tâches)1024
Démonstration mise en avantRevue de pull request GitHub en 4 phases (Context → Review → Verify → Synthesize)
Suivi en directCommande /workflows

Les relecteurs spécialisés de la démonstration voient leurs conclusions vérifiées de façon adversariale par des « sceptiques » indépendants avant d’atterrir dans le rapport final. La progression est sauvegardée en continu — pause et reprise n’obligent jamais à refaire le travail déjà fait. Les workflows peuvent être sauvegardés et réutilisés : ceux placés dans .grok/workflows/ sont partagés avec l’équipe, ceux dans ~/.grok/workflows/ suivent l’utilisateur partout, et chaque workflow sauvegardé devient sa propre slash command paramétrable (par exemple /pr-review 5137). La fonctionnalité /deep-research, qui éclate une question de recherche entre plusieurs investigateurs en parallèle et vérifie chaque affirmation contre ses sources, est incluse nativement.

Cas d’usage mis en avant par xAI : relire chaque fonctionnalité d’une grosse pull request, trier les 100 derniers tickets Linear pour en tirer une liste d’actions, ou auditer chaque gestionnaire de route d’une base de code à la recherche de contrôles d’authentification manquants.

🔗 Annonce officielle — xAI


L’écosystème du code : moins de prompt, plus d’agents

Claude Code : Anthropic supprime 80 % du system prompt pour les modèles Claude 5

24 juillet — Thariq (@trq212), de l’équipe Anthropic, publie un article détaillant l’évolution du context engineering de Claude Code : Anthropic a supprimé plus de 80 % du system prompt de Claude Code pour les modèles Claude 5 comme Opus 5 et Fable 5, sans perte mesurable sur les évaluations de code. Les anciens system prompts imposaient des règles rigides — par exemple ne jamais écrire de commentaires multi-lignes — devenues inutiles, les modèles récents disposant d’un meilleur jugement pour trancher les instructions contradictoires selon le contexte. L’article formalise six changements de doctrine, dont : donner des règles strictes → laisser Claude juger ; tout mettre en amont dans le prompt → divulgation progressive. Anthropic met ces pratiques à disposition via une nouvelle commande, /doctor, qui aide à auditer et redimensionner les skills et fichiers CLAUDE.md d’un projet.

🔗 Fil complet — @trq212

v0 transforme un fichier Figma complet en application

24 juillet — v0 (Vercel) étend son intégration Figma, jusqu’ici plutôt centrée sur l’import de composants isolés : à partir d’un simple lien, l’agent explore automatiquement toutes les pages et frames du fichier, sélectionne les éléments pertinents — tokens de design, couleurs, mise en page, texte, icônes — puis assemble les écrans identifiés en une seule application cohérente, sans sélection manuelle frame par frame. La documentation officielle détaille l’ensemble des données extraites sur la page dédiée de v0 Docs.

🔗 Annonce — @v0

Copilot cloud agent for Linear passe en disponibilité générale

23 juillet — GitHub fait passer en disponibilité générale l’assignation d’issues Linear à Copilot cloud agent : une fois assignée, l’agent analyse l’issue, ouvre une pull request en brouillon dans un environnement éphémère propulsé par GitHub Actions, fait remonter sa progression dans la timeline Linear, puis demande une revue. Nouveauté par rapport à la préversion : choix du modèle et de l’agent personnalisé directement depuis Linear, définition des branches cibles, et pilotage de la session par simple commentaire. Disponible avec les formules Copilot Pro, Pro+, Business et Enterprise.

🔗 Changelog officiel

GitHub MCP Server anticipe la prochaine spécification MCP

23 juillet — Le protocole MCP (Model Context Protocol) devient sans état (stateless) à partir du 28 juillet 2026, et GitHub MCP Server prend déjà en charge cette nouvelle spécification en avance sur sa publication officielle. À la clé : suppression des sessions Redis, connexions plus rapides sans étape initialize, et une implémentation de l’elicitation mise à niveau vers des requêtes HTTP séparées. Les SDK de niveau 1 conservant une rétrocompatibilité, aucune action n’est requise côté clients existants.

🔗 Changelog officiel

Sakana AI publie Fugu-Ultra v1.1 et une interface compatible Claude Code

24 juillet — Sakana AI publie une mise à jour de son moteur d’orchestration multi-modèles Fugu-Ultra (v1.1), avec des gains allant jusqu’à 7,9 points par rapport à v1.0, particulièrement marqués sur ProgramBench et Terminal Bench 2.1. Sakana revendique de meilleures performances que Fable 5 en codage complexe et raisonnement, sans même inclure ce dernier dans son pool de modèles orchestrés. En parallèle, Sakana expose des endpoints compatibles Claude Code pour utiliser l’intelligence multi-agents de Fugu directement depuis ce client plutôt que de dépendre d’un modèle unique.

🔗 Annonce officielle — Sakana AI


Google / Gemini : extension de Spark, correctif de sécurité pour Gemini CLI

Gemini Spark étendu aux abonnés Google AI Pro aux États-Unis

23 juilletGemini Spark, l’agent IA personnel de Google qui travaille en arrière-plan 24/7 pour accomplir des tâches sous la direction de l’utilisateur, franchit une étape d’élargissement : après les abonnés Google AI Ultra, il commence à être déployé auprès des abonnés du palier Google AI Pro, nettement plus large, dans un premier temps aux États-Unis. Google annonce une extension à davantage de pays « bientôt ». Ce n’est pas une nouvelle fonctionnalité au sens strict, mais un changement d’audience qui rapproche un agent autonome de type premium du grand public payant.

🔗 Annonce — @GeminiApp

Gemini CLI v0.53.0-preview.0 corrige une faille RCE

22 juillet — Nouvelle release preview de Gemini CLI (non encore listée dans le changelog officiel stable), avec deux correctifs à portée sécurité : renforcement de l’isolation des tâches et de la confiance de l’espace de travail dans le serveur Agent-to-Agent pour empêcher une exécution de code arbitraire (RCE), et mitigation des boucles d’injection de prompt et des boucles ReAct infinies. S’y ajoutent un orchestrateur de triage basé LLM et un durcissement des profils Seatbelt sur macOS vers un modèle deny-by-default.

🔗 Release GitHub v0.53.0-preview.0


OpenAI : ChatGPT Work se connecte aux sites protégés, un diagnostic corrigé grâce à ChatGPT

ChatGPT Work peut désormais se connecter aux sites nécessitant une authentification

24 juillet — L’agent ChatGPT Work peut désormais utiliser des sites qui exigent une connexion : l’utilisateur prend la main sur le navigateur cloud le temps de s’authentifier, puis laisse l’agent reprendre la tâche automatiquement. Point clé : la connexion persiste d’une session à l’autre, une seule authentification suffisant pour les tâches suivantes sur ce même site — une limitation classique des agents de navigation web ainsi levée. Cette évolution élargit le périmètre des tâches automatisables aux outils internes d’entreprise et aux SaaS protégés par identifiants.

🔗 Annonce — @OpenAIDevs

Comment ChatGPT a aidé à corriger un diagnostic de cancer

24 juillet — OpenAI Newsroom raconte comment le mari de Kiley, diagnostiquée à 18 ans d’un glioblastome au pronostic de quelques mois et toujours vivante cinq ans plus tard sans explication claire, a utilisé ChatGPT pour décrypter un compte-rendu de radiologie récent. Cette lecture a ramené aux résultats de la biopsie initiale, où ChatGPT a aidé à faire ressortir un détail resté inaperçu : une mutation IDH1. En lien avec le neuro-oncologue de Kiley, ce détail a permis de requalifier le diagnostic en astrocytome IDH-muté — toujours sérieux, mais avec un pronostic bien plus favorable.

🔗 Témoignage — @OpenAINewsroom


NVIDIA & vidéo générative : infrastructure plus rapide, agents plus collaboratifs

NVIDIA réduit de 8 minutes à moins de 2 minutes le démarrage de DeepSeek-V4 Pro

24 juillet — NVIDIA détaille une optimisation d’infrastructure d’inférence : le temps de démarrage d’un déploiement DeepSeek-V4 Pro passe de 8 minutes à moins de 2 minutes, en acheminant les poids du modèle vers la mémoire GPU par le chemin le plus rapide via RDMA GPU-à-GPU. Le mécanisme repose sur NVIDIA ModelExpress, le service de distribution et de gestion de cache des poids intégré à NVIDIA Dynamo, sa plateforme d’inférence distribuée. NVIDIA précise que la même approche accélère aussi le post-entraînement par renforcement.

🔗 Annonce — @NVIDIAAI

Runway ajoute des Workflows en langage naturel à son agent

24 juillet — Runway ajoute une fonctionnalité Workflows à Runway Agent : il devient possible de construire, exécuter ou modifier des flux de travail à base de nœuds (node-based workflows) directement en langage naturel, plutôt que par manipulation manuelle d’un éditeur visuel. Distinct du Media Router lancé la veille — qui gère la sélection automatique de modèles génératifs selon coût, qualité et latence — Workflows s’attaque à l’orchestration des étapes de production elles-mêmes.

🔗 Annonce — @runwayml

HeyGen — Companion mode : diriger la vidéo plutôt que la commander

22 juillet — HeyGen introduit le companion mode pour son Video Agent : au lieu de commander une vidéo via un prompt unique, l’utilisateur la dirige de façon itérative — l’agent propose cinq angles créatifs, présente un storyboard pour validation, puis esquisse les images clés à examiner avant la génération finale. L’utilisateur garde la main à chaque étape et ne lance la production intégrale qu’après approbation. Cette fonctionnalité répond à une critique fréquente des générateurs vidéo « en un coup » — résultat imprévisible, itérations coûteuses en temps et en crédits — en rapprochant l’expérience de la collaboration avec un réalisateur humain.

🔗 Annonce — @HeyGen


Genspark : partenariat Microsoft et investissement de 100 millions de dollars au Japon

SecondBrain s’intègre à Outlook, Teams et Microsoft Agent 365

24 juillet — Lors du lancement de Genspark 6.0 à Séoul, Genspark détaille un partenariat stratégique avec Microsoft : SecondBrain, la couche de mémoire persistante de ses agents, s’intègre désormais directement dans Outlook, Office, Teams, ainsi que Microsoft Agent 365 — dont Genspark indique avoir été partenaire de lancement mondial. L’ensemble tourne sur Azure, présenté comme garantissant la robustesse attendue en environnement d’entreprise. Le post remercie nommément Satya Nadella (PDG de Microsoft), Judson Althoff et Rodrigo Kede. Ce volet ne figurait pas dans le billet de lancement initial du 20 juillet.

🔗 Annonce — @genspark_ai

Genspark investit 100 millions de dollars sur 3 ans au Japon

24 juillet — À la suite d’un évènement tenu à Tokyo le 21 juillet devant des clients entreprise, partenaires industriels et influenceurs japonais — le second de Genspark dans le pays —, l’entreprise annonce un investissement de $100 millions sur les trois prochaines années au Japon, six mois seulement après l’ouverture de son activité locale. Trois priorités : résidence des données pour les clients éligibles (institutions financières, agences gouvernementales, grandes entreprises), partenariats de bout en bout avec revendeurs et intégrateurs, et renforcement des équipes sur le terrain, dans la langue et le fuseau horaire des clients.

🔗 Annonce — @genspark_ai


Grok débarque dans Google Workspace

24 juillet — xAI lance un module complémentaire gratuit qui intègre Grok directement dans Sheets, Slides et Docs, installable depuis le Google Workspace Marketplace. Dans Sheets, Grok répond aux questions en citant les cellules utilisées et écrit des formules ; dans Slides, il transforme un plan en présentation en respectant le thème existant ; dans Docs, il rédige et corrige à l’endroit même de l’écriture, avec accès aux emails et fichiers Drive récents si les connecteurs sont activés. Cette intégration complète la suite déjà disponible côté Microsoft 365 (Word, Excel, PowerPoint, Outlook), lancée entre juin et juillet.

🔗 Annonce officielle — xAI


Brèves

  • Replit récapitule ses nouveautés du mois — agent vocal, création depuis Claude ou Slack, mémoire de stack persistante ; au moins une des capacités citées semble recouper une intégration déjà publiée le 17 juin. 🔗 Source
  • Kimi K3 quasi à égalité avec Claude Fable 5 sur DeepSWE — pass@1 à 1,4 point d’écart, mais devant en pass@2/pass@4, à 2,8× moins cher par tâche résolue (Together AI). 🔗 Source
  • Déclaration collective sur l’ouverture des modèles comme voie vers la sécurité de l’IA — coalition d’une quinzaine d’organisations dont Hugging Face, Meta, Mistral AI, NVIDIA et Microsoft, repostée par le compte officiel @huggingface. 🔗 Source
  • HeyGen lance une API Audio to Video — voix et image vers vidéo en un seul appel, avec traitement par lot (ex. 100 narrations sur la même image). 🔗 Source
  • ElevenLabs publie un billet sur la voix IA et la protection des élections — positionnement institutionnel à l’approche d’échéances électorales majeures. 🔗 Source
  • HeyGen — HyperFrames, jour 18 sur 30 — nouvel épisode de la série quotidienne, consacré à son usage dans Video Agent. 🔗 Source
  • Zvec 0.6.0, moteur de recherche vectorielle de Tongyi Lab (Alibaba) — recherche Group-By, plus de 50 points de recall gagnés en quantification INT4, support étendu à 34 langues. 🔗 Source
  • xAI multiplie les plugins tiers dans Grok Build — Tavily et Exa pour la recherche web, Grok STT disponible sur OpenRouter à $0,10 par heure audio. 🔗 Source
  • ChatGPT Pet devient partageable entre utilisateurs — lien partageable depuis les réglages de Personnalisation sur le web, pour qu’un autre utilisateur adopte le pet. 🔗 Source

Ce que ça signifie

Le lancement d’Opus 5 illustre un changement structurel dans la manière dont les modèles frontière atteignent leurs utilisateurs : Cursor, Devin et v0 l’intègrent en moins d’une demi-heure, GitHub Copilot le même jour. Le cycle sortie → adoption, qui se comptait encore récemment en semaines, est désormais quasi nul pour les outils de code les mieux connectés à l’écosystème Anthropic — une dynamique qui raccourcit d’autant la fenêtre de différenciation entre laboratoires et déplace la compétition vers la rapidité d’intégration autant que vers la performance brute des modèles.

Le même jour, un contre-discours s’exprime avec la même intensité. Jensen Huang publie sa toute première prise de parole personnelle sur X pour défendre les modèles ouverts comme voie vers la sécurité et la souveraineté ; une coalition d’une quinzaine d’organisations, dont Hugging Face et Meta, porte une déclaration proche ; et Sakana AI revendique dépasser Fable 5 en orchestrant plusieurs modèles sans même l’inclure dans son pool. Deux visions de la sécurité de l’IA — l’une fondée sur le contrôle propriétaire, l’autre sur la transparence des poids — s’affrontent publiquement le même jour, sans que l’une ne prenne visiblement le pas sur l’autre.

La cybersécurité continue par ailleurs de fonctionner comme un marqueur de prudence délibérée plutôt que de performance brute. Anthropic positionne volontairement Opus 5 derrière Mythos 5 sur les tâches offensives, avec des classificateurs dédiés qui bloquent scan de vulnérabilités, tests d’intrusion et génération d’exploits. Au même moment, Google corrige dans Gemini CLI une faille d’exécution de code arbitraire côté serveur agent-to-agent — un rappel que les outils agentiques eux-mêmes, pas seulement les modèles qu’ils embarquent, restent une surface d’attaque à sécuriser en continu.


Sources