Le 19 juillet 2026 voit Alibaba annoncer Qwen3.8, un modèle de 2,4 billions de paramètres en route vers l’open-weight, pendant qu’OpenAI muscle Codex avec un plugin de cybersécurité porté par un record sur cyber range. En toile de fond, les CEO de Hugging Face et de Together AI montent au créneau le même jour pour défendre les modèles ouverts face aux rumeurs de régulation, pendant que l’outillage développeur s’enrichit côté Copilot CLI et que Kimi K3, saturé par la demande, referme temporairement ses inscriptions.
Qwen3.8 : Alibaba annonce un modèle de 2,4 billions de paramètres, open-weight à venir
19 juillet — Qwen, la division IA d’Alibaba, a annoncé le lancement prochain de Qwen3.8, un nouveau modèle doté de 2,4 billions de paramètres dont les poids seront publiés en open-weight dans les prochaines semaines. Selon l’entreprise, le modèle, encore en évolution continue, compterait parmi les plus puissants disponibles à ce jour — Alibaba revendique même un niveau comparable aux modèles frontière du marché, se plaçant juste derrière Fable 5, le modèle d’Anthropic dont l’accès standard sur les plans Max et Team Premium, annoncé le 18 juillet, prend effet le 20 juillet. Une comparaison qui reste une déclaration de l’éditeur sur son propre lancement, pas un classement tiers vérifié de façon indépendante.
Sans attendre la disponibilité complète des poids, une version de prévisualisation — Qwen3.8-Max-Preview — a fait ses débuts le jour même sur le Token Plan d’Alibaba ainsi que sur les plateformes Qoder et QoderWork, permettant aux premiers utilisateurs de la tester immédiatement.
L’annonce a suscité une forte réaction de la communauté (4,4 millions de vues en quelques heures), avec de nombreuses demandes — notamment de la part d’Unsloth AI — pour que des versions plus compactes du modèle soient également publiées afin de permettre une exécution locale.
| Caractéristique | Détail communiqué |
|---|---|
| Nombre de paramètres | 2,4 billions |
| Disponibilité des poids ouverts | À venir (« soon », non datée) |
| Version de prévisualisation | Qwen3.8-Max-Preview, disponible immédiatement |
| Plateformes de prévisualisation | Alibaba Token Plan, Qoder, QoderWork |
OpenAI lance Codex Security, porté par un record de cybersécurité de GPT-5.6 Sol
18 juillet — OpenAI a lancé Codex Security, un plugin pour Codex (CLI et Desktop) dédié à la détection, la validation et la correction de vulnérabilités dans du code réel. L’annonce s’appuie sur une revendication forte : GPT-5.6 Sol établirait un nouveau record de cybersécurité sur « The Last Ones », un cyber range utilisé par l’AISI (AI Security Institute) pour évaluer les capacités offensives et défensives des modèles sur une simulation d’attaque de réseau d’entreprise.
Le parcours comprend 32 étapes regroupées en neuf jalons, de la reconnaissance initiale (M1) à la prise de contrôle totale du réseau (M9), en passant par le vol d’identifiants navigateur ou l’exploitation d’applications web. Dans sa meilleure tentative, GPT-5.6 Sol atteint le sommet du graphique jusqu’au jalon M9, devançant Claude Mythos 5, GPT-5.5, Claude Opus 4.6, GLM-5.2 et Sonnet 4.5 ; DeepSeek-V4-Pro reste nettement en retrait.
Une fois installé, le plugin suit un parcours guidé quasi identique sur Desktop et CLI : installer Codex, ajouter le plugin Codex Security, lancer un chat avec un prompt d’analyse prêt à l’emploi, choisir le dossier de projet à examiner, puis envoyer le prompt. Codex Security parcourt alors la base de code, identifie les vulnérabilités, les valide pour limiter les faux positifs, puis propose des corrections.
Cette annonce se distingue de GPT-Red (couvert le 15 juillet), centré sur le red teaming interne des modèles d’OpenAI eux-mêmes : Codex Security met cette même capacité offensive au service d’un usage défensif externe, sur des bases de code tierces.
| Modèle évalué (meilleure tentative) | Position sur le cyber range AISI |
|---|---|
| GPT-5.6 Sol | Sommet — jalon M9 (contrôle total du réseau) |
| Claude Mythos 5 | 2ᵉ position, proche du sommet |
| GPT-5.5 / Claude Opus 4.6 | Intermédiaire haut |
| GLM-5.2 / Sonnet 4.5 | Intermédiaire bas |
| DeepSeek-V4-Pro | Nettement en retrait |
🔗 Annonce sur X · Codex Security — page officielle
Les labos open-weight montent au créneau contre la régulation
19 juillet — Le même jour, les CEO de Hugging Face et de Together AI ont publié séparément sur X des prises de position défendant l’IA en poids ouverts — un signal de mobilisation de l’écosystème open-source face à des rumeurs de régulation plus restrictive.
Clément Delangue (Hugging Face) appelle à un rassemblement à San Francisco
Clément Delangue, cofondateur et CEO de Hugging Face, réagit à des rumeurs de limitation prochaine de l’IA open-source : pour lui, il faut au contraire davantage de modèles ouverts, accessibles à tous. Son argumentaire tient en trois points : plus de contrôle et de transparence, une IA moins chère et adaptable, et la capacité de concurrencer les grands acteurs plutôt que de dépendre entièrement de la location d’intelligence auprès d’eux. Sur la sécurité, il estime que restreindre les modèles ouverts ne ferait que masquer les risques et concentrer le pouvoir entre quelques mains. Pour appuyer sa position, un rassemblement pacifique est organisé à San Francisco le samedi suivant, avec inscription via un lien Partiful partagé dans le tweet.
There have been rumors that open-source AI could soon be limited and regulated. I believe the opposite is what’s needed: we need more open-source AI, not less, for everyone, from all over the world, at the frontier and everywhere!
🇫🇷 Des rumeurs circulent sur une possible limitation et régulation prochaine de l’IA open-source. Je pense au contraire qu’il faut plus d’IA open-source, pas moins, pour tout le monde, partout dans le monde, à la frontière technologique comme ailleurs ! — @ClementDelangue sur X
Vipul Ved Prakash (Together AI) défend la commoditisation des modèles ouverts
Vipul Ved Prakash, cofondateur et CEO de Together AI, développe le même jour un argumentaire économique en réponse à un fil de Dean W. Ball sur les performances du modèle Kimi. Sa thèse : la commoditisation des modèles d’IA est déjà en cours, et elle ressemble aux grands marchés de matières premières — pétrole, blé, acier, électricité, mémoire — plutôt qu’à une économie planifiée. Il soutient aussi que les poids ouverts ne freinent pas les dépenses d’investissement mais les déplacent vers l’inférence, la donnée et les outils, à l’image de Linux, défavorable à Sun Microsystems mais bénéfique à presque tout le reste de l’industrie. Il conclut en dénonçant ce qu’il appelle du « security theater » autour des risques existentiels de l’IA, qu’il juge non étayés par des preuves.
It has been clear to many of us, and now it’s becoming clear more tangibly, that AI models will commoditize to various degrees. This is of course a difficult business reality if your core business depends on exclusivity on intelligence. But commodity markets are not communism. They are the largest markets on earth. Oil, grain, steel, electricity, memory: trillions clear through them every year, priced by competition among thousands of suppliers.
🇫🇷 Beaucoup d’entre nous le savaient déjà, et cela devient maintenant plus tangible : les modèles d’IA vont se commoditiser à des degrés divers. C’est bien sûr une réalité économique difficile si votre activité principale dépend de l’exclusivité de l’intelligence. Mais les marchés de matières premières ne sont pas le communisme. Ce sont les plus grands marchés du monde. Pétrole, blé, acier, électricité, mémoire : des milliers de milliards s’y échangent chaque année, au prix fixé par la concurrence entre des milliers de fournisseurs. — @vipulved sur X
GitHub Copilot CLI affiche désormais issues, pull requests et gists dans le terminal
19 juillet — GitHub a annoncé que Copilot CLI permet désormais de consulter sa session en cours, ses issues, ses pull requests et ses gists directement depuis l’outil en ligne de commande, sans basculer vers le navigateur ou l’application GitHub. La fonctionnalité est disponible à partir de la version v1.0.58.
Cet ajout s’inscrit dans la logique de Copilot CLI depuis son lancement : réduire les allers-retours entre le terminal et l’interface web pendant une session de travail avec l’agent. Il s’agit d’un enrichissement d’ergonomie plutôt que d’une nouvelle capacité agentique, mais le CLI reste la priorité de couverture numéro un pour Copilot, aux côtés de Workspace.
Kimi K3 : Moonshot AI suspend temporairement les nouvelles souscriptions
19 juillet — Trois jours après le lancement de Kimi K3 (2,8 billions de paramètres, annoncé le 16 juillet), Moonshot AI annonce que la demande a dépassé ses prévisions de capacité GPU. Sur les 48 dernières heures, celle-ci s’est rapprochée des limites de l’infrastructure disponible : l’entreprise suspend donc temporairement les nouvelles souscriptions pour préserver l’expérience des abonnés déjà en place — ces derniers ne sont pas affectés par la pause.
Moonshot AI indique travailler à l’ajout de capacité supplémentaire et prévoit de rouvrir les inscriptions par lots. L’entreprise annonce aussi une restructuration à venir de son offre, désormais scindée en deux formules : Kimi Membership (Web, application, Work) et Kimi Code Membership (flux de travail liés au code).
Kimi K3 has received far more love than we expected, and our GPUs are feeling it. Over the past 48 hours, demand has pushed close to the limits of our current capacity.
🇫🇷 Kimi K3 a reçu bien plus d’engouement que nous ne l’anticipions, et nos GPU en ressentent l’effet. Au cours des 48 dernières heures, la demande s’est rapprochée des limites de notre capacité actuelle. — @Kimi_Moonshot sur X
Brèves
- Claude Code CLI v2.1.215 — Claude ne déclenche plus automatiquement les skills
/verifyet/code-reviewen cours de session ; il faut désormais les invoquer explicitement. 🔗 Changelog - HeyGen sur la couverture TV du Mondial — Telemundo Deportes utilise un avatar HeyGen du présentateur Pablo Mariño pour ses segments de couverture de la Coupe du monde FIFA 2026. 🔗 Source
- Kling AI publie « BACK SHADOW » — un mockumentaire généré par IA sur les coulisses humaines d’un match de football, dans le contexte de la Coupe du monde FIFA 2026. 🔗 Source
Ce que ça signifie
La course aux modèles frontière ouverts sature déjà l’infrastructure disponible. Qwen3.8 revendique 2,4 billions de paramètres avec un positionnement affiché tout près du sommet du marché, tandis que Kimi K3 — annoncé trois jours plus tôt à peine — doit suspendre ses nouvelles souscriptions faute de capacité GPU suffisante. Le succès d’un modèle ouvert ne se mesure donc plus seulement à ses benchmarks, mais à la capacité de son éditeur à absorber la demande qu’il génère : un problème d’infrastructure autant que de recherche.
La cybersécurité s’impose comme un nouveau terrain de compétition direct entre modèles. Le record revendiqué par GPT-5.6 Sol sur le cyber range « The Last Ones », immédiatement mis au service d’un produit défensif (Codex Security) plutôt que gardé comme simple argument marketing, illustre une tendance plus large : les capacités offensives développées en interne pour durcir un modèle deviennent, presque au même moment, un produit vendu aux équipes de développement pour protéger leur propre code.
La tension entre IA ouverte et régulation prend une tournure plus politique. Les prises de position de Clément Delangue et de Vipul Ved Prakash, publiées le même jour sans concertation apparente, montrent que les dirigeants de l’écosystème open-weight ne se contentent plus de publier des modèles : ils organisent aussi la défense publique du modèle économique qui les sous-tend, avec des registres différents — mobilisation citoyenne d’un côté, théorie économique des marchés de commodités de l’autre.
L’outillage développeur continue de se densifier dans le terminal plutôt que dans le navigateur. Les issues, pull requests et gists qui rejoignent Copilot CLI, tout comme le resserrement du contrôle utilisateur sur /verify et /code-review dans Claude Code, dessinent une même direction : consolider un maximum de contexte et de contrôle directement en ligne de commande, au plus près du code, plutôt que d’imposer des allers-retours vers des interfaces web séparées.
Sources
- Qwen3.8 — annonce sur X
- OpenAI Codex Security — annonce sur X
- OpenAI Codex Security — page officielle
- Clément Delangue sur X
- Vipul Ved Prakash sur X
- GitHub Copilot CLI — annonce sur X
- Kimi K3 — annonce sur X
- Claude Code CLI v2.1.215 — changelog
- HeyGen × Telemundo Deportes sur X
- Kling AI — BACK SHADOW sur X