Le 3 août 2026 concentre trois annonces majeures : Alibaba présente Qwen3.8-Max, son nouveau modèle phare de 2,4 T de paramètres, Genspark passe en open source sa suite bureautique GenOffice, et Vercel ouvre une API programmatique pour v0. Autour de ces trois sorties, Cursor, GitHub, Sakana AI, MiniMax, Runway, ElevenLabs et Google multiplient les mises à jour produit.
Qwen3.8-Max, nouveau modèle phare d’Alibaba pour le code et le cowork
Alibaba a présenté Qwen3.8-Max, décrit comme le modèle le plus capable produit par l’entreprise à ce jour, avec un positionnement centré sur le code et le travail collaboratif avec l’IA (cowork). Le modèle compte 2,4 T de paramètres et est disponible immédiatement via l’API et Qwen Studio.
L’équipe met en avant quatre axes de progrès : un développement autonome longue durée (dix jours ou plus d’auto-évolution, d’un dossier vide jusqu’à la production, avec trace complète du projet publiée sur GitHub), des livrables de qualité production sur de nombreux métiers, une planification autonome sur des horizons longs — jusqu’à 500 tours d’optimisation de conception de puces et 365 jours de stratégie e-commerce cités en exemples — et une intelligence multimodale native où la vision alimente en continu la planification, l’exécution et l’auto-correction.
Alibaba annonce l’ouverture des poids de Qwen3.8-Max la semaine suivant l’annonce, ainsi que la mise en open weights d’une version plus légère, Qwen3.8-27B. Le modèle est aussi disponible dès l’annonce sur Venice, une plateforme de chat anonyme, et une intégration dans un outil appelé « Command Code » a été mentionnée le même jour sans détail supplémentaire.
| Indicateur | Valeur |
|---|---|
| Paramètres | 2,4 T |
| Prix entrée | 2,0 $ / million de tokens |
| Prix sortie | 6,0 $ / million de tokens |
| Cache implicite | 0,25 $ / million de tokens |
| Ouverture des poids | Semaine suivante (Qwen3.8-Max + Qwen3.8-27B) |
Genspark ouvre le code de GenOffice, sa suite bureautique IA
Genspark a annoncé le passage en open source de GenOffice, présentée comme la première suite bureautique IA complète et open source pour PC et Mac. L’outil est gratuit pour tout le monde et sans publicité.
La suite couvre les usages classiques d’un pack bureautique — traitement de texte (Docs), tableur (Sheets), présentation (Slides) et PDF — avec les outils d’édition habituels. Genspark y intègre son Super Agent, capable de faire de la recherche, d’analyser des données puis de rédiger un document ou construire une présentation, en consommant des crédits Genspark.
Fait notable côté méthode de développement : la version Alpha a été construite par un seul ingénieur en une semaine, pour un coût de 10 000 dollars de tokens.
“One engineer, one week, $10,000 in tokens. That’s what it took to build the GenOffice Alpha.”
🇫🇷 Un ingénieur, une semaine, 10 000 dollars de tokens. C’est ce qu’il a fallu pour construire la version Alpha de GenOffice. — @genspark_ai sur X
Le projet est en phase Alpha assumée : Genspark invite la communauté à tester l’outil, remonter des bugs et proposer des demandes de fonctionnalités via un chat de groupe dédié sur GenTeam, sans écrire de code. Les contributeurs les plus utiles reçoivent en remerciement plus de 1 000 crédits Genspark. L’annonce a eu lieu à l’édition singapourienne d’AGI Playground, où Genspark défend l’idée qu’à mesure que les modèles deviennent moins chers, la valeur se déplace vers la meilleure expérience construite au-dessus.
Vercel lance une API programmatique pour v0
Vercel ouvre une nouvelle API v0, disponible dès aujourd’hui, qui donne un accès programmatique aux capacités de construction d’applications jusqu’ici réservées à l’interface de chat. Concrètement, un développeur peut désormais piloter v0 depuis son propre code plutôt qu’en passant par le site web.
Quatre opérations sont exposées : démarrer une conversation à partir d’un prompt texte, d’un dépôt de code existant ou d’une archive ZIP ; générer un aperçu du serveur de développement pour visualiser le résultat en direct ; envoyer des messages de suivi pour itérer sur la génération ; et déployer directement le résultat sur Vercel.
Cette API transforme v0 en brique intégrable dans des chaînes d’outils tierces — agents, scripts d’automatisation, intégrations internes — plutôt qu’en simple produit autonome grand public. C’est une évolution cohérente avec la stratégie de Vercel de faire de v0 une couche de génération d’interfaces exploitable par d’autres agents, y compris des agents tiers qui pilotent v0 sans passer par son chat historique.
Pour les équipes qui construisent déjà des agents de développement, cela ouvre la possibilité d’enchaîner génération de code, prévisualisation et déploiement dans un pipeline entièrement automatisé, sans intervention humaine à chaque étape.
Cursor : agents cloud plus efficaces et nouveaux plugins Google Workspace
Cursor a publié deux mises à jour distinctes le même jour, l’une sur la performance de ses agents cloud, l’autre sur l’intégration de Google Workspace.
Agents cloud : 20 à 30 % de tokens en moins
Cursor annonce des gains d’efficacité significatifs pour ses agents cloud : 20 à 30 % de tokens en moins consommés sur l’ensemble des tâches, et jusqu’à 80 % d’efficacité en plus sur les tâches utilisant le contrôle d’ordinateur (computer use). Ces gains viennent d’une meilleure gestion des serveurs MCP, des skills et du computer use par les agents. L’objectif affiché est de permettre aux utilisateurs de déléguer des tâches plus ambitieuses tout en restant dans leur budget de tokens.
Plugins Google Workspace intégrés à l’éditeur
Cursor peut désormais lire, écrire et agir directement sur Google Workspace via des plugins accessibles depuis la page « Customize » ou le Cursor Marketplace, sans quitter l’éditeur.
| Service Workspace | Fonctionnalités |
|---|---|
| Google Drive | Rechercher, ouvrir et télécharger des fichiers, organiser des dossiers |
| Gmail | Rechercher et lire le courrier, rédiger et envoyer des messages |
| Google Calendar | Consulter les agendas, créer des événements, trouver des créneaux libres |
| Google Docs | Ouvrir, lire, rédiger et modifier des documents |
| Google Sheets | Lire des plages, mettre à jour des cellules, créer des feuilles |
| Google Chat | Accéder aux espaces et messages, envoyer des messages |
L’objectif est de permettre à un développeur de tirer du contexte de sa messagerie ou de son agenda directement depuis Cursor, sans allers-retours vers le navigateur.
GitHub Agentic Workflows automatise la documentation cross-repo chez Aspire
GitHub met en avant un cas d’usage concret de GitHub Agentic Workflows : l’équipe Aspire l’utilise pour transformer automatiquement les fonctionnalités mergées en pull requests de documentation, réparties sur plusieurs dépôts. Le système applique des permissions restreintes (scoped permissions) et impose une revue humaine par un expert du sujet (SME review) avant fusion.
| Métrique suivie | Valeur |
|---|---|
| PR de documentation mergées | 82 / 82 |
| Délai médian de fusion | 44,8 heures |
Ce retour d’expérience illustre l’un des axes prioritaires de GitHub sur les workflows agentiques : garder un humain dans la boucle tout en automatisant les tâches répétitives de maintenance documentaire.
GitHub publie son Ship Log de juillet 2026
GitHub publie son récapitulatif mensuel des sorties de juillet 2026, centré sur le thème du choix pour les développeurs.
L’application de bureau GitHub Copilot est désormais disponible pour tous les plans, y compris Copilot Free et GitHub Education ; les développeurs sans abonnement peuvent aussi utiliser leur propre clé de fournisseur de modèle (bring your own key). Le sélecteur de modèles de Copilot s’enrichit : Kimi K2.7 Code devient le premier modèle à poids ouverts sélectionnable dans le picker, la famille OpenAI GPT-5.6 rejoint Copilot avec des baisses de prix de 80 % pour GPT-5.6 Luna et 20 % pour GPT-5.6 Terra, et Opus 5 d’Anthropic passe en disponibilité générale. GitHub Projects gagne par ailleurs des filtres améliorés et un système de tags basé sur des champs à sélection multiple.
Sakana Namazu, une API LLM taillée pour le marché japonais
Sakana AI a mis en ligne l’API Sakana Namazu, une déclinaison en service de son modèle Namazu jusqu’ici réservé à l’application Sakana Chat. Le modèle s’appuie sur Kimi K2.6, le modèle à poids ouverts de Moonshot AI, affiné par Sakana AI pour la langue et les usages métier japonais.
L’API est compatible avec le format OpenAI : il suffit de modifier l’URL de base et la clé d’API dans un code existant. Elle embarque des outils intégrés de recherche web et d’exécution de code, avec des capacités agentiques pour enchaîner plusieurs étapes de façon autonome.
Sakana AI met en avant trois cas d’usage : la génération autonome de rapports d’étude de marché, l’automatisation du support client, et une application créative pilotant environ 1 000 poissons animés à partir d’une simple consigne. Sur le benchmark FairPoliticsQA, dédié au contexte culturel japonais, le score passe de 34,10 % à 56,30 %.
MiniMax H3 : les poids sont désormais publiés
MiniMax avait annoncé son modèle multimodal ouvert H3 le 31 juillet — déjà couvert dans ces colonnes. Le 3 août, les poids sont effectivement publiés en open weights, avec un support « Day-0 » revendiqué sur l’ensemble de la chaîne d’inférence open source.
| Outil d’inférence | Support Day-0 |
|---|---|
| ComfyUI | Intégration native, un modèle et cinq workflows dès la sortie |
| vLLM-Omni | Endpoint vidéo compatible API OpenAI |
| SGLang / LMSYS | Support local personnalisable, exécution sur matériel NVIDIA et AMD |
| fal | Infrastructure de production prête à l’emploi |
MiniMax présente cette sortie comme le franchissement d’une étape entre l’annonce et la disponibilité réelle : les poids sont ouverts, la mise à disposition en production aussi. Le partenaire tiers Magnific a par ailleurs présenté une démonstration de synchronisation labiale native par personnage, en une seule génération.
Runway lance un plan Max avec 7 jours d’accès illimité à Seedance 2.5
Runway annonce un nouveau palier d’abonnement, le plan Max, avec une offre de lancement : les inscrits obtiennent 7 jours d’accès illimité au modèle Seedance 2.5 dès sa disponibilité sur la plateforme.
Seedance 2.5, déjà évoqué dans nos éditions précédentes, n’est pas encore disponible sur Runway (« coming soon ») : c’est bien le nouveau plan et son offre d’accès anticipé qui constituent la nouveauté du jour, pas le modèle lui-même.
ElevenAgents : l’IA vocale d’ElevenLabs à l’échelle entreprise
ElevenLabs détaille l’échelle et les capacités de sa plateforme d’agents vocaux et de chat ElevenAgents.
“More than 10 million conversations run on ElevenAgents every week.”
🇫🇷 Plus de dix millions de conversations sont traitées chaque semaine sur ElevenAgents. — @ElevenLabs sur X
Chaque conversation correspond à une interaction réelle prise en charge par une voix ou un agent de chat au ton naturel : demande de remboursement, prise de rendez-vous, question sur des prestations, changement de vol. La plateforme propose une simulation de scénarios avant mise en production, un déploiement multicanal, et un suivi via l’outil Spotlight, qui surveille les conversations en production et propose des recommandations proactives d’amélioration. Côté entreprise, ElevenLabs met en avant des garde-fous configurables et des options de résidence régionale des données, pour des clients allant des startups aux gouvernements et entreprises du Fortune 500.
Google et le PSG : Gemini devient l’assistant IA officiel du club
Le Paris Saint-Germain et Google ont annoncé la signature d’un partenariat Premium courant jusqu’en 2029. Dans ce cadre, Google Gemini devient l’assistant IA officiel du club, tandis que Google Pixel devient le smartphone officiel du PSG.
Il s’agit d’un accord de sponsoring et de distribution, sans détail technique sur d’éventuelles fonctionnalités ou intégrations produit associées à ce jour. L’opération s’inscrit dans la stratégie de Google visant à élargir la visibilité grand public de Gemini au-delà de son cercle d’utilisateurs technophiles, en l’associant à l’un des clubs de football les plus suivis au monde.
Brèves
- Vercel et v0 acceptent la connexion via un compte ChatGPT — un bouton « Continue with ChatGPT » a été ajouté aux pages de connexion, en plus du plugin Vercel désormais disponible dans ChatGPT. 🔗 Source
- Replit annonce le Designathon — un concours de design d’une semaine, ouvert à tous les créateurs, avec un lancement en direct le 4 août à 9h (heure du Pacifique) et des prix à la clé. 🔗 Source
- Together AI compare le coût par tâche de Kimi K3 Max et Fable 5 xhigh — sur le benchmark DeepSWE, Kimi K3 Max approche les performances de Fable 5 xhigh pour environ un tiers du coût par exécution, soit 2,8 fois plus de tâches résolues par dollar dépensé. 🔗 Source
- Migration de GitLab vers GitHub Enterprise Cloud en disponibilité générale — l’extension CLI
gh gl2ghpermet désormais de migrer en self-service des dépôts depuis gitlab.com ou GitLab Self-Managed vers GitHub Enterprise Cloud. 🔗 Source - Luma Ray 3.2 disponible sur la plateforme tierce Fuser — le modèle vidéo est intégré à cet outil de recadrage, avec la promesse de conserver l’action de la scène lors d’un changement de format d’image. 🔗 Source
- NVIDIA NeMo Gym intègre Legal Agent Bench — ce benchmark d’agents juridiques, développé avec Harvey, rejoint la bibliothèque ouverte NeMo Gym pour faire progresser les modèles open weights sur des cas d’usage juridiques complexes. 🔗 Source
- Démonstration NVIDIA d’un agent de parkour appris en 30 secondes — une simulation aurait acquis un comportement expert à partir d’un très court extrait vidéo de référence, sans détail technique supplémentaire fourni. 🔗 Source
- Tutoriel Kimi Slides pour générer des présentations — Moonshot AI publie le premier épisode d’une série pédagogique sur Kimi Slides, la génération de présentations propulsée par Kimi K3, avec graphiques et SmartArts. 🔗 Source
Ce que ça signifie
La course aux poids ouverts se poursuit sur plusieurs fronts à la fois. Qwen3.8-Max, malgré ses 2,4 T de paramètres, sera ouvert dès la semaine prochaine ; MiniMax H3 passe de l’annonce à la disponibilité réelle avec un support Day-0 sur quatre briques d’inférence différentes ; et l’analyse coût/performance de Together AI sur Kimi K3 Max illustre pourquoi ces modèles ouverts gagnent du terrain : à qualité proche, ils coûtent une fraction du prix des modèles fermés équivalents. Le rapport de force entre modèles ouverts et fermés se joue de plus en plus sur ce terrain économique plutôt que sur le seul score de benchmark.
Le second axe est la plateformisation des outils de développement en briques programmables. L’API v0 de Vercel, les gains d’efficacité des agents cloud de Cursor et l’intégration Google Workspace, ou encore le cas d’usage documenté par GitHub chez Aspire, dessinent tous la même tendance : les éditeurs ne vendent plus seulement une interface de chat, mais une chaîne d’automatisation pilotable par d’autres agents, avec des garde-fous — permissions restreintes, revue humaine — pour la rendre exploitable en production.
Du côté grand public, deux annonces jouent sur un registre différent : l’ouverture du code de GenOffice par Genspark cherche à démocratiser une suite bureautique IA complète en misant sur la gratuité et l’effet communautaire, tandis que le partenariat entre Google et le PSG relève d’une logique de visibilité de marque plutôt que d’innovation technique — Gemini gagne en exposition grand public sans qu’aucune nouvelle fonctionnalité ne soit annoncée.
Enfin, les chiffres avancés par ElevenLabs — plus de dix millions de conversations hebdomadaires sur ElevenAgents — et l’offre de lancement de Runway autour de Seedance 2.5 confirment que l’IA générative de production, voix comme vidéo, s’installe désormais à l’échelle entreprise, avec des outils de supervision dédiés plutôt que de simples démonstrations technologiques.
Sources
- Qwen3.8-Max — annonce sur X
- GenOffice — annonce sur X
- API v0 — annonce sur X
- Cursor — agents cloud sur X
- Cursor — plugins Google Workspace
- GitHub Agentic Workflows chez Aspire
- GitHub Ship Log juillet 2026
- Sakana Namazu — annonce officielle
- MiniMax H3 — poids publiés
- Runway — plan Max
- ElevenAgents — ElevenLabs sur X
- Google et le PSG — annonce sur X
- Vercel et v0 — connexion ChatGPT
- Replit Designathon
- Together AI — Kimi K3 Max vs Fable 5 xhigh
- Migration GitLab vers GitHub Enterprise Cloud
- Luma Ray 3.2 sur Fuser
- NVIDIA NeMo Gym — Legal Agent Bench
- NVIDIA — démonstration parkour
- Kimi Slides — tutoriel