Zoeken

GPT-5.6 Sol verenigt ChatGPT, Kimi K3 algemeen beschikbaar in Copilot, WeatherNext voorspelt cyclonen vijf dagen vooruit

Artikel gegenereerd door kunstmatige intelligentie
GPT-5.6 Sol verenigt ChatGPT, Kimi K3 algemeen beschikbaar in Copilot, WeatherNext voorspelt cyclonen vijf dagen vooruit

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

Op 6 augustus 2026 verenigt OpenAI de ChatGPT-gesprekservaring rond een bijgewerkte GPT-5.6 Sol voor betalende abonnees, met 68% minder feitelijke fouten, terwijl GPT-5.6 Luna overgaat naar onbeperkte gratis chats. Op dezelfde dag komt Kimi K3 algemeen beschikbaar in GitHub Copilot, publiceert Google DeepMind in Nature WeatherNext, zijn open model dat cyclonen vijf dagen vooruit voorspelt, en opent Alibaba de publieke bèta van Wan3.0 voor het genereren van video’s van 30 seconden. Meta vult de week aan met Artificial Analysis-benchmarks die Muse Spark 1.2 bijna aan de grens plaatsen en een totaal van vijf gouden resultaten op internationale wetenschappelijke olympiades, terwijl een tiental aankondigingen de agentische code-tools (Amp, Devin, Replit, Warp, Cursor), het open-weight-ecosysteem (Hugging Face, Sakana, Together AI) en mediageneratie (ElevenLabs, Suno) bestrijken.


ChatGPT schakelt over op verenigde GPT-5.6 Sol, GPT-5.6 Luna wordt onbeperkt gratis

6 augustus — OpenAI verenigt de gespreks­­ervaring in ChatGPT rond een bijgewerkte versie van GPT-5.6 Sol voor betalende abonnees. Tot nu toe schakelden Plus- en Pro-gebruikers handmatig tussen een snel model (Instant) en een model voor diepgaand redeneren. Voortaan beheert GPT-5.6 Sol beide modi in één ervaring, met een aanpasbare redeneringsinspanning-slider (slider) die on the fly kan worden ingesteld — een directe vereenvoudiging van de interface, als antwoord op feedback van gebruikers over de verwarring tussen de twee oude modi.

Wat betrouwbaarheid betreft, noemt OpenAI een concreet cijfer: op zijn evaluatie voor feitelijkheid bij hoge inzet (financiën, geneeskunde, recht) produceert de nieuwe versie van GPT-5.6 Sol 68% minder antwoorden met feitelijke fouten, vergeleken met GPT-5.5 Instant. Dat is het centrale argument van deze update, gepresenteerd als een winst in betrouwbaarheid in plaats van een sprong in ruwe mogelijkheden.

Aan de gratis kant krijgen Free- en Go-gebruikers ook een ruimer toegangsniveau tot GPT-5.6 Luna: onbeperkte tekstgesprekken vanaf 7 augustus, en een knop “Think” om meer redenering op moeilijkere vragen te activeren — een functie die tot nu toe was voorbehouden aan betaalde abonnementen.

Gevolgde elementNumeriek detail
Feitelijke fouten financiën/geneeskunde/recht-68% vs GPT-5.5 Instant
GPT-5.6 Sol + schuifregelaar (Plus/Pro)beschikbaar sinds 6 augustus
Onbeperkte chats GPT-5.6 Luna (Free/Go)beschikbaar sinds 7 augustus

Een belangrijk afbakeningspunt: deze update betreft alleen de Chat-ervaring van ChatGPT — de versie van GPT-5.6 Sol die ChatGPT Work en Codex aandrijft, wordt door deze aankondiging niet gewijzigd.

🔗 Officiële OpenAI-aankondiging


Kimi K3 algemeen beschikbaar in GitHub Copilot

6 augustus — GitHub kondigt de algemene beschikbaarheid aan van Kimi K3, het open-weight model van Moonshot AI, in Copilot. De uitrol verloopt gefaseerd voor de Pro-, Pro+-, Max-, Business- en Enterprise-abonnementen, en het model is toegankelijk via alle Copilot-interfaces: Visual Studio Code, Visual Studio, Copilot CLI, de cloud-agent, de GitHub Copilot-app, github.com, GitHub Mobile, evenals de JetBrains-, XCode- en Eclipse-plug-ins.

📣 @Kimi_Moonshot’s Kimi K3, an open-weight model, is now generally available and rolling out in GitHub Copilot. The model shows frontier-level abilities on agentic coding with highly cost-effective pricing. It is hosted by @FireworksAI_HQ.

🇳🇱 📣 Kimi K3 van @Kimi_Moonshot, een model met open weights, is nu algemeen beschikbaar en wordt uitgerold in GitHub Copilot. Het model laat frontier-niveau mogelijkheden zien op agentische code, met zeer concurrerende prijzen. Het wordt gehost door @FireworksAI_HQ.@github op X

Het model wordt gehost via Fireworks AI, met gebruiksafhankelijke facturering die aansluit bij de tarieven van de provider — het changelog vermeldt geen exacte prijzen of contextvenster. Voor organisaties in Business en Enterprise staat Kimi K3 standaard uit: beheerders moeten het modelbeleid expliciet inschakelen voordat teams er toegang toe krijgen. Deze toevoeging past in de multi-modelstrategie van Copilot, dat eerder in augustus al Kimi K2.7 Code had geïntegreerd.

🔗 GitHub changelog


WeatherNext: Google DeepMind voorspelt cyclonen vijf dagen vooruit, open weights

6 augustus — Google DeepMind publiceert in het tijdschrift Nature de resultaten van WeatherNext, zijn AI-model voor de voorspelling van tropische cyclonen. Het model behaalt state-of-the-art nauwkeurigheid voor het voorspellen van het traject en de intensiteit van een storm, en biedt gemiddeld 24 uur extra voorbereidingstijd ten opzichte van eerdere methoden.

Predicting cyclones accurately can help save lives - and every hour of lead time counts. Published in @Nature, our AI model WeatherNext achieves state-of-the-art accuracy in forecasting a storm’s track and intensity, giving us a critical extra 24 hours to prepare on average.

🇳🇱 Cyclonen nauwkeurig voorspellen kan levens redden — en elk uur extra tijd telt. Gepubliceerd in @Nature behaalt ons AI-model WeatherNext state-of-the-art nauwkeurigheid in het voorspellen van het traject en de intensiteit van een storm, waardoor we gemiddeld 24 uur extra voorbereidingstijd krijgen.@GoogleDeepMind op X

Tijdens orkaan Melissa leverde WeatherNext vroege voorspellingen van de aanlanding als categorie 5, vijf dagen van tevoren en met een betrouwbaarheidsniveau van 80%. Het model, getraind op meerdere jaren wereldwijde atmosferische gegevens en bijna 5 000 historische cyclonen, genereert elk probabilistisch voorspellingsscenario van 15 dagen in minder dan een minuut op een TPU-chip. Google DeepMind levert voortaan 1 000 probabilistische voorspellingen per storm, toegankelijk via de WeatherLab-tool.

Gemeten indicatorGemeten waarde
Extra voorbereidingstijd+24u gemiddeld
Orkaanwaarschuwing Melissa (categorie 5)5 dagen van tevoren, betrouwbaarheid 80%
Historische cyclonen in training~5 000

Opmerkelijk voor het ecosysteem: de code en de gewichten van het model zijn open op GitHub, vrij beschikbaar voor zowel academisch onderzoek als operationele voorspelling.


Wan3.0 (Alibaba) gaat in publieke bèta met native video’s van 30 seconden

6 augustus — Alibaba lanceert de publieke bèta van Wan3.0, de nieuwe generatie van zijn videogeneratiemodel, met drie nadrukspunten: native videogeneratie tot 30 seconden in één enkele passage, een visuele rendering die “reality-grade” wordt genoemd (expressievere personages, betere consistentie van referenties van scène tot scène), en een Omni-Reference-functie die het begrip van het model uitbreidt voorbij tekst, beeld, audio en video: Wan3.0 kan voortaan gestructureerde documenten lezen (doc, xls, ppt, pdf, enz.) en direct op basis van hun inhoud een video genereren.

De bèta is vanaf nu beschikbaar op Alibaba Cloud Model Studio en Qwen Cloud, met een aanstaande komst naar de Wan-app, exclusief voor leden.

VideokwaliteitAPI-prijs (per gegenereerde seconde)
480p0,05 $
720p0,10 $
1080p0,20 $

De volledige API-toegang moet geleidelijk worden geopend in de komende weken. Deze lancering positioneert Wan3.0 tegenover recente concurrentieaankondigingen rond lange videogeneratie met fijne multimodale controle — FLUX 3 Video van Black Forest Labs, Seedance 2.5 van ByteDance, MiniMax H3 — een segment waarin het vermogen om clips van 20 tot 30 seconden te genereren met rijke referentiecontrole een centraal onderscheidend argument wordt.

🔗 Aankondiging @Alibaba_Wan


Muse Spark 1.2 van Meta nadert de grens, volgens Artificial Analysis

5-6 augustus — Het onafhankelijke analysebureau Artificial Analysis publiceert zijn volledige beoordeling van Muse Spark 1.2, het model van Meta dat gelijktijdig met de agent Muse Code werd gelanceerd. Op de AA Intelligence Index behaalt het een score van 54 (xhigh-variant), een stijging van 3 punten ten opzichte van Muse Spark 1.1 (51) en van 11 punten ten opzichte van Muse Spark 1.0 (43, uitgebracht in april) — zijn derde release in vier maanden. Die score plaatst het feitelijk gelijk met GPT-5.5 (xhigh, 55) en Grok 4.5 (high, 54), net achter de huidige topmodellen: Claude Opus 5 (max, 61), Claude Fable 5 (max, 60), GPT-5.6 Sol (max, 59) en Kimi K3 (max, 57).

De belangrijkste vooruitgang betreft het agentische kenniswerk, een zwak punt dat bij de lancering van Muse Spark 1.1 werd vastgesteld: de GDPval-AA v2 Elo-score stijgt van 1371 naar 1631, waarmee het model op de 5e plaats staat van alle geëvalueerde modellen, vóór Claude Opus 4.8 (1588).

Gemeten indicatorMuse Spark 1.1Muse Spark 1.2
AA Intelligence Index (xhigh)5154
GDPval-AA v2 Elo13711631
Terminal-Bench 2.178%80%
Kosten per taak (Intelligence Index)0,29 $0,40 $

Qua kosten blijft Muse Spark 1.2 een van de efficiëntste modellen van zijn intelligentieniveau, met 0,40 $ per taak bij ongewijzigde API-prijsstelling (1,25 $ / 4,25 $ per miljoen tokens in-/uitvoer). Alleen Grok 4.5 en GPT-5.6 Sol (medium) zijn goedkoper in zijn groep. Op de Vals Index komt Muse Spark 1.2 ook binnen in de top 5 met slechts 0,69 $ per test — drie keer goedkoper dan Kimi K3, tien keer goedkoper dan Claude Fable 5, Opus 5 en GPT-5.6 Sol.

🔗 Artificial Analysis-thread


Meta claimt gouden resultaten op vijf internationale wetenschappelijke olympiades

6 augustus — Meta Superintelligence Labs (MSL) kondigt aan dat het interne versies van de Muse Spark-familie heeft ingeschreven voor vijf internationale wetenschappelijke competities van topniveau in 2026, om echte vooruitgang in redeneren te meten in plaats van op synthetische benchmarks — een cumulatieve balans na een eerste al gerapporteerde fysicamedaille in juli.

To understand whether we’re making genuine progress on reasoning, we entered our AI models in five international STEM Olympiad competitions this year. The results: Asian Physics Olympiad (APhO): Perfect score on the theory exam — gold medal. International Physics Olympiad (IPhO): Perfect score — gold medal. International Mathematical Olympiad (IMO): Gold medal, top 4% of human participants. International Chemistry Olympiad (IChO): Gold-medal level. Romanian Masters of Mathematics (RMM): Gold-medal level.

🇳🇱 Om te weten of we echt vooruitgang boeken in redeneren, hebben we dit jaar onze AI-modellen ingeschreven voor vijf internationale wetenschappelijke competities. Resultaten: Asian Physics Olympiad (APhO) — perfecte score op het theoretische examen, gouden medaille. International Physics Olympiad (IPhO) — perfecte score, gouden medaille. International Mathematics Olympiad (IMO) — gouden medaille, top 4% van de menselijke deelnemers. International Chemistry Olympiad (IChO) — niveau van gouden medaille. Romanian Masters of Mathematics (RMM) — niveau van gouden medaille.@shuchaobi op X

Wetenschappelijke competitieBehaald resultaat
APhO (natuurkunde, Azië)Perfecte score op het theoretische examen — goud
IPhO (natuurkunde, internationaal)Perfecte score op het theoretische examen — goud
IMO (wiskunde)Goud, top 4% van de menselijke deelnemers
IChO (chemie)Niveau gouden medaille
RMM (wiskunde, Roemenië)Niveau gouden medaille

Drie van deze competities (APhO, IPhO, IMO) waren live-proeven, beoordeeld door de officiële jury’s volgens dezelfde normen als voor menselijke kandidaten. Meta preciseert dat de gebruikte modellen geen toegang hadden tot externe hulpmiddelen — geen webzoekopdracht, geen code-interpreter, geen rekenmachine — met een multi-agent orkestratie in parallel redeneren.

🔗 @AIatMeta-relay


AI-ontwikkeltools: Portals, remote sandboxen, modelroutering

Vijf aankondigingen verkleinen deze week de kloof tussen lokale ontwikkeling en externe of multi-modelomgevingen.

Amp lanceert Portals — live preview van apps in de Orbs

6 augustus — Amp voegt Portals toe, vanaf nu beschikbaar in alle orbs (Amp’s externe ontwikkelomgeving), een functie die HTTP-services die in een orb draaien rechtstreeks in de browser blootstelt. Tot nu toe vereiste het live testen van veranderingen van de agent het configureren van een VPN of het jongleren met poorten. Technisch gezien maakt de agent een .amp/services.yaml-bestand aan of detecteert het en voert amp orb services ensure uit om de applicatie te starten, waarna die via een beveiligde HTTPS-verbinding wordt blootgesteld. Portals zijn toegankelijk voor iedereen met toegang tot de thread, waardoor meerdere teamleden dezelfde wijzigingen live kunnen zien, ook wanneer de orb na een slaapstand weer opstart.

🔗 Amp — Portals

Devin Outposts draait nu op Vercel Sandbox

5 augustus — Cognition breidt Devin Outposts uit (eind juli gelanceerd om Devin native op elke computer te laten draaien) met een integratie met Vercel Sandbox, vanaf nu beschikbaar. De agent kan voortaan een applicatie bouwen en testen in een geïsoleerde microVM op de infrastructuur van Vercel, met toegang tot Docker, verbinding met private netwerken via VPN, en hervatten vanuit een bestandssysteem-snapshot die de repository, dependencies en buildstatus intact houdt. Deze integratie brengt Devin Outposts dichter bij de aanbiedingen van vluchtige cloudomgevingen zoals die van Amp (Orbs) of Warp, met als voordeel dat het steunt op de Vercel-infrastructuur die al door veel frontend-teams wordt gebruikt.

🔗 @cognition op X

Replit laat zijn veiligheidscontroles tijdens de build draaien, met Semgrep

5 augustus — Replit kondigt, in samenwerking met Semgrep, aan dat zijn veiligheidscontroles voortaan tijdens het bouwen van de applicatie worden uitgevoerd in plaats van alleen aan het einde — een ontwikkeling die rechtstreeks antwoord geeft op een vraag van gebruikers. Deze scans zijn standaard actief en maken deel uit van de volledige Replit Auto-Protect-functionaliteit, die automatisch de door de agent gegenereerde applicaties beveiligt. Replit meldt dat zijn Agent al meer dan 100 000 scans per dag uitvoert, een cijfer dat de schaal illustreert waarop de tool wordt gebruikt voor vibe coding in productie, met detectie en correctie van kwetsbaarheden vóór publicatie.

🔗 @Replit op X

Warp introduceert aangepaste modelrouters

5 augustus — Iets meer dan een week na de lancering van de Warp Agent CLI voegt Warp aangepaste modelrouters toe, vanaf nu beschikbaar voor alle gebruikers. Het wordt mogelijk om je eigen routeringsregels in natuurlijke taal te definiëren (“stuur eenvoudige taken naar Minimax”, “stuur bugfixes naar Kimi K3”), waarna elke aanvraag automatisch wordt doorgestuurd naar het model dat het meest geschikt wordt geacht. Deze routers komen boven op de automatische routering die al in de CLI is ingebouwd en werken met open-weight modellen, in BYOK (bring your own key), of via een SuperGrok-abonnement — een direct antwoord op de trend bij meerdere concurrerende tools om meerdere modellen te orkestreren op basis van de taak in plaats van te leunen op één enkel frontiermodel.

🔗 @warpdotdev op X

Cursor belicht Cursor Router — tot 68% kostenbesparing zonder kwaliteitsverlies

6 augustus — Cursor publiceert een technisch artikel waarin de werking van Cursor Router wordt uitgelegd, zijn systeem voor automatische modelselectie dat op 22 juli werd gelanceerd — dus niet een lancering, maar een diepgaand artikel met unieke gegevens. De router werkt in twee stappen: « Compass » schat eerst de complexiteit van de taak in door de kans op gebruikerssatisfactie te voorspellen, waarna een classifier per taxonomie (domein, taaktype, modifiers zoals visuele wijzigingen) het best presterende grensmodel op precies die categorie selecteert. De router verdeelt aanvragen over Grok (routineklussen), Sol/GPT-5.6 (planning), Opus (uitvoering) en Fable (debugging) — Opus 5 werd na de eerste lancering toegevoegd. Cursor noemt concrete cijfers: de modus « Auto Intelligence » zou een hogere gebruikerssatisfactie bieden dan alleen Fable tegen 68% lagere kosten, en de modus « Auto Balance » zou Opus 4.8 overtreffen voor 41% minder kosten.

🔗 Cursor — hoe Cursor Router werkt


Open-weight-ecosysteem: inferentie, opslag en autonoom onderzoek

Drie aankondigingen versterken de infrastructuur rond modellen met open gewichten, zowel aan de hosting- als aan de onderzoekskant.

Baseten wordt officiële inferentieleverancier op Hugging Face

6 augustus — Baseten, een AI-infrastructuurplatform gespecialiseerd in serverless inferentie, sluit zich aan bij de Inference Providers van Hugging Face. De integratie maakt het mogelijk om door Baseten gehoste inferentie rechtstreeks te starten vanaf de modelpagina’s van de Hub, via de webinterface of de Python- en JavaScript-SDK’s. De eerste ondersteuning dekt drie belangrijke open-weight-modellen: DeepSeek V4 Flash, Kimi K3 en GLM-5.2, met later nog andere taaktypen. PRO-abonnees ontvangen maandelijks 2 $ aan inferentiecredits die gelden voor alle providers, terwijl gratis accounts beperktere quota hebben. De integratie biedt een API-formaat dat compatibel is met OpenAI via de router van Hugging Face, wat het wisselen van provider vereenvoudigt zonder de aanroepcode te herschrijven.

🔗 Hugging Face — Baseten

Ai2 breidt zijn samenwerking met Hugging Face uit — opslag naar ~2 petabyte

5 augustus — Ai2 (Allen Institute for AI) breidt zijn samenwerking met Hugging Face uit om de verspreiding van zijn werk in open science te versnellen. De toegewezen opslag op de Hub wordt bijna verdrievoudigd en stijgt naar ongeveer 2 petabyte, en verkeer valt niet langer onder de standaard throughputlimieten — een merkbare winst voor het downloaden van de grootste datasets en multi-checkpoint-modellen. Ai2 geeft aan dat zijn resources sinds het voorjaar van 2024 meer dan 50 miljoen keer zijn gedownload, en dat de artefacten rond zijn model MolmoAct 2 in drie weken meer dan 400.000 downloads hebben gehaald. De samenwerking bestrijkt het volledige Ai2-portfolio: de Olmo- en Molmo-modellen, het aardobservatiemodel OlmoEarth, evenals meerdere evaluatiedatasets. Volgens Ai2 publiceert de organisatie jaarlijks meer nieuwe artefacten op de Hub dan welke andere door Hugging Face gevolgde organisatie ook, met meer dan 900 modellen en 1.200 datasets op de teller.

🔗 Ai2 — Hugging Face-partnerschap

Sakana Marlin — autonoom onderzoeksagent en lancering van Marlin Insights

6 augustus — Sakana AI zet Sakana Marlin in de kijker, beschreven als een « Virtual CSO » (virtuele wetenschappelijk directeur) die zelfstandig kan redeneren en gedurende meerdere uren onderzoek kan uitvoeren. Het bedrijf geeft aan dat deze capaciteit steunt op twee onderzoeksblokken die door zijn teams zijn gepubliceerd: AB-MCTS, geaccepteerd als spotlight op NeurIPS 2025, en AI Scientist, gepubliceerd in Nature. Sakana AI heeft ook Marlin Insights gelanceerd, een reeks onderzoeksprojecten geproduceerd door Marlin; de eerste editie analyseert de uitkomst van de crisis in de Straat van Hormuz en de redenen waarom de Verenigde Staten, ondanks hun militaire superioriteit, moeite hebben om een uitweg te vinden. Deze lancering illustreert Sakana AI’s strategie om fundamenteel onderzoek om te zetten in autonome analysetools gericht op ondernemingen, in lijn met zijn recente commerciële uitrol (Daiwa Securities, Namazu).

🔗 @SakanaAILabs op X


GitHub Copilot en het ecosysteem: open data, herbruikbaar design, slash-commando’s

Q1 2026-update van de GitHub Innovation Graph

5 augustus — GitHub publiceert de driemaandelijkse update (Q1 2026) van zijn Innovation Graph, een open-dataproject dat wereldwijde ontwikkelactiviteit volgt. De tweetreeks zet een versnelling van Git-pushactiviteit in meerdere landen buiten de traditionele markten in de verf, evenals een stijging van 16% kwartaal-op-kwartaal in grensoverschrijdende open-source samenwerking in Q1 2026, met opmerkelijke groei voor de Europese Unie, India en Singapore sinds 2020.

Gevolgd landGit-pushes (Q1 2020 → Q1 2026)
India4,4M → 45M
Vietnam630K → 5,1M
Pakistan240K → 3,5M

Alle datasets blijven open en downloadbaar, waardoor deze dynamieken per land en periode gedetailleerder kunnen worden verkend.

🔗 @github — Innovation Graph-thread

Genspark Design — herbruikbaar designsysteem tussen projecten

6 augustus — Genspark lanceert Genspark Design, een functie die vanaf nu beschikbaar is en die een al gebouwd project automatisch omzet in een herbruikbaar designsysteem voor volgende projecten (kleuren, typografie, componenten). Het doel is te vermijden dat de visuele identiteit bij elk nieuw project opnieuw moet worden opgebouwd: een later gegenereerde landingspagina erft dezelfde stijl als een bestaande app, zonder handmatige overname. Deze aankondiging sluit aan bij de recente inspanningen van Genspark rond interfacegeneratie en kantoorsoftwarepakketten (GenOffice), en richt zich op gebruikers die meerdere door AI gegenereerde projecten na elkaar produceren en daarbij visuele consistentie zoeken zonder herhaalde configuratie.

🔗 @genspark_ai op X

Gids voor slash-commando’s in de GitHub Copilot-app

6 augustus — GitHub publiceert een gids met de zes slash-commando’s die beschikbaar zijn in de desktopapp van GitHub Copilot, toegankelijk door « / » te typen in het chatveld. Ze bestrijken de hele workflow: planning, het testen van een aanpak, geautomatiseerde implementatie, kruiscontrole door een ander model, het maken van interactieve interfaces en multi-repository orkestratie — en onderscheiden zich van de slash-commando’s in de CLI, die zich op de terminal richten in plaats van op de desktopapp.

Slash-commandoUitgevoerde functie
/planSplitst de taak op vóór het coderen
/sparAdvocaat van de duivel om een aanpak uit te dagen
/autopilotZet een plan om in code
/rubber-duckOnafhankelijke review door een ander model
/orchestrateCoördineert werk over meerdere repositories

🔗 GitHub — gids voor slash-commando’s


Mediageneratie: dubbing en audiotransparantie

ElevenLabs lanceert Dubbing v2 op ElevenAPI

6 augustus — ElevenLabs maakt op ElevenAPI versie 2 van zijn dubbingmotor (Dubbing v2) algemeen beschikbaar; die bestond al aan productzijde, zodat ontwikkelaars AI-dubbing rechtstreeks in hun eigen applicaties kunnen integreren. Technisch baseert Dubbing v2 zich rechtstreeks op de originele audioprestatie in plaats van op een platte transcriptie, waardoor toon, emotie en frasering van de brontekst behouden blijven. Het model past de zinsbouw aan voor natuurlijke dictie in meer dan 90 talen, met een « sync-aware » vertaling die automatisch begin en einde van dialogen uitlijnt zonder handmatige afstelling. Voor enterprise-usecases is er een gedetailleerde bewerkingsmodus waarmee men zijn eigen transcriptie kan importeren en alleen de gewijzigde segmenten opnieuw kan genereren in plaats van de volledige dubbing — waarbij de hele pipeline (vertaling, stemklonen, dubbing, synchronisatie) via één enkele API beschikbaar is.

🔗 @ElevenLabs op X

Suno zet transparantie-instrumenten uit en actualiseert zijn communityregels

6 augustus — Suno publiceert een artikel ondertekend door CEO Mikey Shulman, waarin de principes worden uiteengezet die het bedrijf zegt te willen volgen om de toekomst van door AI gegenereerde muziek « verantwoordelijk » op te bouwen. Concreet introduceert de aankondiging een uitrol van watermarking- en audiofingerprinting-technologieën om op het platform gegenereerde nummers te identificeren, voorgesteld als bestand tegen vervalsing zonder de luisterervaring te verslechteren, evenals komende beperkingen op downloads om massale verspreiding naar streamingplatforms te beperken terwijl professionele en creatieve toepassingen behouden blijven. De aankondiging gaat vergezeld van een update van de Community Guidelines, die voortaan expliciet het recreëren van bestaande liedjes, het gebruik van iemands stem of beeld zonder toestemming, en spam- of geautomatiseerde omzeilingspraktijken van moderatie verbiedt, met sancties variërend van waarschuwing tot definitieve verbanning.

🔗 @suno op X


Agents en plugins: open standaarden en subagentmodellen

Agent Plugins — open standaard voor agentplugins

6 augustus — OpenAI kondigt Agent Plugins aan, een nieuwe open standaard ontwikkeld met AWS, Cursor, GitHub, VS Code en Vercel om Agent Skills en MCP-serverconfiguraties in een gemeenschappelijk formaat te verpakken. Het doel is ontwikkelaars in staat te stellen één plugin één keer te bouwen en die opnieuw te gebruiken in meerdere compatibele agentclients, in plaats van de integratie voor elk hulpmiddel te dupliceren. Bij de lancering zijn de genoemde compatibele clients Codex, ChatGPT, Cursor, GitHub Copilot, Kiro en VS Code — een brede reikwijdte die zowel het OpenAI-ecosysteem als meerdere directe concurrenten op het terrein van codeagents omvat. De tweets geven geen precieze technische mechaniek (manifestformaat, publicatieproces) of algemene beschikbaarheidsdatum buiten de aangekondigde lancering.

🔗 @OpenAIDevs op X

Perplexity Computer rolt GPT-5.6 Terra en Luna uit als subagentmodellen

6 augustus — Perplexity rolt twee nieuwe GPT-5.6-modellen uit binnen Computer, zijn platform voor subagents en automatiseringen: Terra en Luna. Terra wordt het standaardmodel voor alle subagents van Computer en dient ook als orchestratiemodel; Luna wordt gepositioneerd als het belangrijkste model voor geplande automatiseringen. Volgens Perplexity is Terra ontworpen voor complex, doelgericht werk, een profiel dat past bij de rol van subagent die een taak moet opsplitsen en zelfstandig uitvoeren. Op de WANDR-benchmark zou Terra 11 punten hoger scoren dan Claude Sonnet, terwijl de kosten met een orde van grootte zouden dalen. Deze introductie van rolgespecialiseerde modellen illustreert een steeds meer gedifferentieerde agentarchitectuur bij Perplexity.

🔗 @perplexity_ai op X


Kort nieuws

  • Together AI claimt dat Kimi K3 bijna twee keer beter is dan Claude Fable 5 op de juridische benchmark Harvey LAB-AA — Zonder gepubliceerde methodologische details moet dit worden gezien als een marketingclaim van een inferentieprovider. 🔗 bron
  • Hugging Face zet Cadena in de kijker, een 3D-gaasdecompiler naar bewerkbare CAD — Spaces-demo die een vast 3D-bestand omzet in een stap-voor-stap bewerkbaar CAD-programma, bijvoorbeeld om een gat te vergroten zonder het model opnieuw op te bouwen. 🔗 bron
  • De CEO van Hugging Face verdedigt een laaggewijze AI-regulering — Clément Delangue steunt het nieuwe Amerikaanse regelgevingskader dat modelgewichten, API’s en applicaties van elkaar onderscheidt en dat volgens hem open source beschermt. 🔗 bron
  • Together AI licht zijn multi-datacenterarchitectuur met 99,9% beschikbaarheid toe — Verkeer wordt live over twee sites tegelijk verdeeld, met de mogelijkheid om het volledige verlies van één datacenter op te vangen zonder dienstonderbreking. 🔗 bron
  • Gemini Omni: gratis generatie van 10 video’s verlengd tot 11 augustus — Het aanbod, dat op 4 augustus zou aflopen, blijft toegankelijk tot 11 augustus 2026, 23:59 (Pacific Time). 🔗 bron
  • GenOffice beschikbaar op Linux — De open-source AI-kantoorsuite van Genspark, al beschikbaar op macOS en Windows, is nu compileerbaar en beschikbaar onder Linux. 🔗 bron
  • Flux 3 beschikbaar in de AI-videogentagent van Genspark — Integratie van Flux 3 (Black Forest Labs) met native audio en meertalige dialoog, voor clips tot 20 seconden in 1080p. 🔗 bron
  • Qwen3.8-Max stijgt in de publieke ranglijsten — Alibaba claimt de 5e plaats in de Artificial Analysis Intelligence Index en de 1e plaats in de Agentic Index, na een 2e plaats op de Image-to-WebDev Arena een dag eerder. 🔗 bron
  • Qwen-Image-3.0-Pro uitgerold op Qwen Cloud en fal.ai — Het beeldgeneratiemodel van Alibaba, al wereldwijd op de 5e plaats, wordt rechtstreeks toegankelijk op Qwen Cloud en op het externe platform fal.ai. 🔗 bron
  • OpenAI en de American Psychological Association werken samen rond AI en de mentale gezondheid van jongeren — Partnerschap om evidence-based aanbevelingen en waarborgen te ontwikkelen rond het welzijn van jonge gebruikers. 🔗 bron
  • OpenAI publiceert Signals-data over het wereldwijde gebruik van ChatGPT — Nieuwe indicatoren per land over adoptie en gebruikstrends, zonder op deze datum toegankelijke cijfermatige details. 🔗 bron
  • Cohere werkt samen met de Universiteit van Waterloo aan een certificaat in AI-transformatie — Het nieuwe certificaat « AI Transformation & Change Management » moet studenten voorbereiden op verantwoorde AI-adoptie in bedrijven. 🔗 bron

Wat dit betekent

De week laat een duidelijke verschuiving zien: toonaangevende intelligentie wordt de standaardoptie in plaats van een extra betaalde keuze. OpenAI verenigt ChatGPT rond GPT-5.6 Sol, dat zowel snelheid als diep redeneren aankan, terwijl Luna onbeperkt en gratis wordt voor Free- en Go-accounts. GitHub volgt aan de ontwikkelaarskant een vergelijkbare logica door Kimi K3, een open-weight model, te standaardiseren in Copilot voor al zijn betaalde aanbiedingen. In beide gevallen is het nieuws niet een sprong in ruwe capaciteit, maar een verandering in distributie: modellen die voorheen waren gereserveerd voor premiumlagen of maatwerkintegraties worden de standaardconfiguratie, waardoor de concurrentie verschuift naar waargenomen betrouwbaarheid en toegangsprijs in plaats van naar de ruwe score op een benchmark.

Het meten van AI-capaciteit wordt zelf een gestructureerd strijdtoneel. Meta’s Muse Spark 1.2 klimt volgens Artificial Analysis bijna tot aan de grens, tegen een kost per taak die nog steeds tot de laagste in zijn categorie behoort, terwijl Meta Superintelligence Labs gouden resultaten claimt op vijf internationale wetenschappelijke Olympiades zonder toolgebruik — een publieke demonstratie die is bedoeld om verder te overtuigen dan de gebruikelijke leaderboards. Tegelijkertijd wordt de infrastructuur die deze open modellen draagt steeds professioneler: Baseten wordt een officiële inferentieprovider op Hugging Face voor DeepSeek V4 Flash, Kimi K3 en GLM-5.2, Ai2 verdrievoudigt bijna zijn opslag op de Hub, en Sakana AI verandert zijn fundamentele onderzoek in een autonoom onderzoeksproduct met Marlin. De rode draad: de waarde verschuift van het geïsoleerde model naar het ecosysteem dat het verspreidt, host en verifieert.

Agentische code-tools groeien toe naar één idee: geen enkel model domineert nog alle taken, dus moet er slim worden gerouteerd. Cursor licht toe hoe zijn router complexiteitsinschatting en taxonomie-classificatie combineert om de kosten tot 68% te verlagen zonder verlies aan waargenomen tevredenheid, Warp introduceert routeringsregels in natuurlijke taal, en Amp en Devin breiden hun externe omgevingen uit (Portals, Vercel Sandbox-integratie) om cloudontwikkeling dichter bij het comfort van lokaal werken te brengen. Replit verplaatst op zijn beurt zijn Semgrep-veiligheidsscans naar vóór de build in plaats van erna, met meer dan 100.000 scans per dag op die schaal. Samen schetsen deze aankondigingen een generatie tools waarin intelligentie niet langer de enige hefboom is: orkestratie, veiligheid by default en infrastructuurintegratie tellen even zwaar.

Los van de taalmodellen laat de week zien dat AI zich zowel in gebruikstoepassingen met directe impact nestelt als in grootschalige creatieve productie. WeatherNext van Google DeepMind, gepubliceerd in Nature en beschikbaar met open gewichten, biedt gemiddeld 24 uur extra voorspellingsruimte om een cycloon te anticiperen — een toepassing waar het algemeen belang duidelijk zwaarder weegt dan commerciële concurrentie. Daartegenover illustreren Wan3.0 van Alibaba, ElevenLabs en Suno de snelle rijping van mediageneratie: native video van 30 seconden met multimodale controle, dubbing geconditioneerd op de oorspronkelijke vocale performance en nu algemeen beschikbaar via API, en watermarking-tools die worden uitgerold als reactie op zorgen over de authenticiteit van gegenereerde content. Deze twee richtingen, open wetenschap en commerciële creatie, gaan in hetzelfde tempo vooruit maar met heel verschillende verantwoordelijkheidseisen.


Bronnen