Zoeken

Gemini overschrijdt de grens van een miljard actieve gebruikers, NVIDIA lanceert Nemotron 3.5 Lightning, Mistral smeedt een Europese rekencoalitie

Artikel gegenereerd door kunstmatige intelligentie
Gemini overschrijdt de grens van een miljard actieve gebruikers, NVIDIA lanceert Nemotron 3.5 Lightning, Mistral smeedt een Europese rekencoalitie

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

Op 11 augustus 2026 overschrijdt de Gemini-app de grens van een miljard maandelijkse gebruikers en wordt daarmee het snelst groeiende product in de geschiedenis van Google. NVIDIA publiceert Nemotron 3.5 Lightning en zijn routeringsbibliotheek NeMo Switchyard, Mistral opent zijn platform voor modellen van derden en smeedt een Europese rekencoalitie, en Alibaba onthult Wan-Animate-2, een grote upgrade van zijn open-source animatiemodel. Ook op het menu: ChatGPT-advertenties uitgebreid naar vijf nieuwe markten, nieuwe tools voor ontwikkelaars en een lange lijst van aankondigingen op het gebied van mediageneratie.


Gemini overschrijdt een miljard maandelijkse gebruikers

De Gemini-app heeft officieel de grens van een miljard actieve maandelijkse gebruikers overschreden, waarmee het volgens Google het snelst groeiende product in de hele geschiedenis van het bedrijf is. De aankondiging werd zowel gedeeld via het officiële account @GeminiApp als door Josh Woodward, die bij Google leiding geeft aan de Gemini- en Labs-teams.

Google ondersteunt de aankondiging met een cijfermatig overzicht van de toepassingen die deze groei hebben aangedreven:

Gemeten gebruikGegevens
Spraakinteracties63 % van de gebruikers gebruikt spraak
Gemini Live-sessies1 op 5 gebruikt de livecamera of schermdeling
Schoolgerelateerde vragen38 % bevat een bijlage (bestand)
AfbeeldingsgeneratieMeer dan 150 miljoen afbeeldingen per dag geproduceerd
Android-automatiseringGeautomatiseerde acties in meer dan 40 applicaties
iOS-gebruikersMeer dan 100 miljoen actieve gebruikers op Apple-apparaten

Deze cijfers illustreren een diversificatie van het gebruik verder dan alleen tekstchat: spraak, camera, schermdeling, multimediale generatie en inter-app-automatisering (restaurantreservering, het bestellen van een ritdienst) verschijnen als belangrijke drijvers van de adoptie.

🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.

🇳🇱 🚀 Een miljard voor Gemini! Ons doel blijft om er de meest persoonlijke, proactieve en krachtige assistent van te maken.@GeminiApp op X

🔗 Officiële aankondiging op de Google-blog


NVIDIA lanceert Nemotron 3.5 Lightning en NeMo Switchyard voor agents met hoge volumes

NVIDIA breidt zijn familie van open Nemotron 3-modellen uit met Nemotron 3.5 Lightning, een hybride MoE van 30 miljard parameters (3 miljard actief) ontworpen voor het uitvoeren van agentische taken met hoge volumes — toolaanroepen, resultaatvalidatie, taakdelegatie — in plaats van voor complexe redenering. Beschikbaar in NVFP4 en BF16 met een context tot 1 miljoen tokens, claimt het model tot 4 keer de outputdoorvoer van vergelijkbare modellen en 30 % tijdswinst bij taakvoltooiing. Op PinchBench behaalt het 86 % nauwkeurigheid door 10.000 taken 35 % sneller af te ronden dan Qwen3.6 35B bij equivalente nauwkeurigheid.

Het model wordt gedistribueerd met gewichten, trainingsdata en recepten, en is beschikbaar op Hugging Face, ModelScope, OpenRouter en build.nvidia.com. Together AI is vanaf dag één launchpartner (day-0), met gereserveerde capaciteit via zijn aanbod Dedicated Model Inference voor agentische workloads met hoge volumes.

Parallel daaraan publiceert NVIDIA NeMo Switchyard, een open-sourcebibliotheek die elke aanvraag routeert naar het meest geschikte model (kwaliteit, latency, kosten) zonder de applicatie te herschrijven — waarbij grensmodellen worden gereserveerd voor complexe redenering en Lightning voor gespecialiseerde uitvoering. NVIDIA claimt een taakvoltooiingskost die is teruggebracht tot bijna een derde van die van alleen Opus 4.8. Concrete partners worden genoemd: Boomi routeert 59 % van zijn verkeer naar een sneller fine-tuned model, Cognition verlaagt zijn gemiddelde kost met 28 %, en Ramp combineert model en routing voor 59 % lagere kosten en 32 % minder uitvoeringstijd.

🔗 Officiële NVIDIA-post · Aankondiging van het model op X


Alibaba onthult Wan-Animate-2, een grote upgrade van zijn open-source karakteranimatie

Alibaba (team Wan) publiceert Wan-Animate-2, omschreven als een grote upgrade van zijn open-source model voor karakteranimatie. Vier mogelijkheden worden benadrukt: high-fidelity animatie die bewegingen en micro-expressies overbrengt op mensen, cartoons, robots en dieren; animatie met meerdere personages, waarbij elk personage zijn eigen identiteit en beweging behoudt in dezelfde scène; camerabediening gestuurd door tekst (bijvoorbeeld « bovenaanzicht »), losgekoppeld van de bronvideo; en realtimestreaminggeneratie, die sequenties van willekeurige lengte chunk per chunk produceert zonder zichtbare foutaccumulatie.

Op technisch vlak laat Alibaba expliciete pose-skeletten vallen ten gunste van de referentievideo zelf als bewegingsprior, met een Dual-Branch DiT-architectuur (Diffusion Transformer), een Time-Align RoPE-tijdscodering en een Sparse-Ref Attention (Sparse-Ref Attention) om de berekening te beperken zonder kwaliteitsverlies. De camerabediening steunt op een LoRA die is getraind op ongeveer 50.000 multi-view Unreal Engine-voorbeelden.

Het model is open source, nu beschikbaar op ModelScope, Hugging Face en GitHub, met een online demo. Volgens NVIDIA’s augustuscampagne « Local AI » genereren de 14 miljard parameters 16 tot 26 keer sneller op RTX-systemen dan alternatieven — een bevestiging van de optimalisatie voor lokale inzet op consumentenh/waren.

🔗 Technische details en cijfers van NVIDIA · Aankondiging op X


Mistral lanceert regionale inferentie, opent zijn platform voor GLM-5.2 en smeedt een Europese rekencoalitie

Mistral positioneert zich als het enige Europese AI-lab dat regionale inferentiekeuze en servicegaranties combineert. Het bedrijf, al verwikkeld in een prijs- en technische race tegen OpenAI, Google en Chinese spelers, zet hier in op een onderscheidende positionering: soevereiniteit en voorspelbaarheid van de service, in plaats van alleen de race om benchmarks. Twee nieuwigheden aan de platformkant:

FunctionaliteitStatusBeschrijving
Mistral Regional EndpointsBeschikbaarKeuze tussen Europa of de Verenigde Staten voor inferentie
Mistral Priority TierOpenbaar previewSLA voor beschikbaarheid en aangepaste throughput-limieten

Een ander opvallend onderdeel: het Mistral-platform wordt geopend voor modellen van derden, te beginnen met GLM-5.2 van Z.ai, dat dezelfde regionale controles en serviceafspraken krijgt als Mistral-modellen — een eerste convergentie tussen de twee spelers, tot nu toe directe concurrenten in het segment van betaalbare open modellen.

Ten slotte lanceert Mistral de European Compute Units (ECU), een mechanisme dat meerjarige bedrijfsverplichtingen omzet in toegang tot zijn rekeninfrastructuur, met als doel 1 GW capaciteit tegen 2030 — gelijk aan het verbruik van een grote stad. De aangekondigde oprichterspartners zijn ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman en CEO), Amadeus (Luis Maroto, CEO) en Caisse des Dépôts (Olivier Sichel, CEO) — een mix van industrie, transport en publieke financiën die de ambitie illustreert om een Europese rekenketen op te bouwen die onafhankelijk is van Amerikaanse hyperscalers.

🔗 Officiële aankondiging van Mistral


OpenAI lanceert ChatGPT-advertenties in het Verenigd Koninkrijk, Mexico, Brazilië, Japan en Zuid-Korea

OpenAI zet een nieuwe stap in de uitrol van advertenties binnen ChatGPT. Het programma, in februari 2026 gelanceerd als test in de Verenigde Staten voor de Free- en Go-abonnementen, en vervolgens uitgebreid naar Canada, Australië en Nieuw-Zeeland in maart, is nu officieel gelanceerd in vijf nieuwe markten: Verenigd Koninkrijk, Mexico, Brazilië, Japan en Zuid-Korea. De Plus-, Pro-, Business-, Enterprise- en Education-abonnementen blijven advertentievrij, en andere markten staan op de planning tegen het einde van het jaar.

Het principe blijft onveranderd: advertenties beïnvloeden nooit de antwoorden van ChatGPT, ze blijven duidelijk gelabeld als gesponsord en visueel gescheiden van het organische antwoord. Targeting is gebaseerd op het onderwerp van het huidige gesprek en de geschiedenis van eerdere advertentie-interacties, zonder adverteerders ooit toegang te geven tot gesprekken of persoonlijke gegevens — zij ontvangen alleen geaggregeerde statistieken (weergaven, klikken).

Aan de gebruikerskant laat ChatGPT toe een advertentie te verbergen, te raadplegen waarom die werd getoond, advertentiegegevens in één stap te verwijderen en de personalisatie op elk moment te beheren. Er worden geen advertenties getoond aan geïdentificeerde of vermoedelijke minderjarige accounts, noch in de nabijheid van gevoelige onderwerpen (gezondheid, geestelijke gezondheid, politiek). Volgens OpenAI heeft de pilot geen meetbare impact op het vertrouwen van gebruikers laten zien, wat deze gefaseerde uitbreiding heeft gemotiveerd.

🔗 Officiële aankondiging van OpenAI


Open-source-ecosysteem en inferentie

webAI Intelligence Lab publiceert TwiL-LM3, een 3B-redeneermodel dat GPT-OSS-120B overtreft

Het webAI Intelligence Lab (Austin) publiceert TwiL-LM3, zijn eerste formele open-source redeneermodel. Met slechts 3 miljard parameters claimt het GPT-OSS-120B van OpenAI te overtreffen op 4 van de 5 geteste formele redeneerbenchmarks — ongeveer 40 keer minder parameters voor een 2,6 keer snellere inferentie. Het model, getraind op geverifieerde en propriëtaire data in plaats van automatisch verzamelde webcontent, richt zich op edge computing (edge): het zou kunnen draaien van een Raspberry Pi tot een iPhone, zonder afhankelijk te zijn van de cloud.

🔗 Officiële tweet

Meta bereidt een versie met open gewichten van Muse Spark 1.2 voor

In de thread waarin Muse Glimmer wordt aangekondigd, geeft Alexandr Wang (Meta Superintelligence Labs) aan dat Meta binnenkort een versie met open gewichten van Muse Spark 1.2 zal publiceren — tot nu toe het propriëtaire model dat de code-agent in de terminal Muse Code aandrijft. Er wordt geen exacte datum gegeven, maar de aankondiging bevestigt een verschuiving van Meta naar meer open gewichten over de hele Muse-reeks, in het verlengde van de onmiddellijke opening van de gewichten van Muse Glimmer onder de Apache 2.0-licentie.

🔗 Officiële tweet

Zuckerberg publiceert een tekst over Meta’s AI-filosofie

Op dezelfde dag publiceert Mark Zuckerberg een tekst waarin hij stelt dat « iedereen toegang zou moeten hebben tot superintelligentie », en waarin hij de filosofie en waarden van Meta uiteenzet om een positieve AI-toekomst op te bouwen. De boodschap begeleidt de lancering van Muse Glimmer en positioneert de openheid van gewichten als een fundamentele keuze in plaats van een louter marketingargument, en maakt deel uit van een bredere communicatie van Meta over zijn strategie voor open gewichten in die week.

🔗 Officiële tweet

Lightricks presenteert LTX-2.5, een grote update van zijn open world model

Lightricks publiceert LTX-2.5, een nieuwe versie van zijn « world model » dat al wordt gebruikt voor film, robotica en realtime workflows. De update belooft hogere pixelfidelity, multi-planscènes die van cut tot cut consistent blijven, en een vooraf getrainde basis die bedoeld is om per domein te worden verfijnd (fine-tuned) via een nieuwe rendering genaamd Diffusion Fidelity Rendering. Het team presenteert LTX-2.5 als een open fundering in plaats van een gehuurde tool.

🔗 Officiële tweet

IBM Research publiceert ALTK-Evolve, een agentisch geheugen dat minder tokens verbruikt dan ACE

IBM Research publiceert ALTK-Evolve, een systeem waarmee AI-agents van hun eerdere mislukkingen kunnen leren zonder hertraining, door de hoeveelheid opnieuw ingevoerde instructies af te stemmen op de capaciteit van het gebruikte model — in tegenstelling tot ACE (Agentic Context Engineering), dat zijn volledige « playbook » bij elke stap levert. Op de AppWorld-benchmark met DeepSeek-V3.2 behaalt ALTK-Evolve 89,3 % voltooide taken voor 263K tokens per taak, tegenover 80,4 % en 634K tokens voor ACE. Met gpt-oss-120b behaalt het een gelijke of betere nauwkeurigheid voor ongeveer 40 % van de inferentiekost van ACE.

🔗 Hugging Face-post

Together AI, IBM en NVIDIA bundelen krachten voor enterprise-inferentie op IBM Cloud

Together AI kondigt een partnerschap aan met IBM en NVIDIA om enterprise-kwaliteit AI-inferentie naar IBM Cloud te brengen, via een dedicated cluster van NVIDIA B300-GPU’s met Spectrum-X-netwerk — een primeur van dit type op dit platform, aangedreven door het productie-inferentieplatform van Together AI. Het aanbod richt zich op bedrijven die al klant zijn van IBM Cloud en AI-workloads willen uitrollen zonder naar een andere cloudprovider te migreren.

🔗 Officiële tweet


Ontwikkelaarstools: Amp, Replit, GitHub Copilot en Manus

Amp lanceert wereldwijde plugins en skills voor orbs

Amp (Sourcegraph) introduceert een gecentraliseerd systeem van door Amp gehoste plugins en skills, overal beschikbaar waar Amp draait, met name in de orbs. Er bestaan twee niveaus naast elkaar: een persoonlijk niveau, een experimentele sandbox met live reloading in dezelfde gespreksdraad, en een werkruimte-niveau, beheerd door administrators en standaard geladen voor het hele team. Persoonlijke elementen kunnen worden gedeeld met de werkruimte, en versiebeheer wordt native afgehandeld (update naar de nieuwste versie, detectie van verouderde skills).

🔗 Global Plugins and Skills

Replit MCP-bèta: een app maken, laden, zoeken en publiceren via MCP

Replit versterkt zijn MCP-bèta (Model Context Protocol) met nieuwe mogelijkheden: een applicatie rechtstreeks via MCP maken, laden, zoeken en publiceren, zonder via de webinterface te gaan. Het uitgesproken doel is om vanaf elke compatibele MCP-client echte software op Replit te bouwen — editor, autonome agent of tool van derden — in plaats van beperkt te blijven tot de Replit-interface zelf. Deze uitbreiding bevestigt Replit’s strategie om zijn platform bloot te stellen als een programmeerbare bouwsteen voor agentische workflows.

🔗 Officiële tweet

MAI-Code-1.1-Flash arriveert in GitHub Copilot, MAI-Code-1-Flash verouderd

Het nieuwste compacte codiemodel van Microsoft, MAI-Code-1.1-Flash, wordt uitgerold in GitHub Copilot met native vision-ondersteuning en verbeteringen in codekwaliteit, instructieopvolging en toolgebruik. Het kost 73% minder dan MAI-Code-1-Flash, met een premium queryvermenigvuldiger van 0,25× voor jaarlijkse abonnees. Automatisch geselecteerd op Free en Student, handmatig beschikbaar op Pro, Pro+, Max, Business en Enterprise. Tegelijkertijd kondigt GitHub de veroudering van MAI-Code-1-Flash op 10 september 2026 aan.

🔗 GitHub-changelog

Manus wordt opnieuw een onafhankelijk bedrijf

Manus kondigt aan opnieuw een onafhankelijk bedrijf te worden. Om te voldoen aan de regelgevingseisen in bepaalde rechtsgebieden, zal een deel van de gebruikers hun gegevens moeten opslaan vóór 23 augustus 2026 (07:59, Singaporetijd), en daarna een herstel moeten starten vanaf 25 augustus 2026 (08:00, Singaporetijd). De betrokken gebruikers worden per e-mail en in-appmelding geïnformeerd; er is geen facturering gepland tijdens de overgang, met welkomstbonussen als extraatje.

🔗 Officiële tweet


Mediageneratie: Wan CLI, Motif 3, Luma Scenes en 800 VDC-voeding

Wan CLI: Alibaba laat agents Wan rechtstreeks aansturen

Alibaba brengt de Wan CLI uit, een nieuwe opdrachtregeltool waarmee je het Wan-platform rechtstreeks vanuit agents kunt aanroepen om afbeeldingen en video’s programmatisch te genereren. De verbruikte credits blijven volledig gesynchroniseerd met het Wan Video-account van de gebruiker, waardoor dubbel beheer van facturering tussen webinterface en geautomatiseerd gebruik wordt vermeden. Installatie gebeurt door een opdracht op te halen uit het Wan-paneel en die vervolgens in de eigen agent te plakken, met een meegeleverde videotutorial voor de eerste stappen.

🔗 Officiële tweet

Motif 3: eerste Koreaanse frontiermodel getraind op NVIDIA B200-GPU’s

De Koreaanse startup Motif Technologies lanceert Motif 3 Base en Motif 3, haar eerste modellen die mikken op de frontier-LLM-race, ontwikkeld met steun van het Koreaanse ministerie van Wetenschap en getraind op NVIDIA B200-GPU’s. Motif 3 is gebouwd op Motif 3 Base via post-training met NVIDIA NeMo-RL. In samenwerking met NVIDIA publiceert het team ook een NVFP4-versie (geoptimaliseerde reduced precision van NVIDIA). De set zal beschikbaar zijn op Hugging Face met een technisch rapport, en NVIDIA prees deze lancering als een voorbeeld van de dynamiek van het Koreaanse AI-ecosysteem.

🔗 Officiële tweet

Luma Scenes: videoproductie per scène, aangedreven door Uni-1

Luma AI lanceert Luma Scenes, een tool waarmee je elke scène afzonderlijk kunt verfijnen, timen en valideren vóór de definitieve render — als antwoord op het klassieke probleem van veel varianten produceren om er uiteindelijk maar één bruikbare over te houden, met het risico dat één mislukte scène de hele productie onderuit haalt. De tool bouwt voort op Luma Layers (bewerking per laag, eind juli), en bevestigt Luma’s richting naar granulaire controle in plaats van generatie met één klik, met een workflow die dichter bij traditionele montage staat.

🔗 Officiële tweet

Ideogram Ad Resizer: één ontwerp, alle advertentieformaten

Ideogram lanceert Ad Resizer: op basis van één enkel ontwerp en de beoogde advertentieplaatsingen genereert de tool automatisch een complete set campagneklare formaten (Instagram, Facebook, YouTube, connected TV, display, print), inclusief extreme verhoudingen die moeilijk handmatig bij te snijden zijn. Meteen beschikbaar in de app en via de API, voor integratie in geautomatiseerde advertentieproductiepijplijnen — een concreet marketinggebruiksscenario voor multichannel creatieve teams.

🔗 Officiële tweet

HeyGen for Real Estate: officiële lancering met drie videoformaten voor makelaars

HeyGen lanceert officieel HeyGen for Real Estate, met drie videoformaten die zijn bedacht voor makelaars die zelf in beeld verschijnen zonder camera of montage — doel: hen in staat stellen meerdere keren per dag te publiceren zonder de visuele aanwezigheid op te offeren die deze sector vraagt. Stimuleringsaanbod: wie zich binnen 12 uur na de aankondiging aanmeldt voor het Creator-abonnement, krijgt 30 dagen gratis White Glove-toegang (alleen in de Verenigde Staten). HeyGen noemt een mogelijke uitbreiding naar andere kleine bedrijven buiten de vastgoedsector.

🔗 Officiële tweet

NVIDIA licht de 800 VDC-voedingsarchitectuur van toekomstige « AI factories » toe

NVIDIA, samen met Google en Microsoft, licht via het Open Compute Project een 800 volt-gelijkstroomvoedingsarchitectuur toe die het aantal elektrische omzettingsstappen tussen het net en de GPU’s vermindert om de reken­dichtheid van toekomstige generaties accelerators te ondersteunen. Meer dan 80 fabrikanten werken al aan conforme producten. Uitrol in meerdere fasen: hybride architectuur « Power Rack » vanaf de tweede helft van 2026, « Row Power Center » in 2027, daarna native 800 VDC-installaties in het komende decennium.

🔗 Officiële NVIDIA-post


Qwen, Z.ai en OpenAI: nieuwe modellen en synchronisatie van agents

Qwen3.8-27B: open weights aangekondigd voor deze week

Alibaba Qwen bevestigt dat de open weights van Qwen3.8-27B deze week worden gepubliceerd, een nieuw formaat binnen de Qwen3.8-familie na het vlaggenschipmodel Qwen3.8-Max dat begin augustus al aan bod kwam. Het team presenteert dit nieuwe model als beter dan Qwen3.6-27B in agentische codering, een prestatie die al goed werd ontvangen door de ontwikkelaarscommunity die al weken op dit tussengewicht zat te wachten.

🔗 Officiële tweet

Z.ai: ZCode bereikt 1 miljoen gebruikers, reset van de limieten van het GLM Coding Plan

Z.ai meldt dat ZCode, zijn op GLM-modellen gebaseerde coderingstool, de grens van een miljoen gebruikers overschrijdt. Als dank reset het bedrijf de gebruikslimieten van alle abonnees van het GLM Coding Plan en rolt het een update uit die de capaciteiten voor redenering over een lange horizon beter zou omzetten in daadwerkelijk afgerond werk, met een cache-succespercentage van 98%, goed voor ongeveer 1,8 keer meer gebruik voor abonnees.

🔗 Officiële tweet

ChatGPT desktop-app beschikbaar als preview op Linux, met Codex

OpenAI breidt zijn desktopapp uit naar Linux, tot nu toe alleen beschikbaar voor macOS en Windows. De preview dekt vier belangrijke distributies — Ubuntu 24.04/26.04 LTS, Debian 13 en Fedora 43/44 — met .deb/.rpm-pakketten voor x64 en ARM64. De app bundelt ChatGPT, ChatGPT Work en Codex in één native interface, met toegang tot projecten en ondersteunde browser-workflows, zonder van werkomgeving te wisselen.

🔗 Officiële tweet

Codex en ChatGPT Work importeren het werk van andere AI-agents

Nieuwe functie voor ChatGPT Work en Codex: bestaand werk, gemaakt met andere AI-agents, gesynchroniseerd houden met het OpenAI-ecosysteem. Concreet kunnen gebruikers projecten, gesprekken, skills en plugins importeren, een importgeschiedenis raadplegen en automatische synchronisatie inschakelen in de instellingen. Vanaf nu beschikbaar in de ChatGPT-desktopapp, om de wrijving van het wisselen van tool te verminderen in plaats van opnieuw te beginnen met een volledig nieuwe configuratie.

🔗 Officiële tweet


Kort nieuws

  • Fable-factureringsbug opgelost, 196 terugbetalingen — Anthropic bevestigt de volledige oplossing van een configuratiecachebug die ten onrechte overschrijdingen toonde; 196 gebruikers zijn terugbetaald en gecompenseerd met credits. 🔗 Tweet
  • v0 (Vercel) herontwerpt de zijbalk — gesprekken gegroepeerd per project, realtime statusindicatoren, previewkaarten bij hover. 🔗 Tweet
  • Amp vergroot de schijfgrootte van orbs naar 60 GB — tegenover 40 GB eerder, zonder meerprijs voor nieuwe orbs. 🔗 Tweet
  • DeepSeek V4 Flash 0731 beschikbaar voor fine-tuning op Together AI — specialisatie via SFT of DPO en daarna uitrol in productie. 🔗 Tweet
  • Together AI licht een tweede luik toe over de autoscaling van zijn dedicated inference — drie beleidsregels getest onder dezelfde belasting, slechts één paste zich echt aan. 🔗 Tweet
  • Hugging Face lanceert de Open Model Series — nieuwe educatieve videoreeks over open modellen en lokaal gebruik ervan. 🔗 Tweet
  • FC Barcelona sluit zich aan bij het Google Pixel / Gemini-partnerschap — nieuwe officiële partners van de club, na een vergelijkbaar partnerschap met Bayern München. 🔗 Tweet
  • Copilot-gebruiksrapport: detail van tokens per model — invoer-, uitvoer- en cachetokens nu zichtbaar achter de verbruikte AI-credits. 🔗 Changelog
  • GitHub zet de Rubber Duck-agent van Copilot in de kijker — in een carrièreartikel over vaardigheden van juniorontwikkelaars; de agent gebruikt een tweede model om gegenereerde code te bekritiseren. 🔗 Tweet
  • Perplexity Computer: GitHub, meest gebruikte connector — voornamelijk door niet-ontwikkelaars (4 op 5). 🔗 Tweet
  • Suno Studio 2.0 (teaser) — nieuwe versie van de muziekproductieomgeving van Suno, zonder verdere details. 🔗 Tweet
  • ElevenLabs Summit in New York op 11 november — conferentiedag met tech- en businessleiders; aanmeldingen geopend. 🔗 Tweet
  • FLUX 3 Video bevestigt de wereldwijde #2-positie — Black Forest Labs verlengt de gratis toegang tot de playground tot 16 augustus en teaset 4K en videobewerking. 🔗 Tweet
  • Seedance 2.5 op Runway voegt 50 personagereferenties toe — en gesynchroniseerde clips op een muziekspoor. 🔗 Tweet
  • P-Image-Ideogram beschikbaar op Runway — genereert een afbeelding in slechts 0,6 seconde, met vier kwaliteitsmodi. 🔗 Tweet
  • Kimi K3 beschikbaar op Databricks — nieuw distributiekanaal voor het model van Moonshot AI. 🔗 Tweet
  • Zapier transformeert zijn marketing met ChatGPT Work — minder uitval in de leadfunnel, geautomatiseerde rapportage. 🔗 OpenAI
  • Virgin Atlantic optimaliseert zijn klanttrajecten met ChatGPT Work — sneller productonderzoek en -planning. 🔗 OpenAI
  • Cohere — Aidan Gomez licht de open-source- en soevereiniteitsstrategie toe — aanpasbare, betaalbare en veilige modellen als rode draad. 🔗 Tweet

Wat dit betekent

De schaal van consumentengebruik van AI verandert van niveau: met een miljard maandelijkse gebruikers treedt Gemini toe tot de zeer beperkte kring van Google-producten op massale schaal, gedragen door toepassingen die veel verder gaan dan tekstchat (stem, camera, automatisering). Tegelijk breidt OpenAI zijn ChatGPT-advertenties uit naar vijf nieuwe markten — een teken dat grootschalige monetisering van conversationele assistenten een strategische prioriteit wordt zodra de gebruikersbasis groot en trouw genoeg is.

Aan de infrastructuurkant laat de dag een verschuiving zien naar gespecialiseerde agentische uitvoering in plaats van puur frontier-redeneren. NVIDIA stelt met Nemotron 3.5 Lightning en NeMo Switchyard een expliciet economisch model voor: de dure modellen reserveren voor complexe planning en de uitvoering met hoog volume delegeren aan lichtere en goedkopere modellen, met gemeten kostenbesparingen bij verschillende partners. IBM Research (ALTK-Evolve) en Together AI (autoscaling, IBM Cloud-partnerschap) verdiepen dezelfde economische lijn van inference, terwijl Mistral zijn eigen soevereiniteitsinspanning structureert met de European Compute Units en regionale inference.

De opening van weights blijft uitbreiden naar nieuwe spelers en nieuwe modaliteiten: Wan-Animate-2 van Alibaba, TwiL-LM3 van webAI, Qwen3.8-27B in aantocht, de belofte van Meta over Muse Spark 1.2, en zelfs een eerste Koreaans frontiermodel (Motif 3) gebouwd op de technische stack van NVIDIA. Deze geografische en modale diversificatie — tekst, animatie, ingebedde redenering — bevestigt dat open source allang niet meer het domein is van een kleine groep westerse laboratoria.

Ten slotte blijft de ontwikkelaarstooling voor agents professionaliseren: Amp en Replit voegen lagen van beheer toe (globale plugins, uitgebreide MCP), GitHub versterkt zijn aanbod van goedkope modellen, en OpenAI bouwt expliciete bruggen tussen concurrerende ecosystemen door Codex en ChatGPT Work werk te laten importeren dat elders is gedaan — een inzet op portabiliteit in plaats van opsluiting, nu ontwikkelaars met meerdere AI-agents tegelijk jongleren.


Bronnen