Zoeken

OpenAI beëindigt zijn contract met Cursor, Claude Code verlaagt wekelijkse limieten met 17%, Copilot CLI stapt over op native Rust

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.6-luna.

Bekijk project op GitHub ↗

Tweeëntwintig aankondigingen op acht gebieden voor 29 augustus: een rustige zaterdag, met half zoveel nieuws als de dag ervoor. Het belangrijkste nieuws is eerder contractueel dan technisch. OpenAI heeft SpaceX op de hoogte gebracht van zijn voornemen om te stoppen met het leveren van zijn modellen aan Cursor, met een voorgestelde stopdatum van 12 november, waarbij het expliciet verwijst naar het eerdere gedrag van de bedrijven van Elon Musk. Anthropic kondigt aan dat de wekelijkse limieten van Claude Code permanent met 25% worden verhoogd, wat — naar eigen zeggen — neerkomt op een daling van 17% ten opzichte van vandaag. GitHub laat Copilot CLI draaien op een native Rust-runtime, Together AI zet GLM-5.3 online op de dag dat het beschikbaar komt, en een inferentiegateway publiceert productiecijfers die eindelijk de werkelijke positie van open weights duidelijk maken.


OpenAI beëindigt zijn contract met Cursor na de overname door SpaceX

28 augustus — OpenAI heeft SpaceX op de hoogte gebracht van zijn voornemen om het contract te beëindigen dat Cursor rechtstreeks toegang geeft tot zijn modellen. De voorgestelde stopdatum is 12 november 2026: het bedrijf verduidelijkt dat het de langst mogelijke opzegtermijn heeft gekozen die het contract toestaat, zodat ontwikkelaars zo lang mogelijk toegang tot de modellen behouden.

De aanleiding is de overname van Cursor door SpaceX. OpenAI legt uit dat het met zijn grote partners werkt via overeenkomsten op maat, die naleving van de gebruiksvoorwaarden en de veiligheid van grootschalige integratie garanderen, en zegt er niet op te kunnen vertrouwen dat SpaceX zijn technologie binnen dat kader zal gebruiken. Er worden twee eerdere gevallen bij naam genoemd: na de overname van Twitter door Elon Musk, een bedrijf dat inmiddels onder SpaceX valt, werden de contractuele voorwaarden tussen beide bedrijven verbroken; en eerder dit jaar gaf Musk onder ede toe dat xAI, dat eveneens onder SpaceX is komen te vallen, de gebruiksvoorwaarden van OpenAI had geschonden. De overeenkomst met Cursor voorzag in een beperkte opzegtermijn na een wijziging van zeggenschap, wat de timing verklaart.

Daar komt een tweede, ongebruikelijker argument bij: OpenAI zegt een nieuw verantwoordelijkheidsniveau te aanvaarden naarmate de capaciteiten toenemen, en verwijst naar zijn komende model Astra — het model waarvan het bedrijf op 7 augustus aankondigde niet langer te kunnen uitsluiten dat het volgens zijn voorbereidingskader over een als Kritiek aangemerkt niveau van cybercapaciteiten beschikt. Praktisch gevolg: het contract loopt door tot de laatst mogelijke datum, maar toekomstige modellen zullen niet aan Cursor worden geleverd.

Onderdeel van het dossierWaarde
Datum van kennisgeving aan SpaceX28 augustus 2026
Voorgestelde stopdatum12 november 2026
Duur van het OpenAI-Cursor-partnerschapbijna 4 jaar
Toekomstige modellen geleverd aan Cursorgeen

We’re ending our partnership with Cursor following its acquisition by SpaceX. Under our proposal, Cursor’s direct access to our models would end on November 12.

We know that the people most affected by this decision are the developers who rely on OpenAI models in Cursor. We care about their experience in this transition and we’re ready to go above and beyond to support them.

🇳🇱 We beëindigen ons partnerschap met Cursor naar aanleiding van de overname door SpaceX. Volgens ons voorstel zou de rechtstreekse toegang van Cursor tot onze modellen op 12 november eindigen.

We weten dat de mensen die het meest door deze beslissing worden geraakt de ontwikkelaars zijn die in Cursor op OpenAI-modellen vertrouwen. Hun ervaring tijdens deze overgang gaat ons ter harte en we zijn bereid verder te gaan dan onze verplichtingen om hen te begeleiden.@OpenAI op X

🔗 Besluit over Cursor — OpenAI


Claude Code: wekelijkse limieten dalen op 14 september met 17%, CLI start sneller op

29 augustus — Anthropic kondigt aan dat vanaf 14 september de standaard wekelijkse limieten van Claude Code permanent met 25% worden verhoogd voor de Pro-, Max-, Team- en Enterprise-abonnementen met seats (seat-based). Tot die datum blijft de huidige verhoging van 50% van kracht.

De formulering vroeg om verduidelijking, en Anthropic gaf die zelf in het volgende bericht in zijn thread: afgezet tegen de situatie van vandaag komt de wijziging neer op een verlaging van 17% van de wekelijkse limieten. De berekening is eenvoudig — de huidige verhoging van 50% is tijdelijk, de verhoging van 25% die ervoor in de plaats komt is permanent, en de overgang van de ene naar de andere verlaagt het werkelijke plafond mechanisch. Deze tijdelijke verhoging was niet recent: op 18 juli 2026 kondigde hetzelfde account haar aan «tot 19 augustus», een deadline die zonder nieuwe communicatie was verstreken. De aankondiging van 29 augustus legt dus een eindpunt vast: een permanent plafond dat hoger ligt dan het oorspronkelijke standaardregime, maar lager dan het uitzonderlijke regime van de afgelopen weken. De ontvangst bleef gemengd, zozeer zelfs dat het hoofdbericht — op het moment van de scan ongeveer 1,6 miljoen keer bekeken — vergezeld ging van een door X-lezers opgestelde contextnotitie waarin het cijfer van de daling wordt vermeld.

PeriodeWekelijkse limieten van Claude Code
Tot en met 13 september+50% (tijdelijke verhoging, nog steeds van kracht)
Vanaf 14 september+25% permanent
Door Anthropic aangekondigd netto-effect-17% ten opzichte van vandaag

Compared to today, this works out to a 17% reduction in weekly limits on Claude Code. We’re working on exciting changes that will make it feel like you’re getting more from Claude, while having more visibility and control of your usage. Can’t wait to share them.

🇳🇱 In vergelijking met vandaag betekent dit een verlaging van 17% van de wekelijkse limieten voor Claude Code. We werken aan spannende veranderingen die ervoor zullen zorgen dat je het gevoel krijgt meer Claude te krijgen, met meer inzicht en controle over je verbruik. We kunnen niet wachten om ze te delen.@ClaudeDevs op X

Eerder op de dag publiceerde hetzelfde account zijn wekelijkse overzicht van de leveringen van Claude Code. Het belangrijkste deel van deze thread van zes berichten bundelt vernieuwingen die hier al in de loop van de versies zijn beschreven — het tabblad «Auto mode» in /permissions van 2.1.246, de prompt-cache-regel in /cost en het live volgen van actieve subagents van 2.1.251, de uitsplitsing van taken /loop in /usage van 2.1.243. Eén aspect was daarentegen nog nooit gekwantificeerd: prestaties. De CLI wacht niet langer tot de sandbox (sandbox) of de MCP-servers zijn gestart voordat de eerste instructie kan worden ingevoerd, en de opdracht claude slaat initialisatiestappen over die niet nodig zijn. Wat distributie betreft is de Linux x64-download 4,5 keer kleiner, ongeveer 75 MB, en verbruiken native builds per sessie 40 tot 70 MB minder geheugen.

Aangekondigde prestatiemetingWaarde
Linux x64-download4,5 keer kleiner, ongeveer 75 MB
Geheugen van native builds40 tot 70 MB minder per sessie

🔗 Aankondiging van de wekelijkse limieten · Wekelijks overzicht


Copilot CLI stapt over op een native Rust-engine, Visual Studio krijgt aangepaste organisatieagents

28 augustus — GitHub publiceerde laat op de dag zijn wekelijkse Copilot-overzicht. De titel vermeldt 24 augustus — de week waarop het betrekking heeft — maar het werd pas op 28 augustus om 20.13 uur UTC online gezet, na de vorige scan. Twee van de secties herhalen aankondigingen die hier al zijn behandeld, Copilot in Slack en Microsoft Teams en de algemene beschikbaarheid van het tabblad Customize; de rest is nieuw.

Het meest structurele element betreft de CLI: Copilot CLI draait voortaan op een native Rust-runtime (native Rust runtime), terwijl de terminalinterface in TypeScript geschreven blijft. GitHub kondigt «aanzienlijk betere» prestaties aan zonder ook maar één meting te publiceren, waardoor de lezer zelf mag oordelen. Twee instellingen, defaultMode en defaultPermissionMode, bepalen de uitvoeringsmodus en de machtigingsmodus die op elke nieuwe sessie worden toegepast; de opdrachten /plugin, /mcp en /skills krijgen speciale beheerinterfaces; en de CLI kan een sessie herstellen die niet correct is beëindigd, ook als die midden in een beurt werd onderbroken.

Betrokken oppervlakAangekondigde vernieuwingen
Copilot CLINative Rust-engine, defaultMode en defaultPermissionMode, interfaces /plugin /mcp /skills, sessieherstel
Copilot-applicatieAzure DevOps-issues en pull requests omgezet in sessies, experimentele WSL, splitsbare tabbladen, voorbeeldweergave in de externe browser
JetBrains-extensieBedrijfscontroles voor plugins, MCP-servers, telemetrie en machtigingsmodi van agents
VS Code 1.135Hervatten van elders gestarte Copilot- of Claude-agentsessies, tweede mening van een aanvullend model, één Agents-paneel, verbruik per model en per beurt
Visual Studio 2026Aangepaste organisatieagents, redeneerinspanning Low, Medium en High, weergave Manage models, beoordeling door de Git-agent

Diezelfde dag gepubliceerd, beschrijft een aparte changelogvermelding de augustus-update van Copilot in Visual Studio 2026, beschikbaar op alle abonnementen — Free, Student, Pro, Pro+, Max, Business en Enterprise. De belangrijkste wijziging is de komst van aangepaste agents op organisatieniveau: eigenaren van GitHub-organisaties of -ondernemingen publiceren agents die in al hun repositories kunnen worden gebruikt. Visual Studio detecteert deze automatisch en toont ze in de kiezer met hun beschrijving en oorspronkelijke organisatie. Een GitHub-organisatie is vereist, waardoor persoonlijke accounts zijn uitgesloten. De instelling voor redeneerinspanning komt aan de gebruikerskant met drie niveaus, waarbij GitHub dit expliciet presenteert als een afweging tussen redeneerdiepte en tokenverbruik. De weergave Manage models bundelt mogelijkheden, contextvenstergrootte, kosteninformatie en besturingselementen, terwijl de Git-agent niet-gecommitte wijzigingen of commits controleert voordat een pull request wordt geopend, zowel in GitHub- als in Azure DevOps-repositories.

🔗 Wekelijks Copilot-overzicht · Copilot in Visual Studio, augustus-update


GLM-5.3 arriveert bij Together AI, dat meteen meet wat zijn gedistilleerde versie kost

29 augustus — De derde opeenvolgende dag voor GLM-5.3. Op 27 augustus kondigde Z.ai in twee regels aan dat het de gewichten zou publiceren; op 28 augustus was de opening een feit en opende Together AI een modelpagina met de vermelding « coming soon », zonder tarief. Sinds 29 augustus om 1.57 UTC staat de pagina online en spreekt de host over beschikbaarstelling op « Day 0 ». Het endpoint zai-org/GLM-5.3 wordt zowel serverless als op dedicated infrastructuur aangeboden, en Together AI kondigt compatibiliteit aan met Claude Code, OpenCode en andere platforms voor code-agenten. Volgens de host benadert het model Fable 5 op alle benchmarks, terwijl het een fractie van de prijs per taak kost.

Kenmerk van de dienstWaarde
Prijs invoer / gecachete invoer$1,40 / $0,26 per miljoen tokens
Prijs uitvoer$4,40 per miljoen tokens
Contextvenster1 M tokens (IndexShare-architectuur)
Inspanningsniveauslow, high, max (standaard max)
Aangekondigde SLA99,9 %

Op dezelfde dag publiceert Together AI de zesde vergelijking in zijn DeepSWE-reeks, en voor het eerst worden daarin twee modellen uit dezelfde familie tegenover elkaar gezet: GLM-5.3 en de gedistilleerde versie GLM-5.3 Flash. Het protocol is ongewijzigd — de 113 taken van DeepSWE v1.1, vier pogingen per configuratie, beide modellen op maximale inspanning — voor in totaal 900 volledige uitvoeringen (rollouts), 452 met het volledige model en 448 met Flash. Bij de eerste poging lijkt het verschil duidelijk: 69,0 % pass@1 tegenover 63,4 %. Maar bij pass@4 daalt het tot 2,6 punten, voor een zeventiende van de prijs. Distillatie heeft dus niet de capaciteit weggenomen, maar de consistentie: geen enkele van de 48 taken die het volledige model vier van de vier keer oplost, wordt onoplosbaar voor Flash, dat 93 van de 99 minstens één keer opgeloste taken behoudt. Het mechanisme wordt verderop geïdentificeerd, en dat is het interessantste resultaat: bij instabiele taken is de langste poging in 61 % van de gevallen de winnende poging voor GLM-5.3, maar slechts in 46 % voor Flash — onder de grens van een munt opgooien. Het gedistilleerde model kan extra inspanning niet langer omzetten in een oplossing.

Gemeten metriekGLM-5.3 (maximale inspanning)GLM-5.3 Flash (maximale inspanning)
pass@169,0 %63,4 %
pass@487,6 %85,0 %
Kosten per uitvoering$3,99$0,24
Opgeloste taken per $10017264
Doorlooptijd van begin tot eind35 min26 min
Falen van een al geslaagde referentietest4,4 %6,9 %
Inspanning loont bij instabiele taken61 %46 %

Er wordt slechts één duidelijke regressie vastgesteld, en die betreft voorzichtigheid: Flash laat in 6,9 % van de uitvoeringen een al geslaagde referentietest falen, tegenover 4,4 % voor het volledige model. Daarom raadt Together AI expliciet aan om een volledige regressiesuite uit te voeren voordat een door Flash geproduceerde diff zonder controle wordt geaccepteerd. De operationele conclusie is een cascade binnen dezelfde familie: Flash eerst starten en alleen naar het volledige model opschalen als een verifier het antwoord afwijst. Deze combinatie bereikt 80,9 % succes voor 1,70 dollar per taak, twaalf punten meer dan GLM-5.3 alleen (69,0 % voor 3,99 dollar), voor minder dan de helft van de prijs. Een verschil verdient vermelding voor de lezer: de DeepSWE-score op de modelpagina (66,9) verschilt van de 69,0 % die Together AI in zijn eigen campagne heeft gemeten. De host erkent dit en preciseert dat zijn cijfers afkomstig zijn van zijn eigen uitvoering.

🔗 GLM-5.3 online bij Together AI · GLM-5.3 tegenover GLM-5.3 Flash op DeepSWE


Modellen met open gewichten hebben de helft van het verkeer gepakt, maar slechts 13 % van de uitgaven

29 augustus — Thibault Jaigu, directeur van inferencegateway Requesty, publiceert op de Hugging Face-blog metingen van zijn eigen productie-verkeer in 2026, exclusief door klanten aangeleverde sleutels en interne accounts. Het kerncijfer: modellen met open gewichten gingen van minder dan 5 % van de tokens in januari naar de helft van al het verkeer in de week van 3 augustus, maar vertegenwoordigen slechts ongeveer 13 % van de uitgaven. Een token van een gesloten frontiermodel kost, eenmaal rekening houdend met de cache, ongeveer 6,4 keer zoveel als een open token.

Twee voorbeelden geven een beeld van deze markt. Na de release van kimi-k3 had het oorspronkelijke laboratorium 11 dagen nodig om de meerderheid van de tokens die op zijn eigen model werden aangeboden kwijt te raken; vier andere hosts hadden binnen 72 uur inference op dezelfde gewichten ingeschakeld. En voor glm-5.2 tonen zes hosts een verschil van 5,7x in de werkelijk betaalde prijs — niet door geheime kortingen, maar omdat de goedkoopste 94 % van de invoertokens in de cache plaatst, terwijl de duurste er geen enkele in cache plaatst. Deze cijfers komen van een leverancier die zijn eigen product beschrijft, wat de auteur erkent door te ondertekenen als directeur van Requesty.

Gemeten maatstaf op de gatewayWaarde
Aandeel open gewichten in tokens (januari 2026)minder dan 5 %
Aandeel open gewichten in tokens (week van 3 augustus)50 %
Aandeel open gewichten in de uitgavenongeveer 13 %
Verdeling van de uitgaven (Anthropic / OpenAI / Google)51 % / 21 % / 15 %
Cache-hits / verse invoer / zichtbare uitvoer78 % / 19 % / minder dan 2 %
Verhouding invoer tot uitvoer (januari en daarna augustus)15x en daarna 36x
Gemiddelde context per verzoek (januari en daarna augustus)9,6 k en daarna 28 k tokens

🔗 Bericht van Requesty op Hugging Face


De Search API van Perplexity neemt de drie eerste plaatsen in de Artificial Analysis Search Index in

29 augustus — Perplexity deelt een ranglijst die de dag ervoor door Artificial Analysis is gepubliceerd: de drie contextinstellingen van zijn Search API bezetten de drie eerste plaatsen in de Artificial Analysis Search Index, bij hun debuut in deze ranglijst. De instelling medium behaalt 80 punten, vijf meer dan de vorige leiders Parallel (advanced) en Brave Search (LLM context), die beide op 75 staan; de varianten high en low volgen met respectievelijk 79 en 77.

Het protocol isoleert bewust de zoekcomponent: Artificial Analysis laat hetzelfde model — GPT-5.6 Luna met medium reasoning — draaien in Stirrup, zijn open-source agent-harnas (harness), met tools voor zoeken en het ophalen van webpagina’s. Van test tot test verandert alleen de leverancier achter de zoektool. De voorsprong van Perplexity concentreert zich op BrowseComp; de AA-Omniscience- en DeepSearchQA-scores blijven vergelijkbaar met die van de andere topleveranciers. Het tweede argument is economisch: compactere payloads zorgen ervoor dat het model minder hoeft te lezen, wat resulteert in inferentiekosten per taak van 0,028 tot 0,034 dollar, afhankelijk van de variant, tegenover 0,036 dollar voor de op één na goedkoopste leverancier — het laagste bedrag dat Artificial Analysis tot nu toe heeft gemeten.

Zoekleverancier (variant)Score AA Search IndexTotale kosten per taak
Perplexity Search (medium)80ongeveer 0,091 $
Perplexity Search (high)79ongeveer 0,091 $
Perplexity Search (low)77niet meegedeeld
Parallel (advanced)750,084 $
Brave Search (LLM context)750,13 $

Twee gebruiksvoorbehouden: de ranglijst is afkomstig van Artificial Analysis en niet van Perplexity, dat haar alleen onder de aandacht brengt, en geen enkele blogpost versterkt de boodschap; de bedrijfsblog heeft sinds 25 augustus niets gepubliceerd.

🔗 Bericht van @perplexity_ai · Cijferdetails van @ArtificialAnlys


Codex CLI 0.151.0: extensies onderscheppen MCP-resultaten, externe sandbox wordt strenger

29 augustus — Codex CLI gaat naar 0.151.0, gepubliceerd op GitHub om 11.55 GMT+2 en dezelfde dag vermeld in de officiële changelog van ChatGPT en Codex. De meest structurele vernieuwing betreft de extensies: die kunnen voortaan de resultaten van een MCP-tool inspecteren of vervangen voordat ze het model bereiken. Er komt dus een interceptiepunt tussen de MCP-server en de context, wat filtering, herschrijven of afkappen van tooluitvoer mogelijk maakt zonder de server aan te raken. Daarbij komen een configureerbare respijtperiode voor het ontdekken van tools die door optionele MCP-servers worden aangeboden, en plug-incatalogi die de configuratie per repository combineren en tegelijk ongeldige projectmarketplaces signaleren zonder geldige plugins te laten verdwijnen.

De rest van de versie wordt gedomineerd door het aanscherpen van de sandbox (sandbox). Het commando /cd kan de beperkingen niet langer verzwakken — een scenario waarin het wijzigen van de directory impliciet de beveiligingsmaatregelen versoepelde — en verouderde Guardian-classificaties kunnen na een wijziging van de permissiestatus geen actie meer toestaan. De toepassing van de externe sandbox sluit bovendien beter aan op de werkelijkheid van de uitvoermachine: de persoonlijke directory, het besturingssysteem en de padconventies van de uitvoerder worden in de context doorgegeven, ook voor regels die leesbewerkingen weigeren. Een laatste punt voor teams die hun agenten werk laten delegeren: het tokenverbruik van geneste subagenten wordt eindelijk meegerekend in het budget van het hoofddoel.

Onderdeel van de versieWaarde
Versie0.151.0 (stabiel)
GitHub-publicatie29 augustus 2026, 11.55 GMT+2
Installatienpm install -g @openai/codex@0.151.0
Vernieuwingen / fixes / fundamenteel werk3 / 6 / 2
Vorige stabiele versie0.150.1 (27 augustus)

🔗 Release notes van Codex CLI 0.151.0


Appshots: ChatGPT Work en Codex lezen de context van de weergegeven applicatie

28 augustus — OpenAI Developers presenteert appshots, een mechanisme voor contextvastlegging voor ChatGPT Work en Codex. Het principe: in plaats van te beschrijven wat je voor je ziet, geef je de assistent de volledige context van de applicatie die momenteel wordt weergegeven, zodat die het scherm begrijpt en erop kan handelen. De trigger is bewust minimaal — twee keer drukken op de Command-toets (⌘ ⌘).

De thread beschrijft tien toepassingen die de beoogde reikwijdte duidelijk maken, ver buiten code: een Slack-thread samenvatten, een formulier invullen, een op het scherm weergegeven API-referentie gebruiken om een functie toe te voegen, de thema’s uit een reeks antwoorden op X destilleren, privéberichten identificeren die een antwoord vereisen, notities omzetten in een presentatie, een video in iMovie knippen, of een geopende receptpagina omzetten in een boodschappenlijst. Op het moment van de scan bestaat de aankondiging alleen op X: de changelog van ChatGPT en Codex bevat geen vermelding tussen 27 en 29 augustus, afgezien van versie 0.151.0 van de CLI. De toegangsvoorwaarden — betrokken abonnementen, platforms, algemene of gefaseerde beschikbaarheid — zijn dus niet gedocumenteerd.

🔗 Thread van @OpenAIDevs


Antigravity CLI 1.1.22: het commando /model krijgt een argument, acht stabiliteitsfixes

27 augustus — Een inhaalslag op een kanaal dat tot nu toe nooit was gescand. De changelog van Google Antigravity is verdeeld over vier tabbladen — Antigravity 2.0, Antigravity CLI, Antigravity SDK en Antigravity IDE — waarvan bij eerdere rondes alleen het eerste werd gelezen. Het CLI-tabblad publiceert in de praktijk iedere één tot drie dagen een versie; de meest recente, 1.1.22, brengt drie verbeteringen en acht fixes.

Wat gebruiksgemak betreft accepteert het commando /model voortaan een argument: in plaats van een selector te openen, schakel je direct over naar een model door de naam, slug of het label ervan op te geven. De bewerking stelt de standaardinstelling in dezelfde stap in, met ghost-text-autocompletion tijdens het typen. Het commando /effort, dat de reasoning-inspanning instelt, vult eveneens de ingevoerde tekst aan in plaats van een vast voorbeeld weer te geven. Een derde toevoeging, nuttig bij lange sessies: wanneer een agent veel bestanden genereert, worden de stortvloeden aan bestandssysteemgebeurtenissen gebundeld tot één nieuwe analyse.

De acht fixes zijn gericht op langdurige stabiliteit. De zichtbaarste verwijdert het voortdurende opnieuw tekenen van de interface wanneer het taakpaneel of de details van een subagent geopend bleef zonder actieve taak, waardoor het processorgebruik in rust opliep. Tijdelijke HTTP 502-fouten, die een run simpelweg beëindigden, worden nu na een oplopende wachttijd (backoff) opnieuw geprobeerd. De rest betreft Windows, de daemon zonder interface (headless) en de reasoning-inspanning, die opnieuw selecteerbaar is voor Gemini 3.1 Pro en Gemini 3.5 Flash bij authenticatie met een Gemini API-sleutel.

Antigravity-kanaalLaatste versieDatum
Antigravity 2.02.11.026 augustus 2026
Antigravity CLI1.1.2227 augustus 2026
Antigravity SDK0.1.1525 augustus 2026
Antigravity IDE2.5.513 augustus 2026

🔗 Changelog van Antigravity


MiniMax maakt de balans op van H3 Max en verklaart vide生成ie sneller dan realtime als verworven

29 augustus — MiniMax publiceert een ongewoon lange verklaring over H3 Max, het videomodel dat fal Research heeft verkregen door de open gewichten van MiniMax H3 na te trainen. De aankondiging van het model zelf dateert van 27 augustus; nieuw is hier het standpunt van het oorspronkelijke laboratorium over wat dit externe werk voor het bedrijf betekent.

De boodschap valt uiteen in twee ideeën. Het eerste is strategisch: MiniMax stelt dat H3 Max de waarde van open gewichten tastbaar heeft gemaakt voor zijn eigen teams, en zegt bereid te zijn elk team te ondersteunen dat de aanpak van fal zou reproduceren. Het tweede is technisch en gaat verder: het laboratorium beschouwt videогенераtie die sneller is dan realtime voortaan als verworven, en leidt daar een lijst van tot nu toe onbereikbare gebruiksscenario’s uit af — voortdurende videostreams, interactieve werelden, realtimevertelling. Twee uur eerder deelde MiniMax een communitytest die de omslag goed samenvat: de vraag is niet langer hoe lang een generatie duurt, maar of het model sneller genereert dan een Twitch-stream uitzendt.

They made the value of open weights feel real to our team in a way it hadn’t before. Advancing technology together has always been a core belief at MiniMax. H3 Max made that belief tangible. It showed that the frontier no longer belongs to a few, it belongs to everyone willing to build, experiment, and share what they discover.

🇳🇱 Ze hebben de waarde van open gewichten op een manier tastbaar gemaakt voor ons team die we nooit eerder hadden meegemaakt. Technologie samen vooruitbrengen is altijd een fundamentele overtuiging bij MiniMax geweest. H3 Max heeft die overtuiging tastbaar gemaakt. Het heeft laten zien dat de grens niet langer aan enkelen toebehoort, maar aan iedereen die bereid is te bouwen, te experimenteren en te delen wat die ontdekt.@MiniMax_AI op X

🔗 Door MiniMax gedeelde communitytest


Kort nieuws

  • Grok 4.6 komt naar Grok.com en de iOS- en Android-apps — Na een uitrol die gericht was op partnerplatforms — GitHub Copilot, Amazon Bedrock, Gemini Enterprise Agent Platform en vervolgens Microsoft Foundry op 26 augustus — maakt xAI de reeks compleet met zijn eigen consumentenplatforms. Drie aanbevolen toepassingen: complexe problemen, agentische verzoeken en het maken van applicaties. Geen cijfers, geen benchmark, geen wijziging van de prijsstelling. 🔗 Bericht van @grok
  • Midjourney corrigeert de beeldkwaliteit van zijn V8.2-bewerkingsmodel — Minder dan vierentwintig uur na de opening van de tests publiceert de studio een correctie voor de beeldkwaliteit en nodigt het gebruikers die problemen hebben ondervonden uit hun generaties opnieuw te starten. Verdere updates worden aangekondigd zonder tijdschema. 🔗 Bericht van @midjourney
  • Gemini CLI zet workspacevertrouwen standaard op weigeren — De nightly-versie (nightly) v0.59.0-nightly.20260829.g0bd1d4397 bevat één wijziging: een workspace waarvan het vertrouwen niet kan worden vastgesteld, wordt als onbetrouwbaar behandeld en gedeclareerde MCP-servers worden in beperkte modus gefilterd. Het stabiele kanaal blijft op v0.57.0, de preview op v0.58.0-preview.0. De nightly van 27 augustus had al een SSRF in de ontdekking van OAuth-metadata van MCP-servers gedicht. 🔗 Release notes
  • NVIDIA positioneert Dynamo tegenover SGLang, vLLM en TensorRT-LLM — Een korte video van vijf minuten die antwoord geeft op een veelvoorkomende verwarring: Dynamo vervangt de inferentie-engines niet, maar wordt eromheen geïnstalleerd om de belasting over meerdere GPU’s en nodes te verdelen. De video wordt gepresenteerd door Vishakha Sadhwani. 🔗 Bericht van @NVIDIAAI
  • QwenCloud publiceert het verslag van de Qwen Conference Hong Kong 2026 — Een terugblik op het evenement van 26 augustus, gehouden voor meer dan 300 zakelijke klanten en ontwikkelaars, met een keynote waarin het platform rond drie toegangspunten werd opgebouwd — de website, Skills en de CLI — en een demonstratie van een agent die accountaanmaak, modelselectie, inferentie, implementatie, betaling en facturatie aan elkaar koppelt. 🔗 Bericht van @qwen_cloud
  • Luma organiseert een creatieve avond in San Francisco — Creative Intelligent Machines Continuum, een avond voor creatie op aanvraag die gepland staat voor dinsdag 1 september bij tiat, met stapsgewijze demonstraties onder leiding van de senior creatives van de studio, een gemeenschappelijke prompt en begeleiding ter plaatse. Het initiatief verlengt de reeks Dream Lab Weekly, die op 25 augustus van start ging. 🔗 Bericht van @LumaLabsAI
  • FAST, een poging tot standaard voor het melden van kwetsbaarheden door agents — Het Framework for Autonomous Severity and Triage presenteert zich als een reeks Markdown-bestanden die aan de context van een agent moeten worden toegevoegd, zonder SDK of API. Het maakt onderscheid tussen een onbewezen aanwijzing en een kwetsbaarheid met reproduceerbaar bewijs van impact, biedt een ernstbeslisboom die is afgeleid van wat bug bountyprogramma’s daadwerkelijk betalen in plaats van van CVSS-berekeningen, en vereist vóór indiening een poort met zes controles. Licentie CC-BY 4.0. 🔗 Bericht op Hugging Face
  • Twee AI-sessies, één repository, twee tegengestelde oordelen over een zelfherstellende agent — Een engineeringnotitie over een persoonlijk project: een afgewezen ontwerp voor autonoom zelfherstel verscheen enkele dagen later opnieuw in de repository, geschreven door een andere sessie die een andere assistent gebruikte, zonder spoor van de eerste beslissing. Het bestand kon nooit worden uitgevoerd, maar alleen dankzij twee toevallige bugs — de auteur spreekt over veiligheid door toeval, niet door ontwerp. 🔗 Bericht op Hugging Face
  • three.ws, een opensourcestack om agents een lichaam, portefeuille en beroep te geven — Het project combineert vier bouwstenen: 3D-generatie en rigging met studio’s in de browser, een agentengine met een keten van vangrails en een vaardighedensysteem, een agentportefeuille gebaseerd op x402 (betaling per aanroep boven op HTTP), en distributie via één tag die op elke website of in augmented reality kan worden geplaatst. 🔗 Bericht op Hugging Face

Wat dit betekent

Toegang tot frontiermodellen wordt een kwestie van tegenprestatie, niet alleen van contracten. OpenAI blokkeert Cursor niet vanwege een onbetaalde rekening of een technische clausule, maar omdat het zegt geen vertrouwen te kunnen hebben in het gebruik dat de nieuwe eigenaar ervan zou maken, waarbij het verwijst naar twee met name genoemde precedenten — Twitter en xAI, die beide onder SpaceX zijn komen te vallen. Het argument met de grootste gevolgen is echter het tweede: OpenAI verwijst naar zijn komende model Astra, waarvan het op 7 augustus aankondigde niet langer te kunnen uitsluiten dat het cybercapaciteiten van het niveau Critiek bezit, om te rechtvaardigen dat het geen enkel toekomstig model zal leveren. Met andere woorden: hoe gevaarlijker een generatie modellen wordt geacht, hoe kleiner de lijst van partijen die er toegang toe krijgen — en het selectiecriterium is niet langer de kredietwaardigheid van de klant, maar het nalevingsverleden van diens moederbedrijf. Voor teams die hun productieproces op een externe leverancier hebben gebouwd, is 12 november een migratiedeadline.

Wat van prijs verandert, zijn de plafonds, niet de tarieven. Anthropic heeft geen enkel gepubliceerd tarief gewijzigd: het zet een tijdelijke verhoging van 50% om in een permanente verhoging van 25%, wat neerkomt op −17% ten opzichte van vandaag, en zegt dat zelf in het volgende bericht. GitHub presenteert op zijn beurt de redeneerinspanning als een bewuste afweging met het tokenverbruik en toont voortaan het verbruik per model bij elke gespreksronde. De cijfers van Requesty verklaren waarom deze plafonds de echte prijs zijn geworden: cacheherlezingen vertegenwoordigen 78% van alle verwerkte tokens, zichtbare output minder dan 2%, en de verhouding tussen invoer en uitvoer steeg van 15x in januari naar 36x in augustus. Een agentlus kost niet wat ze schrijft, maar wat ze bij elke stap opnieuw leest — en het is die grootheid die leveranciers zijn gaan rantsoeneren.

Open gewichten hebben volume gewonnen en waarde verloren. De helft van het verkeer, 13% van de uitgaven, en 86% daarvan nog altijd geconcentreerd bij drie leveranciers: de open markt is een groothandelsmarkt geworden, waar hetzelfde model afhankelijk van het cachebeleid alleen al 5,7 keer duurder is bij de ene host dan bij de andere, en waar een laboratorium binnen elf dagen het merendeel van de tokens verliest die op zijn eigen model worden geleverd. GLM-5.3 illustreert dat vandaag: gewichten gepubliceerd op de 28e, op de 29e beschikbaar bij een externe host voor 1,40 dollar per miljoen invoertokens, gevolgd door een onafhankelijke meting die exact becijfert wat de gedistilleerde versie kost — 2,6 punten pass@4 voor een zeventiende van de prijs. Wanneer het model overal hetzelfde is, verschuift de differentiatie naar caching, routing en meting. Dat is infrastructuurwerk, geen laboratoriumwerk.

De commandoregelclient wordt opnieuw een terrein voor technische concurrentie. Copilot CLI schakelt over op een native uitvoeringsengine in Rust en behoudt zijn interface in TypeScript, Claude Code verkleint zijn Linux-download met factor 4,5 en bespaart 40 tot 70 MB geheugen per sessie, Antigravity CLI verwijdert de hertekeningen die de processor in rust zwaar belastten, Codex CLI voorkomt dat /cd zijn sandbox verzwakt en Gemini CLI zet workspacevertrouwen standaard op weigeren. Vijf leveranciers, dezelfde week, rond dezelfde onderwerpen: opstarttijd, geheugengebruik en de exacte reikwijdte van wat de agent mag aanraken. Na een jaar waarin modelcapaciteiten werden vergeleken, speelt de concurrentie zich ook af rond het programma dat ze uitvoert — en veiligheid neemt daarin inmiddels evenveel changelogregels in beslag als functionaliteit.


Bronnen