Zoeken

Meta publiceert Muse Glimmer open source, OpenAI lanceert GPT-5.6-Cyber voor cyberdefensie, Claude boekt vooruitgang op de conjectuur van Riemann

Artikel gegenereerd door kunstmatige intelligentie
Meta publiceert Muse Glimmer open source, OpenAI lanceert GPT-5.6-Cyber voor cyberdefensie, Claude boekt vooruitgang op de conjectuur van Riemann

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

Deze week publiceert Meta Muse Glimmer, een multimodaal agentisch model van 30 miljard parameters met open gewichten, onmiddellijk toegankelijk via een NVIDIA GPU-versnelde endpoint naast Hugging Face. OpenAI herstructureert zijn cyberbeveiligingsprogramma Daybreak en lanceert GPT-5.6-Cyber, een model dat al heeft geholpen een ongekende kwetsbaarheid in de JavaScript-engine van Chrome te ontdekken. Een ander markant feit: een niet-gepubliceerde onderzoeksversie van Claude heeft vooruitgang geboekt op een wiskundig probleem dat verband houdt met de conjectuur van Riemann, met geverifieerd formeel bewijs. Ook op het menu: Anthropic-prijsstelling, ontwikkelaarstools, zakelijke spraak-AI en AI-native finance.


Meta publiceert Muse Glimmer, 30B-agentisch model met open gewichten, beschikbaar via NVIDIA

Meta heeft Muse Glimmer uitgebracht, een dicht multimodaal model van 30 miljard parameters (2B visuele encoder + 28B tekstdecoder) dat is geoptimaliseerd om lokaal, continu, te draaien op consumentenhardware — Mac of pc met een krachtige GPU. De gewichten worden verspreid onder de licentie Apache 2.0. Het model ondersteunt een contextvenster van meer dan 120.000 tokens en haalt volgens NVIDIA tot 20.000 tokens per seconde op één GPU; Alexandr Wang (Meta Superintelligence Labs) verduidelijkt dat het draait op 24 GB VRAM zonder verlies aan agentische betrouwbaarheid.

Technisch combineert Muse Glimmer sliding-window attention met full attention, een Gated Grouped-Query Attention-architectuur die de geheugencache met een factor 16 verkleint, en een licht DFlash-schetsmodel dat de generatie met 2 tot 4x versnelt. Ondersteuning is vanaf dag 0 beschikbaar in transformers, llama.cpp en vLLM, met gequantiseerde GGUF-gewichten en implementaties via Hugging Face Inference Endpoints.

Technische eigenschapGemeten waarde
Parameters30B (encoder 2B + decoder 28B)
LicentieApache 2.0
Contextvenster120.000+ tokens
Minimale VRAM24 GB
Doorvoer (1 GPU)tot 20.000 tokens/s
MCP Atlas (agentisch)75,5 (tegen 54,2–62,5 voor concurrenten)

NVIDIA heeft onmiddellijk een GPU-versnelde toegangspoint geopend om Muse Glimmer te testen, geoptimaliseerd voor zijn edge-, desktop- en workstationplatforms — een concrete beschikbaarheid als aanvulling op het downloaden van de gewichten.

Introducing Muse Glimmer, an open-weight 30B-parameter model optimized for local, always-on agent workflows. […] we’re releasing model weights under a permissive Apache 2.0 license.

🇳🇱 Introductie van Muse Glimmer, een model met open gewichten van 30 miljard parameters, geoptimaliseerd voor lokale en permanente agent-workflows. […] we publiceren de modelgewichten onder de permissieve Apache 2.0-licentie.@AIatMeta op X

🔗 NVIDIA biedt een GPU-versnelde endpoint voor Muse Glimmer


OpenAI breidt Daybreak uit en lanceert GPT-5.6-Cyber, een ongekende CVE ontdekt in Chrome

OpenAI herstructureert zijn cyberbeveiligingsprogramma Daybreak in twee toegangsniveaus en lanceert GPT-5.6-Cyber, een gespecialiseerd model gebouwd op GPT-5.6 Sol. Het uitgesproken doel: geavanceerde intelligentie in handen geven van vertrouwde verdedigers voordat offensieve capaciteiten zich bij aanvallers breed verspreiden.

ToegangsniveauGebruikt modelBeoogd publiek
Daybreak BlueGPT-5.6 Sol (systeembeperkingen opgeheven)Aanbevolen instappunt voor de meeste verdedigers
Daybreak RedGPT-5.6-Cyber (nieuw)Ervaren securityonderzoekers, geautoriseerd geavanceerd werk

GPT-5.6-Cyber vermindert weigeringen op bepaalde dual-use verzoeken met hoog risico (bijvoorbeeld pentesting van productieomgevingen) en presteert beter dan GPT-5.6 Sol en de oudere GPT-5.5 Cyber op ExploitGym 2. In reële omstandigheden heeft het model geholpen twee ongekende kwetsbaarheden in V8, de JavaScript-engine van Chrome, te ontdekken, waardoor geheugen kon worden beschadigd en uit de sandbox van de heap kon worden ontsnapt; na gecoördineerde openbaarmaking aan Google werd de fout gepatcht en als CVE-2026-15903 geregistreerd. Het identificeerde ook ten minste vijf kwetsbaarheden in een populair mobiel besturingssysteem, drie kritieke lekken in een populaire database en meer dan 400 privilege-escalatiekwetsbaarheden in een populaire besturingssysteemkernel — correcties lopen momenteel samen met Daybreak-partners.

OpenAI verplicht hardwarebeveiligingssleutels voor alle individuele Daybreak-accounts vanaf 1 september 2026, en een Daybreak Cyber Partner-programma brengt al dienstverleners (Accenture, IBM, KPMG) en beveiligingsleveranciers (Palo Alto Networks, CrowdStrike, Cisco) samen om deze modellen in hun diensten te integreren.

We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorized cybersecurity work.

🇳🇱 We breiden ons Daybreak-cyberbeveiligingsinitiatief uit en lanceren GPT-5.6-Cyber, een nieuw model voor geavanceerd en geautoriseerd cyberbeveiligingswerk.@OpenAI op X

🔗 Daybreak uitbreiden terwijl het venster voor cyberdefensie kleiner wordt


Claude boekt vooruitgang op de conjectuur van Riemann, zonder die op te lossen

Anthropic vroeg een niet-gepubliceerde onderzoeksversie van Claude om zich op de hypothese van Riemann te storten, een van de zeven Millennium Prize-problemen van het Clay Mathematics Institute (1 miljoen dollar per stuk). Claude loste het probleem niet op, maar boekte wel vooruitgang op een verwante vraag: het verhoogde de ondergrens van het aandeel nulpunten van de Riemann-zètafunctie die aan de hypothese voldoen, van 41,6 % naar 67,2 %.

Het werk vond plaats in twee sessies met in totaal 31 miljoen outputtokens. De eerste genereerde 650 initiële ideeën, allemaal zonder resultaat. Voor de tweede poging coördineerde Claude 60 gespecialiseerde subagents (wiskundige ontwikkeling, ideeënvorming, validatie, redactie), voerde 2.400 shellcommando’s uit en downloadde 54 artikelen van arXiv om zijn pistes te verifiëren. Het resultaat werd vervolgens nagelezen door twee wiskundigen van Anthropic en daarna onderzocht door externe experts Brian Conrey en Dan Goldston. Claude produceerde een bewijs dat formeel geverifieerd was in Lean en de standaardvalidatie doorstond.

Dit resultaat valt buiten het gebruikelijke benchmarkregister: een meetbare verbetering op een probleem dat al decennialang openstaat, met onafhankelijke verificatie en formeel bewijs, illustreert hoe Anthropic zijn onderzoeksmodellen tegenwoordig test op fundamentele wiskundeproblemen in plaats van op klassieke software-engineeringtaken.

We asked an unreleased research version of Claude to take a stab at the Riemann hypothesis. It didn’t solve it, but it did make strides on a related problem: it increased the lower bound for the fraction of zeros of the Riemann zeta function that satisfy the hypothesis from 41.6% to 67.2%.

🇳🇱 We vroegen een niet-gepubliceerde onderzoeksversie van Claude om zijn kans te wagen op de hypothese van Riemann. Het heeft het probleem niet opgelost, maar wel vooruitgang geboekt op een verwant probleem: het heeft de ondergrens verhoogd van het aandeel nulpunten van de Riemann-zètafunctie die aan de hypothese voldoen van 41,6 % naar 67,2 %.@AnthropicAI op X

🔗 Volledige methodologische details op de onderzoeksblog van Anthropic


Anthropic: prijsstelling en veiligheid

Het lanceertarief van Sonnet 5 wordt permanent

Anthropic bevestigt dat het lanceertarief van Claude Sonnet 5 — $2 per miljoen inputtokens, $10 per miljoen outputtokens — permanent wordt. Het model werd in juni gelanceerd met dit tarief als promotie, geldig tot 31 augustus 2026. Anthropic neemt zo de onzekerheid weg die hing boven teams die hun kostenramingen rond deze lanceringsprijs hadden opgebouwd: er is geen prijsverhoging voorzien voor het nieuwe schooljaar op dit model, wat zijn prijspositie tegenover de concurrentie bij tokenintensief gebruik verstevigt.

🔗 Aankondiging

Prompt-injectie volgens Anthropic « grotendeels opgelost »

Boris Cherny, productverantwoordelijke voor Claude Code bij Anthropic, stelt dat prompt-injectie — de meest voorkomende aanvalsmethode tegen AI-gebruikers en -agenten, waarbij een kwaadaardige site of document een verborgen instructie doorsmokkelt die door het model wordt uitgevoerd — nu in de praktijk grotendeels opgelost is met Claude-modellen. Hij verduidelijkt dat deze vooruitgang voornamelijk voortkomt uit modeltraining, aangevuld met meerdere overlappende veiligheidsclassificatoren: de combinatie model + detector (probe) + automodus zou het succespercentage van aanvallen terugbrengen tot 0 %, een regeling die op 14 augustus de standaard toestemmingsmodus van Claude Code wordt. Het gaat om een openbare verklaring op X, niet om een formele onderzoekspublicatie met gedetailleerde methodologie.

🔗 Tweet


Ontwikkelaarstools: Amp schakelt over naar OpenAI, Copilot Chat verbetert

Amp verandert zijn modusroute naar OpenAI als een ChatGPT-abonnement is gekoppeld

De agentische codetool Amp wijzigt de routeringslogica van zijn modi (« the Dial ») wanneer een account is gekoppeld aan een ChatGPT-abonnement. Met een gekoppeld abonnement schakelen de low-, medium- en high-modi over op OpenAI-modellen (GPT-5.6 Terra voor low en code review, GPT-5.6 Sol voor de agent en de oracle in high-modus) in plaats van GLM-5.2 of Claude Fable. Zonder gekoppeld abonnement verandert er niets. Amp rechtvaardigt het loslaten van Claude Fable als oraclemodelel met een convergentie van de prestaties van grensmodellen: medeoprichter @sqs acht het onwaarschijnlijk dat een toekomstige test het prijsverschil van 80x tussen Fable en de gebruikte OpenAI-modellen zou rechtvaardigen. De Ultra-modus is niet betrokken en blijft draaien op Claude Fable.

🔗 We changed the Dial

Copilot Chat op github.com: verbeterde gespreksbediening

GitHub werkt Copilot Chat op github.com bij met drie verbeteringen, algemeen beschikbaar voor alle abonnementen. Toegang tot recente gesprekken wordt eenvoudiger, het chatvenster kan nu worden geminimaliseerd terwijl een antwoord wordt gegenereerd en daarna weer worden geopend om het gesprek te hervatten, en een indicator voor tokenverbruik verschijnt rechtstreeks in de chat — met detail per sessie en per bericht. Deze aanpassingen blijven ergonomische verbeteringen in plaats van een grote functionaliteit, maar spelen wel in op concreet dagelijks gebruik voor accounts met beperkte Copilot-quotas.

🔗 Copilot op web breidt gespreksbediening uit


Open-source-ecosysteem en inferentie

NVIDIA publiceert Magpie TTS Multilingual, open TTS voor spraakagenten in 12 talen

NVIDIA publiceert Magpie TTS Multilingual, een model voor spraaksynthese met open gewichten van ongeveer 357 miljoen parameters, onder de NVIDIA Open Model License, dat twaalf talen dekt (waaronder Frans) met telkens zowel een mannelijke als vrouwelijke stem. De latency tot het eerste geluid bedraagt 32 ms in single-stream op een B200-GPU (239 ms met 64 gelijktijdige streams), 47 ms op H100 en 79 ms op A100, met een real-timefactor tot 320x. Ook het karakterfoutpercentage daalt: van 2,70 % naar 1,54 % voor Frans, van 1,14 % naar 0,60 % voor Spaans. Implementatie is mogelijk via de open gewichten op Hugging Face of via NVIDIA NIM in productie.

🔗 Bouw meertalige spraakagenten met lage latency

Een distillatietechniek vermindert de benodigde GPU-geheugen tot 15x

Multiverse Computing publiceert een kennisdistillatietechniek die offline caching van teacher-logits combineert met een samengevoegde KL-lossfunctie die voorkomt dat de volledige vocabulaire × sequentielengtematrix hoeft te worden gematerialiseerd. Resultaat: het GPU-geheugen daalt van 85,2 GB naar 5,45 GB bij een context van 32K tokens (tot 15,6x minder), en de distillatie van een GPT-OSS 20B-model ging van vier GPU-nodes naar één, met een iteratietijd die ongeveer 5x lager lag. Toegepast op GPT-OSS 120B en Kimi-K3 (2,8T parameters) behoudt de techniek ongeveer 90 % van de nauwkeurigheid van de leraar op BoolQ en HellaSwag. De code is open source gepubliceerd op GitHub.

🔗 Kennisdistillatie goedkoop genoeg maken om op schaal te draaien

DeepSeek-V4-Flash beschikbaar in de cloud van Ollama via Together AI

Together AI levert nu de inferentie-infrastructuur achter DeepSeek-V4-Flash op de cloud van Ollama, gepresenteerd als de best presterende beschikbare hosting voor dit model met open gewichten. Het aanbod benadrukt een zero data retention-beleid en hosting in de Verenigde Staten en de Europese Unie — een soevereiniteitsargument voor bedrijven die DeepSeek-V4-Flash willen gebruiken zonder afhankelijk te zijn van een Chinese infrastructuur. Dit is een nieuw distributiekanaal dat bovenop de reeds bestaande beschikbaarheid van DeepSeek-V4-Flash rechtstreeks op Together AI komt.

🔗 Tweet

Sakana AI traint zijn Fugu-orchestrator op een Gemma 4-basis

Sakana AI publiceert een nieuwe versie van het chef-orchestrator-model van zijn multi-agent-orchestratieproduct Fugu, deze keer getraind op basis van het open model Gemma 4, als aanvulling op de reeds aangeboden verwisselbare modellenset. De tweelaagse architectuur — een klein chef-orchestrator-model dat taken verdeelt, en een modellenset die de daadwerkelijke verwerking uitvoert — is gebaseerd op het Trinity- en Conductor-onderzoek dat op ICLR 2026 werd gepresenteerd. Interne evaluaties tonen een orchestration-prestatie gelijk aan de vorige versie, met lagere kosten. Sakana AI mikt ook op termijn op eigen chef-orchestrator-modellen om te voldoen aan de eisen rond digitale soevereiniteit in Japan.

🔗 Fugu × Gemma 4

Together AI licht zijn partnerschap met Cursor toe voor real-time inferentie

Together AI publiceert een artikel mede geschreven met Cursor waarin hun partnerschap voor inferentie-infrastructuur wordt uiteengezet: agents geïntegreerd in de editor genereren code terwijl ontwikkelaars actief hun bestand bewerken, wat strikte latency-eisen oplegt — het modelantwoord moet in de feedbacklus van de editor passen zonder de workflow te verstoren. Het artikel laat zien hoe Together AI zijn infrastructuur heeft opgebouwd om deze doelstellingen op schaal te halen, een concreet gebruiksgeval van zijn dedicated inferentieaanbod voor AI-ondersteunde ontwikkelingstools.

🔗 Tweet


Generatieve media: ElevenLabs bij Deutsche Telekom, MiniMax licht H3 toe

ElevenLabs rolt zijn AI-stemtechnologie uit bij Deutsche Telekom

ElevenLabs kondigt een partnerschap aan met Deutsche Telekom, de grootste telecomoperator van Europa, om zijn AI-stemtechnologie op drie niveaus te integreren: het contactcenter, de consumentenapp en het netwerk zelf. De AI-oproepassistent draait op ElevenLabs en is rechtstreeks geïntegreerd in het netwerk, waardoor hij beschikbaar is op elk mobiel apparaat dat een oproep kan plaatsen, zonder speciale app — met live-assistentie tijdens gesprekken, realtimevertaling en transcriptie/samenvatting van gesprekken. Het partnerschap begon begin 2025 als een set app-functies en evolueerde naar een integratie in het hart van de diensten van Deutsche Telekom, met een geplande uitbreiding.

🔗 Tweet

MiniMax licht de open-source-roadmap voor H3 toe

Na een AMA-sessie op Reddit publiceert MiniMax een samenvatting van de open-source-roadmap voor zijn videomodel H3. Een overstap naar de Apache-2.0-licentie staat “op tafel” zodra de auteursrechtkwesties zijn opgehelderd, met een volledig technisch rapport in aantocht. MiniMax is ook van plan de gewichten van H3-Regenerate-2K open te stellen, een latent-ruimte-regeneratiemodel waarmee een 768p-resultaat opnieuw kan worden verwerkt naar 2K, een implementatie van sparse attention, een lage-latentievariant 4-NFE/8-NFE die wordt onderzocht, en een uniform beeldgeneratie-/bewerkingsmodel afgeleid van de H3-lijn. De Ref2VA-workflow laat al toe clips aan elkaar te koppelen om video’s van 60 seconden te produceren.

🔗 Tweet


Multimodale agents en IA-native finance

Qwen-MM-Plugins: multimodale agents native maken

AlibabaQwen kondigt Qwen-MM-Plugins aan, een familie plugins die bedoeld is om elke uitvoeringsomgeving voor agents (_agent harness) multimodaal-native te maken: het lezen van afbeeldingen, video’s en documenten, videobewerking en werken met 3D/CAD-bestanden. Het idee: in plaats van een op zichzelf staand multimodaal model wordt er een pluginlaag toegevoegd bovenop de omgeving die de ontwikkelaar al gebruikt. De aankondiging noemt geen benchmarks, geen prijsstelling en geen precieze beschikbaarheidsdatum — het blijft bij een productteaser, met een bijbehorende videodemonstratie. Deze lancering zet de Qwen-strategie van 2026 voort, die de aanbieding nu uitbreidt naar multimodale agentische tooling in plaats van naar nieuwe ruwe modelgewichten.

🔗 Tweet

Vijf lessen voor het opbouwen van een IA-native financefunctie

De CFO van OpenAI, Sarah Friar, deelt vijf lessen voor het opbouwen van een IA-native financefunctie, rond twee ambities: een closing op dag nul (een realtime, gereconcilieerde en traceerbare weergave van de bedrijfsfinanciën) en continue forecasting. Tot de lessen behoren: toegang aan iedereen geven en daarna een reden creëren om die te gebruiken — geïllustreerd door een finance-hackathon waaruit IR-GPT ontstond, een aangepaste GPT om due-diligencevragen van investeerders te beantwoorden; experimenten van onderop combineren met een top-downstrategie; statische spreadsheets achter zich laten ten gunste van levende tools die steunen op de volledige bedrijfscontext; duidelijke verantwoordelijkheid in elke workflow opbouwen; en het rendement op investering van AI meten.

🔗 Building an AI-native finance function

Premium seats komen naar ChatGPT Business

OpenAI lanceert Premium-seats voor ChatGPT Business, waarmee de meest actieve medewerkers 5 keer zoveel gebruik krijgen als Standard-seats en geen gebruikslimiet van vijf uur hebben.

Type seatMaandtariefJaarlijks tarief (omgerekend per maand)
Standard$25/gebruiker$20/gebruiker
Premium$125/gebruiker$100/gebruiker

Bedrijven kunnen Standard- en Premium-seats combineren binnen één werkruimte. Lanceringaanbieding: werkruimte-eigenaars die zich voor 20 augustus 2026 aanmelden, ontvangen $100 aan tegoed per toegevoegde Premium-seat (tot $500 voor vijf seats), met mogelijke vroege toegang vóór algemene beschikbaarheid.

🔗 Premium seats for ChatGPT Business


Kort nieuws

  • Claude Code — verbeteringen in CPU- en geheugengebruik: het team meldt belangrijke verbeteringen in CPU-gebruik en geheugen op het 99e percentiel (P99 RSS) in de afgelopen maanden, zonder vrijgegeven exacte cijfers. 🔗 Tweet
  • De CEO van Replit beschrijft de “self-driving company” in Platformer: Amjad Masad licht zijn visie toe op een bedrijf aangestuurd door een interne bot en agents die de applicaties gebruiken in plaats van mensen. 🔗 Tweet
  • Sakana AI breidt zijn RSI Lab uit naar fysieke AI: het bedrijf wil wereldmodellen bouwen voor fysieke AI en werft voltijds en voor stages in Tokio. 🔗 Tweet
  • FC Bayern München werkt samen met Google Pixel en Gemini: partnerschap aangekondigd zonder details over de exacte aard ervan (sponsoring, productintegratie). 🔗 Tweet
  • Gemini, tips voor een bezoek aan Amerikaanse landbouwbeurzen: lifestyleartikel van de Google-blog met vijf bestaande toepassingen van Gemini (routes, Ask Maps, AI Mode, Gemini Live, fotobewerking), zonder nieuwe functie. 🔗 Google Blog
  • GitHub-facturatie in India: klanten kunnen nu automatische terugkerende betaling per opgeslagen kaart activeren, via een elektronische machtiging die voldoet aan de Reserve Bank of India. 🔗 Changelog
  • GitHub veroudert aangepaste abonnementen per discussie-thread: alleen de staten Subscribed/Not subscribed blijven beschikbaar, terwijl bestaande aangepaste abonnementen automatisch overschakelen naar Subscribed. 🔗 Changelog
  • NVIDIA optimaliseert vLLM voor Qwen 3.5 op GB200: de optimalisaties halen 25.000 tokens per seconde per GPU, in aanloop naar de lancering van Qwen 3.8. 🔗 Tweet
  • Codex Build Week — projecten en winnaars volgen nog: OpenAI meldt dat deelnemers hun ideeën hebben omgezet in echte projecten met Codex; de aankondiging van de winnaars volgt nog. 🔗 Tweet
  • Brief van OpenAI aan de gouverneur van Texas: het bedrijf licht zijn engagement toe voor een verantwoorde ontwikkeling van AI-infrastructuren in de staat. 🔗 OpenAI
  • Model ML versnelt financewerk met GPT-5.6 Sol: het kantoor automatiseert het maken van traceerbare PowerPoint-decks en Excel-werkboeken, met 36% minder tokens dan Opus 5 op een Excel-workflow. 🔗 OpenAI

Wat dit betekent

De race om open gewichten versnelt en wordt diverser: Meta (Muse Glimmer), Alibaba (Qwen-MM-Plugins), MiniMax (H3-roadmap) en Sakana AI (Fugu op Gemma 4) publiceren allemaal in dezelfde week herbruikbare bouwstenen in plaats van enkel gesloten modellen. De trend gaat verder dan alleen tekst: NVIDIA opent een meertalige TTS met 357 miljoen parameters, en Sakana AI rechtvaardigt zijn keuze expliciet met digitale soevereiniteit — een argument dat ook terugkomt bij Together AI voor het hosten van DeepSeek-V4-Flash in de EU en de Verenigde Staten.

AI-veiligheid verschuift van het lab naar concrete productie. OpenAI’s GPT-5.6-Cyber blijft niet steken bij een benchmarkscores: het heeft een echte CVE in V8 laten repareren en honderden andere kwetsbaarheden, terwijl het ook gepaard gaat met een aangescherpt toegangsregime (hardware keys verplicht vanaf september). Daartegenover stelt Anthropic dat het promptinjectie aan defensiekant heeft geneutraliseerd dankzij een stapeling van model + classifiers — twee complementaire benaderingen (aanval met tooling enerzijds, geharde verdediging anderzijds) die laten zien dat beveiliging een volwaardige productdifferentiator wordt en niet langer een bijzaak.

Aan infrastructuurzijde blijft de economie van inferentie onder druk staan: de distillatietechniek van Multiverse Computing deelt het benodigde GPU-geheugen door 15, Together AI versterkt zijn samenwerking met Cursor om strikte latency-eisen voor code-editing te halen, en Anthropic stabiliseert de prijs van Sonnet 5 duurzaam. Samen genomen wijzen deze bewegingen op aanhoudende druk op inferentiekosten naarmate agentische en interactieve toepassingen gemeengoed worden.

Ten slotte nestelt AI zich net zo goed in de supportfuncties van bedrijven als in fundamenteel onderzoek. OpenAI documenteert hoe zijn eigen finance IA-native wordt en lanceert ChatGPT Business-seats met verhoogde capaciteit, terwijl Model ML concrete tokenwinst rapporteert op Excel-workflows. Aan de andere kant van het spectrum herinnert het resultaat van Claude over de Riemann-vermoeden — formeel geverifieerd en nagelezen door externe wiskundigen — eraan dat dezelfde modellen ook worden ingezet op fundamentele onderzoeksproblemen, ver weg van product-use cases.


Bronnen