ai-powered-markdown-translatorArtikel vertaald van fr naar nl met gpt-5.4-mini.
MiniMax lanceert H3, een generalistisch multimodaal model met native stereogeluid en aangekondigde open weights « binnen de komende dagen ». Together AI claimt een spectaculaire groei van zijn volume aan aangeboden tokens, terwijl GitHub de beveiliging van npm-tokens aanscherpt na een golf van accountovernames. Rond deze drie onderwerpen is de dag bijzonder druk op het vlak van beeld- en videogeneratie (Runway, Wan Video, Luma, Black Forest Labs, Ideogram), tooling voor code-agents (Devin, Replit, GitHub Actions) en modelovergangen bij OpenAI en Google.
MiniMax H3 : een generalistisch multimodaal model, aangekondigde open weights
31 juli — MiniMax lanceert H3, beschreven als een generalistisch multimodaal generatiemodel. In tegenstelling tot eerdere generaties (Hailuo 01 en 02), die taken per gespecialiseerd model opsplitsten, verenigt H3 deze mogelijkheden in één model dat een context kan begrijpen waarin tekst, beeld, video en audio samenkomen. De meest in het oog springende eigenschap is native stereogeluid dat samen met de video wordt gegenereerd, op sequenties tot 15 seconden in 2K-resolutie.
MiniMax zet sterk in op een agressieve prijs-prestatieverhouding: in 2K zou de prijs per seconde lager liggen dan een derde van die van de « mainstream »-modellen, en in 768p lager dan de helft van de prijs van 720p bij diezelfde modellen. H3 steunt op meerdere eigen bouwstenen (Contextual Omni Representation, H3-VAE, H3-Omni Transformer, In-Context Regeneration) en ondersteunt bewerking op veralgemeende wijze: image-naar-image, image-naar-video, audio-naar-audio, video-naar-videomotiefoverdracht, met nauwkeurige weergave van tekst en merkelementen — een punt waarop videogeneratiemodellen vaak tekortschieten.
MiniMax kondigt ook aan dat de weights van het model binnenkort worden vrijgegeven, voorgesteld als een manier om hardwarecompatibiliteit te versnellen en de open-sourcegemeenschap te ondersteunen in een sector die historisch werd gedomineerd door gesloten modellen. De lancering gaat gepaard met een day-0-uitrol bij een vijftiental partners, waaronder Runway, Pika, Leonardo.Ai, OpenRouter en Krea.
| Kenmerk | Detail |
|---|---|
| Resolutie | 2K standaard |
| Maximale duur | 15 seconden |
| Audio | Native stereo, gezamenlijk gegenereerd |
| Prijs in 2K | Minder dan een derde van de prijs/seconde van mainstream-modellen |
| Prijs in 768p | Minder dan de helft van de prijs van 720p mainstream |
| Open weights | Aangekondigd « binnen de komende dagen » |
MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities — Today, we’re launching MiniMax H3, a general-purpose multimodal generation model. H3 understands unified context across text, images, video, and audio, generating video with native stereo sound, up to 15 seconds at 2K resolution.
🇳🇱 MiniMax H3 : een open model dat de grenzen tussen taken en modaliteiten uitwist — Vandaag lanceren we MiniMax H3, een generalistisch multimodaal generatiemodel. H3 begrijpt een verenigde context over tekst, afbeeldingen, video en audio heen en genereert video’s met native stereogeluid, tot 15 seconden in 2K-resolutie. — @MiniMax_AI op X
🔗 Vervolglink — @MiniMax_AI op X
Grok Imagine Video 1.5 beschikbaar op Runway
1 augustus — Runway blijft zijn catalogus van externe modellen uitbreiden door Grok Imagine Video 1.5 te integreren, de videoversie van xAI’s generatiemodel, rechtstreeks toegankelijk via zijn platform. De integratie past in de strategie van Runway om de frontier-modellen van verschillende uitgevers te bundelen — het had de dag ervoor al MiniMax H3 verwelkomd — binnen één creatief productieplatform, in plaats van uitsluitend op zijn eigen Gen-modellen te mikken.
🔗 Aankondiging — @runwayml op X
Wan Video (Alibaba) lanceert een Realtime-modus voor schets en tekst
31 juli — Alibaba heeft in de Labs-sectie van wan video een Realtime-modus online gezet waarmee een schets gaandeweg kan worden omgezet in een fotorealistische scène — draadfiguur, ruwe rechthoek, een paar streken — zonder expliciete generatiestap of knop « generate ». Op dezelfde dag presenteerde Alibaba een tweede Realtime-modus, ditmaal voor tekst: de afbeelding wordt live aangepast terwijl de gebruiker een beschrijving typt, zin na zin, zonder laadschermafbeelding. Deze twee functies brengen de ervaring van beeldgeneratie dichter bij een continue interactie zoals tekenen of tekstverwerking, in plaats van een klassieke prompt/generatiecyclus.
🔗 Aankondiging — @Alibaba_Wan op X
Luma lanceert Layers, beeldbewerking per laag aangedreven door Uni-1
30 juli — Luma heeft Layers uitgerold binnen Luma Agents, aangedreven door zijn model Uni-1. Het principe: vraag de agent om de lagen van een bestaand beeld te extraheren (gegenereerd door Luma of geïmporteerd door de gebruiker), en wijzig daarna een specifiek element via eenvoudige conversatie, terwijl de rest van het beeld intact blijft — of dat nu het uitgelichte product, de achtergrond of een tekst is. Luma illustreert de functie met twee voorbeelden: het volledig herontwerpen van een rebrandingposter op basis van een eenvoudige vlakke JPG, en het toevoegen van een geïsoleerd object in een scène zonder de belichting of het decor aan te passen. Het doel is gerichte, iteratieve correcties mogelijk te maken, in plaats van een volledig beeld opnieuw te genereren om één detail te wijzigen.
🔗 Aankondiging — @LumaLabsAI op X
Black Forest Labs onthult een voorproefje van FLUX 3
30 juli — Black Forest Labs (BFL), de uitgever van de FLUX-modellen, heeft via een tijdelijke toegang van 48 uur op de Hermes-agent van Nous Research een eerste publieke voorproef van zijn volgende model, FLUX 3, gegeven. Deze agent ketent meerdere gegenereerde plannen aan elkaar om een volledige korte film te produceren vanuit één enkele prompt van begin tot eind. De aankondiging gaat gepaard met een kortfilmwedstrijd die Nous Research de hele week organiseert, en met een persoonlijke presentatie van FLUX 3 tijdens een BFL-evenement in San Francisco de daaropvolgende vrijdag. BFL heeft tot nu toe noch een algemene beschikbaarheidsdatum, noch technische details over de mogelijkheden van het model gecommuniceerd.
Ideogram lanceert P-Image-Ideogram, Pareto-optimale modelfamilie met Pruna AI
30 juli — Ideogram heeft, in samenwerking met Pruna AI, een nieuwe familie beeldmodellen gelanceerd onder de naam P-Image-Ideogram, tegelijk geoptimaliseerd op kwaliteit, snelheid en kostprijs. Het model biedt vier kwaliteitsmodi (Very low, Low, Medium, High), native generatie in 1K en 2K, en een instaptarief van 0,003 dollar per afbeelding, met een aangekondigde latentie tussen 3 en 8 seconden afhankelijk van de modus. Op de ranglijst van Design Arena (blinde menselijke stemmen) claimt Ideogram een nieuwe Pareto-grens van voorkeur/kost en voorkeur/snelheid: in 1K kost de meest economische modus 0,3 ¢/afbeelding voor een generatie van ongeveer 3 seconden, dus ongeveer 8,6 keer sneller dan het gemiddelde van de beoordeelde modellen. Directe uitrol op een vijftiental partnerplatforms, waaronder ComfyUI, Runware, Replicate, Leonardo.Ai en Together AI.
| Kwaliteitsmodus | Resolutie | Prijs in 1K | Geschatte latentie |
|---|---|---|---|
| Very low | 1K/2K native | 0,3 ¢/afbeelding | ~3 s |
| Low | 1K/2K native | 0,75 ¢/afbeelding | ~3 s |
| Medium | 1K/2K native | niet gespecificeerd | tot 8 s |
| High | 1K/2K native | niet gespecificeerd | tot 8 s |
🔗 Aankondiging — @ideogram_ai op X
Devin lanceert Outposts, native uitvoering van applicaties op elke computer
31 juli — Cognition, de uitgever van Devin, heeft een nieuwe functie aangekondigd genaamd Outposts. Die laat de Devin-agent applicaties rechtstreeks en native uitvoeren en testen op elke computer, in plaats van uitsluitend te vertrouwen op geïsoleerde cloudomgevingen. Deze mogelijkheid sluit aan op de recente aankondigingen van Cognition over native uitvoering — native iOS-ondersteuning via macOS-cloudagents, aangekondigd de dag ervoor — en heeft als doel het bereik uit te breiden van de taken die Devin end-to-end kan overnemen, ook op hardware- of softwareconfiguraties die specifiek zijn voor het apparaat van de gebruiker.
🔗 Aankondiging — @cognition op X
Replit rolt Model Selector, Follow-up Tasks en een nieuwe gebruikspagina uit
31 juli — In zijn wekelijkse samenvatting « This Week in Replit » licht Replit meerdere nieuwigheden toe. De Model Selector is voortaan beschikbaar voor Core- en Pro-abonnementen, met een uitgebreidere keuze inclusief open-weightsmodellen naast de propriëtaire modellen — de gebruiker behoudt de controle, of laat Replit automatisch aanbevelen. Follow-up Tasks gaat deze week live voor alle gebruikers: nadat een taak is voltooid, stelt de Agent volgende stappen voor die met één klik kunnen worden geactiveerd en op de achtergrond worden uitgevoerd. Twee aanpassingen maken de week compleet: een herbouwde gebruikspagina met bijna realtime opvolging per datum, bron, project, workspace, groep en gebruiker, en een verlengde gebruikerssessie (standaard afmelding van 7 naar 14 dagen).
| Functionaliteit | Status |
|---|---|
| Model Selector | Online, Core- en Pro-abonnementen, open modellen inbegrepen |
| Follow-up Tasks | Uitgerold naar alle gebruikers |
| Gebruikspagina | Herbouwd, bijna realtime opvolging |
| Sessieduur | Verlengd van 7 naar 14 dagen |
Together AI : opschaling van open inferentie
Together AI verspreidt deze week meerdere aankondigingen rond dedicated inferentie, vanuit twee verschillende invalshoeken: een spectaculair groeicijfer aan gebruikszijde, en een gedetailleerd technisch artikel over autoscaling van de onderliggende infrastructuur.
Een groei van meer dan 10.000x in aangeboden tokens
1 augustus — Together AI toont een opvallend groeicijfer: het volume aan aangeboden tokens zou zijn gestegen van 30 miljard per maand naar 400.000 miljard (400 biljoen) per maand, dus meer dan 10.000 keer zoveel. Het bedrijf verklaart deze vooruitgang door de migratie van grootschalige workloads naar open-weightsmodellen in plaats van naar gesloten propriëtaire API’s. Het cijfer wordt gepresenteerd zonder precieze referentieperiode, wat de vergelijkende waarde beperkt.
Josh had to stop @vipulved and ask him to repeat the number: @wolfejosh Together AI went from serving 30B tokens a month to 400T. Over 10,000x growth as AI-native companies and enterprises move scaled workloads to open model.
🇳🇱 Josh moest @vipulved onderbreken en hem vragen het cijfer te herhalen: Together AI is gestegen van 30 miljard tokens per maand naar 400.000 miljard. Een groei van meer dan 10.000 keer, gedreven door de migratie van AI-native bedrijven en grote accounts naar open modellen voor hun grootschalige workloads. — @togethercompute op X
Acht metrics om autoscaling van dedicated inferentie aan te sturen
31 juli — Together AI publiceert een technisch artikel over de autoscaling van zijn Dedicated Model Inference. Het uitgangspunt: klassieke metrics uit de webwereld (CPU/GPU-gebruik) weerspiegelen niet de echte druk op een LLM-inferentie-engine — een GPU kan 60% gebruik tonen terwijl de wachtrij al verzadigd is, omdat gebruik de rekenintensiteit meet en niet de wachtdruk. Het artikel beschrijft acht native inferentiemetrics, gegroepeerd in drie families (concurrency, SLO, efficiency), en beveelt inflight_requests aan als standaardmetric. Het kwantificeert ook de werkelijke kost van een cold start op een H100-GPU: ongeveer 86 seconden voor een basismodel, 145 seconden voor een fine-tune van 18 GB, en ongeveer 2,5 minuten om een replica toe te voegen.
| Gemeten stap | Duur op 1×H100 |
|---|---|
| Implementatie basismodel | 86 s |
| Implementatie fine-tune (18 GB) | 145 s |
| Opschalen van 1 naar 2 replica’s | ~2,5 min |
Ai2 — een studie op basis van infini-gram traceert geleende taal in door AI geschreven boeken
31 juli — Ai2 (Allen Institute for AI) zet een studie in de kijker die is opgebouwd rond zijn infini-gram-engine, een tool die enorme tekstcorpora indexeert en de exacte frequentie telt waarmee om het even welke zin voorkomt, waardoor kan worden teruggegaan naar de waarschijnlijke bronnen van een formulering. Het team van Tuhin Chakrabarty (Stony Brook University) isoleerde « zeldzame uitdrukkingen » — wendingen die in maximaal vijf Google Books-boeken voorkomen en afwezig zijn van het geïndexeerde web — en vergeleek hun aanwezigheidsgraad tussen zelfgepubliceerde boeken met sterk gedetecteerde AI-inhoud, zelfgepubliceerde boeken zonder gedetecteerde AI, en bekroonde literatuur. Resultaat: boeken met veel AI-inhoud vertonen een duidelijk hoger aandeel zeldzame uitdrukkingen, wat wijst op een sterkere afhankelijkheid van patronen uit trainingsdata.
| Beoordeelde groep | Dekking in zeldzame uitdrukkingen |
|---|---|
| Top 200 zelfgepubliceerd, sterk AI-gedetecteerd | 41,6 % |
| Top 200 zelfgepubliceerd, geen AI gedetecteerd | 37,2 % |
| Bekroonde of genomineerde literatuur (referentie) | 19,1 % |
Gemini 3.5 Flash Cyber, een model voor cybersicherheit met beperkte toegang
31 juli — Google heeft stilletjes een nieuw lid aan zijn Flash-modelfamilie toegevoegd: Gemini 3.5 Flash Cyber. In tegenstelling tot de publiek aangekondigde versies van deze maand (3.6 Flash, 3.5 Flash-Lite), richt dit model zich op een zeer specifiek gebruik — het op grote schaal detecteren en corrigeren van softwarekwetsbaarheden — en blijft het een economisch model dat voor enkel die use case is geoptimaliseerd. De toegang is bewust beperkt tot overheden en vertrouwde partners, wat het eerder tot een defensieve cyberbeveiligingstool maakt dan tot een commercieel product dat voor iedereen openstaat. Geen aparte productpagina, geen benchmark en geen architectuurdetails vergezellen deze aankondiging: de enige beschikbare bron is een tweewekelijkse samenvattingsdraad van @GoogleAI, wat de diepgang beperkt van wat er op dit moment over te zeggen valt.
Dezelfde samenvattingsdraad kondigt bovendien Collections aan in Gemini Notebook (voorheen NotebookLM), een nieuwe manier om notebooks te groeperen. Ook hier slechts één zin, zonder bijhorende schermafbeelding of documentatie.
🔗 Samenvattingsdraad — @GoogleAI op X
Copilot deprecieert Gemini 2.5 Pro en Gemini 3 Flash
31 juli — GitHub haalt Gemini 2.5 Pro en Gemini 3 Flash uit al zijn Copilot-ervaringen (Chat, inline bewerkingen, ask- en agent-modi, code-completies), zonder dat gebruikers iets hoeven te doen — de modellen verdwijnen automatisch uit de selectielijsten. Gebruikers wordt aangeraden over te stappen op Gemini 3.1 Pro (Preview) en Gemini 3.6 Flash. Aan de beheerkant moeten Enterprise-organisaties controleren of hun modelbeleid deze vervangers toestaat voordat hun teams ze terugzien in de Copilot Chat-kiezer op VS Code en github.com. Deze deprecatie illustreert het snelle rotatieritme van de modellen die in Copilot worden aangeboden, waarbij Gemini-versies van de vorige generatie plaatsmaken voor de nieuwste iteraties van Google.
npm beperkt GAT-tokens voor het omzeilen van 2FA
31 juli — GitHub beperkt wat npm-granulaire toegangstokens (GAT) kunnen doen wanneer ze zijn geconfigureerd om dubbele authenticatie (2FA) te omzeilen. Tot nu toe kon een gelekt token van dit type worden gebruikt om volledige controle over een account over te nemen: andere tokens aanmaken, een maintainer toevoegen, toegangsrechten tot een pakket wijzigen. Voortaan vereisen deze gevoelige handelingen een interactieve 2FA-uitdaging, zelfs voor een token dat normaal van 2FA is vrijgesteld. De maatregel geldt onmiddellijk; een tweede stap staat gepland voor januari 2027, wanneer deze tokens ook hun mogelijkheid verliezen om rechtstreeks pakketten te publiceren, wat automatiseringsteams richting trusted publishing (op basis van OIDC) duwt. Alleen npm-tokens zijn betrokken — de klassieke GitHub-tokens (PAT, GitHub App, Actions) blijven zonder wijziging werken. Het is een directe reactie op de golf van aanvallen via overname van npm-pakketten die de afgelopen maanden in het open-source-ecosysteem is waargenomen.
Self-repository-syntaxis om acties in GitHub Actions te verwijzen
30 juli — GitHub Actions introduceert een nieuwe syntaxis, $/, om te verwijzen naar een actie of herbruikbare workflow die zich in dezelfde repository bevindt als de aanroepende workflow. Tot nu toe vereiste dit soort interne verwijzing ofwel ./ in combinatie met een expliciete checkout-stap, ofwel een versie hard vastzetten. Met $/ wijst de verwijzing automatisch naar de exacte commit die wordt uitgevoerd, zonder extra checkout-stap, en werkt overal waar ./ werd gebruikt: workflowstappen, samengestelde acties, geneste samenstelling en aanroepen van herbruikbare workflows. Deze nieuwigheid vereist een runner in versie 2.336.0 of nieuwer. Het belangrijkste voordeel: organisaties kunnen beleid afdwingen dat vereist dat acties worden vastgepind op volledige commit-SHA’s, terwijl interne verwijzingen automatisch gesynchroniseerd blijven met de ref die wordt uitgevoerd.
OpenAI verwijdert GPT-5.4 en GPT-5.4 mini uit ChatGPT per 31 augustus
31 juli — OpenAI heeft aangekondigd dat GPT-5.4 en GPT-5.4 mini uit de ChatGPT-interface voor gebruikers die zijn ingelogd met een account worden verwijderd, met ingang van 31 augustus. Beide modellen blijven echter toegankelijk via de OpenAI API en in Codex-sessies die met een API-sleutel zijn geauthenticeerd — een onderscheid dat dus wel de gebruikers van de ChatGPT-app/web treft, maar niet de ontwikkelaars die via de API of Codex met API-sleutel werken. Deze aankondiging past binnen de tariefupdate GPT-5.6 (Luna/Terra) van eind juli, die de overstap van het ChatGPT-assortiment naar de nieuwste modellen versnelt.
🔗 Aankondiging — @OpenAIDevs op X
ImageGen in Codex CLI: nieuwe lightbox en canvas
30 juli — OpenAI Devs heeft de in Codex CLI geïntegreerde ImageGen-functie bijgewerkt met een nieuwe lightbox-achtige interface en een toegewijd canvas. Deze evolutie is bedoeld om het verkennen en verfijnen van afbeeldingen die rechtstreeks in de Codex-workflow worden gegenereerd te vereenvoudigen, zonder van context te veranderen. Het gaat om een verbetering van de gebruikservaring in plaats van om een nieuw model, maar het raakt direct de CLI-tool die bij OpenAI prioriteit krijgt.
🔗 Aankondiging — @OpenAIDevs op X
Kort nieuws
- Amp — orbs 20 % sneller opgestart, Puck-assistent overgezet naar GPT-5.6 Sol — Amp meldt een ongeveer 20 % snellere start van orbs (externe machines) en zet zijn Puck-assistent over op GPT-5.6 Sol na zeer kritische gebruikersfeedback. 🔗 bron
- Hugging Face rolt gratis publiek endpoint uit voor DeepSeek-V4-Flash-0731 — Een medewerker van Hugging Face zet op de dag van release een gratis endpoint zonder token online, OpenAI-compatibel, om het model te testen. 🔗 bron
- Sakana AI — 5e plaats op de OSINT Diver 2026 CTF — Een defensie-/inlichtingenteam van Sakana AI, dat een op Fugu-ultra 1.1 gebaseerde OSINT-agent gebruikt, eindigt als 5e van meer dan 850 deelnemende teams. 🔗 bron
- Kimi K3 op Together AI — laagste prijs en beste cache-hitrate volgens OpenRouter — Gegevens uit het dashboard van OpenRouter tonen aan dat Together AI een van de laagste tarieven voor Kimi K3 biedt, met een van de beste cache-succespercentages voor prompts. 🔗 bron
- Een open videomodel (Marlin-2B) maakt 370 uur aan openbare archieven doorzoekbaar voor ongeveer 10 dollar — Een communitylid indexeert 1.864 films uit de Prelinger Archives met Marlin-2B op Hugging Face Jobs, goed voor 23.148 doorzoekbare momenten. 🔗 bron
- GitHub peilt naar het gebruik van toegankelijkheidstools door ontwikkelaars — Open enquête tot 31 augustus 2026 onder ontwikkelaars met een beperking over hun gebruik van toegankelijkheidstechnologieën. 🔗 bron
- Seedance 2.5 ook aangekondigd op Luma — Luma plaagt de aanstaande komst van Seedance 2.5 op zijn platform, zonder opgegeven datum. 🔗 bron
- Ideogram Object Remover beschikbaar op Runware — De tool voor objectverwijdering van Ideogram claimt de beste FID-score op de OmniEraser-benchmark, zonder prompt vereist. 🔗 bron
- SGLang voegt ondersteuning toe voor Inkling-Small op NVIDIA DGX Spark-cluster — Gemeten throughput van 24 tokens/seconde bij concurrency 1, op 2 DGX Spark-systemen verbonden via ConnectX-7. 🔗 bron
- ChatGPT-desktop — Activity-weergave en Voice-snelkoppeling via het dier-icoon — Nieuwe Activity-weergave die wachtende gesprekken en projectupdates samenbrengt, plus een snelkoppeling naar ChatGPT Voice. 🔗 bron
- Tien doorbraken in wiskunde en theoretische informatica — OpenAI deelt tien resultaten over open problemen in geometrie, cryptografie en complexiteit; gedetailleerde inhoud niet raadpleegbaar, bron geblokkeerd voor robots. 🔗 bron
- Vooruitgang boeken met verantwoorde AI in Europa — OpenAI presenteert zijn praktijken rond veiligheid, transparantie en herkomst ter ondersteuning van AI-governance in Europa in het licht van de AI Act; gedetailleerde inhoud niet raadpleegbaar, bron geblokkeerd. 🔗 bron
- Univé bouwt een AI-klare workforce met ChatGPT Enterprise — Casestudy van de Nederlandse verzekeraar Univé over de uitrol van ChatGPT Enterprise; gedetailleerde inhoud niet raadpleegbaar, bron geblokkeerd. 🔗 bron
- OpenAI zegt een in Cambodja gevestigd oplichtingsnetwerk te hebben ontmanteld — Gebruik van ChatGPT voor beleggingsfraude, romance scams, gokfraude en identiteitsfraude; gedetailleerde inhoud niet raadpleegbaar, bron geblokkeerd. 🔗 bron
- avatarin bouwt een 24/7 retail-agent met GPT-Realtime — Meertalige klantenondersteuning voor Yamada Denki: 30.000 gebruikers in twee weken, 92 % positieve beoordelingen volgens de officiële samenvatting; gedetailleerde inhoud niet raadpleegbaar, bron geblokkeerd. 🔗 bron
Wat dit betekent
Generatieve media versnellen hun race naar brede distributie en conversationele bewerking. MiniMax H3 neemt de leiding met een uniform tekst-/beeld-/video-/audio-model en open weights die “binnen de komende dagen” worden beloofd, en wordt dag 0 uitgerold bij een vijftiental partners. Diezelfde beweging zien we bij Ideogram (P-Image-Ideogram, vier kwaliteitsmodi en een prijs vanaf 0,003 dollar per afbeelding), Wan Video (Realtime-modus zonder “generate”-knop) en Luma (Layers, laag-voor-laag bewerking via gesprek): de toegevoegde waarde zit niet langer alleen in de ruwe kwaliteit van een model, maar in de iteratiesnelheid en multi-platformintegratie vanaf de lancering. Black Forest Labs kiest, met een preview van 48 uur van FLUX 3 die voorbehouden is aan een externe agent, voor de omgekeerde aanpak — gecontroleerde teaser in plaats van onmiddellijke algemene beschikbaarheid.
De inferentie van open modellen schaalt op, en het gebruik wordt net zo goed gedocumenteerd als de techniek. Together AI claimt in één maand een groei van meer dan 10.000 keer in het volume aan bediende tokens, gedragen door de migratie van bedrijven naar open modellen, en publiceert tegelijk een diepgaand technisch artikel over de beperkingen van klassieke autoscaling-metrieken voor LLM-inferentie. Daarnaast biedt de Ai2-studie die is opgebouwd op infini-gram een onverwacht licht op diezelfde golf van open modellen: op basis van zelfgepubliceerde boeken documenteert ze in hoeverre door AI gegenereerde teksten dicht blijven bij formuleringen die tijdens training zijn aangetroffen — een herinnering dat de schaalbaarheid van inferentie de fundamentele vragen over de originaliteit van geproduceerde inhoud niet wegneemt.
De tooling voor code-agenten en de beveiliging van de toeleveringsketen ontwikkelen zich parallel, maar niet altijd in dezelfde richting. Devin vergroot zijn uitvoeringsbereik naar eender welke computer met Outposts, Replit voegt steeds meer autonome functies toe (Follow-up Tasks, Model Selector) en GitHub Actions vereenvoudigt het verwijzen naar interne acties met de syntaxis $/. Tegelijkertijd verscherpt GitHub de beveiliging van npm door zelfs voor tokens die daarvoor zijn geconfigureerd een interactieve 2FA-uitdaging verplicht te stellen, als directe reactie op de golf van accountovernames die de afgelopen maanden is waargenomen — een signaal dat de groeiende automatisering van agents gepaard gaat met een parallelle verstrenging van toegangscontroles.
Twee spelers beperken de toegang tot bepaalde modellen, om verschillende redenen. OpenAI haalt GPT-5.4 en GPT-5.4 mini vanaf 31 augustus uit ChatGPT voor ingelogde gebruikers, terwijl ze via de API beschikbaar blijven — een verduidelijking van de productlijn eerder dan een zuivere verwijdering. Google reserveert op zijn beurt Gemini 3.5 Flash Cyber, een economisch model dat is gericht op het opsporen en corrigeren van softwarekwetsbaarheden, uitsluitend voor overheden en vertrouwde partners: een teken dat sommige labs nu expliciet onderscheid maken tussen modellen voor beperkt defensief gebruik en modellen voor het grote publiek.
Bronnen
- MiniMax — Aankondiging van H3 op X
- MiniMax — Aanvullende thread
- Runway — Grok Imagine Video 1.5
- Alibaba Wan — Realtime-modus
- Luma — Layers
- Black Forest Labs — FLUX 3-preview
- Ideogram — P-Image-Ideogram
- Cognition — Devin Outposts
- Replit — Deze week in Replit
- Together AI — Groei van bediende tokens
- Together AI — Dedicated inferentie-autoscaling
- Ai2 — infini-gram-studie over boeken
- GitHub — Deprecatie Gemini 2.5 Pro / Gemini 3 Flash
- GitHub — Beperking van npm 2FA-tokens
- GitHub — Self-repository-syntaxis
- OpenAI — Verwijdering GPT-5.4
- OpenAI — ImageGen in Codex CLI
- Amp — Orbs en Puck
- Hugging Face — DeepSeek-V4-Flash-0731-endpoint
- Sakana AI — OSINT Diver 2026 CTF
- Kimi K3 op Together AI
- Marlin-2B — Prelinger Archives
- GitHub — Toegankelijkheidsenquête
- Seedance 2.5 op Luma
- Ideogram Object Remover op Runware
- SGLang — Inkling-Small op DGX Spark
- ChatGPT-desktop — Activity-weergave
- OpenAI — Tien doorbraken in wiskunde
- OpenAI — Verantwoorde AI in Europa
- OpenAI — Univé
- OpenAI — Ontmanteling van oplichtingsnetwerk
- OpenAI — avatarin