Zoeken

Moonshot lanceert Kimi K3 (2,8T open), NVIDIA kondigt Open Secure AI Alliance aan, Perplexity verstevigt zijn enterprise-aanbod

Artikel gegenereerd door kunstmatige intelligentie
Moonshot lanceert Kimi K3 (2,8T open), NVIDIA kondigt Open Secure AI Alliance aan, Perplexity verstevigt zijn enterprise-aanbod

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

27 juli 2026 is een drukke dag, met drie afzonderlijke grote aankondigingen. Moonshot AI publiceert de gewichten en het technische rapport van Kimi K3, een open model met 2,8 biljoen parameters dat vanaf dag 0 wordt gehost door Together AI. NVIDIA bundelt diezelfde dag een dertigtal partners — van Adobe tot Microsoft, via Hugging Face en SpaceXAI — binnen de Open Secure AI Alliance, een coalitie voor open tools voor AI-beveiliging, in het kielzog van het al eerder besproken Hugging Face-beveiligingsincident. Perplexity publiceert op zijn beurt zijn eerste changelog in twee weken, een reeks van negen functies die sterk op enterprise zijn gericht. Rond deze drie onderwerpen cirkelen zeven opmerkelijke nieuwigheden — Cognizant en Anthropic, Cohere North Automations, de adoptie van Opus 5 door Zed — en vijf kleinere aankondigingen.


Kimi K3: Moonshot AI publiceert een open model met 2,8 biljoen parameters, vanaf dag 0 gehost door Together AI

27 juli, 17:14 — Moonshot AI publiceert de gewichten en het technische rapport van Kimi K3, door de uitgever voorgesteld als het eerste open model in de klasse van 3 000 miljard parameters — een formulering van Moonshot, die als zodanig moet worden genomen. Het gaat om een MoE-model (Mixture-of-Experts) met in totaal 2,8 biljoen parameters, waarvan er slechts 104 miljard per token worden geactiveerd, verdeeld over 93 lagen. Twee eigen architecturale nieuwigheden dragen het grootste deel van de beweerde winst: Kimi Delta Attention (KDA), gecombineerd met een mechanisme van attention residuals (Attention Residuals), en een uiterst spaarzame MoE (« Stable LatentMoE ») die per passage slechts 16 experts van de 896 activeert. Moonshot claimt ongeveer 2,5× winst in schaalop efficiënte uitvoering ten opzichte van Kimi K2 — « niet alleen meer parameters ». Het model integreert ook native visie (MoonViT-V2-encoder) en een contextvenster van een miljoen tokens.

Kimi K3 is onmiddellijk beschikbaar op Kimi.com, de mobiele app (iOS/Android/HarmonyOS), de desktopapp Kimi Work, de commandline-coderingsagent Kimi Code (selecteerbaar via /model) en de Kimi API (model kimi-k3, compatibel met OpenAI/Anthropic), aan het tarief van $0,30/MTok voor invoer met cache, $3,00/MTok zonder cache, en $15,00/MTok voor uitvoer. Together AI is vanaf dag 0 hostingpartner, en Hugging Face repost de aankondiging zonder aanvullende commentaar.

BenchmarkKimi K3Claude Fable 5Claude Opus 4.8GPT-5.5
SWE-Marathon42,035,040,0
MCPMark-Verified94,587,4
GPQA Diamond93,592,691,093,5

Moonshot erkent expliciet verschillende beperkingen: een sterke gevoeligheid voor de behouden redeneermodus (de volledige geschiedenis moet in de volgende beurten precies zo worden meegestuurd, anders dreigt instabiliteit), een neiging tot « buitensporige proactiviteit » bij lange en ambigue taken, en een gebruikerservaringskloof die door het laboratorium zelf als « opmerkelijk » wordt beschouwd tegenover Claude Fable 5 en GPT-5.6 Sol. Een implementatie van prefix caching die compatibel is met het nieuwe aandachtmechanisme is daarnaast aan de vLLM-gemeenschap bijgedragen, parallel aan het model.

“Releasing the model weights and technical report of Kimi K3. Kimi K3 is our most capable model: a 2.8T MoE model with native visual understanding and a 1M-token context window. New model architecture: 2.5x the intelligence per unit of compute, not just more params.”

🇳🇱 Wij publiceren de modelgewichten en het technische rapport van Kimi K3. Kimi K3 is ons krachtigste model: een MoE-model met 2,8 biljoen parameters, met native visueel begrip en een contextvenster van een miljoen tokens. Nieuwe architectuur: 2,5 keer meer intelligentie per rekeneenheid, niet alleen meer parameters.@Kimi_Moonshot op X

🔗 Modelgewichten — Hugging Face

🔗 Technisch rapport — GitHub


NVIDIA bundelt de Open Secure AI Alliance, een dertigtal partners voor AI-beveiliging

27 juli — NVIDIA kondigt de oprichting aan van de Open Secure AI Alliance, een coalitie van een dertigtal oprichtende partners — waaronder Adobe, Cadence, Capital One, Cisco, Cloudflare, Cognition, CrowdStrike, Databricks, Dell, Hugging Face, IBM, LangChain, de Linux Foundation, Microsoft, NAVER, Palantir, Red Hat, Salesforce, SAP, ServiceNow, Siemens, Snowflake, SpaceXAI en Thinking Machines Lab — gewijd aan de ontwikkeling en het delen van open tools voor de beveiliging en betrouwbaarheid van AI-systemen.

De aankondiging bouwt expliciet voort op het beveiligingsincident bij Hugging Face midden juli (al eerder besproken): de NVIDIA-blog herinnert eraan dat Hugging Face het open model GLM 5.2 op zijn eigen infrastructuur heeft laten draaien om meer dan 17 000 acties te analyseren en de inbraak in te dammen — volgens NVIDIA het bewijs dat een toonaangevend open model een defensief voordeel is, geen veiligheidslast.

Partner van de alliantieConcrete bijdrage
NVIDIANOOA (NVIDIA Labs Object-Oriented Agent), onderzoeksraamwerk voor agent-harnassen, open source op GitHub
Hugging FaceDonatie van het Safetensors-formaat aan de PyTorch Foundation
MicrosoftMDASH, multi-model agentische scanset om exploiteerbare kwetsbaarheden aan te tonen
HPESPIFFE/SPIRE, zero-trust identiteit voor agents en AI-diensten
SpaceXAIOpening van de terminal-coderingsagent Grok Build, gewichten van de Grok-lijn volgen

Opmerkelijk genoeg reageert Jensen Huang zelf op de aankondiging — slechts zijn tweede bericht ooit gepubliceerd op X, na de brief van 24 juli die al eerder werd besproken. Diezelfde dag voegt Cognition (Devin) zich bij de alliantie door zijn eigen onderzoeksresultaten over de betrouwbaarheid van modellen afgeleid van open source te delen, die al op 8 juli waren gepubliceerd:

“Closing open source models hurts innovation. The path forward is better tools to evaluate, secure, and deploy them responsibly.”

🇳🇱 Open source-modellen sluiten schaadt innovatie. De weg vooruit loopt via betere tools om ze te evalueren, te beveiligen en verantwoord uit te rollen.@cognition op X

Sakana AI sluit zich dezelfde dag aan bij de beweging pro-open-modellen die op gang kwam door de brief van Jensen Huang van 24 juli — een derde signaal, los van de alliantie zelf, dat de week afsluit: beveiligingsincident (21 juli), open brief (24-26 juli), concrete industriële alliantie (27 juli).

🔗 Officiële aankondiging — NVIDIA

🔗 Jensen Huang op X

🔗 Sakana AI sluit zich aan bij de beweging


Perplexity publiceert zijn eerste changelog in twee weken: negen functies, focus op enterprise

27 juli — Perplexity publiceert een dense changelog-entry, de eerste sinds 13 juli (« Introducing Brain for Perplexity Computer »), na twee weken zonder nieuwe publicatie op dit kanaal. De entry bundelt negen afzonderlijke functies voor Perplexity Search, Computer, de Agent API en Comet Assistant. Acht zijn nieuw; de negende — de integratie van Claude Opus 5 in Search en Computer — was al aangekondigd op X op 25 juli en wordt hier alleen officieel bevestigd in de changelog.

Nieuwe functieTechnische details
Toegangsbeheer op basis van rollen (RBAC) + SCIMAangepaste rollen, groepssynchronisatie, kredietlimieten per groep — exclusief voor jaarlijkse Enterprise-contracten
Kluis voor API-referentiesComputer authenticeert bij elke externe API zonder het geheim bloot te geven aan de agent of de sandbox
Brain uitgerold naar Max-abonneesZelfverbeterend geheugen uitgebreid naar alle Max-abonnees wereldwijd, wiki-schrijven in 15 talen
Skills voor de Agent APIComposabele capaciteiten die op aanvraag worden geladen voor ontwikkelagents
Computer in Comet AssistantToegang tot Computer rechtstreeks vanuit het Comet-paneel, zonder de bekeken pagina te verlaten
Check SourcesControleert of een Ask- of Computer-antwoord daadwerkelijk ondersteund wordt door de geciteerde bronnen
Source Context PanelZijpaneel om de bronnen van een antwoord te inspecteren, vergelijken en verder te verkennen
Sessiebeheer via promptComputer-sessies ophalen, samenvatten, forken of paralleliseren vanuit een eenvoudige conversatie

De eerste twee functies van de tabel richten zich specifiek op organisaties met een jaarlijks Enterprise-contract: het toegangsbeheer op basis van rollen met SCIM-synchronisatie beantwoordt aan een klassieke IT-governancebehoefte (gecentraliseerde provisioning, kredietlimieten per team), terwijl de kluis voor API-referenties Computer uitbreidt naar externe diensten zonder native connector, zonder ooit het ruwe geheim aan de agent bloot te geven. De generalisering van Brain naar alle Max-abonnees raakt dan weer een veel breder publiek dan alleen het Enterprise-segment waar de functie een maand eerder begon.

Geen van deze negen functies wordt vermeld als voorbehouden aan een preview: alle functies zijn uitgerold of bezig met een algemene uitrol op het moment van publicatie. Door zijn omvang — enterprise-governance, ontwikkelaars en publiek in dezelfde entry — is deze changelog de dichtste publicatie van Perplexity sinds de lancering van Personal Computer midden juli.

🔗 Officiële changelog — Perplexity


Cognizant en Anthropic breiden hun enterprise-partnerschap uit

27 juli — Cognizant wordt Global Premier Partner binnen het Claude Partner Network. Claude is voortaan geïntegreerd in drie interne platforms van het bedrijf: Flowsource (full-stack engineeringplatform, module Spec-Driven Development waar Claude Code wordt aangestuurd door de project-specificaties en blueprints), Neuro AI Engineering en Neuro IT Ops. Meer dan 30 000 Cognizant-medewerkers zijn inmiddels op Claude getraind, in het kader van het nieuwe workforce-model « Frontier Certified » van de groep.

KlantcaseGemeten resultaat
Klantbelevingsportaal (wereldwijde fabrikant)Opgeleverd in 6 maanden
Contractintelligentie (biopharma)Tot -40% van de reviewtijd, meer dan 88% extractienauwkeurigheid
Risiconavigatie (verzekeringen)Ongeveer 8 uur/week/persoon bespaard

Ravi Kumar S (CEO van Cognizant) spreekt over een groeiende kloof tussen de capaciteiten van AI en het vermogen van bedrijven om die op te nemen, en positioneert Cognizant als de brug die de nodige bedrijfskundige context, engineeringschaal en vertrouwenskaders voor deze implementaties aanreikt.

🔗 Officiële aankondiging — Anthropic


Coderingstools: Zed neemt Claude Opus 5 over, GitHub Copilot optimaliseert zijn kosten

Zed 1.12.1 en 1.13.1 voegen Claude Opus 5 toe

27 juli — Zed publiceert gelijktijdig zijn versies 1.12.1 (stable) en 1.13.1 (preview), met ondersteuning voor Claude Opus 5 voor de providers Anthropic en Amazon Bedrock BYOK (bring your own key). Zed wordt de vijfde coderingstool die Opus 5 integreert, na Cursor, Devin, v0 en Warp — maar, in tegenstelling tot de vier voorgaande, uitsluitend via changelog, zonder aankondiging op X. Het preview-kanaal corrigeert bovendien drie afzonderlijke bugs: projectinstellingen die language servers niet opnieuw activeren, dubbele antwoorden met GPT-5.x-modellen op Amazon Bedrock’s Mantle-endpoint, en een projectszoekopdracht die geneste repositories ophaalt terwijl die net waren uitgesloten.

🔗 Stabiele changelog — Zed

GitHub Copilot — Auto-routering (HyDRA) laat AI-credits 3,3× langer meegaan

27 juli — GitHub legt uit dat prompt caching (prompt caching), tool search (tool search) en een modelrouteringssysteem genaamd HyDRA de herhaalde context per Copilot-sessie verminderen. Gecijferd resultaat: HyDRA evenaart de taakoplossingsgraad van 70,8% van OpenRouter Auto, met een winst van 3,3× in kredietbesparing. Er is voor deze aankondiging geen apart blogartikel gepubliceerd; het bleef vooralsnog bij een simpele tweet — in de lijn van de efficiëntie-evaluatie van het Copilot-harnas die op 25 juni werd gepubliceerd.

🔗 Aankondiging — @github op X


OpenAI: uitgebreidere spraak voor enterprise en nieuw economisch onderzoek

GPT-Live wereldwijd beschikbaar voor Edu, Business en Enterprise

27 juli — OpenAI bevestigt dat GPT-Live, de nieuwe generatie spraakmodellen die op 8 juli werd geïntroduceerd voor natuurlijke interactie tussen mens en AI, nu wereldwijd beschikbaar is voor de plannen Edu, Business en Enterprise. De ChatGPT Voice-desktopapp had deze plannen al op 23 juli genoemd; het nieuws hier is de expliciete bevestiging dat het spraakmodel zelf — en niet alleen de desktopintegratie — wereldwijd is inbegrepen. De aankondiging wordt rechtstreeks op X geplaatst, zonder apart artikel: dit is het element dat het meest direct verband houdt met de Enterprise-uitbreiding die in dit observatievenster wordt waargenomen.

🔗 Aankondiging — @OpenAI op X

Werken aan de grens : hoe AI taken op het werk verbreedt

27 juli — OpenAI Economic Research publiceert het eerste rapport in een nieuwe terugkerende reeks, gebaseerd op de analyse van meer dan 800.000 ChatGPT-berichten van Amerikaanse gebruikers. Het rapport introduceert het begrip taakoverlap (task crossover) : werk dat gewoonlijk aan een bepaald beroep wordt gekoppeld en dat opduikt in het AI-gebruik van mensen met een ander beroep. 16,8% van de werkgerelateerde berichten, en 43,5% van de berichten die specifiek aan een beroep zijn gekoppeld, gaan over taken uit een ander beroep dan dat van de gebruiker.

Betrokken beroepAandeel taken buiten het beroep
Klantbeleving77%
Design75%
Personeelszaken69%
Juridisch56%
Marketing53%

Het fenomeen komt vaker voor in kleinere organisaties: het aandeel taken buiten het beroep daalt van 18,9% in werkruimten met 2 tot 5 werkplekken naar 16,3% boven de 100 werkplekken, wat past bij het idee dat AI dient als algemeen inzetbaar hulpmiddel waar gespecialiseerde middelen ontbreken.

🔗 Volledig rapport — OpenAI


Meta AI zet SAM en DINOv3 in binnen een project voor assistieve robotica

27 juli — Meta AI publiceert een casestudy over het RAMMP-project (Robotic Assistive Mobility and Manipulation Platform), geleid door de University of Pittsburgh (HERL) en ATDev, gefinancierd tot $41,5 miljoen door ARPA-H (Amerikaanse federale instantie voor geavanceerd biomedisch onderzoek). Het doel: veiligere robotplatforms voor rolstoelgebruikers — ongeveer 5,5 miljoen mensen in de Verenigde Staten, met elk jaar meer dan 100.000 rolstoelgerelateerde verwondingen die op de spoedeisende hulp worden behandeld.

De open source-modellen DINO/DINOv3 (zelfsupervised vision transformer) en SAM/SAM 3.1 (segmentatie) draaien in edge computing rechtstreeks op de ingebouwde hardware van de robots — een beperking die voortkomt uit batterijautonomie en het ontbreken van betrouwbare netwerkconnectiviteit. Het waarnemingssysteem leunt op RF-DETR, een lichtgewicht detector die is verfijnd met DINOv2-embeddings, waarvan de trainingsgegevens automatisch worden geannoteerd via SAM. Het bijbehorende consortium omvat Kinova Robotics, LUCI Mobility, ATDev en teams van Carnegie Mellon, Cornell, Northeastern en Purdue.

🔗 Volledige casestudy — Meta AI


Cohere lanceert North Automations, orkestratie van agentische workflows voor bedrijven

27 juli — Cohere kondigt North Automations aan, een nieuwe mogelijkheid van zijn enterprise-agentplatform North, waarmee geautomatiseerde workflows in natuurlijke taal kunnen worden ontworpen: geplande uitvoeringen, lussen en vertakkingen, modelkeuze per stap, een « Plan »-modus om te herzien vóór de bouw, menselijke goedkeuringspunten en tracking van tokenverbruik. Cohere schat de markt­kans voor agentorkestratie op $550 miljard, verwijzend naar een Gartner-rapport over de hypecyclus van agentische AI.

Automations bouwt voort op de bestaande infrastructuur van North (on-prem of cloud deployment, eigen connectors, MCP of SDK, guardrails en fijnmazige machtigingen) en is vanaf vandaag beschikbaar voor alle North-klanten. Intern hebben de teams Marketing Operations, Customer Success en Sales al hun eigen automatiseringen gebouwd — respectievelijk een omzetting van natuurlijke-taalvragen naar BigQuery SQL-queries, een tracker voor klantbetrokkenheid die HR, Slack en Salesforce samenbrengt, en een voorbereiding van prospectcalls die Salesforce, Slack, Gmail en Notion combineert.

🔗 Aankondiging — @cohere op X

🔗 Blogpost — Cohere


Kort nieuws

  • GitHub Blog — « The harness is all you need (mostly) » — Burke Holland publiceert een Copilot-workflow in 8 stappen (een tool kiezen, YOLO-modus, visueel prototype, plan met /grill-me, implementatie via Autopilot, menselijke review, kruisreview door een model uit een andere familie, oplevering), bruikbaar voor de hele Copilot-familie. 🔗 Bron
  • NVIDIA — de Vera CPU versnelt chipontwerp — intern uitgerold in EDA-workflows met Cadence (Jasper) en Synopsys (VCS), tot 1,5× betere prestaties op bepaalde verificatieworkloads, bij hetzelfde aantal cores. 🔗 Bron
  • NVIDIA — Nemotron 3 Ultra leidt bij agentische RTL-codering — in negen categorieën van echt chipontwerp behaalt dit al bekende open model de beste resultaten onder de geteste open modellen. 🔗 Bron
  • HeyGen / HyperFrames — dag 21 en 22 van 30 — cloudrendering via de HeyGen-API (ongeveer $0,10/minuut in 1080p) en vervolgens een catalogus van herbruikbare componenten om scènes te bouwen zonder vanaf nul te beginnen. 🔗 Dag 21 · Dag 22
  • ElevenLabs — top in Bengaluru op 6 oktober — voorproefjes van nieuwe modellen en demonstraties van Indiase teams die aan spraak-AI werken, aangekondigd voor dit evenement. 🔗 Bron

Wat dit betekent

De openheid van modellen verschuift van woorden naar daden. Na de brief van Jensen Huang op 24 juli en de groeiende steun (Cohere, Ai2, Together AI, en vervolgens Sakana AI dit weekend) betekent 27 juli een kwalitatieve sprong: een gestructureerde industriële alliantie met concrete tools van haar leden (NOOA van NVIDIA, Safetensors van Hugging Face, SPIFFE/SPIRE van HPE), en een vlaggenschipmodel, Kimi K3, dat aanspraak maakt op de klasse van 3 biljoen parameters in open weights. Twee verschillende vormen van dezelfde dynamiek, op dezelfde dag gepubliceerd.

Veiligheid als argument voor openheid, in plaats van ertegen. De Open Secure AI Alliance draait een gebruikelijk argument om: niet de openheid van modellen ondermijnt de veiligheid, maar juist hun geslotenheid ontneemt verdedigers inspecteerbare tools. Het Hugging Face-incident van half juli, waarbij een open model (GLM 5.2) forensische analyse mogelijk maakte van meer dan 17.000 inbraakacties, dient als demonstratie van deze stelling — een schoolvoorbeeld dat NVIDIA expliciet noemt om de oprichting van de alliantie te rechtvaardigen.

De open grens komt dichter bij de gesloten grens. Op meerdere specifieke agentische benchmarks — SWE-Marathon, MCPMark-Verified, GPQA Diamond — presteert Kimi K3 beter dan of gelijk aan Claude Fable 5, Claude Opus 4.8 en GPT-5.5, terwijl het zelf toegeeft nog achter te blijven op de algehele gebruikerservaring. De kloof tussen open en propriëtaire modellen wordt benchmark per benchmark kleiner, ook al erkennen open laboratoria zelf dat ze de totale ervaring van de beste gesloten modellen nog niet evenaren.

Enterprise-AI wordt geïndustrialiseerd via kleine governance-bouwstenen. Cognizant dat 30.000 associates traint op Claude, Perplexity dat RBAC en SCIM toevoegt aan Computer, Cohere dat workfloworkestratie met menselijke goedkeuringspunten lanceert, OpenAI dat GPT-Live uitbreidt naar Edu/Business/Enterprise: vier verschillende spelers zetten op dezelfde dag stappen in bouwstenen voor toegangsbeheer, traceerbaarheid en automatisering — de noodzakelijke basis om agentische AI van prototype naar grootschalige uitrol in bedrijven te brengen.


Bronnen