Sök

GLM-5.2 med öppen källkod under MIT-licens, Qwen-Robot Suite och NVIDIA Blackwell dominerar MLPerf: 16 juni 2026 inom AI

Artikel genererad av artificiell intelligens
GLM-5.2 med öppen källkod under MIT-licens, Qwen-Robot Suite och NVIDIA Blackwell dominerar MLPerf: 16 juni 2026 inom AI

ai-powered-markdown-translator

Artikel översatt från franska till svenska med gpt-5.6-sol.

Visa projekt på GitHub ↗

16 juni 2026 — Z.ai publicerar GLM-5.2-vikterna med öppen källkod under MIT-licens (kontextfönster på 1M tokens, två nivåer av resonemang), Alibaba Qwen presenterar Qwen-Robot Suite som består av tre grundmodeller för robotik, och NVIDIA Blackwell dominerar samtliga benchmarktester i MLPerf Training 6.0 — däribland DeepSeek-V3 671B, som tränades på 2,02 minuter med 8 192 GPU:er. GitHub meddelar att Code Quality blir allmänt tillgängligt (general availability) som betaltjänst den 20 juli för $10 per aktiv utvecklare och månad, June Pixel Drop för med sig Gemini Omni-video och musikgenerering till Pixel-enheter, och Anthropics ekonomiska forskning kvantifierar för första gången hur domänexpertis påverkar Claude Code.


Z.ai GLM-5.2 — vikter med öppen källkod under MIT-licens tillgängliga

16 juni — Z.ai (tidigare Zhipu AI) publicerar officiellt GLM-5.2-vikterna med öppen källkod under MIT-licens och förverkligar därmed tillkännagivandet från den 13 juni. Vikterna kan nu laddas ned från företagets plattform.

“Introducing GLM-5.2: Frontier Intelligence, Open Weights

  • Significant improvements in coding and agentic tasks
  • Strong long-horizon capabilities with a 1M context window
  • Two levels of reasoning effort: GLM-5.2 (max) pushes the limits, while GLM-5.2 (high) strikes a strong balance”

🇸🇪 Vi presenterar GLM-5.2: intelligens i framkant, öppna vikter. Betydande förbättringar för kodnings- och agentbaserade uppgifter. Robusta funktioner för långa sekvenser med ett kontextfönster på 1 miljon tokens. Två nivåer av resonemangsansträngning: GLM-5.2 (max) flyttar fram gränserna, medan GLM-5.2 (high) erbjuder en stark balans.@Zai_org på X

Viktiga egenskaper hos GLM-5.2:

  • Betydande förbättringar för kodningsuppgifter (coding) och agentbaserade uppgifter
  • Kontextfönster på 1 miljon tokens — användbart för storskaliga kodningsagenter och bearbetning av långa dokument
  • Två kompletterande nivåer av resonemangsansträngning
  • Överträffar GLM-5.1 inom kodning, verktygsanvändning och resonemang
  • Tillgänglig via chat.z.ai
VariantResonemangKontextLicens
GLM-5.2 (max)Maximal prestanda1M tokensMIT open-source
GLM-5.2 (high)Stark balans mellan prestanda/hastighet1M tokensMIT open-source

MIT-licensen är den viktigaste aspekten: den tillåter kommersiell användning utan begränsningar, vilket gör GLM-5.2 direkt användbar för företag som inte kan eller vill vara beroende av amerikanska proprietära modeller. Inlägget nådde 515 000 visningar på några timmar — en tydlig signal om communityns intresse för frontier-modeller med öppen källkod och stora kontextfönster.

🔗 Z.ai-bloggen — GLM-5.2


Qwen-Robot Suite — tre grundmodeller för förkroppsligad robotik

16 juni — Alibaba Qwen tillkännager Qwen-Robot Suite, en komplett stack för förkroppsligad intelligens (embodied intelligence) som består av tre separata och kompletterande grundmodeller: navigation, manipulation och en världsmodell.

Qwen-RobotNav — specialist på mobil navigation:

  • Förenar 5 uppgifter i en enda modell: instruktionsföljning, navigation till en målpunkt (point-goal), navigation till ett målobjekt (object-goal), objektspårning och autonom körning
  • Styrbart observationsprotokoll
  • Verktygsgränssnitt för agentbaserade system

Qwen-RobotManip — specialist på manipulation:

  • Enhetligt tillstånds- och handlingsutrymme för heterogena robotar
  • Deltapositioner i kamerans referensram för konsekvent inlärning mellan olika robotkroppar (cross-embodiment)
  • Förtränad på ett korpus med öppen källkod omfattande mer än 38 100 timmar

Qwen-RobotWorld — modell av den fysiska världen:

  • En enda modell som omfattar fler än 20 typer av robotkroppar
  • Handlingsgränssnitt med naturligt språk
  • Förutsäger fysiskt förankrade framtida tillstånd för manipulation, körning och navigation

Varje modell kan användas separat och kombineras som ett verktyg för den fysiska världen. Tillsammans bildar de verktygslådan på låg nivå för agentbaserade system med generell inriktning.

ModellSpecialitetNyckeluppgift
Qwen-RobotNavNavigation för flera uppgifter (5 förenade uppgifter)Verktygsgränssnitt för agentbaserade system
Qwen-RobotManipRobotmanipulation med cross-embodimentKorpus med öppen källkod på 38 100+ timmar
Qwen-RobotWorldFysisk world model20+ typer av robotkroppar

🔗 Qwen-Robot Suite — tillkännagivande


NVIDIA Blackwell dominerar MLPerf Training 6.0 — fullständig seger

16 juni — NVIDIA vann samtliga benchmarktester i MLPerf Training 6.0, branschstandarden för AI-träning som fastställts av konsortiet MLCommons. Det är den enda plattformen som lämnade in resultat för varje test, inklusive de två nya benchmarktesterna i den här utgåvan: DeepSeek-V3 (671 miljarder parametrar, MoE-arkitektur) och GPT-OSS-20B.

Prestandan hos systemet GB300 NVL72 (72 sammankopplade Blackwell Ultra-GPU:er) är anmärkningsvärd:

ModellPlattformGPUTid
DeepSeek-V3 671B (MoE)GB300 NVL728 1922,02 min
GPT-OSS 20B (MoE)GB300 NVL725127,43 min
Llama 3.1 405BGB200 NVL728 1927,07 min
Llama 3.1 8BGB200 NVL721 0244,46 min
Llama 2 70B LoRAGB300 NVL725120,40 min
FLUX.1 (bildgenerering)GB300 NVL7251217,1 min
DLRM-dcnv2GB300 NVL72640,67 min

Att FLUX.1 (Black Forest Labs modell för bildgenerering) ingår i de officiella benchmarktesterna är anmärkningsvärt: det bekräftar att Blackwell-infrastrukturen är referensstandarden för träning av de mest avancerade modellerna för bildgenerering.

På mjukvarusidan har NVIDIA infört flera innovationer i NeMo 26.06-stacken: CUDA-grafer för hela iterationer för MoE, sammanslagning av kärnor via CuTe DSL, MXFP8-precision för uppmärksamhetsblocket och optimeringar av MoE-routern (5× snabbare kärna). Dessa mjukvaruförbättringar gav en ökning på 1,3× av genomströmningen för DeepSeek-V3 på tre månader utan några hårdvaruändringar, från 1 298 till 1 648 TFLOPS/GPU — en påminnelse om att hårdvaruprestanda bara är en del av ekvationen.

🔗 NVIDIA — MLPerf Training 6.0


June Pixel Drop 2026 — Gemini Omni-video, musikgenerering, Daily Brief

16 juniJune Pixel Drop 2026 introducerar flera viktiga funktioner som integrerar Gemini direkt i Pixel-enheter, med en gradvis lansering som inleds under de kommande veckorna.

Gemini Omni — skapande och redigering av AI-video: det räcker att samtala naturligt med Gemini för att kombinera text, bilder och videor. Det går att börja från grunden, remixa innehåll från kamerarullen, använda förinställda mallar eller till och med skapa en personlig AI-avatar med användarens utseende och röst.

Musikgenerering i Gemini: användaren beskriver en idé eller importerar ett foto, som omvandlas till ett originellt ljudspår med sångtext. Stil, röst och tempo kan anpassas via menyn Verktyg → ”Skapa musik” i Gemini-appen.

Daily Brief — AI-agent för morgonen: tillgänglig för alla Google AI Plus-, Pro- och Ultra-prenumeranter (18+, för närvarande endast i USA). Agenten organiserar användarens dag redan innan hen vaknar. Voice Translate, som översätter samtal i realtid, utökas till Pixel 10a (7 språk, däribland franska).

FunktionTillgänglighetAnmärkningar
Gemini Omni-videoPixel (gradvis lansering)Skapande/remix via samtal
MusikgenereringPixel (Gemini-appen)Ljud + sångtext, anpassningsbart
Daily BriefGoogle AI Plus/Pro/Ultra, 18+, USAAI-agent för morgonen
Voice TranslatePixel 10a7 språk + hindi i förhandsversion
Edit with Ask PhotosStorbritannien, Tyskland, Frankrike, Spanien, ItalienFotoredigering via samtal

🔗 June Pixel Drop 2026 — Googles officiella blogg


GitHub Code Quality — allmän tillgänglighet den 20 juli, $10 per aktiv utvecklare

16 juni — GitHub meddelar att GitHub Code Quality går från offentlig förhandsversion till allmän tillgänglighet (general availability) den 20 juli 2026 som en betald produkt. Fler än 10 000 företag deltog i förhandsversionen.

Prissättning från den 20 juli:

KomponentPrissättning
Licens per aktiv utvecklare (committer)$10 / aktiv utvecklare / månad
AI-funktioner (Copilot code review, AI-detektering, Copilot Autofix)Användningsbaserad fakturering
Deterministisk CodeQL-analysGitHub Actions-minuter

Nya funktioner som blir tillgängliga vid GA:

  • Driftsättning i hela organisationen (en enda administratörsväxel)
  • Kvalitetsöversikter på organisationsnivå
  • Tillämpning av kodtäckningskrav via regeluppsättningar (rulesets)
  • Kvalitetspoäng per kodförråd och organisation
  • API för aktivering och hantering av resultat

Tillgänglighet: endast GitHub Enterprise Cloud och GitHub Team. Inte tillgängligt på GitHub Enterprise Server. Kunder som vill avstå innan faktureringen börjar kan inaktivera Code Quality i sina kodförråd före den 20 juli.

🔗 GitHub Code Quality — GA-tillkännagivande


Ekonomisk forskning från Anthropic — domänexpertis väger tyngre än kodkunskaper

16 juni — Anthropic publicerar en ekonomisk studie om användningen av Claude Code, baserad på en konfidentiell analys av omkring 400 000 sessioner mellan oktober 2025 och april 2026. Det är de första kvantitativa resultaten om hur expertis avgör framgången med en AI-kodningsagent.

Studiens viktigaste resultat (författare: Zoe Hitzig, Maxim Massenkoff, Eva Lyubich, Ryan Heller, Peter McCrory):

IndikatorVärde
Analyserade sessioner~400 000
Unika användare~235 000
Omfattad periodOkt 2025 – Apr 2026
Planeringsbeslut (användaren)~70 %
Genomförandebeslut (Claude)~80 %
Genomsnittlig ökning av uppgifternas ekonomiska värde+25 %
Verifierad framgångsfrekvens (domänexpert)28–33 %
Verifierad framgångsfrekvens (nybörjare)15 %
Andel felsökningssessioner okt → apr33 % → 19 %

Huvudslutsats: i en typisk session fattar användaren omkring 70 % av planeringsbesluten (vad som ska göras), medan Claude fattar omkring 80 % av genomförandebesluten (hur det ska göras). Domänexperter — som inte nödvändigtvis är utvecklare — leder Claude genom dubbelt så långa handlingskedjor med fem gånger mer innehåll per instruktion. Framgångsfrekvensen för icke-tekniska yrkesgrupper (jurister, chefer, forskare) ligger mindre än 7 procentenheter under mjukvaruingenjörernas. Det är förståelsen av verksamhetsproblemet, inte kodkunskaperna, som avgör framgången.

🔗 Anthropics ekonomiska forskning — Claude Code


Anthropic och OpenAI — agenter i produktion och lansering i Europa

Claude Managed Agents — guide för produktionssättning

16 juni — Anthropics Applied AI-team publicerar en praktisk guide om produktionssättning av agenter med Claude Managed Agents. Inlägget förklarar hur interaktionsytorna utvecklas: från den klassiska chatboten till planerade, beständiga och autonoma agenter med tillgång till exekveringsmiljöer med bevarat tillstånd (stateful runtime environments). Två funktioner är tillgängliga sedan den 9 juni: körning av agenter enligt ett definierat schema och lagring av miljövariabler i valv (vaults).

🔗 Bygga med Claude Managed Agents

Claude Code v2.1.178 — detaljerade behörigheter och nästlade skills

15 juni — Claude Code v2.1.178 introducerar syntaxen Tool(param:value) för behörighetsregler — exempelvis Agent(model:opus) för att blockera Opus-underagenter. Skills i nästlade kataloger av typen .claude/skills/ laddas automatiskt när arbete utförs i dessa mappar. Auto mode låter nu klassificeraren bedöma starter av underagenter innan de körs, vilket täpper till en lucka där en underagent kunde begära en blockerad åtgärd utan föregående granskning.

🔗 Claude Code v2.1.178

Codex-appen i EES, Storbritannien och Schweiz — Computer Use, Memories, Chronicle

16 juni — OpenAI lanserar fyra avancerade Codex-funktioner i Europeiska ekonomiska samarbetsområdet (EES), Storbritannien och Schweiz: Computer Use (macOS + Windows), Codex-tillägget för Chrome, Memories och Chronicle.

Computer Use gör det möjligt för Codex att interagera med skrivbordsprogram — se, klicka och skriva text. Chrome-tillägget gör det möjligt att utföra uppgifter som kräver kontext från en inloggad webbläsare och arbetar med flera flikar i bakgrunden. Memories kommer ihåg återkommande inställningar och konventioner för kodförråd, men är inaktiverat som standard i de tre regionerna för att uppfylla regelkrav. Chronicle, en valbar förhandsversion endast för Pro-prenumeranter på macOS, hjälper Codex att skapa minnen från skärmens senaste kontext. Funktionerna var redan tillgängliga för Enterprise-användare utanför EES/Storbritannien/Schweiz.

🔗 OpenAI — lansering av Codex i EES/Storbritannien/Schweiz

OpenAI Deployment Simulation — förutsäg beteendet före lansering

16 juni — OpenAI publicerar sin metod Deployment Simulation (driftsättningssimulering): att spela upp verkliga anonymiserade samtal från tidigare driftsättningar med en kandidatmodell för att upptäcka oönskade beteenden före produktionssättning. Metoden testades på driftsättningar av GPT-5-series Thinking (omkring 1,3 miljoner samtal) och har ett medianfel i förutsägelserna på 1,5×, vilket är betydligt bättre än syntetiska utvärderingar. Metoden gjorde det möjligt att upptäcka ”calculator hacking” (en form av avvikelse, reward hacking) före lanseringen av GPT-5.1.

🔗 Deployment Simulation — OpenAI

Codex CLI 0.140.0 — /usage, /import från Claude Code, Bedrock-autentisering

15 juni — Version 0.140.0 av Codex CLI medför flera betydande funktioner. /usage visar kontots dagliga, veckovisa och sammanlagda tokenaktivitet. /import gör det möjligt att selektivt importera konfiguration, projektinställningar och senaste diskussioner från Claude Code — direkt interoperabilitet mellan två konkurrerande verktyg. codex delete raderar en session permanent, med säkerhetsbekräftelse och rensning av tillhörande underagenter. Hanterad Amazon Bedrock-autentisering lagrar API-nycklar krypterat lokalt och omfattar även OAuth MCP-autentiseringsuppgifter. Dessutom har tillförlitligheten för MCP förbättrats (nya försök vid tillfälliga startfel) och skadade SQLite-databaser återställs automatiskt.

🔗 Codex CLI 0.140.0 — GitHub-version


Meta AI — AI Mode på Facebook med Muse Spark

16 juni — Meta lanserar nya verktyg för artificiell intelligens på Facebook. AI Mode är ett nytt sökläge som drivs av Meta AI (med Muse Spark) och förankrar sina svar i vad användare säger offentligt i Metas appar — Grupper, Reels — vilket ger kontextualiserade perspektiv i stället för generiska resultat. Det är tillgängligt från nyhetsflödet eller sökfunktionen.

Nya kreativa verktyg: delningsförslag från kamerarullen med kollagemallar (cutout templates), videoövergångseffekter, fotoförinställningar (photo presets) som gör det möjligt att virtuellt ändra kläder och frisyr samt alternativet ”Wear It” för att virtuellt bära en sporttröja i Stories. Alla dessa funktioner är frivilliga och kan inaktiveras.

🔗 Meta — nya AI-verktyg på Facebook

🔗 Meta Newsroom — tillkännagivande på X


NVIDIA SpatialClaw — spatial resonemangsagent utan träning

16 juni — NVIDIA Research publicerar SpatialClaw, en visuell spatial resonemangsagent som är training-free (utan ytterligare träning). I stället för att anropa en fast uppsättning fördefinierade verktyg skriver agenten Python direkt i en beständig kernel, kombinerar dynamiskt perceptionsmoduler och omprövar sin strategi steg för steg. Utdata blir återanvändbara Python-variabler med NumPy och SciPy.

Resultat: +11,2 poäng på 20 benchmarks för visuellt spatialt resonemang jämfört med en tidigare aktuell agent, konsekvent över 6 olika modellarkitekturer och utan benchmark-specifik finjustering.

🔗 SpatialClaw — @NVIDIAAI på X


Cohere — inflöde av förfrågningar efter USA:s begränsning av Anthropic

15 juni — Cohere, ett kanadensiskt företag inom generativ AI, uppger att det får ett stort antal inkommande förfrågningar (inbounds) från företag som söker alternativ efter USA:s direktiv som begränsar åtkomsten till Anthropic (behandlat den 13 juni). Företaget svarade humoristiskt genom att citera Polymarkets tweet: ”Världen behöver mer Kanada 🇨🇦”. Tweeten nådde 56 000 visningar och 797 likes. Denna positionering bekräftar att det amerikanska direktivet skapar en direkt affärsmöjlighet för suveräna icke-amerikanska leverantörer.

🔗 Cohere — tweet


GitHub Models avvecklas för nya kunder

16 juni — GitHub tillkännager den gradvisa avvecklingen av GitHub Models. Från och med den 16 juni har nya kunder (organisationer och företag utan tidigare användning) inte längre tillgång till tjänsten, vare sig med kostnadsfria eller betalda abonnemang. Befintliga kunder med aktiv användning påverkas inte för närvarande och kan fortsätta använda testmiljön (playground), API:et och de tillgängliga modellerna. GitHub uppger att detaljerade tidsramar för den fullständiga nedstängningen kommer att meddelas senare. För nya projekt som behöver tillgång till AI-modeller hänvisar GitHub till Azure AI Foundry, som erbjuder en omfattande modellkatalog.

🔗 Avveckling av GitHub Models


Kortfattat

  • Claude Code v2.1.179 — 9 stabilitetsfixar (16 juni): pågående arbete bevaras vid avbrutna anslutningar mitt i en ström (mid-stream), rullning med mushjulet har korrigerats i WSL2 under Windows Terminal och VS Code (regression sedan v2.1.172), och Linux-sandboxen har korrigerats för stora katalogträd. 🔗 v2.1.179

  • Gemini Trusted Tester Program — anmälan öppen: Google öppnar ett begränsat antal platser för avancerade användare som vill testa nya Gemini-funktioner före den offentliga lanseringen. 🔗 Anmälan

  • Gemini — Ny flerspråkig mikrofon för över 70 språk (Android och iOS): via @joshwoodward.

  • GitHub Code Quality — aktivering för hela organisationen med ett klick (16 juni): organisationsadministratörer kan aktivera eller inaktivera Code Quality för alla sina repositories med en enda växlingsknapp i säkerhetsinställningarna. 🔗 Ändringslogg

  • Copilot usage metrics — utökning med servertelemetri (15 juni): användningsrapporter för Copilot Enterprise omfattar nu aktiva användare som identifierats på serversidan (utöver klienttelemetri), vilket förbättrar täckningen av DAU i dagliga rapporter och 28-dagarsrapporter. 🔗 Ändringslogg

  • Manus — meddelandekö under körning (16 juni): Manus gör det nu möjligt att köa meddelanden som ska skickas till agenten medan en uppgift pågår. Meddelandena behandlas i ordning så snart den aktuella uppgiften är klar. 🔗 Tillkännagivande

  • ChatGPT for iOS 1.2026.160 — filbläddrare för workspace, MCP-godkännande, LaTeX (15 juni).


Vad det innebär

Publiceringen av GLM-5.2:s vikter under MIT-licens och de tre robotikmodellerna i Qwen-Robot Suite illustrerar hur det kinesiska open-source-utbudet accelererar inom områden där amerikanska aktörer fortfarande till stor del är proprietära. GLM-5.2, med sitt kontextfönster på 1M tokens under MIT-licens, blir en direkt konkurrent till kommersiella modeller för företag som söker ett suveränt alternativ — just den nisch som USA:s direktiv om begränsning av Anthropic har gjort strategiskt synlig, vilket bekräftas av det inflöde av förfrågningar som Cohere rapporterar. Robotik är nästa arena för denna konkurrens: Qwen-Robot Suite erbjuder en komplett stack för navigation–manipulation–world model, medan SpatialClaw från NVIDIA Research visar att avancerat spatialt resonemang kan uppnås utan fine-tuning — två kompletterande angreppssätt som formar arkitekturen för nästa generations agentbaserade robotsystem.

På hårdvarufronten bekräftar resultaten från MLPerf Training 6.0 Blackwell-arkitekturens dominans i industriell skala: att träna DeepSeek-V3 (671 miljarder parametrar) på 2 minuter med 8 192 GPU:er är inte en akademisk bedrift, utan en verklig produktionskapacitet som är driftsatt i cloud-datacenter. Den 1,3× högre genomströmningen för DeepSeek-V3 som uppnåtts genom mjukvaruförbättringar på tre månader utan någon hårdvaruförändring påminner om att kapplöpningen inom AI-prestanda handlar lika mycket om konkurrens mellan mjukvarustackar (NeMo, CuTe DSL, MXFP8) som om chip — en dynamik som förstärker redan dominerande positioner.

Anthropics ekonomiska forskning om Claude Code ger en viktig och kontraintuitiv insikt: expertis inom verksamhetsområdet (juridik, management, vetenskap) avgör framgången med en kodningsagent nästan lika mycket som behärskning av själva koden. De verifierade framgångsgraderna visar en skillnad på endast 7 poäng mellan ingenjörer och icke-utvecklare som är experter inom sitt område. Det är vägledande information för produktteam: målgruppen för AI-kodningsverktyg är inte längre enbart utvecklare, och gränssnittens utformning måste ta hänsyn till detta.

När det gäller utvecklarverktyg sammanfaller flera signaler den 16 juni: den betalda GA-versionen av GitHub Code Quality ($10/aktiv utvecklare), tillgängligheten av Codex med Computer Use i EES/UK/Schweiz, de detaljerade behörigheterna i Claude Code v2.1.178 och OpenAI:s metod Deployment Simulation. Kodkvalitet och driftsättningssäkerhet går från forskningsområden till avgiftsbelagda produkter — en normalisering som återspeglar den ökande mognaden på marknaden för AI-verktyg för utvecklingsteam.


Källor