Sök

Meta publicerar Muse Glimmer som öppen källkod, OpenAI lanserar GPT-5.6-Cyber för cyberförsvar, Claude gör framsteg kring Riemann-hypotesen

Artikel genererad av artificiell intelligens
Meta publicerar Muse Glimmer som öppen källkod, OpenAI lanserar GPT-5.6-Cyber för cyberförsvar, Claude gör framsteg kring Riemann-hypotesen

ai-powered-markdown-translator

Översatt artikel från fr till sv med gpt-5.4-mini.

Visa projekt på GitHub ↗

Den här veckan publicerar Meta Muse Glimmer, en multimodal agentisk modell med 30 miljarder parametrar och öppna vikter, omedelbart tillgänglig via en NVIDIA GPU-accelererad endpoint utöver Hugging Face. OpenAI omstrukturerar sitt cybersäkerhetsprogram Daybreak och lanserar GPT-5.6-Cyber, en modell som redan har lett till upptäckten av en tidigare okänd sårbarhet i Chromes JavaScript-motor. En annan uppmärksammad händelse: en opublicerad forskningsversion av Claude har gjort framsteg i ett matematiskt problem kopplat till Riemann-hypotesen, med formellt verifierat bevis. På menyn också: Anthropic-prissättning, utvecklarverktyg, företags-VI-tal och AI-native finans.


Meta publicerar Muse Glimmer, agentisk 30B-modell med öppna vikter, tillgänglig via NVIDIA

Meta har publicerat Muse Glimmer, en tät multimodal modell med 30 miljarder parametrar (2B visuell encoder + 28B textdecoder) optimerad för att köras lokalt, kontinuerligt, på konsumenthårdvara — Mac eller PC utrustad med en kraftfull GPU. Vikterna distribueras under licensen Apache 2.0. Modellen hanterar ett kontextfönster på över 120 000 tokens och når, enligt NVIDIA, upp till 20 000 tokens per sekund på en enda GPU; Alexandr Wang (Meta Superintelligence Labs) uppger att den körs på 24 GB VRAM utan förlust av agentisk tillförlitlighet.

Tekniskt kombinerar Muse Glimmer attention med glidande fönster och full attention, en Gated Grouped-Query Attention-arkitektur som minskar minnescachen med en faktor 16, samt en lättvikts-Draft-modell, DFlash, som snabbar upp genereringen med 2 till 4x. Stöd finns från dag 0 i transformers, llama.cpp och vLLM, med kvantiserade GGUF-vikter och deployment via Hugging Face Inference Endpoints.

Tekniskt känneteckenMätt värde
Parametrar30B (encoder 2B + decoder 28B)
LicensApache 2.0
Kontextfönster120 000+ tokens
Minsta VRAM24 GB
Genomströmning (1 GPU)upp till 20 000 tokens/s
MCP Atlas (agentisk)75,5 (mot 54,2–62,5 för konkurrenterna)

NVIDIA har omedelbart öppnat en GPU-accelererad åtkomstpunkt för att testa Muse Glimmer, optimerad för dess edge-, desktop- och workstation-plattformar — en konkret tillgänglighet som komplement till nedladdningen av vikterna.

Introducing Muse Glimmer, an open-weight 30B-parameter model optimized for local, always-on agent workflows. […] we’re releasing model weights under a permissive Apache 2.0 license.

🇸🇪 Presentation av Muse Glimmer, en modell med öppna vikter och 30 miljarder parametrar som är optimerad för lokala och permanenta agentarbetsflöden. […] vi publicerar modellens vikter under den tillåtande Apache 2.0-licensen.@AIatMeta på X

🔗 NVIDIA erbjuder en GPU-accelererad endpoint för Muse Glimmer


OpenAI utvidgar Daybreak och lanserar GPT-5.6-Cyber, en tidigare okänd CVE upptäckt i Chrome

OpenAI omstrukturerar sitt cybersäkerhetsprogram Daybreak i två åtkomstnivåer och lanserar GPT-5.6-Cyber, en specialiserad modell byggd på GPT-5.6 Sol. Det uttalade målet: att sätta ledande intelligens i händerna på betrodda försvarare innan offensiva förmågor blir allmänt spridda bland angripare.

ÅtkomstnivåAnvänd modellAvsedd publik
Daybreak BlueGPT-5.6 Sol (systemskydd borttagna)Rekommenderad ingångspunkt för majoriteten av försvarare
Daybreak RedGPT-5.6-Cyber (ny)Erfarna säkerhetsforskare, avancerat auktoriserat arbete

GPT-5.6-Cyber minskar avslag på vissa högriskfrågor med dubbel användning (till exempel pentest mot produktionssystem) och överträffar GPT-5.6 Sol samt den tidigare GPT-5.5 Cyber på ExploitGym 2. I verkliga förhållanden ledde modellen till upptäckten av två tidigare okända sårbarheter i V8, Chromes JavaScript-motor, som gjorde det möjligt att korrumpera minnet och rymma från heap-sandlådan; efter samordnad rapportering till Google korrigerades felet och registrerades som CVE-2026-15903. Den identifierade också minst fem sårbarheter i ett populärt mobilt operativsystem, tre kritiska brister i en populär databas och över 400 sårbarheter för privilegieeskalering i en populär operativsystemskärna — rättningar pågår tillsammans med Daybreak-partnerna.

OpenAI kräver hårdvarubaserade säkerhetsnycklar för alla individuella Daybreak-konton från och med 1 september 2026, och ett Daybreak Cyber Partner-program samlar redan leverantörer (Accenture, IBM, KPMG) och säkerhetsutgivare (Palo Alto Networks, CrowdStrike, Cisco) för att integrera dessa modeller i sina tjänster.

We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorized cybersecurity work.

🇸🇪 Vi utvidgar vårt Daybreak-initiativ för cybersäkerhet och lanserar GPT-5.6-Cyber, en ny modell för avancerat och auktoriserat cybersäkerhetsarbete.@OpenAI på X

🔗 Utvidga Daybreak när fönstret för cyberförsvar krymper


Claude gör framsteg kring Riemann-hypotesen, utan att lösa den

Anthropic bad en opublicerad forskningsversion av Claude att ge sig på Riemann-hypotesen, ett av de sju Millenniepris-problemen från Clay Mathematics Institute (1 miljon dollar vardera). Claude löste inte problemet, men gjorde framsteg i en närliggande fråga: den höjde den nedre gränsen för andelen nollställen i Riemanns zetafunktion som uppfyller hypotesen, från 41,6 % till 67,2 %.

Arbetet genomfördes i två sessioner med totalt 31 miljoner utmatningstokens. Den första genererade 650 initiala idéer, alla utan resultat. För det andra försöket samordnade Claude 60 specialiserade underagenter (matematisk utveckling, idégenerering, validering, skrivande), körde 2 400 shell-kommandon och hämtade 54 artiklar från arXiv för att verifiera sina spår. Resultatet granskades sedan av två matematiker på Anthropic och därefter av de externa experterna Brian Conrey och Dan Goldston. Claude producerade ett bevis formellt verifierat i Lean, som klarade standardvalideringen.

Detta resultat ligger utanför den vanliga benchmark-ramen: en mätbar förbättring på ett problem som varit öppet i årtionden, med oberoende verifiering och formellt bevis, visar hur Anthropic nu testar sina forskningsmodeller på fundamentala matematikproblem snarare än på klassiska programvaruingenjörsuppgifter.

We asked an unreleased research version of Claude to take a stab at the Riemann hypothesis. It didn’t solve it, but it did make strides on a related problem: it increased the lower bound for the fraction of zeros of the Riemann zeta function that satisfy the hypothesis from 41.6% to 67.2%.

🇸🇪 Vi bad en opublicerad forskningsversion av Claude att försöka lösa Riemann-hypotesen. Den löste den inte, men gjorde framsteg i ett närliggande problem: den höjde den nedre gränsen för andelen nollställen i Riemanns zetafunktion som uppfyller hypotesen från 41,6 % till 67,2 %.@AnthropicAI på X

🔗 Fullständig metoddetalj på Anthropics forskningsblogg


Anthropic: prissättning och säkerhet

Lanseringspriset för Sonnet 5 blir permanent

Anthropic bekräftar att lanseringspriset för Claude Sonnet 5 — $2 per miljon tokens in, $10 per miljon tokens ut — blir permanent. Modellen lanserades i juni med detta pris presenterat som kampanjpris, giltigt till och med 31 augusti 2026. Anthropic undanröjer därmed osäkerheten för team som byggt sina kostnadsprognoser kring detta lanseringspris: ingen höjning är att vänta till hösten för denna modell, vilket stärker dess prisposition mot konkurrenterna i användningsfall med hög tokenvolym.

🔗 Tillkännagivande

Prompt injection är ”i stort sett löst” enligt Anthropic

Boris Cherny, produktchef för Claude Code på Anthropic, hävdar att prompt injection — den vanligaste attackmetoden mot användare och AI-agenter, där en skadlig webbplats eller ett dokument smugglar in en dold instruktion som modellen kör — nu är i praktiken i stort sett löst med Claude-modellerna. Han förklarar att framsteget främst kommer från modellträning, kompletterat med flera lager av säkerhetsklassificerare: kombinationen modell + detektor (probe) + automatiskt läge skulle sänka attackernas framgångsgrad till 0 %, ett upplägg som blir Claude Codes standardläge för behörighet den 14 augusti. Detta är ett offentligt uttalande på X, inte en formell forskningspublikation med detaljerad metodik.

🔗 Tweet


Utvecklarverktyg: Amp går över till OpenAI, Copilot Chat förbättras

Amp byter sitt modesystem till OpenAI om ett ChatGPT-abonnemang är kopplat

Det agentiska kodverktyget Amp ändrar sin routningslogik för sina lägen (“the Dial”) när ett konto är kopplat till ett ChatGPT-abonnemang. Med ett kopplat abonnemang går low-, medium- och high-lägena över till OpenAI-modeller (GPT-5.6 Terra för low-läget och kodgranskning, GPT-5.6 Sol för agenten och oraklet i high-läget) istället för GLM-5.2 eller Claude Fable. Utan kopplat abonnemang ändras inget. Amp motiverar att Claude Fable överges som orakelmodell med en konvergens i frontiermodellernas prestanda: medgrundaren @sqs anser det osannolikt att ett framtida test skulle motivera den 80x stora prisskillnaden mellan Fable och de använda OpenAI-modellerna. Ultra-läget påverkas inte och fortsätter att köras på Claude Fable.

🔗 Vi ändrade Dial

Copilot Chat på github.com: förbättrade samtalskontroller

GitHub uppdaterar Copilot Chat på github.com med tre förbättringar, allmänt tillgängliga för alla planer. Åtkomsten till senaste konversationer underlättas, chattfönstret kan nu minimeras medan ett svar genereras och sedan öppnas igen för att återuppta samtalet, och en indikator för tokenförbrukning visas direkt i chatten — med detaljer per session och per meddelande. Dessa justeringar är förbättringar av användbarheten snarare än en större funktion, men de svarar mot ett konkret dagligt användningsfall för konton med begränsade Copilot-kvoter.

🔗 Copilot på webben utökar samtalskontrollerna


Öppen källkod och inferens-ekosystem

NVIDIA publicerar Magpie TTS Multilingual, öppen TTS för röstagenter på 12 språk

NVIDIA publicerar Magpie TTS Multilingual, en modell för talsyntes med öppna vikter och omkring 357 miljoner parametrar, under licensen NVIDIA Open Model License, som täcker tolv språk (inklusive franska) med både manlig och kvinnlig röst för vart och ett. Latensen till första ljudet når 32 ms i enkelström på B200-GPU (239 ms med 64 samtidiga strömmar), 47 ms på H100 och 79 ms på A100, med en realtidsfaktor upp till 320x. Teckenfelfrekvensen sjunker också: från 2,70 % till 1,54 % för franska, från 1,14 % till 0,60 % för spanska. Deployment är möjlig via öppna vikter på Hugging Face eller via NVIDIA NIM i produktion.

🔗 Bygg flerspråkiga röstagenter med låg latens

En destillationsteknik minskar GPU-minnet som krävs med upp till 15x

Multiverse Computing publicerar en kunskapsdestillationsteknik som kombinerar offline-cache av lärarens logits och en sammanslagen KL-förlustfunktion som undviker att materialisera hela matrisen vokabulär × sekvenslängd. Resultatet: GPU-minnet går från 85,2 GB till 5,45 GB vid 32K kontexttokens (upp till 15,6x minskning), och destillationen av en GPT-OSS 20B-modell gick från fyra GPU-noder till en enda, med en ungefär 5x kortare iterationstid. Tillämpad på GPT-OSS 120B och Kimi-K3 (2,8T parametrar) behåller tekniken omkring 90 % av lärarens precision på BoolQ och HellaSwag. Koden publiceras som öppen källkod på GitHub.

🔗 Gör kunskapsdestillation tillräckligt billig för att köras i stor skala

DeepSeek-V4-Flash tillgänglig på Ollama-cloud via Together AI

Together AI tillhandahåller nu inferensinfrastrukturen bakom DeepSeek-V4-Flash på Ollamas moln, beskrivet som den prestandastarkaste tillgängliga hostingen för denna modell med öppna vikter. Erbjudandet lyfter fram en policy för noll datalagring samt hosting i USA och Europeiska unionen — ett suveränitetsargument för företag som vill använda DeepSeek-V4-Flash utan att vara beroende av kinesisk infrastruktur. Detta är en ny distributionskanal som läggs till den redan befintliga tillgängligheten av DeepSeek-V4-Flash direkt på Together AI.

🔗 Tweet

Sakana AI tränar sin orchestrator Fugu på en Gemma 4-basis

Sakana AI publicerar en ny version av chef-modellen i sitt multi-agent-orchestreringsprodukt Fugu, denna gång tränad på den öppna modellen Gemma 4, som komplement till den redan erbjudna utbytbara modellpoolen. Den tvålagrade arkitekturen — en liten chefmodell som fördelar uppgifterna, och en modellpool som utför själva bearbetningen — bygger på forskningen Trinity och Conductor som presenterades på ICLR 2026. Interna utvärderingar visar en orchestration-prestanda i nivå med den tidigare versionen, med lägre kostnad. Sakana AI siktar också på sikt på egna chefmodeller för att möta kraven på digital suveränitet i Japan.

🔗 Fugu × Gemma 4

Together AI beskriver sitt partnerskap med Cursor för realtidsinference

Together AI publicerar en artikel medförfattad med Cursor som beskriver deras partnerskap för inferensinfrastruktur: agenter integrerade i redigeraren genererar kod medan utvecklare aktivt redigerar sin fil, vilket ställer strikta latenskrav — modellens svar måste passa in i redigerarens feedbackloop utan att bryta arbetsflödet. Artikeln illustrerar hur Together AI har byggt sin infrastruktur för att uppfylla dessa mål i stor skala, ett konkret användningsfall för deras dedikerade inferenserbjudanden för AI-assisterade utvecklarverktyg.

🔗 Tweet


Generativ media: ElevenLabs hos Deutsche Telekom, MiniMax beskriver H3

ElevenLabs rullar ut sin AI-röstteknik hos Deutsche Telekom

ElevenLabs annonserar ett partnerskap med Deutsche Telekom, Europas största teleoperatör, för att integrera sin AI-röstteknik på tre nivåer: kontaktcentret, konsumentappen och själva nätverket. Den AI-drivna samtalsassistenten körs på ElevenLabs och är direkt integrerad i nätverket, vilket gör den tillgänglig på vilken mobil enhet som helst som kan ringa samtal, utan dedikerad app — med liveassistans under samtal, översättning i realtid och transkribering/sammanfattning av samtal. Partnerskapet började som en uppsättning appfunktioner i början av 2025 och utvecklades till en integration i kärnan av Deutsche Telekoms tjänster, med planerad utvidgning.

🔗 Tweet

MiniMax beskriver H3:s open source-roadmap i detalj

Efter en AMA-session på Reddit publicerar MiniMax en sammanfattning av open source-roadmapen för sin videomodell H3. En övergång till licensen Apache-2.0 ligger ”på bordet” när upphovsrättsfrågorna väl har klargjorts, med en fullständig teknisk rapport på väg. MiniMax planerar också att öppna vikterna för H3-Regenerate-2K, en latent rymdmodeller för regenerering som gör det möjligt att köra om ett 768p-resultat i 2K, en implementation av sparse attention, en låg-latensvariant 4-NFE/8-NFE under utvärdering, samt en enhetlig modell för bildgenerering/redigering härledd från H3-familjen. Ref2VA-arbetsflödet gör redan det möjligt att kedja samman klipp för att producera videor på 60 sekunder.

🔗 Tweet


Multimodala agenter och AI-native finance

Qwen-MM-Plugins: att göra agenter multimodal-native

AlibabaQwen tillkännager Qwen-MM-Plugins, en familj av plugins som är avsedd att göra vilken agentkörningsmiljö som helst (_agent harness) multimodal-native: bildläsning, video- och dokumentläsning, videoredigering samt arbete med 3D/CAD-filer. Tanken: i stället för en isolerad multimodal modell kommer ett lager av plugins att läggas ovanpå den miljö som utvecklaren redan använder. Tillkännagivandet specificerar varken benchmarks, prissättning eller exakt tillgänglighetsdatum — det stannar på produktteaser-nivå, med en videodemonstration som stöd. Denna lansering förlänger Qwens 2026-strategi, som nu utvidgar sitt erbjudande mot multimodala agentverktyg snarare än nya vikter för råa modeller.

🔗 Tweet

Fem lärdomar för att bygga en AI-native finance-funktion

OpenAIs CFO, Sarah Friar, delar fem lärdomar för att bygga en AI-native finance-funktion, kring två ambitioner: en noll-dagarsstängning (realtidsvy, avstämd och spårbar översikt över företagets finanser) och kontinuerlig prognostisering. Bland lärdomarna: ge alla åtkomst och skapa sedan en anledning att använda den — illustrerat av en finance-hackathon som gav upphov till IR-GPT, en anpassad GPT för att besvara investerares due diligence-frågor; kombinera experimentering underifrån och upp med strategi uppifrån och ned; gå bortom statiska kalkylblad till förmån för levande verktyg som stöds av den fullständiga verksamhetskontexten; bygga ett tydligt ansvar i varje arbetsflöde; och mäta avkastningen på AI-investeringar.

🔗 Building an AI-native finance function

Premium-säten kommer till ChatGPT Business

OpenAI lanserar Premium-säten för ChatGPT Business, som ger de mest aktiva medarbetarna 5 gånger mer användning än Standard-säten och ingen femtimmarsgräns för användning.

SätestypMånadsprisÅrspris (per månad)
Standard$25/användare$20/användare
Premium$125/användare$100/användare

Företag kan blanda Standard- och Premium-säten inom samma arbetsyta. Lanseringserbjudande: ägare av arbetsytor som registrerar sig före 20 augusti 2026 får $100 i krediter per tillagt Premium-säte (upp till $500 för fem säten), med möjlig tidig åtkomst före allmän tillgänglighet.

🔗 Premium seats for ChatGPT Business


Kortnytt

  • Claude Code — förbättrad CPU- och minnesprestanda: teamet uppger betydande förbättringar i CPU-användning och minne vid 99:e percentilen (P99 RSS) under de senaste månaderna, utan att några exakta siffror kommunicerats. 🔗 Tweet
  • Replits VD beskriver ”self-driving company” i Platformer: Amjad Masad beskriver sin vision av ett företag som styrs av en intern bot och agenter som använder apparna i stället för människor. 🔗 Tweet
  • Sakana AI utökar sitt RSI Lab till fysisk AI: företaget vill bygga världsmodeller för fysisk AI och rekryterar på heltid och för praktik i Tokyo. 🔗 Tweet
  • FC Bayern München går samman med Google Pixel och Gemini: partnerskap tillkännagivet utan detaljer om dess exakta karaktär (sponsring, produktintegration). 🔗 Tweet
  • Gemini, råd för att besöka amerikanska jordbruks- och lantbruksmässor: livsstilsartikel på Googles blogg som listar fem befintliga användningsområden för Gemini (rutter, Ask Maps, AI Mode, Gemini Live, fotoredigering), utan någon ny funktion. 🔗 Google Blog
  • GitHub-fakturering i Indien: kunder kan nu aktivera återkommande automatisk betalning med sparat kort, via ett elektroniskt mandat som följer Reserve Bank of India. 🔗 Changelog
  • GitHub avvecklar anpassade prenumerationer per tråd: endast lägena Subscribed/Not subscribed kommer att förbli tillgängliga, och befintliga anpassade prenumerationer kommer automatiskt att växla till Subscribed. 🔗 Changelog
  • NVIDIA optimerar vLLM för Qwen 3.5 på GB200: optimeringarna når 25 000 tokens per sekund och per GPU, inför lanseringen av Qwen 3.8. 🔗 Tweet
  • Codex Build Week — projekt och vinnare på väg: OpenAI uppger att deltagarna har förvandlat sina idéer till verkliga projekt med Codex; tillkännagivandet av vinnarna kommer senare. 🔗 Tweet
  • OpenAIs brev till Texas guvernör: företaget beskriver sitt engagemang för en ansvarsfull utveckling av AI-infrastruktur i delstaten. 🔗 OpenAI
  • Model ML påskyndar finance-arbetet med GPT-5.6 Sol: byrån automatiserar produktionen av spårbara PowerPoint-presentationer och Excel-arbetsböcker, med 36 % färre tokens än Opus 5 i ett Excel-arbetsflöde. 🔗 OpenAI

Vad det betyder

Kapplöpningen om öppna vikter accelererar och blir mer diversifierad: Meta (Muse Glimmer), Alibaba (Qwen-MM-Plugins), MiniMax (H3-roadmapen) och Sakana AI (Fugu på Gemma 4) publicerar alla samma vecka återanvändbara byggblock snarare än bara slutna modeller. Trenden går bortom enbart text: NVIDIA släpper en flerspråkig TTS med 357M parametrar, och Sakana AI motiverar uttryckligen sitt val med digital suveränitet — ett argument som också återkommer hos Together AI för drift av DeepSeek-V4-Flash i EU och USA.

AI-säkerheten går från labbet till konkret produktion. OpenAIs GPT-5.6-Cyber nöjer sig inte med en benchmarksiffra: den fick en faktisk CVE i V8 åtgärdad och hundratals sårbarheter på andra håll, samtidigt som den åtföljs av ett förstärkt åtkomstregim (obligatoriska hårdvarunycklar från och med september). I spegelbild hävdar Anthropic att de har neutraliserat prompt-injektion på försvarssidan tack vare en stapling av modell + klassificerare — två kompletterande angreppssätt (verktygsstödd attack å ena sidan, förstärkt försvar å den andra) som visar att säkerhet blir en egen produktdifferentierande axel, inte ett sidospår.

På infrastruktursidan fortsätter inferensekonomin att pressas: distillationstekniken från Multiverse Computing delar det nödvändiga GPU-minnet med 15, Together AI stärker sitt partnerskap med Cursor för att hålla strikta latenkrav vid kodredigering, och Anthropic stabiliserar långsiktigt priset på Sonnet 5. Samlat visar dessa rörelser på ett fortsatt tryck på inferenskostnaderna i takt med att agentiska och interaktiva användningsfall blir allmänt spridda.

Slutligen etablerar sig AI lika mycket i företagens stödfunktioner som i den grundläggande forskningen. OpenAI dokumenterar hur deras egen finance blir AI-native och lanserar ChatGPT Business-säten med förstärkt kapacitet, samtidigt som Model ML rapporterar konkreta tokenvinster i Excel-arbetsflöden. I den andra änden av spektrumet påminner Claude-resultatet om Riemann-förmodan — formellt verifierat och genomläst av externa matematiker — om att dessa samma modeller också arbetar med grundforskningsproblem, långt från produktanvändningsfall.


Källor