ai-powered-markdown-translatorÖversatt artikel från fr till sv med gpt-5.4-mini.
Den här veckan publicerar Meta Muse Glimmer, en multimodal agentisk modell med 30 miljarder parametrar och öppna vikter, omedelbart tillgänglig via en NVIDIA GPU-accelererad endpoint utöver Hugging Face. OpenAI omstrukturerar sitt cybersäkerhetsprogram Daybreak och lanserar GPT-5.6-Cyber, en modell som redan har lett till upptäckten av en tidigare okänd sårbarhet i Chromes JavaScript-motor. En annan uppmärksammad händelse: en opublicerad forskningsversion av Claude har gjort framsteg i ett matematiskt problem kopplat till Riemann-hypotesen, med formellt verifierat bevis. På menyn också: Anthropic-prissättning, utvecklarverktyg, företags-VI-tal och AI-native finans.
Meta publicerar Muse Glimmer, agentisk 30B-modell med öppna vikter, tillgänglig via NVIDIA
Meta har publicerat Muse Glimmer, en tät multimodal modell med 30 miljarder parametrar (2B visuell encoder + 28B textdecoder) optimerad för att köras lokalt, kontinuerligt, på konsumenthårdvara — Mac eller PC utrustad med en kraftfull GPU. Vikterna distribueras under licensen Apache 2.0. Modellen hanterar ett kontextfönster på över 120 000 tokens och når, enligt NVIDIA, upp till 20 000 tokens per sekund på en enda GPU; Alexandr Wang (Meta Superintelligence Labs) uppger att den körs på 24 GB VRAM utan förlust av agentisk tillförlitlighet.
Tekniskt kombinerar Muse Glimmer attention med glidande fönster och full attention, en Gated Grouped-Query Attention-arkitektur som minskar minnescachen med en faktor 16, samt en lättvikts-Draft-modell, DFlash, som snabbar upp genereringen med 2 till 4x. Stöd finns från dag 0 i transformers, llama.cpp och vLLM, med kvantiserade GGUF-vikter och deployment via Hugging Face Inference Endpoints.
| Tekniskt kännetecken | Mätt värde |
|---|---|
| Parametrar | 30B (encoder 2B + decoder 28B) |
| Licens | Apache 2.0 |
| Kontextfönster | 120 000+ tokens |
| Minsta VRAM | 24 GB |
| Genomströmning (1 GPU) | upp till 20 000 tokens/s |
| MCP Atlas (agentisk) | 75,5 (mot 54,2–62,5 för konkurrenterna) |
NVIDIA har omedelbart öppnat en GPU-accelererad åtkomstpunkt för att testa Muse Glimmer, optimerad för dess edge-, desktop- och workstation-plattformar — en konkret tillgänglighet som komplement till nedladdningen av vikterna.
Introducing Muse Glimmer, an open-weight 30B-parameter model optimized for local, always-on agent workflows. […] we’re releasing model weights under a permissive Apache 2.0 license.
🇸🇪 Presentation av Muse Glimmer, en modell med öppna vikter och 30 miljarder parametrar som är optimerad för lokala och permanenta agentarbetsflöden. […] vi publicerar modellens vikter under den tillåtande Apache 2.0-licensen. — @AIatMeta på X
🔗 NVIDIA erbjuder en GPU-accelererad endpoint för Muse Glimmer
OpenAI utvidgar Daybreak och lanserar GPT-5.6-Cyber, en tidigare okänd CVE upptäckt i Chrome
OpenAI omstrukturerar sitt cybersäkerhetsprogram Daybreak i två åtkomstnivåer och lanserar GPT-5.6-Cyber, en specialiserad modell byggd på GPT-5.6 Sol. Det uttalade målet: att sätta ledande intelligens i händerna på betrodda försvarare innan offensiva förmågor blir allmänt spridda bland angripare.
| Åtkomstnivå | Använd modell | Avsedd publik |
|---|---|---|
| Daybreak Blue | GPT-5.6 Sol (systemskydd borttagna) | Rekommenderad ingångspunkt för majoriteten av försvarare |
| Daybreak Red | GPT-5.6-Cyber (ny) | Erfarna säkerhetsforskare, avancerat auktoriserat arbete |
GPT-5.6-Cyber minskar avslag på vissa högriskfrågor med dubbel användning (till exempel pentest mot produktionssystem) och överträffar GPT-5.6 Sol samt den tidigare GPT-5.5 Cyber på ExploitGym 2. I verkliga förhållanden ledde modellen till upptäckten av två tidigare okända sårbarheter i V8, Chromes JavaScript-motor, som gjorde det möjligt att korrumpera minnet och rymma från heap-sandlådan; efter samordnad rapportering till Google korrigerades felet och registrerades som CVE-2026-15903. Den identifierade också minst fem sårbarheter i ett populärt mobilt operativsystem, tre kritiska brister i en populär databas och över 400 sårbarheter för privilegieeskalering i en populär operativsystemskärna — rättningar pågår tillsammans med Daybreak-partnerna.
OpenAI kräver hårdvarubaserade säkerhetsnycklar för alla individuella Daybreak-konton från och med 1 september 2026, och ett Daybreak Cyber Partner-program samlar redan leverantörer (Accenture, IBM, KPMG) och säkerhetsutgivare (Palo Alto Networks, CrowdStrike, Cisco) för att integrera dessa modeller i sina tjänster.
We’re expanding our cybersecurity initiative Daybreak and introducing GPT-5.6-Cyber, a new model for advanced, authorized cybersecurity work.
🇸🇪 Vi utvidgar vårt Daybreak-initiativ för cybersäkerhet och lanserar GPT-5.6-Cyber, en ny modell för avancerat och auktoriserat cybersäkerhetsarbete. — @OpenAI på X
🔗 Utvidga Daybreak när fönstret för cyberförsvar krymper
Claude gör framsteg kring Riemann-hypotesen, utan att lösa den
Anthropic bad en opublicerad forskningsversion av Claude att ge sig på Riemann-hypotesen, ett av de sju Millenniepris-problemen från Clay Mathematics Institute (1 miljon dollar vardera). Claude löste inte problemet, men gjorde framsteg i en närliggande fråga: den höjde den nedre gränsen för andelen nollställen i Riemanns zetafunktion som uppfyller hypotesen, från 41,6 % till 67,2 %.
Arbetet genomfördes i två sessioner med totalt 31 miljoner utmatningstokens. Den första genererade 650 initiala idéer, alla utan resultat. För det andra försöket samordnade Claude 60 specialiserade underagenter (matematisk utveckling, idégenerering, validering, skrivande), körde 2 400 shell-kommandon och hämtade 54 artiklar från arXiv för att verifiera sina spår. Resultatet granskades sedan av två matematiker på Anthropic och därefter av de externa experterna Brian Conrey och Dan Goldston. Claude producerade ett bevis formellt verifierat i Lean, som klarade standardvalideringen.
Detta resultat ligger utanför den vanliga benchmark-ramen: en mätbar förbättring på ett problem som varit öppet i årtionden, med oberoende verifiering och formellt bevis, visar hur Anthropic nu testar sina forskningsmodeller på fundamentala matematikproblem snarare än på klassiska programvaruingenjörsuppgifter.
We asked an unreleased research version of Claude to take a stab at the Riemann hypothesis. It didn’t solve it, but it did make strides on a related problem: it increased the lower bound for the fraction of zeros of the Riemann zeta function that satisfy the hypothesis from 41.6% to 67.2%.
🇸🇪 Vi bad en opublicerad forskningsversion av Claude att försöka lösa Riemann-hypotesen. Den löste den inte, men gjorde framsteg i ett närliggande problem: den höjde den nedre gränsen för andelen nollställen i Riemanns zetafunktion som uppfyller hypotesen från 41,6 % till 67,2 %. — @AnthropicAI på X
🔗 Fullständig metoddetalj på Anthropics forskningsblogg
Anthropic: prissättning och säkerhet
Lanseringspriset för Sonnet 5 blir permanent
Anthropic bekräftar att lanseringspriset för Claude Sonnet 5 — $2 per miljon tokens in, $10 per miljon tokens ut — blir permanent. Modellen lanserades i juni med detta pris presenterat som kampanjpris, giltigt till och med 31 augusti 2026. Anthropic undanröjer därmed osäkerheten för team som byggt sina kostnadsprognoser kring detta lanseringspris: ingen höjning är att vänta till hösten för denna modell, vilket stärker dess prisposition mot konkurrenterna i användningsfall med hög tokenvolym.
Prompt injection är ”i stort sett löst” enligt Anthropic
Boris Cherny, produktchef för Claude Code på Anthropic, hävdar att prompt injection — den vanligaste attackmetoden mot användare och AI-agenter, där en skadlig webbplats eller ett dokument smugglar in en dold instruktion som modellen kör — nu är i praktiken i stort sett löst med Claude-modellerna. Han förklarar att framsteget främst kommer från modellträning, kompletterat med flera lager av säkerhetsklassificerare: kombinationen modell + detektor (probe) + automatiskt läge skulle sänka attackernas framgångsgrad till 0 %, ett upplägg som blir Claude Codes standardläge för behörighet den 14 augusti. Detta är ett offentligt uttalande på X, inte en formell forskningspublikation med detaljerad metodik.
🔗 Tweet
Utvecklarverktyg: Amp går över till OpenAI, Copilot Chat förbättras
Amp byter sitt modesystem till OpenAI om ett ChatGPT-abonnemang är kopplat
Det agentiska kodverktyget Amp ändrar sin routningslogik för sina lägen (“the Dial”) när ett konto är kopplat till ett ChatGPT-abonnemang. Med ett kopplat abonnemang går low-, medium- och high-lägena över till OpenAI-modeller (GPT-5.6 Terra för low-läget och kodgranskning, GPT-5.6 Sol för agenten och oraklet i high-läget) istället för GLM-5.2 eller Claude Fable. Utan kopplat abonnemang ändras inget. Amp motiverar att Claude Fable överges som orakelmodell med en konvergens i frontiermodellernas prestanda: medgrundaren @sqs anser det osannolikt att ett framtida test skulle motivera den 80x stora prisskillnaden mellan Fable och de använda OpenAI-modellerna. Ultra-läget påverkas inte och fortsätter att köras på Claude Fable.
Copilot Chat på github.com: förbättrade samtalskontroller
GitHub uppdaterar Copilot Chat på github.com med tre förbättringar, allmänt tillgängliga för alla planer. Åtkomsten till senaste konversationer underlättas, chattfönstret kan nu minimeras medan ett svar genereras och sedan öppnas igen för att återuppta samtalet, och en indikator för tokenförbrukning visas direkt i chatten — med detaljer per session och per meddelande. Dessa justeringar är förbättringar av användbarheten snarare än en större funktion, men de svarar mot ett konkret dagligt användningsfall för konton med begränsade Copilot-kvoter.
🔗 Copilot på webben utökar samtalskontrollerna
Öppen källkod och inferens-ekosystem
NVIDIA publicerar Magpie TTS Multilingual, öppen TTS för röstagenter på 12 språk
NVIDIA publicerar Magpie TTS Multilingual, en modell för talsyntes med öppna vikter och omkring 357 miljoner parametrar, under licensen NVIDIA Open Model License, som täcker tolv språk (inklusive franska) med både manlig och kvinnlig röst för vart och ett. Latensen till första ljudet når 32 ms i enkelström på B200-GPU (239 ms med 64 samtidiga strömmar), 47 ms på H100 och 79 ms på A100, med en realtidsfaktor upp till 320x. Teckenfelfrekvensen sjunker också: från 2,70 % till 1,54 % för franska, från 1,14 % till 0,60 % för spanska. Deployment är möjlig via öppna vikter på Hugging Face eller via NVIDIA NIM i produktion.
🔗 Bygg flerspråkiga röstagenter med låg latens
En destillationsteknik minskar GPU-minnet som krävs med upp till 15x
Multiverse Computing publicerar en kunskapsdestillationsteknik som kombinerar offline-cache av lärarens logits och en sammanslagen KL-förlustfunktion som undviker att materialisera hela matrisen vokabulär × sekvenslängd. Resultatet: GPU-minnet går från 85,2 GB till 5,45 GB vid 32K kontexttokens (upp till 15,6x minskning), och destillationen av en GPT-OSS 20B-modell gick från fyra GPU-noder till en enda, med en ungefär 5x kortare iterationstid. Tillämpad på GPT-OSS 120B och Kimi-K3 (2,8T parametrar) behåller tekniken omkring 90 % av lärarens precision på BoolQ och HellaSwag. Koden publiceras som öppen källkod på GitHub.
🔗 Gör kunskapsdestillation tillräckligt billig för att köras i stor skala
DeepSeek-V4-Flash tillgänglig på Ollama-cloud via Together AI
Together AI tillhandahåller nu inferensinfrastrukturen bakom DeepSeek-V4-Flash på Ollamas moln, beskrivet som den prestandastarkaste tillgängliga hostingen för denna modell med öppna vikter. Erbjudandet lyfter fram en policy för noll datalagring samt hosting i USA och Europeiska unionen — ett suveränitetsargument för företag som vill använda DeepSeek-V4-Flash utan att vara beroende av kinesisk infrastruktur. Detta är en ny distributionskanal som läggs till den redan befintliga tillgängligheten av DeepSeek-V4-Flash direkt på Together AI.
🔗 Tweet
Sakana AI tränar sin orchestrator Fugu på en Gemma 4-basis
Sakana AI publicerar en ny version av chef-modellen i sitt multi-agent-orchestreringsprodukt Fugu, denna gång tränad på den öppna modellen Gemma 4, som komplement till den redan erbjudna utbytbara modellpoolen. Den tvålagrade arkitekturen — en liten chefmodell som fördelar uppgifterna, och en modellpool som utför själva bearbetningen — bygger på forskningen Trinity och Conductor som presenterades på ICLR 2026. Interna utvärderingar visar en orchestration-prestanda i nivå med den tidigare versionen, med lägre kostnad. Sakana AI siktar också på sikt på egna chefmodeller för att möta kraven på digital suveränitet i Japan.
Together AI beskriver sitt partnerskap med Cursor för realtidsinference
Together AI publicerar en artikel medförfattad med Cursor som beskriver deras partnerskap för inferensinfrastruktur: agenter integrerade i redigeraren genererar kod medan utvecklare aktivt redigerar sin fil, vilket ställer strikta latenskrav — modellens svar måste passa in i redigerarens feedbackloop utan att bryta arbetsflödet. Artikeln illustrerar hur Together AI har byggt sin infrastruktur för att uppfylla dessa mål i stor skala, ett konkret användningsfall för deras dedikerade inferenserbjudanden för AI-assisterade utvecklarverktyg.
🔗 Tweet
Generativ media: ElevenLabs hos Deutsche Telekom, MiniMax beskriver H3
ElevenLabs rullar ut sin AI-röstteknik hos Deutsche Telekom
ElevenLabs annonserar ett partnerskap med Deutsche Telekom, Europas största teleoperatör, för att integrera sin AI-röstteknik på tre nivåer: kontaktcentret, konsumentappen och själva nätverket. Den AI-drivna samtalsassistenten körs på ElevenLabs och är direkt integrerad i nätverket, vilket gör den tillgänglig på vilken mobil enhet som helst som kan ringa samtal, utan dedikerad app — med liveassistans under samtal, översättning i realtid och transkribering/sammanfattning av samtal. Partnerskapet började som en uppsättning appfunktioner i början av 2025 och utvecklades till en integration i kärnan av Deutsche Telekoms tjänster, med planerad utvidgning.
🔗 Tweet
MiniMax beskriver H3:s open source-roadmap i detalj
Efter en AMA-session på Reddit publicerar MiniMax en sammanfattning av open source-roadmapen för sin videomodell H3. En övergång till licensen Apache-2.0 ligger ”på bordet” när upphovsrättsfrågorna väl har klargjorts, med en fullständig teknisk rapport på väg. MiniMax planerar också att öppna vikterna för H3-Regenerate-2K, en latent rymdmodeller för regenerering som gör det möjligt att köra om ett 768p-resultat i 2K, en implementation av sparse attention, en låg-latensvariant 4-NFE/8-NFE under utvärdering, samt en enhetlig modell för bildgenerering/redigering härledd från H3-familjen. Ref2VA-arbetsflödet gör redan det möjligt att kedja samman klipp för att producera videor på 60 sekunder.
🔗 Tweet
Multimodala agenter och AI-native finance
Qwen-MM-Plugins: att göra agenter multimodal-native
AlibabaQwen tillkännager Qwen-MM-Plugins, en familj av plugins som är avsedd att göra vilken agentkörningsmiljö som helst (_agent harness) multimodal-native: bildläsning, video- och dokumentläsning, videoredigering samt arbete med 3D/CAD-filer. Tanken: i stället för en isolerad multimodal modell kommer ett lager av plugins att läggas ovanpå den miljö som utvecklaren redan använder. Tillkännagivandet specificerar varken benchmarks, prissättning eller exakt tillgänglighetsdatum — det stannar på produktteaser-nivå, med en videodemonstration som stöd. Denna lansering förlänger Qwens 2026-strategi, som nu utvidgar sitt erbjudande mot multimodala agentverktyg snarare än nya vikter för råa modeller.
🔗 Tweet
Fem lärdomar för att bygga en AI-native finance-funktion
OpenAIs CFO, Sarah Friar, delar fem lärdomar för att bygga en AI-native finance-funktion, kring två ambitioner: en noll-dagarsstängning (realtidsvy, avstämd och spårbar översikt över företagets finanser) och kontinuerlig prognostisering. Bland lärdomarna: ge alla åtkomst och skapa sedan en anledning att använda den — illustrerat av en finance-hackathon som gav upphov till IR-GPT, en anpassad GPT för att besvara investerares due diligence-frågor; kombinera experimentering underifrån och upp med strategi uppifrån och ned; gå bortom statiska kalkylblad till förmån för levande verktyg som stöds av den fullständiga verksamhetskontexten; bygga ett tydligt ansvar i varje arbetsflöde; och mäta avkastningen på AI-investeringar.
🔗 Building an AI-native finance function
Premium-säten kommer till ChatGPT Business
OpenAI lanserar Premium-säten för ChatGPT Business, som ger de mest aktiva medarbetarna 5 gånger mer användning än Standard-säten och ingen femtimmarsgräns för användning.
| Sätestyp | Månadspris | Årspris (per månad) |
|---|---|---|
| Standard | $25/användare | $20/användare |
| Premium | $125/användare | $100/användare |
Företag kan blanda Standard- och Premium-säten inom samma arbetsyta. Lanseringserbjudande: ägare av arbetsytor som registrerar sig före 20 augusti 2026 får $100 i krediter per tillagt Premium-säte (upp till $500 för fem säten), med möjlig tidig åtkomst före allmän tillgänglighet.
🔗 Premium seats for ChatGPT Business
Kortnytt
- Claude Code — förbättrad CPU- och minnesprestanda: teamet uppger betydande förbättringar i CPU-användning och minne vid 99:e percentilen (P99 RSS) under de senaste månaderna, utan att några exakta siffror kommunicerats. 🔗 Tweet
- Replits VD beskriver ”self-driving company” i Platformer: Amjad Masad beskriver sin vision av ett företag som styrs av en intern bot och agenter som använder apparna i stället för människor. 🔗 Tweet
- Sakana AI utökar sitt RSI Lab till fysisk AI: företaget vill bygga världsmodeller för fysisk AI och rekryterar på heltid och för praktik i Tokyo. 🔗 Tweet
- FC Bayern München går samman med Google Pixel och Gemini: partnerskap tillkännagivet utan detaljer om dess exakta karaktär (sponsring, produktintegration). 🔗 Tweet
- Gemini, råd för att besöka amerikanska jordbruks- och lantbruksmässor: livsstilsartikel på Googles blogg som listar fem befintliga användningsområden för Gemini (rutter, Ask Maps, AI Mode, Gemini Live, fotoredigering), utan någon ny funktion. 🔗 Google Blog
- GitHub-fakturering i Indien: kunder kan nu aktivera återkommande automatisk betalning med sparat kort, via ett elektroniskt mandat som följer Reserve Bank of India. 🔗 Changelog
- GitHub avvecklar anpassade prenumerationer per tråd: endast lägena Subscribed/Not subscribed kommer att förbli tillgängliga, och befintliga anpassade prenumerationer kommer automatiskt att växla till Subscribed. 🔗 Changelog
- NVIDIA optimerar vLLM för Qwen 3.5 på GB200: optimeringarna når 25 000 tokens per sekund och per GPU, inför lanseringen av Qwen 3.8. 🔗 Tweet
- Codex Build Week — projekt och vinnare på väg: OpenAI uppger att deltagarna har förvandlat sina idéer till verkliga projekt med Codex; tillkännagivandet av vinnarna kommer senare. 🔗 Tweet
- OpenAIs brev till Texas guvernör: företaget beskriver sitt engagemang för en ansvarsfull utveckling av AI-infrastruktur i delstaten. 🔗 OpenAI
- Model ML påskyndar finance-arbetet med GPT-5.6 Sol: byrån automatiserar produktionen av spårbara PowerPoint-presentationer och Excel-arbetsböcker, med 36 % färre tokens än Opus 5 i ett Excel-arbetsflöde. 🔗 OpenAI
Vad det betyder
Kapplöpningen om öppna vikter accelererar och blir mer diversifierad: Meta (Muse Glimmer), Alibaba (Qwen-MM-Plugins), MiniMax (H3-roadmapen) och Sakana AI (Fugu på Gemma 4) publicerar alla samma vecka återanvändbara byggblock snarare än bara slutna modeller. Trenden går bortom enbart text: NVIDIA släpper en flerspråkig TTS med 357M parametrar, och Sakana AI motiverar uttryckligen sitt val med digital suveränitet — ett argument som också återkommer hos Together AI för drift av DeepSeek-V4-Flash i EU och USA.
AI-säkerheten går från labbet till konkret produktion. OpenAIs GPT-5.6-Cyber nöjer sig inte med en benchmarksiffra: den fick en faktisk CVE i V8 åtgärdad och hundratals sårbarheter på andra håll, samtidigt som den åtföljs av ett förstärkt åtkomstregim (obligatoriska hårdvarunycklar från och med september). I spegelbild hävdar Anthropic att de har neutraliserat prompt-injektion på försvarssidan tack vare en stapling av modell + klassificerare — två kompletterande angreppssätt (verktygsstödd attack å ena sidan, förstärkt försvar å den andra) som visar att säkerhet blir en egen produktdifferentierande axel, inte ett sidospår.
På infrastruktursidan fortsätter inferensekonomin att pressas: distillationstekniken från Multiverse Computing delar det nödvändiga GPU-minnet med 15, Together AI stärker sitt partnerskap med Cursor för att hålla strikta latenkrav vid kodredigering, och Anthropic stabiliserar långsiktigt priset på Sonnet 5. Samlat visar dessa rörelser på ett fortsatt tryck på inferenskostnaderna i takt med att agentiska och interaktiva användningsfall blir allmänt spridda.
Slutligen etablerar sig AI lika mycket i företagens stödfunktioner som i den grundläggande forskningen. OpenAI dokumenterar hur deras egen finance blir AI-native och lanserar ChatGPT Business-säten med förstärkt kapacitet, samtidigt som Model ML rapporterar konkreta tokenvinster i Excel-arbetsflöden. I den andra änden av spektrumet påminner Claude-resultatet om Riemann-förmodan — formellt verifierat och genomläst av externa matematiker — om att dessa samma modeller också arbetar med grundforskningsproblem, långt från produktanvändningsfall.
Källor
- Meta lanserar Muse Glimmer
- NVIDIA — GPU-accelererad endpoint Muse Glimmer
- OpenAI — Expanding Daybreak as the cyber defense window narrows
- OpenAI — tillkännagivande av Daybreak/GPT-5.6-Cyber på X
- Anthropic — tillkännagivande av Riemann på X
- Anthropic — forskningsinlägg om Riemann
- Anthropic — permanent pris för Sonnet 5
- Anthropic — prompt-injektion i stor utsträckning löst
- Amp — We changed the Dial
- GitHub — Copilot på webben utökar samtalskontroller
- NVIDIA — Magpie TTS Multilingual
- Multiverse Computing — kunskapsdistillation
- Together AI — DeepSeek-V4-Flash på Ollama
- Sakana AI — Fugu × Gemma 4
- Together AI — partnerskap med Cursor
- ElevenLabs — partnerskap med Deutsche Telekom
- MiniMax — H3-roadmap
- Alibaba_Qwen — Qwen-MM-Plugins
- OpenAI — Building an AI-native finance function
- OpenAI — Premium seats for ChatGPT Business
- Claude Code — förbättringar i CPU-/minnesprestanda
- Replit — self-driving company
- Sakana AI — RSI Lab fysisk AI
- FC Bayern Munich × Google Pixel × Gemini
- Google Blog — Gemini och jordbruksmässor
- GitHub — fakturering i Indien
- GitHub — avveckling av trådbaserade prenumerationer
- vLLM/NVIDIA — optimeringar för Qwen 3.5
- OpenAIDevs — Codex Build Week
- OpenAI — brev till Texas guvernör
- OpenAI — Model ML