Sök

Claude Code går över till Auto Mode som standard, Astra klassas som kritisk för cybersäkerhet hos OpenAI, NVIDIA presenterar Cosmos 3

Artikel genererad av artificiell intelligens
Claude Code går över till Auto Mode som standard, Astra klassas som kritisk för cybersäkerhet hos OpenAI, NVIDIA presenterar Cosmos 3

ai-powered-markdown-translator

Artikel översatt från fr till sv med gpt-5.4-mini.

Visa projekt på GitHub ↗

Den 7 augusti 2026 går Claude Code över till Auto Mode som standardläge för behörighet från och med den 14 augusti för planerna Pro, Max och Team, baserat på en intern studie som mätte att 89% av farliga kommandon blockerades jämfört med 14% vid manuell granskning. Samma dag klassar OpenAI för första gången en av sina kommande modeller, Astra, på den kritiska nivån i sitt Preparedness Framework för cybersäkerhet, och NVIDIA presenterar Cosmos 3, en ny familj av öppna modeller för robotik och autonoma fordon som redan har antagits av Doosan, LG, Samsung och Li Auto. Bilden kompletteras av Claude Codes meddelanden mellan sessioner, en lättnad av de biologiska skyddsräcken i Claude Fable 5, allmän tillgänglighet för Seedance 2.5 på Runway och Luma, samt ett femtontal andra tillkännagivanden från GitHub Copilot, Gemini och agentiska kodverktyg.


Claude Code : Auto Mode blir standardläget för behörighet den 14 augusti

7 augusti — Anthropic meddelar att från och med den 14 augusti blir Auto Mode standardläget för behörighet i Claude Code för användare på planerna Pro, Max och Team. I stället för att be om bekräftelse före varje shellkommando eller känslig åtgärd bygger Auto Mode på en separat klassificerare som analyserar varje verktygsanrop och automatiskt blockerar kommandon som bedöms vara farliga, utan att avbryta användaren vid varje steg.

Anthropic motiverar förändringen med en intern studie genomförd med 1 053 betalande testare, som fick en behörighetsfråga för ett tydligt farligt kommando (endast text, ingenting kördes faktiskt). Mänskliga testare upptäckte faran i endast 13,6% av fallen, en andel som sjunker till omkring 5% efter 50 på varandra följande frågor som följd av trötthet. Auto Mode blockerade däremot samma kommandon i 89% av fallen, en stabil andel oavsett sessionens längd.

Mätt indikatorManuell godkännandeAuto Mode
Initial upptäckt13,6%89%
Upptäckt efter 50 frågor~5%89% (stabilt)

En annan konkret förändring: klassificerarens extra tokenkostnad räknas hädanefter inte längre in i användningsgränserna för planerna Pro, Max och Team, och en utvidgning till Enterprise-planerna och API:et planeras när Auto Mode väl har rullats ut överallt. En notis i appen kommer att informera användare om övergången, och administratörer kan fästa defaultMode eller inaktivera Auto Mode via de hanterade inställningarna.

The team and I use Auto mode exclusively, and have been for many months. I couldn’t imagine going back to permission prompts! Really excited to get this out to everyone.

🇸🇪 Tillsammans med teamet har vi använt Auto Mode uteslutande i flera månader. Jag kan inte föreställa mig att gå tillbaka till behörighetsfrågorna! Verkligen glad över att kunna rulla ut det för alla.@bcherny på X

🔗 Tillkännagivande @ClaudeDevs


OpenAI klassar Astra på kritisk nivå för cybersäkerhet

7 augusti — OpenAI meddelar att deras framtida modell Astra är den första som klassas på den kritiska nivån (Critical) för cybersäkerhet enligt deras Preparedness Framework, som publicerades första gången i december 2023. Tidigare modeller, däribland GPT-5.6 Sol, hade endast bedömts på den höga nivån (High) på denna axel.

Enligt ramverket når en modell den kritiska cybersäkerhetsnivån om den kan identifiera och utveckla fungerande zero-day-exploits mot många härdade kritiska system utan mänsklig inblandning, eller från grunden utforma en helt ny cyberangreppsstrategi utifrån ett enkelt mål på hög nivå. Interna utvärderingar under de senaste dagarna på Astra, kombinerade med externa expertbedömningar, har lett OpenAI till slutsatsen att de inte kan utesluta denna kapacitet — därav denna transparensnotis, publicerad redan innan hela testkampanjen är avslutad. Företaget preciserar att Astra inte har varit inblandad i den senaste säkerhetsincidenten hos Hugging Face.

Som följd skärper OpenAI sina interna kontroller: isolerade testmiljöer, begränsad nätverks- och verktygsåtkomst, förstärkt kryptering av modellens vikter, ökad övervakning och körning i sandbox. Interna aktiviteter som involverar Astra och som ännu inte uppfyller dessa krav pausas, och monitorer analyserar nu modellens resonemangskedja i alla dess agentiska tillämpningar för att utlösa en säkerhetsrespons vid högriskbeteende.

After evaluating one of our upcoming models, Astra, we’re treating it as our first “critical” model for cybersecurity under our Preparedness Framework. This is a scenario we’ve planned for, and we’re putting additional controls in place to ensure Astra’s further development happens safely and securely.

🇸🇪 Efter att ha utvärderat en av våra framtida modeller, Astra, behandlar vi den som vår första modell som är «kritisk» när det gäller cybersäkerhet enligt vårt Preparedness Framework. Det är ett scenario vi hade förutsett, och vi inför ytterligare kontroller för att säkerställa att den fortsatta utvecklingen av Astra sker på ett säkert och tryggt sätt.@OpenAI på X

🔗 OpenAI:s transparensnotis


NVIDIA presenterar Cosmos 3, en familj av öppna modeller för fysisk AI

6 augusti — NVIDIA har presenterat Cosmos 3, en ny familj av öppna modeller för fysisk AI — robotik, autonoma fordon, inbyggd vision — utgiven inom serien Into the Omniverse. Tre storlekar erbjuds: Cosmos 3 Super för högfidelitetsmodellering, Cosmos 3 Nano för effektivt resonemang och Cosmos 3 Edge för inbyggd driftsättning.

Cosmos 3-variantParametrarAvsett användningsområde
Cosmos 3 Super64 miljarderHögfidelitetsmodellering
Cosmos 3 Nano16 miljarderEffektivt resonemang
Cosmos 3 Edge4 miljarderInbyggd driftsättning

Familjen gör anspråk på förstaplatsen i flera topplistor: Artificial Analysis (text-till-bild- och bild-till-video-generering med öppna vikter), PAI-Bench (världsgenerering) och RoboLab (robotpolicys). Flera industriföretag har redan tillkännagett att de använder den — Doosan Robotics, LG Electronics, Samsung Electronics och Skild AI på robotsidan, Li Auto, Xiaomi och Afari på sidan för autonoma fordon — och NVIDIA Cosmos Coalition utökar sin verksamhet till Japan. Modellerna finns tillgängliga under den öppna licensen OpenMDW 1.1 på Hugging Face och GitHub.

🔗 NVIDIA — öppna världsmodeller för fysisk AI


Claude Code och Claude Fable 5: två nyheter från Anthropic

Claude Code-sessioner kan nu prata med varandra

7 augusti — Claude Code introducerar meddelanden mellan sessioner: i stället för att behöva förklara sammanhanget för en uppgift på nytt i en annan session går det nu att be Claude att själv vidarebefordra informationen. Meddelandet som skickas är en sammanfattning — inte hela historiken eller filerna från ursprungssessionen — som mottagande session hämtar mitt under arbetet, utan att börja om från början. Funktionen fungerar åt båda håll: en session kan fråga en annan och få svaret i sin egen konversation, eller så kan Claude initiera meddelandet autonomt när en ändring påverkar en parallell uppgift — användbart för att samordna två agenter kring samma refaktorering. Tillgänglig nu på macOS och Linux.

🔗 Tillkännagivande @ClaudeDevs

Claude Fable 5 lättar på sina biologiska skyddsräcken, -85% falska positiva

7 augusti — Anthropic har uppdaterat de biologiska skyddsräckena i Claude Fable 5 för att minska falska positiva. Enligt interna tester minskar uppdateringen med cirka 85% de fallback-fall som utlöses felaktigt i biologiska ämnen, över alla produktytor — Fable kan nu hantera ett bredare spektrum av vanliga frågor inom hälsa och utbildning utan onödig blockering. Skyddsräcket förblir aktivt för dubbla användningsområden — virologi, toxikologi, molekylär design — som fortfarande växlar över till Opus 5: Fable 5 kan alltså inte användas för professionell biologiforskning eller läkemedelsutveckling. Anthropic säger sig arbeta för att minska detta gap via särskilda tillgångsvägar med förtroende.

🔗 Tillkännagivande @claudeai


Kodverktyg: Amp-prissättning, Replit-SSO och Codex säkerhetsgranskning

Amp omstrukturerar prissättningen och storleken på sina orbs

7 augusti — Amp lägger till en ny orbstorlek a1.medium (4 CPU, 8 GB RAM), 50% billigare än den tidigare a0.medium och bättre anpassad till majoriteten av projekten. Tiden till automatisk paus efter inaktivitet går från 15 till 5 minuter, vilket minskar kostnaden för orbs som glömts bort i bakgrunden. Det blir också möjligt att välja orbstorlek per tråd via kommandot amp -ox och dess flagga --orb-size.

OrbstorlekCPUMinnePris per timme
a1.tiny12 GB0,08 $
a1.medium48 GB0,33 $
a1.xxlarge1632 GB1,32 $

🔗 Amp — storleksanpassa produktionsorbs

Replit lägger till SSO för Okta och Entra ID, gratis till oktober

6 augusti — Replit integrerar företags-SSO i sina genererade applikationer, i partnerskap med Clerk. Kunder på Pro-planen kan be sin agent konfigurera Okta eller Entra ID (OIDC eller SAML) direkt i sin applikation, utan manuell konfiguration av identitetsleverantören. Alternativet erbjuds utan extra kostnad fram till den 1 oktober 2026. Flerfaktor, sessionslängd och kontrollfrekvens kan också konfigureras via agenten, i ett dedikerat kontrollcenter för autentisering.

🔗 Tillkännagivande @Replit

Codex Security Review: forskningsförhandsvisning för säkerhetsanalys av pull requests

6 augusti — OpenAI lanserar Codex Security Review i forskningsförhandsvisning, tillgängligt för ChatGPT Enterprise-, Business-, Edu- och Pro-arbetsytor (inte tillgängligt på Plus). Under introduktionsperioden förbrukar granskningen inga ChatGPT-krediter, med förbehåll för användningsgränser. Verktyget går längre än den befintliga Code Review när det gäller säkerhetsfrågor: det analyserar diffen i pull requesten, repots sammanhang och en hotmodell, som återskapas automatiskt om ingen fil tillhandahålls. Som standard lyfter automatiska granskningar fram fynd med hög och kritisk allvarlighetsgrad, medan manuella granskningar lägger till medelhög allvarlighetsgrad — trösklar som kan justeras per filsökväg. En manuell granskning kan utlösas när som helst via kommentaren @codex security review.

🔗 Tillkännagivande @OpenAIDevs


Forskning och benchmarks: utvärderingsramverk för AI-lärare och kodduell

Ai2 lanserar TutorMoments, ett utvärderingsramverk för AI-lärare

7 augusti — Ai2 publicerar TutorMoments, ett öppet utvärderingsramverk som mäter om modeller kan hantera en central avvägning i undervisning: att ge direkt stöd till eleven, eller låta eleven tänka själv. Metodiken bygger på 462 avidentifierade transkriptioner av verkliga en-till-en-mattesessioner (årskurs 1 till 6), där lärare har annoterat mer än 1 500 viktiga beslutstillfällen. Första slutsatsen: prompten spelar enorm roll — med en neutral instruktion tenderar alla modeller att hjälpa för mycket, men att tydliggöra avvägningen i prompten förbättrar resultaten avsevärt, med stor variation mellan modeller.

Metrik (explicit prompt)Poäng
Lämplig stöttning0,458
Ökad noggrannhet0,182
Undviker överstötta0,496

Ai2 publicerar transkriptionerna, pipelinekoden och råresultaten med öppen tillgång.

🔗 Ai2 — TutorMoments

Together AI jämför DeepSeek-V4 Flash-0731 och GPT-5.6 Luna på verklig kod

6 augusti — Together AI körde 900 DeepSWE-körningar på 113 verkliga mjukvaruingenjörsuppgifter. GPT-5.6 Luna segrar i ren precision med 67,2% pass@1 mot 53,3% för DeepSeek-V4 Flash-0731, ett gap på 14 procentenheter som håller i sig i pass@4 (90,3% vs 80,5%). Den verkliga skillnaden handlar om kostnaden: till 0,10 $ per körning löser DeepSeek 532 uppgifter för 100 $, mot 110 för Luna till 0,61 $ per körning — alltså ungefär 4,8 gånger fler lösningar per dollar. En kaskadstrategi (DeepSeek först, upptrappning till Luna vid fel) löser 78,9% av uppgifterna för 0,385 $ styck, en högre träffsäkerhet än Luna ensam till en 37% lägre kostnad per uppgift.

🔗 Together AI — jämförelse DeepSeek vs GPT-5.6 Luna


Gemini : kreativitet och resor

Gemini Omni: fem kreatörer delar sina kreativa användningsområden

7 augusti — Google lyfter fram fem kreatörer som använder Gemini Omni — tillgängligt via Gemini-appen, Google Flow, AI Studio och API:et — för videoredigering och visualisering av idéer med enkla kommandon. Leon Lin fångar samma urbana scen ur 20 olika perspektiv genom att ändra vinkel och miljö; Carlos Santana förvandlar en utomhusscen med röstkommando (dag/natt, molnig himmel, snötäckt mark); Pan animerar vardagsföremål utifrån skisser; Jerrod Lew tillämpar flera visuella stilar (verklig inspelning, anime, claymation) på samma video i Google Flow; Hyperagent genererar förslag på landskapsdesign och animerade instrumentpaneler. Artikeln illustrerar Gemini Omnis kärnlöfte: att förenkla videoredigering med naturligt språk, utan tekniska färdigheter.

🔗 Google — Gemini Omni Builders

Hur Gemini bygger detaljerade resplaner

6 augusti — Google beskriver i fyra steg hur Gemini fungerar för reseplanering, tillgängligt nu i Gemini-appen. Först sker datainsamling i realtid via Google Maps, Flights, Hotels och YouTube, med en Viator-integration för aktiviteter. Därefter personaliserar funktionen Personal Intelligence rekommendationer utifrån data som redan lagras av användaren i Gmail, Photos, Search och YouTube — till exempel restauranger som föreslås utifrån sparade bilder på mat. Gemini bygger sedan en sammanhängande resplan med hänsyn till restider, och Gemini Spark kan omvandla en kedja av bokningsmail till ett masterdokument för resplanen. Slutligen hjälper assistenten till att fylla i bokningsformulär, jämföra hyrbilar och skriva packlistor — en resa till Kyoto används som exempel i artikeln.

🔗 Google — hur Gemini planerar resor


GitHub Copilot : styrning av granskningar och mätetal per agent

Code Quality inför inte längre automatiskt en Copilot-granskning

7 augusti — Sedan Code Quality aktiverades den 20 juli 2026 skapade GitHub automatiskt en ruleset som krävde en Copilot-granskning på varje pull request. GitHub stänger nu av tre av dessa utlösare: granskning när en PR öppnas, granskning vid nya pushes och granskning av utkast. I befintliga repos har de rulesets som redan skapats ändrats med dessa tre alternativ avstängda — ruleseten finns kvar men agerar inte längre automatiskt; i nya repos skapar aktivering av Code Quality inte längre denna begäran. Team som vill behålla de automatiska granskningarna måste skapa eller ändra en ruleset manuellt, på repo- eller organisationsnivå. GitHub motiverar förändringen med en återkommande önskan: att lägga till en reviewer ska vara ett val, inte ett påtvingat standardbeteende.

🔗 GitHub Changelog

Copilot usage metrics API:n detaljerar aktivitet per tredje parts AI-agent

7 augusti — Copilot usage metrics API:n exponerar en ny tabell totals_by_3rd_party_agent, som för varje partneragent (Claude, Codex…) som körs i GitHub-workflows visar: en stabil identifierare (agent_name, agent_id), antalet uppgifter som startats av användarna och, i de aggregerade rapporterna, antalet sessioner. Denna data riktar sig till företagsägare, faktureringsadministratörer, organisationsägare och innehavare av rollen « Visa Copilot-mått ». Det uttalade målet är att tydligt följa varje app-agent och jämföra deras användning, för driftsättningsbeslut baserade på faktisk användning snarare än på antaganden.

🔗 GitHub Changelog


Mediegenerering: video och röst

Seedance 2.5 blir allmänt tillgänglig på Runway och Luma

7 augusti — Efter tidig tillgång i början av augusti är Seedance 2.5 nu allmänt tillgänglig på Runway: upp till 50 referenser per generering för att bygga universum med flera karaktärer, klipp på 30 sekunder med ljud och dialog, sedan redigering/utökning. Samma dag meddelar Luma att Seedance 2.5 finns på deras plattform med samma kapabiliteter, styrbara via Luma Agents för kontroll över scener, kameravinklar och tempo. Samtidigt bekräftar Pika via sitt API Club att Seedance 2.5 där erbjuds upp till 88% billigare än andra API-aggregatorer, ett pris som beskrivs som permanent.

🔗 Meddelande @runwayml

ElevenLabs beskriver effekten av ElevenAgents på ElevenReader Voice Chat

7 augusti — ElevenLabs delar driftsättningsdata för ElevenAgents, som har generaliserats till hela deras produktutbud. Exempel som lyfts fram: ElevenReader Voice Chat, som låter läsare av en ljudbok ställa frågor halvvägs igenom i samma röst som berättaren, utan att avslöja delar som ligger längre fram i boken.

Mätt måttObserverat värde
Ökning av genomsnittlig lyssningstid+24%
Bokslutförandegrad (5+ sessioner)78%

Den vanligaste frågan gäller en sammanfattning av handlingen, följd av frågor om karaktärer, teman och citat.

🔗 Meddelande @ElevenLabs

Suno lanserar Voices i sin mobila app för iOS och Android

7 augusti — Funktionen Voices, som låter dig spela in din egen röst för att integrera den i genererade låtar, finns nu tillgänglig i Sunos mobilapp (iOS och Android) via knappen « + Voice » på skapandeskärmen. Inspelningen måste vara minst en minut lång. Pro- och Premier-prenumerationer får obegränsad åtkomst, medan gratisplanen har en begränsad version.

🔗 Meddelande @suno


Kortnytt

  • Devin (Cognition) lanserar ett program med 65 000 dollar i krediter för startups — Cognition öppnar ett startup-program som erbjuder upp till 65 000 dollar i Devin-krediter, i linje med liknande program från stora aktörer inom generativ AI. 🔗 källa
  • v0 (Vercel) lanserar en Usage & Activity-instrumentpanel — Uppföljning av krediter per dag, aktivitet per medlem eller projekt och detaljer per meddelande (datum, modell, kostnad), tillgängligt från Settings → Usage & Activity. 🔗 källa
  • Warp Agent CLI — avancerad anpassning — All konfiguration finns nu i en settings.toml-fil som kan redigeras av agenten, med teman, animationer, anpassningsbar statusrad och orkestrering av flera agenter. 🔗 källa
  • Replit får ett Guinness världsrekord för den största AI-videokursen — 14 075 personer byggde tillsammans i en enda live-session, ett rekord som godkänts av Guinness. 🔗 källa
  • SK Telecom publicerar A.X K2, en MoE med 688 miljarder parametrar under Apache 2.0 — Koreansk mixture-of-experts-modell, 256K tokens kontext, öppen licens för kommersiell användning. 🔗 källa
  • Hugging Face värd för en datamängd med en miljon bilder i public domain — 1 080 814 bilder, huvudsakligen från 1800-talsböcker, publicerade på Hub. 🔗 källa
  • Together AI hävdar bästa genomströmning för Kimi K3 på flera benchmarktester — Moonshot AI placerar Together AI först eller lika först på 3 av de 4 testade benchmarkerna: OCRBench, MMMU Pro Vision och DeepSWE. 🔗 källa
  • Bakom kulisserna: Apollo 2 (Apptronik) på Gemini Robotics 2 — Google DeepMind publicerar en serie marknadsföringsinnehåll kring humanoidroboten Apollo 2, som körs på Gemini Robotics 2. 🔗 källa
  • Relationen « Relates to » mellan issues i förhandsvisning och flervalsfält i GA — Ny neutral issue-relation i offentlig förhandsvisning, och övergång till allmän tillgänglighet för flervalsfält för issues och projects. 🔗 källa
  • Secret scanning lägger till en partner och nya push protection-detektorer — Lovable Labs ansluter sig till programmet; nya detektorer inklusive mistral_ai_api_key, samt berikad metadata i varningar för Cohere, GoCardless och Square. 🔗 källa
  • MCP-allowlists i de företagsadministrerade inställningarna — Företag kan centralisera tillåtna eller blockerade MCP-servrar för Copilot app, CLI och VS Code via managed-settings.json. 🔗 källa
  • MiniMax H3 tillgänglig i Genspark AI Video Agent — Videomodellen som släpptes med öppna vikter i början av augusti är nu direkt åtkomlig i Gensparks verktyg för videogenerering. 🔗 källa
  • MiniMax H3 tillgänglig i Luma Agents — Generering av upp till 15 sekunder 2K-video med inbyggt stereoljud, styrbart med text, bild, video och referensljud. 🔗 källa
  • MiniMax H3-communityt producerar en distillerings-LoRA (20 → 4-8 steg) — Fyra dagar efter att vikterna släppts minskar en community-LoRA antalet samplingsteg från 20 till 4-8. 🔗 källa
  • Genspark ansluter sig till World Economic Forums Unicorn Innovator Community — Deltagande annonseras med planerad närvaro i Davos tillsammans med ledare från näringsliv och regeringar. 🔗 källa
  • GitHub låter dig begränsa öppna pull requests på organisationsnivå — Nytt alternativ för att på organisationsnivå sätta ett tak för antalet öppna PR:er från bidragsgivare utan skrivåtkomst. 🔗 källa
  • Genspark låter två AI-agenter (ChatGPT vs Claude) tävla vid lemonadstånd — Marknadsföringsdemo där varje agent driver ett riktigt stånd för att försöka tjäna 100 dollar på en dag. 🔗 källa
  • HSP GRUPPE inför ChatGPT Enterprise i hela sitt nätverk av skatterådgivningsbyråer — Tyskt nätverk för skatterådgivning, revision och juridik, som inför ChatGPT Enterprise över 81 organisationsgrupper. 🔗 källa

Vad det betyder

Defaultsäkerhet håller på att etableras samtidigt hos de största labben, men i olika former. Anthropic gör Auto Mode till standard baserat på en siffra som är svår att ifrågasätta — 89% av farliga kommandon blockeras mot 14% i trött mänsklig granskning — och satsar på att automatiseringen av säkerhetsbedömningar nu är mer tillförlitlig än upprepad mänsklig uppmärksamhet. OpenAI går motsatt väg på ett annat område: i stället för att lätta på en kontroll lägger de till en, genom att klassificera Astra som kritisk redan innan testkampanjen är avslutad. Codex Security Review, som lanserades samma vecka, förlänger den logiken på produktsidan genom att flytta säkerhetsanalysen före merge i stället för att granska i efterhand. De tre annonseringarna berättar samma historia: agentisk säkerhet slutar vara ett manuellt ilagt val och blir ett standardlager, oavsett om det uttrycks som ökad autonomi eller som starkare skyddsräcken.

Ekosystemet för öppna modeller bedöms i allt högre grad utifrån kostnad och industriell användning snarare än enbart benchmarkresultat. NVIDIA positionerar Cosmos 3 inte som ännu en modell utan som infrastruktur som redan antagits av Doosan, LG, Samsung och Li Auto innan den ens fått bred spridning. Together AI dokumenterar samma avvägning på kodsidan: GPT-5.6 Luna vinner 14 poäng i pass@1 på DeepSeek-V4 Flash, men DeepSeek ger 4,8 gånger fler lösningar per dollar, så att en cascading-strategi slår båda modellerna var för sig. SK Telecom adderar en koreansk MoE med 688 miljarder parametrar under en permissiv licens till detta redan täta landskap. Det gemensamma signalvärdet: konkurrensen handlar inte längre bara om kapacitetsgränsen, utan om förhållandet mellan den kapaciteten och dess verkliga pris i användning.

Verktyg för agentisk utveckling får en mer klassisk företagsinfrastruktur — detaljerad fakturering, identitet, styrning — ett tecken på mognad bortom den rena prototypen. Amp delar nu upp sina molnmiljöer efter storlek och tråd som vilken infrastrukturoperatör som helst, Replit lägger till gratis företags-SSO för att snabba på antagandet, och Claude Code låter sina sessioner överföra en kontextsammanfattning i stället för att tvinga användaren att skriva om allt. På GitHub är rörelsen nästan omvänd men pekar i samma riktning: Code Quality tar bort automatiken som lägger till en Copilot-reviewer, vilket gör valet explicit, medan usage metrics API:n äntligen visar vem, Claude eller Codex, som faktiskt utför arbetet i företagsworkflows. Tillsammans flyttar dessa annonser diskussionen från « vilken agent är smartast » till « hur man styr en flotta av agenter ».

Mediegenereringen fortsätter att spridas över plattformar i stället för att stanna hos en enda aktör. Seedance 2.5 blir allmänt tillgänglig samtidigt på Runway och Luma, MiniMax H3 sprids inom några dagar till Genspark och Luma Agents samtidigt som den redan får en community-byggd distillerings-LoRA, och både ElevenLabs och Suno förfinar riktade användningsfall — kontextuella frågor under lyssning av en ljudbok, röstinspelning direkt från mobilen. Denna snabba cirkulation av samma modell mellan flera produkter, på bara några dagar för MiniMax H3, visar hur mycket öppna vikter påskyndar kreativ spridning bortom ursprunglig utgivare.


Källor