Sök

MiniMax lanserar H3 med öppet tillkännagivna vikter, Together AI hävdar en 10 000-faldig tillväxt i tokens, GitHub låser riskfyllda npm-token

Artikel genererad av artificiell intelligens
MiniMax lanserar H3 med öppet tillkännagivna vikter, Together AI hävdar en 10 000-faldig tillväxt i tokens, GitHub låser riskfyllda npm-token

ai-powered-markdown-translator

Översatt artikel från fr till sv med gpt-5.4-mini.

Visa projekt på GitHub ↗

MiniMax lanserar H3, en generell multimodal modell med inbyggt stereoljud och öppet tillkännagivna vikter « inom de kommande dagarna ». Together AI hävdar en spektakulär ökning av sin volym av servade tokens, medan GitHub skärper säkerheten för npm-token efter en våg av attacker med kontokapning. Runt dessa tre ämnen är dagen särskilt intensiv på bild- och videogenereringens sida (Runway, Wan Video, Luma, Black Forest Labs, Ideogram), kodagentsverktyg (Devin, Replit, GitHub Actions) och modellövergångar hos OpenAI och Google.


MiniMax H3 : en generell multimodal modell, öppet tillkännagivna vikter

31 juli — MiniMax lanserar H3, beskriven som en generell multimodal genereringsmodell. Till skillnad från tidigare generationer (Hailuo 01 och 02), som delade upp uppgifterna mellan specialiserade modeller, förenar H3 dessa förmågor i en enda modell som kan förstå ett sammanhang som blandar text, bild, video och ljud. Dess mest anmärkningsvärda egenskap är det inbyggda stereoljudet som genereras tillsammans med videon, i sekvenser på upp till 15 sekunder i 2K-upplösning.

MiniMax lyfter fram en aggressiv pris-prestandapositionering: i 2K skulle priset per sekund vara lägre än en tredjedel av de « mainstream »-modellernas, och i 768p lägre än hälften av priset för 720p hos samma modeller. H3 bygger på flera proprietära komponenter (Contextual Omni Representation, H3-VAE, H3-Omni Transformer, In-Context Regeneration) och hanterar redigering på ett generaliserat sätt: bild-till-bild, bild-till-video, ljud-till-ljud, rörelseöverföring video-till-video, med exakt återgivning av text och varumärkeselement — en punkt som ofta är svag hos videogenereringsmodeller.

MiniMax tillkännager också en snart kommande öppning av modellens vikter, presenterad som ett sätt att påskynda hårdvarukompatibilitet och stödja open source-communityn i en sektor som historiskt dominerats av slutna modeller. Lanseringen åtföljs av en dag-0-rullning hos ett femtontal partners, däribland Runway, Pika, Leonardo.Ai, OpenRouter och Krea.

EgenskapDetalj
Upplösning2K som standard
Maximal längd15 sekunder
LjudInbyggt stereoljud, genererat tillsammans
Pris i 2KMindre än en tredjedel av priset/sekund för mainstream-modeller
Pris i 768pMindre än hälften av priset för 720p mainstream
Öppna vikterTillkännagivna « inom de kommande dagarna »

MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities — Today, we’re launching MiniMax H3, a general-purpose multimodal generation model. H3 understands unified context across text, images, video, and audio, generating video with native stereo sound, up to 15 seconds at 2K resolution.

🇸🇪 MiniMax H3 : en öppen modell som suddar ut gränserna mellan uppgifter och modaliteter — I dag lanserar vi MiniMax H3, en generell multimodal genereringsmodell. H3 förstår ett enhetligt sammanhang över text, bilder, video och ljud, och genererar videor med inbyggt stereoljud, upp till 15 sekunder i 2K-upplösning.@MiniMax_AI på X

🔗 Kompletterande tråd — @MiniMax_AI på X


Grok Imagine Video 1.5 tillgänglig på Runway

1 augusti — Runway fortsätter att utöka sin katalog av tredjepartsmodeller genom att integrera Grok Imagine Video 1.5, video-versionen av xAI:s genereringsmodell, direkt tillgänglig från sin plattform. Integrationen ingår i Runways strategi att aggregera frontmodeller från flera utgivare — den hade redan välkomnat MiniMax H3 dagen innan — i en och samma kreativa produktionsplattform, snarare än att satsa enbart på sina egna Gen-modeller.

🔗 Tillkännagivande — @runwayml på X


Wan Video (Alibaba) lanserar ett Realtime-läge för skiss och text

31 juli — Alibaba har lagt upp, i Labs-sektionen på wan video, ett Realtime-läge som gör det möjligt att förvandla en skiss till en fotorealistisk scen i takt med att man ritar — en spretig figur, en ungefärlig rektangel, några streck — utan något explicit genereringssteg eller någon « generate »-knapp. Samma dag presenterade Alibaba ett andra Realtime-läge, denna gång för text: bilden justeras live i takt med att användaren skriver en beskrivning, mening för mening, utan laddningsskärm. Dessa två funktioner för generation av bilder närmare en kontinuerlig interaktion i stil med ritning eller ordbehandling, snarare än en klassisk prompt/genereringscykel.

🔗 Tillkännagivande — @Alibaba_Wan på X


Luma lanserar Layers, lagerbaserad bildredigering driven av Uni-1

30 juli — Luma har rullat ut Layers inom Luma Agents, drivet av sin modell Uni-1. Principen: be agenten extrahera lagren från en befintlig bild (genererad av Luma eller importerad av användaren), och sedan ändra ett specifikt element via enkel konversation, medan resten av bilden förblir intakt — oavsett om det gäller produkten som lyfts fram, bakgrunden eller en text. Luma illustrerar funktionen med två exempel: en fullständig omgestaltning av en rebranding-affisch utifrån en enkel platt JPG, och tillägg av ett isolerat objekt i en scen utan att röra belysningen eller miljön. Målet är att möjliggöra riktade och iterativa justeringar, i stället för att regenera en hel bild för att ändra en enda detalj.

🔗 Tillkännagivande — @LumaLabsAI på X


Black Forest Labs avslöjar en förhandstitt på FLUX 3

30 juli — Black Forest Labs (BFL), utgivaren av FLUX-modellerna, gav en första offentlig förhandsvisning av sin kommande modell, FLUX 3, via en tillfällig 48-timmarsåtkomst på Nous Researchs Hermes-agent. Denna agent kedjar samman flera genererade planer för att producera en komplett kortfilm utifrån en enda end-to-end-prompt. Tillkännagivandet åtföljs av en kortfilmstävling som Nous Research organiserar under hela veckan, samt en personlig presentation av FLUX 3 vid ett BFL-evenemang i San Francisco följande fredag. BFL har i nuläget inte kommunicerat vare sig ett allmänt tillgänglighetsdatum eller tekniska detaljer om modellens kapaciteter.

🔗 Tillkännagivande — @bfl_ai på X


Ideogram lanserar P-Image-Ideogram, Pareto-optimal modellfamilj med Pruna AI

30 juli — Ideogram lanserade, i samarbete med Pruna AI, en ny familj av bildmodeller kallad P-Image-Ideogram, samtidigt optimerad för kvalitet, hastighet och kostnad. Modellen erbjuder fyra kvalitetslägen (Very low, Low, Medium, High), inbyggd generering i 1K och 2K, och ett startpris på 0,003 dollar per bild, med en annonserad latens mellan 3 och 8 sekunder beroende på läge. I Design Arena-rankingen (blinda mänskliga röster) gör Ideogram anspråk på en ny Pareto-front för preferens/kostnad och preferens/hastighet: i 1K kostar det mest ekonomiska läget 0,3 ¢/bild för en generering på ungefär 3 sekunder, alltså cirka 8,6 gånger snabbare än genomsnittet av de utvärderade modellerna. Omedelbar utrullning på ett femtontal partnerplattformar, däribland ComfyUI, Runware, Replicate, Leonardo.Ai och Together AI.

KvalitetslägeUpplösningPris i 1KUngefärlig latens
Very lowInbyggt 1K/2K0,3 ¢/bild~3 s
LowInbyggt 1K/2K0,75 ¢/bild~3 s
MediumInbyggt 1K/2Kej specificeratupp till 8 s
HighInbyggt 1K/2Kej specificeratupp till 8 s

🔗 Tillkännagivande — @ideogram_ai på X


Devin lanserar Outposts, inbyggd körning av appar på vilken dator som helst

31 juli — Cognition, utgivaren av Devin, har tillkännagett en ny funktion kallad Outposts. Den gör det möjligt för Devin-agenten att köra och testa appar direkt på vilken dator som helst, i stället för att enbart vara beroende av isolerade molnmiljöer. Denna förmåga ingår i den fortsatta linjen av Cognitions senaste tillkännagivanden om inbyggd körning — inbyggt iOS-stöd via macOS-molnagenter, tillkännagett dagen innan — och syftar till att utöka spannet av uppgifter som Devin kan hantera från början till slut, även på hårdvaru- eller mjukvarukonfigurationer som är specifika för användarens arbetsstation.

🔗 Tillkännagivande — @cognition på X


Replit rullar ut Model Selector, Follow-up Tasks och en ny användningssida

31 juli — I sin veckosammanfattning « This Week in Replit » beskriver Replit flera nyheter. Model Selector är nu tillgänglig för Core- och Pro-planerna, med ett utökat val som inkluderar modeller med öppna vikter utöver proprietära modeller — användaren behåller kontrollen, eller låter Replit rekommendera automatiskt. Follow-up Tasks blir tillgängligt för alla användare denna vecka: efter att ha slutfört en uppgift föreslår Agent nästa steg som kan aktiveras med ett klick och körs i bakgrunden. Två justeringar kompletterar veckan: en ombyggd användningssida som erbjuder nästan realtidsuppföljning per datum, resurs, projekt, workspace, grupp och användare, samt en förlängd användarsession (standardutloggning höjd från 7 till 14 dagar).

FunktionStatus
Model SelectorOnline, Core- och Pro-planer, öppna modeller ingår
Follow-up TasksRullat ut till alla användare
AnvändningssidaOmbyggd, nästan realtidsuppföljning
SessionslängdFörlängd från 7 till 14 dagar

🔗 Tillkännagivande — @Replit på X


Together AI : uppskalning av öppen inferens

Together AI multiplicerar tillkännagivandena kring dedikerad inferens denna vecka, ur två olika vinklar: en imponerande tillväxtsiffra på användningssidan, och en detaljerad teknisk artikel om autoskalning av den underliggande infrastrukturen.

En tillväxt i servade tokens med mer än 10 000 gånger

1 augusti — Together AI visar en slående tillväxtsiffra: dess volym av servade tokens ska ha gått från 30 miljarder per månad till 400 000 miljarder (400 trillioner) per månad, alltså mer än 10 000 gånger. Företaget förklarar denna utveckling med flytten av storskaliga arbetslaster till modeller med öppna vikter snarare än till slutna proprietära API:er. Siffran presenteras utan någon exakt jämförelseperiod, vilket begränsar dess jämförande värde.

Josh had to stop @vipulved and ask him to repeat the number: @wolfejosh Together AI went from serving 30B tokens a month to 400T. Over 10,000x growth as AI-native companies and enterprises move scaled workloads to open model.

🇸🇪 Josh var tvungen att avbryta @vipulved och be honom upprepa siffran: Together AI har gått från 30 miljarder servade tokens per månad till 400 000 miljarder. En tillväxt på mer än 10 000 gånger, driven av att AI-native-företag och stora konton migrerar till öppna modeller för sina storskaliga arbetslaster.@togethercompute på X

Åtta mätvärden för att styra autoskalning av dedikerad inferens

31 juli — Together AI publicerar en teknisk artikel om autoskalningen av sin Dedicated Model Inference. Utgångspunkten: de klassiska mätvärden som ärvts från webbvärlden (CPU/GPU-användning) återspeglar inte den verkliga belastningen i en LLM-inferensmotor — en GPU kan visa 60 % användning medan dess kö redan är mättad, eftersom användning mäter beräkningsintensitet, inte väntande last. Artikeln beskriver åtta inferens-nativa mätvärden, grupperade i tre familjer (konkurrens, SLO, effektivitet), och rekommenderar inflight_requests som standardmått. Den kvantifierar också den verkliga kostnaden för en cold start på H100-GPU: cirka 86 sekunder för en basmodell, 145 sekunder för en fine-tune på 18 Go, och ungefär 2,5 minuter för att lägga till en replika.

Mätt stegVaraktighet på 1×H100
Utrullning av basmodell86 s
Utrullning av fine-tune (18 Go)145 s
Uppskalning från 1 till 2 replikor~2,5 min

🔗 Fullständig teknisk artikel


Ai2 — en studie baserad på infini-gram spårar lånad språk i böcker skrivna av AI

31 juli — Ai2 (Allen Institute for AI) lyfter fram en studie byggd på sin infini-gram-motor, ett verktyg som indexerar enorma textkorpusar och räknar den exakta förekomsten av vilken fras som helst, vilket gör det möjligt att spåra troliga källor till en formulering. Teamet ledd av Tuhin Chakrabarty (Stony Brook University) isolerade « sällsynta uttryck » — formuleringar som förekommer i högst fem Google Books-böcker och saknas på det indexerade webben — och jämförde deras förekomst mellan självpublicerade böcker med hög AI-detekterad innehållsnivå, självpublicerade böcker utan upptäckt AI, och prisbelönt litteratur. Resultat: böcker med hög AI-innehållsnivå visar en tydligt högre andel sällsynta uttryck, vilket tyder på ett starkare beroende av mönster från träningsdata.

Utvärderad gruppTäckning av sällsynta uttryck
Topp 200 självpublicerade, AI starkt detekterad41,6 %
Topp 200 självpublicerade, ingen AI detekterad37,2 %
Prisbelönt eller nominerad litteratur (referens)19,1 %

🔗 Fullständig artikel — Ai2


Gemini 3.5 Flash Cyber, en modell dedikerad till cybersäkerhet med begränsad åtkomst

31 juli — Google lade diskret till en ny medlem i sin Flash-modellfamilj: Gemini 3.5 Flash Cyber. Till skillnad från de allmänna versionerna som tillkännagavs denna månad (3.6 Flash, 3.5 Flash-Lite) riktar sig denna modell till en mycket specifik användning — att upptäcka och korrigera mjukvarusårbarheter i stor skala — och förblir en ekonomisk modell optimerad för just detta enda användningsfall. Åtkomsten är medvetet begränsad till regeringar och betrodda partners, vilket gör den till ett defensivt cybersäkerhetsverktyg snarare än en kommersiell produkt öppen för alla. Ingen dedikerad produktsida, inga benchmark-resultat och inga arkitekturdetaljer följer med tillkännagivandet: den enda tillgängliga källan är en sammanfattande tvåveckorstråd från @GoogleAI, vilket begränsar djupet i vad som kan sägas om den just nu.

Samma sammanfattande tråd tillkännager dessutom Collections i Gemini Notebook (f.d. NotebookLM), ett nytt sätt att gruppera sina notebooks. Även här bara en enda mening, utan skärmdump eller tillhörande dokumentation.

🔗 Sammanfattande tråd — @GoogleAI på X


Copilot avvecklar Gemini 2.5 Pro och Gemini 3 Flash

31 juli — GitHub tar bort Gemini 2.5 Pro och Gemini 3 Flash från hela sitt Copilot-utbud (Chat, inline-edits, ask- och agentlägen, kodkompletteringar), utan att användaren behöver göra något — modellerna försvinner automatiskt från väljarna. Användare uppmanas att byta till Gemini 3.1 Pro (Preview) och Gemini 3.6 Flash. På administrationssidan måste Enterprise-organisationer kontrollera att deras modellpolicyer faktiskt tillåter dessa ersättare innan deras team hittar dem i Copilot Chats väljare i VS Code och github.com. Avvecklingen visar den snabba rotations­takten för modellerna som erbjuds i Copilot, där Gemini-versioner från föregående generation lämnar plats åt Googles senaste iterationer.

🔗 Officiell ändringslogg


npm begränsar GAT-jetonger med 2FA-bypass

31 juli — GitHub begränsar vad npm:s granulära åtkomstjetonger (GAT) som är konfigurerade för att kringgå tvåfaktorsautentisering (2FA) kan göra. Hittills kunde en läckt jetong av den här typen användas för att ta över ett konto helt: skapa andra jetonger, lägga till en underhållare, ändra åtkomsträttigheter till ett paket. Framöver kräver dessa känsliga operationer en interaktiv 2FA-utmaning, även för en jetong som normalt är undantagen från 2FA. Åtgärden gäller omedelbart; ett andra steg är planerat till januari 2027, då dessa jetonger också förlorar förmågan att publicera paket direkt, vilket driver automatiserings­team mot betrodd publicering (trusted publishing, baserat på OIDC). Endast npm-jetonger berörs — vanliga GitHub-jetonger (PAT, GitHub App, Actions) fortsätter att fungera oförändrat. Det är ett direkt svar på den våg av paketövertaganden i npm som observerats under de senaste månaderna i öppen källkods-ekosystemet.

🔗 Officiell ändringslogg


Self-repository-syntax för att referera till actions i GitHub Actions

30 juli — GitHub Actions introducerar en ny syntax, $/, för att referera till en action eller ett återanvändbart workflow som ligger i samma repository som det anropande workflowet. Tidigare krävde den här typen av intern referens antingen ./ tillsammans med ett uttryckligt checkout-steg, eller att man hårdkodade en version. Med $/ pekar referensen automatiskt på exakt det commit som körs, utan ytterligare checkout-steg, och fungerar överallt där ./ användes: workflow-steg, kompositactions, nästlad komposition och anrop av återanvändbara workflows. Nyheten kräver en runner i version 2.336.0 eller senare. Dess främsta poäng: att låta organisationer tillämpa policyer som kräver att actions låses till fullständiga commit-SHA:er, samtidigt som interna referenser hålls automatiskt synkade med den ref som körs.

🔗 Officiell ändringslogg


OpenAI tar bort GPT-5.4 och GPT-5.4 mini från ChatGPT den 31 augusti

31 juli — OpenAI har meddelat att GPT-5.4 och GPT-5.4 mini tas bort från ChatGPT-gränssnittet för användare som är inloggade med ett konto, från och med den 31 augusti. Båda modellerna förblir dock tillgängliga via OpenAI:s API samt i Codex-sessioner som autentiseras med API-nyckel — en skillnad som alltså berör användare av ChatGPT-appen/webben, men inte utvecklare som använder API:et eller Codex med API-nyckel. Tillkännagivandet ligger i linje med den GPT-5.6-prisuppdatering (Luna/Terra) som kom i slutet av juli och som påskyndar skiftet i ChatGPT-sortimentet mot de nyaste modellerna.

🔗 Tillkännagivande — @OpenAIDevs på X


ImageGen i Codex CLI: ny lightbox och canvas

30 juli — OpenAI Devs har uppdaterat ImageGen-funktionen i Codex CLI med ett nytt gränssnitt i stil med en “lightbox” och en dedikerad canvas. Förändringen syftar till att förenkla utforskning och finjustering av bilder som genereras direkt i Codex-arbetsflödet, utan att byta kontext. Det är en användbarhetsförbättring snarare än en ny modell, men den berör direkt CLI-verktyget som OpenAI prioriterar högt.

🔗 Tillkännagivande — @OpenAIDevs på X


Kortnyheter

  • Amp — orbstarter 20 % snabbare, assistenten Puck flyttad till GPT-5.6 Sol — Amp meddelar att start av orbs (fjärrmaskiner) nu går ungefär 20 % snabbare och flyttar sin assistent Puck till GPT-5.6 Sol efter mycket kritisk användarfeedback. 🔗 källa
  • Hugging Face publicerar en gratis publik endpoint för DeepSeek-V4-Flash-0731 — En anställd på Hugging Face lägger, samma dag som modellen släpps, ut en gratis endpoint utan token, kompatibel med OpenAI, för att testa modellen. 🔗 källa
  • Sakana AI — 5:e plats i OSINT CTF Diver 2026 — Ett försvars-/underrättelseteam på Sakana AI, som använder en OSINT-agent baserad på Fugu-ultra 1.1, slutar på 5:e plats bland mer än 850 deltagande team. 🔗 källa
  • Kimi K3 på Together AI — lägsta pris och högsta cache-takt enligt OpenRouter — Data från OpenRouters kontrollpanel visar att Together AI erbjuder en av de lägsta priserna för Kimi K3, med en av de bästa träffarna för promptcache. 🔗 källa
  • En öppen videomodell (Marlin-2B) gör 370 timmar offentliga arkiv sökbara för cirka 10 dollar — En medlem i communityn indexerar 1 864 filmer från Prelinger Archives med Marlin-2B på Hugging Face Jobs och skapar 23 148 sökbara ögonblick. 🔗 källa
  • GitHub undersöker utvecklares användning av tillgänglighetsverktyg — En enkät öppen till den 31 augusti 2026 bland utvecklare med funktionsnedsättning om deras användning av tillgänglighetsteknik. 🔗 källa
  • Seedance 2.5 annonseras också på Luma — Luma teasar den kommande ankomsten av Seedance 2.5 till sin plattform, utan angivet datum. 🔗 källa
  • Ideogram Object Remover tillgänglig på Runware — Ideograms verktyg för att ta bort objekt hävdar bästa FID-poäng på OmniEraser-benchmarken, utan att någon prompt krävs. 🔗 källa
  • SGLang lägger till stöd för Inkling-Small på NVIDIA DGX Spark-kluster — Mätt genomströmning på 24 tokens/sekund vid konkurrens 1, på 2 DGX Spark-system sammankopplade med ConnectX-7. 🔗 källa
  • ChatGPT desktop — Aktivitet-vy och Voice-genväg via djurikonen — Ny Activity-vy som samlar väntande konversationer och projektuppdateringar, plus en genväg till ChatGPT Voice. 🔗 källa
  • Tio framsteg inom matematik och teoretisk datavetenskap — OpenAI delar tio resultat om öppna problem inom geometri, kryptografi och komplexitet; detaljerat innehåll går inte att läsa, källan är robotskyddad. 🔗 källa
  • Att driva fram en ansvarsfull AI i Europa — OpenAI presenterar sina säkerhets-, transparens- och ursprungspraktiker till stöd för AI-styrning i Europa i ljuset av AI Act; detaljerat innehåll kan inte läsas, källan är blockerad. 🔗 källa
  • Univé bygger en AI-redo arbetsstyrka med ChatGPT Enterprise — Fallstudie om det nederländska försäkringsbolaget Univé och utrullningen av ChatGPT Enterprise; detaljerat innehåll kan inte läsas, källan är blockerad. 🔗 källa
  • OpenAI säger sig ha slagit ut ett bedrägerinätverk baserat i Kambodja — Användning av ChatGPT för investeringsbedrägerier, romansbedrägerier, spelbedrägerier och identitetsstöld; detaljerat innehåll kan inte läsas, källan är blockerad. 🔗 källa
  • avatarin bygger en retail-agent dygnet runt med GPT-Realtime — Flerspråkig kundsupport för Yamada Denki: 30 000 användare på två veckor, 92 % positiva omdömen enligt den officiella sammanfattningen; detaljerat innehåll kan inte läsas, källan är blockerad. 🔗 källa

Vad det betyder

Mediegenereringen accelererar sin satsning på bred distribution och konversationsbaserad redigering. MiniMax H3 går i täten med en enhetlig text/bild/video/audio-modell och öppna vikter som utlovas “inom de närmaste dagarna”, utrullad day 0 hos ett femtontal partners. Samma rörelse syns hos Ideogram (P-Image-Ideogram, fyra kvalitetslägen och ett pris från 0,003 dollar per bild), Wan Video (Realtime-läge utan knappen “generate”) och Luma (Layers, redigering av ett lager i taget via konversation): mervärdet handlar inte längre bara om råmodellens kvalitet, utan om iterationshastighet och multiplattformsintegration redan vid lansering. Black Forest Labs, med en 48-timmars förhandstitt på FLUX 3 reserverad för en tredje parts agent, väljer motsatt väg — kontrollerad teaser snarare än omedelbar allmän tillgänglighet.

Inferens för öppna modeller skalar upp, och användningen dokumenteras lika mycket som tekniken. Together AI hävdar en tillväxt på mer än 10 000 gånger i sin volym av serverade tokens på en månad, driven av företags migration mot öppna modeller, och publicerar samtidigt en detaljerad teknisk artikel om begränsningarna i klassiska autoskalningsmått för LLM-inferens. Som komplement ger Ai2-studien byggd på infini-gram en oväntad inblick i samma våg av öppna modeller: den dokumenterar, utifrån självpublicerade böcker, hur nära AI-genererade texter fortfarande ligger formuleringar som förekommer i träningsdata — en påminnelse om att skalbar inferens inte suddar ut de grundläggande frågorna om innehållets originalitet.

Verktygen för kodagenter och leveranskedjans säkerhet utvecklas parallellt, men inte alltid i samma riktning. Devin utökar sitt exekveringsområde till vilken dator som helst med Outposts, Replit multiplicerar sina autonomifunktioner (Follow-up Tasks, Model Selector) och GitHub Actions förenklar referenser till interna actions med syntaxen $/. Samtidigt skärper GitHub säkerheten i npm genom att kräva en interaktiv 2FA-utmaning även för jetonger som konfigurerats för att kringgå den, som ett direkt svar på vågen av kontoövertaganden som observerats under de senaste månaderna — en signal om att den växande automatiseringen av agenter åtföljs av en parallell åtstramning av åtkomstkontroller.

Två aktörer stramar åt åtkomsten till vissa av sina modeller, av olika skäl. OpenAI tar bort GPT-5.4 och GPT-5.4 mini från ChatGPT för inloggade användare från och med den 31 augusti, samtidigt som de förblir tillgängliga via API — snarare en förtydligad modellportfölj än ett rent borttagande. Google, å sin sida, reserverar Gemini 3.5 Flash Cyber, en ekonomisk modell avsedd för att upptäcka och åtgärda sårbarheter i mjukvara, endast för regeringar och förtroendepartners: ett tecken på att vissa laboratorier nu uttryckligen skiljer mellan modeller för begränsad defensiv användning och modeller för allmänheten.


Källor