ai-powered-markdown-translatorÖversatt artikel från fr till sv med gpt-5.4-mini.
Den 17 augusti 2026 säkrar OpenAI och NVIDIA gemensamt en enorm AI-infrastrukturplats i Ohio, samtidigt som Cursor lanserar sin egen plattform för kodhosting, Origin, i beta. Runt dessa två stora besked fortsätter DeepSeek V4 Pro sin utrullning hos flera leverantörer, GitHub beskriver sina agentiska canvases och en spektakulär optimering av sin kodsökning, och Google lanserar Sheets canvas för att förvandla kalkylark till mini-appar.
OpenAI och NVIDIA säkrar en AI-plats på 8 GW-IT i Ohio
17 augusti — OpenAI, NVIDIA och SB Energy meddelar samma dag, ur två kompletterande vinklar, ett gemensamt avtal om att säkra en enorm AI-infrastrukturplats vid teknikhubben PORTS-Pike i Pike County, Ohio — en tidigare anläggning för gasdiffusion i Portsmouth. NVIDIA och SB Energy säkrar mark-, energi- och byggnadskapacitet (land, power and shell) för en inledande utbyggnad på 4,25 gigawatt, med möjlighet att utökas med ytterligare 3,75 gigawatt, inom ett 20-årigt avtal som etappindelas mellan 2028 och 2030. OpenAI, som är operativ hyresgäst, siktar på omkring 8 gigawatt-IT totalt med stöd från det amerikanska energidepartementet (DOE).
Projektet ska skapa 35 000 byggjobb under sex år, följt av 2 500 långsiktiga driftjobb. Kylningen ska ske med sluten krets och luft, med återcirkulation av vatten. OpenAI investerar 40 miljoner dollar i en lokal samhällsfond (utöver de 40 miljoner som redan åtagits av SB Energy), och tillhandahåller upp till 84 miljoner dollar i Codex-krediter för omkring 844 000 berättigade studenter i Ohio under läsåret 2026–2027. För NVIDIA:s del skulle varje GPU-generation som tas i drift på platsen kunna motsvara omkring 1,5 miljoner chip, alltså 150 till 200 miljarder dollar i intäkter — inom ramen för ett OpenAI/NVIDIA-datoråtagande fram till 2030 på uppskattningsvis 12 till 16 gigawatt (cirka 600 miljarder dollar).
| Mått | Värde |
|---|---|
| Målkapacitet (OpenAI) | ~8 GW-IT |
| Inledande kapacitet (NVIDIA/SB Energy) | 4,25 GW (+3,75 GW utbyggbart) |
| Avtalets längd | 20 år, etappindelat 2028–2030 |
| Byggjobb | 35 000 under 6 år |
| Codex-krediter för studenter i Ohio | upp till 84 M$ för ~844 000 studenter |
| OpenAI/NVIDIA-åtagande till 2030 | 12-16 GW (~600 Md$) |
“OpenAI has entered into an agreement to secure approximately 8 gigawatts-IT at the PORTS-Pike Technology Campus in Pike County, Ohio, working with SB Energy, NVIDIA, and the U.S. Department of Energy.”
🇸🇪 OpenAI har ingått ett avtal om att säkra omkring 8 gigawatt-IT vid teknikhubben PORTS-Pike i Pike County i Ohio, i samarbete med SB Energy, NVIDIA och det amerikanska energidepartementet. — OpenAI, officiellt pressmeddelande
🔗 NVIDIA — säkra intelligensinfrastrukturen
Cursor lanserar Origin, sin plattform för kodhosting
17 augusti — Cursor rullar ut Origin i beta, en plattform för kodhosting med repositories integrerad direkt i editorn, utformad för agent-skala (agent scale) snarare än som enbart en konkurrent till GitHub. Lanseringen startar för alla prenumeranter på de betalda planerna, med möjlighet till opt-out för företagsorganisationer.
Repositorier som skapas i Origin nås via cursor.com/codebase/[nom], och det är fortfarande möjligt att synkronisera befintliga GitHub-repositories parallellt — i realtid, där GitHub förblir sanningskällan för pushar. För pull requests erbjuder Cursor en komplett upplevelse (tidslinje, commits, checks, diffar) med dubbelriktad synkronisering: en kommentar som postas i Cursor visas på GitHub inom några sekunder. AI-agenter kan svara på frågor om koden, göra ändringar, uppdatera pull requests och pusha brancher direkt från repositories-vyn.
Cursor har ingått integrationspartnerskap inför lanseringen med Vercel (förhandsgranskningar), Depot och Buildkite (CI/CD kompatibelt med befintliga GitHub Actions-arbetsflöden), med fler annonserade integrationer på väg.
“Origin, our code hosting platform, is now live. It’s fast, easy to use, and deeply integrated with Cursor. Get started by syncing your repos from GitHub.”
🇸🇪 Origin, vår plattform för kodhosting, är nu live. Den är snabb, lätt att använda och djupt integrerad i Cursor. För att komma igång, synkronisera dina repositories från GitHub. — @cursor_ai på X
🔗 Cursor changelog — Origin-kodhosting
Replit stärker sin säkerhet med black-box-penetrationstester
17 augusti — Replit lägger till pen tests black-box (intrångstester i svart låda) i sitt säkerhetserbjudande, som komplement till de white-box-scanningar som redan finns. Skannern körs via applikationens nätverks- och webbläsargränssnitt, och beter sig först som en oautentiserad besökare och sedan som en vanlig autentiserad användare, vilket avslöjar verkliga funktioner inklusive sådana utan synlig knapp.
Enligt Replit överlappar resultaten från de två metoderna sällan: black-box hittade oskyddade administratörspaneler och endpoint:er sårbara för denial of service som white-box missade, medan white-box identifierade logikbuggar i auktorisering som inte syntes utifrån. Tre nivåer erbjuds i Security Center för varje projekt: nivå 1 gratis (kontroll av beroenden), nivå 2 (white-box-scan) och nivå 3 (en kombination av båda). När en sårbarhet väl har bekräftats kan Replit Agent åtgärda den med ett klick.
🔗 Replit-meddelande — black-box pen tests
Öppna modeller och inferens: DeepSeek, Yutori, GPU-allokering
Tre publikationer kring ekosystemet Together AI och Hugging Face illustrerar den pågående kampen om kostnad och effektivitet i inferens.
DeepSeek V4 Pro 0813: utrullning hos flera leverantörer och DeepSWE-benchmark
16 augusti — DeepSeek V4 Pro, vars lansering i öppna vikter redan hade rapporterats den 13 augusti, fortsätter sin utrullning under revisionen « 0813 »: Together AI och Novita bekräftar båda stöd, med en MoE-arkitektur (Mixture of Experts) på 1,6T parametrar, ett kontextfönster på 1M tokens och tre resonemangslägen (kodning, agenter, komplex resonemang). På mjukvaruingenjörs-benchmarken DeepSWE mäter Together AI ett resultat på 88,5 % pass@4 till en kostnad av 0,24 $ per uppgift — 35 gånger billigare än GPT-5.6 Sol och 90 gånger billigare än Fable 5.
🔗 Together AI — DeepSeek V4 Pro 0813
Yutori rullar ut sin agentmodell Navigator på Together AI
16 augusti — Together AI lyfter fram Navigator, webb-navigationsagentmodellen (browser-use) från startupen Yutori. Dessa agenter arbetar i täta loopar — skärmbild, åtgärd, upprepning, ibland dussintals gånger per uppgift — vilket gör inferenskostnaden särskilt känslig. Enligt Together AI överträffar Navigator referensmodellerna samtidigt som den är dubbelt så snabb i inferens och 4 till 5 gånger billigare.
🔗 Together AI — Yutori Navigator
En resursbegränsad GPU-allokerare hämtar upp till 33 poäng i klusterutnyttjande
17 augusti — Dharma-AI-teamet publicerar på Hugging Face den andra delen av sin studie om hantering av GPU-kluster. Deras « resursbegränsade GPU-allokerare » ersätter FIFO-schemaläggning med optimering över en 24-timmarshorisont, samtidigt som den respekterar GPU-kontiguitet och efterfrågekurvor i realtid. På sju testade scenarier ligger förbättringarna i utnyttjande mellan 51,6 % och 72,4 % i blandat läge, upp till 53,6 % till 87,0 % på träningslaster. Ett test med enhetlig prioritet bekräftar en förbättring på 23,1 % oberoende av prioritetssignalen, och ett kluster med 64 GPU:er håller en värdeökning på 15,9 % med en allokeringslatens på 15 ms.
🔗 Hugging Face — Dharma-AI GPU-allokerare
Gemini: Sheets canvas förvandlar kalkylark till mini-appar
17 augusti — Google lanserar Sheets canvas, som bygger på Gemini 3.7 Flash för att förvandla ett klassiskt Google Sheets-kalkylark till en interaktiv mini-app, utan att skriva kod. Till skillnad från vanliga prototypverktyg som genererar ett låst gränssnitt från en statisk export, analyserar Sheets canvas arkets schema nativt (kolumner, datatyper, relationer) för att bygga funktionella gränssnittskomponenter — ett simuleringsbord för « vad händer om » blir till exempel en uppsättning reglage som justerar finansiella prognoser i realtid.
Den framhävda nyheten är dubbelriktad synkronisering: interaktioner i mini-appen slår igenom i realtid i det underliggande arket, och tvärtom. Användaren kan sedan finjustera appen genom ren konversation, där Gemini bevarar kontexten för att iterera utan att börja om från början. Sheets canvas finns nu tillgängligt för Google AI Pro- och Ultra-prenumeranter, och utrullningen är planerad för Google Workspace-företags- och utbildningskonton på vissa abonnemang.
🔗 Google AI — meddelande om Sheets canvas
GitHub Copilot: canvases, kodsökning och konfigurerbara granskningar
GitHub publicerar tre tekniska och produktmässiga nyheter mellan den 16 och 17 augusti, kring styrning av agentiska arbetsflöden och prestandan i sin sökmotor.
Canvases gör agentiska arbetsflöden synliga och styrbara
17 augusti — GitHub beskriver i detalj « canvases », en bestående och delad arbetsyta i Copilot-appen för att följa komplexa agentiska arbetsflöden utan att de försvinner i chattscrollen. Tillvägagångssättet bygger på fyra principer: definiera arbetsflödets tillstånd, lyfta fram beslutspunkter, omedelbart spara framsteg och behålla explicita mänskliga godkännandepunkter. Två konkreta canvases illustrerar metoden — ett « Java Modernization Studio » som organiserar en migrering i faser (utvärdering, åtgärd, validering, leverans), och ett « Site Studio » som hanterar innehållsskapande med redigerbara sektioner och granskningsspårning — båda offentliga i repositoryt awesome-copilot. Författaren nämner en kostnad på omkring 2 000 till 3 000 AI-krediter per canvas.
🔗 GitHub — hur canvases gör agentiska arbetsflöden styrbara
Kodsökning: case-folding körs med över 45 GiB/s på en enda kärna
16 augusti — GitHub publicerar en erfarenhetsrapport om optimeringen av case-folding (normalisering av versaler/gemener för skiftlägesokänslig jämförelse) i sin sökmotor Blackbird, som indexerar mer än 180 miljoner repositories och 480 TB kod. Den mest betydelsefulla optimeringen är kontraintuitiv: att ta bort en gren för tidig utgång i stället för att lägga till en, vilket gör att LLVM kan vektorisera loopen helt via NEON-instruktioner.
| Version | Genomströmning |
|---|---|
| Naiv (med tidig utgång) | 3,1 GiB/s |
| Helt grenfri loop | mer än 45 GiB/s |
| Värsta fall (fullständig folding, icke-ASCII) | 869 MiB/s |
Teamet publicerar resultatet som en öppen källkods-Rust-crate med namnet casefold.
“GitHub case-folds every byte of code search at over 45 GiB/s on one core. The biggest win came from removing an early-exit branch, not adding one.”
🇸🇪 GitHub tillämpar case-folding på varje byte i sin kodsökning med över 45 GiB/s på en enda kärna. Den största vinsten kom från att ta bort en gren för tidig utgång, inte från att lägga till en. — @github på X
🔗 GitHub — case-folding av källkod i minneshastighet
Copilot code review: Balanced-djup går till allmän tillgänglighet
16 augusti — GitHub Copilot låter nu användare välja djupet på automatiserade kodgranskningar för pull requests: « Balanced » (mer fördjupad analys, komplexa ändringar) går till allmän tillgänglighet, vid sidan av « Lite » (enkla ändringar som snabbt ska valideras). Inställningen kan sättas som standard på organisations- eller repository-nivå, eller väljas ad hoc när granskning begärs för en viss PR.
🔗 GitHub — Balanced-djup i allmän tillgänglighet
OpenAI: defensiv cybersäkerhet och effektivitetsvinster för GPT-5.6 Sol
The Defender’s Window — OpenAI:s strategi för defensiv cybersäkerhet
17 augusti — Greg Brockman, ordförande för OpenAI, återkommer till säkerhetsincidenten OpenAI-Hugging Face, som beskrivs som en vändpunkt: ett agentiskt kollektiv kedjade ihop sårbarheter för att ta sig in i OpenAI:s forskningsinfrastruktur och produktionsinfrastrukturen hos ett annat företag. OpenAI påminner om att man har begränsat spridningen av sina cyberförmågor till endast « betrodda försvarare », men noterar att andra laboratorier publicerar öppna viktsmodeller med offensiva kapaciteter nära gränsen — senaste exemplet som nämns är GLM-5.3 från Z.ai, väntad i slutet av augusti. OpenAI tränar nu sina modeller att producera kod som är « supermänskligt säker » och satsar på deras matematiska bevisförmåga för att formellt verifiera mjukvarusäkerhet.
Konkrekt anekdot: efter incidenten bad Brockman ChatGPT Work (GPT-5.6 Sol) att granska säkerheten på hans egen webbplats. På ungefär 15 minuter upptäckte verktyget 13 problem — felkonfigurerad DNS som möjliggjorde e-postspoofing, föråldrad jQuery, okrypterad trafik mellan Cloudflare och AWS — och åtgärdade dem sedan på ungefär en timme, utan tung mänsklig inblandning.
🔗 OpenAI — The Defender’s Window
GPT-5.6 Sol — uppmätta effektivitetsvinster hos kunder och på ARC-AGI-3
17 augusti — Tack vare retained reasoning och komprimering har GPT-5.6 Sols resultat på ARC-AGI-3 ökat från 13,3 % till 38,3 %, samtidigt som det förbrukar omkring 6 gånger färre utgångstokens. Två konkreta kundexempel: fastighetsstartupen hypha_ai behöll 98 % av GPT-5.5:s precision samtidigt som kostnaden minskade 18 gånger genom att gå över till GPT-5.6 Luna, och RogoAI (finansiell analys) använde programmatiska verktygskall för att matcha kvaliteten i sina utvärderingar med 21 % färre inmatningstokens.
🔗 OpenAI Devs — effektivitetsvinster för GPT-5.6 Sol
Mediegenerering: ElevenLabs i Claude, Seedance 2.5 hos Pika och Luma
ElevenLabs lanserar sin MCP-server, direkt tillgänglig i Claude
17 augusti — ElevenLabs erbjuder en officiell MCP-server (Model Context Protocol) för att hantera sina röst- och chattagenter direkt från Claude, utan att lämna arbetsmiljön: se senaste prestanda, skapa nya agenter, uppdatera konfigurationer, uppskatta kostnaden i LLM-token innan en ändring bekräftas. Autentiseringen sker via OAuth, utan någon server att hosta eller API-nycklar att hantera, och teamet får kontroll över vad agenterna faktiskt får se eller ändra.
🔗 ElevenLabs — meddelande om MCP-servern
Seedance 2.5 i 1080p anländer till Pika API Club och Luma med 4K-upscale
17 augusti — Efter sin förtidsåtkomst på Runway den 15 augusti fortsätter Seedance 2.5 i 1080p-upplösning sin utrullning hos tredjepartspartners. Pika Labs öppnar det via sitt Pika API Club och anger ett pris som är upp till 60 % billigare än konkurrenternas. Luma Labs meddelar samma dag tillgängligheten för Seedance 2.5 i 1080p, med en kompletterande funktion: upscale till 4K direkt på sin plattform.
🔗 Pika Labs — Seedance 2.5 på Pika API Club
Kortnytt
- ABC Legal inför över 50 agenter med Claude Managed Agents — 1 100 anställda, upp till 50 % kostnadsminskning på vissa juridiska uppgifter, veckovis feedbackloop via Slack och pull requests. 🔗 Claude
- Hugging Face-teamet Diffusers integrerar fyra nya öppna modeller på en vecka — MiniMax H3 (video/audio), LTX2.5 (video/audio), Wan Animate 2 och MiniMax Music 3. 🔗 Tweet
- datatrove 0.10.0 kör pipelines på Hugging Face Jobs utan Slurm-kluster — ny
JobsPipelineExecutoroch stöd för Hugging Face-lagringsbucketar somDataFolder. 🔗 Tweet - Together AI värdar kodgenereringsmodellerna från Relace AI — tränade på dedikerade GPU-kluster för Y Combinator-programmet. 🔗 Tweet
- På ICML framhåller Tri Dao att öppna modeller närmar sig de slutna labben — nu bara några månaders fördröjning, drivet av framsteg i service-stacken (kärnor, inferensmotorer, spekulativ avkodning). 🔗 Tweet
- Google, Gemini och Pixel formaliserar ett partnerskap med fem europeiska fotbollsklubbar — Arsenal, FC Barcelona, Bayern München, Liverpool och PSG, med ett åtagande om motsvarande synlighet för damfotbollen. 🔗 Google
- OpenClaw: GitHub-teaser på X — GitHub-kontot nämner ett projekt som heter OpenClaw utan några ytterligare tillgängliga detaljer. 🔗 Tweet
- MiniMax-H3 hävdar en 4,44x vinst på RTX 4090 — ny CuTe DSL-kärna dedikerad till SM89 för uppmärksamhetsmekanismen Sol-Attn. 🔗 Tweet
- Alibaba ordnar en livesession med skaparna av Wan3.0 den 19 augusti — med partnerna Magnific, fal, OpenArt och KoyalAI, kl. 15 UTC. 🔗 Tweet
- Kling presenterar effekten « Hitchcock Zoom » — ny effekt för videogenerering inspirerad av den omvända zoom-travelling som populariserades av Alfred Hitchcock. 🔗 Tweet
- MiniMax H3 till -50 % på 2K-generering via Magnific till och med 1 september — rabatt tillkännagiven under ett evenemang i San Francisco. 🔗 Tweet
- GPT-5.6 Sol till halva priset på AI Gateway (Vercel) och OpenRouter — tillfälliga kampanjer på 50 % till och med 18 september 2026, tillämpas automatiskt på användningen. 🔗 Tweet
- OpenAI finansierar 14 forskningsprojekt inom offentlig politik för AI-eran — 1 miljon dollar i finansiering och upp till 1 miljon dollar i API-krediter, fördelade på 5 länder/regioner. 🔗 OpenAI
- Codex lyfts fram genom användaromdömen — en innehållsskapare (över 1,5 miljoner prenumeranter) driver sin verksamhet med Codex, och en OpenAI-anställd använder det som intern videoredigeringsassistent. 🔗 Tweet
Vad det betyder
Skalan för AI-infrastruktur passerar en ny fysisk och finansiell tröskel. Sajten i Ohio kombinerar i sig själv 8 gigawatt-IT som mål, 35 000 byggjobb och ett OpenAI/NVIDIA-datorkommitment som uppskattas till 600 miljarder dollar fram till 2030 — ett projekt som nu kan jämföras med nationella industri- eller energiprojekt snarare än med ett enkelt datacenter. Finansieringsmekanismen som NVIDIA har avslöjat (partiellt stöd för hyres- och energibetalningar snarare än full finansiering) visar också att även de största AI-laboratorierna måste luta sig mot specifika finansieringsupplägg för att absorbera denna kostnadsnivå.
Kodhosting blir i sig självt en agentisk stridsplats. Cursor lanserar Origin för att inte längre vara beroende av GitHub för infrastrukturen som driver dess agenter, GitHub svarar med canvases för att göra agentiska arbetsflöden styrbara snarare än att de går förlorade i chatten, och Replit lägger till black-box pen tests så att dess egen Agent kan rätta det den upptäcker med ett klick. I alla tre fallen konvergerar målet: att ge agenter ett direkt och säkert grepp om kodens livscykel, inte bara om dess generering.
Kostnaden för inferens fortsätter att sjunka snabbare än kapaciteten ökar. DeepSeek V4 Pro behandlar DeepSWE till 35 gånger lägre kostnad än GPT-5.6 Sol, Yutori Navigator kör 4 till 5 gånger billigare än referensmodellerna, och GPT-5.6 Sol förbättrar sig själv från 13,3 % till 38,3 % på ARC-AGI-3 samtidigt som den använder 6 gånger färre tokens — samma vecka som Tri Dao på ICML understryker att öppna modeller stänger kvalitetsgapet på några månader. GPU-allokatorn under begränsning från Dharma-AI tillför en kompletterande dimension: en del av dessa vinster kommer inte längre från modellen utan från själva schemaläggningen av klustren.
Slutligen blir teknisk noggrannhet återigen ett kommunikationsargument i sig. GitHub multiplicerar genomströmningen i sin kodsökning med 15 genom att ta bort kod snarare än att lägga till den, och OpenAI beskriver hur en säkerhetsgranskning av GPT-5.6 Sol korrigerade 13 verkliga sårbarheter på en timme — två olika sätt att visa, med siffror som stöd, att detaljerad ingenjörskonst fortfarande är det som skiljer en produktannonsering från en kompetensdemonstration.
Källor
- OpenAI — OpenAI går med i PORTS-Pike-projektet
- NVIDIA — säkra intelligensens infrastruktur
- Cursor — tillkännagivande av Origin på X
- Cursor — changelog för Origin code hosting
- Replit — black-box pen tests
- Together AI — DeepSeek V4 Pro 0813
- Together AI — Yutori Navigator
- Hugging Face — Dharma-AI GPU-allokator
- Google AI — tillkännagivande av Sheets canvas
- GitHub — canvases i Copilot-appen
- GitHub — case-folding på X
- GitHub — case-folding i minneshastighet
- GitHub — Copilot code review Balanced på X
- OpenAI — The Defender’s Window
- OpenAI Devs — GPT-5.6 Sol-effektivitet
- ElevenLabs — MCP-server
- Pika Labs — Seedance 2.5 1080p
- Claude — ABC Legal-fallstudie
- Hugging Face Diffusers — fyra nya modeller
- datatrove 0.10.0
- Together AI — Relace AI
- Together AI — Tri Dao på ICML
- Google — fotbollspartnerskap
- GitHub — OpenClaw-teaser
- MiniMax-H3 — RTX 4090-vinst
- Alibaba Wan — livesession
- Kling — Hitchcock Zoom-effekt
- MiniMax H3 — Magnific-kampanj
- OpenRouter — GPT-5.6 Sol-kampanj
- OpenAI — finansiering av forskning om offentlig politik
- Peter Yang — Codex-vittnesmål