ai-powered-markdown-translatorArtikel översatt från fr till sv med gpt-5.4-mini.
Den 11 juli lämnar agenterna koden och börjar påverka den verkliga världen: Replit kopplar sin agent till Ramp för att bilda ett bolag och hantera kassa, fakturor och utgifter autonomt, GitHub publicerar ett open source-dataset med över 40 miljoner repos om kodens språkliga fördelning, och HeyGen följer upp med två utvecklarannonser — transparent videoutgång i WebM och automatisk redigering synkroniserad med talade videor. Pika demonstrerar samtidigt avancerade videoredigeringsfunktioner via en modell som den kallar “Gemini Omni”, en tillskrivning som ännu inte bekräftats av Google. Fem kortnotiser kompletterar bilden, från Together AIs telefonlinje till Cohere:s infrastruktursamarbete med NVIDIA och CoreWeave.
Replit lanserar Ramp for Agents: dess agenter hanterar nu företagets finanser
11 juli — Replit har tillkännagett ett partnerskap med Ramp, en plattform för finansiell hantering och företagskort, som gör det möjligt för dess agent att gå bortom kodgenerering och ta hand om verkliga finansiella uppgifter. Konkret kan Replits agent nu hjälpa till att skapa ett bolag (incorporation), skicka in en ansökan om ett Ramp-konto för den här enheten och sedan förbereda företaget för att spendera pengar, betala sina fakturor och hantera sin kassa — allt i en konversation på naturligt språk.
Lanseringen ligger i linje med Replits strategi, som redan har öppnat sin agent för e-handel (Shopify-integration, juni 2026) och upptäckbarhet (SEO Agent, juni 2026). Produkten går via en dedikerad sida som drivs av Ramp, “Finance for the Agent Economy”, som förser agenter med kort, överföringar och bankkonton med inbyggda kontroller för att styra varje spenderad dollar.
“Ramp for Agents.
Replit Agent can now incorporate your company, apply for Ramp, and get your business ready to spend, pay bills, and manage money.
Every company used to start with paperwork. The next one starts with a prompt.”
🇸🇪 Ramp for Agents. Replit-agenten kan nu bilda ditt bolag, ansöka om Ramp och göra ditt företag redo att spendera pengar, betala räkningar och hantera pengar. Varje företag började en gång med pappersarbete — nästa börjar med en prompt. — @Replit på X
GitHub publicerar Multilingual Repositories Dataset
11 juli — GitHub har publicerat GitHub Multilingual Repositories Dataset, en ny öppen datamängd riktad till forskare och utvecklare som arbetar med flerspråkig AI. Den omfattar över 40 miljoner repos och mer än 80 miljoner klassificeringsrader, och kartlägger var README-filer, issues och pull requests skrivna på andra språk än engelska finns på plattformen.
| Mätt indikator | Mätt värde |
|---|---|
| Täckta repos | 40M+ |
| Klassificeringsrader | 80M+ |
| README-repos på portugisiska (dominerande) | 3M+ |
| Dominerande språk i issue-texter | Koreanska |
De siffror som GitHub lyfter fram visar konkreta språkliga trender: koreanska dominerar issue-texter, medan portugisiska ligger i topp för README-filer, med över 3 miljoner berörda repos. Det rör sig inte om en Copilot-funktion i egentlig mening, utan om en forsknings- och öppen data-publicering, i linje med GitHubs positionering som en utvecklingsplattform driven av AI.
🔗 Tweet @github — Multilingual Repositories Dataset
Pika redigerar videor med en modell som den kallar “Gemini Omni”
11 juli — Pika publicerade en videodemonstration som lyfter fram avancerade redigeringsfunktioner applicerade på en av användaren importerad video: ändring av bakgrund, ändring av kameravinkel, ändring av klädsel, tillägg av visuella effekter och till och med dubbning av rösten på franska — allt presenterat av Pika som möjligt “with Gemini Omni”.
“Drop in your video and change the background, change the angle, swap the outfit, add visual effects, even make it speak French — all with Gemini Omni”
🇸🇪 Importera din video och ändra bakgrunden, ändra vinkeln, ändra klädseln, lägg till visuella effekter, låt den till och med prata franska — allt med Gemini Omni. — @pika_labs på X
Redaktionell försiktighet: namnet “Gemini Omni” förekommer ännu inte i något officiellt tillkännagivande från Google eller DeepMind — den särskilda genomgången av Gemini-tillkännagivanden visade inga nyheter den 11 juli. Det är namnet som Pika själv använder för att beteckna den underliggande modellen bakom denna funktion; dess exakta existens och natur har inte fastställts oberoende. Den här nyheten bör läsas som en funktion som tillkännagivits av Pika, inte som en produktlansering bekräftad av Google.
Måttligt engagemang för kontot (15 000 visningar, 80 gilla-markeringar), klart under Pikas större publiceringar — ett tecken på ett funktionsmeddelande snarare än en flaggskeppsproduktlansering.
HeyGen stärker sitt utvecklarekosystem: transparent video och automatiserad redigering
Två tillkännagivanden samma dag för HeyGen, det ena om videoutgångsformatet, det andra om automatisering av redigering.
Transparent videoutgång i WebM via API, CLI och MCP
11 juli — HeyGen tillkännagav ett nytt videoutgångsalternativ på sitt API, sin CLI och sin MCP-server: WebM-format med transparent alfakanal. Genom att ange parametern output_format: "webm" på endpointen /v3/videos kommer de genererade avatarvideorna tillbaka med en verkligt transparent bakgrund (nativ alfakanal), utan att använda en grön bakgrund (green screen) som måste friläggas i efterhand.
Den här funktionen riktar sig till utvecklare som komponerar avatarvideor i större produktioner — redigering, överlägg, integration i 3D-scener. Den tillhörande tråden illustrerar ett konkret exempel: en avatar kompositerad direkt i en three.js-scen i Minecraft-stil.
🔗 Tweet @HeyGen — transparent WebM-utgång
“Talking-Head-Recut Skill” synkroniserar grafik med en talad video
11 juli — Sjätte avsnittet i en serie dagliga demonstrationer kring HyperFrames, HeyGens agentstyrda videoproduktionsmiljö: “Talking-Head-Recut Skill” lägger grafiska överlägg (animerade titlar, räknare, kort, citat) ovanpå en “talking head”-video, automatiskt synkroniserade med det talade innehållet. Agenten läser transkriptionen, avgör vilka element som förtjänar en grafik och ritar sedan varje kort enligt den angivna grafiska profilen.
Demonstrationen visar arbetsflödet från början till slut utifrån en enda prompt: sökning efter ett aktuellt ämne (OpenAIs tillkännagivande av GPT-5.6), källhänvisat manus, avatar genererad direkt från HeyGens CLI, grafisk profil hämtad live från chatgpt.com, och sedan slutrendering med undertexter och musik — utan videoredigerare eller kamera. Skillet är dokumenterat som open source på GitHub.
🔗 Tweet @HeyGen — Talking-Head-Recut Skill 🔗 GitHub — talking-head-recut skill
Kortnotiser
- Together AI lanserar en rösttelefonlinje — en minimalistisk tweet (“Why type when you can call?”) leder till
docs.together.ai/call, som öppnar en telefonknappsats (+1 415-723-8167, ext. 676) som kopplar uppringaren till en röstassistent driven av Together AIs inferensplattform, utan någon tillhörande bloggartikel. 🔗 Tweet @togethercompute - Pika lägger ut en experimentell MCP-server —
experiment.pika.art(“Pika MCP – Make Your Agent Creative”) gör det möjligt för AI-agenter att anropa Pikas kreativa funktioner för videogenerering och videoredigering direkt från sin agentmiljö. 🔗 Tweet @pika_labs - MiniMax och Fireworks AI optimerar M3-kärnan på Blackwell — en ny “KV-stationary”-kernel utvecklad av Fireworks AI för MiniMax öppna modell M3 läser varje valt block endast en gång, bevarar vinsterna från sparse attention och uppnår omkring 980 TFLOP/s på en B200-GPU. 🔗 Tweet @MiniMax_AI
- GPT-Live rullas ut till 100 % globalt — OpenAIs full-duplex-röstfunktion, lanserad den 8 juli, når sin fullständiga utrullning i ChatGPT; OpenAI fördubblar tillfälligt röstanvändningsgränsen för helgen 11–12 juli. 🔗 Tweet @athyuttamre
- Cohere lyfter fram sitt partnerskap med NVIDIA och CoreWeave — institutionell kommunikation på X kring tillförlitlighet och infrastruktursskydd för stora företag som använder AI, utan tekniska detaljer eller tillhörande artikel. 🔗 Tweet @cohere
Vad det betyder
Videoproduktion blir en helt agentstyrd pipeline, från redigering till distribution. HeyGen tar bort ett klassiskt tekniskt steg — friläggningen av den gröna bakgrunden — genom att göra den nativa alfakanalen tillgänglig via API, CLI och MCP, och automatiserar synkroniseringen av grafik på talade videor via sin Talking-Head-Recut Skill: en enda prompt räcker nu för att producera en källhänvisad, grafiskt utformad och textad video utan kamera eller redigerare. Pika driver samma logik på efterproduktionssidan, med en modell som den kallar “Gemini Omni” för att ändra bakgrund, vinkel och klädsel i en befintlig video — en tillskrivning som, eftersom den saknar officiell Google-bekräftelse, också illustrerar en tendens att ge tekniska byggblock smeknamn för att ge dem en känsla av kraft, något som bör mötas med nödvändig försiktighet.
Agenter lämnar koden och rör sig in i ett företags administrativa och finansiella arbete. Ramp for Agents låter Replits agent bilda ett bolag, öppna ett Ramp-konto och hantera kassa och fakturor — ett område som fram till nu varit strikt mänskligt. Samma rörelse återfinns, i mindre skala, i Pika MCP, som öppnar Pikas kreativa funktioner för externa AI-agenter via en experimentell MCP-server: agenten nöjer sig inte längre med att skapa, den orkestrerar tredjepartstjänster för användarens räkning.
Grunderna för flerspråkig AI och storskalig inferens fortsätter att öppnas upp. GitHubs Multilingual Repositories Dataset dokumenterar, på skalan 40 miljoner repos, var koreanska, portugisiska och andra språk i den globala koden faktiskt finns — en resurs för alla forskare som arbetar med flerspråkiga modeller. Den KV-stationary-kernel som Fireworks AI har utvecklat för MiniMax M3 illustrerar samma infrastrukturarbete på inferenssidan, genom att på Blackwell bevara de teoretiska vinsterna med sparse attention. Cohere:s förstärkta partnerskap med NVIDIA och CoreWeave fullbordar bilden: infrastrukturens tillförlitlighet blir ett försäljningsargument i sig för företags-AI.
Rösten etablerar sig som en egen produktkanal, snarare än bara en extra funktion. GPT-Live når full utrullning hos OpenAI bara tre dagar efter lanseringen, med fördubblade gränser för att uppmuntra testning; Together AI öppnar å sin sida en telefonlinje som direkt kopplar uppringaren till en röstassistent driven av dess inferensplattform. Två olika sätt — det ena integrerat i en befintlig app, det andra tillgängligt från en vanlig telefon — för samma satsning: det röstbaserade gränssnittet blir en fullvärdig ingång till modellerna, inte bara ett alternativ bland andra.
Källor
- Tweet @Replit — Ramp for Agents
- Tweet @github — Multilingual Repositories Dataset
- Tweet @pika_labs — videoredigering med “Gemini Omni”
- Tweet @HeyGen — transparent WebM-utgång
- Tweet @HeyGen — Talking-Head-Recut Skill
- GitHub — talking-head-recut skill
- Tweet @togethercompute — rösttelefonlinje
- Tweet @pika_labs — Pika MCP
- Tweet @MiniMax_AI — M3-kernel på Blackwell
- Tweet @athyuttamre — GPT-Live rullas ut till 100 %
- Tweet @cohere — partnerskap med NVIDIA och CoreWeave