Zoeken

Claude Code bediend vanaf de telefoon, GLM-5.3 voorbij GPT-5.6 Sol en Claude Fable 5, Perplexity licht zijn Brain-geheugen toe

Artikel gegenereerd door kunstmatige intelligentie
Claude Code bediend vanaf de telefoon, GLM-5.3 voorbij GPT-5.6 Sol en Claude Fable 5, Perplexity licht zijn Brain-geheugen toe

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

Op 22 augustus opent Anthropic Claude Code Remote Control voor het starten van sessies vanaf de telefoon, terwijl Google Antigravity voorziet van een vergelijkbare functie om zijn agents op afstand te besturen. Aan modelzijde tonen twee vergelijkingen van Together AI dat het open model GLM-5.3 GPT-5.6 Sol en Claude Fable 5 evenaart of overtreft op de DeepSWE-benchmark, tegen een fractie van de kosten. Perplexity licht daarnaast de architectuur van Brain toe, zijn versiegebaseerde agentische geheugen met Git, en NotebookLM wordt voor alle gebruikers toegankelijk met integratie in de AI-modus van Google Search. Ook op het menu: Replit herziet zijn agentmodi, Runway opent een licentieaanbod voor modellen, OpenAI scherpt zijn controle op API-kosten en zijn Codex-beveiligingssuite aan, en Grok Bot breidt zijn toegang uit.


Claude Code Remote Control: meer betrouwbaarheid en sessiestart vanaf de telefoon

22 augustus — Anthropic publiceert op X een draad met meerdere betrouwbaarheidsfixes voor Remote Control, de functie waarmee je een Claude Code-sessie vanaf een telefoon kunt bedienen terwijl die op een externe computer draait. De status­synchronisatie tussen telefoon en machine laat na het afsluiten van Claude Code geen spooksessie meer zien, netwerkonderbrekingen (wifi-wissel, klep dichtklappen) triggeren voortaan automatisch opnieuw verbinden, en het openen van grote sessies gaat op iOS aanzienlijk sneller. Drie slash-commando’s krijgen speciaal mobiel gedrag (/clear, /compact, /diff). Productnieuws: het wordt mogelijk om een sessie direct vanaf de telefoon te starten — elke machine waarop claude remote-control draait verschijnt als een apparaatkaart in het Code-tabblad, selecteerbaar om de sessie op afstand te starten.

Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.

🇳🇱 Je telefoon blijft nu gesynchroniseerd met wat er op je machine draait. Wanneer je een sessie op je laptop hervat, blijft de telefoon op de actieve sessie in plaats van die te archiveren. Als Claude Code stopt, toont je telefoon het binnen enkele seconden offline in plaats van een verouderde sessie zichtbaar te laten.@ClaudeDevs op X

🔗 Volledige draad op X 🔗 Documentatie voor Remote Control


Replit: Conversations, hernoemde Agent-modi (Power/Max), en Routines en Memories in bèta

22 augustus — Replit publiceert zijn wekelijkse overzicht This Week in Replit, met drie nieuwe functies. Conversations maakt het mogelijk om een app-idee te starten met een fase van onderzoek en conversationele ideevorming voordat wordt overgeschakeld naar bouwen, zonder de verzamelde context te verliezen — een veelvoorkomend probleem wanneer die fase in een andere AI-assistent begon. De modi van de Agent zijn hernoemd: de oude Economy-modus wordt Power, de oude Power-modus wordt Max, met identieke kosten voor beide. Tot slot komen Routines en Memories in bèta: Routines plannen de uitvoering van een taak op basis van een gesprek en leveren het resultaat automatisch terug, ondersteund door een persistent geheugensysteem. Deze aankondigingen werden live gepresenteerd tijdens Replits Friday Showcase.

🔗 Aankondigingsdraad


Together AI vergelijkt GLM-5.3 met GPT-5.6 Sol en Claude Fable 5 op DeepSWE

21 augustus — Together AI publiceert op dezelfde dag twee onafhankelijke vergelijkingen waarin GLM-5.3, het nieuwste open model van Zhipu/Z.ai, tegenover twee gesloten referenties op DeepSWE wordt gezet, hun benchmark voor software-engineering (113 taken, 4 pogingen per configuratie, maximale inzet, 904 runs in totaal). Tegenover GPT-5.6 Sol geeft GLM-5.3 de eerste poging prijs, maar evenaart het al op de tweede en overtreft het op de vierde, tegen een veel lagere kostprijs. Tegenover Claude Fable 5 is de initiële kloof vrijwel nul en groeit die duidelijk in het voordeel van GLM-5.3 bij meerdere pogingen — Claude Fable 5 blijkt de duurste configuratie van de vergelijking. Een GLM-5.3-naar-Sol-cascade, die alleen opschaalt als tests mislukken, haalt 85,9% succes tegen 6,61 dollar per taak, een beter resultaat dan een perfecte oracle-router (83,8%).

Geteste vergelijkingScore bij eerste pogingScore na 4 pogingenKost per run
GLM-5.3 vs GPT-5.6 Sol69,0 % vs 72,7 %87,6 % vs 85,8 %3,99 $ vs 8,37 $ (2,1× goedkoper)
GLM-5.3 vs Claude Fable 569,0 % vs 69,7 %87,6 % vs 84,1 %3,99 $ vs 21,63 $ (5,4× goedkoper)

Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.

🇳🇱 Kies niet één enkel model. Laat eerst GLM-5.3 draaien en schaal op naar GPT-5.6 Sol wanneer de tests mislukken. Deze cascade lost 85,9% van de DeepSWE-taken op voor 6,61 dollar per stuk. Sol alleen lost 72,7% op voor 8,37 dollar. Dertien punten beter, 21% goedkoper.Together AI, officiële blog

🔗 Vergelijking GLM-5.3 vs Claude Fable 5


21 augustus — Het X-account van NotebookLM, hernoemd naar Gemini Notebook, kondigt aan dat de vernieuwde Notebook-ervaring na een gefaseerde uitrol nu beschikbaar is voor alle gebruikers op het web (een mobiele versie wordt aangekondigd), nadat eerst stapsgewijs werd uitgerold. Een andere structurele verandering: notebooks zijn nu rechtstreeks toegankelijk vanuit de AI-modus van Google Search, waardoor de tool voor documentensamenvatting dichter bij de belangrijkste zoekmachine van Google komt te staan. De aankondiging bevat ook twee fixes voor Chat: betere weergave en kopiëren-plakken van wiskundige vergelijkingen, en het verhelpen van een bug die cijfers omgekeerd weergaf in talen die van rechts naar links worden geschreven (Arabisch, Hebreeuws). Meer nieuwigheden worden in de komende weken beloofd.

🔗 Aankondiging op X


OpenAI voegt uitgavenmonitoring per API-sleutel toe aan de dashboards Usage and Spend

21 augustus — OpenAI voegt granulariteit per API-sleutel toe aan de dashboards Usage and Spend van zijn ontwikkelaarsplatform. Tot nu toe geaggregeerd op organisatieniveau of projectniveau, maakt de uitgavenmonitoring het nu mogelijk om de bijdrage van elke afzonderlijke API-sleutel te isoleren, zodat precies zichtbaar wordt welke toepassingen of workflows de rekening het zwaarst beïnvloeden. De functie wordt geleverd met configureerbare uitgavenlimieten op organisatieniveau of projectniveau, inclusief de mogelijkheid om harde limieten in te stellen die het verkeer automatisch afsnijden zodra het plafond is bereikt. Deze controles zijn toegankelijk via de interface van de API Platform en via de Admin API, zodat ze in programmatische workflows kunnen worden geïntegreerd. OpenAI presenteert deze update als aanvulling op de tariefverlaging van GPT-5.6 Sol die dezelfde dag werd aangekondigd.

🔗 Aankondiging op X


Codex Security: praktische gids en open source CLI voor cyberverdediging (Daybreak)

21 augustus — OpenAI publiceert een gids waarin het Daybreak-ecosysteem wordt uiteengezet, zijn op AI gebaseerde cyberverdedigingsplatform, van de eerste triage in ChatGPT tot de productie van een geverifieerde patch. Het meest concrete punt voor ontwikkelaars is de Codex Security CLI, een open source-tool gepubliceerd als npm-pakket (@openai/codex-security), bruikbaar om een lokale repository te scannen (npx @openai/codex-security scan .) en integreerbaar in CI/CD (GitHub Actions, GitLab CI/CD) met export in SARIF-formaat. Opvallende nieuwigheid: de bulk-scan, waarmee een hele portefeuille van repositories wordt geaudit op basis van een CSV-inventaris, met hervatting na onderbreking en configureerbare parallelle verwerking. OpenAI onderscheidt ook twee toegangsniveaus: Daybreak Blue (triage van kwetsbaarheden, validatie van patches) voor goedgekeurde verdedigers, en Daybreak Red (gevorderd onderzoek naar kwetsbaarheden, red teaming), voor een beperkter aantal toegestane toepassingen. Codex Security cloud heeft inmiddels meer dan 30 miljoen commits geanalyseerd op meer dan 30.000 codebases.

🔗 Volledige gids


Grok Bot breidt zijn toegang uit naar meer abonnementen en wordt gratis op proef

21 augustus — Tien dagen na de bètastart breidt Grok Bot zijn toegang uit naar een breder scala aan abonnementen: SuperGrok Plus, SuperGrok Heavy, evenals de Cursor-aanbiedingen (Pro+, Ultra en alle Teams-abonnementen). Gebruikers buiten deze abonnementen krijgen nu een gratis proef met beperkt gebruik. Deze autonome AI-agents beschikken over hun eigen cloudomgeving met browser- en terminaltoegang, voor taken zoals commerciële prospectie, het bouwen van complete websites (inclusief domeinaankoop en deployment), het sorteren van inboxen, klantenondersteuning of notulen maken tijdens vergaderingen. Meerdere Bots kunnen parallel draaien in dezelfde groep, en een ‘routine’-modus laat een Bot een taak leren door de gebruiker die eenmaal uit te voeren. Er is een enterprise-wachtlijst geopend voor grootschaligere uitrol.

🔗 Aankondiging op X


Runway licht zijn bedrijfsstrategie en een licentieaanbod voor modellen toe

21 augustus — De nieuwe commercieel directeur van Runway, Sean Holcombe, licht in een blogpost de bedrijfsstrategie toe: de omzet is op jaarbasis meer dan verdubbeld, de nettoretentie ligt boven 300%, en de internationale uitbreiding is sterk (Europa boven 20% van de enterprise-basis, Japan is de grootste Aziatische markt geworden). De meest structurele aankondiging is de lancering van een licentieaanbod voor modellen: in plaats van een gebruiksgefactureerde API-toegang kunnen sommige enterprise-klanten gesloten modelgewichten en een propriëtair trainings-/inferentiekader krijgen om rechtstreeks in hun eigen omgeving te hosten en verder af te stemmen. Runway richt zich op vier profielen: bedrijven met eigen creatieve intellectuele eigendom, platforms die al over rekenkracht beschikken, organisaties met zware regelgevingsvereisten, en spelers met zeer grote volumes.

🔗 Volledige blogpost


Perplexity licht Brain toe, het agentische geheugensysteem van Computer

19 augustus — Perplexity licht de werking toe van Brain, het persistente geheugensysteem van Computer, zijn lokale agent. In plaats van een klassieke vectordatabase organiseert Brain geheugen in de vorm van een met Git geversioneerd kennis-wiki, verdeeld over drie lagen in het bestandssysteem van de sandbox: knowledge/ (de wiki), notes/ (gedistilleerde fragmenten) en sessions/ (ruwe transcripties). Een speciale “Memory Agent” laadt op aanvraag relevante bestanden in plaats van bij elke start de volledige boomstructuur te kopiëren, terwijl achtergrondagents met de naam “Dream” de wiki offline in vier stappen onderhouden, met controles vóór publicatie.

Geëvalueerde metriekZonder BrainMet Brain
Nauwkeurigheid (interne benchmark, 640 vragen)0,6000,661
Bewijsherinnering (interne benchmark)0,5730,625
Nauwkeurigheid in productie (laatste 30 dagen)referentie+9,3 punten

🔗 Technisch artikel


Kort nieuws

  • Devin (Cognition) — extra korting van 20% op GPT-5.6 Sol — OpenAI voegt een prijsverlaging van 20% toe op GPT-5.6 Sol voor 3 maanden, boven op de korting van 70% die al sinds 18 augustus van kracht is: de cumulatieve korting op Devin Desktop en CLI bedraagt nu 76% tot 3 oktober 2026. 🔗 Aankondiging
  • Google Antigravity 2.9.1 — Remote Control om agents op afstand te besturen — Nieuwe functie waarmee een lokale agentsessie vanuit elke browser kan worden gestart en bewaakt, met prestatieverbeteringen en beter herstel na fouten. 🔗 Changelog
  • Auto model selection met -30% voor Copilot Max — Promotie op automatische modelkeuze (Claude, GPT of Microsoft AI) voor Copilot Max-abonnees, geldig tot 30 september 2026. 🔗 Aankondiging · 🔗 Einddatum
  • GitHub Universe 2026 — ticketverkoop opnieuw gelanceerd — Marketingherlancering van de GitHub Universe 2026-conferentie via een korte video, zonder bijbehorende productaankondiging. 🔗 Video
  • Midjourney — grote changelog voor de alpha van de site — Twee weken UX-fixes op alpha.midjourney.com: projectmappen, terugkeer van Upscale/Zoom/Vary, blijvende instellingen en prestatiecorrecties. 🔗 Changelog
  • MiniMax laat het lanceren van model M3 op SambaNova doorschemeren — In reactie op een cryptische aankondiging van SambaNova laat MiniMax een aanstaande komst van een model M3 doorschemeren, zonder specificaties of releasedatum te communiceren. 🔗 Tweet
  • Grok 4.6 beschikbaar op Google Enterprise Agent Platform — Het model voegt zich bij Model Garden (voorheen Vertex AI), met een contextvenster van 500.000 tokens en een prijs van 2 $ / 6 $ per miljoen tokens voor input/output. 🔗 Aankondiging
  • Cohere activeert een lokale modus voor spraakdictatie via superwhisper — De modus “Go Local” combineert Cohere Transcribe en het open model S1-mini (0,6 miljard parameters) van superwhisper, met volledig transcriptie op het apparaat. 🔗 Aankondiging

Wat dit betekent

Twee onafhankelijke aankondigingen, zonder verband met elkaar, komen vandaag samen rond dezelfde beweging: de aansturing van een AI-agent loskoppelen van de machine waarop hij daadwerkelijk draait. Bij Anthropic kan Claude Code Remote Control voortaan een sessie rechtstreeks vanaf de telefoon starten, met automatische herverbinding en synchronisatie van de status tussen apparaten. Bij Google introduceert Antigravity zijn eigen functie “Remote Control”: een lokale agentsessie besturen en bewaken vanuit eender welke browser. In beide gevallen blijven de rekenkracht en de uitvoering verankerd op de werkplek — het is het controleveld dat mobiel wordt. Deze ontkoppeling speelt in op een gebruik dat inmiddels gangbaar is: een langdurige taak starten op je ontwikkelmachine en die daarna volgen en opnieuw overnemen vanaf een ander apparaat, zonder de lopende uitvoering ooit te onderbreken.

De tweede beweging die vandaag zichtbaar is, raakt aan de economie van modellen. De twee vergelijkingen van Together AI laten zien dat GLM-5.3, een open model van Zhipu/Z.ai, GPT-5.6 Sol en Claude Fable 5 evenaart of overtreft op dezelfde software-engineeringbenchmark, tegen een kostprijs die 2 tot 5 keer lager ligt. Dat is geen geïsoleerd geval: in dezelfde week breidt xAI de cloudintegraties voor Grok 4.6 uit (Google Enterprise Agent Platform na GitHub Copilot en Amazon Bedrock), geeft OpenAI een cumulatieve korting van 76 % op GPT-5.6 Sol aan Devin-gebruikers, en vergroot Replit zijn eigen agentmodi. De concurrentie draait niet langer alleen om de ruwe capaciteit van modellen, maar om de prijs-prestatieverhouding en de beschikbaarheid op meerdere platforms — een terrein waarop open modellen, gecombineerd met cascadestrategieën tussen modellen, volwaardige commerciële troeven worden tegenover gesloten modellen.

Een derde lijn, discreter, loopt ook door de dag: persistent geheugen wordt een volwaardige infrastructuurlaag voor AI-agents. Perplexity licht de architectuur van Brain toe, een versioned kenniswiki met Git die het geheugen van zijn Computer-agent structureert in plaats van het op te stapelen in een klassieke vector database, met gemeten winst in nauwkeurigheid en recall van bewijzen. Tegelijk breidt Google de toegang uit tot de vernieuwde Notebook-ervaring van NotebookLM en integreert die rechtstreeks in de AI-modus van Google Search, waardoor de tool voor documentensamenvatting nog dichter tegen de hoofdzakelijke zoekmachine aan komt te liggen. In beide gevallen komt de toegevoegde waarde niet langer alleen van het onderliggende model, maar van de manier waarop de geschiedenis en de opgebouwde kennis worden georganiseerd, teruggevonden en hergebruikt van de ene sessie naar de andere.

Een laatste invalshoek betreft de volwassenheid van tools voor technische en beveiligingsteams in bedrijven. OpenAI voegt uitgavenbewaking per API-sleutel en configureerbare strikte limieten toe aan zijn dashboards, op hetzelfde moment dat het een gedetailleerde gids publiceert over Codex Security, met een open source CLI die een volledig portfolio aan repositories kan auditen. Deze twee aankondigingen, op dezelfde dag gepubliceerd door hetzelfde team, schetsen een samenhangend antwoord op een gedeelde zorg bij organisaties die AI-agents op grote schaal uitrollen: een fijne controle houden over kosten en het veiligheidsoppervlak, zonder afbreuk te doen aan de snelheid die deze tools beloven.


Bronnen