Zoeken

ChatGPT keert terug op WhatsApp, GitHub Copilot CLI betrouwbaarder, Anthropic onderzoekt de waarden van Claude

ChatGPT keert terug op WhatsApp, GitHub Copilot CLI betrouwbaarder, Anthropic onderzoekt de waarden van Claude

ai-powered-markdown-translator

Artikel vertaald van fr naar nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

OpenAI brengt ChatGPT terug naar WhatsApp in Europa en breidt het uit naar twee nieuwe berichtenapps, GitHub verbetert de betrouwbaarheid van Copilot CLI en Amp verandert de manier waarop zijn agents code committen. Aan de onderzoekszijde publiceert Anthropic een studie naar de waarden die Claude uitdrukt per taal, terwijl Ai2 en Sakana AI respectievelijk een in productie zijnde maritieme bewakingsagent en een experiment met fysieke collectieve intelligentie toelichten.


ChatGPT terug op WhatsApp in de EER, uitbreiding naar Kakao en Viber

13 juli — ChatGPT is opnieuw beschikbaar op WhatsApp in de Europese Economische Ruimte (EER), na een periode van onbeschikbaarheid in de regio. Toegang verloopt via het geverifieerde contact 1-800-CHATGPT, waarmee je vragen kunt stellen, afbeeldingen kunt sturen, spraaknotities kunt versturen, afbeeldingen kunt genereren en ChatGPT in vele talen kunt gebruiken, rechtstreeks in de berichtenapp.

OpenAI breidt tegelijk de beschikbaarheid van ChatGPT uit naar twee nieuwe apps: Kakao in Zuid-Korea en Viber, in de ondersteunde markten. De strategie is duidelijk: de assistent toegankelijk maken in de berichtenapps die mensen al dagelijks gebruiken, in plaats van gebruikers te dwingen via de aparte ChatGPT-app of -site te gaan.

🔗 Aankondiging — @ChatGPTapp


GitHub Copilot CLI v1.0.42: betrouwbaardere delegatie aan subagents

13 juli — GitHub brengt versie 1.0.42+ van Copilot CLI uit, te installeren via het commando /update. Deze update introduceert een slimmere delegatie aan subagents (smarter subagent delegation), bedoeld om code-sessies sneller en betrouwbaarder te maken, zonder technische details over de meetmethode.

Type gemeten foutGeclaimde reductie
Toolfouten-23%
Zoekfouten-27%
Bewerkingsfouten-18%

GitHub geeft aan dat er ondanks deze wijzigingen geen kwaliteitsvermindering is vastgesteld.

🔗 Aankondiging — @github


Amp-orbs kunnen nu committeren namens de gebruiker

11 juli — Amp voegt in de projectinstellingen een optie toe waarmee orbs (de machines die agents op afstand uitvoeren) kunnen committen onder de identiteit van de gebruiker in plaats van die van Amp, met een bij de commit gekoppelde vermelding co-authored-by.

You can now make Amp orbs commit as you, not Amp (+ co-authored-by you). It’s in project settings. Useful for, e.g., pushing to a repo where Vercel only deploys for known committers.

🇳🇱 Je kunt nu Amp-orbs namens jou laten committen, en niet namens Amp (met een co-authored-by-vermelding van jou). Dat zit in de projectinstellingen. Handig bijvoorbeeld om te pushen naar een repository waar Vercel alleen deployt voor bekende committers.@sqs op X


Anthropic onderzoekt de waarden die Claude uitdrukt per model en taal

13 juli — Anthropic bouwt voort op zijn werk rond de waarden die Claude in gesprekken uitdrukt (meer dan 3.000 geïdentificeerde waarden, zoals eerlijkheid of warmte) door te analyseren hoe die variëren per gebruikt model en per taal. De studie steunt op meer dan 300.000 geanonimiseerde gesprekken, gegroepeerd in vier assen.

As (Frans / origineel)Wat het meet
Gezag vs. Voorzichtigheid (Deference vs. Caution)Neiging om de gebruiker te volgen of af te remmen
Warmte vs. Striktheid (Warmth vs. Rigor)Warme toon of nadruk op bewijs
Diepgang vs. Bondigheid (Depth vs. Brevity)Uitgebreide of beknopte antwoorden
Openhartigheid vs. Uitvoering (Candor vs. Execution)Directe kritiek of eenvoudige uitvoering

De verschillen tussen modellen blijven bescheiden (Sonnet 4.6 speelser en bevestigender, Opus 4.7 kritischer en directer), maar de duidelijkste verschillen verschijnen per taal: Claude neigt naar warmte in het Hindi en Arabisch, en naar striktheid in het Russisch, waar het vaker om bewijs vraagt ter ondersteuning van de beweringen van de gebruiker.

🔗 Aankondiging — @AnthropicAI


Ai2 licht de achtergronden van Shippy toe, zijn maritieme bewakingsagent

13 juli — Ai2 (AllenAI) publiceert een praktijkverslag over Shippy, de agent die door zijn Skylight-team is gebouwd voor maritieme domeinbewaking: detectie van visserijactiviteiten, scheepsopvolging, beschermde zones. De agent bedient vandaag meer dan 300 partners in meer dan 70 landen.

The real work wasn’t the model. It was building a system we could trust to be correct, to stay within appropriate boundaries.

🇳🇱 Het echte werk zat niet in het model. Het was het bouwen van een systeem waarop we konden vertrouwen dat het juist zou zijn, en binnen passende grenzen zou blijven.Ai2 Blog

Technisch gezien draait Shippy op OpenClaw (een open source agent-framework) met Claude Opus 4.6 als model, opgebouwd uit drie onderdelen — een “ziel” (de systeemprompt en de waarborgen daarvan), “vaardigheden” (skills) en een “config” (parameters en modelkeuzes). De isolatie tussen klantagents verloopt via Mothership, een eigen platform dat per gebruikerssessie een Kubernetes-deployment uitrolt, en de evaluatie via het Harbor-framework, waar een LLM-jurylid de antwoorden beoordeelt met een geschreven redenering.


Sakana AI laat bijna 200 fysieke blokken samenwerken om hun eigen vorm te herkennen

12 juli — Sakana AI publiceert samen met de IT University of Copenhagen en Autodesk onderzoek naar fysieke collectieve intelligentie: “cellulaire blokken” — kubusvormige hardwaremodules die lokaal hetzelfde neurale netwerk uitvoeren (neurale cellulaire automaten, Neural Cellular Automata) — leiden samen af welke globale vorm ze vormen, zonder centrale controller.

At Sakana AI, a recurring theme in our research is collective intelligence: the observation that sophisticated, robust behavior can arise from many simple parts following local rules, with no central controller, as it does in a colony, a tissue, or a brain.

🇳🇱 Bij Sakana AI is een terugkerend thema in ons onderzoek collectieve intelligentie: de observatie dat verfijnd en robuust gedrag kan ontstaan uit veel eenvoudige onderdelen die lokale regels volgen, zonder centrale controller, zoals het geval is in een kolonie, een weefsel of een brein.Sakana AI Blog

Getest op bijna 200 blokken en vier samengestelde vormen (vliegtuig, gitaar, boot, tafel), haalt het systeem 100% classificatieprecisie in 60 cycli (ongeveer 3 minuten), blijft het robuust tot 5% defecte modules, detecteert het structurele schade met 94,8% precisie, en schaalt het in simulatie op tot rasters van meer dan 18.000 kubussen.


Google DeepMind presenteert de Skill “Predicting the Past” in Google Antigravity

13 juli — Google DeepMind licht een Skill toe met de naam “Predicting the Past”, uitgevoerd in Google Antigravity zonder dat programmeerkennis vereist is, die oude teksten en artefacten analyseert. Drie gebruiksscenario’s worden gedocumenteerd: de datering en lokalisatie van een 1.800 jaar oude Romeinse vloektablet (curse tablet) met behulp van het Aeneas-model, het in kaart brengen van de verering van de Aufaniae door heel Europa (tot aan een afgezonderd altaar in Spanje, opgericht door een Romeinse veteraan), en de reconstructie van het netwerk van bezoekers van het orakel van Dodona op basis van antieke loden tabletten.

De Skill genereert telkens een verklaring van zijn voorspelling, als een epigrafisch commentaar voor domeinexperts.

🔗 Aankondiging — @GoogleDeepMind


Kort nieuws

  • Amp bereidt collaboratieve threads voor meerdere gebruikers voor — een Amp-thread kan al vanuit veel clients tegelijk gevolgd worden, maar alleen onder het account van de maker; het team werkt aan samenwerking met meerdere accounts op dezelfde thread. 🔗 @sqs op X
  • Een native macOS-versie van Amp is in ontwikkeling — zonder verwachte functionele verschillen ten opzichte van de huidige webapp en zonder aangekondigde datum. 🔗 @sqs op X
  • GitHub splitst de SSO- en Organisaties-pagina’s — de gecombineerde pagina met gebruikersinstellingen wordt opgesplitst in twee afzonderlijke pagina’s voor meer duidelijkheid. 🔗 GitHub Changelog
  • HeyGen CLI: muziek en geluidseffecten via de commandoregel — gratis zoeken en downloaden uit de muziek/SFX-catalogus van HeyGen vanuit de terminal, met een demonstratie van een agent die geluiden synchroniseert op het ritme van een video. 🔗 @HeyGen op X

Wat dit betekent

Distributie wordt opnieuw een strijdtoneel voor consumentenassistenten. De terugkeer van ChatGPT op WhatsApp in de EER en de uitbreiding naar Kakao en Viber laten zien dat OpenAI inzet op aanwezigheid in al geïnstalleerde apps in plaats van op het aantrekken van gebruikers naar zijn eigen interfaces. Het is meer een distributiekanaallogica dan een functielogica: de assistent gaat naar waar de gebruikers al zijn, zelfs als hij terugkeert naar gereguleerde markten zoals Europa na een onderbreking.

De betrouwbaarheid van agents wordt een volwaardig engineeringthema, geen bijproduct van het model. GitHub kwantificeert precies de winst van zijn nieuwe delegatie aan subagents (-23% toolfouten, -27% zoekfouten, -18% bewerkingsfouten), en Ai2 verwoordt met Shippy dezelfde les tussen de regels door: betrouwbaarheid in productie komt van deterministische tools, expliciete waarborgen en geïsoleerde infrastructuur, niet alleen van het gekozen model. De Amp-orbs die nu namens de gebruiker committen, vallen onder dezelfde operationele zorg — netjes integreren in bestaande deploy-pipelines.

Onderzoek naar modelgedrag reikt verder dan tekst. De studie van Anthropic over de waarden die Claude per taal uitdrukt laat zien dat culturele verschillen (warmte in Hindi en Arabisch, striktheid in het Russisch) zwaarder wegen dan verschillen tussen modelversies. De cellulaire blokken van Sakana AI stellen een verwante maar aparte vraag: kun je intelligent en robuust gedrag krijgen zonder centraal model, op basis van identieke lokale regels die op schaal worden herhaald — een mogelijke richting voor fysieke systemen die zichzelf kunnen diagnosticeren.

No-code AI groeit richting zeer gespecialiseerde experttoepassingen. De Skill “Predicting the Past” van Google DeepMind, toegepast op epigrafie en archeologie, laat zien hoe complexe workflows toegankelijk worden voor onderzoekers zonder programmeerkennis, en nichegebieden openstellen voor gebruikers die die tools zelf niet hadden kunnen bouwen.


Bronnen