ai-powered-markdown-translatorArtikel vertaald van fr naar nl met gpt-6.1-sol.
Anthropic voegt twee functies toe aan Claude: Claude Dashboards voor dashboards die actueel worden gehouden en Claude Motion voor animaties die in code worden geschreven. Daarnaast haalt het bedrijf Docs, Slides en Design uit bèta voor alle abonnementen, inclusief Free. Diezelfde dag lanceert het bedrijf zijn Cyber Mission, met een programma ter verdediging van kritieke infrastructuur en OSS Scanner, dat open source-projecten gratis scans met zijn krachtigste modellen biedt. OpenAI rolt ondertussen het niveau Ultrafast uit voor GPT-6.1 Sol, tot 8 keer sneller dan de Standard-modus, terwijl Anthropic en NVIDIA zich verbinden aan de Genesis Mission, met respectievelijk 150 miljoen en 1 miljard dollar.
Claude Dashboards en Claude Motion in bèta, Docs, Slides en Design voor alle abonnementen
8 oktober — Anthropic voegt twee functies toe aan Claude. Met Claude Dashboards, in bèta voor betaalde abonnementen, verbind je een dataplatform van het bedrijf (Amazon Redshift, BigQuery, ClickHouse, Databricks of Snowflake) of een andere connector, zoals verkoopkansen in Salesforce, en stel je vervolgens een vraag in gewone taal: Claude schrijft de query, bouwt het dashboard en houdt het actueel wanneer de gegevens veranderen. Een klik op een getal toont de query die het oplevert, en elke grafiek vermeldt wanneer de gegevens zijn bijgewerkt. Anthropic richt de functie op snelle en verkennende vragen; voor verder onderzoek kan het dashboard worden overgezet naar Amplitude, Grafana, Hex, Mixpanel, Omni, Perplexity, PostHog of Sigma, in afwachting van Looker, monday.com en Tableau.
Claude Motion, in bèta voor Team en Enterprise, richt zich op korte animaties: een uitlegvideo van 30 seconden op basis van een kwartaalrapport, een geanimeerde grafiek in een presentatie of een productdemonstratie. Omdat er geen model voor videogeneratie aan te pas komt, bevat de animatie geen door IA gegenereerde beelden of personen.
Claude Motion turns reports, charts, or product walkthroughs into short animations. Claude writes each one as code, with no video model involved, so you can change any word, number, or timing, then export an MP4. In beta on Team and Enterprise plans.
🇳🇱 Claude Motion zet rapporten, grafieken of productdemonstraties om in korte animaties. Claude schrijft elke animatie in code, zonder enig videomodel, zodat je elk woord, getal of tijdstip kunt aanpassen en vervolgens een MP4 kunt exporteren. In bèta voor de abonnementen Team en Enterprise. — @claudeai op X
Diezelfde dag verliezen Claude Docs, Slides en Design hun bèta-label en worden ze beschikbaar voor alle abonnementen, inclusief Free. Volgens Anthropic zijn er meer dan 45 miljoen documenten, presentaties en ontwerpen gemaakt sinds ze op 16 september in gesprekken beschikbaar kwamen. De overgang uit bèta brengt ondersteuning voor CMEK voor artefacten, de keuze van artefactsjablonen door beheerders, gezamenlijk bewerken met Claude, delen buiten de organisatie als de beheerder dat toestaat, PowerPoint- en PDF-exports die overeenkomen met de weergave in de editor, rechtstreeks verzenden naar Google Slides en bewerken vanuit de mobiele app.
| Betrokken functie | Status op 8 oktober | Betrokken abonnementen |
|---|---|---|
| Claude Dashboards | Bèta | Betaalde abonnementen |
| Claude Motion | Bèta | Team en Enterprise |
| Claude Docs, Slides en Design | Uit bèta | Alle, inclusief Free |
| claude.ai/design (zelfstandige site) | Open tot 14 december | — |
Praktisch gevolg: de zelfstandige site claude.ai/design, inmiddels geïntegreerd in Claude, blijft open tot 14 december. De ontwerpsystemen (design systems) van een organisatie kunnen in één keer worden gemigreerd vanaf de pagina Artifacts, maar de gesprekken en opmerkingen op de zelfstandige site, evenals de openbare links, verdwijnen bij de sluiting. In Enterprise zijn Dashboards en Motion standaard uitgeschakeld, terwijl Docs, Slides en Design op 15 oktober standaard worden ingeschakeld.
🔗 Claude-blogbericht: Dashboards en Motion · Thread van @claudeai
Runway en Luma, lanceringspartners van Claude Motion
8 oktober — Twee spelers op het gebied van generatieve video presenteren zich als lanceringspartners van Claude Motion. Bij Runway kan elke animatie worden geëxporteerd om gegenereerde beelden toe te voegen, shots te bewerken door de gewenste wijziging te beschrijven en Runway Agent een langere montage rond de animatie te laten samenstellen; dezelfde 16:9 kan er ook worden omgezet naar verticale en vierkante formaten. Bij Luma worden animaties rechtstreeks geopend via de Luma-connector (MCP) die aan Claude is toegevoegd: de videomodellen Ray en Uni geven ze een andere stijl met behoud van de beweging, kaderen ze opnieuw naar 9:16, 1:1, 4:3 of 21:9, en de Luma-agent maakt er andere versies van. Runway noch Luma vermeldt prijzen of kosten in credits. Anthropic noemt ook Adobe, Descript, HeyGen, Higgsfield en invideo als tools om verder te werken aan een animatie; Canva en Captions worden binnenkort verwacht.
🔗 Blogbericht van Runway · Blogbericht van Luma
Anthropic Cyber Mission: een programma voor kritieke infrastructuur en OSS Scanner voor open source
8 oktober — Twee dagen na de uitbreiding van zijn Cyber Verification Program lanceert Anthropic de Anthropic Cyber Mission, gepresenteerd als een langetermijnverbintenis om de systemen waarvan iedereen afhankelijk is te beveiligen. Het uitgangspunt komt uit Project Glasswing: kwetsbaarheden vinden was nog nooit zo eenvoudig, maar ze verifiëren, prioriteren en verhelpen blijft moeilijk. De missie begint op twee terreinen: kritieke infrastructuur en open source-software; andere gebieden zijn aangekondigd, zonder datum.
Voor kritieke infrastructuur biedt het Critical Infrastructure Defense Program (CIDP) de meest geavanceerde Claude-modellen, ingenieurs op locatie en het dreigingsonderzoek van Anthropic aan dienstverleners van exploitanten van operationele technologie: programmeerbare controllers, besturingssoftware en industriële netwerken voor elektriciteit, water of vervoer, die vaak niet kunnen worden stilgelegd om een patch toe te passen. Elf oprichtingspartners doen mee: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC en Rockwell Automation. Het programma begint met een kleine groep en moet de komende maanden worden uitgebreid naar andere partners en sectoren.
Voor open source biedt OSS Scanner, geïnspireerd op OSS-Fuzz van Google, ingeschreven projecten gratis periodieke scans met de krachtigste modellen van Anthropic, inclusief Claude Mythos. Elk rapport bevat een manier om de kwetsbaarheid te reproduceren, een uitleg en, als die beschikbaar is, een voorgestelde patch, maar wordt zonder menselijke controle verstuurd: Anthropic verwacht een percentage terecht positieve bevindingen boven de 90 % en waarschuwt dat sommige rapporten fouten zullen bevatten, zoals een verkeerd ingeschatte ernst. De dienst pakt het knelpunt aan dat het Frontier Red Team beschrijft: het aantal gevonden kwetsbaarheden overstijgt ruimschoots wat mensen kunnen beoordelen en prioriteren.
| Door Anthropic gepubliceerde indicator | Gepubliceerde waarde |
|---|---|
| Potentiële kwetsbaarheden gevonden in zes maanden | Meer dan 29 000 |
| Handmatig beoordeelde en geprioriteerde kwetsbaarheden | Ongeveer 6 000 |
| Geverifieerde kritieke of ernstige kwetsbaarheden (48 projecten) | 97 |
| Geaccepteerd volgens de eisen voor gecoördineerde openbaarmaking (CVD) | 85, oftewel 88 % |
| Daadwerkelijke maar dubbele kwetsbaarheden, of ongeldige bevindingen | 11 en 1 |
| Aandeel kwetsbaarheden dat door LLM wordt gevonden op de CyberGym-benchmark | Minder dan 20 % begin vorig jaar, meer dan 85 % dit jaar |
wolfSSL meldt dat van de 74 ontvangen rapporten alle op twee na geldig waren en vijf tot CVE hebben geleid. Inschrijven gebeurt via een pull request op de GitHub-repository anthropics/oss-scanner en is voorbehouden aan de hoofdbeheerders van projecten die per geval als kritiek worden beoordeeld. Het Defender Advantage Fund, dat in augustus werd gelanceerd, houdt de dienst gratis. De voorspelling van Anthropic is voorzichtig: binnen twee jaar zal IA de verdediging ten goede komen, maar niet noodzakelijk op korte termijn, aangezien het uitbuiten van kwetsbaarheden goedkoper wordt terwijl verificatie, openbaarmaking en herstel langzaam blijven.
🔗 Anthropic-blogbericht: Anthropic Cyber Mission · Blogbericht van het Frontier Red Team over OSS Scanner · Repository anthropics/oss-scanner
Ultrafast voor GPT-6.1 Sol: tot 8 keer sneller, voor 12 en 60 dollar per miljoen tokens
8 oktober — Het niveau Ultrafast, op 29 september aangekondigd als « binnenkort beschikbaar », komt naar GPT-6.1 Sol. OpenAI Developers meldt dat het diezelfde dag wordt uitgerold in de API, in Codex en in ChatGPT Work, met een intelligentie die wordt gepresenteerd als vergelijkbaar met die van GPT-6 Astra. OpenAI richt het op werk waarbij elke seconde telt: een storing debuggen, agents door applicaties laten navigeren of live ervaringen aanbieden.
Ultrafast is rolling out today for GPT-6.1 Sol in the API, Codex, and ChatGPT Work. Near-Astra intelligence at up to 8x faster speeds than Sol Standard, so you can build as fast as the ideas come.
🇳🇱 Ultrafast wordt vandaag uitgerold voor GPT-6.1 Sol in de API, Codex en ChatGPT Work. Een intelligentie die dicht bij die van Astra ligt, tot 8 keer sneller dan Sol in de Standard-modus, om net zo snel te bouwen als de ideeën opkomen. — @OpenAIDevs op X
In de API hoef je alleen gpt-6.1-sol aan te roepen met service_tier: "ultrafast" in de Responses API. De modus is beschikbaar voor alle API-gebruikers, onder voorbehoud van de verzoeklimieten, met wereldwijde verwerking en gegevensresidentie in de Verenigde Staten en de Europese Unie, terwijl GPT-6 Astra in Ultrafast beperkt blijft tot gegevensresidentie in de Verenigde Staten. De prijs volgt de regel die al voor Astra geldt: zes keer de Standard-prijs, oftewel 12 dollar per miljoen invoertokens en 60 dollar voor uitvoer, vijf keer goedkoper dan GPT-6 Astra in Ultrafast (60 en 300 dollar).
| Verwerkingsmodus van gpt-6.1-sol | Invoerprijs | Invoer uit cache | Schrijven naar cache | Uitvoerprijs |
|---|---|---|---|---|
| Standard, korte context | 2,00 dollars | 0,10 dollar | 2,50 dollars | 10,00 dollars |
| Fast, korte context | 4,00 dollars | 0,20 dollar | 5,00 dollars | 20,00 dollars |
| Ultrafast, korte context | 12,00 dollars | 0,60 dollar | 15,00 dollars | 60,00 dollars |
| Ultrafast, lange context | 24,00 dollars | 1,20 dollar | 30,00 dollars | 90,00 dollars |
Prijzen per miljoen tokens, volgens de pagina Pricing van de API op 8 oktober.
In Codex en ChatGPT Work is toegang voorbehouden aan het abonnement Pro 500, in aanmerking komende Enterprise-werkruimten met betaling naar verbruik en Edu-aanbiedingen met credits. In Enterprise is Ultrafast standaard uitgeschakeld en moeten de eigenaren van de werkruimte het inschakelen, voor bepaalde gebruikers of voor iedereen. De documentatie van Codex licht de kosten toe: de gebruikslimieten die in het abonnement zijn inbegrepen worden 8 keer sneller verbruikt dan in de Standard-modus, en gekochte credits en Enterprise-gebruik op aanvraag worden zes keer zo duur gefactureerd. Andere selfservice-abonnementen hebben er bij de lancering geen toegang toe, ook niet met gekochte credits.
🔗 Changelog van de OpenAI API · Prijzen van de OpenAI API · Ultrafast in Codex (documentatie)
Wetenschap: 150 miljoen dollar van Anthropic en 1 miljard van NVIDIA voor de Genesis Mission, een hemelkaart in ultraviolet
Twee toezeggingen aan de Genesis Mission, het Amerikaanse federale programma dat wetenschappelijke ontdekkingen met IA wil versnellen, werden op 8 oktober aangekondigd op dezelfde top, « Science: A New Golden Age », georganiseerd in Washington door het Office of Science and Technology Policy (OSTP) van het Witte Huis. Diezelfde dag laat Anthropic zien wat Claude Science voor een astrofysicus kan produceren.
Anthropic: 150 miljoen dollar over drie jaar en Claude voor meer dan 15 federale agentschappen
8 oktober — Anthropic zegt 150 miljoen dollar over drie jaar toe aan de Genesis Mission. De financiering moet Claude toegankelijk maken voor meer dan 15 agentschappen die deel uitmaken van de missie, waaronder NASA, de National Institutes of Health en de National Science Foundation. Concreet zal Anthropic Claude, Claude Code en API-credits leveren aan enkele honderden onderzoeksprojecten, samenwerken met de agentschappen en nationale laboratoria aan de prioriteiten van de regering, waaronder fusie-energie en kwantumcomputing, en training en technische ondersteuning verzorgen. De toezegging bouwt voort op het partnerschap dat in december 2025 met het ministerie van Energie werd gesloten; in juli hadden Google DeepMind (40 miljoen dollar) en OpenAI (17 miljoen dollar) hun eigen toezeggingen aan de missie aangekondigd.
🔗 Anthropic-blogbericht: toezegging aan de Genesis Mission · Tweet van @AnthropicAI
NVIDIA: 1 miljard dollar over vijf jaar voor de Amerikaanse wetenschap
8 oktober — Op hetzelfde evenement kondigt NVIDIA toezeggingen ter waarde van 1 miljard dollar over vijf jaar aan, om de Amerikaanse capaciteit voor onderzoek en ontwikkeling op het gebied van superintelligentie uit te breiden in domeinen zoals kwantumcomputing, gezondheid en energiezekerheid. Het persbericht noemt drie onderdelen, zonder het bedrag te verdelen: steun aan universitaire onderzoeksinstellingen, investeringen om het Amerikaanse leiderschap in kwantumcomputing te versnellen en steun aan cloudproviders die de missies van de overheid ondersteunen. NVIDIA zegt ook mee te werken aan verschillende projecten die zijn gefinancierd tijdens fase 2 van de Genesis Mission en die diezelfde dag zijn aangekondigd, op het gebied van kwantumcomputing, fusie, het ontwerpen van accelerators en micro-elektronica. Het bedrijf wijst daarnaast op zijn partnerschap met het DOE, dat de grootste wetenschappelijke supercomputer van het ministerie omvat, in het Argonne National Laboratory.
De eerste volledige kaart van de hemel in ultraviolet, gemaakt met Claude Science
8 oktober — De blog Anthropic Science vertelt hoe Brice Ménard, astrofysicus aan de Johns Hopkins-universiteit en onderzoeker bij Anthropic, met Claude Science heeft gemaakt wat Anthropic presenteert als de eerste volledige kaart van de hemel in ultraviolet. Het GALEX-onderzoek vanuit de ruimte (NASA, 2003-2013) dekte slechts ongeveer twee derde ervan, met zo’n 38 000 waarnemingen. Claude coördineerde agents die de openbare onderzoeksgegevens verzamelden en onderling kalibreerden. Vervolgens vulden ze het ontbrekende derde aan via reconstructie (inpainting), op basis van de relatie tussen ultraviolet en andere golflengten. In opzettelijk afgeschermde gebieden wijken de schattingen ongeveer 10 % af van de werkelijke metingen.
The work would have taken humans weeks of work, but, with Claude, just took a few days while Ménard worked on other projects.
🇳🇱 Dit werk zou mensen weken hebben gekost, maar met Claude duurde het slechts enkele dagen terwijl Ménard aan andere projecten werkte. — @AnthropicAI op X
🔗 Blogbericht van Anthropic Science
Verboden gebruik en misbruik: het gebruiksbeleid van Anthropic voor 2026 en twee door OpenAI ontmantelde beïnvloedingsoperaties
Twee publicaties van 8 oktober laten zien wat de laboratoria verbieden en hoe ze misbruik opsporen: Anthropic herschrijft zijn gebruiksbeleid, OpenAI beschrijft twee beïnvloedingsoperaties die het heeft verbannen.
Anthropic publiceert de versie voor 2026 van zijn gebruiksbeleid, van kracht op 12 november
8 oktober — Anthropic publiceert de jaarlijkse update van zijn gebruiksbeleid (Usage Policy), die op 12 november van kracht wordt. Het gaat vooral om verduidelijkingen op basis van vastgesteld misbruik. Een nieuwe sectie bundelt de tot nu toe verspreide regels over misleidende campagnes en kunstmatige activiteit, en richt zich op alle misleidende activiteit, politiek of commercieel, inclusief het bouwen van tools voor beïnvloedingsoperaties. De sectie over verkiezingen, hernoemd tot « ondermijn democratische processen niet » (Do Not Undermine Democratic Processes), schrapt het algemene verbod op gepersonaliseerde targeting van kiezers, dat maatschappelijke toepassingen zoals kiezersvoorlichting in andere talen blokkeerde. De tekst verduidelijkt ook dat het wapenverbod betrekking heeft op de software en onderdelen van wapens en op het bewapenen van drones, verbiedt het volgen van personen zonder hun toestemming en verbiedt, uitsluitend in extreme gevallen, aanhoudend en nodeloos beledigend gedrag tegenover de modellen.
🔗 Blogbericht van Anthropic: update van het gebruiksbeleid voor 2026
OpenAI ontmantelt Dark Clark en Bogus Bylines, waaronder zijn eerste operatie van categorie 5
8 oktober — OpenAI publiceert een rapport over twee clandestiene beïnvloedingsoperaties die het heeft verbannen en die met behulp van zijn modellen neporganisaties (false front) in stand hielden. « Dark Clark », van Russische oorsprong, richtte zich op Latijns-Amerika: de uitvoerders schreven vooral hun interne rapporten met ChatGPT en bestuurden een zogenaamd onderzoekscentrum, het Social Research Center, dat werd geleid door een fictief personage, « Mia Clark ». « Bogus Bylines », van Iraanse oorsprong, plaatste bijna 100 artikelen onder zeven valse namen van westerse journalisten in een twaalftal online media, waarvan één bijna 2 miljoen volgers op Facebook had. OpenAI zegt in tweeënhalf jaar 30 van dit soort operaties te hebben blootgelegd.
| Ontmantelde operatie | Herkomst van de accounts | Belangrijkste doelwit | Categorie op de IO Breakout Scale (1 tot 6) |
|---|---|---|---|
| Dark Clark | Rusland | Latijns-Amerika | 5, een primeur volgens OpenAI |
| Bogus Bylines, artikelen | Iran | Internationale online media | 4 |
| Bogus Bylines, reacties | Iran | Sociale netwerken | 2 |
🔗 Rapport van OpenAI over operaties met neporganisaties als dekmantel
Claude Haiku 5.5 bij derden: GitHub Copilot biedt het vanaf het Pro-abonnement aan, Devin meet een score van 58,4 %
Claude Haiku 5.5 werd op 7 oktober gelanceerd en verscheen diezelfde dag in twee codetools, die het elk vergelijken met Claude Sonnet 5.
GitHub Copilot: Haiku 5.5 in alle betaalde abonnementen, inclusief Pro
7 oktober — Iets meer dan twee uur na de lancering door Anthropic wordt Claude Haiku 5.5 algemeen beschikbaar in GitHub Copilot voor de abonnementen Pro, Pro+, Max, Business en Enterprise: inclusief Pro, zoals Claude Sonnet 5.5 en anders dan GPT-6.1 Sol eind september. Het kan in tien omgevingen worden geselecteerd, van VS Code tot Xcode. GitHub richt het op subagents, snelle wijzigingen en taken in de terminal; volgens de eerste tests evenaarde het Claude Sonnet 5 op veel codetaken met aanzienlijk minder tokens en stappen, zonder gepubliceerde cijfers. Het wordt tegen het openbare tarief gefactureerd: 0,10 dollar per miljoen inputtokens en 0,50 dollar voor output tot 100 000 inputtokens, daarna 0,50 en 2,50 dollar, oftewel tien keer goedkoper dan Claude Haiku 4.5 in de eerste tariefschijf.
🔗 Claude Haiku 5.5 in GitHub Copilot · Modellen en tarieven van GitHub Copilot
Devin: 58,4 % op FrontierCode 1.1, hoger dan Claude Sonnet 5
7 oktober — Cognition maakt Claude Haiku 5.5 beschikbaar in Devin. Op FrontierCode 1.1, zijn eigen benchmark die modellen beoordeelt op echte engineeringtaken op basis van de codekwaliteit en de geschiktheid van de code om te worden gemerged, behaalt Haiku 5.5 58,4 %, hoger dan Claude Sonnet 5, tegen ongeveer een achtste van de kosten per taak volgens Cognition, dat geen precies bedrag noemt. Het wordt ook toegevoegd aan de helpers (sidekicks) van Devin Fusion, dat een hoofdmodel combineert met een ondersteunend model: met Claude Opus 5.5 als hoofdmodel en Haiku 5.5 ter ondersteuning behoudt Fusion een score van 66,2 terwijl de kosten en latency dalen.
| Door Cognition beoordeeld model | Score FrontierCode 1.1 Extended |
|---|---|
| Claude Sonnet 5 | 56,2 |
| Kimi K3 | 58,2 |
| Claude Haiku 5.5 | 58,4 |
| GPT-6.1 Sol | 60,4 |
| Claude Sonnet 5.5 | 64,4 |
| Claude Opus 5.5 | 65,3 |
Codeagents: Claude Code 2.1.295, Codex CLI 0.162.0, Antigravity CLI 1.3.1, VS Code 1.141 en Delta 0.19
Vijf tools voor codeagents ontwikkelen zich verder: Claude Code maakt zijn hooks strenger, Codex CLI beheert worktrees, Antigravity CLI vernieuwt het beoordelen van wijzigingen, VS Code ordent agentsessies in een raster en Delta voegt teamwerk toe.
Claude Code 2.1.295: hooks die blokkeren als ze mislukken
8 oktober — Claude Code kreeg op één dag twee versies. Versie 2.1.294 corrigeert de hooks prompt en agent die als instructies in natuurlijke taal waren geschreven en konden doorlaten wat ze moesten blokkeren. Versie 2.1.295 telt 143 vermeldingen, waaronder 97 fixes. Met de nieuwe optie onFailure: "block" voor command- en HTTP-hooks blokkeert een hook die niet start, een time-out krijgt of een onverwachte code teruggeeft de actie in plaats van die door te laten; verschillende fixes gaan in dezelfde richting, voor de beveiligingen van mods en de opties --tools en --restricted. Claude Code ondersteunt ook het Program Status Protocol (OSC 7501), waarmee compatibele terminals kunnen weergeven of de agent werkt, wacht of klaar is, en de beschrijvingen van MCP-tools die via het zoeken naar tools worden geladen, gaan van 2 048 naar 16 384 tekens.
🔗 Claude Code 2.1.295 · Claude Code 2.1.294
Codex CLI 0.162.0: beheerde worktrees en vastgepinde taken
8 oktober — Codex CLI 0.162.0, de eerste stabiele versie sinds 0.161.0 van de dag ervoor, vermeldt 225 PR. Wanneer de worktrees-functie is ingeschakeld, beschikt Codex over tools om beheerde Git-worktrees te maken en op te sommen vanuit vertrouwde lokale projecten, en het commandocentrum voor agents maakt het mogelijk een taak vast te pinnen met de toets p, in een gedeelde groep « Pinned » wanneer de server dat ondersteunt. De terminal krijgt /copy om door blokken van de transcriptie te navigeren en ze te kopiëren, Ctrl+Insert om een selectie te kopiëren en een instelling voor de scrollsnelheid, en URL’s worden zelfs in goedkeuringen en MCP-prompts klikbaar. Aanbieders van aangepaste modellen die compatibel zijn met de Responses API kunnen directe webtoegang en compaction op afstand aangeven. Wat fixes betreft, behoudt apply_patch CRLF-regeleinden, wordt de Linux-sandbox versterkt en krijgen Windows-versies een ondertekende PowerShell-installer.
🔗 Release notes van Codex CLI 0.162.0
Antigravity CLI 1.3.1: vernieuwde codereview in /diff, standaard gemiddelde uitvoerigheid
7 oktober — De CLI van Antigravity heeft tussen 2 en 7 oktober vijf versies uitgebracht. Versie 1.3.1 verbetert codereview in de terminal: in de bestandsweergave van /diff openen de pijltjes links en rechts het aangrenzende bestand bij de eerste wijziging, onthoudt elk bestand zijn positie, gaan n en N door naar het volgende of vorige bestand en geeft de kop aan waar je bent. De tien fixes hebben onder meer betrekking op /rewind in zeer lange gesprekken, plugins onder Windows en sessies met een GEMINI_API_KEY-sleutel, die opnieuw proberen wanneer de verbinding met de Gemini API wegvalt. Versie 1.3.0 van 6 oktober verandert de standaarduitvoerigheid van « high » naar « medium », dat toolaanroepen en overwegingen bundelt in beknopte samenvattingen; met /config kun je teruggaan naar de vorige instelling. Eerder vertrouwde 1.2.16 het genereren van afbeeldingen toe aan een ingebouwde subagent en bracht 1.2.15 Android-binaries voor Termux.
🔗 Changelog van Antigravity, tabblad CLI
VS Code 1.141: agentsessies in een raster en opruimen van worktrees
7 oktober — VS Code 1.141 richt zich op de agentsessies van Copilot. Het venster Agents kan meerdere sessies in een raster plaatsen, en de opdracht Chat: Open Worktree Cleanup toont de schijfruimte die worktrees van inactieve sessies innemen om ze te verwijderen, op verzoek of automatisch zodra de pull request is gemerged. Gesprekken die in Copilot CLI of in de GitHub Copilot-app worden gestart, verschijnen vanaf hun eerste verzoek, zonder de editor opnieuw te laden, en een Codex-gesprek dat in de ChatGPT-app of in Codex CLI is geopend, kan er met behoud van de geschiedenis worden voortgezet: door een Copilot-model te kiezen, ga je verder met je GitHub Copilot-abonnement, bijvoorbeeld nadat je je ChatGPT-gebruikslimiet hebt bereikt. Voor bedrijven kan de sandbox van de Copilot-harness via beheerde instellingen worden afgedwongen, in preview, en deze harness wordt geleidelijk de standaardkeuze voor gebruikers bij wie experimenten zijn ingeschakeld.
🔗 Release notes van VS Code 1.141
Delta 0.19: vermeldingen van teamgenoten en een inbox
7 oktober — Zed Industries publiceert Delta 0.19.0, zijn omgeving om met meerdere mensen en agents te programmeren, op 8 oktober gevolgd door 0.19.1 met fixes. Je kunt nu een teamgenoot in een bericht of reactie vermelden door @ gevolgd door diens gebruikersnaam te typen, waarna de melding in een nieuwe inbox (Inbox) verschijnt. De agent @delta leest en wijzigt een groot deel van de instellingen vanuit het gesprek. Een instelling, Agent Thread Creation, voorkomt dat agents gesprekken op het hoogste niveau aanmaken zonder subagents uit te schakelen, de agent kan worktrees van meerdere threads mergen en CLI-opdrachten worden uitgevoerd zonder een venster te openen. In totaal vermelden de release notes 11 nieuwe functies, 22 verbeteringen en 45 fixes. Op 8 oktober vertelt een door Zed gedeeld blogbericht hoe het team Google Docs heeft vervangen door Delta voor zijn interne documenten.
🔗 Release notes van Delta · Blogbericht van Delta over het afscheid van Google Docs
Generatieve media: Nano Banana 2.1, Brand Kit en ElevenReader in Brazilië bij ElevenLabs, SemanTok van Stability AI
Vier aankondigingen rond beeld, video en stem: een beeldmodel voor de helft van de prijs bij Google, een herbruikbare huisstijl en een app voor het voorlezen van teksten bij ElevenLabs, en onderzoek naar videogeneratie bij Stability AI.
Nano Banana 2.1 algemeen beschikbaar in de Gemini API, voor de helft van de prijs
6 oktober — Google heeft Nano Banana 2.1 (gemini-nano-banana-2.1) algemeen beschikbaar gemaakt in de Gemini API en Google AI Studio, zonder blogbericht. Dit model voor het genereren en bewerken van afbeeldingen is een update van Nano Banana 2, met een betere visuele kwaliteit, betere tekstweergave, consistentere personages van beurt tot beurt en panoramaformaten, van 1:4 tot 8:1, zonder tiling-artefacten in 2K en 4K. Het accepteert maximaal 14 referentieafbeeldingen en gebruikt Google-zoekresultaten als onderbouwing. De prijs per afbeelding wordt gehalveerd in 1K en 2K, en Google merkt Nano Banana 2 (gemini-3.1-flash-image) als verouderd aan, zonder einddatum.
| Outputprijs | Nano Banana 2.1 | Nano Banana 2 |
|---|---|---|
| Afbeelding 1K | 0,0336 dollar | 0,067 dollar |
| Afbeelding 2K | 0,0504 dollar | 0,101 dollar |
| Afbeelding 4K | 0,113 dollar | 0,151 dollar |
| Miljoen afbeeldingstokens | 30 dollars | 60 dollars |
🔗 Release notes van de Gemini API · Modelinformatie over Nano Banana 2.1
Brand Kit van ElevenLabs: de huisstijl opgeslagen in de werkruimte
8 oktober — ElevenLabs voegt Brand Kit toe aan ElevenCreative, zijn suite voor het maken van content. Kleuren, lettertypen, logo’s met hun gebruiksregels, referentieafbeeldingen en merkrichtlijnen, inclusief wat het merk nooit doet, vormen één object in de werkruimte dat je met @ oproept in Image & Video, in Flows of bij de ElevenCreative-agent. Volgens de thread van ElevenLabs maak je in enkele minuten een kit door het webadres van een site te plakken of de bestanden van de organisatie te uploaden; het hele team genereert vervolgens op basis van dezelfde richtlijnen, en een bureau kan per klant een kit maken. ElevenLabs wil de kits uitbreiden naar de stem en het geluid van het merk, zonder datum te noemen. Brand Kit is nu beschikbaar, zonder vermelde prijs; HeyGen (augustus) en Runway (september) bieden al vergelijkbare tools aan.
🔗 Blogbericht van ElevenLabs: Brand Kit · Thread van @ElevenLabs
SemanTok van Stability AI: een model van 201M dat een 3,4 keer groter model evenaart
7 oktober — Het team Interactive Research van Stability AI presenteert SemanTok, een videotokenizer voor wereldmodellen (world models) die video token voor token genereren, aangekondigd op X op 8 oktober. Bij tokenizers « van grof naar fijn » (coarse-to-fine) beschrijven de eerste tokens de scène als geheel en voegen de volgende details toe; SemanTok maakt deze eerste tokens betekenisrijker en daardoor gemakkelijker te voorspellen. Daartoe injecteert het bevroren DINO-kenmerken in zijn encoder en voegt het lichte heads toe die deze vanuit elk tokenprefix reconstrueren. Volgens Stability AI evenaart of overtreft een autoregressief model met 201M parameters dat op SemanTok is gebouwd een 3,4 keer groter VideoFlexTok-model, en kosten korte prefixes minder om te voorspellen. Het artikel staat op arXiv; code en gewichten worden niet genoemd.
🔗 Onderzoeksbericht van Stability AI · Artikel op arXiv
ElevenReader komt naar Brazilië met de stem van Fábio Porchat en 70 000 boeken
8 oktober — ElevenLabs lanceert in Brazilië ElevenReader, zijn app die boeken, documenten en artikelen omzet in audio, gratis beschikbaar op iOS en Android, met de stem van acteur en komiek Fábio Porchat. De catalogus berust op een samenwerking met Bookwire Brasil: 70 000 titels in Braziliaans Portugees, onder licentie van de belangrijkste uitgevers van het land, waarvan de meeste nog geen audio-editie hadden. ElevenLabs heeft ook Dom Casmurro van Machado de Assis geproduceerd, voorgelezen door Fábio Porchat met originele muziek en sounddesign. Volgens de algemeen directeur van Bookwire Brasil is dit de grootste selectie Braziliaanse boeken die ooit in audio is aangeboden.
| Aanbod in Brazilië | Toegangsvoorwaarden |
|---|---|
| ElevenReader-app (iOS, Android) | Gratis |
| Dom Casmurro voorgelezen door Fábio Porchat | Gratis voor iedereen |
| 70 000 titels onder licentie van Bookwire | Met ElevenReader Ultra, prijs niet vermeld |
🔗 Blogpost van ElevenLabs: ElevenReader in Brazilië
Gespecialiseerde modellen: LightOnOCR-3 voor documenten, Falcon-ASR voor het Arabisch, Carbon-A voor genomen
Drie gespecialiseerde modellen, waarvan twee met open gewichten, om documenten te lezen, Arabisch te transcriberen en genomen te annoteren.
LightOnOCR-3: drie open OCR-modellen die ook de lay-out herkennen
8 oktober — LightOn publiceert LightOnOCR-3 onder de Apache 2.0-licentie, in drie groottes (0.8B, 1B en 4B). Naast het transcriberen van een pagina kunnen de modellen elk gebied ervan herkennen: met de prompt voor visuele verankering (grounding) wordt elk blok voorafgegaan door een gelabelde bounding box, krijgen afbeeldingen een korte beschrijving en worden grafieken omgezet in HTML-tabellen met gegevens. Op een H100 verwerkt de 4B 21 % meer pagina’s per seconde dan Chandra-OCR-2, dat net als dit model op Qwen3.5 is gebouwd. LightOn verduidelijkt dat zijn scores worden berekend na normalisatie van de outputs, die bij de repository is gepubliceerd en de scores van alle toonaangevende modellen aanzienlijk verandert.
| Benchmark | LightOnOCR-3-4B | LightOnOCR-3-0.8B | LightOnOCR-3-1B | Vermelde referentie |
|---|---|---|---|---|
| olmOCR-Bench, totaalscore | 86,3 | 85,5 | 84,5 | Infinity Parser Pro (35,1B) 87,6 ; Chandra 2 85,8 |
| ParseBench, vijf categorieën | 75,1 | 74,6 | 71,4 | Infinity Parser Pro 74,3 |
| fr-bench-pdf2md, Franse documenten | 74,1 | 70,5 | 69,6 | Chandra 2 69,0 ; MistralOCR4.1 54,1 |
Falcon-ASR: 1,6 miljard parameters voor Emiratisch Arabisch, zonder gepubliceerde gewichten
7 oktober — Het Technology Innovation Institute (TII) in Abu Dhabi presenteert Falcon-ASR, een spraakherkenningsmodel met 1,6 miljard parameters dat zich richt op het Arabisch, en vooral op het Emiratische dialect. Dezelfde set gewichten transcribeert ook Engels, Frans, Spaans en Portugees, zonder dat de taal hoeft te worden opgegeven, met een tijdstempel voor elk woord. Net als Falcon-OCR-Arabic en Falcon-Emirati, die een dag eerder werden gepresenteerd, is het alleen als demo beschikbaar: TII kondigt toegang via een API en native apps aan, zonder de gewichten te publiceren.
| Evaluatie van het woordfoutenpercentage (WER) | Score van Falcon-ASR | Vermelde referentie |
|---|---|---|
| Gemiddelde over zes Arabische datasets (Open Universal Arabic ASR) | 20,92 % | 23,17 %, beste gepubliceerde resultaat per 30 september |
| Emiratisch, interne evaluatie van TII | 22,73 % | Qwen3-Omni, tweede, 4,07 punten hoger |
| Gemiddelde over zeven Engelse datasets (Open ASR Leaderboard) | 5,74 % | Geen referentie vermeld |
Carbon-A: 566 miljoen kandidaatgenen bij 22 617 soorten
8 oktober — Het biologieteam van Hugging Face (HuggingFaceBio) publiceert Carbon-A, een model met 1,2 miljard parameters onder de MIT-licentie dat eiwitcoderende gebieden rechtstreeks in het ADN herkent, met één model voor zoogdieren, planten, schimmels en protisten. Op 42 referentiegenomen behaalt het een gemiddelde F1-score op nucleotideniveau van 0,944 en presteert het volgens de auteurs beter dan de zeven vergeleken tools, waaronder AUGUSTUS, Helixer en Tiberius. Het team heeft het model toegepast op de eukaryote genomen van GenBank om de Carbon Annotation Database op te bouwen: 48 167 assemblages van 22 617 taxa en 566 miljoen voorspelde coderende loci, oftewel 11 keer zoveel taxa als in het trainingscorpus. Validatie in het laboratorium met ActiveSite en UCSD, via volledige ARN-sequencing, bevestigt een deel van de genen; de auteurs verduidelijken dat dit de transcriptie bewijst, maar nog niet de productie van eiwitten. Over drie weken staat een nieuwe reeks gepland.
Training met reinforcement learning: de 1 004 omgevingen van TermGrade en TRL v1.15.0
Twee publicaties voor reinforcement learning: beoordeelde terminalomgevingen en een bibliotheek die langere sequenties trainbaar maakt.
TermGrade: 1 004 terminalomgevingen beoordeeld door zes modellen
8 oktober — Het bedrijf ai& publiceert TermGrade, 1 004 terminalomgevingen om agents te trainen en te evalueren met reinforcement learning. Elke taak draait in een Linux-container met een instructie en tests, en werd alleen opgenomen als de eigen referentieoplossing de tests doorstond: van de 66 165 kandidaattaken die DeepSeek-V4-Pro schreef, kwam 1,5 % door dit filter. Zes configuraties van open modellen, van Kimi-K3 tot gemma-4-31B-it, hebben elke taak geprobeerd, en de 36 144 pogingen worden gepubliceerd, inclusief mislukkingen. Een model leert het meest van taken die het ongeveer de helft van de keren succesvol uitvoert: getraind op 151 taken uit deze categorie behaalt gemma-4-31B-it 46,1 op Terminal-Bench 2.1, oftewel 3,1 punten meer dan het basismodel, en gemiddeld 2,1 punten meer over vijf trainingsruns. Alles wordt gepubliceerd onder Apache-2.0.
🔗 Blogpost over TermGrade · TermGrade-collectie op Hugging Face
TRL v1.15.0: een gefuseerde LM-head voor sequenties die tot 6,9 keer langer zijn
8 oktober — TRL v1.15.0, de trainingsbibliotheek van Hugging Face, introduceert een gefuseerde LM-head (fused LM head) die de log-probabilities en de entropie van elk token rechtstreeks berekent met een Triton-kernel, zonder ooit de volledige tensor met logits op te bouwen; deze is standaard ingeschakeld voor SFT, DPO, KTO, GRPO, RLOO en distillatie. Bij 8 192 tokens daalt het piekgeheugengebruik met 52 tot 82 %, afhankelijk van de methode. Deze metingen zijn uitgevoerd op een B300 die tot 79 Gio was begrensd, met de willekeurige gewichten van gemma-3-1b, waarvan het vocabulaire 262 000 tokens telt; de winst is het grootst bij kleine modellen met een groot vocabulaire. De versie verbreekt ook de compatibiliteit: de ondersteuning voor Python 3.10 stopt, use_liger_kernel is deprecated en de experimentele MiniLLM-trainer is verwijderd.
| Trainingsmethode | Maximale lengte in v1.14.2 (tokens) | Maximale lengte in v1.15.0 (tokens) | Verbeteringsfactor |
|---|---|---|---|
| DPO | 10 240 | 59 392 | ×5,80 |
| KTO (batch van 2) | 9 216 | 63 488 | ×6,89 |
| GRPO | 28 672 | 114 688 | ×4,00 |
| RLOO | 23 552 | 100 352 | ×4,26 |
| SFT (nll-loss) | 20 480 | 107 520 | ×5,25 |
🔗 Releasenotes van TRL v1.15.0
Inferentie: llama.cpp in Windows ML, ML Drift als open source, Together AI op B300’s van IBM Cloud
Drie aankondigingen voor het draaien van modellen, van de Windows-PC tot het GPU-cluster.
llama.cpp komt naar Windows ML, in experimentele vorm
7 oktober — Tijdens zijn Windows-evenement voegt Microsoft experimentele ondersteuning voor llama.cpp toe aan Windows ML, zijn framework voor lokale inferentie: je haalt een GGUF-model op Hugging Face op en voert het lokaal uit via dezelfde Windows ML-stack, met nieuwe API’s voor specifieke taken. Ook een native Windows-API voor uitvoering op een lager niveau komt beschikbaar als experimentele preview. Microsoft zegt samen met NVIDIA en de community rechtstreeks bij te dragen aan het llama.cpp-project: geoptimaliseerde CUDA-kernels, betere scheduling tussen processor en GPU, CUDA graphs, speculatieve decoding (Eagle-3, MTP, D-Flash2), uitvoering op meerdere GPU’s en het NVFP4-formaat. De blogpost plaatst deze vernieuwingen op PC’s met NVIDIA RTX Spark-chips, zoals de Surface Laptop Ultra. Op X verwelkomt Georgi Gerganov van llama.cpp de aanwezigheid van het project op het Windows-evenement en ziet hij daarin een teken dat de software- en hardwarestacks eindelijk samenkomen.
🔗 Blogpost over Microsoft Foundry on Windows · Tweet van @ggerganov
ML Drift: de GPU-engine van LiteRT gepubliceerd als open source
8 oktober — Het Google AI Edge-team publiceert ML Drift, zijn GPU-rekenengine voor inferentie op apparaten, als open source onder de Apache 2.0-licentie. De engine verbergt de verschillen tussen OpenGL ES, OpenCL, Metal en WebGPU, dient als GPU-versnellingsengine voor LiteRT, is beschikbaar als zelfstandige bibliotheek en volgt de GPU-delegate van TensorFlow Lite op, die geen nieuwe functies meer zal krijgen. De engine wisselt van kernels afhankelijk van of het LLM de prompt leest of tokens genereert, en biedt een SKILL.md-handleiding waarmee coding agents shaders kunnen schrijven en controleren. Hij draait al in productie: tot 40 % minder latentie per afbeelding voor de effecten van YouTube Shorts, en tot 30 % verbetering voor Lightroom en Photoshop op mobiele apparaten volgens de blogpost; bij Gemma meet Google tot 12 % minder geheugengebruik dan bij andere softwareframeworks (frameworks).
🔗 Aankondiging van ML Drift op het Google Developers Blog · Repository google-ai-edge/ml-drift
Together AI, eerste klant van een inferentiecluster met B300-GPU’s op IBM Cloud
6 oktober — Together AI kondigt aan met IBM en NVIDIA samen te werken om zijn inferentiecapaciteit voor bedrijven uit te breiden, te beginnen met een groot cluster van NVIDIA B300-GPU’s op IBM Cloud, verbonden via het Spectrum-X Ethernet-netwerk van NVIDIA. Volgens Together AI is dit het eerste dedicated inferentiecluster van deze omvang op IBM Cloud, en is het bedrijf de eerste klant: het beheert de inferentielaag, IBM levert de cloud en NVIDIA de chips en het netwerk. Together AI verklaart deze uitbreiding vanuit de vraag naar open modellen: het zegt elke maand honderden biljoenen tokens te leveren aan meer dan een miljoen ontwikkelaars. De blogpost vermeldt noch de omvang van het cluster, noch een tijdschema.
🔗 Blogpost van Together AI · Tweet van @togethercompute
Kort nieuws
- Codex sneller bijsturen — In de ChatGPT-desktopapp verwerkt Codex een vervolgbericht dat tijdens een taak wordt verstuurd eerder, om een aanpak te corrigeren of van richting te veranderen; de instelling Follow-up behavior bepaalt of deze berichten de lopende uitvoering bijsturen of op de volgende uitvoering wachten. 🔗 bron
- ChatGPT Go in Warp — Abonnees op ChatGPT Go kunnen het nu in Warp gebruiken voor elke terminalvraag of programmeertaak; volgens een door Warp aangehaald lid van het OpenAI-team Sign in with ChatGPT is het inbegrepen gebruik beschikbaar voor Go-klanten, naast Plus en Pro, in alle partnerapps. 🔗 bron
- Oracle — Volgens een casestudy van OpenAI heeft Oracle 130 000 actieve ChatGPT-gebruikers en meer dan 95 000 Codex-gebruikers; een onderzoek naar de talentmarkt waarvoor 2 tot 4 dagen nodig waren, kan in 15 tot 20 minuten worden voorbereid, en Codex vertaalt bedrijfsvragen naar SQL-query’s. 🔗 bron
- Pollo AI — Dit platform voor videocreatie, dat naar eigen zeggen meer dan 26 miljoen gebruikers heeft, routeert de verzoeken van zijn agent met GPT-5.6, laat moeilijke taken uitvoeren door GPT-6 Astra en al zijn afbeeldingen maken door GPT-Image-2.5, en zegt de tijd voor het kiezen van een model met meer dan 50 % te verkorten. 🔗 bron
- Release notes van Devin van 7 oktober — Een notificatie-inbox bundelt de meldingen van sessies, met instelbare verzending naar de telefoon, de status van de merge queue wordt in de hele app weergegeven en privésleutels die als secrets zijn opgeslagen, worden regel voor regel gemaskeerd in de uitvoer van opdrachten. 🔗 bron
- Copilot CLI 1.0.94 — Deze versie is na zes prereleases stabiel geworden, voegt Claude Haiku 5.5 toe aan de modelkiezer, geeft de weergegeven shellcode door aan de beoordelaar van Assisted Permissions om onnodige goedkeuringen te voorkomen en maakt het mogelijk een MCP-server te activeren voordat deze wordt ontdekt. 🔗 bron
- Gemini CLI v0.65.0-nightly.20261008 — De telemetrie ondersteunt aangepaste OTLP-headers (
telemetry.otlpHeaders), een verzoek dat sinds oktober 2025 openstaat; de CLI blijft niet meer in een lus tussen verificatie en OAuth hangen, en de geschiedenis eindigt altijd met een gebruikersbericht, wat een fout 400 na/rewindvoorkomt. 🔗 bron - De Antigravity SDK 0.1.21 isoleert experimentele API’s en configureert de skills van subagents — Eerste versie in de changelog sinds 0.1.18 van 21 september: een decorator
@betaen een modulegoogle.antigravity.betascheiden prereleases van de stabiele API, en metskills_configkan een subagent de skills van de bovenliggende agent overnemen, ze vervangen of zonder skills werken. 🔗 bron - Developer Knowledge API — Google presenteert het ecosysteem van deze API, die zijn documentatie voor ontwikkelaars (Google Cloud, Firebase, Android) als actuele Markdown aanbiedt: een vooraf in Cloud Shell geïnstalleerde opdracht
gcloud developer-knowledge, een skill voor codeagents gekoppeld aan een MCP-server, waarbij Antigravity, Claude Code, Cursor en GitHub Copilot worden genoemd, en bibliotheken in zeven talen. 🔗 bron - AQuA — Google Cloud publiceert deze kwaliteitsagent (Ambient Quality Agent) als referentie-implementatie, die een steekproef neemt van maximaal 1 000 sessies van een ADK-agent in productie, mislukkingen groepeert, ze in BigQuery bijhoudt en met Gemini 3.8 Flash een diagnose van de oorzaken uitvoert. 🔗 bron
- Concepten tellen mee voor de limieten voor pull requests — Vanwege bijdragen van lage kwaliteit maakt GitHub het mogelijk om pull requests in conceptvorm mee te tellen bij de limieten per gebruiker, terwijl een bijdrager er tot nu toe onbeperkt kon openen. 🔗 bron
- Pull requests archiveren — Dit is niet langer voorbehouden aan beheerders: de rollen triage, write, maintain en admin kunnen een pull request archiveren, waardoor die wordt gesloten, voor het publiek wordt verborgen en alle nieuwe activiteit wordt geblokkeerd, inclusief opmerkingen van beheerders. 🔗 bron
- GitHub-tijdlijnen en schermlezers — Schermlezers doorlopen de tijdlijnen van issues en pull requests als lijsten, met het aantal elementen en de huidige positie, en kondigen geladen gebeurtenissen aan op github.com en GitHub Enterprise Server 3.23. 🔗 bron
- Paper Reproductions with ML Intern — Abubakar Abid kondigt bij Hugging Face een functie aan die agents de experimenten van een gepubliceerd artikel onafhankelijk laat reproduceren vanuit de Paper Pages, om open artefacten te produceren die helpen degelijk onderzoek te herkennen; geen cijfers of documentatie. 🔗 bron
- De chat van Hugging Face via SSH — Adrien Carreira, verantwoordelijk voor de infrastructuur van Hugging Face, presenteert een chat met open modellen die toegankelijk is via de opdracht
ssh chat.hf.co, zonder configuratie of sleutel; er is geen bijbehorende documentatie of lijst met modellen. 🔗 bron - huggingface_hub 2.2.0 — Kleine bugfixrelease:
hf jobs statsgeeft nu een snapshot terug en geeft daarna de controle terug (-fom live te volgen), alle parallelle downloads verlopen via hf_xet en twee wijzigingen verbreken de compatibiliteit. 🔗 bron - swarmlab — Hugging Face heeft zonder aankondiging deze testomgeving opengesteld, die onderzoekt hoe zwermen LLM-agents van verschillende aanbieders de waarheid vinden of verdeeld raken, afhankelijk van de topologie van de communicatie, de vertragingen en de rollen; één regel YAML volstaat om een hypothese te testen. 🔗 bron
- Darwin-27B-ZTC — VIDRAFT publiceert onder Apache-2.0 een beoordelaar die in één doorgang een kansverdeling over de mogelijke antwoorden teruggeeft, zonder een token te genereren: een nauwkeurigheid van 0,743 bij zero-shot op 2 000 beoordelingen van typed-decisions en een Brier-score van 0,097, volgens de auteurs. 🔗 bron
- Superfluid — basecompute publiceert onder Apache-2.0 deze lokale LLM-server, compatibel met de API’s van OpenAI, Anthropic en Ollama, die interactieve vragen voorrang geeft op het werk van agents: een responstijd van 0,36 seconde met acht actieve agents, tegenover meer dan 10 seconden voor llama-server, volgens de auteurs. 🔗 bron
- funes 1.8.0 — De tool die sessies van codeagents indexeert, voegt een meertalig embeddings-model toe: bij 30 vragen over 2 000 gesprekken in het Chinees staat het juiste gesprek 30 van de 30 keer in de eerste acht resultaten, tegenover 23, en stijgt de gemiddelde reciproke rang van 0,601 naar 0,983. 🔗 bron
- GLiNER en Indiase talen — Een communityblog laat zien dat door combinerende tekens in woorden te behouden, zonder hertraining, de gemiddelde F1 bij zero-shot van GLiNER2 van 13,2 naar 68,0 stijgt op negen Indiase talen, en die na fine-tuning in het Hindi van 59,9 naar 82,6. 🔗 bron
- Multilingual Terminal-Bench — LILT licht zijn benchmark met 324 programmeertaken in tien talen toe: Claude Opus 5.5 presteert er ongeveer 3 punten beter dan Opus 5 met 30 % minder tokens, wat neerkomt op ongeveer 45 % lagere kosten per taak; Gemini 3.8 Flash heeft er een mediaan van 41 beurten per taak nodig, tegenover 5 voor GPT-6 Sol. 🔗 bron
- Collectieve GPU-primitieven — Milos Kotlar voorspelt de communicatietijd van vijf primitieven op vier GPU’s van het type RTX 4090 met een gemiddelde fout van 10,9 %, tegenover 22,9 % voor een algemeen model, maar met een fout van 61,6 % in het slechtste geval. 🔗 bron
- Best-of-N bij redeneren over video — facebookresearch zet zonder aankondiging en onder de niet-commerciële licentie CC BY-NC 4.0 de code van de studie Selecting or Solving? online, over best-of-N-selectie en panels van verificateurs bij redeneren over video. 🔗 bron
- KDD Cup 2026 Data Agents — NVIDIA beschrijft het harness waarmee zijn team KGMON tweede werd met een voorgeschreven klein LLM: gegevens omgezet in SQLite-tabellen, het schema vanaf het begin aangeleverd, een kleine set tools en gericht lezen van documenten; de blogpost noemt geen score of modelnaam. 🔗 bron
- Microduck — Matthieu Lapeyre van Pollen Robotics kondigt voor deze kleine tweebenige robot, uitgerust met de nieuwe zelfontwikkelde printplaat, een gebruiksduur van meer dan drie uur aan op een batterij van 2 600 mAh, met een processor die maximaal 60 °C bereikt in plaats van 114 °C. 🔗 bron
- Albums op Suno — De functie, gepresenteerd op 5 oktober, is nu beschikbaar: je bundelt je nummers tot een volledige release, kiest de hoes, zet de nummers in de gewenste volgorde en publiceert op het gewenste moment; er wordt geen abonnement of limiet voor het aantal nummers genoemd. 🔗 bron
- HeyGen en Ryan Serhant — HeyGen lanceert op Instagram, TikTok en X een dagelijkse videoreeks gepresenteerd door de officiële avatar van makelaar Ryan Serhant, bekend uit de Netflix-serie Owning Manhattan; geen financiële details. 🔗 bron
- Runway en de Tech Coalition — Runway sluit zich aan bij deze alliantie tegen online seksuele uitbuiting van kinderen en haar programma Lantern voor het delen van signalen tussen platforms, en wijst opnieuw op zijn veiligheidsmaatregelen: gegevensfiltering, adversarial tests, hashing, meldingen aan NCMEC en C2PA-herkomstgegevens. 🔗 bron
- SpaceXAI en Omarchy — SpaceXAI wordt oprichtingssponsor van de Omacom Foundation met 1,5 miljoen dollar aan Grok-tokens; Grok 4.7 en zijn opvolgers zullen de agents van het project aandrijven, waaronder Omabot, dat pull requests beoordeelt. 🔗 bron
- Gids voor de guardrails van Perplexity — Perplexity publiceert een gids die AI-guardrails op drie momenten plaatst (invoer, acties van agents, uitvoer), vijf soorten bescherming vergelijkt en zeven gevallen illustreert, van promptinjectie tot hallucinatie; geen nieuwe functionaliteit. 🔗 bron
- pplx-decider-v1.1-27b op OpenRouter — Het beslissingsmodel van Perplexity met open gewichten komt beschikbaar op OpenRouter tegen het tarief van de Decisions API: 0,02 dollar per miljoen invoertokens, gratis uitvoer, een context van 262 000 tokens. 🔗 bron
- Cohere in Ottawa — Cohere opent zijn eerste kantoor in Ottawa, vlak bij Lansdowne Park, waar al bijna 30 medewerkers werken (commerciële activiteiten, engineering, infrastructuur, beveiliging, soevereine AI); er wordt geen oppervlakte of personeelsdoelstelling genoemd. 🔗 bron
Wat dit betekent
De assistent maakt inmiddels werkproducten, niet meer alleen antwoorden. Een dashboard van Claude Dashboards wordt bijgewerkt wanneer de gegevens veranderen, een animatie van Claude Motion blijft woord voor woord bewerkbaar doordat ze in code is geschreven, en Docs, Slides en Design, die voor alle abonnementen de bètafase hebben verlaten, melden al meer dan 45 miljoen creaties. Deze objecten vinden vervolgens hun weg naar bestaande tools: het dashboard gaat naar Grafana of PostHog, de animatie naar Runway of Luma, die er gegenereerde shots aan toevoegen. De Brand Kit van ElevenLabs volgt dezelfde logica: de huisstijl wordt een object in de werkruimte, dat met @ wordt aangeroepen, in plaats van een instructie die in elke prompt moet worden herhaald.
Beveiliging gaat op een andere schaal werken, zowel bij de verdediging als bij de handhaving van regels. Anthropic stelt vast dat het vinden van kwetsbaarheden nog nooit zo gemakkelijk is geweest: meer dan 29 000 potentiële kwetsbaarheden in zes maanden, waarvan ongeveer 6 000 handmatig beoordeeld. OSS Scanner verstuurt bewust rapporten zonder menselijke controle, met een verwacht aandeel van meer dan 90 % true positives, om dit knelpunt te verlichten. Tegelijkertijd worden de gebruiksregels concreter: het beleid van Anthropic voor 2026 brengt misleidende campagnes samen in een aparte sectie, en OpenAI presenteert Dark Clark als de eerste operatie van categorie 5 die het heeft ontmanteld sinds het met zijn rapportages begon. In de tools zorgt Claude Code 2.1.295 er nu voor dat een falende hook de actie blokkeert in plaats van die door te laten.
Snelheid en prijs worden instellingen die je zelf kiest. Ultrafast verkoopt GPT-6.1 Sol voor zes keer zoveel om tot 8 keer sneller te werken; volgens GitHub en Cognition evenaart of overtreft Claude Haiku 5.5 Sonnet 5 bij code, voor ongeveer een achtste van de kosten per taak volgens Cognition; Nano Banana 2.1 halveert de prijs van een 1K-afbeelding. Inference strekt zich uit van het apparaat, met llama.cpp in Windows ML en ML Drift op de GPU’s van telefoons en computers, tot het B300-cluster waarvan Together AI op IBM Cloud de eerste klant is, en TRL vermindert het piekgeheugengebruik bij een training met 8 192 tokens met 52 tot 82 %.
Tot slot worden veel cijfers van vandaag gemeten door degenen die ze publiceren. FrontierCode is de bedrijfseigen benchmark van Cognition, GitHub zegt dat Haiku 5.5 Sonnet 5 evenaart zonder cijfers te publiceren, LightOn berekent zijn scores na een normalisatie die de scores van alle topmodellen verandert, TII evalueert Falcon-ASR in het Emiratisch Arabisch alleen op een interne dataset en publiceert de gewichten niet, en de auteurs van Carbon-A vergelijken het zelf met zeven tools. Open wetenschap biedt een tegenwicht: TermGrade publiceert zijn 36 144 pogingen, inclusief mislukkingen, Carbon-A zijn database van 566 miljoen kandidaatgenen, en de ultraviolette kaart van Claude Science maakt pixel voor pixel onderscheid tussen wat gemeten en wat voorspeld is. De 150 miljoen dollar van Anthropic en het miljard van NVIDIA voor de Genesis Mission sturen in dezelfde richting: deze tools in handen van onderzoekers geven.
Bronnen
- Claude Dashboards en Claude Motion (blogbericht van Claude)
- Lanceringsthread voor Dashboards en Motion (@claudeai)
- Claude Motion (@claudeai)
- Runway en Claude Motion (Runway)
- Luma en Claude Motion (Luma)
- Anthropic Cyber Mission (Anthropic)
- OSS Scanner (Frontier Red Team van Anthropic)
- Repository anthropics/oss-scanner
- Ultrafast voor GPT-6.1 Sol (@OpenAIDevs)
- Changelog van de OpenAI API
- Prijzen van de OpenAI API
- Ultrafast in Codex (documentatie)
- Inzet voor de Genesis Mission (Anthropic)
- Aankondiging van de Genesis Mission (@AnthropicAI)
- NVIDIA investeert 1 miljard dollar om de Amerikaanse wetenschap vooruit te helpen (NVIDIA)
- De ontbrekende kaart van de hemel (Anthropic Science)
- Kaart van de hemel in ultraviolet (@AnthropicAI)
- Update van het gebruiksbeleid voor 2026 (Anthropic)
- Verstoring van dekmanteloperaties die door AI worden ondersteund (OpenAI)
- Claude Haiku 5.5 in GitHub Copilot (GitHub Changelog)
- Modellen en prijzen van GitHub Copilot
- Claude Haiku 5.5 in Devin (blog van Devin)
- Claude Code 2.1.295
- Claude Code 2.1.294
- Codex CLI 0.162.0
- Changelog van Antigravity, tabblad CLI
- Release notes van VS Code 1.141
- Release notes van Delta
- Blogbericht van Delta over het stoppen met Google Docs
- Release notes van de Gemini API
- Informatieblad van Nano Banana 2.1
- Introductie van Brand Kit (ElevenLabs)
- Brand Kit (@ElevenLabs)
- SemanTok (Stability AI)
- Artikel over SemanTok op arXiv
- ElevenReader in Brazilië (ElevenLabs)
- LightOnOCR-3 (blog van Hugging Face)
- Falcon-ASR (blog van Hugging Face)
- Carbon-A en de Carbon Annotation Database (blog van Hugging Face)
- TermGrade (ai&)
- TermGrade-collectie op Hugging Face
- TRL v1.15.0
- llama.cpp in Windows ML (Microsoft Foundry on Windows)
- llama.cpp op het Windows-evenement (@ggerganov)
- ML Drift (Google Developers Blog)
- Repository google-ai-edge/ml-drift
- Together AI, IBM Cloud en NVIDIA (blog van Together AI)
- B300-cluster op IBM Cloud (@togethercompute)
- Release notes van ChatGPT
- ChatGPT Go in Warp (@warpdotdev)
- Oracle (casestudy van OpenAI)
- Pollo AI (casestudy van OpenAI)
- Release notes van Devin van 7 oktober
- Copilot CLI 1.0.94
- Gemini CLI v0.65.0-nightly.20261008
- Changelog van Antigravity, tabblad SDK
- Ecosysteem van de Developer Knowledge API (Google Developers Blog)
- AQuA, kwaliteitsagent voor ADK-agents (Google Developers Blog)
- Draft pull requests tellen mee voor de limieten voor pull requests (GitHub Changelog)
- Gebruikers met de Triage-rol of hoger kunnen nu pull requests archiveren (GitHub Changelog)
- Schermlezers kunnen tijdlijnen als lijsten doorlopen (GitHub Changelog)
- Reproducties van wetenschappelijke artikelen met ML Intern (@abidlabs)
- Chatten via SSH (@XciD_)
- huggingface_hub 2.2.0
- Repository huggingface/swarmlab
- Darwin-27B-ZTC (blog van Hugging Face)
- Superfluid (blog van Hugging Face)
- funes 1.8.0 (blog van Hugging Face)
- GLiNER en de Indiase talen (blog van Hugging Face)
- Multilingual Terminal-Bench (blog van Hugging Face)
- Communicatietijd van collectieve GPU-primitives (blog van Hugging Face)
- Repository facebookresearch/best-n-selection-video-reasoning
- Lessen uit de KDD Cup 2026 (technisch blog van NVIDIA)
- Autonomie van Microduck (@matth_lapeyre)
- Albums op Suno (@suno)
- Dagelijkse serie van Ryan Serhant (@HeyGen)
- Runway sluit zich aan bij de Tech Coalition (Runway)
- SpaceXAI, oprichtingssponsor (omarchy.org)
- AI guardrails (Perplexity)
- pplx-decider-v1.1-27b op OpenRouter
- Nieuw kantoor van Cohere in Ottawa (Cohere)