ai-powered-markdown-translatorArtikel aus dem Französischen ins Deutsche mit gpt-5.4-mini übersetzt.
Zwischen dem 14. und 16. August 2026 ist Cursor offiziell zu SpaceX gestoßen, Z.ai hat GLM-5.3 mit einem starken Schwerpunkt auf Cyberabwehr veröffentlicht, und Pika Labs hat seine erste Generation von Audiomodellen vorgestellt. Parallel dazu hat Anthropic ein internes Experiment beschrieben, bei dem Claude-Code-Routinen die iOS-, Android-, Desktop- und Web-Anwendungen eigenständig warten, mit 388 geöffneten und 180 gemergten Pull Requests. Ebenfalls auf dem Menü: Watermarking bei Anthropic und Gemini, Neuigkeiten zu Copilot, Zed und Replit sowie die Veröffentlichung der offenen Gewichte von Qwen3.8-27B.
Cursor schließt sich SpaceX an — Übernahme offiziell abgeschlossen
14. August — Cursor gibt bekannt, dass seine Übernahme durch SpaceX offiziell abgeschlossen ist. Der Editor schließt sich dem SpaceXAI-Team an, um nach eigenen Worten dazu beizutragen, Grok zur nützlichsten KI der Welt zu machen und eine Reihe von Produkten zu verbessern: Grok Build, Grok Bot, Grok API und Cursor selbst.
Der Prozess war keine völlige Überraschung: Bereits im April 2026 war eine Partnerschaft zwischen den beiden Unternehmen angekündigt worden, und dieser Schritt im August bildet den Abschluss.
Strategisch begründet Cursor den Schritt mit dem Zugang zur massiven GPU-Infrastruktur von SpaceX, die es ermöglichen soll, leistungsfähigere Modelle günstiger zu trainieren und bereitzustellen. Der Editor erklärt, seinen Produktkurs beibehalten zu wollen — Entwicklern dabei zu helfen, weniger Zeit mit dem Schreiben von Code und mehr Zeit mit dem Lösen komplexer Probleme zu verbringen —, mit leistungsfähigeren KI-Teamkollegen (AI teammates) und gesenkten Preisen, die als direkte Folge dieser Zusammenlegung der Rechenressourcen angekündigt werden.
Das ist eine bemerkenswerte Bewegung in der Landschaft der KI-Entwicklungstools: Cursor, eine der meistgenutzten agentischen IDEs, wechselt den Eigentümer, um in das xAI/SpaceX-Ökosystem an der Seite von Grok integriert zu werden, in einem Kontext rascher Konsolidierung der Branche. Der Beitrag nennt keine unmittelbaren Änderungen an der Nutzererfahrung über das Versprechen hinaus, leistungsfähigere und günstigere Modelle zu liefern.
Cursor is now part of @SpaceX. Today, we have officially closed our acquisition. We will join the @SpaceXAI team to help make Grok the world’s most useful AI and improve Grok Build, Grok Bot, Grok API, Cursor, and more.
🇩🇪 Cursor ist jetzt Teil von @SpaceX. Heute haben wir unsere Übernahme offiziell abgeschlossen. Wir treten dem Team @SpaceXAI bei, um Grok zur nützlichsten KI der Welt zu machen und Grok Build, Grok Bot, Grok API, Cursor und mehr zu verbessern. — @cursor_ai auf X
🔗 Offizieller Cursor-Beitrag — “Cursor is now a part of SpaceX”
Z.ai bringt GLM-5.3 für agentisches Coding und Cyberabwehr heraus
14. August — Z.ai (Zhipu AI) stellt GLM-5.3 als Nachfolger von GLM-5.2 vor, mit zwei Prioritäten: agentisches Coding und Cyberabwehr. Das Modell ist das Ergebnis eines Post-Trainings auf einer Basis von 743 Milliarden Parametern und liefert bessere Ergebnisse beim agentischen Coding, während es weniger Ausgabe-Tokens verbraucht als GLM-5.2.
Auf der Sicherheitsseite hat Z.ai während des Post-Trainings Daten zur Schwachstellenfindung und autorisierte Sicherheitsumgebungen integriert:
| Bewerteter Benchmark | GLM-5.2 | GLM-5.3 |
|---|---|---|
| CyberGym (Schwachstellenidentifikation) | 77,2 % | 84,5 % |
| ExploitBench (Ausnutzungs-Reasoning) | 24,4 % | 54,4 % |
| ExploitGym (erfolgreiche Aufgaben in 2h) | 29 | 105 |
| ExploitGym (erfolgreiche Aufgaben in 6h) | 39 | 130 |
Laut Z.ai hat die gesamte GLM-Serie 2 436 Schwachstellen in 269 Projekten identifiziert (darunter 1 097 mit mittlerem bis hohem Schweregrad), im Rahmen autorisierter Forschungen, die mit Universitäten und professionellen Sicherheitsteams durchgeführt wurden.
Angesichts der offensichtlichen Dual-Use-Risiken eines Modells, das für offensive Cybersicherheit leistungsfähiger ist, verfolgt Z.ai eine stufenweise Einführung: Ausgewählte Sicherheitspartner testen das Modell zunächst in einem kontrollierten Rahmen, bevor ein breiterer API-Zugang und anschließend die Veröffentlichung offener Gewichte erfolgen, sobald die Sicherheitsbewertungen abgeschlossen sind. Derzeit ist GLM-5.3 über den GLM Coding Plan und ZCode verfügbar, mit einem „Weekend Build“-Event (16.–17. August), das neuen ZCode-Nutzern 100 Millionen kostenlose Tokens bietet.
Claude Code hält die Anwendungen von Anthropic eigenständig am Laufen: 388 offene PRs, 180 gemergt
13. August — Boris Cherny (Claude-Code-Team bei Anthropic) beschreibt ein internes Experiment, das seit mehreren Wochen läuft: Claude die tägliche Wartung der Anthropic-Anwendungen anzuvertrauen (iOS, Android, Desktop, Web, CLI und Agent SDK). Das Setup basiert auf einem dedizierten Slack-Kanal, in dem „Claude Tag“ eine Reihe automatisierter täglicher Routinen ausführt:
| Routine | Aufgabe |
|---|---|
| Crash fuzzer | Öffnet die App in einem Simulator, provoziert Abstürze, identifiziert die Ursache und schlägt einen Fix vor |
| Dup unifier | Erkennt ähnliche, aber auseinanderlaufende Abstraktionen und eröffnet PRs, um sie zu vereinheitlichen |
| Dead-code remover | Entfernt statisch unerreichbaren Code nach Bestätigung durch Logging |
| Abstraction police | Korrigiert Abstraktionen, die leaken (leaky abstractions) |
Die Ergebnisse werden als überraschend positiv dargestellt: In den letzten Wochen haben diese Routinen 388 Pull Requests über die Anthropic-Repositories hinweg geöffnet, von denen 180 nach einem Claude-Code-Review und anschließendem menschlichen Review gemergt wurden. Im Fehlerfall fordert das Team Claude auf, seine Routine selbst anzupassen, um sich am nächsten Tag zu verbessern. Anthropic gibt an, nun darüber nachzudenken, den Merge-Prozess solcher mechanischer Änderungen zu vereinfachen, und lädt alle Interessierten ein, einen ähnlichen Workflow nachzubauen.
Over the last few weeks, these routines have opened 388 PRs across our repos, 180 of which we merged after Claude Code Review + human review. Claude generally gets these PRs right on the first shot, and if it doesn’t, we ask Claude to tune its routines so it’s better the next day.
🇩🇪 In den letzten Wochen haben diese Routinen 388 Pull Requests über unsere Repositories hinweg geöffnet, von denen 180 nach einem Claude-Code-Review und einem menschlichen Review gemergt wurden. Claude erstellt diese PRs in der Regel direkt korrekt, und falls nicht, bitten wir es, seine Routinen anzupassen, damit sie am nächsten Tag besser sind. — @bcherny auf X
🔗 Prompt der Crash-Fuzzing-Routine
Pika Labs bringt Pika Audio Models heraus, vier Foundation-Modelle für generierten Sound
14. August — Pika Labs, bislang auf Videogenerierung ausgerichtet, betritt mit vier Foundation-Modellen unter dem Namen Pika Audio Models den Markt für generiertes Audio: Pika Soundtrack (Hintergrundmusik für Videos), Pika Music (Musikgenerierung), Pika SFX (Soundeffekte) und Pika Speech (synthetische Stimme).
Das zentrale Argument der Ankündigung ist der Preis:
| Modell | Behaupteter Vergleich |
|---|---|
| Pika Soundtrack | $0,617 pro Sekunde — 2x effizienter als Hunyuan Foley |
| Pika SFX | bis zu 20x effizienter als die Alternativen |
| Pika Speech | 9x effizienter als ElevenLabs v3, 4,5x effizienter als Cartesia |
| Pika Music | bis zu 10x effizienter als vergleichbare Musikmodelle |
Die vier Modelle sind ausschließlich über den Pika API Club verfügbar, vorerst ohne angekündigten öffentlichen Zugang — eine Entscheidung, die eher auf Entwickler und Integratoren als auf direkte Erstellung in der Pika-App ausgerichtet ist. Für die Landschaft der Mediengenerierung positioniert dieser Start Pika Labs als direkten Konkurrenten von ElevenLabs im Sprachbereich und von Musikakteuren bei der Generierung, wobei auf den Preis statt auf eine behauptete qualitative Überlegenheit gesetzt wird.
Sound on! Today, we’re introducing Pika Audio models: 4 frontier foundation models that cover the full spectrum of generative sound. And we’ve made them less expensive than every audio model on the market—up to 20x times cheaper.
🇩🇪 Der Sound ist aktiviert! Heute stellen wir die Pika Audio Models vor: 4 bahnbrechende Foundation-Modelle, die das gesamte Spektrum generierten Sounds abdecken. Und wir haben sie günstiger gemacht als jedes Audio-Modell auf dem Markt — bis zu 20-mal günstiger. — @pika_labs auf X
🔗 Detaillierte Preisvergleiche
Anthropic: Watermarking, Risk Report und Auto Mode standardmäßig
Anthropic veröffentlicht am 13. und 14. August drei Ankündigungen hintereinander, zwischen regulatorischer Transparenz und der Weiterentwicklung des Flaggschiffprodukts Claude Code.
FAQ zum Watermarking: Einhaltung des AI Act ohne Qualitätsverlust
14. August — Anthropic veröffentlicht eine FAQ, um Fragen zum Watermarking (unsichtbare Markierung) von von Claude generierten Texten zu beantworten. Diese Maßnahme soll dem europäischen AI Act entsprechen, im Rahmen desselben Code of Practice, den auch andere große Modellentwickler unterzeichnet haben. Das Unternehmen stellt klar, dass die Methode praktisch keinen Einfluss auf die Qualität der Antworten hat, dass markierte und unmarkierte Texte beim Lesen nicht unterscheidbar sind, dass keine versteckten Zeichen eingefügt werden, dass das Watermarking keine zusätzlichen Tokens verbraucht und nicht teurer wird und dass sich Watermarks nicht auf eine bestimmte Person oder Konversation zurückverfolgen lassen.
Zweiter Risk Report: Transparenz über Risiken
14. August — Im Rahmen seiner Responsible Scaling Policy veröffentlicht Anthropic regelmäßig Risk Reports, die die von seinen Systemen ausgehenden Risiken und den Bereitschaftsgrad des Unternehmens zu deren Bewältigung detailliert beschreiben. Der zweite Bericht dieser Art wurde gerade online gestellt, in Fortsetzung des bereits veröffentlichten ersten Berichts. Der Ankündigungstweet nennt den genauen Inhalt des Dokuments nicht, abgesehen von seiner Existenz und seinem Ziel der Transparenz — die Praxis fügt sich jedoch in eine breitere Bewegung freiwilliger Risikogovernance bei großen KI-Laboren ein, parallel zu regulatorischen Pflichten wie dem europäischen AI Act.
🔗 Ankündigung des Risk Reports
Auto Mode wird zum Standardmodus, neuer Befehl /auto-mode-setup
14. August — Die am 7. August angekündigte Umstellung ist nun wirksam: Auto Mode wird zum standardmäßigen Berechtigungsmodus in Claude Code für Pro-, Max- und Team-Konten. Falls bereits ein Standardmodus manuell konfiguriert war, bittet Claude um Bestätigung, bevor er geändert wird. Zwei Mechanismen halten die Kontrolle aufrecht: jederzeit per Shift+Tab den Modus wechseln oder einen festen Modus mit dem Parameter „defaultMode“ in den Einstellungen anheften. Anthropic führt außerdem einen neuen Befehl ein, /auto-mode-setup, der das Projekt-Repository analysiert und eine Liste von Repositories und vertrauenswürdigen Domains vorschlägt, die der Nutzer bestätigen kann.
Code-Tools: Amp hostet Git, Zed 1.15, Replit-Neuigkeiten
Drei agentische Editoren und Entwicklungsumgebungen veröffentlichen zwischen dem 14. und 16. August bemerkenswerte Updates.
Amp hostet jetzt Git-Repositories — „Step 1“
15. August — Amp (Sourcegraph) fügt das Hosting von Git-Repositories direkt in sein Ökosystem ein, vorgestellt vom Gründer @sqs als erster Schritt („Step 1“) einer größeren Ambition: die Abhängigkeit von Nutzern und Agenten von GitHub zu verringern. In einer Folge-Nachricht präzisiert er, dass dies nur ein erster Meilenstein sei und kein Bruch mit GitHub. Bei Pull Requests vertritt Amp eine klarere Position: Sie bleiben ein guter Grund, auf GitHub zu bleiben, aber das Unternehmen ist der Meinung, dass sie in einem von Agenten dominierten Workflow immer weniger wichtig werden — eine Aussage, die damit übereinstimmt, dass das Amp-Team bereits direkt auf main ohne PR pusht.
Zed v1.15: Branch-Diff, Drag-and-drop, JSX/TSX Custom Elements
14. August — Zed veröffentlicht Version 1.15, am selben Tag wie den Start der privaten Delta-Beta. Die bemerkenswerteste Funktion erlaubt es, den aktuellen Branch direkt in den Rändern des Editors mit dem Standard-Branch des Repositories zu vergleichen, über die Option „Diff Against Default Branch“. Zed fügt außerdem Drag-and-drop von Dateien in externe Anwendungen hinzu (macOS und Linux Wayland), und das gekoppelte Bearbeiten von JSX/TSX-Tags funktioniert nun auch mit benutzerdefinierten Elementen (custom elements) — beim Umbenennen eines Tags wird das entsprechende Gegenstück automatisch aktualisiert. Emmet-Vervollständigungen sind zudem in return- und Pfeilfunktionen verfügbar.
Replit: MCP-Server, Admin API Beta, Inline-Diagramme, Clerk-Migration
14. August — In seiner Wochenzusammenfassung beschreibt Replit mehrere Neuerungen: Drei neue MCP-Server können dem Agent hinzugefügt werden, darunter Airtable und Rootly Docs; eine Admin API in Beta ermöglicht Enterprise-Administratoren, Kontodaten auszulesen und Nutzung sowie Ausgaben zu verfolgen; Inline-Diagramme erlauben es, den Agenten nach Daten zu fragen und direkt ein in der Unterhaltung angezeigtes Diagramm zu erhalten; und eine vereinfachte Migration von Anwendungen, die Replit Auth nutzen, zu Clerk Auth, wobei der Agent zuerst die Kontodaten migriert, damit bestehende Nutzer ihren Zugriff behalten.
🔗 „This Week in Replit“-Thread
GitHub Copilot: Grok 4.6, Agent-Apps und Open-Source-Sicherheit
Vier GitHub-Ankündigungen prägen die Woche, zwischen neuen Modellen, CLI-Tools und Sicherheitsinitiativen.
Grok 4.6 in GitHub Copilot verfügbar
14. August — Das Reasoning-Modell von xAI wird in Copilot schrittweise verfügbar gemacht (VS Code, Visual Studio, CLI, JetBrains, Xcode, Eclipse, App und Cloud-Agent) für Pro- bis Enterprise-Tarife, mit nutzungsabhängiger Abrechnung. Für Business und Enterprise müssen Administratoren die Grok-4.6-Richtlinie explizit aktivieren, da sie standardmäßig deaktiviert ist. Diese Integration steht im Kontext einer geschäftigen Woche für Copilot: Grok 4.6 ist am selben Tag auch bei Devin, Warp und Genspark angekommen.
Wöchentliche Neuigkeiten: Agent Plugins 1.0, /tasks, /rewind, Kimi K3
14. August — Die wöchentliche Copilot-Zusammenfassung beschreibt mehrere Updates: Agent Plugins 1.0 wird auf VS Code, CLI, SDK und der Copilot-App allgemein verfügbar; Kimi K3 wird auf allen Abonnementstufen ausgerollt; und MAI-Code-1.1-Flash führt natives Bildverständnis ein. In der Copilot CLI verwaltet ein Befehl /tasks Unteragenten, ein Befehl /rewind macht Änderungen rückgängig, ohne über git zu gehen, und --plan lässt sich im Headless-Modus nun mit --mode autopilot kombinieren. Der Copilot-JetBrains-Speicher behält den Kontext zwischen Sitzungen, und Ollama wird als BYOK-Anbieter verfügbar. VS Code 1.133 fügt den Modellwechsel zwischen Claude im BYOK-Modus und integrierten Modellen hinzu.
Agent-Apps: scopen, absichern und deployen, ohne GitHub zu verlassen
14. August — GitHub erläutert, wie vier erwähnbare Agent-Apps („@mention“) helfen, den Software-Lebenszyklus abzudecken, ohne das Tool zu wechseln: Amplitude analysiert die Auswirkung einer Funktion auf das Nutzerverhalten, Endor Labs übernimmt die Sicherheitsprüfung von Abhängigkeiten, LaunchDarkly erstellt und verdrahtet Feature Flags für schrittweise Deployments, und PagerDuty bewertet das Deployment-Risiko, indem es aktive Incidents prüft, bevor es eine Bereitstellung in Produktion empfiehlt. Weitere Agent-Apps sind zum Start verfügbar: Packfiles, Miro, Bright Security, SonarQube und Octopus Deploy.
Secure Open Source Fund: Bilanz von Session 4
13. August — GitHub veröffentlicht die Bilanz der vierten Session seines Programms Secure Open Source Fund: 50 Open-Source-Projekte haben ihre Sicherheitslage verbessert, indem sie KI-gestützte Workflows, das Fachwissen der Maintainer, GitHub-Sicherheitstools und direkte Finanzierung kombiniert haben. Die Nachricht betont die zentrale Rolle der Maintainer beim Schutz des Open-Source-Ökosystems, zu einem Zeitpunkt, an dem KI die Art und Weise, wie Software gebaut, geprüft und abgesichert wird, tiefgreifend verändert.
Gemini: konfigurierbares Watermark und Pixel-11-Zusammenfassung
Konfigurierbares SynthID: Watermark erkennen und personalisieren
14. August — Gemini erlaubt es nun, direkt zu prüfen, ob ein Inhalt (Bild, Video, Musik) von KI erzeugt wurde, indem man es einfach fragt: „Is this AI-generated?“. Ergänzend dazu rollt Google über mehrere Tage hinweg die Möglichkeit aus, zu wählen, ob mit Gemini erstellte Inhalte ein sichtbares Watermark anzeigen oder nicht. Die unsichtbaren SynthID-Watermarks sowie die C2PA-Metadaten bleiben dabei unabhängig von dieser Einstellung stets im Hintergrund eingebettet — nur die sichtbare Anzeige wird optional, über einen Button „Show watermark“ in den Kontoeinstellungen.
🔗 SynthID-Ankündigung konfigurieren
Pixel 11, Gemini Intelligence und WeatherNext 2 als Open Source
14. August — In seiner wöchentlichen Zusammenfassung blickt Google AI auf die Pixel-11-Reihe (Pixel 11, Pixel Watch 5, Pixel Tag) zurück, die Magic Capture, Rambler und eine Erweiterung von Live Transcribe für die Echtzeitübersetzung der amerikanischen Gebärdensprache enthält — alles unter der Leitung von Gemini Intelligence, einer neuen proaktiven und agentischen KI-Schicht. Dieselbe Zusammenfassung bestätigt die Open-Source-Veröffentlichung von WeatherNext 2, dem Wettervorhersage-Tool von Google DeepMind, das einen zusätzlichen Tag Vorhersagehorizont für die Bahn und Intensität eines Zyklons bietet. Schließlich ist die neue Gemini-Notebook-Erfahrung nun vollständig für Pro-Nutzer ausgerollt.
Mediengenerierung: Wan Agent Skills, HeyGen Avatar V, NVIDIA x Runway
Wan startet Agent Skills, einen Marktplatz für Community-Workflows
14. August — Alibaba eröffnet auf Wan Video eine neue Funktion, Agent Skills, mit der Nutzer wiederverwendbare kreative Workflows erstellen und teilen können, die auf den Wan-Modellen aufbauen — vom „Short-Drama“-Generator bis zum Musikclip-Generator. Der Start geht mit einem Anreizprogramm einher: Jeder erfolgreich veröffentlichte Skill bringt 150 Inspiration-Punkte, gedeckelt auf 450 Punkte pro Konto, bis zum 31. August 2026. Diese Ankündigung steht in der Kontinuität der jüngsten Releases des Wan-Ökosystems (Wan3.0, Wan-Animate-2, Wan CLI): Alibaba strukturiert die Plattform über ein bloßes, isoliertes Video-Generierungstool hinaus.
🔗 Wan-Agent-Skills-Ankündigung
HeyGen stellt Avatar V vor, die neue Generation seiner Avatar-Engine
13. August — HeyGen präsentiert Avatar V, eine neue Version seiner Engine zur Generierung von Video-Avataren. Anstatt das Referenzvideo des Nutzers, wie es „die meisten Avatar-Systeme“ laut dem Unternehmen tun würden, auf ein einziges Bild zu komprimieren, würde Avatar V die gesamte Referenzvideo-Sequenz auf jeder Modellebene einlesen. Dieser Ansatz soll feine Details besser bewahren, die normalerweise verloren gehen — Hauttextur, Zähne, Mikroausdrücke — sowie den typischen Sprechrhythmus der gefilmten Person. Es werden weder Benchmark-Zahlen noch ein Termin für die allgemeine Verfügbarkeit genannt.
NVIDIA erläutert die Vera-Rubin-Partnerschaft mit Runway, Ursprung von Gen-4.5
13. August — Auf dem Runway AI Summit 2026 stellte NVIDIA über seinen Leiter für Medien und Unterhaltung, Richard Kerris, die Rolle seiner Vera-Rubin-Infrastruktur für den Einsatz des Modells Gen-4.5 von Runway heraus. Die hervorgehobene Zahl: Dank dieser Infrastruktur habe Runway Gen-4.5 in nur einem Tag auf seiner Plattform bereitstellen können. NVIDIA positioniert generative Echtzeit-KI als ein neues Rechenmodell für Medien und Unterhaltung, das kreative Produktion in einen Live-Prozess verwandeln kann, der vom Künstler gesteuert wird, statt in eine klassische, verzögert gerenderte Pipeline.
Open-Source-Ökosystem: Hugging-Face-Bilanz und AI Factory in Indien
State of Open Models Summer 2026: China dominiert die Spitze, Qwen führt bei den Derivaten
14. August — Hugging Face veröffentlicht seinen halbjährlichen Überblick über das Ökosystem offener Modelle. Chinesische Labore dominierten 2026 die Frontier-Releases, mit Modellen von 754 Milliarden bis 2,78 Billionen Parametern, verglichen mit weniger als 130 Milliarden Parametern bei den meisten US-Releases. Qwen (Alibaba) setzt sich als Gründungsmodell der Community mit 151.448 Derivaten auf dem Hub durch, also mit dem 2,6-Fachen der Reichweite von Meta. Beim tatsächlichen Einsatz ziehen Modelle mit weniger als 1 Mrd. Parametern 83 % aller historischen Downloads an. Schließlich treten KI-Agenten als neue Traffic-Kategorie hervor: Claude Code machte im Juli 44,4 % des als „agent“ getaggten Traffics aus.
Together AI und Larsen & Toubro bauen Indiens größte AI Factory
13. August — Together AI kündigt eine Partnerschaft mit der indischen Larsen & Toubro Group an, um das zu bauen, was zum größten GPU-Cluster des Landes werden soll: 10.000 NVIDIA-B300-GPUs, vorgestellt als „India’s largest AI Factory“. Die Infrastruktur wird ausdrücklich in den Dienst des Open-Source-Ökosystems gestellt — Inferenz, Fine-Tuning und Training im großen Maßstab — für das indische KI-native Ökosystem. Die Ankündigung bestätigt den Aufstieg regionaler AI Factories auf NVIDIA-Hardware der neuesten Generation.
Qwen3.8-27B: offene Gewichte und blitzartige Ökosystem-Adoption
14. August — Alibaba veröffentlicht die offenen Gewichte von Qwen3.8-27B, einem dichten, nativ multimodalen Modell unter Apache-2.0-Lizenz. Laut Qwen übertrifft es Qwen3.7-Plus insgesamt und sticht beim Programmieren und bei Büroaufgaben hervor, mit einem nativen Kontextfenster von 262K Tokens, das über YaRN auf bis zu 1M erweitert werden kann.
| Anbieter / Tool | Detail |
|---|---|
| Unsloth | Läuft mit nur 17 GB RAM |
| SGLang | 206 Tokens/Sekunde auf einer einzelnen RTX 5090 |
| vLLM | Day-0-Support mit vollem 1M-Token-Kontextfenster |
| Ollama, LM Studio, MediaTek, RTX Spark | Integration in den darauffolgenden Tagen |
Am 16. August wurde Qwen3.8-27B zum trendendsten Modell auf Hugging Face, und Alibaba gab bekannt, dass die Qwen-Familie auf der Plattform kumuliert die Marke von 3 Milliarden Downloads überschritten hat.
OpenAI bringt Computer History in ChatGPT desktop
13. August — OpenAI führt Computer History ein, eine Funktion in der ChatGPT-desktop-App, die es ChatGPT und Codex ermöglicht, sich an die jüngste Aktivität des Nutzers über Anwendungen und Websites hinweg zu erinnern, um den Bedarf zu reduzieren, den Kontext bei jeder Interaktion neu zu erklären. Die Funktion basiert auf der zuvor veröffentlichten Chronicle-Vorschau und bietet eine neue chronologische Ansicht, mit der sich aus häufigen Aufgaben „Skills“ erstellen lassen. Beim Datenschutz kann der Nutzer seinen Verlauf löschen, bestimmte Anwendungen ausschließen, und die Aktivierung erfolgt per explizitem Opt-in. Der Rollout beginnt für Pro-, Business- und Enterprise-Nutzer von ChatGPT desktop auf Mac; EEA, Vereinigtes Königreich und Schweiz folgen in den kommenden Wochen.
🔗 Computer-History-Ankündigung
Perplexity migriert Sonar auf die Agent API
13. August — Perplexity entwickelt seine Sonar-API zu einer neuen Agent API weiter, die die geerdete Websuche beibehält und zugleich Multi-Step-Suche, Code-Ausführung, integrierte Tools und den Zugriff auf mehrere Modelle über einen einzigen Einstiegspunkt hinzufügt. Bei den Benchmarks BrowseComp und WideSearch gibt das Team an, dass die Agent API mehr als doppelt so gut abschneidet wie der beste jemals mit Sonar erreichte Wert. Für Entwickler, die bereits an Sonar angebunden sind, bleibt die Migration zu beobachten: Die Ankündigung nennt weder einen Abschaltzeitplan noch Angaben zur Abwärtskompatibilität.
Kurzmeldungen
- Claude Code desktop — Auto-Continue nach Erreichen des Nutzungslimits — eine neue Checkbox erlaubt es Claude Code desktop, eine Sitzung automatisch fortzusetzen, sobald das Nutzungslimit zurückgesetzt wird. 🔗 Tweet
- Claude Cowork — Office Hours offen für Nicht-Tech-Teams — das Cowork-Team öffnet 15-Minuten-Slots, um Rückmeldungen von Nutzern aus Marketing, Vertrieb, Finance, Legal und Ops einzusammeln. 🔗 Tweet
- Gemini 3.7 Flash verfügbar in Devin, zwei Wochen lang -50 % — auf FrontierCode 1.1 auf dem Niveau von Claude Sonnet 5 für weniger als die Hälfte der Kosten, bis zum 27. August 2026 um 50 % reduziert. 🔗 Tweet
- Gemini 3.7 Flash verfügbar auf Genspark — integriert in AI Chat, Code Agent und Genspark Claw, drei Wochen nach 3.6 Flash, zum halben Preis. 🔗 Tweet
- Amp verbessert das Teilen von Portal-URLs — OpenGraph-Vorschauen, kürzere URLs, und der Portal-Tab wirkt mehr wie ein teilbarer Browser. 🔗 Tweet
- Copilot CLI und ein Namecheap-Skill automatisieren eine GitHub-Pages-Website — von einem leeren Repository zu einer GitHub-Pages-Website per HTTPS auf einer eigenen Domain in etwa 14 Minuten. 🔗 Tweet
- GitHub erläutert den Workflow gestapelter Pull Requests mit KI-Agenten — von Agenten erzeugte Arbeit in einen Stapel gezielter PRs zerlegen, verwaltet über die
gh stack-CLI. 🔗 Tweet - GitHub Copilot Dev Days — Aufruf zu Community-Events — GitHub lädt Entwickler ein, Copilot-Dev-Days-Events in ihrer Stadt zu organisieren oder daran teilzunehmen. 🔗 Tweet
- Nutzer aus Kommentaren blockieren (persönliche Repositories) — PR- und Issue-Kommentare in persönlichen Repositories erlauben nun, einen Nutzer über das More-Menü zu blockieren oder zu entsperren. 🔗 GitHub-Changelog
- OAuth Apps — mehrere Redirect-URIs und Token-Refresh — bis zu 10 Redirect-URIs und kurzlebige Tokens mit Refresh, ausgeliefert mit GitHub Enterprise Server 3.23. 🔗 GitHub-Changelog
- Ideogram aktualisiert seinen KI-Bildeditor — Entfernen von Objekten und zielgerichtete Nachbearbeitung, in einigen Vergleichstests laut einem Drittanbieter besser als GPT-2 und Nano Banana Pro. 🔗 Tweet
- NVIDIA und Indosat eröffnen Indonesiens erstes universitäres KI-Zentrum — drei erste Studentenprojekte: Tuberkulose-Screening, Präzisionslandwirtschaft und Katastrophenwarnung. 🔗 NVIDIA-Artikel
- Runway öffnet den Frühzugang zu Seedance 2.5 in 1080p — Update, das nur die Ausgabeauflösung betrifft, ohne sonst neu angekündigte Funktion. 🔗 Tweet
- Cohere — North Mini Code überschreitet 150k Downloads — das Open-Source-Modell bleibt über Model Vault, OpenRouter oder lokal verfügbar, nachdem das kostenlose OpenCode-Angebot endete. 🔗 Tweet
Was das bedeutet
Die Konsolidierung rund um GPU-Infrastruktur beschleunigt sich und verschiebt die Kräfteverhältnisse. Die Übernahme von Cursor durch SpaceX verankert einen agentischen IDE-Editor in einem Ökosystem massiver Rechenleistung, statt ihn von Drittanbietern abhängig zu lassen — ähnlich wie Together AI gemeinsam mit Larsen & Toubro den größten GPU-Cluster Indiens baut, um regionale Open-Source-Inferenz zu versorgen, oder wie NVIDIA seinen Vera-Rubin-Chip als Voraussetzung für den Ein-Tages-Rollout von Gen-4.5 bei Runway inszeniert. In allen drei Fällen wird Rechenkapazität ebenso zum Verkaufsargument wie das Modell selbst.
Agenten begnügen sich nicht mehr mit Assistenz: Sie beginnen zu operieren. Die Claude-Code-Routinen, die die Anwendungen von Anthropic eigenständig am Laufen halten (388 PRs, 180 gemergt), sind das eindrucksvollste Beispiel, aber die Bewegung ist breiter — Auto Mode wird zur Standard-Einstellung von Claude Code, GitHub strukturiert Agent-Apps, die eine Funktion von Anfang bis Ende scopen und deployen können, seine Copilot CLI gewinnt /tasks- und /rewind-Befehle zur Verwaltung von Subagenten, und Amp beginnt, sich von GitHub zu lösen, indem es Git-Repositories selbst hostet. Die Entwicklungsinfrastruktur reorganisiert sich rund um die Autonomie der Agenten statt um reine Code-Assistance.
Die Governance generierter Inhalte wird zu einer gemeinsamen Sorge, getragen von derselben regulatorischen Frist. Anthropic erläutert seine Watermarking-Methode und veröffentlicht seinen zweiten Risk Report in derselben Woche, in der Gemini das sichtbare Watermark konfigurierbar macht und SynthID im Hintergrund aktiv hält — zwei unterschiedliche Antworten auf denselben Code of Practice des europäischen AI Act. Die stufenweise Bereitstellung von GLM-5.3, das sowohl offensiv als auch defensiv in der Cybersicherheit leistungsfähiger ist, zeigt dieselbe Spannung: ein leistungsfähigeres Modell veröffentlichen und zugleich sein Dual-Use-Potenzial kontrollieren, bevor die Gewichte offengelegt werden.
Schließlich entscheidet sich die Wirtschaft offener Modelle immer stärker über Einführungsgeschwindigkeit und Preis statt nur über rohe Leistung. Qwen3.8-27B wird innerhalb von kaum zwei Tagen zum trendendsten Modell auf Hugging Face, getragen von Day-0-Support bei Ollama, vLLM und SGLang, während die Hugging-Face-Bilanz bestätigt, dass Qwen bei den Community-Derivaten bereits mit dem 2,6-Fachen von Meta führt. Pika Labs folgt derselben Logik bei generiertem Audio und setzt auf ein Preisargument von bis zu 20-mal günstiger statt auf eine behauptete qualitative Überlegenheit — ein Zeichen dafür, dass der Kampf um offene und kostengünstige Modelle inzwischen ebenso sehr über Distribution wie über Benchmarks entschieden wird.
Quellen
- Cursor — Ankündigung auf X
- Cursor — offizieller Beitrag
- Z.ai — Ankündigung von GLM-5.3 auf X
- Boris Cherny — Claude-Code-Routinen auf X
- Boris Cherny — Prompt-Crash-Fuzzing auf X
- Pika Labs — Ankündigung von Pika Audio Models auf X
- Pika Labs — Preisvergleiche
- Anthropic — FAQ zum Watermarking auf X
- Anthropic — zweiter Risk Report auf X
- Anthropic — Auto Mode standardmäßig auf X
- Amp — Git-Hosting auf X
- Zed — Changelog v1.15
- Replit — wöchentlicher Thread auf X
- GitHub — Grok 4.6 in Copilot
- GitHub — wöchentliche Copilot-Releases
- GitHub — Agent-Apps
- GitHub — Secure Open Source Fund Session 4 auf X
- Gemini — konfigurierbares SynthID auf X
- Google AI — Pixel-11-Zusammenfassung auf X
- Wan — Agent Skills auf X
- HeyGen — Avatar V auf X
- NVIDIA — Vera Rubin x Runway-Partnerschaft auf X
- Hugging Face — State of Open Models Summer 2026
- Together AI — AI Factory in Indien auf X
- Alibaba Qwen — Ankündigung von Qwen3.8-27B auf X
- OpenAI — Computer History auf X
- Perplexity — Agent API auf X
- Claude Code Desktop — Auto-Continue auf X
- Claude Cowork — Office Hours auf X
- Devin — Gemini 3.7 Flash auf X
- Genspark — Gemini 3.7 Flash auf X
- Amp — Teilen von Portal-URLs auf X
- GitHub — Copilot CLI + Skill Namecheap auf X
- GitHub — gestapelte Pull Requests
- GitHub — Copilot Dev Days auf X
- GitHub — Blockieren von Benutzern aus Kommentaren heraus
- GitHub — OAuth-Apps, Redirect-URIs und Refresh-Tokens
- Curious Refuge — Ideogram-Editor auf X
- NVIDIA — KI-Zentrum Indonesien
- Runway — Seedance 2.5 1080p auf X
- Cohere — North Mini Code auf X