ai-powered-markdown-translatorAus dem Fr ins De mit gpt-5.4-mini übersetzter Artikel.
Der 3. August 2026 bündelt drei große Ankündigungen: Alibaba stellt Qwen3.8-Max vor, sein neues Flaggschiffmodell mit 2,4 T Parametern, Genspark stellt seine Bürosoftware-Suite GenOffice als Open Source bereit, und Vercel öffnet eine programmatische API für v0. Rund um diese drei Veröffentlichungen legen Cursor, GitHub, Sakana AI, MiniMax, Runway, ElevenLabs und Google mit zahlreichen Produktupdates nach.
Qwen3.8-Max, neues Flaggschiffmodell von Alibaba für Code und Cowork
Alibaba hat Qwen3.8-Max vorgestellt, beschrieben als das bislang leistungsfähigste vom Unternehmen produzierte Modell, mit einer Ausrichtung auf Code und kollaboratives Arbeiten mit KI (cowork). Das Modell umfasst 2,4 T Parameter und ist sofort über die API und Qwen Studio verfügbar.
Das Team hebt vier Fortschrittsbereiche hervor: autonome langfristige Entwicklung (zehn Tage oder mehr Selbstentwicklung, von einem leeren Ordner bis zur Produktion, mit vollständiger Projektspur, die auf GitHub veröffentlicht wurde), produktionsreife Ergebnisse in vielen Fachbereichen, autonome Planung über lange Zeithorizonte — bis zu 500 Runden zur Optimierung von Chipdesign und 365 Tage E-Commerce-Strategie werden als Beispiele genannt — sowie native multimodale Intelligenz, bei der Vision fortlaufend Planung, Ausführung und Selbstkorrektur speist.
Alibaba kündigt an, die Gewichte von Qwen3.8-Max in der Woche nach der Ankündigung zu veröffentlichen, sowie die Open-Weights-Bereitstellung einer leichteren Version, Qwen3.8-27B. Das Modell ist außerdem ab der Ankündigung auf Venice, einer anonymen Chat-Plattform, verfügbar, und eine Integration in ein Tool namens „Command Code“ wurde am selben Tag ohne weitere Details erwähnt.
| Indikator | Wert |
|---|---|
| Parameter | 2,4 T |
| Eingabepreis | 2,0 $ / Million Tokens |
| Ausgabepreis | 6,0 $ / Million Tokens |
| Impliziter Cache | 0,25 $ / Million Tokens |
| Öffnung der Gewichte | Folgewoche (Qwen3.8-Max + Qwen3.8-27B) |
Genspark veröffentlicht den Code von GenOffice, seiner KI-Bürosuite
Genspark hat die Umstellung von GenOffice auf Open Source angekündigt, vorgestellt als die erste vollständige, Open-Source-KI-Bürosuite für PC und Mac. Das Tool ist für alle kostenlos und werbefrei.
Die Suite deckt die klassischen Anwendungen eines Office-Pakets ab — Textverarbeitung (Docs), Tabellenkalkulation (Sheets), Präsentationen (Slides) und PDF — mit den üblichen Bearbeitungswerkzeugen. Genspark integriert darin seinen Super Agent, der recherchieren, Daten analysieren und anschließend ein Dokument verfassen oder eine Präsentation erstellen kann, wobei er Genspark-Credits verbraucht.
Bemerkenswert auf der Entwicklungsmethodik-Seite: Die Alpha-Version wurde von nur einem Ingenieur innerhalb einer Woche gebaut, zu Kosten von 10.000 Dollar an Tokens.
“One engineer, one week, $10,000 in tokens. That’s what it took to build the GenOffice Alpha.”
🇩🇪 Ein Ingenieur, eine Woche, 10.000 Dollar an Tokens. So viel war nötig, um die Alpha-Version von GenOffice zu bauen. — @genspark_ai auf X
Das Projekt befindet sich in einer bewusst eingeräumten Alpha-Phase: Genspark lädt die Community ein, das Tool zu testen, Bugs zu melden und Funktionswünsche über einen speziellen Gruppenchat auf GenTeam einzubringen, ohne Code zu schreiben. Die hilfreichsten Mitwirkenden erhalten als Dank über 1.000 Genspark-Credits. Die Ankündigung erfolgte bei der Singapurer Ausgabe von AGI Playground, wo Genspark die These vertritt, dass mit sinkenden Modellkosten der Wert sich auf die beste darüber geschichtete Erfahrung verlagert.
Vercel startet eine programmatische API für v0
Vercel eröffnet eine neue v0-API, ab heute verfügbar, die programmatischen Zugriff auf die Fähigkeiten zur Anwendungsentwicklung bietet, die bislang auf die Chat-Oberfläche beschränkt waren. Konkret kann ein Entwickler v0 nun aus eigenem Code heraus steuern, statt über die Website zu gehen.
Vier Operationen werden bereitgestellt: eine Unterhaltung ausgehend von einem Textprompt, einem bestehenden Code-Repository oder einem ZIP-Archiv starten; eine Vorschau des Entwicklungsservers erzeugen, um das Ergebnis live zu visualisieren; Folge-Nachrichten senden, um die Generierung iterativ zu verbessern; und das Ergebnis direkt auf Vercel bereitstellen.
Diese API verwandelt v0 in einen Baustein, der sich in Drittanbieter-Toolchains einfügen lässt — Agenten, Automatisierungsskripte, interne Integrationen — statt in ein einfaches eigenständiges Massenprodukt. Das ist eine konsistente Entwicklung mit Vercels Strategie, v0 zu einer Schicht für die Generierung von Oberflächen zu machen, die von anderen Agenten genutzt werden kann, einschließlich Drittanbieter-Agenten, die v0 steuern, ohne seinen historischen Chat zu durchlaufen.
Für Teams, die bereits Entwicklungsagenten bauen, eröffnet dies die Möglichkeit, Codegenerierung, Vorschau und Deployment in einer vollständig automatisierten Pipeline zu verketten, ohne menschlichen Eingriff in jeder Phase.
Cursor: effizientere Cloud-Agenten und neue Google-Workspace-Plugins
Cursor hat am selben Tag zwei getrennte Updates veröffentlicht, eines zur Leistung seiner Cloud-Agenten, das andere zur Integration von Google Workspace.
Cloud-Agenten: 20 bis 30 % weniger Tokens
Cursor kündigt erhebliche Effizienzgewinne für seine Cloud-Agenten an: 20 bis 30 % weniger Tokens über alle Aufgaben hinweg und bis zu 80 % mehr Effizienz bei Aufgaben mit Computersteuerung (computer use). Diese Verbesserungen resultieren aus einem besseren Management von MCP-Servern, Skills und computer use durch die Agenten. Das erklärte Ziel ist, Nutzern zu ermöglichen, ambitioniertere Aufgaben zu delegieren und dabei im Token-Budget zu bleiben.
In den Editor integrierte Google-Workspace-Plugins
Cursor kann nun direkt über Plugins, die über die Seite „Customize“ oder den Cursor Marketplace zugänglich sind, in Google Workspace lesen, schreiben und handeln, ohne den Editor zu verlassen.
| Workspace-Dienst | Funktionen |
|---|---|
| Google Drive | Dateien suchen, öffnen und herunterladen, Ordner organisieren |
| Gmail | Posteingang durchsuchen und lesen, Nachrichten verfassen und senden |
| Google Calendar | Kalender anzeigen, Ereignisse erstellen, freie Zeitfenster finden |
| Google Docs | Dokumente öffnen, lesen, verfassen und bearbeiten |
| Google Sheets | Bereiche lesen, Zellen aktualisieren, Tabellen erstellen |
| Google Chat | Auf Räume und Nachrichten zugreifen, Nachrichten senden |
Ziel ist es, einem Entwickler Kontext aus seiner E-Mail oder seinem Kalender direkt aus Cursor heraus zu nutzen, ohne Hin- und Herwechseln zum Browser.
GitHub Agentic Workflows automatisiert die Cross-Repo-Dokumentation bei Aspire
GitHub hebt einen konkreten Anwendungsfall von GitHub Agentic Workflows hervor: Das Aspire-Team nutzt ihn, um gemergte Funktionen automatisch in Dokumentations-Pull-Requests umzuwandeln, die über mehrere Repositories verteilt sind. Das System wendet eingeschränkte Berechtigungen (scoped permissions) an und erzwingt vor dem Merge eine menschliche Prüfung durch einen Fachexperten (SME review).
| Verfolgte Kennzahl | Wert |
|---|---|
| Gemergte Doku-PRs | 82 / 82 |
| Median der Merge-Dauer | 44,8 Stunden |
Dieser Erfahrungsbericht illustriert einen der vorrangigen Schwerpunkte von GitHub bei agentischen Workflows: den Menschen im Loop zu behalten und gleichzeitig repetitive Aufgaben der Dokumentationspflege zu automatisieren.
GitHub veröffentlicht seinen Ship Log für Juli 2026
GitHub veröffentlicht seine monatliche Zusammenfassung der Veröffentlichungen vom Juli 2026, fokussiert auf das Thema Wahlmöglichkeiten für Entwickler.
Die GitHub-Copilot-Desktop-App ist nun für alle Pläne verfügbar, einschließlich Copilot Free und GitHub Education; Entwickler ohne Abonnement können außerdem ihren eigenen Modellanbieter-Schlüssel (bring your own key) verwenden. Der Copilot-Modellauswähler wird erweitert: Kimi K2.7 Code wird zum ersten Modell mit offenen Gewichten, das im Picker auswählbar ist, die OpenAI-GPT-5.6-Familie kommt zu Copilot hinzu mit Preisrückgängen von 80 % für GPT-5.6 Luna und 20 % für GPT-5.6 Terra, und Opus 5 von Anthropic wird allgemein verfügbar. GitHub Projects erhält außerdem verbesserte Filter und ein Tag-System auf Basis von Feldern mit Mehrfachauswahl.
Sakana Namazu, eine LLM-API für den japanischen Markt
Sakana AI hat die API Sakana Namazu online gestellt, eine Service-Variante seines Modells Namazu, das bislang auf die Anwendung Sakana Chat beschränkt war. Das Modell basiert auf Kimi K2.6, dem Open-Weights-Modell von Moonshot AI, das von Sakana AI für die japanische Sprache und geschäftliche Anwendungsfälle feinabgestimmt wurde.
Die API ist mit dem OpenAI-Format kompatibel: Es genügt, die Basis-URL und den API-Schlüssel in bestehendem Code zu ändern. Sie bringt integrierte Werkzeuge für Websuche und Codeausführung mit, einschließlich agentischer Fähigkeiten, um mehrere Schritte autonom zu verketten.
Sakana AI hebt drei Anwendungsfälle hervor: die autonome Erstellung von Marktstudienberichten, die Automatisierung des Kundensupports und eine kreative Anwendung, die rund 1.000 animierte Fische aus einer einfachen Anweisung heraus steuert. Im FairPoliticsQA-Benchmark, der dem japanischen kulturellen Kontext gewidmet ist, steigt der Score von 34,10 % auf 56,30 %.
MiniMax H3: Die Gewichte sind nun veröffentlicht
MiniMax hatte sein offenes multimodales Modell H3 am 31. Juli angekündigt — bereits in diesen Spalten behandelt. Am 3. August werden die Gewichte tatsächlich als Open Weights veröffentlicht, mit einem beanspruchten „Day-0“-Support über die gesamte Open-Source-Inferenzkette hinweg.
| Inferenzwerkzeug | Day-0-Support |
|---|---|
| ComfyUI | Native Integration, ein Modell und fünf Workflows ab Veröffentlichung |
| vLLM-Omni | Video-Endpoint mit OpenAI-API-Kompatibilität |
| SGLang / LMSYS | Anpassbarer lokaler Support, Ausführung auf NVIDIA- und AMD-Hardware |
| fal | Produktionsinfrastruktur sofort einsatzbereit |
MiniMax präsentiert diese Veröffentlichung als Überschreiten einer Schwelle zwischen Ankündigung und tatsächlicher Verfügbarkeit: Die Gewichte sind offen, und die Bereitstellung in Produktion ebenfalls. Der Drittanbieter-Partner Magnific hat zudem eine Demo der nativen, charakterspezifischen Lippensynchronisation in nur einer einzigen Generierung vorgestellt.
Runway startet einen Max-Plan mit 7 Tagen unbegrenztem Zugriff auf Seedance 2.5
Runway kündigt eine neue Abo-Stufe an, den Max-Plan, mit einem Startangebot: Angemeldete erhalten 7 Tage unbegrenzten Zugriff auf das Modell Seedance 2.5, sobald es auf der Plattform verfügbar ist.
Seedance 2.5, bereits in früheren Ausgaben erwähnt, ist auf Runway noch nicht verfügbar („coming soon“): Die eigentliche Neuigkeit des Tages ist also der neue Plan und sein Frühzugangsangebot, nicht das Modell selbst.
ElevenAgents: die Sprach-KI von ElevenLabs im Unternehmensmaßstab
ElevenLabs beschreibt den Umfang und die Fähigkeiten seiner Plattform für Sprach- und Chat-Agenten ElevenAgents.
“More than 10 million conversations run on ElevenAgents every week.”
🇩🇪 Mehr als zehn Millionen Gespräche werden jede Woche über ElevenAgents verarbeitet. — @ElevenLabs auf X
Jedes Gespräch entspricht einer realen Interaktion, die von einer Stimme oder einem Chat-Agenten mit natürlichem Ton übernommen wird: Erstattungsanfrage, Terminvereinbarung, Frage zu Leistungen, Flugänderung. Die Plattform bietet eine Simulation von Szenarien vor dem Produktivgang, eine kanalübergreifende Bereitstellung und ein Monitoring über das Tool Spotlight, das Gespräche in der Produktion überwacht und proaktive Verbesserungsempfehlungen liefert. Auf Unternehmensseite hebt ElevenLabs konfigurierbare Sicherheitsvorkehrungen und Optionen zur regionalen Datenresidenz hervor, für Kunden von Startups bis zu Regierungen und Fortune-500-Unternehmen.
Google und PSG: Gemini wird offizieller KI-Assistent des Clubs
Paris Saint-Germain und Google haben die Unterzeichnung einer Premium-Partnerschaft bis 2029 bekannt gegeben. In diesem Rahmen wird Google Gemini der offizielle KI-Assistent des Clubs, während Google Pixel das offizielle Smartphone des PSG wird.
Es handelt sich um eine Sponsoring- und Distributionsvereinbarung, ohne technische Details zu möglichen damit verbundenen Produktfunktionen oder Integrationen bis heute. Die Aktion ist Teil von Googles Strategie, die öffentliche Sichtbarkeit von Gemini über seinen Kreis technikaffiner Nutzer hinaus zu erweitern, indem es mit einem der weltweit am meisten verfolgten Fußballvereine verknüpft wird.
Kurzmeldungen
- Vercel und v0 akzeptieren die Anmeldung mit einem ChatGPT-Konto — auf den Login-Seiten wurde zusätzlich zum nun in ChatGPT verfügbaren Vercel-Plugin ein Button „Continue with ChatGPT“ hinzugefügt. 🔗 Quelle
- Replit kündigt den Designathon an — ein einwöchiger Designwettbewerb, offen für alle Kreativen, mit einem Live-Start am 4. August um 9 Uhr (Pazifikzeit) und Preisen als Gewinn. 🔗 Quelle
- Together AI vergleicht die Kosten pro Aufgabe von Kimi K3 Max und Fable 5 xhigh — im DeepSWE-Benchmark erreicht Kimi K3 Max nahe an die Leistung von Fable 5 xhigh für etwa ein Drittel der Kosten pro Ausführung, also 2,8-mal mehr gelöste Aufgaben pro ausgegebenem Dollar. 🔗 Quelle
- Migration von GitLab zu GitHub Enterprise Cloud in allgemeiner Verfügbarkeit — die CLI-Erweiterung
gh gl2ghermöglicht nun die Self-Service-Migration von Repositories von gitlab.com oder GitLab Self-Managed zu GitHub Enterprise Cloud. 🔗 Quelle - Luma Ray 3.2 auf der Drittanbieter-Plattform Fuser verfügbar — das Videomodell ist in dieses Werkzeug zum Zuschneiden integriert, mit dem Versprechen, die Handlung der Szene bei einem Wechsel des Seitenverhältnisses beizubehalten. 🔗 Quelle
- NVIDIA NeMo Gym integriert Legal Agent Bench — dieser Benchmark für juristische Agenten, entwickelt mit Harvey, ergänzt die offene NeMo-Gym-Bibliothek, um Open-Weights-Modelle auf komplexen juristischen Anwendungsfällen voranzubringen. 🔗 Quelle
- NVIDIA-Demo eines in 30 Sekunden erlernten Parkour-Agenten — eine Simulation soll aus einem sehr kurzen Referenzvideoclip ein Expertenverhalten erlangt haben, ohne dass weitere technische Details genannt wurden. 🔗 Quelle
- Kimi Slides Tutorial zum Erstellen von Präsentationen — Moonshot AI veröffentlicht die erste Episode einer Lehrserie über Kimi Slides, die von Kimi K3 angetriebene Präsentationsgenerierung mit Diagrammen und SmartArts. 🔗 Quelle
Was das bedeutet
Der Wettlauf um offene Gewichte geht auf mehreren Fronten gleichzeitig weiter. Qwen3.8-Max wird trotz seiner 2,4 T Parameter ab nächster Woche offen verfügbar sein; MiniMax H3 wechselt von der Ankündigung zur tatsächlichen Verfügbarkeit mit Day-0-Support für vier verschiedene Inferenz-Bausteine; und die Kosten-/Leistungsanalyse von Together AI zu Kimi K3 Max zeigt, warum diese offenen Modelle an Boden gewinnen: Bei ähnlicher Qualität kosten sie nur einen Bruchteil der Preise vergleichbarer geschlossener Modelle. Das Machtverhältnis zwischen offenen und geschlossenen Modellen entscheidet sich immer stärker auf diesem wirtschaftlichen Terrain statt nur über den Benchmark-Score.
Die zweite Achse ist die Plattformisierung der Entwicklungswerkzeuge in programmierbare Bausteine. Die v0-API von Vercel, die Effizienzgewinne der Cloud-Agenten von Cursor und die Google-Workspace-Integration sowie der von GitHub bei Aspire dokumentierte Anwendungsfall zeichnen alle denselben Trend nach: Anbieter verkaufen nicht mehr nur eine Chat-Oberfläche, sondern eine durch andere Agenten steuerbare Automatisierungskette, mit Leitplanken — eingeschränkten Berechtigungen, menschlicher Prüfung —, um sie produktionsreif nutzbar zu machen.
Für den Massenmarkt setzen zwei Ankündigungen auf ein anderes Register: Die Öffnung des Codes von GenOffice durch Genspark soll eine vollständige KI-Bürosuite über Kostenlosigkeit und den Community-Effekt demokratisieren, während die Partnerschaft zwischen Google und dem PSG eher einer Logik der Markenpräsenz als der technischen Innovation folgt — Gemini gewinnt an öffentlicher Sichtbarkeit, ohne dass eine neue Funktion angekündigt wird.
Schließlich bestätigen die von ElevenLabs genannten Zahlen — mehr als zehn Millionen wöchentliche Gespräche auf ElevenAgents — und das Launch-Angebot von Runway rund um Seedance 2.5, dass generative Produktions-KI, ob Sprache oder Video, sich nun im Unternehmensmaßstab etabliert, mit dedizierten Überwachungstools statt bloßer Technologiedemonstrationen.
Quellen
- Qwen3.8-Max — Ankündigung auf X
- GenOffice — Ankündigung auf X
- API v0 — Ankündigung auf X
- Cursor — Cloud-Agenten auf X
- Cursor — Google-Workspace-Plugins
- GitHub Agentic Workflows bei Aspire
- GitHub Ship Log Juli 2026
- Sakana Namazu — offizielle Ankündigung
- MiniMax H3 — veröffentlichte Gewichte
- Runway — Max-Tarif
- ElevenAgents — ElevenLabs auf X
- Google und der PSG — Ankündigung auf X
- Vercel und v0 — ChatGPT-Verbindung
- Replit Designathon
- Together AI — Kimi K3 Max vs. Fable 5 xhigh
- Migration von GitLab zu GitHub Enterprise Cloud
- Luma Ray 3.2 auf Fuser
- NVIDIA NeMo Gym — Legal Agent Bench
- NVIDIA — Parkour-Demo
- Kimi Slides — Tutorial