ai-powered-markdown-translatorAus dem Französischen ins Deutsche mit gpt-5.4-mini übersetzter Artikel.
Am 11. August 2026 überschreitet die Gemini-App die Marke von einer Milliarde monatlicher Nutzer und wird damit zum am schnellsten wachsenden Produkt in der Geschichte von Google. NVIDIA veröffentlicht Nemotron 3.5 Lightning und seine Routing-Bibliothek NeMo Switchyard, Mistral öffnet seine Plattform für Drittmodelle und schmiedet eine europäische Rechenkoalition, und Alibaba enthüllt Wan-Animate-2, ein großes Upgrade seines Open-Source-Animationsmodells. Ebenfalls auf dem Programm: auf fünf neue Märkte ausgeweitete ChatGPT-Werbung, neue Tools für Entwickler und eine lange Liste von Ankündigungen zur Mediengenerierung.
Gemini überschreitet die Milliarde monatlicher Nutzer
Die Gemini-App hat offiziell die Marke von einer Milliarde aktiven monatlichen Nutzern überschritten und ist damit laut Google das am schnellsten wachsende Produkt in der gesamten Unternehmensgeschichte. Die Ankündigung wurde sowohl vom offiziellen Konto @GeminiApp als auch von Josh Woodward verbreitet, der bei Google die Gemini- und Labs-Teams leitet.
Google begleitet die Ankündigung mit einer zahlenbasierten Bilanz der Nutzungsmuster, die dieses Wachstum getragen haben:
| Gemessene Nutzung | Daten |
|---|---|
| Sprachinteraktionen | 63 % der Nutzer verwenden Sprache |
| Gemini Live-Sitzungen | 1 von 5 nutzt die Live-Kamera oder Bildschirmfreigabe |
| Schulische Anfragen | 38 % enthalten einen Anhang (Datei) |
| Bilderzeugung | Mehr als 150 Millionen Bilder werden pro Tag erstellt |
| Android-Automatisierung | Automatisierte Aktionen in mehr als 40 Anwendungen |
| iOS-Nutzer | Mehr als 100 Millionen aktive Nutzer auf Apple-Geräten |
Diese Zahlen verdeutlichen eine Diversifizierung der Nutzung über den reinen Text-Chat hinaus: Sprache, Kamera, Bildschirmfreigabe, Multimedia-Generierung und App-übergreifende Automatisierung (Restaurantreservierung, VTC-Bestellung) erweisen sich als wichtige Treiber der Adoption.
🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.
🇩🇪 🚀 Eine Milliarde für Gemini! Unser Ziel bleibt es, daraus den persönlichsten, proaktivsten und leistungsfähigsten Assistenten zu machen. — @GeminiApp auf X
🔗 Offizielle Ankündigung im Google-Blog
NVIDIA bringt Nemotron 3.5 Lightning und NeMo Switchyard für High-Volume-Agenten auf den Markt
NVIDIA erweitert seine Familie offener Nemotron-3-Modelle um Nemotron 3.5 Lightning, ein hybrides MoE mit 30 Milliarden Parametern (3 Milliarden aktiv), das für die Ausführung hochvolumiger agentischer Aufgaben entwickelt wurde — Tool-Aufrufe, Ergebnisvalidierung, Aufgabendeligierung — statt für komplexes Schlussfolgern. Verfügbar in NVFP4 und BF16 mit einem Kontext von bis zu 1 Million Tokens, beansprucht das Modell bis zu 4-mal den Ausgabedurchsatz vergleichbarer Modelle und 30 % Zeitersparnis bei der Aufgabenfertigstellung. Auf PinchBench erreicht es 86 % Genauigkeit und schließt 10.000 Aufgaben 35 % schneller als Qwen3.6 35B bei gleicher Genauigkeit ab.
Das Modell wird mit Gewichten, Trainingsdaten und Rezepten verteilt und ist auf Hugging Face, ModelScope, OpenRouter und build.nvidia.com verfügbar. Together AI ist vom ersten Tag an Launch-Partner (day-0) mit reservierter Kapazität über sein Angebot Dedicated Model Inference für hochvolumige agentische Workloads.
Parallel dazu veröffentlicht NVIDIA NeMo Switchyard, eine Open-Source-Bibliothek, die jede Anfrage an das am besten geeignete Modell routet (Qualität, Latenz, Kosten), ohne die Anwendung umzuschreiben — Frontier-Modelle bleiben komplexem Schlussfolgern vorbehalten, Lightning der spezialisierten Ausführung. NVIDIA gibt die Kosten für die Aufgabenfertigstellung mit knapp einem Drittel von Opus 4.8 allein an. Konkrete Partner werden genannt: Boomi routet 59 % seines Traffics an ein schnelleres feinabgestimmtes Modell, Cognition senkt seine durchschnittlichen Kosten um 28 %, und Ramp kombiniert Modell und Routing für 59 % Kosten und 32 % weniger Ausführungszeit.
🔗 Offizieller NVIDIA-Artikel · Modellankündigung auf X
Alibaba enthüllt Wan-Animate-2, ein großes Upgrade seiner Open-Source-Charakteranimation
Alibaba (Wan-Team) veröffentlicht Wan-Animate-2, beschrieben als ein großes Upgrade seines Open-Source-Modells für Charakteranimation. Vier Fähigkeiten werden hervorgehoben: eine High-Fidelity-Animation, die Bewegungen und Mikroausdrücke über Menschen, Zeichentrickfiguren, Roboter und Tiere hinweg überträgt; Multi-Character-Animation, bei der jede Figur ihre eigene Identität und Bewegung in derselben Szene beibehält; textgesteuerte Kamerasteuerung (zum Beispiel „Top-Down-Ansicht“), entkoppelt vom Quellvideo; und Echtzeit-Streaming-Generierung, die Sequenzen beliebiger Länge chunk für chunk erzeugt, ohne sichtbare Fehlerakkumulation.
Auf technischer Ebene verzichtet Alibaba auf explizite Pose-Skelette zugunsten des Referenzvideos selbst als Bewegungsprior, mit einer Dual-Branch-DiT-Architektur (Diffusion Transformer), einer zeitlichen Time-Align-RoPE-Codierung und einer spärlichen Aufmerksamkeit (Sparse-Ref Attention), um die Rechenlast ohne Qualitätsverlust zu begrenzen. Die Kamerasteuerung stützt sich auf eine LoRA, die auf etwa 50.000 Multi-View-Unity-Engine-Beispielen trainiert wurde.
Das Modell ist Open Source, ab sofort auf ModelScope, Hugging Face und GitHub verfügbar, mit Online-Demo. Laut NVIDIAs „Local AI“-Kampagne vom August erzeugen seine 14 Milliarden Parameter auf RTX-Systemen 16- bis 26-mal schneller als die Alternativen — eine Bestätigung seiner Optimierung für den lokalen Einsatz auf Consumer-Hardware.
🔗 Technische Details und NVIDIA-Zahlen · Ankündigung auf X
Mistral startet regionale Inferenz, öffnet seine Plattform für GLM-5.2 und schmiedet eine europäische Rechenkoalition
Mistral positioniert sich als das einzige europäische KI-Labor, das regionale Inferenzwahl und Servicegarantien kombiniert. Das Unternehmen, das bereits in einem tariflichen und technischen Wettlauf mit OpenAI, Google und chinesischen Akteuren steht, setzt hier auf eine andere Ausrichtung: Souveränität und planbare Servicequalität statt nur auf den Benchmark-Wettlauf. Zwei Neuheiten auf Plattformseite:
| Funktion | Status | Beschreibung |
|---|---|---|
| Mistral Regional Endpoints | Verfügbar | Wahl zwischen Europa oder den USA für die Inferenz |
| Mistral Priority Tier | Öffentliche Vorschau | SLA für Verfügbarkeit und angepasste Durchsatzgrenzen |
Ein weiterer bemerkenswerter Punkt: Die Mistral-Plattform öffnet sich für Drittmodelle, beginnend mit GLM-5.2 von Z.ai, das dieselben regionalen Kontrollen und Servicezusagen erhält wie die Mistral-Modelle — eine erste Annäherung zwischen den beiden Akteuren, die bislang direkte Konkurrenten im Segment der erschwinglichen offenen Modelle waren.
Schließlich startet Mistral die European Compute Units (ECU), einen Mechanismus, der mehrjährige Unternehmenszusagen in Zugang zu seiner Recheninfrastruktur umwandelt, mit dem Ziel von 1 GW Kapazität bis 2030 — das entspricht der Leistung, die eine große Stadt verbraucht. Die angekündigten Gründungspartner sind ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman und CEO), Amadeus (Luis Maroto, CEO) und Caisse des Dépôts (Olivier Sichel, CEO) — eine Mischung aus Industrie, Transport und öffentlicher Finanzwirtschaft, die den Anspruch verdeutlicht, eine unabhängige europäische Rechenindustrie jenseits der US-Hyperscaler aufzubauen.
🔗 Offizielle Mistral-Ankündigung
OpenAI startet ChatGPT-Werbung im Vereinigten Königreich, in Mexiko, Brasilien, Japan und Südkorea
OpenAI geht einen weiteren Schritt bei der Einführung von Werbung in ChatGPT. Das Werbeprogramm, das im Februar 2026 in den USA zunächst für die Free- und Go-Angebote getestet und im März auf Kanada, Australien und Neuseeland ausgeweitet wurde, wird nun offiziell in fünf neuen Märkten gestartet: Vereinigtes Königreich, Mexiko, Brasilien, Japan und Südkorea. Die Angebote Plus, Pro, Business, Enterprise und Education bleiben werbefrei, und weitere Märkte sind bis Jahresende vorgesehen.
Das Prinzip bleibt unverändert: Werbung beeinflusst niemals die Antworten von ChatGPT, sie bleibt klar als gesponsert gekennzeichnet und visuell von der organischen Antwort getrennt. Das Targeting basiert auf dem Thema der laufenden Konversation und der Historie früherer Werbeinteraktionen, ohne Werbetreibenden je Zugriff auf Gespräche oder personenbezogene Daten zu geben — sie erhalten nur aggregierte Statistiken (Aufrufe, Klicks).
Auf Nutzerseite kann ChatGPT eine Anzeige ausblenden, anzeigen lassen, warum sie eingeblendet wurde, seine Werbedaten mit einem Handgriff löschen und die Personalisierung jederzeit verwalten. Minderjährigen, die erkannt oder vermutet werden, werden keine Anzeigen gezeigt, ebenso wenig in der Nähe sensibler Themen (Gesundheit, psychische Gesundheit, Politik). Laut OpenAI zeigte der Pilot keine messbaren Auswirkungen auf das Nutzervertrauen, was diese schrittweise Ausweitung motiviert hat.
🔗 Offizielle OpenAI-Ankündigung
Open-Source-Ökosystem und Inferenz
webAI Intelligence Lab veröffentlicht TwiL-LM3, ein 3B-Raumodell, das GPT-OSS-120B übertrifft
Das Labor webAI Intelligence Lab (Austin) veröffentlicht TwiL-LM3, sein erstes Open-Source-Modell für formales Schlussfolgern. Mit nur 3 Milliarden Parametern gibt es an, GPT-OSS-120B von OpenAI in 4 der 5 getesteten Benchmarks für formales Schlussfolgern zu übertreffen — also rund 40-mal weniger Parameter für eine 2,6-mal schnellere Inferenz. Das Modell wurde auf verifizierten und proprietären Daten statt auf automatisch gesammeltem Web-Content trainiert und zielt auf Edge-Computing: Es soll vom Raspberry Pi bis zum iPhone laufen können, ohne auf die Cloud angewiesen zu sein.
Meta bereitet eine Version von Muse Spark 1.2 mit offenen Gewichten vor
Im Thread zur Ankündigung von Muse Glimmer erklärt Alexandr Wang (Meta Superintelligence Labs), dass Meta bald eine Version von Muse Spark 1.2 mit offenen Gewichten veröffentlichen wird — bisher das proprietäre Modell, das den Terminal-Code-Agenten Muse Code antreibt. Ein genaues Datum wird nicht genannt, doch die Ankündigung bestätigt eine Verschiebung von Meta hin zu mehr offenen Gewichten in der gesamten Muse-Reihe, in Kontinuität mit der sofortigen Veröffentlichung der Gewichte von Muse Glimmer unter der Apache-2.0-Lizenz.
Zuckerberg veröffentlicht einen Text über Metas KI-Philosophie
Am selben Tag veröffentlicht Mark Zuckerberg einen Text, in dem er erklärt, dass „jeder Zugang zu Superintelligenz haben sollte“, und die Philosophie und Werte von Meta darlegt, um eine positive Zukunft der KI aufzubauen. Die Botschaft begleitet den Start von Muse Glimmer und positioniert die Offenlegung der Gewichte als grundlegende Entscheidung statt bloß als Marketingargument; sie fügt sich in eine breitere Kommunikation von Meta zu seiner Open-Weights-Strategie in dieser Woche ein.
Lightricks stellt LTX-2.5 vor, ein großes Update seines offenen World Models
Lightricks veröffentlicht LTX-2.5, eine neue Version seines „World Model“, das bereits für Film, Robotik und Echtzeit-Workflows eingesetzt wird. Das Update verspricht eine höhere Pixeltreue, mehrschichtige Szenen, die von Schnitt zu Schnitt konsistent bleiben, sowie ein vortrainiertes Fundament, das mit einem neuen Rendering namens Diffusion Fidelity Rendering für verschiedene Domänen feinabgestimmt (fine-tuned) werden kann. Das Team präsentiert LTX-2.5 als offene Grundlage statt als gemietetes Werkzeug.
IBM Research veröffentlicht ALTK-Evolve, ein agentisches Gedächtnis mit geringerem Token-Bedarf als ACE
IBM Research veröffentlicht ALTK-Evolve, ein System, mit dem KI-Agenten aus vergangenen Fehlern lernen können, ohne neu trainiert zu werden, indem die Menge der zurückgespeisten Anweisungen an die Kapazität des verwendeten Modells angepasst wird — im Gegensatz zu ACE (Agentic Context Engineering), das bei jedem Schritt sein vollständiges „Playbook“ liefert. Im AppWorld-Benchmark mit DeepSeek-V3.2 erreicht ALTK-Evolve 89,3 % erledigte Aufgaben bei 263K Tokens pro Aufgabe, gegenüber 80,4 % und 634K Tokens für ACE. Mit gpt-oss-120b erzielt es dieselbe oder eine bessere Genauigkeit bei etwa 40 % der Inferenzkosten von ACE.
Together AI, IBM und NVIDIA schließen sich für Unternehmensinferenz auf IBM Cloud zusammen
Together AI kündigt eine Partnerschaft mit IBM und NVIDIA an, um KI-Inferenz auf Unternehmensniveau auf IBM Cloud bereitzustellen, über einen dedizierten Cluster von NVIDIA-B300-GPUs mit Spectrum-X-Netzwerk — eine Premiere dieser Art auf dieser Plattform, angetrieben von der Produktions-Inferenzplattform von Together AI. Das Angebot richtet sich an Unternehmen, die bereits IBM-Cloud-Kunden sind und KI-Workloads einsetzen möchten, ohne zu einem anderen Cloud-Anbieter zu migrieren.
Entwickler-Tools: Amp, Replit, GitHub Copilot und Manus
Amp startet globale Plugins und Skills für die orbs
Amp (Sourcegraph) führt ein zentrales System für von Amp gehostete Plugins und Skills ein, verfügbar überall dort, wo Amp läuft, insbesondere in den orbs. Es gibt zwei Ebenen: eine persönliche Ebene, ein experimenteller Sandkasten mit Live-Recharging (live reloading) im selben Gesprächs-Thread, und eine Workspace-Ebene, die von Administratoren verwaltet und standardmäßig für das gesamte Team geladen wird. Persönliche Elemente können in den Workspace übernommen werden, und das Versioning ist nativ verwaltet (Aktualisierung auf die neueste Version, Erkennung veralteter Skills).
Replit MCP-Beta: Eine App über MCP erstellen, laden, durchsuchen und veröffentlichen
Replit erweitert seine MCP-Beta (Model Context Protocol) um neue Fähigkeiten: eine Anwendung direkt über MCP erstellen, laden, durchsuchen und veröffentlichen, ohne die Weboberfläche zu nutzen. Das erklärte Ziel ist es, echte Software auf Replit von jedem kompatiblen MCP-Client aus bauen zu können — Editor, autonomer Agent oder Dritttool — statt auf die Replit-Oberfläche selbst beschränkt zu bleiben. Diese Erweiterung bestätigt Replits Strategie, seine Plattform als programmierbaren Baustein für agentische Workflows bereitzustellen.
MAI-Code-1.1-Flash kommt zu GitHub Copilot, MAI-Code-1-Flash veraltet
Microsofts neuestes kompaktes Code-Modell, MAI-Code-1.1-Flash, wird in GitHub Copilot ausgerollt – mit nativer Vision-Unterstützung sowie Verbesserungen bei Codequalität, Befolgung von Anweisungen und Tool-Nutzung. Es kostet 73 % weniger als MAI-Code-1-Flash, mit einem Premium-Request-Multiplikator von 0,25× für Jahresabonnenten. Auf Free und Student automatisch ausgewählt, auf Pro, Pro+, Max, Business und Enterprise manuell auswählbar. Gleichzeitig kündigt GitHub die Veraltung von MAI-Code-1-Flash zum 10. September 2026 an.
Manus wird wieder ein unabhängiges Unternehmen
Manus kündigt an, wieder ein unabhängiges Unternehmen zu werden. Um den regulatorischen Anforderungen bestimmter Rechtsräume zu entsprechen, muss ein Teil der Nutzer seine Daten vor dem 23. August 2026 (7:59 Uhr, Singapur-Zeit) sichern und anschließend ab dem 25. August 2026 (8:00 Uhr, Singapur-Zeit) eine Wiederherstellung starten. Betroffene Nutzer werden per E-Mail und In-App-Benachrichtigung informiert; während der Übergangszeit ist keine Abrechnung vorgesehen, dazu gibt es Willkommensboni.
Mediengenerierung: Wan CLI, Motif 3, Luma Scenes und 800-VDC-Versorgung
Wan CLI: Alibaba ermöglicht die Steuerung von Wan direkt aus Agents heraus
Alibaba veröffentlicht das Wan CLI, ein neues Kommandozeilenwerkzeug, mit dem sich die Wan-Plattform direkt aus Agents heraus aufrufen lässt, um Bilder und Videos programmgesteuert zu generieren. Die verbrauchten Credits bleiben vollständig mit dem Wan-Video-Konto des Nutzers synchronisiert, sodass keine doppelte Abrechnungsverwaltung zwischen Weboberfläche und automatisierter Nutzung entsteht. Die Installation erfolgt, indem ein Befehl aus dem Wan-Panel abgerufen und in den eigenen Agent eingefügt wird; zur Einarbeitung gibt es ein Video-Tutorial.
Motif 3: erstes koreanisches Frontier-Modell, trainiert auf NVIDIA-B200-GPUs
Das koreanische Startup Motif Technologies bringt Motif 3 Base und Motif 3 auf den Markt, seine ersten Modelle für den Wettlauf um Frontier-LLMs, entwickelt mit Unterstützung des koreanischen Wissenschaftsministeriums und trainiert auf NVIDIA-B200-GPUs. Motif 3 basiert auf Motif 3 Base und wurde per Post-Training mit NVIDIA NeMo-RL weiterentwickelt. In Zusammenarbeit mit NVIDIA veröffentlicht das Team außerdem eine NVFP4-Version (optimierte reduzierte Präzision von NVIDIA). Das Paket wird auf Hugging Face mit technischem Bericht verfügbar sein, und NVIDIA lobte den Launch als Beispiel für die Dynamik des koreanischen KI-Ökosystems.
Luma Scenes: szenenbasierte Videoproduktion, angetrieben von Uni-1
Luma AI startet Luma Scenes, ein Tool, mit dem sich jede Szene vor dem finalen Rendering einzeln verfeinern, timen und validieren lässt — als Antwort auf das klassische Problem, viele Varianten produzieren zu müssen, um nur eine brauchbare zu behalten, wobei eine misslungene Szene die gesamte Produktion gefährden kann. Das Tool baut auf Luma Layers auf (Layer-basiertes Editing, Ende Juli) und bestätigt Lumas Ausrichtung auf granulare Kontrolle statt One-Click-Generierung, mit einem Workflow, der dem traditionellen Schnitt näherkommt.
Ideogram Ad Resizer: ein Design, alle Werbeformate
Ideogram startet Ad Resizer: Ausgehend von einem einzigen Design und den gewünschten Werbeplätzen erzeugt das Tool automatisch ein komplettes Set kampagnenbereiter Formate (Instagram, Facebook, YouTube, Connected TV, Display, Print), einschließlich extremer Seitenverhältnisse, die manuell schwer zuzuschneiden sind. Sofort verfügbar in der App und über die API, zur Integration in automatisierte Werbeproduktions-Pipelines — ein konkreter Marketing-Use-Case für multikanale Kreativteams.
HeyGen for Real Estate: offizieller Launch mit drei Videoformaten für Immobilienmakler
HeyGen startet offiziell HeyGen for Real Estate mit drei Videoformaten für Immobilienmakler, die selbst ohne Kamera oder Schnitt im Bild erscheinen — mit dem Ziel, ihnen zu ermöglichen, mehrmals täglich zu posten, ohne die visuelle Präsenz zu opfern, die dieser Sektor verlangt. Anreiz: Wer sich innerhalb von 12 Stunden nach der Ankündigung für den Creator-Plan anmeldet, erhält 30 Tage lang kostenlosen White-Glove-Zugang (nur USA). HeyGen spricht von einer möglichen Ausweitung auf andere kleine Unternehmen jenseits der Immobilienbranche.
NVIDIA erläutert die 800-VDC-Stromversorgungsarchitektur künftiger „AI factories“
NVIDIA beschreibt zusammen mit Google und Microsoft über das Open Compute Project eine 800-Volt-Gleichstromarchitektur, die die Anzahl der elektrischen Umwandlungsschritte zwischen Netz und GPUs reduziert, um die Rechendichte künftiger Beschleuniger-Generationen zu unterstützen. Mehr als 80 Hersteller arbeiten bereits an konformen Produkten. Die Einführung erfolgt in mehreren Phasen: hybride „Power Rack“-Architektur ab der zweiten Jahreshälfte 2026, „Row Power Center“ im Jahr 2027 und anschließend native 800-VDC-Installationen im kommenden Jahrzehnt.
Qwen, Z.ai und OpenAI: neue Modelle und Agent-Synchronisierung
Qwen3.8-27B: Open Weights für diese Woche angekündigt
Alibaba Qwen bestätigt, dass die Open Weights von Qwen3.8-27B noch in dieser Woche veröffentlicht werden, eine neue Größe in der Qwen3.8-Familie nach dem bereits Anfang August abgedeckten Flaggschiffmodell Qwen3.8-Max. Das Team stellt das neue Modell als überlegen gegenüber Qwen3.6-27B im agentischen Coding dar — eine Leistung, die von der Entwickler-Community, die seit mehreren Wochen auf diese Zwischengröße wartete, bereits gut aufgenommen wurde.
Z.ai: ZCode erreicht 1 Million Nutzer, Reset der Limits des GLM Coding Plan
Z.ai kündigt an, dass ZCode, sein auf GLM-Modellen basierendes Coding-Tool, die Marke von einer Million Nutzern überschreitet. Als Dank setzt das Unternehmen die Nutzungslimits aller Abonnenten des GLM Coding Plan zurück und rollt ein Update aus, das die Fähigkeit, langfristiges Denken besser in tatsächlich abgeschlossene Arbeit zu überführen, verbessern soll, mit einer Cache-Erfolgsquote von 98 % und damit rund 1,8-mal mehr Nutzung für Abonnenten.
ChatGPT-Desktop-App auf Linux als Vorschau verfügbar, mit Codex
OpenAI erweitert seine Desktop-App auf Linux, bislang nur für macOS und Windows verfügbar. Die Vorschau umfasst vier große Distributionen — Ubuntu 24.04/26.04 LTS, Debian 13 und Fedora 43/44 — mit .deb/.rpm-Paketen für x64 und ARM64. Die App bündelt ChatGPT, ChatGPT Work und Codex in einer einzigen nativen Oberfläche, mit Zugriff auf Projekte und unterstützte Browser-Workflows, ohne die Arbeitsumgebung zu wechseln.
Codex und ChatGPT Work importieren Arbeit anderer KI-Agents
Neue Funktion für ChatGPT Work und Codex: bestehende Arbeit, die mit anderen KI-Agents erstellt wurde, im OpenAI-Ökosystem synchron halten. Konkret können Nutzer Projekte, Unterhaltungen, Skills und Plugins importieren, einen Importverlauf einsehen und in den Einstellungen eine automatische Synchronisierung aktivieren. Ab sofort in der ChatGPT-Desktop-App verfügbar, um die Reibung eines Tool-Wechsels zu reduzieren, statt mit einer komplett neuen Konfiguration bei Null anzufangen.
Kurzmeldungen
- Fable-Abrechnungsfehler behoben, 196 Rückerstattungen — Anthropic bestätigt die vollständige Behebung eines Konfigurations-Cache-Bugs, der fälschlicherweise Überschreitungen anzeigte; 196 Nutzer wurden erstattet und als Ausgleich gutgeschrieben. 🔗 Tweet
- v0 (Vercel) überarbeitet die Seitenleiste — Gespräche nach Projekt gruppiert, Echtzeit-Statusanzeigen, Vorschaukarten beim Hover. 🔗 Tweet
- Amp erhöht die Diskgröße der Orbs auf 60 GB — zuvor 40 GB, ohne Mehrkosten für neue Orbs. 🔗 Tweet
- DeepSeek V4 Flash 0731 mit Fine-Tuning auf Together AI verfügbar — Spezialisierung via SFT oder DPO, danach Produktionseinführung. 🔗 Tweet
- Together AI erläutert einen zweiten Teil zum Autoscaling seiner dedizierten Inferenz — drei Richtlinien unter derselben Last getestet, nur eine hat sich wirklich angepasst. 🔗 Tweet
- Hugging Face startet die Open Model Series — neue pädagogische Videoreihe über offene Modelle und deren lokale Nutzung. 🔗 Tweet
- FC Barcelona tritt der Partnerschaft Google Pixel / Gemini bei — neue offizielle Partner des Vereins, nach einer ähnlichen Partnerschaft mit dem FC Bayern München. 🔗 Tweet
- Copilot-Nutzungsbericht: Token-Details pro Modell — Eingabe-, Ausgabe- und Cache-Tokens sind nun hinter den verbrauchten KI-Credits sichtbar. 🔗 Changelog
- GitHub stellt den Copilot-Rubber-Duck-Agenten heraus — in einem Karriereartikel über Fähigkeiten von Junior-Entwicklern; der Agent nutzt ein zweites Modell, um generierten Code zu kritisieren. 🔗 Tweet
- Perplexity Computer: GitHub der meistgenutzte Connector — überwiegend von Nicht-Entwicklern (4 von 5). 🔗 Tweet
- Suno Studio 2.0 (Teaser) — neue Version der Musikproduktionsumgebung von Suno, ohne weitere Details. 🔗 Tweet
- ElevenLabs Summit in New York am 11. November — Konferenztag mit Tech- und Business-Führungskräften; Bewerbungen offen. 🔗 Tweet
- FLUX 3 Video bestätigt Platz #2 weltweit — Black Forest Labs verlängert den kostenlosen Zugang zum Playground bis zum 16. August und teasert 4K sowie Video-Editing. 🔗 Tweet
- Seedance 2.5 auf Runway fügt 50 Charakterreferenzen hinzu — und synchronisierte Clips auf einem Musik-Track. 🔗 Tweet
- P-Image-Ideogram auf Runway verfügbar — erzeugt ein Bild in nur 0,6 Sekunden, mit vier Qualitätsmodi. 🔗 Tweet
- Kimi K3 auf Databricks verfügbar — neuer Vertriebskanal für das Modell von Moonshot AI. 🔗 Tweet
- Zapier transformiert sein Marketing mit ChatGPT Work — weniger Abbrüche im Lead-Funnel, automatisiertes Reporting. 🔗 OpenAI
- Virgin Atlantic optimiert Kundenpfade mit ChatGPT Work — schnellere Recherche und Produktplanung. 🔗 OpenAI
- Cohere — Aidan Gomez erläutert die Open-Source- und Sovereign-Strategie — anpassbare, bezahlbare und sichere Modelle als roter Faden. 🔗 Tweet
Was das bedeutet
Die Nutzungsdimension von Consumer-KI wechselt die Liga: Mit einer Milliarde monatlicher Nutzer gehört Gemini nun zum sehr kleinen Kreis der massivsten Google-Produkte, getragen von Anwendungsfällen, die weit über Text-Chat hinausgehen (Sprache, Kamera, Automatisierung). Im Gegenzug erweitert OpenAI seine ChatGPT-Werbung auf fünf neue Märkte — ein Zeichen dafür, dass die Monetarisierung von Conversational Assistants in großem Maßstab zu einer strategischen Priorität wird, sobald die Nutzerbasis groß und loyal genug ist.
Auf Infrastrukturseite zeigt der Tag einen Wechsel hin zu spezialisierter agentischer Ausführung statt reinem Frontier-Reasoning. NVIDIA schlägt mit Nemotron 3.5 Lightning und NeMo Switchyard ein explizites Wirtschaftsmodell vor: teure Modelle für komplexe Planung reservieren und die ausführungsintensive Massenarbeit an leichtere und günstigere Modelle delegieren, mit messbaren Kostenvorteilen bei mehreren Partnern. IBM Research (ALTK-Evolve) und Together AI (Autoscaling, IBM-Cloud-Partnerschaft) vertiefen denselben ökonomischen Weg der Inferenz, während Mistral mit den European Compute Units und regionaler Inferenz den eigenen Souveränitätsansatz strukturiert.
Die Offenheit der Gewichte breitet sich weiter auf neue Akteure und neue Modalitäten aus: Wan-Animate-2 von Alibaba, TwiL-LM3 von webAI, das kommende Qwen3.8-27B, Metas Versprechen zu Muse Spark 1.2 und sogar ein erstes koreanisches Frontier-Modell (Motif 3), aufgebaut auf dem NVIDIA-Tech-Stack. Diese geografische und modale Diversifizierung — Text, Animation, eingebettetes Reasoning — bestätigt, dass Open Source längst nicht mehr das Vorrecht einiger weniger westlicher Labore ist.
Schließlich professionalisiert sich das agentische Entwickler-Tooling weiter: Amp und Replit fügen Verwaltungsschichten hinzu (globale Plugins, erweitertes MCP), GitHub schärft sein Angebot an kostengünstigen Modellen, und OpenAI baut explizite Brücken zwischen konkurrierenden Ökosystemen, indem Codex und ChatGPT Work Arbeit importieren können, die anderswo entstanden ist — ein Plädoyer für Portabilität statt Abschottung, in einer Zeit, in der Entwickler parallel mit mehreren KI-Agents jonglieren.
Quellen
- Gemini — eine Milliarde Nutzer
- Gemini — Ankündigung auf X
- NVIDIA — Nemotron 3.5 Lightning und NeMo Switchyard
- Alibaba Wan — Wan-Animate-2
- NVIDIA — Local-AI-Zahlen (Wan-Animate-2)
- Mistral — regionale Inferenz, GLM-5.2, Rechenkoalition
- OpenAI — ChatGPT-Werbung
- webAI — TwiL-LM3
- Meta — Muse Spark 1.2 (Alexandr Wang)
- Zuckerberg — Metas KI-Philosophie
- IBM Research — ALTK-Evolve
- Together AI, IBM, NVIDIA — IBM-Cloud-Inferenz
- Amp — globale Plugins und Skills
- Replit — MCP-Beta
- GitHub — MAI-Code-1.1-Flash
- Manus — unabhängiges Unternehmen
- Alibaba Wan — Wan CLI
- Motif Technologies — Motif 3
- Luma AI — Luma Scenes
- Ideogram — Ad Resizer
- HeyGen — for Real Estate
- NVIDIA — 800-VDC-Architektur
- Alibaba Qwen — Qwen3.8-27B
- Z.ai — ZCode 1 Million Nutzer
- OpenAI — ChatGPT-Desktop-App für Linux
- OpenAI — Agentenimport in Codex/ChatGPT Work
- Anthropic — Fable-Abrechnungsfehler behoben
- v0 — Überarbeitung der Seitenleiste
- Amp — Orbs mit 60 GB
- Together AI — DeepSeek V4 Flash 0731 Fine-Tuning
- Together AI — Autoscaling dedizierte Inferenz
- Hugging Face — Open Model Series
- FC Barcelona — Partnerschaft Google Pixel / Gemini
- GitHub — Copilot-Nutzungsbericht nach Modell
- GitHub — Rubber-Duck-Agent
- Perplexity Computer — GitHub-Connector
- Suno — Suno Studio 2.0
- ElevenLabs — Summit New York
- Black Forest Labs — FLUX 3 Video
- Runway — Seedance 2.5
- Runway — P-Image-Ideogram
- Kimi Moonshot — K3 auf Databricks
- OpenAI — Zapier
- OpenAI — Virgin Atlantic
- Cohere — Open-Source- und Sovereign-Strategie