Cerca

Gemini supera la soglia del miliardo di utenti attivi, NVIDIA lancia Nemotron 3.5 Lightning, Mistral federa una coalizione di calcolo europea

Articolo generato da intelligenza artificiale
Gemini supera la soglia del miliardo di utenti attivi, NVIDIA lancia Nemotron 3.5 Lightning, Mistral federa una coalizione di calcolo europea

ai-powered-markdown-translator

Articolo tradotto dal fr all’it con gpt-5.4-mini.

Vedi progetto su GitHub ↗

L’11 agosto 2026, l’applicazione Gemini supera il miliardo di utenti mensili, diventando il prodotto con la crescita più rapida nella storia di Google. NVIDIA pubblica Nemotron 3.5 Lightning e la sua libreria di routing NeMo Switchyard, Mistral apre la sua piattaforma a modelli di terze parti e federa una coalizione di calcolo europea, e Alibaba svela Wan-Animate-2, importante aggiornamento del suo modello open source di animazione. In programma anche: pubblicità ChatGPT estese a cinque nuovi mercati, nuovi strumenti per sviluppatori e una lunga serie di annunci sulla generazione media.


Gemini supera il miliardo di utenti mensili

L’applicazione Gemini ha ufficialmente superato il miliardo di utenti mensili attivi, diventando, secondo Google, il prodotto con la crescita più rapida dell’intera storia dell’azienda. L’annuncio è stato rilanciato sia dall’account ufficiale @GeminiApp sia da Josh Woodward, che guida i team Gemini e Labs in Google.

Google accompagna l’annuncio con un bilancio numerico sugli utilizzi che hanno trainato questa crescita:

Utilizzo misuratoDato
Interazioni vocaliIl 63 % degli utenti usa la voce
Sessioni Gemini Live1 su 5 usa la videocamera in diretta o la condivisione schermo
Richieste scolasticheIl 38 % include un allegato (file)
Generazione di immaginiOltre 150 milioni di immagini prodotte ogni giorno
Automazione AndroidAzioni automatizzate in oltre 40 applicazioni
Utenti iOSOltre 100 milioni di utenti attivi su dispositivi Apple

Questi dati illustrano una diversificazione degli utilizzi oltre la semplice chat testuale: voce, videocamera, condivisione schermo, generazione multimediale e automazione tra applicazioni (prenotazione di ristoranti, ordine di VTC) emergono come motori importanti dell’adozione.

🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.

🇮🇹 🚀 Un miliardo per Gemini! Il nostro obiettivo resta renderlo l’assistente più personale, proattivo e potente.@GeminiApp su X

🔗 Annuncio ufficiale sul blog Google


NVIDIA lancia Nemotron 3.5 Lightning e NeMo Switchyard per gli agenti ad alto volume

NVIDIA amplia la sua famiglia di modelli aperti Nemotron 3 con Nemotron 3.5 Lightning, un MoE ibrido da 30 miliardi di parametri (3 miliardi attivi) progettato per l’esecuzione di task agentici ad alto volume — chiamata di strumenti, validazione dei risultati, delega di compiti — piuttosto che per il ragionamento complesso. Disponibile in NVFP4 e BF16 con un contesto fino a 1 milione di token, il modello rivendica fino a 4 volte il throughput in uscita di modelli comparabili e un guadagno del 30 % nel tempo di completamento dei task. Su PinchBench, raggiunge l’86 % di precisione completando 10 000 task il 35 % più velocemente di Qwen3.6 35B a precisione equivalente.

Il modello è distribuito con pesi, dati di addestramento e ricette, disponibile su Hugging Face, ModelScope, OpenRouter e build.nvidia.com. Together AI è partner di lancio fin dal primo giorno (day-0), con capacità riservata tramite la sua offerta Dedicated Model Inference per carichi di lavoro agentici ad alto volume.

In parallelo, NVIDIA pubblica NeMo Switchyard, una libreria open source che indirizza ogni richiesta verso il modello più adatto (qualità, latenza, costo) senza riscrittura dell’applicazione — riservando i modelli frontier al ragionamento complesso e Lightning all’esecuzione specializzata. NVIDIA rivendica un costo di completamento dei task ridotto a circa un terzo di quello di Opus 4.8 da solo. Vengono citati partner concreti: Boomi indirizza il 59 % del suo traffico verso un modello fine-tuned più veloce, Cognition riduce il suo costo medio del 28 %, e Ramp combina modello e routing per un costo del 59 % e un tempo di esecuzione inferiore del 32 %.

🔗 Articolo ufficiale NVIDIA · Annuncio del modello su X


Alibaba svela Wan-Animate-2, importante aggiornamento della sua animazione di personaggi open source

Alibaba (team Wan) pubblica Wan-Animate-2, descritto come un importante aggiornamento del suo modello open source di animazione di personaggi. Vengono messe in evidenza quattro capacità: un’animazione ad alta fedeltà che riproduce movimenti e micro-espressioni attraverso esseri umani, cartoni animati, robot e animali; l’animazione multi-personaggio, in cui ogni personaggio conserva la propria identità e il proprio movimento in una stessa scena; un controllo della camera pilotato dal testo (per esempio «vista dall’alto»), disaccoppiato dal video sorgente; e una generazione in streaming in tempo reale, che produce sequenze di lunghezza arbitraria chunk per chunk senza accumulo di errore osservabile.

Sul piano tecnico, Alibaba abbandona gli scheletri di posa espliciti a favore del video di riferimento stesso come prior di movimento, con un’architettura Dual-Branch DiT (Diffusion Transformer), una codifica temporale Time-Align RoPE e un’attenzione sparsa (Sparse-Ref Attention) per limitare il calcolo senza perdita di qualità. Il controllo della camera si basa su una LoRA addestrata su circa 50 000 campioni multi-view Unreal Engine.

Il modello è open source, disponibile da subito su ModelScope, Hugging Face e GitHub, con demo online. Secondo la campagna «Local AI» di agosto di NVIDIA, i suoi 14 miliardi di parametri generano da 16 a 26 volte più velocemente sui sistemi RTX rispetto alle alternative — conferma della sua ottimizzazione per il deployment locale su hardware consumer.

🔗 Dettagli tecnici e cifre NVIDIA · Annuncio su X


Mistral lancia l’inferenza regionale, apre la sua piattaforma a GLM-5.2 e federa una coalizione di calcolo europea

Mistral si posiziona come l’unico laboratorio di IA europeo a combinare scelta regionale dell’inferenza e garanzie di servizio. L’azienda, già impegnata in una corsa tariffaria e tecnica contro OpenAI, Google e gli attori cinesi, punta qui su un posizionamento distinto: la sovranità e la prevedibilità del servizio, piuttosto che la sola corsa ai benchmark. Due novità lato piattaforma:

FunzionalitàStatoDescrizione
Mistral Regional EndpointsDisponibileScelta Europa o Stati Uniti per l’esecuzione dell’inferenza
Mistral Priority TierAnteprima pubblicaSLA di disponibilità e limiti di throughput personalizzati

Altro elemento notevole: la piattaforma Mistral si apre a modelli di terze parti, iniziando con GLM-5.2 di Z.ai, che beneficerà degli stessi controlli regionali e impegni di servizio dei modelli Mistral — una prima convergenza tra i due attori, finora concorrenti diretti nel segmento dei modelli aperti a basso costo.

Infine, Mistral lancia le European Compute Units (ECU), un meccanismo che converte gli impegni pluriennali delle aziende in accesso alla sua infrastruttura di calcolo, con l’obiettivo di 1 GW di capacità entro il 2030 — ossia l’equivalente della potenza consumata da una grande città. I partner fondatori annunciati sono ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman e CEO), Amadeus (Luis Maroto, CEO) e Caisse des Dépôts (Olivier Sichel, CEO) — un mix di industria, trasporti e finanza pubblica che illustra l’ambizione di costruire una filiera di calcolo europea indipendente dagli hyperscaler americani.

🔗 Annuncio ufficiale Mistral


OpenAI lancia le pubblicità ChatGPT nel Regno Unito, in Messico, in Brasile, in Giappone e in Corea del Sud

OpenAI compie un nuovo passo nel dispiegamento della pubblicità all’interno di ChatGPT. Lanciato in test negli Stati Uniti nel febbraio 2026 per le offerte Free e Go, poi esteso al Canada, all’Australia e alla Nuova Zelanda a marzo, il programma pubblicitario è ora ufficialmente lanciato in cinque nuovi mercati: Regno Unito, Messico, Brasile, Giappone e Corea del Sud. Le offerte Plus, Pro, Business, Enterprise ed Education restano senza pubblicità, e altri mercati sono previsti entro fine anno.

Il principio resta invariato: le pubblicità non influenzano mai le risposte di ChatGPT, restano chiaramente etichettate come sponsorizzate e visivamente separate dalla risposta organica. Il targeting si basa sull’argomento della conversazione in corso e sulla cronologia delle interazioni pubblicitarie passate, senza mai dare agli inserzionisti accesso alle conversazioni o ai dati personali — ricevono solo statistiche aggregate (visualizzazioni, clic).

Sul fronte del controllo utente, ChatGPT consente di nascondere una pubblicità, consultare il motivo per cui è stata mostrata, eliminare i propri dati pubblicitari in un solo gesto e gestire la personalizzazione in qualsiasi momento. Nessuna pubblicità viene mostrata agli account minorenni identificati o presunti, né in prossimità di argomenti sensibili (salute, salute mentale, politica). Secondo OpenAI, il pilota non ha mostrato alcun impatto misurato sulla fiducia degli utenti, il che ha motivato questa estensione graduale.

🔗 Annuncio ufficiale OpenAI


Ecosistema open source e inferenza

webAI Intelligence Lab pubblica TwiL-LM3, modello di ragionamento 3B che supera GPT-OSS-120B

Il laboratorio webAI Intelligence Lab (Austin) pubblica TwiL-LM3, il suo primo modello di ragionamento formale open source. Con soli 3 miliardi di parametri, rivendica di superare GPT-OSS-120B di OpenAI su 4 dei 5 benchmark di ragionamento formale testati — cioè circa 40 volte meno parametri per un’inferenza 2,6 volte più veloce. Addestrato su dati verificati e proprietari invece che su contenuti web raccolti automaticamente, il modello punta al calcolo in periferia (edge): viene annunciato come capace di girare da un Raspberry Pi a un iPhone, senza dipendere dal cloud.

🔗 Tweet ufficiale

Meta prepara una versione a pesi aperti di Muse Spark 1.2

Nel thread che annuncia Muse Glimmer, Alexandr Wang (Meta Superintelligence Labs) indica che Meta pubblicherà a breve una versione a pesi aperti di Muse Spark 1.2 — finora il modello proprietario che alimenta l’agente di codice nel terminale Muse Code. Non viene fornita alcuna data precisa, ma l’annuncio conferma una svolta di Meta verso una maggiore apertura dei pesi in tutta la sua gamma Muse, in continuità con l’apertura immediata dei pesi di Muse Glimmer sotto licenza Apache 2.0.

🔗 Tweet ufficiale

Zuckerberg pubblica un testo sulla filosofia IA di Meta

Lo stesso giorno, Mark Zuckerberg pubblica un testo affermando che «tutti dovrebbero avere accesso alla superintelligenza», illustrando la filosofia e i valori di Meta per costruire un futuro positivo dell’IA. Il messaggio accompagna il lancio di Muse Glimmer, posizionando l’apertura dei pesi come una scelta di fondo piuttosto che un semplice argomento di marketing, e si inserisce in una comunicazione più ampia di Meta sulla sua strategia di pesi aperti in quella settimana.

🔗 Tweet ufficiale

Lightricks presenta LTX-2.5, importante aggiornamento del suo world model aperto

Lightricks pubblica LTX-2.5, nuova versione del suo «world model» già utilizzato per il cinema, la robotica e i flussi di lavoro in tempo reale. L’aggiornamento promette una fedeltà pixel superiore, scene multi-piano che restano coerenti da un taglio all’altro e una base pre-addestrata pensata per essere affinata (fine-tuned) secondo diversi ambiti, tramite un nuovo rendering battezzato Diffusion Fidelity Rendering. Il team presenta LTX-2.5 come una fondazione aperta piuttosto che come uno strumento noleggiato.

🔗 Tweet ufficiale

IBM Research pubblica ALTK-Evolve, una memoria agentica meno dispendiosa in token di ACE

IBM Research pubblica ALTK-Evolve, un sistema che consente ad agenti IA di imparare dai propri fallimenti passati senza riaddestramento, calibrando la quantità di istruzioni reiniettate in base alla capacità del modello utilizzato — a differenza di ACE (Agentic Context Engineering), che consegna l’intero suo «playbook» a ogni fase. Sul benchmark AppWorld con DeepSeek-V3.2, ALTK-Evolve raggiunge l’89,3 % di task completati per 263K token per task, contro l’80,4 % e 634K token per ACE. Con gpt-oss-120b, ottiene una precisione uguale o migliore per circa il 40 % del costo di inferenza di ACE.

🔗 Billetto Hugging Face

Together AI, IBM e NVIDIA si associano per l’inferenza enterprise su IBM Cloud

Together AI annuncia una partnership con IBM e NVIDIA per portare inferenza IA di livello enterprise su IBM Cloud, tramite un cluster dedicato di GPU NVIDIA B300 con rete Spectrum-X — una prima del genere su questa piattaforma, alimentata dalla piattaforma di inferenza di produzione di Together AI. L’offerta si rivolge alle aziende già clienti di IBM Cloud che desiderano distribuire carichi di lavoro IA senza migrare verso un altro fornitore cloud.

🔗 Tweet ufficiale


Strumenti per sviluppatori: Amp, Replit, GitHub Copilot e Manus

Amp lancia i plugin e le skill globali per gli orb

Amp (Sourcegraph) introduce un sistema centralizzato di plugin e skill ospitati da Amp, disponibile ovunque Amp venga eseguito, in particolare negli orb. Coesistono due livelli: un livello personale, sandbox sperimentale con live reloading nella stessa conversazione, e un livello spazio di lavoro, gestito dagli amministratori e caricato per default per l’intero team. Gli elementi personali possono essere condivisi nello spazio di lavoro, e il versioning è gestito nativamente (aggiornamento all’ultima versione, rilevamento delle skill obsolete).

🔗 Plugin e Skill Globali

Replit MCP beta: creare, caricare, cercare e pubblicare un’app via MCP

Replit rafforza la sua beta MCP (Model Context Protocol) con nuove capacità: creare, caricare, cercare e pubblicare un’applicazione direttamente tramite MCP, senza passare dall’interfaccia web. L’obiettivo dichiarato è consentire di costruire software reale su Replit da qualsiasi client MCP compatibile — editor, agente autonomo o strumento di terze parti — invece di restare confinati all’interfaccia di Replit stessa. Questa estensione conferma la strategia di Replit di esporre la sua piattaforma come un mattone programmabile per i workflow agentici.

🔗 Tweet ufficiale

MAI-Code-1.1-Flash arriva su GitHub Copilot, MAI-Code-1-Flash deprecato

L’ultimo modello di codice compatto di Microsoft, MAI-Code-1.1-Flash, viene distribuito in GitHub Copilot con supporto visivo nativo e miglioramenti nella qualità del codice, nel follow-up delle istruzioni e nell’uso degli strumenti. Costa il 73% in meno rispetto a MAI-Code-1-Flash, con un moltiplicatore di richiesta premium di 0,25× per gli abbonati annuali. Selezionato automaticamente su Free e Studente, disponibile in selezione manuale su Pro, Pro+, Max, Business ed Enterprise. Nel frattempo, GitHub annuncia la deprecazione di MAI-Code-1-Flash il 10 settembre 2026.

🔗 Changelog GitHub

Manus tornerà a essere un’azienda indipendente

Manus annuncia di tornare a essere un’azienda indipendente. Per conformarsi ai requisiti normativi di alcune giurisdizioni, una parte degli utenti dovrà salvare i propri dati prima del 23 agosto 2026 (7:59, ora di Singapore), poi avviare un ripristino a partire dal 25 agosto 2026 (8:00, ora di Singapore). Gli utenti interessati saranno avvisati via e-mail e notifica in-app; durante la transizione non è prevista alcuna fatturazione, con bonus di benvenuto inclusi.

🔗 Tweet ufficiale


Generazione media: Wan CLI, Motif 3, Luma Scenes e alimentazione 800 VDC

Wan CLI: Alibaba consente di controllare Wan direttamente dagli agenti

Alibaba pubblica Wan CLI, un nuovo strumento a riga di comando che consente di chiamare la piattaforma Wan direttamente dagli agenti per generare immagini e video in modo programmatico. I crediti consumati restano completamente sincronizzati con l’account Wan Video dell’utente, evitando una doppia gestione della fatturazione tra interfaccia web e utilizzo automatizzato. L’installazione avviene recuperando un comando dal pannello Wan e poi incollandolo nel proprio agente, con un tutorial video fornito per iniziare.

🔗 Tweet ufficiale

Motif 3: primo modello di frontiera coreano addestrato su GPU NVIDIA B200

La startup coreana Motif Technologies lancia Motif 3 Base e Motif 3, i suoi primi modelli mirati alla corsa agli LLM di frontiera, sviluppati con il sostegno del ministero coreano della Scienza e addestrati su GPU NVIDIA B200. Motif 3 è costruito su Motif 3 Base tramite post-training usando NVIDIA NeMo-RL. In collaborazione con NVIDIA, il team pubblica anche una versione NVFP4 (precisione ridotta ottimizzata NVIDIA). Il tutto sarà disponibile su Hugging Face con report tecnico, e NVIDIA ha salutato questo lancio come un esempio della dinamica dell’ecosistema IA coreano.

🔗 Tweet ufficiale

Luma Scenes: produzione video per scene, alimentata da Uni-1

Luma AI lancia Luma Scenes, uno strumento che consente di rifinire, temporizzare e validare ogni scena individualmente prima del rendering finale — rispondendo al problema classico di produrre molte varianti per poi conservarne solo una utilizzabile, con il rischio che una scena fallita comprometta l’intera produzione. Lo strumento estende Luma Layers (editing a livelli, fine luglio), confermando l’orientamento di Luma verso il controllo granulare invece che la generazione con un clic, con un flusso di lavoro più vicino al montaggio tradizionale.

🔗 Tweet ufficiale

Ideogram Ad Resizer: un design, tutti i formati pubblicitari

Ideogram lancia Ad Resizer: a partire da un design unico e dagli spazi pubblicitari target, lo strumento genera automaticamente un set completo di formati pronti per la campagna (Instagram, Facebook, YouTube, televisione connessa, display, stampa), compresi rapporti estremi difficili da ritagliare manualmente. Disponibile subito nell’applicazione e tramite API, per l’integrazione in pipeline di produzione pubblicitaria automatizzate — un caso d’uso marketing concreto per i team creativi multicanale.

🔗 Tweet ufficiale

HeyGen for Real Estate: lancio ufficiale con tre formati video per agenti immobiliari

HeyGen lancia ufficialmente HeyGen for Real Estate, con tre formati video pensati per gli agenti immobiliari che compaiono loro stessi sullo schermo senza telecamera né montaggio — obiettivo: permettere loro di pubblicare più volte al giorno senza sacrificare la presenza visiva richiesta da questo settore. Offerta incentivante: gli iscritti al piano Creator entro 12 ore dall’annuncio ricevono l’accesso White Glove gratuito per 30 giorni (solo Stati Uniti). HeyGen accenna a una possibile estensione ad altre piccole imprese oltre al settore immobiliare.

🔗 Tweet ufficiale

NVIDIA dettaglia l’architettura di alimentazione 800 VDC delle future « AI factories »

NVIDIA, con Google e Microsoft, dettaglia tramite l’Open Compute Project un’architettura di alimentazione in corrente continua a 800 volt, che riduce le fasi di conversione elettrica tra la rete e le GPU per sostenere la densità di calcolo delle future generazioni di acceleratori. Più di 80 produttori stanno già lavorando su prodotti conformi. Distribuzione in più fasi: architettura ibrida « Power Rack » già dal secondo semestre 2026, « Row Power Center » nel 2027, poi installazioni native 800 VDC nel decennio a venire.

🔗 Billet ufficiale NVIDIA


Qwen, Z.ai e OpenAI: nuovi modelli e sincronizzazione degli agenti

Qwen3.8-27B: pesi aperti annunciati per questa settimana

Alibaba Qwen conferma che i pesi aperti di Qwen3.8-27B saranno pubblicati questa settimana, una nuova dimensione nella famiglia Qwen3.8 dopo il modello di punta Qwen3.8-Max già trattato all’inizio di agosto. Il team presenta questo nuovo modello come superiore a Qwen3.6-27B nel coding agentico, una performance già ben accolta dalla community di sviluppatori che attendeva questa dimensione intermedia da diverse settimane.

🔗 Tweet ufficiale

Z.ai: ZCode raggiunge 1 milione di utenti, reset dei limiti del GLM Coding Plan

Z.ai annuncia che ZCode, il suo strumento di coding basato sui modelli GLM, supera il milione di utenti. In segno di ringraziamento, l’azienda reimposta i limiti di utilizzo di tutti gli abbonati al GLM Coding Plan e distribuisce un aggiornamento pensato per trasformare meglio le capacità di ragionamento a lungo orizzonte in lavoro effettivamente completato, con un tasso di successo della cache del 98%, offrendo circa 1,8 volte più utilizzo per gli abbonati.

🔗 Tweet ufficiale

ChatGPT desktop app disponibile in anteprima su Linux, con Codex

OpenAI estende la sua applicazione desktop a Linux, finora riservata a macOS e Windows. L’anteprima copre quattro distribuzioni principali — Ubuntu 24.04/26.04 LTS, Debian 13 e Fedora 43/44 — con pacchetti .deb/.rpm in x64 e ARM64. L’app riunisce ChatGPT, ChatGPT Work e Codex in un’unica interfaccia nativa, con accesso ai progetti e ai flussi di lavoro del browser supportati, senza cambiare ambiente di lavoro.

🔗 Tweet ufficiale

Codex e ChatGPT Work importano il lavoro di altri agenti IA

Nuova funzionalità per ChatGPT Work e Codex: mantenere sincronizzato con l’ecosistema OpenAI il lavoro esistente, realizzato con altri agenti IA. In concreto, gli utenti possono importare progetti, conversazioni, skill e plugin, consultare una cronologia delle importazioni e attivare la sincronizzazione automatica nelle impostazioni. Disponibile da subito nell’app desktop ChatGPT, per ridurre l’attrito nel cambio strumento invece di ricominciare da zero con una configurazione completamente nuova.

🔗 Tweet ufficiale


Brevi

  • Bug di fatturazione Fable risolto, 196 rimborsi — Anthropic conferma la risoluzione completa di un bug della cache di configurazione che mostrava erroneamente superamenti; 196 utenti rimborsati e accreditati come compensazione. 🔗 Tweet
  • v0 (Vercel) ridisegna la sua barra laterale — conversazioni raggruppate per progetto, indicatori di stato in tempo reale, schede di anteprima al passaggio del mouse. 🔗 Tweet
  • Amp aumenta la dimensione disco degli orbs a 60 GB — contro i 40 GB precedenti, senza sovrapprezzo per i nuovi orbs. 🔗 Tweet
  • DeepSeek V4 Flash 0731 disponibile al fine-tuning su Together AI — specializzazione tramite SFT o DPO e poi distribuzione in produzione. 🔗 Tweet
  • Together AI dettaglia un secondo capitolo sull’autoscaling della sua inferenza dedicata — tre politiche testate sotto lo stesso carico, una sola si è davvero adattata. 🔗 Tweet
  • Hugging Face lancia l’Open Model Series — nuova serie video didattica sui modelli aperti e il loro uso locale. 🔗 Tweet
  • FC Barcelona si unisce alla partnership Google Pixel / Gemini — nuovi partner ufficiali del club, dopo una partnership simile con il Bayern Monaco. 🔗 Tweet
  • Rapporto d’uso Copilot: dettaglio dei token per modello — token di input, output e cache ora visibili dietro i crediti IA consumati. 🔗 Changelog
  • GitHub mette in evidenza l’agente Rubber Duck di Copilot — in un articolo di carriera sulle competenze degli sviluppatori junior; l’agente usa un secondo modello per criticare il codice generato. 🔗 Tweet
  • Perplexity Computer: GitHub, connettore più usato — perlopiù da non sviluppatori (4 su 5). 🔗 Tweet
  • Suno Studio 2.0 (teaser) — nuova versione dell’ambiente di produzione musicale di Suno, senza dettagli aggiuntivi. 🔗 Tweet
  • ElevenLabs Summit a New York l’11 novembre — giornata di conferenze che riunisce leader tech e business; candidature aperte. 🔗 Tweet
  • FLUX 3 Video conferma il rango #2 mondiale — Black Forest Labs prolunga l’accesso gratuito al playground fino al 16 agosto e anticipa 4K ed editing video. 🔗 Tweet
  • Seedance 2.5 su Runway aggiunge 50 riferimenti di personaggi — e clip sincronizzate su una traccia musicale. 🔗 Tweet
  • P-Image-Ideogram disponibile su Runway — genera un’immagine in appena 0,6 secondi, con quattro modalità di qualità. 🔗 Tweet
  • Kimi K3 disponibile su Databricks — nuovo canale di distribuzione per il modello di Moonshot AI. 🔗 Tweet
  • Zapier trasforma il suo marketing con ChatGPT Work — riduzione degli abbandoni nel funnel dei lead, reporting automatizzato. 🔗 OpenAI
  • Virgin Atlantic ottimizza i suoi percorsi clienti con ChatGPT Work — ricerca e pianificazione di prodotto accelerate. 🔗 OpenAI
  • Cohere — Aidan Gomez dettaglia la strategia open source e sovrana — modelli personalizzabili, accessibili e sicuri come filo conduttore. 🔗 Tweet

Cosa significa

La scala di utilizzo dell’IA consumer cambia marcia: con un miliardo di utenti mensili, Gemini entra nel circolo molto ristretto dei prodotti Google più massicci, trainato da usi che vanno ben oltre la chat testuale (voce, camera, automazione). In parallelo, OpenAI estende le pubblicità di ChatGPT a cinque nuovi mercati — un segnale che la monetizzazione su larga scala degli assistenti conversazionali sta diventando una priorità strategica una volta che la base utenti è sufficientemente ampia e fedele.

Sul fronte infrastrutturale, la giornata illustra una svolta verso l’esecuzione agentica specializzata invece del solo ragionamento di frontiera. NVIDIA propone con Nemotron 3.5 Lightning e NeMo Switchyard un modello economico esplicito: riservare i modelli costosi alla pianificazione complessa e delegare l’esecuzione ad alto volume a modelli più leggeri ed economici, con risparmi misurati presso diversi partner. IBM Research (ALTK-Evolve) e Together AI (autoscaling, partnership IBM Cloud) approfondiscono lo stesso filone economico dell’inferenza, mentre Mistral struttura il proprio sforzo di sovranità con le European Compute Units e l’inferenza regionale.

L’apertura dei pesi continua a estendersi a nuovi attori e a nuove modalità: Wan-Animate-2 di Alibaba, TwiL-LM3 di webAI, Qwen3.8-27B in arrivo, la promessa di Meta su Muse Spark 1.2 e persino un primo modello di frontiera coreano (Motif 3) costruito sulla stack tecnica NVIDIA. Questa diversificazione geografica e modale — testo, animazione, ragionamento integrato — conferma che l’open source non è più appannaggio di pochi laboratori occidentali.

Infine, gli strumenti agentici per sviluppatori continuano a professionalizzarsi: Amp e Replit aggiungono livelli di gestione (plugin globali, MCP esteso), GitHub rafforza la propria offerta di modelli a basso costo e OpenAI costruisce ponti espliciti tra ecosistemi concorrenti consentendo a Codex e ChatGPT Work di importare il lavoro svolto altrove — una scommessa sulla portabilità più che sulla chiusura, in un momento in cui gli sviluppatori destreggiano più agenti IA in parallelo.


Fonti