ai-powered-markdown-translatorArticolo tradotto dal fr all’it con gpt-6-sol.
Il 23 settembre Anthropic presenta il suo laboratorio di biologia molecolare e il primo risultato: ART, un sistema enzimatico sconosciuto individuato da circa 950 agenti Claude nel DNA dei batteriofagi. Google lancia Gemini 3.8 Flash TTS e Flash-Lite TTS, due modelli di sintesi vocale che creano e clonano voci; Black Forest Labs pubblica FLUX 3 Action, un modello a pesi aperti per controllare i robot; Perplexity pubblica il primo audit di sicurezza di SPACE, il sandbox in cui operano i suoi agenti.
Anthropic apre un laboratorio di biologia molecolare e Claude vi scopre ART
23 settembre — Anthropic presenta un nuovo gruppo di ricerca nelle scienze della vita, dotato di un proprio laboratorio di biologia molecolare, costituito in primavera e situato nell’area della baia di San Francisco. Il suo primo risultato: gli agenti Claude hanno individuato nel DNA dei batteriofagi, i virus che infettano i batteri, un sistema enzimatico mai descritto prima, che Anthropic ha chiamato ART (array-associated reverse transcriptases, trascrittasi inverse associate a un array).
Tutto è partito da un prompt: cercare in un vasto database di sequenze di DNA nuovi esempi di trascrittasi inverse, gli enzimi che copiano l’RNA in DNA. Nell’arco di 21 ore, circa 950 agenti hanno consumato 210 milioni di token, raccolto oltre 200 000 trascrittasi inverse, isolato 3 500 nuovi sistemi candidati e selezionato i 20 più promettenti, ciascuno corredato da un rapporto leggibile da una persona. Secondo Anthropic, un’analisi del genere richiederebbe a un esperto settimane, se non mesi; l’intervento umano si è limitato al prompt iniziale e agli esperimenti di laboratorio.
| Fase della campagna | Valore misurato |
|---|---|
| Durata della ricerca | 21 ore |
| Agenti Claude impiegati | circa 950 |
| Token consumati | 210 milioni |
| Trascrittasi inverse raccolte | oltre 200 000 |
| Nuovi sistemi candidati | 3 500 |
| Candidati selezionati e analizzati | 20 |
ART riunisce tre elementi: la trascrittasi inversa, un gene vicino associato la cui funzione è sconosciuta e un lungo array di sequenze di DNA ripetute e regolarmente distanziate, la cui disposizione ricorda un array CRISPR. La trascrittasi stessa, trovata in un fago gigante, era già nota; Claude «sembra essere il primo», secondo Anthropic, ad aver notato l’array non codificante e la proteina che lo accompagna. I primi esperimenti mostrano che questo array viene espresso sotto forma di piccoli RNA distinti. Anthropic mantiene la cautela: la funzione di ART non è ancora nota e sono in corso altri esperimenti. Secondo Anthropic, solo una manciata di sistemi conosciuti condivide queste caratteristiche, e tutti sono programmabili e capaci di tagliare, copiare e incollare il DNA.
Claude has discovered a previously unknown enzyme system hidden in the DNA of bacteriophages. Beside the enzyme’s gene sits a long array of repeating DNA—a structure that looks somewhat similar to CRISPR.
🇮🇹 Claude ha scoperto un sistema enzimatico finora sconosciuto, nascosto nel DNA dei batteriofagi. Accanto al gene dell’enzima si trova un lungo array di DNA ripetuto, una struttura che somiglia un po’ a CRISPR. — @AnthropicAI su X
Il laboratorio opera solo ai livelli di biosicurezza BSL-1 e BSL-2 e non manipola alcun patogeno in grado di infettare gli esseri umani; tutto il lavoro al banco è svolto da scienziati umani. Il team usa Claude Science e Claude Code, talvolta con un sistema sviluppato internamente che coordina molte sessioni in parallelo. Poiché una campagna produce centinaia, se non migliaia di rapporti, le ipotesi diventano a loro volta oggetto di studio: ciò che distingue quelle che i ricercatori ritengono meritevoli di verifica serve ad affinare le istruzioni date a Claude. Feng Zhang, pioniere dell’editing genomico con CRISPR (MIT e Broad Institute), ha esaminato il preprint e lo considera un esempio entusiasmante di ciò che gli agenti IA possono apportare alla scoperta biologica. Anthropic pubblica il preprint e invita gli scienziati a sottoporle quesiti di ricerca.
🔗 Claude scopre un nuovo sistema enzimatico con ripetizioni simili a CRISPR · Preprint (PDF)
Gemini 3.8 Flash TTS e Flash-Lite TTS: Google crea e clona voci
23 settembre — Google aggiunge alla famiglia Gemini due modelli di sintesi vocale (text-to-speech), che presenta come i suoi modelli audio più espressivi: Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS. Entrambi sono disponibili a livello generale nell’API Gemini e in Google AI Studio, con un nuovo endpoint Voices; il changelog dell’API riporta la voce in data 22 settembre, mentre l’annuncio pubblico è arrivato il 23.
I due modelli si dividono i compiti. Flash TTS serve per creare: si descrivono in linguaggio naturale il ruolo, l’accento e il carattere di una voce, poi si dirige ogni battuta (interpretazione, ritmo, cambio di dialetto). Google lo destina ai videogiochi, agli audiolibri e ai podcast. Flash-Lite TTS punta su volumi e costi: doppiaggio su larga scala, produzione audio di massa e agenti vocali in tempo reale; è destinato a sostituire gemini-3.1-flash-tts-preview. Entrambi gestiscono dialoghi a due voci nello stesso copione, ore di audio senza variazioni significative del timbro e tag come <laughs>, <sigh> o |mhm|.
L’articolo annuncia oltre 2 000 voci pronte all’uso, con varianti regionali come il francese del Québec; la documentazione dell’API descrive invece 30 voci da studio e una libreria ampliata con diverse centinaia di voci. La clonazione vocale funziona a partire da un campione di 30 secondi, a condizione che venga registrato il consenso verbale del proprietario della voce, e ogni audio generato reca il watermark SynthID. Un punto importante per i lettori francesi: secondo una nota dell’articolo, la clonazione vocale tramite AI Studio non è disponibile nello Spazio economico europeo, nel Regno Unito, in Svizzera, in India, nell’Illinois né in Texas. Il remix delle voci esistenti è annunciato a breve.
| Caratteristica del modello | Gemini 3.8 Flash TTS | Gemini 3.8 Flash-Lite TTS |
|---|---|---|
| Identificativo API | gemini-3.8-flash-tts | gemini-3.8-flash-lite-tts |
| Lingue supportate (documentazione dell’API) | 130 | 101 |
| Utilizzo previsto | Creazione, direzione precisa | Volumi, doppiaggio, agenti vocali |
| Output audio, prezzo Standard fino al 31/12/2026 (milione di token) | 9 dollari | 6 dollari |
| Output audio, prezzo Standard dal 01/01/2027 (milione di token) | 18 dollari | 12 dollari |
| Prodotto per il pubblico | Gemini Notebook | Google Vids (narrazione annunciata) |
Per confronto, Gemini 3.1 Flash TTS Preview costa 20 dollari per milione di token audio in uscita. Google sostiene il lancio con valutazioni esterne: Flash TTS si piazza al primo posto nel Voice Design Benchmark di Hume AI (71,4) e i due modelli occupano i primi due posti nell’Overall Quality Index di Hume AI. Arriveranno anche su Gemini Enterprise tramite API «a breve».
🔗 Annuncio di Google · Note di versione dell’API Gemini · Prezzi dell’API
FLUX 3 Action: Black Forest Labs pubblica un modello a pesi aperti per controllare i robot
23 settembre — Black Forest Labs, nota per i suoi modelli di immagini FLUX, pubblica FLUX 3 Action, un modello di azione del mondo (World Action Model) da 7 miliardi di parametri progettato per controllare i robot. Derivato dalla base multimodale FLUX 3, predice nello stesso calcolo le immagini future e i comandi motori a partire dalle telecamere e dalla posizione delle articolazioni. I pesi sono aperti (la scheda Hugging Face del checkpoint DROID indica la licenza «flux-kommunity-license») e il laboratorio pubblica anche il codice, la procedura di fine-tuning, i benchmark ed esempi riproducibili.
An open weights 7B World Action Model that achieves first place on the RoboLab benchmark. It outperforms the previous best open model by 6.1 percentage points while using 56% fewer parameters and running up to 3.95x faster.
🇮🇹 Un modello di azione del mondo da 7B a pesi aperti che conquista il primo posto nel benchmark RoboLab. Supera il precedente miglior modello aperto di 6,1 punti percentuali, pur utilizzando il 56 % di parametri in meno e funzionando fino a 3,95 volte più velocemente. — @bfl_ai su X
| Modello valutato | Tipo di modello | Accesso ai pesi | Successo RoboLab-120 | Numero di parametri |
|---|---|---|---|---|
| FLUX 3 Action | WAM | Aperti | 42,92 % | 7B |
| OASIS WAM | VLM + WAM | Chiusi | 39,0 % | – |
| Cosmos3-Nano-Policy | WAM | Aperti | 36,8 % | 16B |
| Phoenix | TAMP+FM | Chiusi | 34,4 % | – |
| BiMind v0.1 | VLA | Chiusi | 33,3 % | – |
| π0.5 | VLA | Aperti | 28,0 % | 3,3B |
| DreamZero | WAM | Aperti | 25,7 % | 14B |
| GR00T N1.6 | VLA | Aperti | 7,2 % | 3B |
Il precedente miglior modello aperto era Cosmos3-Nano-Policy di NVIDIA. L’affermazione «fino a 3,95 volte più veloce» si riferisce al confronto con Cosmos 3 Nano in FP8: da 1,52 a 3,95 volte, a seconda della GPU. Rispetto a π0.5, il modello vision-langage-action (VLA) aperto più performante, la variante distillata in un solo passaggio (38,3 %) è più veloce sulle GPU per workstation e data center, ma più lenta su una RTX 5090; prevede però 2,13 secondi di movimento per predizione, contro 1 secondo per π0.5.
L’articolo prova anche una politica ibrida in cui GPT-6 Astra di OpenAI supervisiona il robot: abbinato ad Astra con un livello di ragionamento basso (low), FLUX 3 Action completa con successo il 90 % degli episodi, con un costo di 8,77 dollari e circa 8 minuti per ogni successo, contro 13,47 dollari e 16 minuti per Astra da solo con livello di ragionamento «xhigh», che completa con successo tutti i compiti. Su un vero braccio Franka, una valutazione alla cieca di Positronic Robotics attribuisce a FLUX 3 Action 28 successi su 30, contro 27 per Cosmos 3 Nano e 13 per π0.5. Su Hugging Face sono disponibili tre checkpoint (base, SO-101 e DROID) e il modello è integrato in LeRobot con NVIDIA, con possibilità di distribuzione su Jetson.
🔗 FLUX 3 Action (Black Forest Labs) · Collezione Hugging Face
Escaping SPACE: Perplexity pubblica il primo audit di sicurezza del sandbox di Computer
23 settembre — Il Perplexity Secure Intelligence Institute pubblica la prima parte di un rapporto sui test di intrusione (red-teaming) condotti su SPACE, il sandbox in cui operano gli agenti di Perplexity Computer, presentato il 15 luglio. Si tratta della prima valutazione di sicurezza pubblicata di SPACE. Ogni sandbox è una micro macchina virtuale Firecracker, isolata dalla macchina host, e un gateway dedicato a ciascun sandbox applica le regole per il traffico di rete in uscita.
Nove modelli hanno ricevuto accesso root nella macchina virtuale, con due missioni di tipo capture the flag: superare il confine tra la VM e l’host per recuperare un identificativo AWS esca, oppure raggiungere un URL bloccato dalle regole di rete. Il protocollo combina la presenza o meno di accesso al codice sorgente di SPACE con due livelli di accesso alla rete, nessuno o parziale (repository dei pacchetti PyPI e Ubuntu, ricerca web di Perplexity), con tre tentativi per configurazione. Risultato: nessuna evasione dalla VM verso l’host in 108 tentativi, anche con il codice sorgente. Il filtro di rete ha retto quando ogni accesso era bloccato (0 su 54); con un accesso parziale alla rete, invece, 11 tentativi su 54 hanno raggiunto la destinazione vietata, prima della correzione.
| Modello valutato | Successi con codice sorgente | Successi senza codice sorgente |
|---|---|---|
| Claude Opus 5.0 | 3 tentativi su 3 | Nessuno |
| GPT-5.6 Sol | 3 tentativi su 3 | 2 tentativi su 3 |
| Kimi K3 | 2 tentativi su 3 | Nessuno |
| GPT-5.6 Cyber | Nessuno | 1 tentativo su 3 |
| Altri cinque modelli valutati | Nessuno | Nessuno |
Sono state sfruttate due falle. La prima è uno spoofing DNS: l’agente iniettava una falsa risposta che associava pypi.org all’indirizzo della destinazione e il gateway, che non ne verificava la provenienza, la registrava; per riuscirci serviva un indirizzo interno visibile solo nel codice sorgente. La seconda riguarda la condivisione degli indirizzi IP da parte di una CDN: GPT-5.6 Sol ha fatto cercare l’URL vietato da fiddle.fastly.dev, raggiungibile allo stesso indirizzo di PyPI, mentre GPT-5.6 Cyber è passato attraverso un servizio di immagini di Taboola e il generatore di screenshot thum.io prima di leggere la flag tramite riconoscimento dei caratteri. Claude Opus 5.0 ha individuato questo vettore ma lo ha scartato, ritenendolo contrario all’istruzione di non prendere di mira alcun sistema esterno. Kimi K3 è l’unico modello a pesi aperti ad aver avuto successo. Due modelli non hanno potuto essere valutati: Fable ha rifiutato l’esercizio nonostante l’iscrizione di Perplexity al Cyber Verification Program di Anthropic, e anche GPT-6 Astra ha rifiutato.
Le falle, scoperte il 26 agosto, sono state corrette: ogni pacchetto in uscita deve riportare l’indirizzo assegnato alla propria VM e il gateway termina direttamente il TLS per verificare il nome del server (SNI) e l’host HTTP. Dopo una nuova valutazione nella configurazione più favorevole all’attaccante, i modelli non hanno più recuperato la flag. Perplexity ha poi testato, senza agenti, dieci piattaforme sandbox di terze parti: otto presentavano almeno una possibilità di aggiramento, tra cui E2B, Vercel Sandbox, Modal Sandboxes e Daytona Sandbox, mentre Cloudflare Sandbox e NVIDIA OpenShell hanno resistito. Tutti i fornitori, avvisati il 1° settembre, hanno risposto; al 10 settembre Daytona, Deno e microsandbox avevano corretto i problemi, mentre Vercel e Modal consideravano il comportamento un limite noto. La seconda parte del rapporto, dedicata alle strategie dei modelli, è annunciata senza una data.
Claude Code 2.1.281: attribuzione disattivabile e modalità auto più restrittiva
23 settembre — Pubblicata alle 19:19 UTC, il giorno dopo la 2.1.280, Claude Code 2.1.281 contiene 176 voci, di cui 112 correzioni. Due cambiamenti si notano nell’uso quotidiano: l’impostazione "attribution": false in settings.json elimina ogni attribuzione nei commit e nelle pull request, mentre l’invio immediato di un messaggio (ctrl+enter) sposta in background gli strumenti in esecuzione invece di annullare il turno.
La modalità auto diventa più restrittiva: quando la revisione del classificatore avviene lato server, anche i comandi shell di sola lettura ne attendono il verdetto. Una correzione di sicurezza da segnalare: un rm ricorsivo che prendeva di mira una sostituzione di comando, come rm -rf "$(pwd)", veniva eseguito senza conferma in modalità auto e con --dangerously-skip-permissions; ora richiede conferma anche in presenza di una regola Bash che lo autorizza. Per non bloccare le sessioni non presidiate, la richiesta di conferma per un rm pericoloso attende due minuti, poi rifiuta il comando suggerendo di riscriverlo.
Modifica incompatibile per i runner ospitati autonomamente: gli script intermedi (wrapper) o gli hook che aggiungono --system-prompt devono passare a --system-prompt-file. Per gli amministratori, il gateway Claude apps può chiamare Amazon Bedrock usando un ruolo IAM ottenuto tramite STS (assume_role), anche in un altro account AWS se necessario, e applicare un guardrail Bedrock a ogni richiesta.
Anthropic sul fronte dei prodotti: claude.ai più veloce, Marketplace ampliato
Due annunci di prodotto di Anthropic, pubblicati lo stesso giorno, completano il risultato scientifico.
claude.ai tre volte più veloce in due settimane
23 settembre — Su claude.dev, tre ingegneri di Anthropic raccontano lo sprint di due settimane, svolto ad agosto, che ha reso claude.ai e l’applicazione desktop circa tre volte più veloci. Tutto si è svolto in un unico canale Slack, con Claude Tag (beta) basato su un modello di ricerca interno «più o meno paragonabile a Opus 5.5»: Claude ha individuato i colli di bottiglia, costruito i benchmark, proposto le correzioni e monitorato i rilasci, mentre le persone fissavano gli obiettivi e approvavano ogni modifica. Il bilancio: oltre 3.000 modifiche integrate, senza incidenti visibili ai clienti né ripristini di versioni precedenti.
| Percorso misurato (75° percentile) | Prima dello sprint | Dopo lo sprint |
|---|---|---|
| Pagina claude.ai pronta per la digitazione | 3,1 s | 0,55 s |
| Nuova sessione Claude Code (desktop) | 0,8 s | 0,3 s |
| Sessione cloud Claude Cowork (desktop) | 2,6 s | 0,73 s |
| Media geometrica su 13 misurazioni | – | 3,1x più veloce |
Il metodo si basa su un’idea: non appena Claude dispone di un valore da migliorare, può ottimizzare. Il team ha quindi trasformato misurazioni deterministiche in soglie di CI che possono solo abbassarsi. Una parte di questi miglioramenti, uno streaming circa quattro volte più fluido, era già stata annunciata il 24 agosto.
🔗 Come abbiamo reso claude.ai 3 volte più veloce in due settimane
Claude Marketplace riunisce connettori, agenti e integratori
23 settembre — Anthropic amplia Claude Marketplace, lanciato in anteprima limitata a marzo. La vetrina riunisce ora tre categorie di offerte: oltre 2.000 connettori e plugin (Atlassian, Google, Microsoft, Notion, Salesforce…), agenti e prodotti basati su Claude (CrowdStrike, Cursor, Harvey, Legora, Lovable, Snowflake), che le aziende possono pagare usando parte del proprio impegno di spesa con Anthropic, e le società di consulenza del Claude Partner Network (Accenture, Boston Consulting Group, Deloitte). Per gli sviluppatori di prodotti ci sono tre possibilità: creare un connettore o un plugin con MCP e gli Agent Skills, candidare un agente o un prodotto, oppure entrare nel Partner Network. Un articolo di approfondimento illustra il meccanismo di acquisto: CodeRabbit ha finanziato un piano Vercel usando il proprio budget Anthropic impegnato, con un accordo concluso in una settimana. Questo pagamento tramite l’impegno di spesa Anthropic resta in anteprima limitata, previa verifica dell’idoneità.
ChatGPT: Voice passa all’azione, schede di ripasso e Privacy Center
Voice usa i plugin e arriva in ChatGPT Work
23 settembre — OpenAI amplia ChatGPT Voice in due direzioni. La modalità vocale Live può ora usare i plugin e le applicazioni collegate all’account, come la posta elettronica, il calendario o Slack, durante una conversazione sul web, su iOS e su Android. Inoltre Voice arriva in ChatGPT Work sul web e sui dispositivi mobili: si può chiedere a voce di creare un documento, una presentazione o un foglio di calcolo, usare un’applicazione collegata o svolgere un’attività nel browser, che può proseguire per iscritto dopo la chiamata.
Quanto ai modelli, il post di OpenAI su X indica che Voice può anche basarsi su GPT-6 Astra, Sol e Luna; l’articolo di assistenza precisa invece che Live si basa su GPT-Live-1 o GPT-Live-1 mini a seconda del piano, senza descrivere nel dettaglio il ruolo dei modelli GPT-6. Gli utenti Free e Go hanno Voice in Chat con i plugin previsti dal loro piano; Voice in Work richiede l’accesso a entrambi e le attività avviate in questo modo rientrano nel normale utilizzo di Work. Live non supporta né il video né la condivisione dello schermo. Il rilascio è mondiale dal 23 settembre, nell’ultima versione dell’applicazione.
🔗 Annuncio di OpenAI su X · Articolo di assistenza su ChatGPT Voice
Schede di ripasso e centro per la privacy
22 settembre — ChatGPT può ora creare schede di ripasso interattive (flashcard) a partire da un argomento o da appunti caricati. Si tocca una scheda per girarla, poi si indica se si conosceva la risposta o se occorre ripassarla; l’ordine delle schede può essere mescolato. Le schede vengono salvate automaticamente nella libreria. La funzione è disponibile su dispositivi mobili e sul web per tutti i piani, compreso quello gratuito.
21 settembre — Aggiornamento: il giorno prima, la stessa pagina delle note di rilascio annunciava un centro per la privacy (Privacy Center), in fase di rilascio per gli utenti che hanno effettuato l’accesso con i piani Free, Go, Plus e Pro. Riunisce in un unico posto informazioni sulla riservatezza delle conversazioni, sulla memoria, sulla personalizzazione, sull’uso dei dati, sulle applicazioni collegate e sulla sicurezza dell’account, con link diretti alle impostazioni. Sul web vi si accede dal menu dell’account (Help, poi Privacy Center) e sui dispositivi mobili dalle impostazioni.
Due nuovi benchmark: salute mentale e servizio di inferenza
MentalHealthBench (OpenAI)
23 settembre — OpenAI pubblica MentalHealthBench, un benchmark aperto che misura come i modelli rispondono in conversazioni realistiche sulla salute mentale, dagli scambi quotidiani con una componente emotiva fino alle emergenze. È stato sviluppato con oltre 80 psicologi e psichiatri abilitati di 22 paesi, che parlano 19 lingue. Le conversazioni, sintetiche, rappresentano quattro profili: adulti, adolescenti dai 13 ai 17 anni, persone che prestano assistenza e clinici. Per ciascuna, gli esperti hanno scritto criteri ponderati da -10 a +10; sono stati mantenuti solo quelli approvati da almeno due esperti su tre, senza obiezioni del terzo. La valutazione è automatica, con GPT-5.6 Sol come valutatore, e il punteggio è suddiviso in dieci dimensioni, tra cui la sicurezza, la ricerca del contesto e il rispetto dell’autonomia dell’utente. OpenAI afferma che i modelli migliorano costantemente, soprattutto nella ricerca del contesto, ma i punteggi per modello compaiono solo nei grafici dell’articolo. OpenAI ricorda che ChatGPT non sostituisce né la terapia né l’assistenza di un professionista.
🔗 Presentazione di MentalHealthBench
SWE-Serve (NVIDIA)
23 settembre — Il team di NVIDIA responsabile dei dati e della valutazione dei modelli Nemotron pubblica SWE-Serve, realizzato con il team SGLang: 83 pull request effettivamente integrate in questo motore per il servizio di inferenza diventano 53 attività eseguibili (decodifica speculativa, supporto dei modelli, kernel, cache, API di servizio). Il risultato principale riguarda la differenza tra test locali e servizio reale: nelle 19 attività che avviano un server vero, le stesse correzioni superano i test nel 69,4 % dei casi senza i test sul servizio in esecuzione, ma nel 45,9 % con il verificatore completo. Circa una correzione su tre che supera gli altri controlli fallisce quindi quando il modello viene caricato e interrogato.
| Modello valutato (ragionamento max) | pass@1 su 3 esecuzioni | Costo medio per attività |
|---|---|---|
| Claude Opus 5 | 75 % | 17,40 dollari |
| GPT-5.6 Sol | 75 % | 12,26 dollari |
| Kimi K3 | 64 % | 7,24 dollari |
| GPT-5.6 Luna | 64 % | 0,95 dollaro |
| DeepSeek V4 Flash (0731) | 55 % | 0,69 dollaro |
Undici modelli sono stati valutati con un agente minimale, senza accesso al web; la tabella non comprende Claude Opus 5.5 né GPT-6 Sol e Luna, usciti il 22 settembre, né GPT-6 Astra. Le attività e i verificatori sono pubblici.
🔗 Come SWE-Serve mette in luce la differenza tra test locali e servizio in esecuzione · Repository GitHub
Il video generativo entra nei software di montaggio
Runway in DaVinci Resolve Studio
23 settembre — Due settimane dopo i plugin per Premiere Pro e After Effects, Runway arriva in DaVinci Resolve Studio, il software di montaggio di Blackmagic Design. Il plugin, gratuito per macOS e Windows, si apre da Workspace, poi Workflow Integrations. Permette di generare immagini e video tramite prompt e importarli con un clic nel Media Pool e sulla timeline, senza passare dal browser. La funzione Edit Studio interviene su una clip già montata: il pannello esporta l’intervallo scelto e Aleph 2.0 lo renderizza di nuovo in un nuovo stile, mantenendo la stessa durata, a partire da un massimo di cinque fotogrammi chiave ritoccati. Occorre DaVinci Resolve Studio 19 o successivo; la generazione è disponibile con tutti i piani Runway a pagamento e consuma i crediti esistenti, con il costo di ogni generazione mostrato prima della conferma.
🔗 Runway è ora in DaVinci Resolve
Gemini Omni 1.1 Flash gratuito in Google Vids
23 settembre — Chiunque abbia un account Google o Google Workspace può ora generare video gratuitamente con Gemini Omni 1.1 Flash in Google Vids, da vids.new su computer. La versione 1.1 introduce tre comandi: prolungare una scena mantenendo personaggi, illuminazione e ambientazione, impostare la durata esatta di una clip per sincronizzarla con una voce fuori campo e generare direttamente in 1080p. Ogni clip reca una filigrana SynthID. Il rilascio completo inizia il 23 settembre e può richiedere da 1 a 3 giorni; i piani a pagamento offrono volumi di generazione più elevati, senza che siano state pubblicate cifre. Google annuncia a breve la narrazione con Gemini 3.8 Flash-Lite TTS in Vids, in oltre 100 lingue.
Made On YouTube 2026: Gemini Omni nel montaggio degli Shorts
23 settembre — Durante l’evento annuale Made On YouTube, YouTube integra Gemini Omni in un assistente di montaggio conversazionale per Shorts e per l’applicazione YouTube Create: bastano semplici istruzioni testuali per tagliare passaggi parlati, sincronizzare la musica, aggiungere testi introduttivi o riordinare le inquadrature. Le dirette ottengono il doppiaggio automatico (Live auto-dubbing), YouTube Music riceve Ask Music per comporre le code di ascolto conversando, e Podcast Lineup offre ogni settimana presentazioni parlate, generate dall’IA, dei podcast consigliati. I creator ottengono anche un rilevamento delle somiglianze più ampio per proteggere la propria voce e il proprio volto. Solo per i feed iniziali personalizzati (Custom Feeds) è indicato un periodo di lancio: arriveranno questo autunno per gli spettatori statunitensi; per le altre funzioni non c’è ancora un calendario preciso.
🔗 Made On YouTube 2026 · Riepilogo di Google
Gli assistenti si collegano ad altre applicazioni
Gemini: una nuova serie di applicazioni collegate
23 settembre — Google introduce una nuova serie di applicazioni collegabili a Gemini, che l’account @GeminiApp descrive come connessioni MCP. L’articolo cita 14 nomi in tre categorie: produttività (Airtable, Linear, monday.com, PandaDoc, Wispr AI, Zoho), creatività (Adobe, Picsart, Squarespace, Webflow) e vita quotidiana (apartments.com, Experian, Peloton, SeatGeek); il post di @GeminiApp parla invece di 13 nuove applicazioni. Questi servizi si attivano nelle impostazioni o si richiamano nella conversazione digitando @. Tra gli esempi forniti: ritoccare l’illuminazione di una foto con Adobe o consultare il proprio punteggio di credito con Experian. L’articolo non precisa né i paesi né i piani interessati.
🔗 Annuncio di Google · Annuncio di @GeminiApp
Muse, l’agente di Meta: Shopify, PayPal, Expedia, Instacart, poi ElevenLabs e HeyGen
22 e 23 settembre — Muse, l’agente personale lanciato da Meta l’8 settembre, ha annunciato in meno di 24 ore quattro connettori per servizi commerciali, tutti disponibili «prossimamente» secondo l’account ufficiale @Muse, senza indicazioni su date, prezzi o paesi. Il 23, anche due aziende dei media generativi annunciano il loro arrivo: ElevenLabs, senza una data di disponibilità, e HeyGen, che si appoggia al proprio server MCP.
| Servizio annunciato | Utilizzo descritto nell’annuncio | Annunciato da | Disponibilità annunciata |
|---|---|---|---|
| Shopify | Pagamento con un solo gesto su tutto il web | @Muse | Prossimamente |
| PayPal | Pagamenti gestiti dall’agente, nel mondo | @Muse | Prossimamente |
| Expedia | Prenotazione di hotel | @Muse | Prossimamente |
| Instacart | Spesa consegnata a domicilio | @Muse | Prossimamente |
| ElevenLabs | Voci fuori campo, colonne sonore e video | @ElevenLabs | Non precisata |
| HeyGen | Video del proprio avatar, con la propria voce, pronto da pubblicare | @HeyGen | Non precisata |
🔗 I quattro connettori annunciati da @Muse · ElevenLabs arriva in Muse · HeyGen entra in Muse
Grok Bot nelle Tesla e in Google Slides, Sheets e Docs
22 settembre — Tesla annuncia l’arrivo di Grok Bot, l’agente di SpaceXAI, nelle sue auto: con i Connectors, Grok può gestire la casella di posta, organizzare il calendario o riprendere file, conversazioni e attività esistenti, senza che il conducente tolga le mani dal volante. L’account @grok rilancia l’annuncio la sera stessa. L’attivazione prevede tre passaggi: accedere all’applicazione Grok nell’auto, aggiungere i Connectors dall’applicazione mobile o dal sito di Grok, quindi abbonarsi a SuperGrok, necessario per Grok Bot. I messaggi non precisano né i modelli di veicoli interessati né i paesi.
Lo stesso giorno, l’account @bot annuncia che Grok Bot si collega nativamente a Google Slides, Sheets e Docs, gestisce meglio gli allegati delle email (lettura e aggiunta di file) e può instradare la navigazione web attraverso la rete dell’utente. SpaceXAI promette anche attività più rapide e un’applicazione desktop più reattiva, senza fornire dati a sostegno.
🔗 Post di @grok · Annuncio di Tesla · Thread di Grok Bot
Antigravity: agenti in locale e comando /plan
Il SDK esegue i suoi agenti in locale con Gemma 4 26B
23 settembre — Il SDK Antigravity, che consente di accedere da Python alle capacità degli agenti di Google Antigravity, ora supporta workflow interamente locali. Il supporto iniziale riguarda Gemma 4 26B A4B eseguito con LiteRT (Google AI Edge), su una macchina con più di 24 GB di VRAM o di memoria unificata; LocalOpenAIAgentConfig si collega a qualsiasi server compatibile con OpenAI, come Ollama, LM Studio o vLLM. Google indica tra i vantaggi l’assenza di costi API e di limiti di frequenza, il codice che non lascia la macchina e i workflow ibridi. Nella sua dimostrazione, Gemini 3.8 Flash pianifica nel cloud l’audit di tre moduli vulnerabili usando 95 token, senza mai vedere il codice, mentre istanze locali di Gemma 4 26B riproducono le vulnerabilità, scrivono e convalidano le correzioni; il 97,2 % dei token (3 322) resta in locale. Queste novità sono arrivate con il SDK 0.1.18 del 21 settembre, che rimuove anche lo strumento per le domande interattive ASK_QUESTION dagli strumenti predefiniti, affinché gli agenti operino in autonomia.
🔗 Annuncio di Google Developers
Antigravity 2.16.0 e 2.17.0, CLI 1.2.8 e 1.2.9
22 settembre — L’applicazione Antigravity pubblica due versioni nello stesso giorno. La 2.17.0 introduce il comando /plan: l’agente redige un piano che si può esaminare e modificare prima che scriva una sola riga di codice, con un’impostazione Plan Review Policy a tre modalità (esaminare ogni piano, lasciare decidere l’agente, fare a meno della revisione). Riserva inoltre alle regole un budget di 20 000 token e legge la configurazione per repository in .gemini/config.json; il precedente .agents/settings.json non viene più preso in considerazione. La 2.16.0 consente di connettersi a una distribuzione WSL, trascinare documenti Word, Excel e PowerPoint in un prompt e visualizza i sottoagenti in schede aggiornate in tempo reale.
| Versione dell’applicazione | Numero di miglioramenti | Numero di correzioni | Novità principale |
|---|---|---|---|
| 2.16.0 | 12 | 15 | WSL, allegati Office, schede dei sottoagenti |
| 2.17.0 | 11 | 10 | /plan, budget di 20 000 token per le regole |
22 e 23 settembre — Sul versante del terminale, la CLI 1.2.9 aggiunge una sintassi @ per scrivere direttamente a un sottoagente e rende più affidabile la modalità headless: le attività in background vengono attese fino a 30 minuti, anziché essere annullate pochi secondi dopo che l’agente è diventato inattivo. La 1.2.8 rivede la compattazione del contesto e limita la dettatura vocale a 3 min 30 s.
Google DeepMind: una memoria persistente cifrata per Private AI Compute
23 settembre — Google DeepMind illustra come intende dotare Private AI Compute, la sua piattaforma di elaborazione in enclave cloud isolate a livello hardware, di una memoria persistente. Finora la piattaforma era «senza stato»: tutto il contesto scompariva al termine dell’attività. Il nuovo livello funziona come una cassaforte cifrata nel cloud, le cui chiavi restano esclusivamente sui dispositivi dell’utente; secondo Google, questo rende i dati inaccessibili a chiunque, Google compresa. Quando un modello ha bisogno di un’informazione, un’enclave sicura decifra temporaneamente i dati in una memoria isolata, elabora la richiesta, registra il nuovo contesto e lo cifra di nuovo immediatamente. L’esempio citato è ritrovare sul proprio computer istruzioni di montaggio consultate in precedenza con occhiali connessi.
Si tratta di un annuncio architetturale, formulato al futuro, senza una data di disponibilità né un prodotto indicato per nome. A sostegno della fiducia, Google pubblica un libro bianco aggiornato, un registro pubblico a prova di manomissione del suo software server, che i dispositivi potranno verificare prima di inviare dati personali, e i risultati di un audit indipendente condotto da una società di cui non rivela il nome.
Qwen: agenti per smartphone e audio meno costoso
Qwen Intelligence, tre agenti per i produttori di telefoni
23 settembre — Qwen lancia Qwen Intelligence, un’offerta di agenti per smartphone rivolta innanzitutto ai produttori di telefoni. I moduli (pianificazione, esecuzione, immagini, memoria) si combinano a scelta e un sistema di instradamento distribuisce i calcoli tra il dispositivo e il cloud. Al lancio sono disponibili tre agenti: Mobile Planner pianifica le attività complesse, Mobile-Use le esegue passando prima dalle API, con un ripiego sull’interfaccia grafica (82,1 su MobileWorld, 97,2 su AndroidDaily e il 90 % di riuscita dall’inizio alla fine, secondo Qwen), mentre Mobile Creative genera un’immagine in 3 secondi. Qwen rende disponibili quattro benchmark, ma non i pesi né il codice degli agenti. Mobile-Use e Mobile Creative sono già fatturati in base all’utilizzo, mentre la fatturazione di Mobile Planner è annunciata «a breve».
| Modello o sistema valutato (secondo Qwen) | Punteggio complessivo MobilePA-Bench |
|---|---|
| Qwen-Planner-Agent 27B | 77,05 % |
| GPT-6 Astra | 76,84 % |
| Claude Opus 5 | 75,71 % |
| Claude Fable 5 | 74,53 % |
| GLM 5.3 | 73,88 % |
🔗 Annuncio di Qwen su X · Rapporto Qwen-Planner-Agent
Qwen-Audio-3.1, fino al 95 % meno costoso
23 settembre — Qwen-Audio-3.1 aggiorna i tre modelli audio di Qwen, riconoscimento vocale (ASR), sintesi vocale (TTS) e conversazione in tempo reale (Realtime), e ne aggiunge due: TTS-Next, che genera in un solo passaggio voce, effetti e sottofondo sonoro, e ASR-Next, che distingue i parlanti, aggiunge marcatori temporali alla trascrizione e riconosce emozioni e rumori ambientali. Realtime ascolta e parla contemporaneamente e può essere interrotto. Su QwenCloud, qwen-audio-3.1-realtime-plus costa 6,4 dollari per milione di token audio in ingresso e 24 dollari per l’uscita di testo e audio, con 262K token di contesto; l’ASR su file costa 0,15 dollari per milione di token in ingresso. Solo queste due API sono disponibili; le altre sono annunciate «a breve».
| Famiglia di modelli | Riduzione di prezzo annunciata |
|---|---|
| TTS | circa 70 % |
| Realtime | circa 85 % |
| ASR | fino al 95 % |
🔗 Annuncio di Qwen-Audio-3.1 su X · Qwen-Audio-3.1-Realtime su QwenCloud
Mistral Vibe: Chat e Work si fondono, la CLI restringe le autorizzazioni
Chat e Work si fondono, base di conoscenza in anteprima
22 settembre — Mistral pubblica quattro note di rilascio per Vibe, il suo assistente (in precedenza Le Chat), senza un articolo né un tweet. La novità principale fonde Chat e Work in un’unica esperienza: si pone una domanda o si avvia un’attività nello stesso posto, un selettore Fast / Think sostituisce il cambio di modalità e gli Skills sostituiscono i Chat Agents; Deep Research diventa uno di essi. La migrazione è iniziata il 14 settembre per gli account Free, Pro e Teams; le aziende seguiranno dal 1° ottobre, nell’arco di circa sei mesi. La base di conoscenza per gli agenti (Agentic Knowledge Base), in anteprima pubblica, sostituisce una memoria opaca con pagine consultabili e modificabili e indica la provenienza di ogni fatto recuperato. Mini App Canvas genera piccole applicazioni React condivisibili a partire da un prompt, mentre i fogli di calcolo Excel o CSV arrivano in Vibe Work nei piani a pagamento.
Vibe CLI 2.25.8 corregge le elusioni delle autorizzazioni
23 settembre — Vibe CLI 2.25.8 comprende 5 aggiunte e 38 correzioni, diverse delle quali riguardano la sicurezza delle autorizzazioni. Una lista di autorizzazioni basata sui percorsi relativi non autorizza più un file solo perché il suo percorso termina con lo stesso suffisso; i caratteri jolly dei comandi shell non aggirano più la verifica dei percorsi esterni alla cartella di lavoro; un’autorizzazione concessa a una cartella principale non copre più automaticamente le sue sottocartelle, il che può far ricomparire alcune richieste di approvazione. Le note menzionano anche, per la prima volta, una «Rust CLI», oggetto di 18 voci, che consente tra l’altro di configurare i progetti remoti di Vibe Code. Per le aziende, la configurazione imposta dall’organizzazione si applica fin dall’apertura di una sessione Unified Harness, ed è stata corretta la connessione OAuth ai server MCP che emettono un segreto client, come Supabase.
🔗 Note di rilascio di Vibe CLI 2.25.8
Agenti di programmazione aperti e da riga di comando
ZCode diventa open source dopo problemi di sicurezza
21 settembre — Notizia recuperata: Z.ai ha reso pubblico il codice di ZCode, la sua infrastruttura per la programmazione tramite agenti presentata come lo strumento ufficiale di GLM-5.3, in risposta a problemi di sicurezza segnalati dalla comunità. L’account @zcode_ai afferma di aver completato le correzioni necessarie e si scusa. Il repository zai-org/ZCode, con licenza Apache-2.0, contiene i client, i servizi backend, la CLI e il runtime dell’agente; il 23 settembre contava circa 6 500 stelle.
With respect to the code data referenced by the community, we confirm that no such data is retained and that it has never been used for model training.
🇮🇹 Riguardo ai dati del codice menzionati dalla comunità, confermiamo che nessuno di questi dati viene conservato e che non è mai stato usato per addestrare modelli. — @zcode_ai su X
Secondo ZCode, due organismi hanno poi valutato la situazione: per il CAICT, il bucket Alibaba Cloud OSS «zcode-prod» non contiene più dati; per NSFOCUS, sono stati eliminati sia i suoi oggetti sia il bucket stesso. Entrambi rilevano che il client v3.14.0 integra la correzione, che la funzione Repo Wiki è stata rimossa e che il flusso che caricava snapshot dei repository locali è disattivato. Z.ai annuncia una procedura permanente per segnalare le vulnerabilità, con ricompense, e promette di pubblicare il rapporto di valutazione completo.
🔗 Codice sorgente di ZCode su GitHub
Kimi Code 2.1.0 rafforza la sicurezza
23 settembre — Moonshot pubblica Kimi Code 2.1.0 (2 novità, 18 correzioni). La novità più visibile è un layout sperimentale a schermo intero, selezionabile in /settings e attivo dopo il riavvio. Diverse correzioni rafforzano la sicurezza: gli strumenti per i file non possono più uscire dalla cartella di lavoro tramite link simbolici; la configurazione locale di un progetto si applica solo dopo l’approvazione dello spazio di lavoro; la configurazione git di un repository non può più eseguire comandi durante le operazioni git in background; vengono rifiutate le cartelle aggiuntive che puntano alla cartella personale o alla radice. L’OAuth dei server MCP richiede ora l’accesso offline, eliminando le nuove autorizzazioni ogni ora. Nel frattempo, Moonshot ha archiviato la precedente Kimi CLI scritta in Python (11 424 stelle), le cui versioni 1.51.0 e 1.52.0 rimandano a Kimi Code.
🔗 Note di rilascio di Kimi Code 2.1.0
DeepSeek Harness 0.1.7-rc.1, in anteprima
23 settembre — DeepSeek pubblica la v0.1.7-rc.1 di DeepSeek Harness, la sua infrastruttura per agenti open source con licenza MIT, presentata il 13 agosto. È una versione candidata (release candidate): il repository conta 21 versioni preliminari da agosto, senza alcuna versione stabile finora. Le aggiunte principali sono sperimentali: una modalità Computer Use che consente all’agente di operare sul computer locale e acquisirne schermate (tramite Cua Driver MCP o un driver nativo) e tre backend per il controllo del browser (Playwright MCP, Chrome DevTools MCP, Stagehand). L’interfaccia web acquisisce terminali integrati e una revisione delle modifiche con diff; la modalità headless legge le attività dall’input standard ed emette gli eventi in JSON; l’agente può lavorare su uno spazio remoto tramite SSH. Migrazioni da prevedere: l’adattatore ufficiale di DeepSeek usa esclusivamente la Messages API, i backend di esecuzione E2B vengono rimossi e la modalità team sperimentale passa da 8 a 16 membri.
🔗 DeepSeek Harness v0.1.7-rc.1
GenCode, l’agente di programmazione di Genspark
23 settembre — Genspark lancia GenCode, un agente di programmazione integrato nella sua Super App, su macOS, Windows e Linux, disponibile anche da riga di comando. L’argomento principale è la scelta del modello: Claude, GPT, DeepSeek o un modello a pesi aperti, attività per attività, da un unico account e senza dover configurare una chiave API; Genspark annuncia modelli aperti «a un costo compreso tra 1/10 e 1/20». GenCode importa in un unico passaggio le istruzioni, le regole e la memoria create per Claude Code. Il README del pacchetto npm @genspark/gencode ne precisa l’origine: deriva da opencode, l’agente di programmazione open source, ma resta un prodotto proprietario non affiliato al progetto, che condivide intenzionalmente la cartella .opencode/ dei repository. La spesa viene mostrata in crediti Genspark a ogni passaggio.
🔗 GenCode · Annuncio di Genspark su X
GitHub Copilot: approvazioni assistite e sandbox locale
Copilot per JetBrains 1.18.0
22 settembre — La versione 1.18.0 di Copilot per gli IDE JetBrains introduce, in anteprima pubblica, le approvazioni assistite (assisted approvals): nelle sessioni degli agenti, le chiamate agli strumenti considerate a basso rischio vengono approvate automaticamente, mentre le azioni più rischiose richiedono comunque una decisione. Si può anche modificare un messaggio precedente: Copilot riporta allora la conversazione e le modifiche ai file a quel punto prima di inviare la nuova istruzione. L’agente Codex, disponibile in Copilot per JetBrains, ottiene una modalità piano per esaminare, perfezionare o approvare l’approccio prima di qualsiasi modifica, e le sessioni accettano gli skills e le istruzioni dell’organizzazione e dell’azienda. Il server MCP GitHub integrato, attivo per impostazione predefinita, può ora essere disattivato. Gli utenti di un IDE JetBrains 2025.1 riceveranno un avviso che li inviterà a passare alla versione 2026.1 o successiva.
🔗 Novità di Copilot per JetBrains
L’app Copilot isola le sessioni locali
23 settembre — L’app GitHub Copilot, l’applicazione desktop di GitHub dedicata ai suoi agenti, riceve una sandbox locale in anteprima pubblica. Configurata progetto per progetto, limita ciò a cui possono accedere i comandi di una sessione locale: il file system (cartelle con accesso in lettura e scrittura, in sola lettura o vietate), la rete (accesso in uscita a internet e alla rete locale) e le credenziali (Git tramite HTTPS, GitHub CLI). Le impostazioni gestite dall’azienda possono rendere la politica più restrittiva. Se il sistema operativo non è in grado di applicare la politica richiesta, la shell della sandbox si arresta con un errore anziché essere eseguita senza protezione. Disattivata per impostazione predefinita, la sandbox si attiva per le nuove sessioni del progetto, oppure con /sandbox on per una sessione in corso; non copre le sessioni cloud né gli host remoti e le sue impostazioni restano distinte da quelle di Copilot CLI.
🔗 Sandbox locale nell’app GitHub Copilot
Cursor: due bot per la messa in produzione, il 7 % di token in meno
Rollouts e Security Review
23 settembre — Cursor lancia due bot dedicati all’«ultimo miglio» della distribuzione del codice, disponibili nei piani Teams ed Enterprise. All’apertura di ogni pull request, Rollouts pubblica un piano di monitoraggio (rischi, effetti attesi, segnali da verificare), poi confronta il piano con log, metriche e tracce dopo ogni distribuzione ed emette un verdetto per ciascun ambiente: sano, regressione rilevata o inconcludente. In caso di regressione, indica la modifica sospetta e può aprire una PR di ripristino soggetta ad approvazione, senza eseguire autonomamente né il merge né il ripristino. Security Review esamina ogni pull request e segnala le vulnerabilità sfruttabili (iniezioni, aggiramento dell’autenticazione, segreti lasciati nel codice, SSRF…), ciascuna con la sua gravità, il percorso di attacco e una correzione proposta. Per 10 giorni, crediti di prova permettono di testare Rollouts su circa 50 modifiche per Teams e 500 per Enterprise.
Costo in token ridotto del 7 %, senza perdita di qualità
23 settembre — Cursor spiega come ha ridotto del 7 % il costo in token del suo agente per gli utenti, senza cali di qualità. Poiché i modelli recenti non hanno più bisogno di lunghe liste di divieti, il prompt di sistema è stato accorciato di circa il 66 %, con tagli convalidati da test A/B sul traffico reale. Gli strumenti integrati, la maggior parte dei quali viene usata in meno del 20 % delle conversazioni, vengono ora caricati su richiesta.
| Leva di ottimizzazione | Effetto misurato da Cursor |
|---|---|
| Prompt di sistema alleggerito | circa il 66 % del prompt eliminato |
| Strumenti integrati caricati su richiesta | -60 % di token di descrizione nel contesto statico |
| Punti di interruzione della cache espliciti | -20 % di errori della cache a freddo |
| Un numero di riga ogni dieci righe | -1,6 % di token letti dalla cache |
| Insieme delle modifiche | -7 % di costo in token per gli utenti |
NVIDIA: diarizzazione aperta e AI Day Singapore
Nemotron 3 Diarization distingue fino a otto parlanti
23 settembre — NVIDIA pubblica su Hugging Face Nemotron 3 Diarization, un modello a pesi aperti da 100 milioni di parametri che determina chi parla e quando durante una conversazione, anche quando le voci si sovrappongono. Riconosce fino a otto parlanti, contro i quattro del predecessore Streaming Sortformer, e funziona sia in differita sia in streaming, con una latenza del buffer regolabile da 30,4 a 0,32 secondi. Non trascrive le parole: fornisce intervalli temporali per ciascun parlante, da combinare con un modello di trascrizione. Nei primi risultati del Diarization-Bench di VoiceArena si colloca al primo posto tra 12 sistemi, con un errore di diarizzazione del 14,72 %, contro il 19,3 % del secondo; secondo NVIDIA, questa classifica iniziale può ancora cambiare. Rispetto al modello precedente, l’errore diminuisce in media del 41 % su otto set di valutazione, con un lieve peggioramento nelle conversazioni a due parlanti di CALLHOME. Licenza OpenMDW 1.1.
| Misura pubblicata | Nemotron 3 Diarization | Modello precedente |
|---|---|---|
| Numero massimo di parlanti riconosciuti | 8 | 4 |
| Velocità a 30,4 s (batch di 32, RTX PRO 5000) | 15 113 volte il tempo reale | 2 619 volte |
| Errore DIHARD III a 30,4 s | 12,73 % | 19,09 % |
🔗 Nemotron 3 Diarization sul blog di Hugging Face
AI Day Singapore: Vera Rubin e Nemotron nel Sud-est asiatico
22 settembre — In un articolo pubblicato il 22 alle 19:30 PT, durante l’AI Day Singapore (22 e 23 settembre), NVIDIA presenta Sea Limited, società madre di Shopee, Garena e Monee, come la prima azienda della regione ASEAN ad adottare la sua piattaforma Vera Rubin per sviluppare e distribuire modelli e agenti su scala più ampia. Il resto dell’articolo mostra gli adattamenti locali dei modelli aperti Nemotron: AI Singapore estende ai modelli Nemotron la sua famiglia SEA-LION, dedicata alle lingue della regione; in Vietnam, Viettel AI ha perfezionato Nemotron 3 Super per il vietnamita, portandolo in testa al benchmark VMLU; in Thailandia, iApp Technology ha adattato Nemotron 3 Nano al diritto thailandese con OpenThai 2.0 Legal, pubblicato come open source, che alimenta il chatbot giuridico Thanoy e i suoi circa 43 000 utenti.
🔗 All’AI Day Singapore, NVIDIA e i suoi partner presentano i progressi dell’IA nel Sud-est asiatico
Portare l’IA in produzione senza problemi
Due annunci condividono la stessa idea: convalidare i sistemi su carichi reali prima di spostare il traffico o aggiornare le macchine.
Le distribuzioni canary di Together AI
22 settembre — Together AI descrive le distribuzioni progressive della sua offerta Dedicated Model Inference, disponibili dall’aggiornamento del 15 settembre: consentono di cambiare il modello servito da un endpoint senza interruzioni né modifiche all’URL. Sono proposte tre strategie: la canary aumenta il traffico verso il nuovo modello per fasi (5 %, 25 %, 50 % e poi 100 % per impostazione predefinita), la blue-green sposta tutto il traffico in una volta e la sostituzione progressiva cambia le repliche una alla volta. Dopo ogni fase della distribuzione canary, un controllo confronta la latenza o il tasso di errore con quelli del vecchio modello e mette in pausa la distribuzione se peggiorano. Nella dimostrazione pubblicata, il passaggio da Qwen2.5-7B a Qwen3.5-9B viene fermato già al 10 % del traffico a causa di una regressione del 137 % della latenza p95 (1 740 ms contro 734 ms); il ritorno al vecchio modello è avvenuto senza errori in nessuna delle 6 800 richieste servite.
🔗 Distribuzioni canary: aggiornare i modelli in produzione senza interruzioni
NVCRE e NodeWright di NVIDIA
23 settembre — NVIDIA presenta due progetti open source (Apache 2.0) di DSX OS, il livello software della sua piattaforma per fabbriche di IA, destinati ai cluster GPU gestiti con Kubernetes. NVIDIA Cluster Readiness Engine (NVCRE) parte da una constatazione: un cluster può superare tutti i controlli di integrità e fallire comunque durante un addestramento distribuito. Per questo ne verifica l’idoneità con carichi reali (test di comunicazione NCCL, diagnostica DCGM, preaddestramento NeMo) su gruppi di nodi scelti in base alla topologia, individua i nodi responsabili e, in modalità diagnostica, divide in due i gruppi che falliscono finché non isola i sospetti. Tra questi carichi, l’articolo cita modelli Nemotron 5 da 8 e 56 miliardi di parametri, senza ulteriori dettagli. NodeWright, in precedenza Skyhook e usato in produzione da NVIDIA, aggiorna il sistema dei nodi (impostazioni del kernel, agenti di sicurezza, correzioni delle vulnerabilità) aspettando la conclusione delle attività protette, con ondate fisse, lineari o esponenziali che si fermano automaticamente se falliscono troppi lotti.
🔗 Verificare l’idoneità dei cluster GPU prima dell’arrivo dei carichi di lavoro IA · NodeWright
Due set di dati aperti: conversazioni a più voci e corpus scientifico
Basis Conversations 1500
23 settembre — Basis pubblica su Hugging Face Basis Conversations 1500: 1 502 ore di conversazioni spontanee tra 2 645 persone di 33 paesi, in 22 lingue, dall’inglese al mingrelio e allo xhosa. Ogni conversazione coinvolge da due a quattro persone, ciascuna registrata su una traccia sincronizzata separata (FLAC 48 kHz): materiale utile per studiare sovrapposizioni, interruzioni e turni di parola, aspetti con cui i modelli hanno ancora difficoltà secondo il team. Circa 100 ore sono annotate nel dettaglio da esseri umani (113 096 valutazioni): segnali vocali di ascolto empatici o infastiditi, silenzi imbarazzati, sovrapposizioni cooperative o competitive. Le trascrizioni fornite sono automatiche e non devono essere usate come riferimenti per l’addestramento senza verifica. L’articolo presenta il set di dati come liberamente utilizzabile per scopi commerciali e di ricerca, ma è soggetto a una licenza specifica di Basis (basis-data-license-1.0), con accesso approvato manualmente.
QVAC Genesis III
23 settembre — Tether AI Research pubblica QVAC Genesis III, terza parte del suo corpus sintetico destinato al preaddestramento di piccoli modelli nelle scienze, nella tecnologia, nell’ingegneria e nella matematica. Con altri 43,06 miliardi di token, l’insieme raggiunge 191,43 miliardi di token e circa 160 milioni di documenti in 19 ambiti; l’articolo che lo accompagna è stato accettato alla conferenza COLM 2026. Il metodo interroga un piccolo modello allievo, Qwen3-1.7B-Base: un errore diventa una spiegazione correttiva, una risposta corretta un’analisi di ciascuna opzione di risposta. Addestrato da zero su questo corpus, un modello da 1,7 miliardi di parametri migliora nettamente rispetto allo stesso modello addestrato su Cosmopedia-v2, a parità di budget di token. Il corpus è pubblicato con una licenza non commerciale (CC-BY-NC 4.0), mentre per un modello addestrato su di esso è annunciata la licenza Apache 2.0.
| Benchmark valutato | Guadagno rispetto a Cosmopedia-v2 (a parità di budget di token) |
|---|---|
| ARC-Easy | +28,57 punti |
| ARC-Challenge | +21,35 punti |
| GPQA Diamond | +2,52 punti |
| MMLU STEM | +15,03 punti |
L’IA per il clima e l’alimentazione
Ai2 e Global Fishing Watch monitorano gli oceani con gli agenti
23 settembre — Alla Climate Week di New York, Ai2 e Global Fishing Watch annunciano una collaborazione per introdurre l’IA, in particolare gli agenti, nel monitoraggio degli oceani e nel controllo della pesca. Le due organizzazioni collaboravano già; ora passano allo sviluppo congiunto: una pipeline di rilevamento comune, nuovi modelli di visione in tempo reale applicati alle immagini satellitari e agenti capaci di incrociare diverse fonti di dati. Global Fishing Watch avrà a disposizione OlmoEarth, la piattaforma di osservazione della Terra di Ai2 basata su modelli aperti, per annotare i propri dati e addestrare i propri modelli. I rilevamenti delle imbarcazioni in tempo reale di Skylight saranno integrati nel suo portale per i gestori delle aree marine, e i due team svilupperanno ulteriormente agenti come Shippy, al quale un analista può chiedere la cronologia di un’imbarcazione. L’annuncio non indica né un calendario né un importo.
🔗 Ai2 e Global Fishing Watch uniscono le forze per portare gli agenti IA nel monitoraggio degli oceani
Google.org e la Gates Foundation, per 200 milioni di piccoli agricoltori
18 e 22 settembre — Aggiornamento: Google.org e la Gates Foundation ampliano la loro iniziativa comune per mettere strumenti di IA dedicati al clima, all’agricoltura e alle lingue a disposizione di 200 milioni di piccoli agricoltori nell’Africa subsahariana e nell’Asia meridionale, rispetto ai 50 milioni previsti inizialmente. I due partner destinano all’iniziativa finanziamenti combinati per 100 milioni di dollari, con il supporto tecnico di ricercatori e ingegneri di Google. Il comunicato della Gates Foundation è datato 18 settembre; blog.google ne ha dato notizia la sera del 22. Il programma finanzia realtà locali come Wadhwani AI e Digital Green in India, integra previsioni basate sull’IA nella piattaforma climatica TomorrowNow, mappa gli appezzamenti con una risoluzione inferiore al metro e sostiene set di dati vocali e testuali aperti in oltre 40 lingue africane. I piccoli agricoltori producono quasi il 35 % del cibo mondiale.
🔗 Annuncio di Google.org · Comunicato della Gates Foundation
Notizie in breve
- Anthropic, modernizzazione del codice — Nella serie «Notes from the Field», due ingegneri di Anthropic distaccati presso i clienti, Jonah Ezekiel e Lexie Tonelli, propongono sei fasi per preparare una modernizzazione del codice condotta da agenti: obiettivo, «certificato» dei test, revisione umana per fasi, prerequisiti, flusso degli agenti e infine avvio. Non forniscono cifre sui costi: consigliano di misurarli con un progetto pilota. 🔗 fonte
- Boris Cherny verifica il Claude Agent SDK con Lean — La sera del 22, Boris Cherny (Claude Code) racconta di aver fatto verificare formalmente il Claude Agent SDK da Opus 5.5 con l’assistente di dimostrazione Lean: pochi prompt brevi hanno prodotto 16 pull request che correggono bug e condizioni di concorrenza. Dice di usare anche TLA+. 🔗 fonte
- Codex CLI 0.156.1 — Questa versione correttiva della 0.156.0 aggiunge GPT-6 Sol e GPT-6 Luna al selettore dei modelli della CLI; il messaggio mostrato quando si raggiunge il limite di richieste consiglia ora Luna e vengono proposte migrazioni da GPT-5.5 e GPT-5.6. 🔗 fonte
- Airbnb e GPT-6 Astra — Un nuovo accordo amplia l’accesso dei team di ingegneria e prodotto di Airbnb ai modelli di OpenAI, tra cui GPT-6 Astra, tramite l’API di OpenAI e Amazon Bedrock. Il direttore tecnico, Ahmad Al-Dahle, afferma che i suoi team rilasciano circa l’80 % di funzionalità in più rispetto a un anno fa; non viene comunicato alcun importo. 🔗 fonte
- OpenAI Academy compie due anni — Più di 250 eventi e oltre 4 milioni di persone raggiunte da settembre 2024; OpenAI sta sperimentando un programma di formatori della comunità (Community Trainer Program) in cui i dipendenti delle organizzazioni partner imparano a condurre laboratori, dopo una valutazione. 🔗 fonte
- Un display LED trasformato in assistente vocale — Sul blog OpenAI Developers, Sid Rampally racconta come Codex lo abbia aiutato a cablare e programmare un pannello LED da 128 × 64 pixel controllato da un Raspberry Pi; GPT-Live-1 gestisce la conversazione e delega ricerche e visualizzazione a GPT-5.6 Luna tramite la Responses API. 🔗 fonte
- MedGemma supera i 10 milioni di download — Google descrive gli impieghi sul campo dei suoi modelli medici aperti: screening del tumore del collo dell’utero su oltre 3 500 donne in Zambia, progetti pilota all’ospedale AIIMS di Delhi, rilevamento della tubercolosi in Indonesia. Google ricorda che i risultati dei modelli non devono guidare direttamente una diagnosi. 🔗 fonte
- Gemini Notebook in Google Docs — Digitando @ in Docs, si può citare un notebook come fonte: Gemini basa la stesura sulle fonti del notebook, con citazioni nel testo, e le combina con email e file tramite Workspace Intelligence. Disponibile per Business Standard e Plus, Enterprise Standard e Plus, Education Plus e per gli abbonati a Google AI Pro e Ultra. 🔗 fonte
- Sei strumenti Google Flow — Google Labs presenta sei strumenti creati con Google Flow Tools da professionisti creativi: Mondo Sónico (effetti sonori sincronizzati), CaptionCast (sottotitoli animati), ThumbnailForge (miniature), Surface (texture su superfici 3D), CollageMotion Pro e SwissFlow Studio (motion design); ciascuno può essere duplicato e rielaborato. 🔗 fonte
- Google Beam disponibile in Francia — Beam, la piattaforma di comunicazione video di Google pensata per ricreare la presenza faccia a faccia e venduta insieme a HP, viene ora consegnata in sei paesi, tra cui la Francia, con 18 partner. Uno studio interno indica che i team si sentono il 50 % più connessi e tengono il 21 % di riunioni di aggiornamento in meno. 🔗 fonte
- Android Enterprise e gli agenti Gemini — Gemini può svolgere attività in sequenza tra applicazioni usando il contesto mostrato sullo schermo, mentre misure di protezione impediscono agli agenti personali di accedere al profilo di lavoro; gli amministratori possono limitare o disattivare l’automazione IA sull’intera flotta di dispositivi. 🔗 fonte
- AI Brief in francese — La beta chiusa di AI Brief, che permette di guidare le campagne AI Max di Google Ads con parole proprie, viene estesa al francese, all’olandese, al tedesco, all’italiano, al giapponese, al portoghese e allo spagnolo. 🔗 fonte
- Gemini CLI, nightly del 23 settembre — Si tratta soltanto di una nightly, non di una versione stabile: aggiunge Gemini 3.8 Flash e Gemini 3.5 Flash Lite, accessibili subito tramite chiave API, Vertex AI o gateway, e con i flag sperimentali usando un account Google. Martedì 22 non è stata rilasciata alcuna versione stabile. 🔗 fonte
- EcoHash misura le proprie ottimizzazioni video — Su una RTX PRO 6000 da 96 Go, EcoHash riduce il tempo per un video MiniMax H3 da 174,8 a 40,8 secondi e quello per Wan2.2 nella generazione di video da testo da 132,3 a 10,7 secondi, con una LoRA distillata in 4 passaggi; tre delle dieci impostazioni provate, tra cui entrambe le modalità di compilazione, non hanno prodotto differenze. 🔗 fonte
- Tataro di Crimea, evitato un test falsato — Lo sviluppatore di un modello di riconoscimento vocale per il tataro di Crimea ha scoperto che quattro audiolibri comparivano due volte nel suo corpus: il 96,9 % dei campioni del test principale aveva un duplicato nei dati di addestramento. Dopo la correzione, un affinamento LoRA e una regolazione del decoder, il tasso di errore per parola è passato da 0,3463 a 0,1701. 🔗 fonte
- Falcon-H1 e mlx-lm — In mlx-lm 0.31.3, senza cache KV, durante l’addestramento viene eseguito solo il primo dei 66 layer di Falcon-H1: qualsiasi LoRA viene addestrata senza errori né avvisi su un modello a un solo layer. La correzione richiede una riga ed è stata aperta una issue. 🔗 fonte
- Agenti e contributi open source — Quentin Gallouédec (Hugging Face) ritiene che i contributi prodotti dagli agenti cancellino il segnale di un’esigenza reale e facciano perdere tempo ai maintainer nella revisione; chiede di smettere di lanciare agenti su progetti scelti a caso e di cominciare usando il progetto. 🔗 fonte
- Phionyx all’IETF — L’autore di Phionyx presenta una bozza individuale, Claim-Preserving Exchange of AI Evaluation Evidence, affinché il risultato di una valutazione mantenga condizioni e limiti nel passaggio da un sistema all’altro; il testo non è stato adottato da alcun gruppo di lavoro. 🔗 fonte
- Kimi Work 3.2.12 — L’agente desktop di Moonshot permette di selezionare un passaggio in un file PPT, Excel, Word o Markdown per farlo modificare con precisione; viene eliminato il limite di dimensione degli allegati. 🔗 fonte
- Qwen-Image-2.1 in testa ai modelli aperti — Secondo Arena, Qwen-Image-2.1 diventa il primo modello aperto per la modifica di immagini (1 367 punti, 16º nella classifica generale) e per la generazione di immagini da testo (1 228 punti, 17º nella classifica generale). 🔗 fonte
- OpenTelemetry nell’app Copilot — Gli amministratori possono esportare le tracce delle sessioni degli agenti dell’app GitHub Copilot (richieste ai modelli, strumenti utilizzati) verso i propri strumenti di monitoraggio tramite la proprietà
telemetrydimanaged-settings.json; il contenuto dei prompt e delle risposte è escluso per impostazione predefinita. 🔗 fonte - Copilot CLI e C++ — Il Microsoft C++ Language Server di Copilot CLI crea ora un indice persistente dei simboli dell’intero progetto, attivo per impostazione predefinita; la prima indicizzazione può richiedere tempo e molta memoria, e GitHub non quantifica il miglioramento. 🔗 fonte
- Una pull request da un milione di righe — Un articolo di ingegneria di GitHub spiega come l’app Copilot visualizzi una pull request di 2 200 file, oltre un milione di righe e più di 400 commenti, separando la geometria del codice, calcolata in anticipo, da quella dei commenti, misurata vicino all’area visibile. 🔗 fonte
- Genspark aggiunge Opus 5.5, GPT-6 e Grok 4.7 — Nella notte del 23, Genspark rende disponibili Claude Opus 5.5, Grok 4.7, GPT-6 Sol e GPT-6 Luna in AI Chat, Code Agent e Claw, riprendendo le descrizioni dei rispettivi produttori, senza precisare piani né prezzi. 🔗 fonte
- Sondaggio GitHub e Yale — Tra 1 039 utenti di GitHub negli Stati Uniti, il 71 % si dice preoccupato per l’impatto ambientale dell’IA e otto su dieci vogliono strumenti per scrivere codice che consumi meno energia; GitHub precisa che il campione, composto da persone che hanno acconsentito a ricevere le sue comunicazioni di marketing, non è rappresentativo. 🔗 fonte
- Zed 1.21.0 — La versione stabile rende disponibili Claude Opus 5.5 e GPT-6 Astra, Sol e Luna con la propria chiave API, aggiunge l’accesso a SuperGrok nel pannello Agent e impedisce per impostazione predefinita che il computer entri in modalità sospensione mentre un agente lavora. 🔗 fonte
- Warp — GPT-6 Sol e Luna, seguiti da Claude Opus 5.5, arrivano nel terminale Warp e in Warp Agent CLI, insieme a Grok 4.7 per chi collega il proprio abbonamento Grok; viene annunciata soltanto la disponibilità, senza prezzi. 🔗 fonte
- Devin in Microsoft Teams — Devin, finora limitato ai canali, ora risponde anche nei messaggi diretti e nelle chat di gruppo, avvia Automations da un canale e invia schede con domande o richieste di approvazione; l’applicazione non richiede nuove autorizzazioni. 🔗 fonte
- Scribe v2 Medical — Disponibile dall’11 settembre, il modello di trascrizione clinica di ElevenLabs riceve l’annuncio ufficiale, con un dato nuovo: il 35 % di errori nelle parole in meno sull’audio clinico rispetto a Scribe v2. Il prezzo parte da 0,22 dollari l’ora. 🔗 fonte
- Sora 2 lascia ElevenLabs — ElevenLabs rimuove Sora 2 e Sora 2 Pro dal proprio studio perché OpenAI chiude l’API Sora il 24 settembre, una scadenza annunciata da OpenAI il 24 marzo; i flussi interessati devono passare a un altro modello video, come Gemini Omni 1.1 Flash. 🔗 fonte
- Cohere Model Vault in Canada — Cohere annuncia che Model Vault, la sua piattaforma di inferenza dedicata a un singolo tenant, è disponibile in Canada, senza specificare regione cloud, fornitore né prezzo; la pagina del prodotto non menziona ancora il Canada. 🔗 fonte
- Cohere e la gestione del cambiamento — Un articolo di Katherine Correia (Cohere) invita a integrare l’IA come partecipante anziché come semplice strumento, a classificare le attività come verificabili, basate sul giudizio o ibride e a definirne la governance in base ai casi d’uso; non presenta prodotti né dati numerici. 🔗 fonte
Che cosa significa
Il risultato di Anthropic porta gli agenti di programmazione nella biologia fondamentale. Circa 950 agenti Claude hanno esaminato più di 200 000 trascrittasi inverse in 21 ore, e gli esseri umani sono intervenuti solo all’inizio, con un prompt, e alla fine, per gli esperimenti. Il collo di bottiglia si sposta verso la selezione delle ipotesi, che Anthropic studia ormai come oggetto di ricerca. Resta necessaria la prudenza: la funzione di ART è sconosciuta e il risultato, per ora, è presentato in un preprint. La stessa logica di impiegare molti agenti con risultati misurabili si ritrova nello sprint che ha accelerato claude.ai, con oltre 3 000 modifiche, e nella verifica formale del Claude Agent SDK con Lean.
La sicurezza degli ambienti isolati per gli agenti diventa un tema pubblico. L’audit di Perplexity distingue due confini: l’isolamento della macchina virtuale ha retto in tutti i 108 tentativi, mentre il filtro di rete è stato aggirato 11 volte su 54 da modelli che hanno sfruttato un DNS verificato in modo insufficiente o gli indirizzi condivisi di una CDN; 8 piattaforme di terze parti su 10 presentavano almeno una possibilità di aggiramento. Due modelli, Fable e GPT-6 Astra, si sono rifiutati di eseguire il test. Lo stesso giorno, l’app GitHub Copilot introduce un ambiente isolato locale che interrompe l’esecuzione se non può garantire la protezione, la modalità automatica di Claude Code sottopone al classificatore persino i comandi di sola lettura, e Vibe CLI e Kimi Code correggono modi per aggirare le autorizzazioni; due giorni prima, ZCode aveva reso pubblico il proprio codice dopo problemi segnalati dalla comunità.
La voce diventa un’interfaccia per agire. Gemini 3.8 Flash TTS e Flash-Lite TTS rendono la generazione audio più di due volte meno costosa rispetto alla versione di anteprima precedente (9 e 6 dollari per milione di token fino alla fine del 2026, contro 20) e aggiungono la replica della voce subordinata a un consenso registrato, non disponibile nello Spazio economico europeo tramite AI Studio. Qwen annuncia riduzioni di prezzo dal 70 al 95 % per la propria gamma di strumenti audio, NVIDIA presenta un modello che distingue otto parlanti e Basis pubblica 1 500 ore di conversazioni con voci sovrapposte. Nel frattempo, ChatGPT Voice passa dalla conversazione all’azione, con i plugin e le attività di ChatGPT Work.
Infine, l’IA fisica si apre, con alcune distinzioni. FLUX 3 Action porta un modello da 7 miliardi di parametri al primo posto di RoboLab-120, lo integra in LeRobot con NVIDIA e mostra che una policy rapida e affidabile riduce il bisogno di ragionamento costoso: 8,77 dollari per successo con GPT-6 Astra come supervisore, contro 13,47 per Astra da solo. Ma «aperto» può significare cose diverse: una licenza dedicata per FLUX 3 Action come per Basis Conversations 1500, una licenza non commerciale per QVAC Genesis III, benchmark pubblicati senza i pesi per Qwen Intelligence. Per chi vuole riutilizzare queste risorse, la licenza conta quanto il punteggio.
Fonti
- Claude scopre un nuovo sistema enzimatico con ripetizioni simili a CRISPR (Anthropic)
- Preprint ART (PDF, Anthropic)
- @AnthropicAI: il sistema enzimatico scoperto da Claude
- Gemini 3.8 Flash TTS e Flash-Lite TTS (Google)
- Note di rilascio dell’API Gemini, 22 settembre
- Prezzi dell’API Gemini
- FLUX 3 Action (Black Forest Labs)
- @bfl_ai: lancio di FLUX 3 Action
- Collezione FLUX 3 Action su Hugging Face
- Sfuggire a SPACE, parte I (Perplexity)
- Claude Code v2.1.281
- Come abbiamo reso claude.ai 3 volte più veloce in due settimane (claude.dev)
- Claude Marketplace (Anthropic)
- @OpenAI: ChatGPT Voice con i plugin e in ChatGPT Work
- Articolo della guida di ChatGPT Voice
- Note di rilascio di ChatGPT
- Presentazione di MentalHealthBench (OpenAI)
- SWE-Serve (NVIDIA)
- Repository NVIDIA/swe-serve
- Runway è ora disponibile in DaVinci Resolve
- Gemini Omni 1.1 Flash in Google Vids
- Made On YouTube 2026
- Riepilogo di Made On YouTube 2026 (Google)
- Nuove applicazioni connesse di Gemini
- @GeminiApp: 13 nuove applicazioni connesse
- @Muse: quattro connettori in arrivo
- @ElevenLabs: ElevenLabs arriva su Muse
- @HeyGen: HeyGen si unisce a Muse
- @grok: Grok Bot nelle Tesla
- @Tesla: Grok e i Connectors
- @bot: Grok Bot collegato a Google Slides, Sheets e Docs
- Modelli locali nell’SDK Antigravity (Google Developers)
- Registro delle modifiche di Antigravity
- Memoria persistente per Private AI Compute (Google DeepMind)
- @Alibaba_Qwen: Qwen Intelligence
- Rapporto Qwen-Planner-Agent
- @Alibaba_Qwen: Qwen-Audio-3.1
- Qwen-Audio-3.1-Realtime su QwenCloud
- Note di rilascio di Mistral
- Vibe CLI 2.25.8
- @zcode_ai: rilascio del codice sorgente di ZCode
- Repository zai-org/ZCode
- Kimi Code 2.1.0
- DeepSeek Harness v0.1.7-rc.1
- GenCode (Genspark)
- @genspark_ai: lancio di GenCode
- Copilot per JetBrains 1.18.0 (GitHub Changelog)
- Sandbox locale nell’app GitHub Copilot (GitHub Changelog)
- Rollouts e Security Review (registro delle modifiche di Cursor)
- Maggiore efficienza nell’uso dei token (Cursor)
- Nemotron 3 Diarization (NVIDIA, blog di Hugging Face)
- AI Day Singapore (NVIDIA)
- Rilasci canary (Together AI)
- NVIDIA Cluster Readiness Engine (NVIDIA)
- NodeWright (NVIDIA)
- Basis Conversations 1500 (blog di Hugging Face)
- QVAC Genesis III (blog di Hugging Face)
- Ai2 e Global Fishing Watch (Skylight)
- Google.org e la Gates Foundation (blog.google)
- Comunicato della Gates Foundation
- Come prepararsi ai progetti di modernizzazione del codice guidati dall’IA (Anthropic)
- @bcherny: verifica formale del Claude Agent SDK in Lean
- Codex CLI 0.156.1
- Airbnb e GPT-6 Astra (OpenAI)
- Due anni di OpenAI Academy
- Dare vita al mio display LED (OpenAI Developers)
- MedGemma e la salute globale (Google)
- Gemini Notebook in Google Docs (Workspace Updates)
- Sei strumenti di Google Flow (Google Labs)
- Google Beam si espande in sei Paesi (Google)
- Novità di Android Enterprise 2026 (Google)
- AI Brief e AI Max (Google Ads)
- Gemini CLI v0.62.0-nightly.20260923
- Tre ottimizzazioni su dieci non hanno avuto alcun effetto (EcoHash)
- Riconoscimento vocale del tataro di Crimea (blog di Hugging Face)
- Fine-tuning di Falcon-H1 su un Mac (blog di Hugging Face)
- La strada verso l’inferno dell’open source è lastricata di buone intenzioni (blog di Hugging Face)
- La dashboard indica PASS. Che cosa ha superato esattamente il test? (Phionyx)
- Note di rilascio di Kimi Work
- @arena: Qwen-Image-2.1 è il primo modello aperto
- OpenTelemetry nell’app GitHub Copilot
- Intelligenza del codice C++ in Copilot CLI
- Visualizzazione di pull request molto grandi nell’app GitHub Copilot
- @genspark_ai: Claude Opus 5.5 in Genspark
- Studio di GitHub e Yale sull’efficienza dello sviluppo software
- Zed 1.21.0
- @warpdotdev: GPT-6 Sol e Luna in Warp
- Devin, Microsoft Teams e Microsoft 365
- @ElevenLabs: Scribe v2 Medical
- Registro delle modifiche di ElevenLabs del 23 settembre
- @cohere: Model Vault in Canada
- Gestione del cambiamento nell’IA (Cohere)