ai-powered-markdown-translatorArticolo tradotto dal fr al it con gpt-5.4-mini.
Il 22 agosto, Anthropic apre Claude Code Remote Control all’avvio di sessioni dal telefono, mentre Google dota Antigravity di una funzionalità equivalente per pilotare i suoi agenti da remoto. Sul fronte dei modelli, due confronti Together AI mostrano il modello aperto GLM-5.3 eguagliare o superare GPT-5.6 Sol e Claude Fable 5 sul benchmark DeepSWE, a una frazione del costo. Perplexity dettaglia inoltre l’architettura di Brain, la sua memoria agentica versionata con Git, e NotebookLM diventa accessibile a tutti gli utenti con un’integrazione nella Modalità IA di Google Search. In programma anche: Replit rivede le sue modalità agente, Runway apre un’offerta di licenza dei modelli, OpenAI rafforza il controllo dei costi API e la sua suite di sicurezza Codex, e Grok Bot amplia il suo accesso.
Claude Code Remote Control: affidabilità rafforzata e avvio di sessione dal telefono
22 agosto — Anthropic pubblica su X un thread che dettaglia diversi correttivi di affidabilità per Remote Control, la funzionalità che permette di pilotare una sessione Claude Code da un telefono mentre gira su un computer remoto. La sincronizzazione dello stato tra telefono e macchina non lascia più una sessione fantasma visualizzata dopo la chiusura di Claude Code, le interruzioni di rete (cambio di Wi-Fi, chiusura del coperchio) attivano ora una riconnessione automatica, e l’apertura delle sessioni di grandi dimensioni è nettamente accelerata su iOS. Tre comandi slash ottengono un comportamento mobile dedicato (/clear, /compact, /diff). Novità di prodotto: diventa possibile avviare una sessione direttamente dal telefono — qualsiasi macchina che esegue claude remote-control appare come una scheda dispositivo nella scheda Code, selezionabile per avviare la sessione da remoto.
Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.
🇮🇹 Il tuo telefono rimane ora sincronizzato con ciò che gira sulla tua macchina. Riprendere una sessione sul tuo laptop mantiene il telefono sulla sessione attiva invece di archiviarla. Quando Claude Code termina, il tuo telefono lo mostra offline in pochi secondi invece di lasciare visualizzata una sessione obsoleta. — @ClaudeDevs su X
🔗 Thread completo su X 🔗 Documentazione Remote Control
Replit: Conversations, modalità Agent rinominate (Power/Max), Routines e Memories in beta
22 agosto — Replit pubblica il suo riepilogo settimanale This Week in Replit, con tre novità inedite. Conversations permette di avviare un’idea di applicazione con una fase di ricerca e ideazione conversazionale prima di passare alla costruzione, senza perdere il contesto accumulato — un problema frequente quando questa fase iniziava in un altro assistente IA. Le modalità dell’Agent vengono rinominate: la vecchia modalità Economy diventa Power, la vecchia modalità Power diventa Max, a costo identico su entrambe. Infine, Routines e Memories arrivano in beta: le Routines programmano l’esecuzione di un’attività a partire da una conversazione e ne restituiscono automaticamente il risultato, supportate da un sistema di memoria persistente. Questi annunci sono stati presentati dal vivo durante il Friday Showcase di Replit.
Together AI confronta GLM-5.3 con GPT-5.6 Sol e Claude Fable 5 su DeepSWE
21 agosto — Together AI pubblica lo stesso giorno due confronti indipendenti che oppongono GLM-5.3, l’ultimo modello aperto di Zhipu/Z.ai, a due riferimenti chiusi su DeepSWE, il suo benchmark di ingegneria del software (113 compiti, 4 tentativi per configurazione, sforzo massimo, 904 esecuzioni totali). Di fronte a GPT-5.6 Sol, GLM-5.3 cede nel primo tentativo ma lo raggiunge già dal secondo e lo supera al quarto, a un costo nettamente inferiore. Di fronte a Claude Fable 5, il divario iniziale è quasi nullo e si amplia nettamente a favore di GLM-5.3 con i tentativi multipli — Claude Fable 5 emerge come la configurazione più costosa del confronto. Una cascata GLM-5.3 verso Sol, che scala solo in caso di fallimento dei test, raggiunge l’85,9 % di successo a 6,61 dollari per attività, un risultato migliore di un router oracolo perfetto (83,8 %).
| Confronto testato | Punteggio al primo tentativo | Punteggio dopo 4 tentativi | Costo per esecuzione |
|---|---|---|---|
| GLM-5.3 vs GPT-5.6 Sol | 69,0 % vs 72,7 % | 87,6 % vs 85,8 % | 3,99 $ vs 8,37 $ (2,1× meno costoso) |
| GLM-5.3 vs Claude Fable 5 | 69,0 % vs 69,7 % | 87,6 % vs 84,1 % | 3,99 $ vs 21,63 $ (5,4× meno costoso) |
Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.
🇮🇹 Non scegliete un solo modello. Eseguite per primo GLM-5.3 e scalate verso GPT-5.6 Sol quando i test falliscono. Questa cascata risolve l’85,9 % dei compiti DeepSWE a 6,61 dollari ciascuno. Sol da solo ne risolve il 72,7 % a 8,37 dollari. Tredici punti in più, 21 % meno costoso. — Together AI, blog ufficiale
🔗 Confronto GLM-5.3 vs Claude Fable 5
NotebookLM disponibile per tutti gli utenti, integrato nella Modalità IA di Google Search
21 agosto — L’account X di NotebookLM, rinominato Gemini Notebook, annuncia che l’esperienza «Notebook» rinnovata è ora disponibile per tutti gli utenti sul web (una versione mobile è annunciata in arrivo), dopo un rollout progressivo. Un altro cambiamento strutturale: i notebook sono ora accessibili direttamente dalla Modalità IA di Google Search, avvicinando lo strumento di sintesi documentale al motore di ricerca principale di Google. L’annuncio include anche due correzioni lato Chat: un miglior rendering e copia-incolla delle equazioni matematiche, e la correzione di un bug che mostrava i numeri al contrario nelle lingue scritte da destra a sinistra (arabo, ebraico). Altre novità sono promesse nelle prossime settimane.
OpenAI aggiunge un monitoraggio delle spese per chiave API ai dashboard Usage and Spend
21 agosto — OpenAI aggiunge una granularità per chiave API ai dashboard Usage and Spend della sua piattaforma sviluppatori. Finora aggregato a livello di organizzazione o progetto, il monitoraggio delle spese permette ora di isolare il contributo di ciascuna chiave API individuale, per identificare con precisione quali applicazioni o quali flussi di lavoro incidono di più sulla fattura. La funzionalità è accompagnata da limiti di spesa configurabili a livello di organizzazione o progetto, con la possibilità di impostare limiti rigidi che interrompono automaticamente il traffico una volta raggiunto il tetto. Questi controlli sono accessibili dall’interfaccia della API Platform e tramite la Admin API, per integrarli in flussi di lavoro programmatici. OpenAI presenta questo aggiornamento come complementare alla riduzione tariffaria di GPT-5.6 Sol annunciata lo stesso giorno.
Codex Security: guida pratica e CLI open source per la difesa cyber (Daybreak)
21 agosto — OpenAI pubblica una guida che dettaglia l’ecosistema Daybreak, la sua piattaforma di difesa cyber assistita da IA, dal triage iniziale in ChatGPT fino alla produzione di una correzione verificata. Il punto più concreto per gli sviluppatori è la Codex Security CLI, uno strumento open source pubblicato come pacchetto npm (@openai/codex-security), utilizzabile per scansionare un repository locale (npx @openai/codex-security scan .) e integrabile in CI/CD (GitHub Actions, GitLab CI/CD) con export in formato SARIF. Novità notevole: il bulk-scan, che verifica un intero portafoglio di repository a partire da un inventario CSV, con ripresa dopo interruzione e parametri di concorrenza configurabili. OpenAI distingue anche due livelli di accesso: Daybreak Blue (triage delle vulnerabilità, validazione delle patch) per i difensori approvati, e Daybreak Red (ricerca avanzata di vulnerabilità, red teaming), riservato a un numero più ristretto di usi autorizzati. Codex Security cloud ha già analizzato più di 30 milioni di commit su oltre 30.000 basi di codice.
Grok Bot estende il suo accesso a più piani e diventa gratuito in prova
21 agosto — Dieci giorni dopo il lancio in beta, Grok Bot amplia il suo accesso a una gamma più ampia di piani: SuperGrok Plus, SuperGrok Heavy, oltre alle offerte Cursor (Pro+, Ultra e tutti i piani Teams). Gli utenti al di fuori di questi piani beneficiano ora di una prova gratuita a uso limitato. Questi agenti IA autonomi dispongono di un proprio ambiente cloud con accesso al browser e al terminale, per attività come la prospezione commerciale, la creazione di siti web completi (acquisto del dominio e deployment inclusi), lo smistamento delle caselle di posta, il supporto clienti o la presa di appunti in riunione. Più Bot possono girare in parallelo in un unico gruppo, e una modalità «routine» permette a un Bot di imparare un’attività osservando l’utente eseguirla una prima volta. È aperta una lista d’attesa enterprise per i deployment su scala maggiore.
Runway dettaglia la sua strategia enterprise e un’offerta di licenza dei modelli
21 agosto — Il nuovo direttore commerciale di Runway, Sean Holcombe, dettaglia in un post la strategia enterprise della società: fatturato più che raddoppiato nell’anno, retention netta superiore al 300 % e forte espansione internazionale (Europa oltre il 20 % della base enterprise, Giappone diventato primo mercato asiatico). L’annuncio più strutturale è l’apertura di un’offerta di licenza dei modelli: invece di un accesso a consumo via API, alcuni clienti enterprise potranno ricevere pesi di modelli chiusi e un framework proprietario di training/inference da ospitare e affinare direttamente nel proprio ambiente. Runway punta a quattro profili: aziende con proprietà intellettuale creativa propria, piattaforme che dispongono già di capacità di calcolo, organizzazioni soggette a forti vincoli normativi e attori ad altissimo volume.
Perplexity dettaglia Brain, il sistema di memoria agentica di Computer
19 agosto — Perplexity dettaglia il funzionamento di Brain, il sistema di memoria persistente di Computer, il suo agente locale. Piuttosto che una classica base vettoriale, Brain organizza la memoria come un wiki di conoscenze versionato con Git, suddiviso in tre livelli nel file system del sandbox: knowledge/ (il wiki), notes/ (estratti distillati) e sessions/ (trascrizioni grezze). Un «Memory Agent» dedicato carica su richiesta i file pertinenti invece di copiare l’intera struttura a ogni avvio, mentre agenti in background chiamati «Dream» mantengono il wiki offline in quattro fasi, con verifiche prima della pubblicazione.
| Metrica valutata | Senza Brain | Con Brain |
|---|---|---|
| Accuratezza (benchmark interno, 640 domande) | 0,600 | 0,661 |
| Richiamo delle prove (benchmark interno) | 0,573 | 0,625 |
| Accuratezza in produzione (ultimi 30 giorni) | controllo | +9,3 punti |
Brevi
- Devin (Cognition) — sconto aggiuntivo del 20 % su GPT-5.6 Sol — OpenAI aggiunge un calo del 20 % al prezzo di GPT-5.6 Sol per 3 mesi, che si somma allo sconto del 70 % già in vigore dal 18 agosto: la riduzione cumulativa su Devin Desktop e CLI raggiunge ora il 76 % fino al 3 ottobre 2026. 🔗 Annuncio
- Google Antigravity 2.9.1 — Remote Control per pilotare gli agenti da remoto — Nuova funzionalità che consente di avviare e monitorare una sessione di agente locale da qualsiasi browser, con miglioramenti delle prestazioni e recupero dagli errori più efficace. 🔗 Changelog
- Auto model selection a -30 % per Copilot Max — Promozione sulla selezione automatica del modello (Claude, GPT o Microsoft AI) per gli abbonati Copilot Max, valida fino al 30 settembre 2026. 🔗 Annuncio · 🔗 Data di fine
- GitHub Universe 2026 — rilancio della biglietteria — Rilancio di marketing della conferenza GitHub Universe 2026 tramite un breve video, senza annuncio di prodotto associato. 🔗 Video
- Midjourney — changelog importante per l’alpha del sito — Due settimane di correzioni UX su alpha.midjourney.com: cartelle di progetto, ritorno di Upscale/Zoom/Vary, persistenza delle impostazioni e correzioni di performance. 🔗 Changelog
- MiniMax lascia intravedere il lancio del modello M3 su SambaNova — In risposta a un annuncio enigmatico di SambaNova, MiniMax lascia intendere l’arrivo imminente di un modello M3, senza specifiche né data di uscita comunicate. 🔗 Tweet
- Grok 4.6 disponibile su Google Enterprise Agent Platform — Il modello entra in Model Garden (ex-Vertex AI), con una finestra di contesto di 500.000 token e una tariffazione di 2 $ / 6 $ per milione di token in input/output. 🔗 Annuncio
- Cohere attiva una modalità locale per la dettatura vocale tramite superwhisper — La modalità «Go Local» combina Cohere Transcribe e il modello aperto S1-mini (0,6 miliardi di parametri) di superwhisper, con trascrizione interamente sul dispositivo. 🔗 Annuncio
Cosa significa
Due annunci indipendenti, senza legame tra loro, convergono oggi su un unico movimento: sganciare il controllo di un agente IA dalla macchina su cui gira realmente. In Anthropic, Claude Code Remote Control consente ora di avviare una sessione direttamente dal telefono, con riconnessione automatica e sincronizzazione dello stato tra dispositivi. In Google, Antigravity introduce la propria funzionalità « Remote Control »: controllare e monitorare una sessione di agente locale da qualsiasi browser. In entrambi i casi, il calcolo e l’esecuzione restano ancorati alla postazione di lavoro — è la finestra di controllo a diventare mobile. Questo disaccoppiamento risponde a un uso ormai comune: avviare un’attività lunga sulla propria macchina di sviluppo, poi seguirla e riprenderne il controllo da un altro dispositivo, senza mai interrompere l’esecuzione in corso.
Il secondo movimento visibile oggi riguarda l’economia dei modelli. I due confronti di Together AI mostrano GLM-5.3, un modello aperto di Zhipu/Z.ai, eguagliare o superare GPT-5.6 Sol e Claude Fable 5 su uno stesso benchmark di ingegneria software, per un costo da 2 a 5 volte inferiore. Non è un caso isolato: nella stessa settimana, xAI moltiplica le integrazioni cloud per Grok 4.6 (Google Enterprise Agent Platform dopo GitHub Copilot e Amazon Bedrock), OpenAI concede uno sconto cumulato del 76 % su GPT-5.6 Sol agli utenti di Devin, e Replit amplia le proprie modalità agentiche. La competizione non si gioca più soltanto sulla capacità grezza dei modelli, ma sul rapporto costo-efficacia e sulla disponibilità multipiattaforma — un terreno in cui i modelli aperti, combinati a strategie di cascata tra modelli, diventano argomenti commerciali a pieno titolo di fronte ai modelli chiusi.
Un terzo filone, più discreto, attraversa anche la giornata: la memoria persistente sta diventando un vero blocco d’infrastruttura per gli agenti IA. Perplexity dettaglia l’architettura di Brain, un wiki di conoscenze versionato con Git che struttura la memoria del suo agente Computer invece di accumularla in un classico database vettoriale, con miglioramenti misurati nella correttezza e nel richiamo delle prove. Allo stesso momento, Google amplia l’accesso all’esperienza Notebook rinnovata di NotebookLM e la integra direttamente nel Modo IA di Google Search, avvicinando un po’ di più lo strumento di sintesi documentale al motore di ricerca principale. In entrambi i casi, il valore aggiunto non deriva più soltanto dal modello sottostante, ma dal modo in cui la cronologia e le conoscenze accumulate vengono organizzate, ritrovate e riutilizzate da una sessione all’altra.
Un ultimo punto riguarda la maturità degli strumenti destinati ai team tecnici e di sicurezza in azienda. OpenAI aggiunge il monitoraggio delle spese per chiave API e limiti rigorosi configurabili ai propri dashboard, proprio mentre pubblica una guida dettagliata su Codex Security, con una CLI open source in grado di auditare un intero portafoglio di repository. Questi due annunci, pubblicati lo stesso giorno dallo stesso team, delineano una risposta coerente a una preoccupazione condivisa dalle organizzazioni che distribuiscono agenti IA su larga scala: mantenere un controllo fine sui costi e sulla superficie di sicurezza, senza rinunciare alla velocità promessa da questi strumenti.
Fonti
- Claude Code Remote Control — fil di discussione completo
- Claude Code Remote Control — citazione sulla sincronizzazione
- Documentazione Remote Control
- Replit — Questa settimana in Replit
- Together AI — GLM-5.3 vs GPT-5.6 Sol su DeepSWE
- Together AI — GLM-5.3 vs Claude Fable 5 su DeepSWE
- NotebookLM — annuncio su X
- OpenAI — Utilizzo e spesa per chiave API
- OpenAI — Codex Security e Daybreak
- Grok Bot — annuncio su X
- Grok Bot — dettagli x.ai
- Runway — strategia aziendale e licenza dei modelli
- Perplexity — Brain, memoria agentica di Computer
- Devin — sconto aggiuntivo su GPT-5.6 Sol
- Google Antigravity — changelog 2.9.1
- GitHub — selezione automatica del modello a -30 %
- GitHub — selezione automatica del modello, data di fine
- GitHub Universe 2026 — rilancio della biglietteria
- Midjourney — changelog alpha
- MiniMax — annuncio del modello M3
- Grok 4.6 — Google Enterprise Agent Platform
- Cohere — modalità locale superwhisper