ai-powered-markdown-translatorArticolo tradotto dal fr al it con gpt-5.4-mini.
Il 22 luglio 2026 è dominato dagli strumenti e dagli agenti IA aziendali: Cursor lancia Cursor Router, un router di modelli che riduce i costi del 60 % senza alcuna perdita di qualità percepibile, OpenAI presenta una dopo l’altra la sua piattaforma di agenti Presence e il suo data center Project Camellia da 3,2 gigawatt in Georgia, Alibaba svela Qwen-Image-3.0 e Synthesia lancia Roleplay Sessions per la formazione professionale. Attorno a questi cinque annunci principali gravitano una trentina di novità degne di nota — dalla Genesis Mission del Dipartimento dell’Energia statunitense (Google, OpenAI, Arcee AI) alle novità di Anthropic, GitHub Copilot, NVIDIA e Cohere.
Cursor lancia Cursor Router, routing intelligente dei modelli al 60 % in meno
22 luglio — Cursor ha lanciato Cursor Router, un router di modelli integrato nella modalità Auto che analizza ogni richiesta e sceglie automaticamente il modello più adatto al compito, invece di inviare sistematicamente tutte le richieste a un modello frontier (frontier). La funzionalità è disponibile da oggi su tutte le superfici (desktop, web, iOS, CLI, SDK) per i piani Teams ed Enterprise.
| Modalità di ottimizzazione | Obiettivo | Fatturazione |
|---|---|---|
| Intelligence | Qualità frontier sistematica | Tariffa del modello effettivamente utilizzato |
| Balance | Qualità vicina alla frontier, uso quotidiano | Tariffa del modello effettivamente utilizzato |
| Cost | Qualità corretta, ottimizzata in token | Tariffa del modello effettivamente utilizzato |
Sul fronte amministrativo, i team Teams ed Enterprise dispongono di controlli granulari: attivare o disattivare Router per team, limitare le modalità accessibili, definire una modalità predefinita, autorizzare o bloccare alcuni modelli sottostanti e scegliere se mostrare o meno il nome del modello effettivamente instradato (nascosto per impostazione predefinita). Opzioni di applicazione morbida o rigorosa consentono di standardizzare l’uso della modalità Auto all’interno di un’organizzazione.
In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.
🇮🇹 In accesso anticipato, i clienti non hanno osservato alcun calo di qualità, per un costo per commit inferiore rispetto all’instradamento di tutte le richieste verso Opus 4.8. — @cursor_ai su X
OpenAI Presence, piattaforma di agenti vocali e testuali per l’impresa
22 luglio — OpenAI lancia Presence, una piattaforma di agenti IA destinata alle aziende per distribuire in produzione agenti vocali e testuali affidabili, oltre la semplice dimostrazione tecnica. Presence combina il ragionamento dei modelli con policy, guardrail e regole di escalation umana.
Ogni implementazione inizia da un compito preciso (fatturazione, sinistri assicurativi, richieste IT interne): l’agente riceve solo le conoscenze e gli accessi di sistema necessari, e l’azienda cliente definisce cosa può fare, quando è richiesta una validazione umana e quando una persona deve riprendere in mano la situazione. Dopo la messa in produzione, le sessioni reali e i casi di escalation fanno emergere le lacune del sistema; Codex propone allora gli aggiornamenti che i team testano e validano, consentendo all’agente di adattarsi all’evoluzione del comportamento degli utenti.
Da oggi, Presence supporta esperienze in tempo reale in voce e in testo per l’assistenza clienti, le vendite outbound o flussi interni ad alto impatto. Il prodotto è disponibile per i clienti enterprise idonei tramite un programma di disponibilità generale limitata, con supporto diretto dei team OpenAI e poi, per il monitoraggio continuo, da parte di system integrator selezionati.
Project Camellia, data center OpenAI da 3,2 gigawatt in Georgia
22 luglio — OpenAI illustra Project Camellia, un progetto infrastrutturale IA di lungo termine nella contea di Effingham, in Georgia. L’azienda ha firmato un contratto con Georgia Power per 3,2 gigawatt di potenza, erogati in fasi tra il 2028 e il 2032.
Sull’elettricità, OpenAI si impegna a coprire l’intero costo dell’infrastruttura e del servizio, senza ricadute sulle tariffe dei residenti, e il sito è progettato per ridurre in modo proattivo il proprio consumo in caso di forte domanda prima che i clienti residenziali ne risentano. Sul fronte idrico, un circuito chiuso ricircola l’acqua invece di prelevarla e scaricarla in continuo, per un consumo continuo paragonabile a quello di un edificio per uffici equivalente.
Sul piano economico, OpenAI annuncia 80 milioni di dollari di benefici comunitari nell’arco di vita del progetto (scuole, pubblica sicurezza, salute, alloggio, veterani, piccole imprese), oltre a centinaia di milioni di dollari di entrate fiscali locali e statali attese — con l’azienda che prevede di diventare il maggior contribuente della contea. Si aggiungono fino a 71 milioni di dollari di crediti Codex per gli studenti idonei dei college, community college e istituti tecnici della Georgia, ciascuno dei quali riceverà 100 dollari di crediti tramite il proprio account ChatGPT.
Qwen-Image-3.0, terza generazione del modello di generazione di immagini di Alibaba
22 luglio — Alibaba ha lanciato Qwen-Image-3.0, terza generazione del suo modello di generazione di immagini, riassunta dal team in una parola d’ordine: «Real» (« 实 »), dopo la precisione della versione 1.0 e la varietà/completezza della 2.0.
| Dimensione | Cosa cambia concretamente |
|---|---|
| Contenuto ricco | Prompt fino a 4,5k token; layout complessi in un solo passaggio (giornali, storyboard, soggetti d’esame, griglie di infografica 3×3, interfacce annidate) |
| Dettagli autentici | Testo leggibile fino a 10px, pagine LaTeX complete, texture quasi fotorealistiche (pori, ciocche di capelli, pelle) |
| Conoscenza approfondita | Rendering nativo in 12 lingue, oltre 100 stili artistici, interfacce realistiche (web, giochi, stream), recupero web in tempo reale |
Un esempio evidenziato da Alibaba illustra questa «espansione orizzontale»: con soli 3,7k token, il modello genera un’infografica 3×3 che copre nove domini molto diversi (sicurezza in galleria, geometria spaziale, analisi stilistica di un testo classico cinese, moto di un proiettile, parassitologia, diagnosi medica, teoremi di Sylow, controllo bancario, struttura del DNA), con testo e visual precisi in ogni riquadro. Alibaba posiziona il modello non come un semplice strumento «bello da vedere», ma come uno strumento di produttività per il design, la creazione di contenuti, l’istruzione e l’e-commerce. È accessibile da subito tramite Qwen Chat.
Synthesia lancia Roleplay Sessions per la formazione professionale
22 luglio — Synthesia lancia Roleplay Sessions, primo tassello della sua futura piattaforma «Sessions» destinata alla formazione professionale tramite IA. Il principio: una conversazione di training in diretta con un avatar che risponde e stimola in tempo reale, fa coaching all’utente con un sistema di punteggio, poi misura la progressione delle competenze su scala di team. Il target dichiarato è la vendita, il management, il servizio clienti e qualsiasi situazione in cui un dipendente debba allenarsi a sostenere una conversazione difficile.
| Indicatore | Valore |
|---|---|
| Competenze di base sconvolte entro il 2027 (fonte Synthesia) | 44 % dei dipendenti |
| Datori di lavoro che dichiarano di mancare di capacità per colmare il divario | 63 % |
| Aumento medio delle competenze (grande società globale di recruiting) | circa 30 % |
| Commerciali che tornano ad allenarsi volontariamente (azienda Fortune 10) | circa 70 % |
Roleplay Sessions cerca di riunire in un’unica piattaforma quattro fasi normalmente separate — informare, allenare, coachare e misurare — sfruttando la base video di Synthesia, già utilizzata dal 90 % delle aziende Fortune 100. I primi deployment riguardano un grande gruppo europeo e una società Fortune 10.
Genesis Mission del DOE: Google, OpenAI e Arcee AI moltiplicano gli impegni
22 luglio — Tre attori distinti hanno annunciato lo stesso giorno nuovi impegni attorno alla Genesis Mission, l’iniziativa del Dipartimento dell’Energia statunitense (DOE) volta a raddoppiare il ritmo della scoperta scientifica in un decennio.
| Organizzazione | Impegno | Dettaglio |
|---|---|---|
| Google DeepMind | 40 milioni di dollari | Token IA e crediti Google Cloud per dare a più ricercatori dei laboratori nazionali accesso a Gemini e ad altri modelli |
| OpenAI | 17 milioni di dollari | Accesso Codex per circa 2 000 ricercatori, supporto API per due campagne scientifiche, fino a 10 milioni di dollari di utilizzo API offerti per 2,5 milioni spesi, accesso a GPT-Rosalind per la biologia |
| Arcee AI | Partnership (importo non comunicato) | Costruzione di Genesis-Science-1 (GS1), modello statunitense a pesi aperti associato a un harness di ricerca governato per i workflow di calcolo scientifico |
Google amplia una collaborazione già avviata intorno alla biologia computazionale (AlphaFold, Isomorphic Labs). OpenAI si appoggia a lavori già svolti con il sistema dei laboratori nazionali, inclusa una sessione «AI Jam» che ha riunito oltre 1 000 scienziati di nove laboratori. Arcee AI, da parte sua, apre un programma di contributo destinato a ricercatori, laboratori, università, aziende e organizzazioni non profit; il progetto è agli inizi, senza data di uscita né benchmark comunicato per GS1 a questo stadio.
🔗 Google DeepMind su X — 🔗 OpenAI sull’argomento — 🔗 Arcee AI su X
Anthropic moltiplica gli annunci su Claude
Claude Security entra in beta per Claude Code
22 luglio — Anthropic lancia in versione beta il plugin Claude Security per Claude Code: scansione delle modifiche in corso alla ricerca di vulnerabilità prima del commit, oppure analisi completa del repository, il tutto dal terminale, sfruttando l’inferenza Claude già in uso (nessun servizio terzo separato da provisionare). Questo lancio posiziona Claude Code sullo stesso terreno di Codex Security di OpenAI o del secret scanning rafforzato di GitHub Copilot. Né prezzi né piani interessati oltre allo stato beta sono specificati.
Claude può interrogare l’Anthropic Economic Index tramite un connector
22 luglio — Un nuovo connector nativo dà accesso all’Anthropic Economic Index, il dataset pubblico che misura l’uso dell’IA nell’economia. Una volta attivato dal menu dei connector, Claude può rispondere a domande come «quali professioni usano di più l’IA» basandosi direttamente sui dati dell’Index anziché sulle sue conoscenze generali.
Claude Managed Agents: effort, seeding, 500 skill e webhook
22 luglio — Anthropic distribuisce un insieme di funzionalità per Claude Managed Agents: livelli di effort configurabili per agente (risposte più rapide e meno costose a effort ridotto), sessioni «seeded» con fino a 50 eventi direttamente alla creazione, fino a 500 skill totali attraverso tutti gli agenti di una sessione, webhook per gli ambienti e gli store di memoria e streaming degli eventi dei sub-agent.
Claude Code su desktop si integra con il simulatore iOS
21 luglio — Claude Code su desktop supporta il simulatore iOS: l’applicazione può essere compilata e avviata da Claude, che la osserva, interagisce con essa e itera fino al completamento del compito, in un pannello affiancato alla conversazione. Disponibile da oggi in beta pubblica, riservato a macOS e richiede Xcode.
🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 Simulatore iOS
Strumenti di codice: Amp, Warp e Replit
Amp lancia Multiplayer, la collaborazione in tempo reale sugli orb
22 luglio — Tre settimane dopo il lancio degli agenti negli orb, Amp aggiunge Multiplayer: lo stesso orb può ora essere condiviso e modificato simultaneamente da più membri di uno spazio di lavoro, con invio di messaggi all’agente, consultazione del portale, osservazione delle modifiche ai file in diretta e terminale condiviso, attivabile dal menu Share di un thread.
Warp aggiunge il supporto dei link ipertestuali OSC 8
22 luglio — Warp introduce il supporto di OSC 8, uno standard terminale che consente alle CLI e agli agenti di codifica di emettere link cliccabili al posto di testo semplice. Sviluppata da un contributore esterno su una richiesta aperta da cinque anni, la funzionalità viene distribuita in versione Dev dietro un indicatore di funzionalità (feature flag), in attesa di ulteriori test sul motore di rendering della griglia del terminale.
Replit rilancia la sua app mobile
22 luglio — Replit pubblica una revisione della sua app mobile (iOS, rilascio progressivo su Android): home screen ripensata, input vocale per parlare direttamente all’Agent, navigazione tramite swipe tra chat, task e anteprima, e Live Activities iOS che seguono in diretta l’avanzamento dell’agent, anche fuori dall’app.
🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit mobile
Microsoft Asia pubblica Mage-Flow, modello compatto di generazione di immagini
22 luglio — Microsoft Asia pubblica su Hugging Face Mage-Flow, un modello di generazione ed editing di immagini di soli 4 miliardi di parametri, che rivendica una qualità paragonabile a modelli molto più grandi. Sul fronte prestazioni, il modello genera un’immagine in 4 passaggi in meno di un secondo a 1024×1024, e può arrivare fino a 4K. Una demo è disponibile tramite gli Hugging Face Spaces.
Gemini: Galaxy Unpacked 2026 e Gemini 3.5 Pro
Tre novità Gemini lato Samsung
22 luglio — A margine del Galaxy Unpacked 2026, Google dettaglia tre novità Gemini per l’ecosistema Galaxy: un’automazione delle attività estesa a più di 40 applicazioni popolari (spesa, prenotazioni, acquisto di biglietti, in grado di trattare immagini complesse come istruzioni ed eseguirsi in background); Gemini Notebook (il vecchio NotebookLM) preinstallato sulla serie Galaxy Z Fold8, con sei mesi di prova di Google AI Pro inclusi; e Gemini su Galaxy Watch 9 (attivazione con un semplice sollevamento del polso, senza parola chiave di attivazione), con occhiali intelligenti sviluppati con Samsung (montature Gentle Monster e Warby Parker) previsti per l’autunno 2026.
Gemini 3.5 Pro entra nei test con partner
21 luglio — Josh Woodward, VP responsabile di Gemini, conferma che il prossimo modello di punta, Gemini 3.5 Pro, è ufficialmente entrato in fase di test con partner. Non viene fornita alcuna data di disponibilità generale, ma questa conferma colloca Gemini 3.5 Pro come la prossima grande uscita attesa sul fronte dei modelli Gemini.
🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro
Manus lancia Plan Mode
22 luglio — Manus introduce Plan Mode, una fase di revisione strutturata prima dell’esecuzione: invece di partire direttamente con la costruzione, l’agente genera un piano di fattibilità in formato Markdown, con obiettivi, passaggi e vincoli, che l’utente può modificare o far rivedere prima della validazione. L’attivazione avviene tramite / sul web o + su mobile; la modalità può anche essere avviata nel corso di un’attività per pianificare le fasi successive. Disponibile immediatamente per tutti gli utenti, sul web e su mobile, in opt-in.
GitHub Copilot: Canvases e fatturazione
GitHub Copilot lancia le Canvases
21 luglio — GitHub introduce le canvases, spazi di lavoro interattivi all’interno dell’app GitHub Copilot in cui sviluppatori e agenti collaborano in tempo reale: visualizzazione di informazioni complesse, interazioni dirette (clic, modifiche), affinamento tramite iterazioni di prompt. Creazione tramite il comando /create-canvas. Usati illustrati: smistamento di issue con una scansione di card, diagrammi interattivi di architettura, dashboard di worktree, coaching sulla qualità dei prompt, ricerca di conoscenza multi-piattaforma. Un utente ha documentato un caso in cui l’app ha avviato automaticamente una canvas del browser per cliccare fino alla schermata di pagamento e verificare una funzionalità, sostituendo un test Playwright scritto a mano.
Cosa offre Copilot oltre al semplice accesso a un’API
22 luglio — GitHub spiega la propria politica di fatturazione, ora basata su crediti IA addebitati alle tariffe API pubblicate dei modelli. Le completions di codice e le Next Edit Suggestions restano incluse nei piani a pagamento; chat e attività agentiche consumano crediti IA. L’argomento di GitHub: oltre all’accesso al modello, Copilot offre un flusso integrato (issue, repository, pull request, policy organizzative), un consumo di token ridotto a parità di risoluzione dei compiti secondo le sue valutazioni, controlli di policy per gli amministratori e un’infrastruttura agent già collaudata in produzione tramite l’SDK Copilot.
🔗 Canvases — 🔗 Copilot vs accesso API puro
ElevenLabs: ElevenMusic e servizio pubblico ucraino
ElevenLabs introduce Vocals e Styles su ElevenMusic
22 luglio — ElevenLabs aggiunge due funzionalità a ElevenMusic, disponibili anche nei Finetunes di ElevenCreative: le Vocals, che consentono di generare brani originali con la propria voce o con una voce della libreria vocale (caricamento di brani per affinare Music v2 sul proprio timbro, oppure modalità one-shot a partire da una sola registrazione); e gli Styles, per garantire coerenza stilistica su brani completi, compatibili con le Vocals. ElevenLabs precisa che tutti i caricamenti vengono controllati per la conformità ai diritti d’autore.
ElevenLabs equipaggia Obrii (Ucraina) con un assistente vocale per il servizio pubblico per l’impiego
22 luglio — Obrii, il nuovo ecosistema digitale del mercato del lavoro ucraino, lancia il suo primo servizio IA: un assistente vocale sviluppato con ElevenLabs per il servizio pubblico per l’impiego, accessibile 24 ore su 24, anche durante gli allarmi di raid aereo.
“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”
🇮🇹 Con ElevenLabs, abbiamo lanciato un assistente vocale IA per il servizio pubblico per l’impiego, avvicinando i servizi pubblici ai cittadini, 24 ore su 24 e 7 giorni su 7, anche durante gli allarmi di raid aereo. — @C_o_S su X
🔗 Vocals e Styles di ElevenMusic
NVIDIA: simulazione medica, fabbrica in Texas e modelli Cosmos
Framework open source di simulazione fisica medica
22 luglio — NVIDIA pubblica in open source, in NVIDIA Isaac for Healthcare, un framework GPU-accelerato di simulazione di fisica medica, presentato come il primo del suo genere: interazioni tra dispositivo medico (catetere, guida) e anatomia del paziente, combinando simulazione fisica classica e IA generativa (Cosmos-H Dreams). Facendo girare 8 192 ambienti in parallelo, NVIDIA afferma di aver ridotto il tempo di addestramento di politiche robotiche (policies) da più di cinque ore a meno di due minuti. CMR Surgical, Johnson & Johnson MedTech, XCath e Medtronic Structural Heart lo usano già; disponibile da subito su GitHub.
NVIDIA e Wistron aprono uno stabilimento di superchip a Fort Worth
21 luglio — Wistron apre il suo primo stabilimento statunitense, un sito di 30 000 m² a Fort Worth (Texas), che già produce i superchip Grace Blackwell Ultra e in futuro realizzerà i Vera Rubin. Investimento da 700 milioni di dollari, oltre 500 posti di lavoro creati (obiettivo 1 000 entro fine anno), nell’ambito dell’impegno da 500 miliardi di dollari di NVIDIA per la produzione di piattaforme IA negli Stati Uniti.
Cosmos 3 Super, fino a 25 volte più veloce
22 luglio — NVIDIA pubblica Cosmos 3 Super, una variante a 4 step della famiglia Cosmos 3, che genera immagini e video fino a 25 volte più velocemente dei modelli originali, mantenendo al contempo un posizionamento elevato su Artificial Analysis: primo posto in image-to-video (senza audio), secondo posto in text-to-image. Disponibile da subito su Hugging Face.
Resoconto del Nemotron Model Reasoning Challenge su Kaggle
22 luglio — NVIDIA pubblica il resoconto del suo Nemotron Model Reasoning Challenge su Kaggle: oltre 5 000 partecipanti suddivisi in più di 4 000 team, attorno a tecniche per migliorare il ragionamento dei modelli aperti. I team NullSira, vli e YS-L chiudono ai primi tre posti.
🔗 Simulazione medica — 🔗 Stabilimento Wistron — 🔗 Cosmos 3 Super — 🔗 Resoconto Kaggle
Kimi K3: secondo su AA-Briefcase, ma costoso e lento
21 luglio — Artificial Analysis pubblica i risultati di Kimi K3 (Moonshot AI) su AA-Briefcase, il suo benchmark di knowledge work agentico (fogli di calcolo, presentazioni, mockup di interfacce). Il modello ottiene il secondo miglior punteggio registrato, con un salto di oltre 700 punti rispetto alla generazione precedente.
| Modello valutato | Elo AA-Briefcase | Costo medio per attività | Tempo medio per attività |
|---|---|---|---|
| Claude Fable 5 (max) | 1574 | — | — |
| Kimi K3 | 1543 | 10,57 dollari | 56,4 minuti |
| GPT-5.6 Sol (max) | 1501 | — | — |
| Claude Sonnet 5 (max) | 1388 | — | — |
| Claude Opus 4.8 (max) | 1347 | — | — |
| Kimi K2.6 (riferimento) | 816 | ~1 dollaro | — |
Kimi K3 mostra un tasso di successo del 51% nelle griglie di valutazione, appena dietro Claude Fable 5 (56%), con una qualità analitica comparabile ma una qualità di presentazione inferiore. Controparte negativa: un costo medio di 10,57 dollari per attività, circa dieci volte superiore a Kimi K2.6, conseguenza del prezzo del modello, di un uso elevato di token in output e di una media di 83 turni per attività (contro 67 per Claude Fable 5 e 50 per GPT-5.6 Sol).
OpenAI: usi stampa e limiti API
Come le redazioni usano gli strumenti OpenAI
22 luglio — OpenAI pubblica una panoramica degli usi dei suoi strumenti da parte di organizzazioni giornalistiche. L’Associated Press li usa per il reporting, la verifica (tracciamento degli upload, geolocalizzazione, cronolocalizzazione di immagini e video), la trasformazione di migliaia di dossier della Corte Suprema in informazioni strutturate e la conversione di articoli in script per la distribuzione, mantenendo però i giornalisti al comando del giudizio editoriale. POLITICO analizza grandi volumi di documenti pubblici per un reportage originale più rapido; viene citata anche Axios. OpenAI rinnova il suo sostegno all’American Journalism Project e prosegue le partnership con il Lenfest Institute e WAN-IFRA.
Limiti di spesa rigidi estesi a tutti gli account API
22 luglio — OpenAI estende questa settimana a tutti gli account della API Platform l’accesso ai limiti di spesa rigidi (hard spend limits), consentendo a ogni sviluppatore di fissare un tetto al proprio consumo nell’importo desiderato, con monitoraggio dell’uso in tempo reale dalla dashboard.
🔗 Usi stampa — 🔗 Limiti API
Cohere: diacritizzazione araba e modello di codice leggero
Speech Tashkeel 2B e l’ecosistema comunitario Transcribe Arabic
22 luglio — Cohere mette in evidenza Speech Tashkeel 2B, un modello partner sviluppato da NAMAA che converte l’arabo grezzo in testo completamente diacritizzato (marche grammaticali di caso, harakāt, tanwīn, sukūn, shadda), con una versione quantizzata a 4 bit. L’annuncio è accompagnato da contributi della community attorno a Transcribe Arabic, il modello di riconoscimento vocale arabo di Cohere: l’app listen-habibi, un supporto nativo per Ruby e quantizzazioni GGUF/ONNX pubblicate su Hugging Face. Cohere annuncia inoltre una partnership con HUMAIN per estendere questo lavoro ad altre lingue con poche risorse.
North Mini Code, modello di codice leggero ed economico
21 luglio — Cohere presenta North Mini Code, un modello di codice open source progettato per attività ripetitive e poco complesse — debug, creazione di test unitari — posizionato come alternativa economica ai modelli più grandi per contenere i costi di inferenza.
🔗 Speech Tashkeel 2B — 🔗 North Mini Code
Brevi
- Warp pubblica un post sulle tensioni economiche delle startup IA in ipercrescita — analisi di un futuro restringimento dei ricavi per le startup in forte crescita. 🔗 Fonte
- Hugging Face organizza il suo primo evento in Giappone, a Tokyo — presentazione degli strumenti recenti e dei piani dell’azienda per il mercato giapponese, a Otemachi. 🔗 Fonte
- Ai2 pubblica una nuova versione di PaperFinder — strumento di ricerca documentale scientifica elogiato da un ricercatore utente abituale, senza dettagli tecnici comunicati. 🔗 Fonte
- Sakana AI pubblica una presentazione generale di Fugu, «One Model to Command Them All» — post di blog che amplia la portata del modello di orchestrazione oltre la declinazione Fugu-Cyber già trattata. 🔗 Fonte
- Gemini Live — guida della fotocamera per assistenza visiva in tempo reale — puntare la fotocamera verso un oggetto o un documento per ottenere aiuto contestuale senza dover descrivere la situazione per iscritto. 🔗 Fonte
- AlphaFold — nuova applicazione nell’ingegneria proteica in vista dei 5 anni della base — Pushmeet Kohli (Google DeepMind) elogia un uso per colmare zone d’ombra strutturali in biologia. 🔗 Fonte
- Nuova dashboard di impatto delle metriche Copilot (Enterprise) — coorti di adozione (Code-first, Agent-first, Multi-agent, Passive) con indicatori di velocità e merge per utente. 🔗 Fonte
- Copilot Business/Enterprise — visibilità dei crediti IA per ciclo di fatturazione — visualizzazione ora possibile anche senza budget individuale assegnato. 🔗 Fonte
- GHES — imminente irrigidimento del caricamento dei bundle di supporto (18 agosto 2026) — rifiuto degli upload da istanze non patchate; aggiornamento richiesto a 3.21.3, 3.20.5, 3.19.9, 3.18.12 o 3.17.18. 🔗 Fonte
- NVIDIA lancia i moduli Jetson Thor T2000 e T3000 — nuovi moduli per la robotica e l’IA all’edge, senza scheda tecnica dettagliata disponibile in questa fase. 🔗 Fonte
- Cisco lancia Antares, piccoli modelli per il rilevamento di vulnerabilità nel codice — Antares-350M e Antares-1B, disponibili su Hugging Face, eseguibili localmente per evitare di inviare codice sensibile al cloud. 🔗 Fonte
- HeyGen HyperFrames — Giorno 17/30: il flusso Storyboard — piano in tre passaggi (card, schizzi, rendering finale) con revisione tramite commento frame per frame. 🔗 Fonte
- Kling AI pubblica un tutorial MCP per creare performance cinematografiche con gli agenti — flusso creativo completo in un agente: personaggio, emozione, generazione video in batch. 🔗 Fonte
- Una famiglia costruisce una casa sull’albero con ChatGPT come consulente — progettazione strutturale, scelta dei materiali e traduzione delle idee dei bambini in piani realizzabili. 🔗 Fonte
- Codex Live Build — sessione di costruzione in diretta — diretta con i creatori delle tastiere Codex Micro. 🔗 Fonte
- Una giocatrice ricrea le Dolomiti italiane in un videogioco con Codex — mondo aperto «Valdiluce» con arrampicata, volo planato e funivia funzionante. 🔗 Fonte
- Promozione ChatGPT Work — 100 dollari di crediti omaggio — ai primi 10 000 partecipanti che pubblicano su X ciò che apprezzano di ChatGPT Work. 🔗 Fonte
Cosa significa
Il routing dei modelli si sta imponendo come il nuovo terreno di competizione degli strumenti di coding: Cursor Router promette il 60% di risparmio senza perdita di qualità percepibile scegliendo automaticamente il modello giusto per ogni richiesta, mentre Artificial Analysis mostra al contrario che Kimi K3, secondo miglior punteggio nel suo benchmark di knowledge work agentico, costa circa dieci volte più della generazione precedente e richiede quasi un’ora per attività. Il messaggio è lo stesso da entrambe le parti: la potenza bruta di un modello non basta più a giustificarne l’uso, il compromesso costo/qualità/latenza diventa il vero parametro decisionale per i team che distribuiscono questi strumenti su larga scala.
Gli agenti aziendali stanno chiaramente passando da una logica di dimostrazione a una logica di produzione. OpenAI Presence struttura esplicitamente policy, guardrail e escalation umana attorno al ragionamento dei modelli; Synthesia Roleplay Sessions quantifica guadagni concreti di crescita delle competenze in condizioni reali; GitHub Copilot Canvases documenta un caso in cui un agente ha verificato il proprio lavoro fino alla schermata di pagamento, sostituendo test scritti a mano; e Claude Managed Agents aggiunge livelli di effort e webhook pensati per workflow agentici complessi in produzione. Questi annunci convergono verso la stessa esigenza: rendere gli agenti affidabili e pilotabili nel tempo, non solo capaci in una dimostrazione.
Sul fronte istituzionale, la Genesis Mission del DOE illustra una corsa ormai aperta a tre — Google, OpenAI e Arcee AI — per inserirsi nella ricerca scientifica pubblica statunitense, ciascuno con una propria logica: token e crediti cloud per Google, accesso Codex e API per OpenAI, modello aperto governato per Arcee AI. Questa dinamica istituzionale si accompagna a una corsa all’infrastruttura fisica, con Project Camellia (3,2 gigawatt in Georgia) e lo stabilimento di superchip Wistron a Fort Worth (700 milioni di dollari, diverse centinaia di posti di lavoro) che mostrano come capacità di calcolo e radicamento territoriale stiano diventando argomenti di comunicazione a pieno titolo, quantificati e dettagliati pubblicamente.
Infine, la generazione multimodale continua a diversificarsi dal basso e dall’alto: Qwen-Image-3.0 spinge il realismo e l’utilità professionale di un modello di frontiera, mentre Mage-Flow (Microsoft Asia, 4 miliardi di parametri) e Cosmos 3 Super (NVIDIA, fino a 25 volte più veloce) puntano su compattezza e velocità per rendere queste capacità accessibili a costi di calcolo più contenuti. Il caso d’uso ElevenLabs/Obrii in Ucraina ricorda inoltre che queste tecnologie vocali trovano spazio anche in servizi pubblici ad alto impatto sociale, oltre che nei soli casi d’uso commerciali.
Fonti
- Cursor Router — changelog
- OpenAI Presence
- Project Camellia
- Qwen-Image-3.0
- Synthesia Roleplay Sessions
- Google DeepMind — Genesis Mission
- OpenAI — Genesis Mission
- Arcee AI — Genesis-Science-1
- Claude Security
- Anthropic Economic Index — connettore
- Claude Managed Agents
- Claude Code — simulatore iOS
- Amp Multiplayer
- Warp — link OSC 8
- Replit — applicazione mobile
- Microsoft Asia — Mage-Flow
- Galaxy Unpacked 2026 — Gemini
- Gemini 3.5 Pro — test partner
- Manus Plan Mode
- GitHub Copilot — Canvas
- GitHub Copilot vs accesso API grezzo
- ElevenLabs — Vocals e Styles
- ElevenLabs — Obrii Ukraine
- NVIDIA — simulazione fisica medica
- NVIDIA/Wistron — fabbrica di Fort Worth
- NVIDIA — Cosmos 3 Super
- NVIDIA — bilancio Nemotron Reasoning Challenge
- Kimi K3 — AA-Briefcase
- OpenAI — usi stampa
- OpenAI — limiti di spesa API
- Cohere — Speech Tashkeel 2B
- Cohere — North Mini Code