Cerca

Replit lancia Ramp for Agents per agenti finanziari autonomi, GitHub pubblica un dataset multilingue di 40M di repository, HeyGen apre l’output video WebM trasparente

Replit lancia Ramp for Agents per agenti finanziari autonomi, GitHub pubblica un dataset multilingue di 40M di repository, HeyGen apre l’output video WebM trasparente

ai-powered-markdown-translator

Articolo tradotto dal fr al it con gpt-5.4-mini.

Vedi progetto su GitHub ↗

Il 11 luglio, gli agenti escono dal codice per toccare il mondo reale: Replit associa il suo agente a Ramp per costituire una società e gestire in modo autonomo tesoreria, fatture e spese, GitHub pubblica un dataset open source di oltre 40 milioni di repository sulla distribuzione linguistica del codice, e HeyGen mette a segno due annunci per sviluppatori — output video WebM trasparente e montaggio automatico sincronizzato su video parlati. Pika, dal canto suo, dimostra capacità avanzate di editing video tramite un modello che chiama «Gemini Omni», un’attribuzione non confermata da Google ad oggi. Cinque brevi completano il quadro, dalla linea telefonica vocale di Together AI alla partnership infrastrutturale di Cohere con NVIDIA e CoreWeave.


Replit lancia Ramp for Agents: i suoi agenti gestiscono ora le finanze dell’azienda

11 luglio — Replit ha annunciato una partnership con Ramp, piattaforma di gestione finanziaria e carte aziendali, che consente al suo agente di andare oltre la generazione di codice per occuparsi di operazioni finanziarie reali. In concreto, l’agente Replit può ora accompagnare la creazione di una società (incorporation), presentare una richiesta di conto Ramp per questa entità, quindi preparare l’azienda a spendere denaro, pagare le fatture e gestire la tesoreria — il tutto da una conversazione in linguaggio naturale.

Il lancio si inserisce nella continuità della strategia di Replit, che ha già aperto il suo agente all’e-commerce (integrazione Shopify, giugno 2026) e alla reperibilità (SEO Agent, giugno 2026). Il prodotto passa attraverso una pagina dedicata gestita da Ramp, «Finance for the Agent Economy», che fornisce agli agenti carte, bonifici e conti bancari con controlli integrati per limitare ogni dollaro speso.

“Ramp for Agents.

Replit Agent can now incorporate your company, apply for Ramp, and get your business ready to spend, pay bills, and manage money.

Every company used to start with paperwork. The next one starts with a prompt.”

🇮🇹 Ramp for Agents. Replit Agent può ora costituire la tua società, richiedere un conto Ramp e preparare la tua azienda a spendere, pagare le fatture e gestire il denaro. Un tempo ogni impresa iniziava con la burocrazia — la prossima inizia con un prompt.@Replit su X


GitHub pubblica il Multilingual Repositories Dataset

11 luglio — GitHub ha pubblicato il GitHub Multilingual Repositories Dataset, un nuovo set di dati open source destinato a ricercatori e sviluppatori che lavorano sull’IA multilingue. Copre oltre 40 milioni di repository e più di 80 milioni di righe di classificazione, mappando dove vivono i README, le issue e le pull request scritti in una lingua diversa dall’inglese sulla piattaforma.

Indicatore misuratoValore misurato
Repository coperti40M+
Righe di classificazione80M+
Repository README in portoghese (lingua dominante)3M+
Lingua dominante dei testi delle issueCoreano

I numeri evidenziati da GitHub rivelano tendenze linguistiche concrete: il coreano domina i testi delle issue, mentre il portoghese è in testa per i README, con oltre 3 milioni di repository interessati. Non si tratta propriamente di una funzionalità Copilot, ma di una pubblicazione di ricerca e dati aperti, in continuità con il posizionamento di GitHub come piattaforma di sviluppo potenziata dall’IA.

🔗 Tweet @github — Multilingual Repositories Dataset


Pika modifica video con un modello che chiama «Gemini Omni»

11 luglio — Pika ha pubblicato una dimostrazione video che mette in evidenza funzioni di editing avanzate applicate a un video importato dall’utente: cambio dello sfondo, cambio dell’angolo della camera, cambio dell’abbigliamento, aggiunta di effetti visivi e persino doppiaggio della voce in francese — il tutto presentato da Pika come reso possibile «with Gemini Omni».

“Drop in your video and change the background, change the angle, swap the outfit, add visual effects, even make it speak French — all with Gemini Omni”

🇮🇹 Importa il tuo video e cambia lo sfondo, cambia l’angolo, cambia l’abito, aggiungi effetti visivi, fallo persino parlare in francese — il tutto con Gemini Omni.@pika_labs su X

Cautela editoriale: il nome «Gemini Omni» non compare in alcun annuncio ufficiale Google o DeepMind ad oggi — la scansione dedicata agli annunci Gemini non ha rilevato alcuna novità in questo 11 luglio. Si tratta del nome usato da Pika stessa per indicare il modello alla base di questa funzionalità; la sua esistenza e la sua natura esatte non sono state stabilite in modo indipendente. Questa notizia va letta come una funzionalità annunciata da Pika, e non come un lancio di prodotto confermato da Google.

Coinvolgimento moderato per l’account (15.000 visualizzazioni, 80 like), nettamente al di sotto dei principali post di Pika — segno di un annuncio di funzionalità più che di un lancio di prodotto di punta.


HeyGen rafforza il suo ecosistema per sviluppatori: video trasparente e montaggio automatizzato

Due annunci nello stesso giorno per HeyGen, uno sul formato di output video, l’altro sull’automazione del montaggio.

Output video WebM trasparente su API, CLI e MCP

11 luglio — HeyGen ha annunciato una nuova opzione di output video sulla sua API, sulla sua CLI e sul suo server MCP: il formato WebM con canale alpha trasparente. Impostando il parametro output_format: "webm" sull’endpoint /v3/videos, i video avatar generati tornano con uno sfondo realmente trasparente (canale alpha nativo), senza ricorrere a uno sfondo verde (green screen) da ritagliare in seguito.

Questa funzionalità è pensata per gli sviluppatori che compongono video avatar in produzioni più ampie — montaggio, sovrapposizioni, integrazione in scene 3D. Il thread associato illustra un esempio concreto: un avatar compositato direttamente in una scena three.js in stile Minecraft.

🔗 Tweet @HeyGen — output WebM trasparente

La «Talking-Head-Recut Skill» sincronizza la grafica su un video parlato

11 luglio — Sesto episodio di una serie di dimostrazioni quotidiane attorno a HyperFrames, l’ambiente di produzione video pilotato da agente di HeyGen: la «Talking-Head-Recut Skill» sovrappone elementi grafici di abbellimento (titoli animati, contatori, schede, citazioni) su un video di tipo «testa parlante», sincronizzati automaticamente con il discorso pronunciato. L’agente legge la trascrizione, decide quali elementi meritano una grafica, poi disegna ogni scheda secondo il sistema grafico fornito.

La dimostrazione illustra il funzionamento end-to-end a partire da un solo prompt: ricerca di un tema d’attualità (l’annuncio GPT-5.6 di OpenAI), script con fonti, avatar generato direttamente dalla CLI di HeyGen, sistema grafico ripreso in diretta da chatgpt.com, quindi rendering finale con sottotitoli e musica — senza editor video né telecamera. La skill è documentata in open source su GitHub.

🔗 Tweet @HeyGen — Talking-Head-Recut Skill 🔗 GitHub — talking-head-recut skill


Brevi

  • Together AI lancia una linea di chiamata vocale — un tweet minimalista («Why type when you can call?”) rimanda a docs.together.ai/call, che apre un tastierino telefonico (+1 415-723-8167, ext. 676) mettendo in contatto il chiamante con un assistente vocale alimentato dalla piattaforma di inferenza di Together AI, senza articolo di blog associato. 🔗 Tweet @togethercompute
  • Pika mette online un server MCP sperimentaleexperiment.pika.art («Pika MCP – Make Your Agent Creative») permette ad agenti IA di chiamare direttamente dal proprio ambiente agentico le capacità creative di generazione e modifica video di Pika. 🔗 Tweet @pika_labs
  • MiniMax e Fireworks AI ottimizzano il kernel M3 su Blackwell — un nuovo kernel «KV-stationary» sviluppato da Fireworks AI per il modello aperto M3 di MiniMax legge ogni blocco selezionato una sola volta, preservando i guadagni dell’attenzione sparsa (sparse attention) e raggiungendo circa 980 TFLOP/s su un GPU B200. 🔗 Tweet @MiniMax_AI
  • GPT-Live distribuito al 100 % in tutto il mondo — la funzionalità vocale full-duplex di OpenAI, lanciata l’8 luglio, raggiunge il suo rilascio completo su ChatGPT; OpenAI raddoppia temporaneamente il limite di utilizzo vocale per il weekend dell’11-12 luglio. 🔗 Tweet @athyuttamre
  • Cohere mette in evidenza la sua partnership con NVIDIA e CoreWeave — comunicazione istituzionale su X attorno all’affidabilità e alla protezione dell’infrastruttura per le grandi aziende che distribuiscono IA, senza dettaglio tecnico né articolo associato. 🔗 Tweet @cohere

Cosa significa

La produzione video diventa una pipeline interamente pilotata da agente, dal montaggio alla distribuzione. HeyGen elimina una classica fase tecnica — il ritaglio dello sfondo verde — rendendo il canale alpha nativo su API, CLI e MCP, e automatizza la sincronizzazione della grafica sui video parlati tramite la sua Talking-Head-Recut Skill: un solo prompt basta ormai per produrre un video con fonti, grafica e sottotitoli senza telecamera né editor. Pika spinge la stessa logica sul fronte della post-produzione, con un modello che chiama «Gemini Omni» per cambiare sfondo, angolo e abbigliamento di un video esistente — un’attribuzione che, in assenza di conferma ufficiale Google, illustra anche una tendenza a soprannominare i blocchi tecnici per conferirgli un’aura di potenza, da prendere con la dovuta prudenza.

Gli agenti escono dal codice per occuparsi dell’amministrazione e delle finanze di un’azienda. Ramp for Agents consente all’agente di Replit di costituire una società, aprire un conto Ramp e gestire tesoreria e fatture — un territorio che, finora, restava rigorosamente umano. Lo stesso movimento si ritrova, in scala più piccola, nel Pika MCP, che apre le capacità creative di Pika ad agenti IA terzi tramite un server MCP sperimentale: l’agente non si limita più a produrre, orchestra servizi di terze parti per conto dell’utente.

Le fondamenta dell’IA multilingue e dell’inferenza su larga scala continuano ad aprirsi. Il Multilingual Repositories Dataset di GitHub documenta, su scala di 40 milioni di repository, dove vivono realmente il coreano, il portoghese e le altre lingue del codice mondiale — una risorsa per ogni ricercatore che lavori su modelli multilingue. Il kernel KV-stationary sviluppato da Fireworks AI per l’M3 di MiniMax illustra lo stesso lavoro infrastrutturale sul fronte dell’inferenza, preservando su Blackwell i guadagni teorici dell’attenzione sparsa. La partnership rafforzata di Cohere con NVIDIA e CoreWeave completa il quadro: l’affidabilità dell’infrastruttura diventa un argomento di vendita a sé stante per l’IA enterprise.

La voce si sta affermando come canale di prodotto a sé, più che come semplice funzione accessoria. GPT-Live raggiunge il rilascio completo presso OpenAI appena tre giorni dopo il lancio, con limiti raddoppiati per incoraggiare le prove; Together AI, dal canto suo, apre una linea telefonica che collega direttamente il chiamante a un assistente vocale alimentato dalla sua piattaforma di inferenza. Due approcci diversi — uno integrato in un’app esistente, l’altro accessibile da un telefono tradizionale — per la stessa scommessa: l’interfaccia vocale diventa un punto di accesso a pieno titolo ai modelli, non solo un’opzione tra le altre.


Fonti