Pesquisar

Replit lança Ramp for Agents para agentes financeiros autônomos, GitHub publica um dataset multilíngue de 40 milhões de repositórios, HeyGen abre a saída de vídeo WebM transparente

Replit lança Ramp for Agents para agentes financeiros autônomos, GitHub publica um dataset multilíngue de 40 milhões de repositórios, HeyGen abre a saída de vídeo WebM transparente

ai-powered-markdown-translator

Artigo traduzido do fr para o pt com gpt-5.4-mini.

Ver projeto no GitHub ↗

Em 11 de julho, os agentes saem do código para tocar o mundo real: a Replit associa seu agente ao Ramp para incorporar uma empresa e gerir tesouraria, faturas e despesas de forma autônoma, a GitHub publica um dataset open source de mais de 40 milhões de repositórios sobre a distribuição linguística do código, e a HeyGen emenda dois anúncios para desenvolvedores — saída de vídeo WebM transparente e montagem automática sincronizada em vídeos falados. A Pika, por sua vez, demonstra capacidades avançadas de edição de vídeo por meio de um modelo que ela chama de « Gemini Omni », uma atribuição ainda não confirmada pelo Google até o momento. Cinco breves completam o panorama, da linha de chamada de voz da Together AI à parceria de infraestrutura da Cohere com a NVIDIA e a CoreWeave.


Replit lança Ramp for Agents: seus agentes agora gerenciam as finanças da empresa

11 de julho — A Replit anunciou uma parceria com a Ramp, plataforma de gestão financeira e cartões corporativos, permitindo que seu agente vá além da geração de código para assumir tarefas financeiras reais. Na prática, o agente da Replit agora pode acompanhar a criação de uma empresa (incorporação), enviar uma solicitação de conta Ramp para essa entidade e, então, preparar a empresa para gastar dinheiro, pagar faturas e gerenciar seu caixa — tudo a partir de uma conversa em linguagem natural.

O lançamento se insere na continuidade da estratégia da Replit, que já havia aberto seu agente ao e-commerce (integração com Shopify, junho de 2026) e à descoberta (SEO Agent, junho de 2026). O produto passa por uma página dedicada operada pela Ramp, « Finance for the Agent Economy », que fornece aos agentes cartões, transferências e contas bancárias com controles integrados para enquadrar cada dólar gasto.

“Ramp for Agents.

Replit Agent can now incorporate your company, apply for Ramp, and get your business ready to spend, pay bills, and manage money.

Every company used to start with paperwork. The next one starts with a prompt.”

🇵🇹 Ramp for Agents. O agente da Replit agora pode incorporar sua empresa, solicitar uma conta Ramp e preparar seu negócio para gastar, pagar faturas e gerenciar dinheiro. Toda empresa costumava começar com papelada — a próxima começa com um prompt.@Replit no X


GitHub publica o Multilingual Repositories Dataset

11 de julho — A GitHub publicou o GitHub Multilingual Repositories Dataset, um novo conjunto de dados open source destinado a pesquisadores e desenvolvedores que trabalham com IA multilíngue. Ele cobre mais de 40 milhões de repositórios e mais de 80 milhões de linhas de classificação, mapeando onde vivem os README, issues e pull requests escritos em uma língua diferente do inglês na plataforma.

Indicador medidoValor medido
Repositórios cobertos40M+
Linhas de classificação80M+
Repositórios README em português (língua dominante)3M+
Língua dominante dos textos de issuesCoreano

Os números destacados pela GitHub revelam tendências linguísticas concretas: o coreano domina os textos de issues, enquanto o português lidera nos README, com mais de 3 milhões de repositórios envolvidos. Não se trata propriamente de um recurso do Copilot, mas de uma publicação de pesquisa e dados abertos, em continuidade com o posicionamento da GitHub como plataforma de desenvolvimento impulsionada por IA.

🔗 Tweet @github — Multilingual Repositories Dataset


Pika edita vídeos com um modelo que ela chama de « Gemini Omni »

11 de julho — A Pika publicou uma demonstração em vídeo destacando funções avançadas de edição aplicadas a um vídeo importado pelo usuário: mudança de fundo, mudança de ângulo de câmera, mudança de roupa, adição de efeitos visuais e até dublagem da voz em francês — tudo apresentado pela Pika como possível « with Gemini Omni ».

“Drop in your video and change the background, change the angle, swap the outfit, add visual effects, even make it speak French — all with Gemini Omni”

🇵🇹 Importe seu vídeo e mude o fundo, mude o ângulo, mude a roupa, adicione efeitos visuais, faça-o até falar francês — tudo com Gemini Omni.@pika_labs no X

Cautela editorial: o nome « Gemini Omni » não aparece em nenhum anúncio oficial da Google ou da DeepMind até o momento — a varredura dedicada aos anúncios Gemini não identificou nenhuma notícia nesta 11 de julho. Trata-se do nome usado pela própria Pika para designar o modelo subjacente a essa funcionalidade; sua existência e natureza exatas não foram estabelecidas de forma independente. Esta notícia deve ser lida como uma funcionalidade anunciada pela Pika, e não como um lançamento de produto confirmado pela Google.

Engajamento moderado da conta (15 mil visualizações, 80 curtidas), bem abaixo das publicações principais da Pika — sinal de um anúncio de funcionalidade em vez de um lançamento de produto carro-chefe.


HeyGen fortalece seu ecossistema de desenvolvedores: vídeo transparente e montagem automatizada

Dois anúncios no mesmo dia para a HeyGen, um sobre o formato de saída de vídeo, outro sobre a automação da edição.

Saída de vídeo WebM transparente na API, CLI e MCP

11 de julho — A HeyGen anunciou uma nova opção de saída de vídeo em sua API, sua CLI e seu servidor MCP: o formato WebM com canal alpha transparente. Ao definir o parâmetro output_format: "webm" no endpoint /v3/videos, os vídeos de avatar gerados retornam com um fundo realmente transparente (canal alpha nativo), sem recorrer a um fundo verde (green screen) para recorte posterior.

Essa funcionalidade mira desenvolvedores que compõem vídeos de avatar em produções maiores — montagem, sobreposições, integração em cenas 3D. O thread associado ilustra um exemplo concreto: um avatar composto diretamente em uma cena three.js no estilo Minecraft.

🔗 Tweet @HeyGen — saída WebM transparente

A « Talking-Head-Recut Skill » sincroniza os gráficos em um vídeo falado

11 de julho — Sexto episódio de uma série de demonstrações diárias em torno de HyperFrames, o ambiente de produção de vídeo conduzido por agente da HeyGen: a « Talking-Head-Recut Skill » sobrepõe gráficos de identidade visual (títulos animados, contadores, cartões, citações) a um vídeo do tipo “cabeça falante”, sincronizados automaticamente com o discurso proferido. O agente lê a transcrição, decide quais elementos merecem um gráfico e, em seguida, desenha cada cartão na identidade visual fornecida.

A demonstração ilustra o funcionamento de ponta a ponta a partir de um único prompt: busca de um tema de atualidade (o anúncio GPT-5.6 da OpenAI), roteiro com fontes, avatar gerado diretamente pela CLI da HeyGen, identidade visual recuperada ao vivo de chatgpt.com e, por fim, renderização com legendas e música — sem editor de vídeo nem câmera. A skill é documentada em open source no GitHub.

🔗 Tweet @HeyGen — Talking-Head-Recut Skill 🔗 GitHub — talking-head-recut skill


Breves

  • Together AI lança uma linha de chamada de voz — um tweet minimalista (“Why type when you can call?”) leva a docs.together.ai/call, que abre um discador telefônico (+1 415-723-8167, ext. 676) conectando quem liga a um assistente de voz impulsionado pela plataforma de inferência da Together AI, sem artigo de blog associado. 🔗 Tweet @togethercompute
  • Pika coloca no ar um servidor MCP experimentalexperiment.pika.art (“Pika MCP – Make Your Agent Creative”) permite que agentes de IA chamem diretamente, a partir de seu ambiente agêntico, as capacidades criativas de geração e edição de vídeo da Pika. 🔗 Tweet @pika_labs
  • MiniMax e Fireworks AI otimizam o kernel M3 no Blackwell — um novo kernel « KV-stationary » desenvolvido pela Fireworks AI para o modelo aberto M3 da MiniMax lê cada bloco selecionado apenas uma vez, preservando os ganhos da atenção esparsa (sparse attention) e alcançando cerca de 980 TFLOP/s em uma GPU B200. 🔗 Tweet @MiniMax_AI
  • GPT-Live implantado a 100 % no mundo todo — a funcionalidade de voz full-duplex da OpenAI, lançada em 8 de julho, atinge sua implantação completa no ChatGPT; a OpenAI dobra temporariamente o limite de uso de voz para o fim de semana de 11-12 de julho. 🔗 Tweet @athyuttamre
  • Cohere destaca sua parceria com NVIDIA e CoreWeave — comunicação institucional no X sobre a confiabilidade e a proteção da infraestrutura para grandes empresas que implantam IA, sem detalhes técnicos nem artigo associado. 🔗 Tweet @cohere

O que isso significa

A produção de vídeo está se tornando um pipeline totalmente conduzido por agente, da edição à distribuição. A HeyGen elimina uma etapa técnica clássica — o recorte do fundo verde — ao tornar o canal alpha nativo disponível em API, CLI e MCP, e automatiza a sincronização de gráficos em vídeos falados por meio da sua Talking-Head-Recut Skill: um único prompt agora basta para produzir um vídeo com fontes, identidade visual e legendas, sem câmera nem editor. A Pika empurra a mesma lógica para o pós-produção, com um modelo que ela chama de « Gemini Omni » para alterar fundo, ângulo e roupa de um vídeo existente — uma atribuição que, por falta de confirmação oficial da Google, também ilustra uma tendência a dar apelidos a blocos técnicos para lhes conferir um verniz de potência, algo a ser visto com a cautela devida.

Os agentes estão saindo do código para tocar a parte administrativa e financeira de uma empresa. O Ramp for Agents permite que o agente da Replit incorpore uma empresa, abra uma conta Ramp e gerencie tesouraria e faturas — um território que, até aqui, permanecia estritamente humano. O mesmo movimento aparece, em menor escala, no Pika MCP, que abre as capacidades criativas da Pika a agentes de IA terceirizados por meio de um servidor MCP experimental: o agente não se limita mais a produzir, ele orquestra serviços de terceiros em nome do usuário.

As bases da IA multilíngue e da inferência em larga escala continuam a se abrir. O Multilingual Repositories Dataset da GitHub documenta, na escala de 40 milhões de repositórios, onde realmente vivem o coreano, o português e as outras línguas do código mundial — um recurso para qualquer pesquisador que trabalhe com modelos multilíngues. O kernel KV-stationary desenvolvido pela Fireworks AI para o M3 da MiniMax ilustra o mesmo trabalho de infraestrutura do lado da inferência, preservando no Blackwell os ganhos teóricos da atenção esparsa. A parceria reforçada da Cohere com NVIDIA e CoreWeave completa esse quadro: a confiabilidade da infraestrutura se torna um argumento de venda por si só para a IA empresarial.

A voz se estabelece como um canal de produto por direito próprio, em vez de uma simples funcionalidade secundária. O GPT-Live atinge sua implantação completa na OpenAI apenas três dias após o lançamento, com limites dobrados para incentivar o teste; a Together AI, por sua vez, abre uma linha telefônica ligando diretamente quem chama a um assistente de voz impulsionado por sua plataforma de inferência. Duas abordagens diferentes — uma integrada a um aplicativo já existente, outra acessível a partir de um telefone convencional — para a mesma aposta: a interface de voz se torna um ponto de entrada completo para os modelos, e não apenas uma opção entre outras.


Fontes