Pesquisar

NVIDIA capta 500 mil milhões de dólares para a sua infraestrutura de IA, Alibaba publica Qwen3.8-2.4T-A95B em pesos abertos, Zed lança Delta

Artigo gerado por inteligência artificial
NVIDIA capta 500 mil milhões de dólares para a sua infraestrutura de IA, Alibaba publica Qwen3.8-2.4T-A95B em pesos abertos, Zed lança Delta

ai-powered-markdown-translator

Artigo traduzido do fr para o pt com gpt-5.4-mini.

Ver projeto no GitHub ↗

Em 12 de agosto de 2026, a NVIDIA anuncia parcerias de financiamento que ultrapassam 500 mil milhões de dólares para construir a infraestrutura de IA da próxima década, enquanto a Alibaba publica os pesos abertos de Qwen3.8-2.4T-A95B, o seu modelo de raciocínio com 2,4 biliões de parâmetros. A Zed apresenta Delta, um ambiente multijogador para programar com agentes, a Google DeepMind lança SL2T para traduzir linguagem gestual em texto no Pixel 11, e a Suno assina uma parceria global com a BMG. No menu também: novos modelos abertos na Cohere e na Liquid AI, avanços no lado das ferramentas de desenvolvimento (Devin, Replit, GitHub Copilot) e um estudo da OpenAI sobre a adoção da IA agêntica nas empresas.


NVIDIA mobiliza mais de 500 mil milhões de dólares para a infraestrutura de IA

12 de agosto — A NVIDIA anuncia parcerias com seis grandes atores da finança e do investimento — Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs e KKR — para criar plataformas de financiamento independentes destinadas a mobilizar mais de 500 mil milhões de dólares em capital de terceiros. O objetivo: sustentar ao longo do tempo a construção das « AI factories », os enormes datacenters dedicados ao treino e à inferência dos modelos.

A NVIDIA apresenta este movimento como uma viragem estrutural para a indústria: o financiamento da implementação de capacidades de computação de IA já não dependeria apenas dos balanços das próprias empresas tecnológicas, mas passaria agora a apoiar-se em veículos de financiamento dedicados, liderados por instituições financeiras de primeiro plano em vez de pelas próprias grandes empresas do setor.

Este anúncio inscreve-se na continuidade de outras iniciativas da NVIDIA sobre a infraestrutura detalhadas nestes últimos dias: a arquitetura de alimentação a 800 volts em corrente contínua para as futuras gerações de aceleradores e o programa NSF de centros regionais dedicados à IA nos Estados Unidos. Ele confirma a dimensão das necessidades de capital para sustentar a procura de computação, num momento em que a corrida à infraestrutura de IA se acelera entre todos os grandes fornecedores de cloud.

🔗 Publicação oficial da NVIDIA


Alibaba publica os pesos abertos de Qwen3.8-2.4T-A95B, modelo de raciocínio com 2 400 mil milhões de parâmetros

12 de agosto — A Alibaba publica os pesos abertos de Qwen3.8-2.4T-A95B, o modelo principal anunciado como intenção no início de agosto sob o nome Qwen3.8-Max. Trata-se aqui do lançamento efetivo dos pesos: um modelo Mixture-of-Experts de granularidade fina que totaliza 2 400 mil milhões de parâmetros, dos quais 95 mil milhões ativos por token, concebido para cargas de raciocínio e agênticas exigentes.

A arquitetura alterna camadas de atenção completa e atenção linear: as primeiras asseguram a interação token a token, as segundas apoiam-se num estado recorrente limitado para controlar a memória à medida que o contexto cresce. O modelo suporta uma janela de contexto até 1 milhão de tokens, com um comprimento de saída até 128K tokens, e integra um controlo de profundidade de raciocínio configurável (low/high/xhigh) para arbitrar entre custo de computação e qualidade da resposta consoante a tarefa.

A NVIDIA, que detalha a implementação numa publicação técnica dedicada, relata um débito nativo superior a 4 000 tokens por segundo e por GPU num GB300 NVL72 (72 GPU Blackwell Ultra) em precisão FP8, com otimizações NVFP4 previstas para breve.

Indicador medidoValor medido
Parâmetros totais / ativos2 400 mil milhões / 95 mil milhões
Janela de contextoaté 1 milhão de tokens
Débito por GPUmais de 4 000 tokens/s (GB300 NVL72, FP8)
Débito por utilizadormais de 350 tokens/s
Disponibilidade dos pesosHugging Face, ModelScope

Os pesos estão disponíveis em Hugging Face e ModelScope, com implementação suportada por SGLang, vLLM, NVIDIA Dynamo e NVIDIA NIM; o fine-tuning é possível através de NVIDIA NeMo AutoModel (LoRA e SFT).

🔗 Anúncio da NVIDIA no X · Publicação técnica da NVIDIA


Zed lança Delta, ambiente multijogador para programar com agentes

12 de agosto — A Zed apresenta Delta, um ambiente multijogador para programar com agentes e rever o que eles produzem. O produto assenta em DeltaDB, a base de dados apresentada em acesso antecipado no início de julho sob a designação « Google Docs para código ». Delta é a sua primeira aplicação concreta, com os primeiros convites para uma beta privada enviados a partir de 12 de agosto.

No Delta, a conversa com o agente torna-se ela própria um documento: o cursor funciona em todo o fio da conversa, com os mesmos atalhos de teclado que no editor de código. Para responder a um ponto específico, basta colocar o cursor sobre ele e começar a escrever, sem que nada fique fora de alcance no thread.

A revisão faz-se no mesmo lugar onde o trabalho teve lugar: o agente que escreveu o código permanece presente no thread, o que permite fazer-lhe diretamente uma pergunta em vez de reconstituir a sua intenção a partir de um diff. Um thread é partilhado com um clique, e os colegas participam nele como intervenientes de pleno direito — podem explorar o histórico, coeditar prompts, ou retomar o trabalho vários dias mais tarde sem se perguntarem se o último código foi mesmo commitado.

Delta is built on DeltaDB, which keeps your code and conversation in sync for everyone in the thread, in real-time. It works with the git repo you already have. Every edit and conversation is captured between your commits.

🇵🇹 O Delta baseia-se no DeltaDB, que mantém o código e a conversa sincronizados em tempo real para toda a gente no thread. Funciona com o repositório git que já tem. Cada edição e cada conversa são capturadas entre os seus commits.@zeddotdev no X

A Zed alargará os convites gradualmente nas próximas semanas; as inscrições na lista de espera estão abertas.

🔗 Anúncio no X


SL2T: a Google DeepMind traduz a linguagem gestual em texto no Pixel 11

12 de agosto — A Google DeepMind apresenta SL2T (sign-language-to-text), um modelo que converte a linguagem gestual diretamente em texto escrito. A funcionalidade chega ao Android: os utilizadores podem agora fazer gestos diretamente no Gboard e no Live Transcribe em vez de escrever, para pesquisa na web, redação de mensagens ou pedidos enviados ao Gemini.

Tecnicamente, o sistema baseia-se num modelo MediaPipe Holistic executado on-device, que segue as posições do corpo (mãos, braços, tronco, cabeça, rosto) em vez de registar o vídeo bruto — o vídeo original é imediatamente eliminado, e apenas as coordenadas geométricas das poses são enviadas aos servidores para tradução. Esta escolha protege a privacidade ao mesmo tempo que permite uma tradução direta das coordenadas para texto, sem passar por anotações intermédias que até agora limitavam a precisão dos sistemas existentes.

O modelo foi treinado com mais de 100 000 horas de dados cobrindo mais de 50 línguas gestuais, das quais cerca de 25% em língua gestual americana (ASL). No benchmark FLEURS-ASL, o SL2T atinge uma pontuação zero-shot de 70 BLEURT, que a Google DeepMind qualifica como significativamente superior a qualquer pontuação anteriormente reportada.

O desenvolvimento envolveu a comunidade surda em todas as etapas através de um comité consultivo dedicado, que co-redigiu um relatório de impacto conjunto detalhando as capacidades e os limites do sistema. A funcionalidade começa com ASL para inglês no Pixel 11, com outros dispositivos e línguas gestuais previstos para o futuro.

SL2T is state-of-the-art on academic benchmarks, plus it’s optimized for real-world use like one-handed signing while holding a phone. To protect privacy, it tracks body poses on-device, while our servers translate them into text.

🇵🇹 O SL2T está no estado da arte nos benchmarks académicos e está otimizado para uso real, como fazer sinais com uma só mão enquanto segura o telefone. Para proteger a privacidade, segue as poses do corpo no dispositivo, enquanto os nossos servidores traduzem esses dados em texto.@GoogleDeepMind no X

🔗 Anúncio oficial da Google DeepMind


Suno anuncia uma parceria global com a BMG

12 de agosto — A Suno anuncia uma parceria global com a BMG (Bertelsmann Music Group), uma das principais editoras discográficas e sociedades de edição musical do mundo. A empresa qualifica o acordo como um « landmark » (marco) para a construção de um ecossistema criativo que associa artistas e autores-compositores em vez de os contornar.

Esta parceria insere-se num contexto particular: a Suno foi alvo de processos em 2024-2025 por parte das três grandes editoras discográficas — Universal Music Group, Warner Music Group e Sony Music — por utilização não autorizada de gravações protegidas no treino dos seus modelos. Um acordo com a BMG marca, portanto, uma viragem estratégica para relações de licenciamento negociadas com a indústria musical em vez de uma relação de força judicial, uma tendência já iniciada no lado do vídeo com o acordo entre a Runway e a Bertelsmann em julho — da qual a BMG faz precisamente parte.

O comunicado não detalha os termos financeiros nem o perímetro exato do acordo (catálogo disponível para treino, remuneração dos titulares de direitos, ferramentas propostas aos artistas da BMG). Esses elementos continuam por уточar através das próximas comunicações oficiais da Suno e da BMG.

🔗 Anúncio no X


Ferramentas de desenvolvimento agêntico: Devin, Replit, VS Code e JetBrains

Várias ferramentas de desenvolvimento assistidas por IA avançam em paralelo neste 12 de agosto, entre novos modelos disponíveis, controlo da infraestrutura e padronização de plugins de agentes.

Grok 4.6 disponível no Devin, Cognition coloca-o atrás de Opus 5 e Fable 5

A Cognition adiciona Grok 4.6 (xAI, anunciado no mesmo dia) como modelo disponível no Devin. A equipa posiciona-o como uma melhoria significativa face ao Grok 4.5, classificando-o à frente do GPT-5.6 Sol e logo atrás de Opus 5 e Fable 5 no seu próprio ranking interno. A Cognition destaca uma força particular na exploração aprofundada de código e na análise da causa raiz antes de qualquer modificação — um ponto útil para tarefas de debugging complexas em que o Devin precisa de compreender um sistema antes de lhe tocar.

🔗 Anúncio no X

Replit permite escolher a região de alojamento dos workspaces (Pro/Enterprise)

A Replit abre aos clientes Pro e Enterprise a escolha da região de alojamento para os novos workspaces, entre América do Norte, Europa e Ásia. O objetivo é duplo: reduzir a latência percecionada durante o desenvolvimento e dar controlo sobre a localização dos dados e dos previews das aplicações publicadas, um ponto frequentemente exigido em contexto empresarial (conformidade, proximidade dos utilizadores). A funcionalidade junta-se à possibilidade já existente de escolher a região das aplicações publicadas e fica disponível de imediato para as contas elegíveis.

🔗 Anúncio no X

Agent Plugins 1.0 chega ao VS Code, Copilot CLI e à app Copilot

O standard aberto Agent Plugins 1.0, publicado a 6 de agosto com AWS, Anysphere (Cursor), Microsoft, OpenAI e Vercel — e desde então juntando-se a Google como mantenedora — chega agora ao VS Code, Copilot CLI e à app Copilot. Um plugin empacotado uma única vez (competências do agente + servidores MCP) torna-se instalável a partir do marketplace Awesome Copilot e funciona sem modificação em vários clientes compatíveis, sem migração obrigatória para os plugins Copilot existentes. Para as empresas, a governação passa por managed-settings.json, disponível nos planos Copilot Business e Enterprise.

🔗 Changelog do GitHub

Copilot para JetBrains ganha memória persistente e acesso ao Ollama local

O GitHub Copilot para JetBrains recebe uma grande atualização: a memória persistente permite agora conservar e recordar informações úteis de uma sessão de chat de agente para a outra, evitando repetir o contexto do projeto ou as suas preferências. Outra adição notável, o Ollama torna-se um fornecedor BYOK (Bring Your Own Key), dando acesso a modelos executados localmente diretamente no seletor de modelos da JetBrains. As empresas ganham também controlos do servidor sobre a disponibilidade dos plugins, o acesso MCP e o comportamento de contorno das permissões.

🔗 Changelog do GitHub


Modelos abertos e IA embarcada

No lado dos modelos, vários laboratórios publicam em sequência versões abertas otimizadas para inferência local e compreensão de documentos.

Hugging Face: Transformers.js ultrapassa 10 milhões de downloads mensais

Clément Delangue, CEO da Hugging Face, anuncia que Transformers.js, a biblioteca que permite executar modelos de IA diretamente no navegador, ultrapassa a marca dos 10 milhões de downloads mensais — um crescimento próximo de 10x em apenas seis meses, desenvolvido internamente ao longo de três anos. Delangue relaciona este crescimento com uma tendência mais ampla: a deslocação de uma parte crescente das cargas de trabalho de IA para o local, por razões de custo, privacidade e resiliência face à escassez de computação. A mensagem não contém detalhes técnicos adicionais: trata-se de um anúncio de tração num projeto já existente.

🔗 Tweet oficial

Ai2: OlmoEarth Studio passa agora a permitir a exportação de embeddings personalizados

A Ai2 (Allen Institute for AI) adiciona ao OlmoEarth Studio o cálculo e a exportação de vetores de embeddings de observação da Terra, em três variantes: Nano (128 dimensões, 1,4 milhão de parâmetros), Tiny (192 dimensões, 6,2 milhões) e Base (768 dimensões, 89 milhões). Os vetores, armazenados em Cloud-Optimized GeoTIFF, podem ser diretamente utilizados nas ferramentas SIG padrão (QGIS, GDAL, rasterio). Os casos de uso demonstrados incluem a pesquisa por similaridade, a segmentação few-shot — um mapa de ocupação do solo treinado com 60 pixels anotados atinge um F1 ponderado de 0,84 — e a deteção de alteração temporal. Os modelos e o código são publicados em Hugging Face e GitHub.

🔗 Publicação no Hugging Face

Liquid AI: LFM2.5-VL-3B, modelo visão-linguagem para o edge

A Liquid AI publica LFM2.5-VL-3B, um modelo visão-linguagem de 3,1 mil milhões de parâmetros otimizado para inferência no dispositivo. Ele combina um codificador visual SigLIP2 400M com um backbone de texto de 2,6 mil milhões de parâmetros, treinado em cerca de 34 000 mil milhões de tokens. Nos benchmarks, obtém 81,0% em MMBench (contra 80,0% para a versão anterior), 87,9% no grounding RefCOCO e 91,1% em DocVQA. Do lado da velocidade: 228 tokens/segundo em CPU (M5 Max) e 20 tokens/segundo em móvel (Galaxy S26 Ultra), para uma pegada de memória de cerca de 3 GB. O modelo está disponível no Hugging Face com integrações llama.cpp, MLX, vLLM e SGLang.

🔗 Publicação no Hugging Face

Cohere lança North Micro Vision, seu menor modelo de visão-linguagem

Cohere amplia sua família de modelos North com North Micro Vision, seu menor modelo de visão-linguagem até agora. Este modelo de 2,4 bilhões de parâmetros foi projetado para a compreensão sofisticada de documentos e lançado em open source sob a licença Apache 2.0, com os pesos disponíveis no Hugging Face. Apesar do tamanho reduzido, ele inclui processamento visual em resolução nativa, conversas multi-turno combinando imagem e texto, raciocínio espacial e compreensão de imagens multilíngue. A Cohere afirma que ele supera o Gemma 4 E2B e o Ministral 3 3B em uma ampla gama de benchmarks de compreensão visual, sem divulgar números precisos no anúncio.

🔗 Anúncio no X


Assistentes conectados: Gemini e Runway ampliam suas integrações

Gemini adiciona 14 novos aplicativos conectados

O Google amplia a lista de aplicativos conectáveis diretamente ao Gemini nas configurações: 14 novos serviços entram no catálogo, entre eles Zoho Bigin, Granola, Wix, GetYourGuide, Ticketmaster, OpenTable, Pandora, iHeartRadio, Thumbtack, Zocdoc e Otter.ai. Depois que o serviço é conectado, basta pedir ao Gemini, por exemplo, «Encontre uma consulta com o oftalmo perto do trabalho no Zocdoc» para que o assistente interaja diretamente com o serviço. A implementação ocorre gradualmente ao longo das próximas semanas, dando continuidade à estratégia do Google de fazer do Gemini um ponto de entrada único para múltiplos serviços de terceiros.

🔗 Anúncio oficial do Google

Runway conecta Agent ao Figma, Dropbox e Notion

Runway adiciona conectores Figma, Dropbox e Notion ao Agent, seu assistente de produção integrado à plataforma, para evitar que os ativos criativos permaneçam isolados em ferramentas separadas. O Agent agora pode sincronizar diretamente designs, arquivos e documentos dessas plataformas de terceiros para um espaço de trabalho único. Essa funcionalidade está disponível em todos os planos pagos, em continuidade à estratégia da Runway de fazer do Agent um hub central de produção de mídia conectado ao ecossistema de ferramentas já existente das equipes criativas.

🔗 Anúncio no X


Estudo da OpenAI sobre a adoção da IA agentiva nas empresas

A OpenAI publica dois estudos complementares sobre o uso corporativo da IA: «Enterprise Signals», um panorama prático da IA agentiva entre seus clientes, e um working paper complementar sobre a difusão da adoção entre empresas, funções e níveis de senioridade. A constatação central: o uso está migrando da assistência para a execução. Em junho, Codex gerou 64% do volume combinado de tokens produzidos por Codex e ChatGPT entre clientes corporativos. A diferença cresce entre as empresas mais avançadas e as demais: as «frontier firms» (top 10% em uso mensal) agora geram 8,3 vezes mais tokens de saída por usuário ativo do que as empresas típicas, contra uma relação de 2,6 em janeiro. Desde fevereiro, os usuários semanais de Codex em empresas aumentaram 108 vezes na área jurídica e 41 vezes em vendas, contra um fator 5 em engenharia.

🔗 Estudo completo da OpenAI


Breves

  • Grok 4.6 disponível no v0 (Vercel) — no mesmo dia de seu anúncio pela xAI, o v0 adiciona o Grok 4.6 ao seletor de modelos para geração de aplicativos. 🔗 Tweet
  • Open_MOSS publica versões FP8/NF4 do MOSS-VL — versões quantizadas do MOSS-VL-Instruct e do MOSS-VL-Realtime para inferência local com apenas 24 GB de VRAM. 🔗 Tweet
  • Google AI Studio oferece um visualizador 3D para o eclipse solar total de 12 de agosto — acompanhamento em tempo real da sombra da Lua sobre o globo, com simulação do céu local a partir de Reykjavík ou Valencia. 🔗 Tweet
  • GitHub Enterprise Server 3.22 em release candidate — Copilot CLI em ambiente desconectado, Enterprise Teams em disponibilidade geral, controles refinados para secret scanning e rulesets. 🔗 Changelog
  • Rule insights disponível no nível de organização (prévia pública) — o painel de auditoria dos rulesets se expande além do nível de repository, com exportação CSV. 🔗 Changelog
  • Migração automática das regras de proteção de branch para rulesets — um botão «Convert to ruleset» traduz automaticamente uma regra clássica em um ruleset equivalente. 🔗 Changelog
  • Seedance 2.5 chega ao agente de vídeo de IA da Genspark — geração de 30 segundos em uma única passagem, até 30 imagens e 10 clipes de vídeo/áudio em referência. 🔗 Tweet
  • Genspark na Grant Thornton — geração de propostas acelerada — a consultoria gera respostas a licitações a partir de um único prompt, com revisão humana sistemática. 🔗 Tweet
  • GitHub Monthly Enterprise Roundup — edição de agosto de 2026 — o roundup destaca a passagem da IA da conclusão de código para workflows de engenharia governados de ponta a ponta. 🔗 Tweet
  • LTX-2.5 disponível no Runway — o world model aberto da Lightricks, lançado em 11 de agosto, entra no catálogo de modelos do Runway. 🔗 Tweet
  • FLUX 3 disponível no Luma — o primeiro modelo multimodal unificado da Black Forest Labs (imagem, vídeo, áudio) chega ao Luma, com geração de vídeo para áudio nativa. 🔗 Tweet
  • Nemotron 3.5 Lightning disponível na API Agent da Perplexity — o modelo aberto 30B MoE da NVIDIA entra na camada de execução de alto volume dos agentes da Perplexity. 🔗 Tweet
  • Qwen-Image-3.0 disponível no OpenArt — o modelo de geração de imagens da Alibaba amplia sua distribuição para uma nova plataforma de terceiros. 🔗 Tweet
  • Qwen3.8-Max sobe para o 4.º lugar no Legal Research Bench — o modelo passa da 22.ª para a 4.ª posição nesse ranking especializado em pesquisa jurídica. 🔗 Tweet
  • Os modelos Daybreak (cibersegurança) disponíveis via Amazon Bedrock — Daybreak Blue e Daybreak Red da OpenAI acessíveis a defensores autorizados diretamente pela console Bedrock. 🔗 OpenAI

O que isso significa

O financiamento da infraestrutura de IA está mudando de escala: os 500 bilhões de dólares mobilizados pela NVIDIA junto a atores financeiros tradicionais (Apollo, BlackRock, Goldman Sachs, KKR…) marcam a passagem de um modelo financiado apenas pelos balanços das empresas de tecnologia para veículos de capital dedicados. Esse movimento macroeconômico se combina com uma realidade mais concreta: o Qwen3.8-2.4T-A95B, lançado no mesmo dia, roda nativamente a mais de 4.000 tokens por segundo por GPU na infraestrutura NVIDIA GB300 — o apetite por capital e a demanda por computação se alimentam mutuamente, e cada novo modelo massivo justifica um pouco mais os investimentos anunciados.

A abertura dos pesos continua a se expandir em todas as escalas: do modelo de fronteira de 2.400 bilhões de parâmetros da Alibaba ao pequeno modelo de visão-linguagem de 2,4 bilhões da Cohere, passando pelo LFM2.5-VL-3B da Liquid AI, projetado para rodar em dispositivos móveis. Essa diversificação pelo tamanho — e não apenas pelo desempenho — confirma o tracionamento medido pelo Hugging Face: o Transformers.js foi baixado 10 milhões de vezes por mês, quase 10 vezes mais do que há seis meses, prova de que a inferência local está saindo do estágio experimental para se tornar uma opção de produção plenamente consolidada.

As ferramentas de desenvolvimento assistidas por IA convergem para formatos de colaboração mais ricos. O Zed transforma a troca com o agente em um documento compartilhado e versionado com Delta, o GitHub padroniza plugins de agentes em VS Code, Copilot CLI e JetBrains via Agent Plugins 1.0, e tanto o Devin quanto o v0 integram o Grok 4.6 no mesmo dia de seu lançamento pela xAI. O ponto em comum: essas ferramentas deixam de ser simples assistentes isolados para se tornarem camadas de infraestrutura interoperáveis, em que a escolha do modelo subjacente e a memória entre sessões importam tanto quanto a própria geração de código.

Por fim, a IA se integra mais profundamente a usos cotidianos e a relações industriais negociadas em vez de impostas. O SL2T do Google DeepMind traduz a língua de sinais diretamente no Pixel 11 com uma arquitetura pensada para a privacidade, Gemini e Runway ampliam seus conectores para dezenas de serviços de terceiros, e o Suno assina com a BMG um acordo de licenciamento que contrasta com os processos judiciais de 2024-2025 — um sinal de que a indústria musical agora negocia com os modelos generativos em vez de combatê-los sistematicamente. Do lado corporativo, o estudo da OpenAI confirma que essa mudança para a execução agentiva já se aprofunda fortemente entre as organizações mais avançadas e as demais.


Fontes