ai-powered-markdown-translatorArtigo traduzido do fr para o pt com gpt-5.4-mini.
Em 11 de agosto de 2026, o aplicativo Gemini ultrapassa um bilhão de usuários mensais, tornando-se o produto de crescimento mais rápido da história do Google. A NVIDIA publica Nemotron 3.5 Lightning e sua biblioteca de roteamento NeMo Switchyard, a Mistral abre sua plataforma a modelos de terceiros e reúne uma coalizão de computação europeia, e a Alibaba revela Wan-Animate-2, uma grande atualização de seu modelo de animação open source. Também no menu: anúncios do ChatGPT expandidos para cinco novos mercados, novas ferramentas para desenvolvedores e uma longa lista de anúncios em geração de mídia.
Gemini ultrapassa um bilhão de usuários mensais
O aplicativo Gemini ultrapassou oficialmente um bilhão de usuários mensais ativos, tornando-se, segundo o Google, o produto de crescimento mais rápido de toda a história da empresa. O anúncio foi repercutido tanto pela conta oficial @GeminiApp quanto por Josh Woodward, que lidera as equipes Gemini e Labs no Google.
O Google acompanha o anúncio com um balanço numérico sobre os usos que impulsionaram esse crescimento:
| Uso medido | Dado |
|---|---|
| Interações de voz | 63 % dos usuários usam voz |
| Sessões Gemini Live | 1 em 5 usa a câmera ao vivo ou o compartilhamento de tela |
| Pedidos escolares | 38 % incluem um anexo (arquivo) |
| Geração de imagens | Mais de 150 milhões de imagens produzidas por dia |
| Automação Android | Ações automatizadas em mais de 40 aplicativos |
| Usuários iOS | Mais de 100 milhões de usuários ativos em dispositivos Apple |
Esses números ilustram uma diversificação dos usos além do simples chat de texto: voz, câmera, compartilhamento de tela, geração multimídia e automação entre aplicativos (reserva de restaurante, pedido de carro por aplicativo) aparecem como motores importantes da adoção.
🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.
🇵🇹 🚀 Um bilhão para o Gemini! Nosso objetivo continua sendo fazer dele o assistente mais pessoal, proativo e poderoso. — @GeminiApp no X
🔗 Anúncio oficial no blog do Google
NVIDIA lança Nemotron 3.5 Lightning e NeMo Switchyard para agentes de alto volume
A NVIDIA amplia sua família de modelos abertos Nemotron 3 com Nemotron 3.5 Lightning, um MoE híbrido de 30 bilhões de parâmetros (3 bilhões ativos) projetado para a execução de tarefas agentivas de alto volume — chamada de ferramentas, validação de resultados, delegação de tarefas — em vez de raciocínio complexo. Disponível em NVFP4 e BF16 com contexto de até 1 milhão de tokens, o modelo reivindica até 4 vezes a taxa de saída de modelos comparáveis e 30 % de ganho de tempo na conclusão de tarefas. No PinchBench, ele atinge 86 % de precisão ao concluir 10 000 tarefas 35 % mais rápido que o Qwen3.6 35B com precisão equivalente.
O modelo é distribuído com pesos, dados de treinamento e receitas, disponível no Hugging Face, ModelScope, OpenRouter e build.nvidia.com. A Together AI é parceira de lançamento desde o primeiro dia (day-0), com capacidade reservada via sua oferta Dedicated Model Inference para cargas de trabalho agentivas de alto volume.
Em paralelo, a NVIDIA publica NeMo Switchyard, uma biblioteca open source que roteia cada requisição para o modelo mais adequado (qualidade, latência, custo) sem reescrever o aplicativo — reservando os modelos de fronteira para o raciocínio complexo e o Lightning para a execução especializada. A NVIDIA reivindica um custo de conclusão de tarefas reduzido para perto de um terço do de Opus 4.8 sozinho. Parceiros concretos são citados: a Boomi roteia 59 % do seu tráfego para um modelo fine-tuned mais rápido, a Cognition reduz seu custo médio em 28 %, e a Ramp combina modelo e roteamento para 59 % de custo e 32 % de tempo de execução a menos.
🔗 Post oficial da NVIDIA · Anúncio do modelo no X
Alibaba revela Wan-Animate-2, grande atualização de sua animação de personagem open source
A Alibaba (equipe Wan) publica Wan-Animate-2, descrito como uma grande atualização de seu modelo open source de animação de personagem. Quatro capacidades são destacadas: uma animação de alta fidelidade que retranscreve movimentos e microexpressões em humanos, desenhos animados, robôs e animais; a animação com múltiplos personagens, em que cada personagem preserva sua identidade e seu movimento próprios em uma mesma cena; um controle de câmera guiado por texto (por exemplo, “vista de cima”), desacoplado do vídeo-fonte; e uma geração em streaming em tempo real, produzindo sequências de duração arbitrária em chunk por chunk sem acúmulo observável de erro.
No plano técnico, a Alibaba abandona esqueletos de pose explícitos em favor do próprio vídeo de referência como a priori de movimento, com uma arquitetura Dual-Branch DiT (Diffusion Transformer), uma codificação temporal Time-Align RoPE e uma atenção esparsa (Sparse-Ref Attention) para limitar o cálculo sem perda de qualidade. O controle de câmera se apoia em uma LoRA treinada com cerca de 50 000 amostras multivisão do Unreal Engine.
O modelo é open source, disponível desde já no ModelScope, Hugging Face e GitHub, com demonstração online. Segundo a campanha “Local AI” de agosto da NVIDIA, seus 14 bilhões de parâmetros geram de 16 a 26 vezes mais rápido em sistemas RTX do que as alternativas — confirmação de sua otimização para implantação local em hardware de consumo.
🔗 Detalhes técnicos e números da NVIDIA · Anúncio no X
Mistral lança a inferência regional, abre sua plataforma ao GLM-5.2 e reúne uma coalizão de computação europeia
A Mistral se posiciona como o único laboratório de IA europeu a combinar escolha regional de inferência e garantias de serviço. A empresa, já engajada em uma corrida tarifária e técnica contra OpenAI, Google e os atores chineses, aposta aqui em um posicionamento distinto: a soberania e a previsibilidade do serviço, em vez da simples corrida por benchmarks. Duas novidades do lado da plataforma:
| Funcionalidade | Status | Descrição |
|---|---|---|
| Mistral Regional Endpoints | Disponível | Escolha Europa ou Estados Unidos para a execução da inferência |
| Mistral Priority Tier | Visualização pública | SLA de disponibilidade e limites de taxa personalizados |
Outro aspecto notável: a plataforma Mistral se abre a modelos de terceiros, começando pelo GLM-5.2 da Z.ai, que contará com os mesmos controles regionais e compromissos de serviço que os modelos Mistral — uma primeira convergência entre os dois atores, até então concorrentes diretos no segmento de modelos abertos acessíveis.
Por fim, a Mistral lança as European Compute Units (ECU), um mecanismo que converte compromissos plurianuais de empresas em acesso à sua infraestrutura de computação, com o objetivo de 1 GW de capacidade até 2030 — o equivalente à potência consumida por uma grande cidade. Os parceiros fundadores anunciados são ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman et CEO), Amadeus (Luis Maroto, CEO) e Caisse des Dépôts (Olivier Sichel, CEO) — uma mistura de industriais, transporte e finanças públicas que ilustra a ambição de construir uma cadeia de computação europeia independente dos hyperscalers americanos.
OpenAI lança as publicidades do ChatGPT no Reino Unido, no México, no Brasil, no Japão e na Coreia do Sul
A OpenAI dá mais um passo na implantação da publicidade dentro do ChatGPT. Lançado em teste nos Estados Unidos em fevereiro de 2026 para as ofertas Free e Go, e depois expandido para o Canadá, a Austrália e a Nova Zelândia em março, o programa publicitário é agora oficialmente lançado em cinco novos mercados: Reino Unido, México, Brasil, Japão e Coreia do Sul. As ofertas Plus, Pro, Business, Enterprise e Education continuam sem publicidade, e outros mercados estão previstos até o fim do ano.
O princípio permanece inalterado: os anúncios nunca influenciam as respostas do ChatGPT, eles continuam claramente identificados como patrocinados e visualmente separados da resposta orgânica. A segmentação baseia-se no tema da conversa em andamento e no histórico das interações publicitárias anteriores, sem nunca dar aos anunciantes acesso às conversas ou aos dados pessoais — eles recebem apenas estatísticas agregadas (visualizações, cliques).
Do lado do controle do usuário, o ChatGPT permite ocultar um anúncio, consultar por que ele foi exibido, excluir seus dados publicitários com um gesto e gerenciar a personalização a qualquer momento. Nenhum anúncio é mostrado a contas de menores identificadas ou presumidas, nem próximo de temas sensíveis (saúde, saúde mental, política). Segundo a OpenAI, o piloto não mostrou nenhum impacto mensurável na confiança dos usuários, o que motivou essa expansão gradual.
Ecossistema open source e inferência
webAI Intelligence Lab publica TwiL-LM3, modelo de raciocínio 3B que supera o GPT-OSS-120B
O laboratório webAI Intelligence Lab (Austin) publica TwiL-LM3, seu primeiro modelo de raciocínio formal em open source. Com apenas 3 bilhões de parâmetros, ele afirma superar o GPT-OSS-120B da OpenAI em 4 dos 5 benchmarks de raciocínio formal testados — ou seja, cerca de 40 vezes menos parâmetros para uma inferência 2,6 vezes mais rápida. Treinado com dados verificados e proprietários em vez de conteúdo web coletado automaticamente, o modelo mira a computação na borda (edge): é anunciado como capaz de rodar de um Raspberry Pi a um iPhone, sem depender da nuvem.
Meta prepara uma versão com pesos abertos de Muse Spark 1.2
No fio que anuncia o Muse Glimmer, Alexandr Wang (Meta Superintelligence Labs) indica que a Meta publicará em breve uma versão com pesos abertos de Muse Spark 1.2 — até aqui o modelo proprietário que alimenta o agente de código em terminal Muse Code. Nenhuma data precisa é dada, mas o anúncio confirma uma inflexão da Meta em direção a mais pesos abertos em toda a sua linha Muse, na continuidade da abertura imediata dos pesos de Muse Glimmer sob licença Apache 2.0.
Zuckerberg publica um texto sobre a filosofia de IA da Meta
No mesmo dia, Mark Zuckerberg publica um texto afirmando que “todos deveriam ter acesso à superinteligência”, detalhando a filosofia e os valores da Meta para construir um futuro positivo da IA. A mensagem acompanha o lançamento do Muse Glimmer, posicionando a abertura dos pesos como uma escolha de fundo em vez de um simples argumento de marketing, e se insere em uma comunicação mais ampla da Meta sobre sua estratégia de pesos abertos naquela semana.
Lightricks apresenta LTX-2.5, grande atualização de seu world model aberto
A Lightricks publica LTX-2.5, nova versão de seu “world model” já usado para cinema, robótica e fluxos de trabalho em tempo real. A atualização promete maior fidelidade de pixels, cenas multi-plano que permanecem coerentes de um corte ao outro, e uma base pré-treinada pensada para ser ajustada (fine-tuned) conforme diferentes domínios, por meio de uma nova renderização batizada Diffusion Fidelity Rendering. A equipe apresenta o LTX-2.5 como uma fundação aberta em vez de uma ferramenta alugada.
IBM Research publica ALTK-Evolve, uma memória agentiva menos faminta por tokens que ACE
A IBM Research publica ALTK-Evolve, um sistema que permite a agentes de IA aprender com seus fracassos passados sem retreinamento, calibrando a quantidade de instruções reinjetadas conforme a capacidade do modelo usado — ao contrário do ACE (Agentic Context Engineering), que entrega a totalidade de seu “playbook” a cada etapa. No benchmark AppWorld com DeepSeek-V3.2, o ALTK-Evolve atinge 89,3 % de tarefas concluídas para 263K tokens por tarefa, contra 80,4 % e 634K tokens para ACE. Com gpt-oss-120b, ele obtém precisão igual ou melhor por cerca de 40 % do custo de inferência do ACE.
Together AI, IBM e NVIDIA se unem para a inferência empresarial no IBM Cloud
A Together AI anuncia uma parceria com IBM e NVIDIA para levar inferência de IA de nível empresarial ao IBM Cloud, por meio de um cluster dedicado de GPUs NVIDIA B300 com rede Spectrum-X — uma estreia desse tipo nessa plataforma, alimentada pela plataforma de inferência de produção da Together AI. A oferta mira empresas já clientes do IBM Cloud que desejam implantar cargas de trabalho de IA sem migrar para outro provedor de nuvem.
Ferramentas para desenvolvedores: Amp, Replit, GitHub Copilot e Manus
Amp lança plugins e skills globais para os orbs
A Amp (Sourcegraph) introduz um sistema centralizado de plugins e skills hospedados pela Amp, disponível em qualquer lugar onde a Amp funcione, em especial nos orbs. Dois níveis coexistem: um nível pessoal, sandbox experimental com reloading a quente (live reloading) no mesmo fio de conversa, e um nível espaço de trabalho, gerenciado pelos administradores e carregado por padrão para toda a equipe. Os elementos pessoais podem ser compartilhados com o espaço de trabalho, e o versionamento é gerenciado nativamente (atualização para a versão mais recente, detecção de skills obsoletas).
Replit MCP beta: criar, carregar, pesquisar e publicar um app via MCP
A Replit reforça sua beta MCP (Model Context Protocol) com novas capacidades: criar, carregar, pesquisar e publicar um aplicativo diretamente via MCP, sem passar pela interface web. O objetivo declarado é permitir construir software real no Replit a partir de qualquer cliente MCP compatível — editor, agente autônomo ou ferramenta de terceiros — em vez de ficar restrito à própria interface da Replit. Essa extensão confirma a estratégia da Replit de expor sua plataforma como um bloco programável para workflows agentivos.
MAI-Code-1.1-Flash chega ao GitHub Copilot, MAI-Code-1-Flash descontinuado
O mais recente modelo compacto de código da Microsoft, MAI-Code-1.1-Flash, está sendo disponibilizado no GitHub Copilot com suporte nativo a visão e melhorias em qualidade de código, seguimento de instruções e uso de ferramentas. Ele custa 73% menos que o MAI-Code-1-Flash, com um multiplicador de requisição premium de 0,25× para assinantes anuais. Selecionado automaticamente no Free e Estudante, disponível para seleção manual no Pro, Pro+, Max, Business e Enterprise. Em paralelo, o GitHub anuncia a descontinuação de MAI-Code-1-Flash em 10 de setembro de 2026.
Manus vai voltar a ser uma empresa independente
Manus anuncia que voltará a ser uma empresa independente. Para cumprir exigências regulatórias de algumas jurisdições, parte dos usuários terá de salvar seus dados antes de 23 de agosto de 2026 (7h59, horário de Singapura) e depois iniciar uma restauração a partir de 25 de agosto de 2026 (8h00, horário de Singapura). Os usuários afetados serão avisados por e-mail e notificação no app; não há cobrança prevista durante a transição, com bônus de boas-vindas incluídos.
Geração de mídia: Wan CLI, Motif 3, Luma Scenes e alimentação 800 VDC
Wan CLI: Alibaba permite controlar Wan diretamente a partir dos agentes
Alibaba lança o Wan CLI, uma nova ferramenta de linha de comando que permite chamar a plataforma Wan diretamente a partir de agentes para gerar imagens e vídeos de forma programática. Os créditos consumidos continuam totalmente sincronizados com a conta Wan Video do usuário, evitando uma dupla gestão de faturamento entre a interface web e o uso automatizado. A instalação é feita obtendo um comando no painel Wan e colando-o no agente, com um tutorial em vídeo fornecido para ajudar na configuração inicial.
Motif 3: primeiro modelo fronteira coreano treinado em GPU NVIDIA B200
A startup coreana Motif Technologies lança Motif 3 Base e Motif 3, seus primeiros modelos voltados para a corrida dos LLMs de fronteira, desenvolvidos com apoio do Ministério da Ciência da Coreia e treinados em GPU NVIDIA B200. O Motif 3 é construído sobre o Motif 3 Base por meio de pós-treinamento usando NVIDIA NeMo-RL. Em colaboração com a NVIDIA, a equipe também publica uma versão NVFP4 (precisão reduzida otimizada pela NVIDIA). O conjunto ficará disponível no Hugging Face com relatório técnico, e a NVIDIA elogiou este lançamento como um exemplo do dinamismo do ecossistema de IA coreano.
Luma Scenes: produção de vídeo por cenas, impulsionada por Uni-1
Luma AI lança Luma Scenes, uma ferramenta que permite refinar, cronometrar e validar cada cena individualmente antes da renderização final — respondendo ao problema clássico de produzir muitas variações para aproveitar apenas uma, com o risco de que uma cena malfeita comprometa toda a produção. A ferramenta amplia o Luma Layers (edição por camadas, no fim de julho), confirmando a orientação da Luma para controle granular em vez de geração com um clique, com um fluxo de trabalho mais próximo da edição tradicional.
Ideogram Ad Resizer: um design, todos os formatos publicitários
Ideogram lança Ad Resizer: a partir de um único design e dos posicionamentos publicitários visados, a ferramenta gera automaticamente um conjunto completo de formatos prontos para campanha (Instagram, Facebook, YouTube, TV conectada, display, impressão), incluindo proporções extremas difíceis de recortar manualmente. Disponível imediatamente no aplicativo e via API, para integração em pipelines automatizados de produção publicitária — um caso de uso de marketing concreto para equipes criativas multicanal.
HeyGen for Real Estate: lançamento oficial com três formatos de vídeo para corretores imobiliários
HeyGen lança oficialmente HeyGen for Real Estate, com três formatos de vídeo pensados para corretores imobiliários que aparecem eles mesmos na tela sem câmera nem edição — objetivo: permitir que publiquem várias vezes por dia sem sacrificar a presença visual exigida por esse setor. Oferta promocional: quem se inscrever no plano Creator nas 12 horas após o anúncio recebe acesso White Glove gratuito por 30 dias (apenas nos Estados Unidos). A HeyGen menciona uma possível expansão para outras pequenas empresas além do setor imobiliário.
NVIDIA detalha a arquitetura de alimentação 800 VDC das futuras « AI factories »
NVIDIA, com Google e Microsoft, detalha por meio do Open Compute Project uma arquitetura de alimentação em corrente contínua de 800 volts, que reduz as etapas de conversão elétrica entre a rede e as GPUs para sustentar a densidade de computação das futuras gerações de aceleradores. Mais de 80 fabricantes já estão trabalhando em produtos compatíveis. Implantação em várias etapas: arquitetura híbrida « Power Rack » já no segundo semestre de 2026, « Row Power Center » em 2027 e, depois, instalações nativas 800 VDC na década seguinte.
Qwen, Z.ai e OpenAI: novos modelos e sincronização de agentes
Qwen3.8-27B: pesos abertos anunciados para esta semana
Alibaba Qwen confirma que os pesos abertos de Qwen3.8-27B serão publicados esta semana, uma nova dimensão na família Qwen3.8 após o modelo principal Qwen3.8-Max já abordado no início de agosto. A equipe apresenta esse novo modelo como superior ao Qwen3.6-27B em codificação agentica, um desempenho já bem recebido pela comunidade de desenvolvedores que aguardava esse tamanho intermediário há várias semanas.
Z.ai: ZCode atinge 1 milhão de usuários, reset dos limites do GLM Coding Plan
Z.ai anuncia que ZCode, sua ferramenta de codificação baseada nos modelos GLM, ultrapassa um milhão de usuários. Como agradecimento, a empresa redefine os limites de uso de todos os assinantes do GLM Coding Plan e implementa uma atualização que pretende transformar melhor as capacidades de raciocínio de longo horizonte em trabalho efetivamente concluído, com uma taxa de sucesso de cache de 98%, oferecendo cerca de 1,8 vez mais uso para os assinantes.
Aplicativo desktop do ChatGPT disponível em prévia no Linux, com Codex
OpenAI amplia seu aplicativo desktop para Linux, até então restrito a macOS e Windows. A prévia cobre quatro distribuições principais — Ubuntu 24.04/26.04 LTS, Debian 13 e Fedora 43/44 — com pacotes .deb/.rpm em x64 e ARM64. O app reúne ChatGPT, ChatGPT Work e Codex em uma única interface nativa, com acesso aos projetos e workflows de navegador compatíveis, sem trocar de ambiente de trabalho.
Codex e ChatGPT Work importam o trabalho de outros agentes de IA
Nova funcionalidade para ChatGPT Work e Codex: manter o trabalho existente, feito com outros agentes de IA, sincronizado com o ecossistema OpenAI. Na prática, os usuários podem importar projetos, conversas, skills e plugins, consultar um histórico de importação e ativar a sincronização automática nas configurações. Disponível agora no aplicativo desktop do ChatGPT, para reduzir o atrito da mudança de ferramenta em vez de recomeçar do zero com uma configuração totalmente nova.
Resumo
- Bug de faturamento da Fable resolvido, 196 reembolsos — Anthropic confirma a resolução completa de um bug de cache de configuração que exibia incorretamente excedentes; 196 usuários reembolsados e creditados como compensação. 🔗 Tweet
- v0 (Vercel) redesenha sua barra lateral — conversas agrupadas por projeto, indicadores de status em tempo real, cartões de prévia ao passar o mouse. 🔗 Tweet
- Amp aumenta o tamanho de disco dos orbs para 60 GB — contra 40 GB antes, sem custo adicional para os novos orbs. 🔗 Tweet
- DeepSeek V4 Flash 0731 disponível para fine-tuning no Together AI — especialização via SFT ou DPO e depois implantação em produção. 🔗 Tweet
- Together AI detalha uma segunda parte sobre o autoscaling de sua inferência dedicada — três políticas testadas sob a mesma carga, e apenas uma se adaptou de fato. 🔗 Tweet
- Hugging Face lança a Open Model Series — nova série em vídeo educativa sobre modelos abertos e seu uso local. 🔗 Tweet
- FC Barcelona entra na parceria Google Pixel / Gemini — novos parceiros oficiais do clube, após parceria semelhante com o Bayern de Munique. 🔗 Tweet
- Relatório de uso do Copilot: detalhes dos tokens por modelo — tokens de entrada, saída e cache agora visíveis por trás dos créditos de IA consumidos. 🔗 Changelog
- GitHub destaca o agente Rubber Duck do Copilot — em um artigo de carreira sobre competências de desenvolvedores juniores; o agente usa um segundo modelo para criticar o código gerado. 🔗 Tweet
- Perplexity Computer: GitHub, conector mais usado — majoritariamente por não desenvolvedores (4 em 5). 🔗 Tweet
- Suno Studio 2.0 (teaser) — nova versão do ambiente de produção musical da Suno, sem detalhes adicionais. 🔗 Tweet
- ElevenLabs Summit em Nova York em 11 de novembro — dia de conferências reunindo líderes de tecnologia e negócios; inscrições abertas. 🔗 Tweet
- FLUX 3 Video confirma o posto #2 global — Black Forest Labs estende o acesso gratuito ao playground até 16 de agosto e provoca 4K e edição de vídeo. 🔗 Tweet
- Seedance 2.5 no Runway adiciona 50 referências de personagens — e clipes sincronizados com uma faixa musical. 🔗 Tweet
- P-Image-Ideogram disponível no Runway — gera uma imagem em apenas 0,6 segundo, com quatro modos de qualidade. 🔗 Tweet
- Kimi K3 disponível na Databricks — novo canal de distribuição para o modelo da Moonshot AI. 🔗 Tweet
- Zapier transforma seu marketing com ChatGPT Work — redução de abandono no funil de leads, relatórios automatizados. 🔗 OpenAI
- Virgin Atlantic otimiza seus fluxos de clientes com ChatGPT Work — pesquisa e planejamento de produto acelerados. 🔗 OpenAI
- Cohere — Aidan Gomez detalha a estratégia open source e soberana — modelos personalizáveis, acessíveis e seguros como fio condutor. 🔗 Tweet
O que isso significa
A escala de uso da IA voltada ao consumidor muda de patamar: com um bilhão de usuários mensais, o Gemini entra no círculo muito restrito dos produtos Google mais massivos, impulsionado por usos que vão muito além do chat de texto (voz, câmera, automação). Em paralelo, a OpenAI expande seus anúncios do ChatGPT para cinco novos mercados — um sinal de que a monetização em larga escala de assistentes conversacionais se torna uma prioridade estratégica assim que a base de usuários fica grande e fiel o suficiente.
Do lado da infraestrutura, o dia ilustra uma mudança em direção à execução agentica especializada, em vez de depender apenas do raciocínio de fronteira. A NVIDIA propõe, com Nemotron 3.5 Lightning e NeMo Switchyard, um modelo econômico explícito: reservar os modelos caros para o planejamento complexo e delegar a execução de alto volume a modelos mais leves e baratos, com ganhos de custo medidos em vários parceiros. IBM Research (ALTK-Evolve) e Together AI (autoscaling, parceria IBM Cloud) aprofundam o mesmo caminho econômico da inferência, enquanto a Mistral estrutura seu próprio esforço de soberania com as European Compute Units e a inferência regional.
A abertura dos pesos continua se expandindo para novos atores e novas modalidades: Wan-Animate-2 da Alibaba, TwiL-LM3 da webAI, Qwen3.8-27B a caminho, a promessa da Meta sobre Muse Spark 1.2 e até um primeiro modelo fronteira coreano (Motif 3) construído sobre a pilha técnica da NVIDIA. Essa diversificação geográfica e modal — texto, animação, raciocínio embarcado — confirma que o open source já não é mais privilégio de um pequeno número de laboratórios ocidentais.
Por fim, as ferramentas agenticas para desenvolvedores continuam se profissionalizando: Amp e Replit adicionam camadas de gestão (plugins globais, MCP ampliado), o GitHub fortalece sua oferta de modelos de baixo custo, e a OpenAI constrói pontes explícitas entre ecossistemas concorrentes ao permitir que Codex e ChatGPT Work importem o trabalho feito em outros lugares — uma aposta na portabilidade em vez do aprisionamento, num momento em que os desenvolvedores alternam entre vários agentes de IA em paralelo.
Fontes
- Gemini — um bilhão de usuários
- Gemini — anúncio no X
- NVIDIA — Nemotron 3.5 Lightning e NeMo Switchyard
- Alibaba Wan — Wan-Animate-2
- NVIDIA — números do Local AI (Wan-Animate-2)
- Mistral — inferência regional, GLM-5.2, coalizão de computação
- OpenAI — anúncios do ChatGPT
- webAI — TwiL-LM3
- Meta — Muse Spark 1.2 (Alexandr Wang)
- Zuckerberg — filosofia de IA da Meta
- IBM Research — ALTK-Evolve
- Together AI, IBM, NVIDIA — inferência IBM Cloud
- Amp — plugins e skills globais
- Replit — MCP beta
- GitHub — MAI-Code-1.1-Flash
- Manus — empresa independente
- Alibaba Wan — Wan CLI
- Motif Technologies — Motif 3
- Luma AI — Luma Scenes
- Ideogram — Ad Resizer
- HeyGen — for Real Estate
- NVIDIA — arquitetura 800 VDC
- Alibaba Qwen — Qwen3.8-27B
- Z.ai — ZCode 1 milhão de usuários
- OpenAI — aplicativo desktop do ChatGPT no Linux
- OpenAI — importação de agentes no Codex/ChatGPT Work
- Anthropic — bug de faturamento da Fable resolvido
- v0 — redesenho da barra lateral
- Amp — orbs a 60 GB
- Together AI — fine-tuning do DeepSeek V4 Flash 0731
- Together AI — autoscaling da inferência dedicada
- Hugging Face — Open Model Series
- FC Barcelona — parceria Google Pixel / Gemini
- GitHub — relatório de uso do Copilot por modelo
- GitHub — agente Rubber Duck
- Perplexity Computer — conector GitHub
- Suno — Suno Studio 2.0
- ElevenLabs — Summit Nova York
- Black Forest Labs — FLUX 3 Video
- Runway — Seedance 2.5
- Runway — P-Image-Ideogram
- Kimi Moonshot — K3 na Databricks
- OpenAI — Zapier
- OpenAI — Virgin Atlantic
- Cohere — estratégia open source e soberana