Pesquisar

Claude Managed Agents ganham força, Firebird inaugura sua maior AI factory na CIS, Kimi K3 retorna ao Copilot

Artigo gerado por inteligência artificial
Claude Managed Agents ganham força, Firebird inaugura sua maior AI factory na CIS, Kimi K3 retorna ao Copilot

ai-powered-markdown-translator

Artigo traduzido do fr para o pt com gpt-5.4-mini.

Ver projeto no GitHub ↗

Em 8 de agosto de 2026, a Anthropic amplia os Claude Managed Agents com orçamento de sessão, escolha de região de computação, carregamento automático de skills e um modelo conselheiro consultável durante a sessão. No mesmo dia, a Firebird inaugura na Armênia a maior AI factory da região CIS, com mais de 70 000 GPUs previstos até o fim de 2027, enquanto o GitHub confirma o retorno do Kimi K3 ao Copilot com sua precificação exata, generaliza os níveis Lite e Balanced para a revisão de código e publica seu resumo semanal. Completa o quadro: Warp Agent CLI, que conecta uma assinatura X Premium ao Grok, o balanço interno da Replit sobre o uso massivo de agentes, o Meta Muse Spark 1.2, que confirma sua competitividade em dois rankings, e cerca de quinze notas de destaque do lado da Hugging Face, da Together AI e da mídia generativa.


Claude Developer Platform: quatro atualizações para os Managed Agents

8 de agosto — A Anthropic entregou quatro melhorias aos Claude Managed Agents da Claude Developer Platform. Agora é possível definir um orçamento por sessão para controlar os gastos: uma sessão que atinge o limite entra em pausa com um evento budget_reached, e basta aumentar o orçamento para retomar. O parâmetro model.inference_geo aceita us (cobrado a 1,1x, região US garantida) ou global (tarifa padrão, inferência onde a capacidade estiver disponível). Os Managed Agents também carregam automaticamente as skills já presentes em .claude/skills/ dos repositórios anexados, sem configuração adicional. Por fim, um Managed Agent agora pode receber um modelo “conselheiro” (advisor) mais potente, acionável durante a sessão para obter uma segunda opinião — basta uma única linha de configuração do roster.

AtualizaçãoDetalhe
Orçamento de sessãoPausa automática no limite, evento budget_reached
Região de computaçãous (1,1x) ou global (tarifa padrão)
Carregamento das skillsAutomático a partir dos repositórios anexados
Modelo conselheiroSegunda opinião durante a sessão, 1 linha de configuração

🔗 Anúncio @ClaudeDevs


Ferramentas de código: Warp conecta X Premium, Replit publica seu balanço interno de agentes

Warp Agent CLI adiciona /connect-grok para vincular uma assinatura X Premium

7 de agosto — A Warp adiciona o comando /connect-grok ao Warp Agent CLI, lançado em 4 de agosto, para vincular uma assinatura X Premium existente e usar o Grok sem configurar uma chave de API separada — uma extensão do modelo “bring your own key” já oferecido pela ferramenta. No mesmo dia, a Warp publicou uma demonstração em vídeo apresentando várias funcionalidades em conjunto: orquestração multiagente, o modo de planejamento com realce de sintaxe do raciocínio, um modo de voz (/voice) e um modo shell.

Run /connect-grok in the Warp Agent CLI to use your X Premium subscription with Warp!

🇵🇹 Execute /connect-grok no Warp Agent CLI para usar sua assinatura X Premium com o Warp!@warpdotdev no X

Replit detalha como suas equipes quase triplicaram o code output com agentes

7 de agosto — A Replit publica um balanço interno sobre 6 meses de uso de seus próprios agentes internamente: o volume de código produzido quase triplicou, enquanto o tempo de revisão, a taxa de regressão e os incidentes permaneceram estáveis, e a qualidade melhorou. A equipe enfatiza: não se trata de uma única IA, mas de um sistema de agentes distribuídos por várias funções — investigação de incidentes, revisão de pull requests, triagem de suporte, análise de dados, pesquisa de contas comerciais. Outro ponto marcante: uma ferramenta SaaS paga usada internamente foi substituída por um aplicativo desenvolvido inteiramente na Replit, considerado melhor que o original. A Replit classifica essa evolução como o início de uma “empresa em piloto automático”.

Over the last 6 months, Replit nearly tripled its code output. Quality held. Nothing broke. We started becoming a self-driving company.

🇵🇹 Nos últimos 6 meses, a Replit quase triplicou seu volume de código produzido. A qualidade se manteve. Nada quebrou. Tornamo-nos uma empresa em piloto automático.@Replit no X


Meta Muse Spark 1.2 confirma sua competitividade em dois rankings

6 de agosto — Dois rankings independentes confirmam a ascensão do Meta Muse Spark 1.2. No Vals Index (ranking geral), o modelo entra no top 5 a US$ 0,69 por teste — cerca de 3 vezes mais barato que o Kimi e 10 vezes mais barato ou mais que o Opus, o Fable ou o GPT-5.6 Sol para um posicionamento comparável. Em um ranking especializado em desenvolvimento de videogames, o Muse Spark 1.2 iguala o GPT-5.6-Sol e fica em 3º lugar empatado, uma posição que um engenheiro da equipe Meta considera inalcançável no início do ano para a empresa nesse tipo de ranking. Esses dois sinais se somam às medalhas de ouro nas Olimpíadas Científicas Internacionais e ao benchmark Artificial Analysis já cobertos no início de agosto, confirmando uma dinâmica contínua de aumento de competitividade da família Muse Spark, com uma clara vantagem de custo.

RankingPosição do Muse Spark 1.2Referência
Vals IndexTop 5US$ 0,69/teste, 3x mais barato que Kimi
Videogames (especializado)3º empatadoIgual ao GPT-5.6-Sol

Muse Spark 1.2 just cracked the top 5 on the Vals Index, at just $0.69 per test. This is 3x cheaper than Kimi and 10x or more cheaper than Fable, Opus, and 5.6 Sol.

🇵🇹 O Muse Spark 1.2 acaba de entrar no top 5 do Vals Index, por apenas US$ 0,69 por teste. Isso é 3 vezes mais barato que o Kimi e 10 vezes mais barato ou mais que o Fable, o Opus e o 5.6 Sol.@ValsAI no X


GitHub Copilot: Kimi K3, novidades semanais e revisão de código

Kimi K3 no Copilot: pausa e retomada do deploy, tarifas confirmadas

6-7 de agosto — O GitHub pausa o deploy do Kimi K3 no Copilot em 6 de agosto, enquanto resolve um incidente que afeta o GitHub Actions, ao mesmo tempo em que comunica antecipadamente a precificação prevista do modelo. No dia seguinte, 7 de agosto, o GitHub anuncia a retomada do deploy: o Kimi K3 é cobrado pela tarifa de tabela do fornecedor (provider list pricing) no modelo de cobrança por uso (usage-based billing), e a empresa encaminha para sua documentação de preços para obter o detalhamento completo dos modelos e das requisições. Esse episódio completa a disponibilização geral do Kimi K3 no Copilot anunciada na véspera: ele acrescenta a informação precisa de preços e o detalhe do incidente técnico que interrompeu brevemente o deploy.

Tipo de tokensPreço
Entrada3 US$ / milhão
Saída15 US$ / milhão
Entrada em cache0,30 US$ / milhão

🔗 Tweet da retomada do deploy

Novidades semanais de 3 de agosto: app, CLI, VS Code

7 de agosto — O resumo semanal do GitHub Copilot cobre o app desktop, o CLI e o VS Code 1.132. No app desktop, o Copilot agora exibe o modelo usado por requisição com o detalhamento dos créditos consumidos e do uso do cache, e permite participar de sessões compartilhadas ou abrir uma exploração paralela via /side. O CLI lida com várias sessões simultâneas em uma barra lateral (atalhos n para criar, x para navegar), adiciona um comando experimental /worktree para um espaço de trabalho isolado e um comando /rewind sem dependência de Git para restaurar um estado anterior. No VS Code 1.132, a ditado multilíngue detecta automaticamente o idioma falado, e o comando /btw permite fazer uma pergunta complementar sem interromper a conversa em andamento.

SuperfícieNovidade principal
App desktopModelo e créditos exibidos por requisição, comando /side
CLIVárias sessões, /worktree, /rewind sem Git
VS Code 1.132Ditado multilíngue, comando /btw

🔗 Novidades semanais de 3 de agosto

Copilot code review: Lite e Balanced passam a ter disponibilidade geral

7 de agosto — O GitHub generaliza dois níveis de esforço para o Copilot code review, substituindo as antigas designações Low e Medium. O nível Lite é voltado para mudanças simples (documentação, correções menores) com um retorno direcionado; o nível Balanced é destinado à lógica complexa, ao código sensível do ponto de vista de segurança e às mudanças cross-service, com uma análise mais aprofundada baseada em modelos com raciocínio reforçado. A escolha é feita por revisão individual sem alterar os valores padrão do repositório ou da organização, mas os administradores podem definir um nível padrão aplicável a todos os repositórios nas configurações da organização. O nível escolhido agora aparece na cronologia e no comentário de resumo da pull request. Os dois níveis estão incluídos no Copilot Pro, Pro+, Max, Business e Enterprise.

NívelDestinoPlanos incluídos
LiteMudanças simples, docs, correções menoresPro, Pro+, Max, Business, Enterprise
BalancedLógica complexa, segurança, cross-servicePro, Pro+, Max, Business, Enterprise

🔗 Os níveis de esforço do Copilot code review estão geralmente disponíveis


Firebird lança a maior AI factory da região CIS na Armênia

8 de agosto — A Firebird, um cloud de IA emergente ativo na região CIS (Comunidade dos Estados Independentes), inaugurou em Hrazdan, na Armênia, o que é apresentado como a maior AI factory da região. A infraestrutura se apoia na plataforma de computação acelerada da NVIDIA e em servidores Dell Technologies PowerEdge, com uma plataforma NVIDIA DSX que reivindica 40% mais GPUs na mesma área graças à sua eficiência energética. A implantação prevê mais de 70 000 GPUs (mistura de Blackwell e Rubin) até o fim de 2027, para uma capacidade-alvo de 300 megawatts, colocada em operação em pouco mais de seis meses. A Perplexity é citada como cliente inicial. A Firebird anuncia um roteiro regional de 2 gigawatts, com a Armênia e o Cazaquistão como primeiros marcos.

ElementoDetalhe
GPUs implantadas70 000+ (Blackwell + Rubin) até o fim de 2027
Capacidade-alvo300 MW
ParceirosNVIDIA, CoreWeave, Dell Technologies, Schneider Electric, Vertiv
Cliente inicialPerplexity

🔗 Firebird Launches CIS Region’s Largest AI Factory in Armenia


Notas breves

  • Replit permite mover um projeto entre workspaces — Transferência possível entre workspaces da mesma conta team ou enterprise, a partir do menu suspenso da lista de projetos. 🔗 fonte
  • Novo modelo de fundação de DNA publicado na Hugging Face — Um modelo capaz de ler e gerar sequências de DNA está disponível com um espaço de demonstração; nome do modelo e organização não especificados. 🔗 fonte
  • NVIDIA publica os assets de tool-use conversacional do NeMo Gym — Pares policy/ferramenta de referência e históricos de prompts colocados on-line na Hugging Face para treinar agentes conversacionais que usam ferramentas. 🔗 fonte
  • Hugging Face divulga um estudo sobre agentes de IA que reproduzem artigos da ICML 2026 — Thread sobre a reprodução automatizada de publicações científicas por agentes de IA, sem detalhes de metodologia nem taxa de sucesso. 🔗 fonte
  • Hugging Face Storage Buckets integrado ao Vast AI — As instâncias GPU alugadas no Vast AI agora podem ler e gravar diretamente em um bucket Hugging Face, sem transferência manual. 🔗 fonte
  • Um fornecedor terceirizado reivindica a inferência mais rápida para DeepSeek V4 Flash e Kimi K3 — Reivindicação baseada em tráfego de produção real, em vez de testes sintéticos, a ser vista com cautela. 🔗 fonte
  • Together AI adiciona uma seção Learn à sua documentação — Conteúdo pedagógico explicando o tempo até o primeiro token (TTFT), janelas de contexto, sampling, fine-tuning, quantization e trade-offs de implantação. 🔗 fonte
  • FLUX 3 disponível em produção na Together AI — O modelo multimodal da Black Forest Labs (vídeo e áudio sincronizado, clipes de até 20 segundos) está acessível via inferência serverless gerenciada da Together AI. 🔗 source
  • Roomote escolhe a Together AI como provedora de inferência — A ferramenta de agentes agora pode atribuir diferentes modelos abertos conforme as etapas do workflow: código, planejamento, visão e revisão. 🔗 source
  • O Copilot impact dashboard adiciona uma seção de retorno sobre investimento — Nova seção comparando o custo mensal do Copilot por desenvolvedor com o número de pull requests produzidas, com um seletor de salário interativo. 🔗 source
  • Empresas agora podem instalar GitHub Apps de terceiros — Os proprietários de contas enterprise podem instalar GitHub Apps públicas externas, com acesso limitado à conta enterprise e permissões sensíveis restritas. 🔗 source
  • MiniMax H3 número 1 em três categorias do DesignArena — O modelo open weights reivindica a primeira posição em Multi-Image to Video, Image to Video e Video Editing no ranking DesignArena Frontier. 🔗 source
  • Kimi K3 — forte crescimento dos downloads e dos usuários ativos (SensorTower) — Os downloads do app Kimi quase quintuplicaram e os usuários ativos diários subiram cerca de 40% desde o lançamento do Kimi K3. 🔗 source

O que isso significa

A infraestrutura agentica está se padronizando entre os grandes fornecedores. A Anthropic está adicionando aos Managed Agents o que o Claude Code já oferecia sozinho — orçamento, escolha de região, carregamento de skills — e inovando com um modelo conselheiro consultável durante a sessão. O GitHub estende a mesma lógica do lado da governança: o Copilot code review generaliza Lite e Balanced em configuração por organização, enquanto o CLI adiciona comandos reversíveis (/rewind) que tratam a sessão como um estado a ser restaurado, em vez de um fluxo descartável. A Warp, por sua vez, amplia o acesso a modelos de terceiros (Grok via assinatura X Premium) sem exigir uma chave de API dedicada. O ponto em comum: as ferramentas agenticas adotam os mesmos reflexos da infraestrutura cloud clássica — orçamentos, regiões, permissões, reversão.

A relação custo/desempenho continua a ditar as escolhas de adoção mais do que o ranking bruto. O Meta Muse Spark 1.2 entra no top 5 do Vals Index a US0,69porteste,3vezesmaisbaratoqueoKimiapesardeumposicionamentocomparaˊvel;oKimiK3,porsuavez,ve^seusdownloadsquasequintuplicaremsegundoaSensorTower,aomesmotempoemqueconfirmanoGitHubCopilotumaprecificac\ca~oprecisaporuso(US 0,69 por teste, 3 vezes mais barato que o Kimi apesar de um posicionamento comparável; o Kimi K3, por sua vez, vê seus downloads quase quintuplicarem segundo a SensorTower, ao mesmo tempo em que confirma no GitHub Copilot uma precificação precisa por uso (US 3 / US$ 15 por milhão de tokens). Juntos, esses dois sinais desenham um mercado em que a tração do usuário e o custo por requisição pesam tanto quanto a posição em um ranking de referência.

A implantação de infraestrutura física continua a acelerar fora das áreas tradicionais. A Firebird escolhe a Armênia para construir a maior AI factory da região CIS, com mais de 70.000 GPUs previstas até o fim de 2027 e um plano regional de 2 gigawatts. A Perplexity, citada como cliente inicial, ilustra um movimento em que os fornecedores de modelos buscam ativamente diversidade geográfica de computação, em vez de depender apenas dos hubs americanos ou chineses.

Por fim, o ecossistema de ferramentas satélites se consolida em torno de alguns fornecedores abertos de inferência. A Together AI emenda integrações em uma semana — FLUX 3 em produção, Roomote como cliente agentico, uma seção pedagógica dedicada aos conceitos de inferência — enquanto a Hugging Face amplia seu papel de plataforma de armazenamento (integração Vast AI) tanto quanto de distribuição de modelos. Esse movimento discreto, feito de breves em vez de anúncios espetaculares, constrói a infraestrutura sobre a qual repousam os usos mais visíveis do dia.


Fontes