ai-powered-markdown-translatorArtigo traduzido do fr para o pt com gpt-5.4-mini.
O dia 22 de julho de 2026 é dominado por ferramentas e agentes de IA empresarial: a Cursor lança o Cursor Router, um roteador de modelos que reduz os custos em 60 % sem perda perceptível de qualidade, a OpenAI revela em sequência sua plataforma de agentes Presence e seu data center Project Camellia de 3,2 gigawatts na Geórgia, a Alibaba apresenta o Qwen-Image-3.0 e a Synthesia lança o Roleplay Sessions para formação profissional. Em torno desses cinco grandes anúncios gravitam cerca de trinta novidades notáveis — da Genesis Mission do Departamento de Energia dos EUA (Google, OpenAI, Arcee AI) às novidades da Anthropic, GitHub Copilot, NVIDIA e Cohere.
Cursor lança Cursor Router, roteamento inteligente de modelos 60 % mais barato
22 de julho — A Cursor lançou o Cursor Router, um roteador de modelos integrado ao modo Auto que analisa cada solicitação e escolhe automaticamente o modelo mais adequado à tarefa, em vez de enviar sistematicamente todas as solicitações para um modelo de fronteira (frontier). A funcionalidade está disponível a partir de hoje em todas as superfícies (desktop, web, iOS, CLI, SDK) para os planos Teams e Enterprise.
| Modo de otimização | Objetivo | Cobrança |
|---|---|---|
| Intelligence | Qualidade de fronteira sistemática | Tarifa do modelo realmente utilizado |
| Balance | Qualidade próxima da fronteira, uso diário | Tarifa do modelo realmente utilizado |
| Cost | Qualidade correta, otimizada em tokens | Tarifa do modelo realmente utilizado |
No lado da administração, as equipes Teams e Enterprise dispõem de controles detalhados: ativar ou desativar o Router por equipe, restringir os modos acessíveis, definir um modo padrão, autorizar ou bloquear certos modelos subjacentes e escolher exibir ou não o nome do modelo realmente roteado (oculto por padrão). Opções de aplicação flexível ou estrita permitem padronizar o uso do modo Auto dentro de uma organização.
In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.
🇵🇹 Em acesso antecipado, os clientes não observaram nenhuma queda de qualidade, por um custo por commit inferior em comparação com o roteamento de todas as solicitações para Opus 4.8. — @cursor_ai no X
OpenAI Presence, plataforma de agentes de voz e texto para empresas
22 de julho — A OpenAI lança o Presence, uma plataforma de agentes de IA destinada às empresas para implantar em produção agentes de voz e texto confiáveis, além da simples demonstração técnica. O Presence combina o raciocínio dos modelos com políticas, salvaguardas e regras de escalonamento humano.
Cada implantação começa com uma tarefa específica (faturamento, sinistros de seguro, solicitações internas de TI): o agente recebe apenas os conhecimentos e acessos de sistema necessários, e a empresa cliente define o que ele pode fazer, quando uma validação humana é exigida e quando uma pessoa deve retomar o controle. Após a colocação em produção, as sessões reais e os casos de escalonamento revelam as lacunas do sistema; Codex então propõe atualizações que as equipes testam e validam, o que permite ao agente se adaptar à evolução do comportamento dos usuários.
A partir de hoje, o Presence dá suporte a experiências em tempo real em voz e texto para suporte ao cliente, vendas ativas ou fluxos internos de alto impacto. O produto está disponível para clientes empresariais elegíveis por meio de um programa de disponibilidade geral limitada, com acompanhamento direto das equipes da OpenAI e, depois, para o acompanhamento contínuo, por integradores de sistemas selecionados.
Project Camellia, data center da OpenAI de 3,2 gigawatts na Geórgia
22 de julho — A OpenAI detalha o Project Camellia, um projeto de infraestrutura de IA de longo prazo no condado de Effingham, na Geórgia. A empresa contratou com a Georgia Power 3,2 gigawatts de capacidade, entregues em fases entre 2028 e 2032.
No que diz respeito à eletricidade, a OpenAI se compromete a assumir a totalidade dos custos de infraestrutura e serviço, sem repasse para as tarifas dos residentes, e o local foi concebido para reduzir proativamente seu consumo em caso de alta demanda antes que os clientes residenciais sejam impactados. Em relação à água, um circuito fechado recircula a água em vez de captá-la e descartá-la continuamente, para um consumo contínuo comparável ao de um edifício de escritórios equivalente.
No plano econômico, a OpenAI anuncia 80 milhões de dólares em benefícios comunitários ao longo da vida do projeto (escolas, segurança pública, saúde, habitação, veteranos, pequenas empresas), além de centenas de milhões de dólares em receitas fiscais locais e estaduais esperadas — com a empresa prevendo tornar-se o maior contribuinte do condado. Somam-se até 71 milhões de dólares em créditos Codex para estudantes elegíveis de faculdades, community colleges e escolas técnicas da Geórgia, cada um recebendo 100 dólares em créditos por meio de sua conta ChatGPT.
Qwen-Image-3.0, terceira geração do modelo de geração de imagens da Alibaba
22 de julho — A Alibaba lançou o Qwen-Image-3.0, terceira geração de seu modelo de geração de imagens, resumida pela equipe em uma palavra de ordem: « Real » (« 实 »), após a precisão da versão 1.0 e a variedade/completude da 2.0.
| Dimensão | O que isso muda concretamente |
|---|---|
| Conteúdo rico | Prompts de até 4,5k tokens; layout complexo em uma única passagem (jornais, storyboards, temas de prova, grades de infográfico 3×3, interfaces aninhadas) |
| Detalhes autênticos | Texto legível até 10px, páginas LaTeX completas, texturas quase fotográficas (poros, fios de cabelo, pele) |
| Conhecimento aprofundado | Renderização nativa em 12 idiomas, mais de 100 estilos artísticos, interfaces realistas (web, jogos, streams), recuperação web ao vivo |
Um exemplo destacado pela Alibaba ilustra essa « expansão horizontal »: com apenas 3,7k tokens, o modelo gera um infográfico 3×3 cobrindo nove áreas muito diferentes (segurança em túneis, geometria espacial, análise estilística de um texto clássico chinês, movimento de projétil, parasitologia, diagnóstico médico, teoremas de Sylow, controle bancário, estrutura do DNA), com texto e visuais precisos em cada célula. A Alibaba posiciona o modelo não como uma simples ferramenta « bonita de ver », mas como uma ferramenta de produtividade para design, criação de conteúdo, educação e e-commerce. Ele já está acessível via Qwen Chat.
Synthesia lança Roleplay Sessions para formação profissional
22 de julho — A Synthesia lança o Roleplay Sessions, primeiro bloco de sua futura plataforma « Sessions » destinada à formação profissional por IA. O princípio: uma conversa de treinamento ao vivo com um avatar que responde e provoca em tempo real, orienta o usuário com um sistema de pontuação e depois mede a progressão das competências em escala de equipe. O foco declarado é vendas, gestão, atendimento ao cliente e qualquer situação em que um funcionário precise treinar uma conversa difícil.
| Indicador | Valor |
|---|---|
| Competências básicas abaladas até 2027 (fonte Synthesia) | 44 % dos funcionários |
| Empregadores que declaram não ter capacidade para fechar a lacuna | 63 % |
| Aumento médio de competência (grande agência global de recrutamento) | cerca de 30 % |
| Vendedores que voltam para treinar voluntariamente (empresa da Fortune 10) | cerca de 70 % |
O Roleplay Sessions busca reunir em uma única plataforma quatro etapas habitualmente dispersas — informar, treinar, orientar e medir — apoiando-se na base de vídeos da Synthesia, já usada por 90 % das empresas da Fortune 100. Os primeiros deployments dizem respeito a um grande grupo europeu e a uma empresa da Fortune 10.
Genesis Mission do DOE: Google, OpenAI e Arcee AI multiplicam os compromissos
22 de julho — Três atores distintos anunciaram no mesmo dia novos compromissos em torno da Genesis Mission, a iniciativa do Departamento de Energia dos EUA (DOE) voltada a dobrar o ritmo da descoberta científica em uma década.
| Organização | Compromisso | Detalhe |
|---|---|---|
| Google DeepMind | 40 milhões de dólares | Tokens de IA e créditos do Google Cloud para dar a mais pesquisadores dos laboratórios nacionais acesso ao Gemini e a outros modelos |
| OpenAI | 17 milhões de dólares | Acesso Codex para cerca de 2 000 pesquisadores, suporte de API para duas campanhas científicas, até 10 milhões de dólares em uso de API oferecidos por 2,5 milhões gastos, acesso ao GPT-Rosalind para biologia |
| Arcee AI | Parceria (valor não divulgado) | Construção do Genesis-Science-1 (GS1), modelo americano em pesos abertos associado a um harness de pesquisa governado para workflows de computação científica |
A Google amplia uma colaboração já estabelecida em torno da biologia computacional (AlphaFold, Isomorphic Labs). A OpenAI se apoia em trabalhos já realizados com o sistema dos laboratórios nacionais, incluindo uma sessão « AI Jam » que reuniu mais de 1 000 cientistas de nove laboratórios. A Arcee AI, por sua vez, abre um programa de contribuição destinado a pesquisadores, laboratórios, universidades, empresas e organizações sem fins lucrativos; o projeto ainda está no início, sem data de lançamento nem benchmark divulgado para o GS1 até o momento.
🔗 Google DeepMind no X — 🔗 OpenAI sobre o assunto — 🔗 Arcee AI no X
Anthropic multiplica os anúncios sobre Claude
Claude Security entra em beta para o Claude Code
22 de julho — A Anthropic lança em versão beta o plugin Claude Security para Claude Code: varredura das modificações em andamento em busca de vulnerabilidades antes do commit, ou análise completa do repositório, tudo a partir do terminal, com base na inferência Claude já usada (sem serviço de terceiros separado para provisionar). Esse lançamento posiciona o Claude Code no mesmo terreno do Codex Security da OpenAI ou do secret scanning reforçado do GitHub Copilot. Nem preços nem planos afetados além do status beta são informados.
Claude pode consultar o Anthropic Economic Index por meio de um connector
22 de julho — Um novo connector nativo dá acesso ao Anthropic Economic Index, o conjunto de dados público que mede o uso da IA na economia. Uma vez ativado no menu de connectors, Claude pode responder a perguntas como « quais profissões usam mais IA » com base diretamente nos dados do Index, em vez de em seu conhecimento geral.
Claude Managed Agents: esforço, seeding, 500 skills e webhooks
22 de julho — A Anthropic lança um conjunto de funcionalidades para o Claude Managed Agents: níveis de esforço configuráveis por agente (respostas mais rápidas e menos custosas com esforço reduzido), sessões « seedadas » com até 50 eventos diretamente na criação, até 500 skills no total entre todos os agentes de uma sessão, webhooks para os ambientes e stores de memória, e streaming dos eventos dos subagentes.
Claude Code no desktop se integra ao simulador iOS
21 de julho — O Claude Code no desktop passa a suportar o simulador iOS: o aplicativo pode ser compilado e executado pelo Claude, que o observa, interage com ele e itera até o fim da tarefa, em um painel lado a lado com a conversa. Disponível a partir de hoje em beta pública, exclusivo para macOS e exigindo Xcode.
🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 Simulador iOS
Ferramentas de código: Amp, Warp e Replit
Amp lança Multiplayer, a colaboração em tempo real nos orbs
22 de julho — Três semanas após o lançamento dos agentes em orbs, a Amp adiciona o Multiplayer: um mesmo orb agora pode ser compartilhado e trabalhado simultaneamente por vários membros de um workspace, com envio de mensagens ao agente, consulta ao portal, observação das mudanças de arquivos ao vivo e terminal compartilhado, ativável a partir do menu Share de um thread.
Warp adiciona suporte a links de hipertexto OSC 8
22 de julho — A Warp entrega o suporte a OSC 8, um padrão de terminal que permite que CLIs e agentes de codificação emitam links clicáveis em vez de texto bruto. Desenvolvida por um colaborador externo a partir de uma solicitação aberta há cinco anos, a funcionalidade é lançada na versão Dev atrás de um feature flag, enquanto duram testes adicionais no mecanismo de renderização da grade do terminal.
Replit relança seu aplicativo móvel
22 de julho — A Replit publica uma reformulação de seu aplicativo móvel (iOS, implantação gradual no Android): tela inicial redesenhada, entrada por voz para falar diretamente com o Agent, navegação por swipe entre chat, tasks e preview, e Live Activities no iOS que acompanham o progresso do agente em tempo real, inclusive fora do aplicativo.
🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit mobile
Microsoft Asia publica Mage-Flow, modelo compacto de geração de imagens
22 de julho — A Microsoft Asia publica no Hugging Face o Mage-Flow, um modelo de geração e edição de imagens com apenas 4 bilhões de parâmetros, que reivindica qualidade comparável à de modelos muito maiores. Em termos de desempenho, o modelo gera uma imagem em 4 etapas em menos de um segundo a 1024×1024, e pode chegar até 4K. Uma demo está disponível via Spaces do Hugging Face.
Gemini: Galaxy Unpacked 2026 e Gemini 3.5 Pro
Três novidades Gemini do lado da Samsung
22 de julho — À margem do Galaxy Unpacked 2026, a Google detalha três novidades Gemini para o ecossistema Galaxy: uma automação de tarefas ampliada para mais de 40 aplicativos populares (compras, reservas, compra de ingressos, capaz de tratar imagens complexas como instruções e de ser executada em segundo plano); o Gemini Notebook (o antigo NotebookLM) pré-instalado na série Galaxy Z Fold8, com seis meses de teste do Google AI Pro incluídos; e o Gemini no Galaxy Watch 9 (ativação com um simples levantamento de pulso, sem palavra-chave de ativação), com óculos inteligentes desenvolvidos com a Samsung (armações Gentle Monster e Warby Parker) previstos para o outono de 2026.
Gemini 3.5 Pro entra em teste com parceiros
21 de julho — Josh Woodward, VP responsável pelo Gemini, confirma que o próximo modelo principal, Gemini 3.5 Pro, entrou oficialmente em fase de testes com parceiros. Nenhuma data de disponibilidade geral é fornecida, mas essa confirmação situa o Gemini 3.5 Pro como o próximo grande lançamento esperado do lado dos modelos Gemini.
🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro
Manus lança Plan Mode
22 de julho — A Manus introduz Plan Mode, uma etapa de revisão estruturada antes da execução: em vez de partir diretamente para a construção, o agente gera um plano de viabilidade em formato Markdown, com objetivos, etapas e restrições, que o usuário pode editar ou mandar revisar antes da validação. A ativação é feita via / na web ou + no mobile; o modo também pode ser acionado no meio da tarefa para planejar as fases seguintes. Disponível imediatamente para todos os usuários, na web e no mobile, em opt-in.
GitHub Copilot: Canvases e faturação
GitHub Copilot lança os Canvases
21 de julho — O GitHub introduz os canvases, espaços de trabalho interativos dentro do app GitHub Copilot onde desenvolvedores e agentes colaboram em tempo real: visualização de informações complexas, interações diretas (cliques, edições), refinamento por iterações de prompts. Criação via comando /create-canvas. Usos ilustrados: triagem de issues por varredura de cartões, diagramas interativos de arquitetura, painéis de worktrees, coaching sobre a qualidade dos prompts, pesquisa de conhecimento multiplataforma. Um usuário documentou um caso em que o app lançou automaticamente um canvas no navegador para clicar até a tela de pagamento e verificar uma funcionalidade, substituindo um teste Playwright escrito manualmente.
O que o Copilot traz além do acesso bruto a uma API
22 de julho — O GitHub explica sua política de faturação, agora baseada em créditos de IA cobrados segundo as tarifas públicas de API dos modelos. As completions de código e o Next Edit Suggestions continuam incluídos nos planos pagos; chat e tarefas agentivas consomem créditos de IA. O argumento do GitHub: além do acesso ao modelo, o Copilot traz um fluxo integrado (issues, repositórios, pull requests, políticas da organização), um consumo de tokens reduzido em paridade de resolução de tarefas segundo suas avaliações, controles de política para administradores e uma infraestrutura de agente já comprovada em produção via o SDK Copilot.
🔗 Canvases — 🔗 Copilot vs acesso bruto à API
ElevenLabs: ElevenMusic e serviço público ucraniano
ElevenLabs introduz Vocals e Styles no ElevenMusic
22 de julho — A ElevenLabs adiciona dois recursos ao ElevenMusic, também disponíveis nos Finetunes do ElevenCreative: os Vocals, que permitem gerar músicas originais com a própria voz ou uma voz da biblioteca vocal (envio de faixas para refinar o Music v2 no seu timbre, ou modo pontual a partir de uma única gravação); e os Styles, para consistência estilística em faixas completas, compatíveis com os Vocals. A ElevenLabs esclarece que todos os envios são verificados quanto à conformidade com os direitos autorais.
ElevenLabs equipa a Obrii (Ucrânia) com um assistente vocal para o serviço público de emprego
22 de julho — Obrii, o novo ecossistema digital do mercado de trabalho ucraniano, coloca no ar seu primeiro serviço de IA: um assistente vocal desenvolvido com a ElevenLabs para o serviço público de emprego, acessível 24 horas por dia, inclusive durante alertas de ataque aéreo.
“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”
🇵🇹 Com a ElevenLabs, lançamos um assistente vocal de IA para o serviço público de emprego — aproximando os serviços públicos dos cidadãos, 24 horas por dia, 7 dias por semana, inclusive durante alertas de ataque aéreo. — @C_o_S no X
NVIDIA: simulação médica, fábrica no Texas e modelos Cosmos
Framework open source de simulação física médica
22 de julho — A NVIDIA publica em open source, no NVIDIA Isaac for Healthcare, um framework acelerado por GPU de simulação de física médica, apresentado como o primeiro do tipo: interações entre dispositivo médico (cateter, guia) e anatomia do paciente, combinando simulação física clássica e IA generativa (Cosmos-H Dreams). Executando 8 192 ambientes em paralelo, a NVIDIA anuncia ter reduzido um tempo de treinamento de políticas robóticas (policies) de mais de cinco horas para menos de dois minutos. CMR Surgical, Johnson & Johnson MedTech, XCath e Medtronic Structural Heart já o utilizam; disponível agora no GitHub.
NVIDIA e Wistron abrem uma fábrica de superchips em Fort Worth
21 de julho — A Wistron inaugura sua primeira fábrica americana, um site de 30 000 m² em Fort Worth (Texas), que já produz os superchips Grace Blackwell Ultra e, no futuro, fabricará os Vera Rubin. Investimento de 700 milhões de dólares, mais de 500 empregos criados (meta de 1 000 até o fim do ano), no âmbito do compromisso de 500 bilhões de dólares da NVIDIA para a fabricação de plataformas de IA nos Estados Unidos.
Cosmos 3 Super, até 25 vezes mais rápido
22 de julho — A NVIDIA publica o Cosmos 3 Super, uma variante de 4 etapas da sua família Cosmos 3, gerando imagens e vídeos até 25 vezes mais rápido que os modelos originais, mantendo, ao mesmo tempo, uma posição alta no Artificial Analysis: primeiro lugar em imagem-para-vídeo (sem áudio), segundo lugar em texto-para-imagem. Disponível agora no Hugging Face.
Balanço do Nemotron Model Reasoning Challenge no Kaggle
22 de julho — A NVIDIA publica o balanço do seu Nemotron Model Reasoning Challenge no Kaggle: mais de 5 000 participantes distribuídos em mais de 4 000 equipes, em torno de técnicas de melhoria do raciocínio de modelos abertos. As equipes NullSira, vli e YS-L terminam nas três primeiras posições.
🔗 Simulação médica — 🔗 Fábrica Wistron — 🔗 Cosmos 3 Super — 🔗 Balanço Kaggle
Kimi K3: segundo no AA-Briefcase, mas caro e lento
21 de julho — A Artificial Analysis publica os resultados do Kimi K3 (Moonshot AI) no AA-Briefcase, seu benchmark de trabalho de conhecimento agentivo (planilhas, apresentações, maquetes de interface). O modelo obtém a segunda melhor nota registrada, um salto de mais de 700 pontos em relação à geração anterior.
| Modelo avaliado | Elo AA-Briefcase | Custo médio por tarefa | Tempo médio por tarefa |
|---|---|---|---|
| Claude Fable 5 (max) | 1574 | — | — |
| Kimi K3 | 1543 | 10,57 dólares | 56,4 minutos |
| GPT-5.6 Sol (max) | 1501 | — | — |
| Claude Sonnet 5 (max) | 1388 | — | — |
| Claude Opus 4.8 (max) | 1347 | — | — |
| Kimi K2.6 (referência) | 816 | ~1 dólar | — |
O Kimi K3 apresenta uma taxa de sucesso de 51% nas grelhas de avaliação, logo atrás do Claude Fable 5 (56%), com qualidade analítica comparável, mas qualidade de apresentação inferior. O reverso da medalha: um custo médio de 10,57 dólares por tarefa, cerca de dez vezes mais que o Kimi K2.6, consequência do preço do modelo, do uso elevado de tokens de saída e de uma média de 83 turnos por tarefa (contra 67 para o Claude Fable 5 e 50 para o GPT-5.6 Sol).
OpenAI: usos na imprensa e limites de API
Como as redações usam as ferramentas da OpenAI
22 de julho — A OpenAI publica um panorama dos usos de suas ferramentas por organizações de imprensa. A Associated Press as usa para reportagem, verificação (rastreamento de upload, geolocalização, cronolocalização de imagens e vídeos), transformação de milhares de processos da Suprema Corte em informações estruturadas e conversão de artigos em scripts para transmissão, mantendo os jornalistas no comando do julgamento editorial. A POLITICO analisa grandes volumes de documentos públicos para reportagens originais mais rápidas; a Axios também é citada. A OpenAI renova seu apoio ao American Journalism Project e continua suas parcerias com o Lenfest Institute e a WAN-IFRA.
Limites de gasto rígidos estendidos a todas as contas de API
22 de julho — A OpenAI estende esta semana a todas as contas da API Platform o acesso aos limites de gasto rígidos (hard spend limits), permitindo que cada desenvolvedor limite seu consumo ao valor que escolher, com acompanhamento de uso em tempo real pelo painel.
🔗 Usos na imprensa — 🔗 Limites de API
Cohere: diacritização árabe e modelo de código leve
Speech Tashkeel 2B e o ecossistema comunitário Transcribe Arabic
22 de julho — A Cohere destaca o Speech Tashkeel 2B, um modelo parceiro desenvolvido pela NAMAA que converte o árabe bruto em texto totalmente diacritizado (marcas gramaticais de caso, harakāt, tanwīn, sukūn, shadda), com uma versão quantizada em 4 bits. O anúncio é acompanhado por contribuições da comunidade em torno do Transcribe Arabic, o modelo de reconhecimento de fala árabe da Cohere: o aplicativo listen-habibi, suporte nativo a Ruby e quantizações GGUF/ONNX publicadas no Hugging Face. A Cohere anuncia ainda uma parceria com a HUMAIN para estender esse trabalho a outras línguas com poucos recursos.
North Mini Code, modelo de código leve e econômico
21 de julho — A Cohere apresenta o North Mini Code, um modelo de código open source concebido para tarefas repetitivas e pouco complexas — depuração, criação de testes unitários — posicionado como alternativa econômica a modelos maiores para reduzir os custos de inferência.
🔗 Speech Tashkeel 2B — 🔗 North Mini Code
Breves
- Warp publica um texto sobre as tensões econômicas das startups de IA em hiper-crescimento — análise de um estreitamento das receitas no horizonte para startups em forte crescimento. 🔗 Fonte
- Hugging Face organiza seu primeiro evento no Japão, em Tóquio — apresentação das ferramentas recentes e dos planos da empresa para o mercado japonês, em Otemachi. 🔗 Fonte
- Ai2 publica uma nova versão do PaperFinder — ferramenta de busca documental científica elogiada por um pesquisador usuário frequente, sem detalhes técnicos divulgados. 🔗 Fonte
- Sakana AI publica uma visão geral do Fugu, « One Model to Command Them All » — texto de blog ampliando o alcance do modelo de orquestração para além da versão Fugu-Cyber já coberta. 🔗 Fonte
- Gemini Live — guia de câmera para assistência visual em tempo real — apontar a câmera para um objeto ou documento para obter ajuda contextual sem precisar descrever a situação por escrito. 🔗 Fonte
- AlphaFold — nova aplicação em engenharia de proteínas às vésperas dos 5 anos da base — Pushmeet Kohli (Google DeepMind) celebra um uso para preencher áreas estruturais obscuras na biologia. 🔗 Fonte
- Novo painel de impacto das métricas Copilot (Enterprise) — coortes de adoção (Code-first, Agent-first, Multi-agent, Passivos) com indicadores de velocidade e de merge por usuário. 🔗 Fonte
- Copilot Business/Enterprise — visibilidade dos créditos de IA por ciclo de faturação — exibição agora possível mesmo sem orçamento individual atribuído. 🔗 Fonte
- GHES — endurecimento próximo do upload dos bundles de suporte (18 de agosto de 2026) — rejeição de uploads provenientes de instâncias não patchadas; atualização necessária para 3.21.3, 3.20.5, 3.19.9, 3.18.12 ou 3.17.18. 🔗 Fonte
- NVIDIA lança os módulos Jetson Thor T2000 e T3000 — novos módulos para robótica e IA na borda, sem ficha técnica detalhada disponível neste estágio. 🔗 Fonte
- Cisco lança Antares, pequenos modelos para detectar vulnerabilidades em código — Antares-350M e Antares-1B, disponíveis no Hugging Face, executáveis localmente para evitar enviar código sensível para a nuvem. 🔗 Fonte
- HeyGen HyperFrames — Dia 17/30: o fluxo Storyboard — plano em três passagens (cartões, esboços, renderização final) com revisão por comentário frame a frame. 🔗 Fonte
- Kling AI publica um tutorial MCP para criar performances cinematográficas com agentes — fluxo criativo completo em um agente: personagem, emoção, geração de vídeo em lote. 🔗 Fonte
- Uma família constrói uma cabana na árvore com o ChatGPT como consultor — projeto estrutural, escolha de materiais e tradução das ideias das crianças em planos viáveis. 🔗 Fonte
- Codex Live Build — sessão de construção ao vivo — transmissão com os criadores dos teclados Codex Micro. 🔗 Fonte
- Uma jogadora recria os Dolomitas italianos em jogo eletrônico com Codex — mundo aberto « Valdiluce » com escalada, voo planado e teleférico funcional. 🔗 Fonte
- Promoção ChatGPT Work — 100 dólares em créditos oferecidos — aos 10 000 primeiros participantes que publicarem no X o que apreciam no ChatGPT Work. 🔗 Fonte
O que isso significa
O roteamento de modelos está se impondo como o novo campo de competição das ferramentas de código: o Cursor Router promete 60% de economia sem perda perceptível de qualidade ao escolher automaticamente o modelo certo por requisição, enquanto a Artificial Analysis mostra, em sentido oposto, que o Kimi K3, segundo melhor score no seu benchmark de trabalho de conhecimento agentivo, custa cerca de dez vezes mais que sua geração anterior e leva quase uma hora por tarefa. A mensagem é a mesma dos dois lados: a força bruta de um modelo já não basta para justificar seu uso, e a arbitragem custo/qualidade/latência se torna o verdadeiro parâmetro de decisão para equipes que implantam essas ferramentas em grande escala.
Os agentes corporativos passam claramente de uma lógica de demonstração para uma lógica de produção. O OpenAI Presence estrutura explicitamente políticas, salvaguardas e escalada humana em torno do raciocínio dos modelos; as Synthesia Roleplay Sessions quantificam ganhos concretos de capacitação em condições reais; o GitHub Copilot Canvases documenta um caso em que um agente verificou seu próprio trabalho até a tela de pagamento, substituindo testes escritos à mão; e o Claude Managed Agents acrescenta níveis de esforço e webhooks pensados para workflows agentivos complexos em produção. Esses anúncios convergem para a mesma exigência: tornar os agentes confiáveis e controláveis ao longo do tempo, não apenas capazes em uma demonstração.
No terreno institucional, a Genesis Mission do DOE ilustra uma corrida agora aberta a três — Google, OpenAI e Arcee AI — para se inserir na pesquisa científica pública americana, cada uma com sua própria lógica: tokens e créditos de nuvem para Google, acesso ao Codex e à API para OpenAI, modelo aberto governado para Arcee AI. Essa dinâmica institucional se soma a uma corrida à infraestrutura física, com o Project Camellia (3,2 gigawatts na Geórgia) e a fábrica de superchips Wistron em Fort Worth (700 milhões de dólares, várias centenas de empregos) mostrando que a capacidade de computação e o enraizamento territorial se tornam argumentos de comunicação por si só, quantificados e detalhados publicamente.
Por fim, a geração multimodal continua se diversificando por baixo e por cima: o Qwen-Image-3.0 empurra o realismo e a utilidade profissional de um modelo de fronteira, enquanto o Mage-Flow (Microsoft Asia, 4 bilhões de parâmetros) e o Cosmos 3 Super (NVIDIA, até 25 vezes mais rápido) apostam na compacidade e na velocidade para tornar essas capacidades acessíveis com menor custo de computação. O caso de uso ElevenLabs/Obrii na Ucrânia lembra, além disso, que essas tecnologias de voz também encontram usos de serviço público de alto impacto social, para além dos usos comerciais.
Fontes
- Cursor Router — changelog
- Presença OpenAI
- Projeto Camélia
- Qwen-Image-3.0
- Sessões de Roleplay da Synthesia
- Google DeepMind — Missão Genesis
- OpenAI — Missão Genesis
- Arcee AI — Genesis-Science-1
- Segurança do Claude
- Anthropic Economic Index — conector
- Agentes Gerenciados do Claude
- Claude Code — simulador iOS
- Amp Multiplayer
- Warp — links OSC 8
- Replit — aplicativo móvel
- Microsoft Asia — Mage-Flow
- Galaxy Unpacked 2026 — Gemini
- Gemini 3.5 Pro — teste de parceiros
- Modo de Planejamento do Manus
- GitHub Copilot — Canvases
- GitHub Copilot vs acesso bruto à API
- ElevenLabs — Vocals e Styles
- ElevenLabs — Obrii Ukraine
- NVIDIA — simulação física médica
- NVIDIA/Wistron — fábrica de Fort Worth
- NVIDIA — Cosmos 3 Super
- NVIDIA — balanço do Desafio de Reasoning Nemotron
- Kimi K3 — AA-Briefcase
- OpenAI — usos na imprensa
- OpenAI — limites de gasto da API
- Cohere — Speech Tashkeel 2B
- Cohere — North Mini Code