ai-powered-markdown-translatorArtigo traduzido do francês para o português com o gpt-5.6-sol.
Nesta quarta-feira, a Anthropic funde o chat e o Cowork num único Claude, que escolhe as suas próprias ferramentas, e lança o Claude Docs e o Claude Slides em versão beta. A Zed abre o Delta a todos, substituindo a pull request por uma revisão no fio de discussão, e a NVIDIA faz o Vera Rubin NVL72 estrear no MLPerf Inference v6.1, num momento em que a eletricidade se impõe como a restrição das fábricas de IA. Os agentes de marcas também entram na publicidade, tanto no ChatGPT como no YouTube, enquanto a Cohere assina o acordo definitivo com a Aleph Alpha e a Mistral chega ao Firefox.
Um único Claude: o chat e o Cowork fundem-se, Claude Docs e Claude Slides chegam em versão beta
16 de setembro — A Anthropic funde o chat e o Claude Cowork: já não há um modo para escolher, o Claude decide por si próprio se deve pesquisar na web, ler ficheiros ou executar código, e entrega ficheiros concluídos. As tarefas longas continuam na cloud mesmo com o computador desligado, mas os ficheiros locais, o navegador integrado e o controlo do computador (computer use, em versão beta nos planos Pro e Max) exigem que o Claude Desktop esteja aberto.
Today, chat and Cowork start merging into one Claude. The direction: one Claude that carries context across everything you’re working on, wherever you are.
🇵🇹 Hoje, o chat e o Cowork começam a fundir-se num único Claude. O rumo: um único Claude que mantém o contexto de tudo aquilo em que trabalha, onde quer que esteja. — Boris Cherny (Anthropic) no X
Os novos Claude Docs e Claude Slides produzem documentos e apresentações, e o Claude Design, lançado em abril, passa agora a funcionar nas conversas. Os três estão em versão beta nos planos pagos, mediante escolha dos administradores Enterprise. Cada criação pode ser partilhada por ligação, com as apresentações a poderem ser exportadas para PowerPoint ou PDF. No modo Manual, a predefinição, o Claude pede autorização antes de cada ação; no modo Auto, verificações de segurança automatizadas antecedem cada ação.
| Plano ou público abrangido | Calendário anunciado |
|---|---|
| Pro e Max (web, desktop, mobile) | «Ao longo das próximas semanas», sem nada para ativar |
| Team e Free | «Em breve», sem data |
| Enterprise | Aviso prévio de pelo menos 30 dias antes de qualquer mudança |
A mudança é definitiva, mas as tarefas, os projetos, os conectores, as skills e os artefactos do Cowork são preservados. No lançamento, o centro de ajuda assinala algumas limitações: não é possível adicionar conteúdo a partir do GitHub nem criar ramificações de conversas, as conversas incógnitas abrem na experiência antiga, as antigas tarefas do Cowork não aparecem na pesquisa e o Dispatch está fechado a novos utilizadores. O Chat e o Cowork já partilhavam projetos e artefactos desde 7 de julho, e a memória desde 25 de agosto.
🔗 Publicação da Anthropic 🔗 Centro de ajuda
Design, Slides e Docs também funcionam no Claude Code
No mesmo dia, a @ClaudeDevs indica que o Claude Design, o Claude Slides e o Claude Docs também funcionam no Claude Code: é possível pedir um suporte para revisão de design (design review deck) ou uma maquete de interface, direcionando o Claude para os ficheiros reais e os RFC do repositório, modificar o resultado diretamente ou na conversa e, em seguida, partilhar a ligação. No caso do Design, não se trata de uma estreia, uma vez que o comando /design existe em versão preliminar de investigação desde 17 de agosto: a novidade está no Slides e no Docs. O tweet não especifica uma versão mínima, planos ou documentação, e as notas da versão mais recente publicada não fazem qualquer referência a isso.
Zed abre o Delta em versão beta pública e substitui a pull request por uma revisão no fio de discussão
16 de setembro — A Zed abre o Delta a todos. Lançada a 12 de agosto mediante inscrição, e depois a 4 de setembro no Windows para os inscritos, a ferramenta pode agora ser descarregada livremente no macOS, Linux e Windows, utilizada na web sem instalação, e os seus fios de discussão (threads) podem ser acompanhados a partir de um dispositivo móvel.
A ideia central é colaborar sem commit nem push. Um colega de equipa convidado para a conversa com o agente vê as mesmas cópias de trabalho (worktrees), pode retomá-las na sua máquina, questionar o agente sobre as suas escolhas ou continuar se o autor se desligar. A revisão de código, apresentada numa prévia a 10 de setembro, substitui a pull request: um subfio guia o revisor pelas alterações da branch, com o contexto do agente original, numa cópia isolada dos worktrees. Em seguida, o comando /land encarrega o agente de agrupar tudo num único commit, passar pela CI, efetuar a fusão após a aprovação da equipa e eliminar a branch.
No repositório do Delta, as pull requests foram desativadas na semana anterior ao anúncio, e 33 pessoas já fundiram aí 570 alterações desde então; o repositório do editor Zed permanece no GitHub «por enquanto». Nos bastidores, o DeltaDB complementa o controlo de versões do Git com deltas incrementais que preservam, entre dois commits, as alterações e as mensagens tanto dos humanos como dos agentes; o commit continua a ser o ponto de controlo, de modo que um colega de equipa que nunca abra o Delta vê um repositório Git comum.
A Zed afirma querer substituir o GitHub.com e chama a esta forma de trabalhar engenharia contínua (continuous engineering); o seu roteiro, sem data, prevê armazenamento Git no DeltaDB e considera, a prazo, uma verificação semelhante à CI no fio de discussão. O Delta é gratuito durante a versão beta, estão anunciados planos pagos «em breve», sem preço nem data, e a Zed promete manter uma versão gratuita.
🔗 Publicação da Zed sobre a versão beta pública do Delta 🔗 Fio da Zed sobre o comando /land
Vera Rubin NVL72 estreia no MLPerf Inference v6.1 com até 3,7 vezes o débito do GB300 NVL72
16 de setembro — A NVIDIA faz estrear o Vera Rubin NVL72, a sua plataforma rack de próxima geração, no MLPerf Inference v6.1, cujos resultados são publicados pela MLCommons, com submissões em versão preliminar (preview). Segundo as comparações da NVIDIA entre as suas próprias submissões, o rack atinge até 3,7 vezes o débito do GB300 NVL72 no Qwen3-VL, nos cenários offline, servidor e interativo, com vLLM e NVIDIA Dynamo, e até 2,5 vezes no DeepSeek-R1 com TensorRT-LLM. A Nebius também submeteu resultados do Vera Rubin NVL72 em versão preliminar.
A NVIDIA atribui estes ganhos à conceção conjunta de hardware e software: precisão NVFP4 para os pesos, a atenção e a cache KV, serviço desagregado que separa o pré-preenchimento (prefill) e a descodificação, paralelismo de especialistas em grande escala e domínio NVLink de sexta geração, para o qual a NVIDIA reivindica um débito de pacotes 10 vezes superior ao da Ethernet padrão. A geração atual também publica os seus números:
| Teste MLPerf Inference v6.1 | Sistema submetido | Resultado publicado pela NVIDIA |
|---|---|---|
| DeepSeek-R1 offline, de 72 a 288 GPU | GB300 NVL72, de 1 a 4 racks | 99 % de eficiência de escalabilidade |
| WAN 2.2, texto para vídeo | GB300 NVL72 | 0,65 vídeo 720p por segundo, 5,7 s por vídeo |
| Qwen3-VL, v6.1 em comparação com v6.0 | GB300 NVL72 | Até 1,6 vezes, graças ao software |
| Edge-Agentic, novo teste (Qwen3.6-27B) | Jetson AGX Thor, TensorRT Edge-LLM | Submissão sem números na publicação |
A NVIDIA também comunica ganhos obtidos após o prazo-limite no GPT-OSS-120B e no DLRMv3, que a MLCommons ainda não verificou. A empresa reivindica 19 parceiros, oito dos quais em sistemas multinó Blackwell NVL72, e menciona o futuro teste MLPerf Endpoints da MLCommons, que deverá padronizar a medição da inferência agêntica.
🔗 NVIDIA Vera Rubin NVL72 oferece desempenho de liderança na estreia no MLPerf Inference v6.1
A eletricidade no centro das fábricas de IA: DSX MaxLPS na Lambda e a aliança AEMA
15 e 16 de setembro — Dois anúncios da NVIDIA colocam a rede elétrica no centro da implementação da IA, ambos com a Emerald AI: uma fábrica de IA controlada pelo seu software reduziu o consumo a pedido de um fornecedor de eletricidade e, depois, a Emerald AI, a Google e a NVIDIA lançaram uma aliança para data centers flexíveis.
AI Infra Summit: Lambda valida o DSX MaxLPS, uma fábrica de IA reduz o consumo a pedido da rede
15 de setembro — No AI Infra Summit, a keynote de Ian Buck (NVIDIA) centrou-se nos tokens produzidos por megawatt nas fábricas de IA (AI factories). A Lambda validou o DSX MaxLPS, o software da NVIDIA que monitoriza o consumo das GPU e dos racks e redistribui a potência de acordo com as cargas: 19 nós HGX B200 funcionaram dentro do orçamento elétrico de 16 nós à potência máxima, com o débito a passar de cerca de 4 para 5 milhões de tokens por segundo (+24 %) e um aumento de 23 % no desempenho por watt. A NVIDIA projeta até 40 % mais capacidade de GPU para o Vera Rubin NVL72 com o mesmo orçamento, «em ambientes adequados». Numa noite de agosto, um sinal da Silicon Valley Power fez uma fábrica de IA em Santa Clara, controlada pelo Emerald AI Conductor, reduzir automaticamente o consumo de 4 para 3 MW, sem interromper a inferência prioritária; desde então, foram atendidos mais de 200 sinais, com uma resposta em menos de um minuto. O DSX Flex, que processa este tipo de sinais, terá a sua primeira implementação comercial dedicada numa fábrica Vera Rubin de 96 MW em Manassas, na Virgínia.
AEMA, uma aliança para data centers que se adaptam à rede
16 de setembro — A Emerald AI, a Google e a NVIDIA lançam a AI Energy Management Alliance (AEMA), uma coligação para data centers capazes de modular o seu consumo em função do estado da rede: deslocar cargas, recorrer ao armazenamento, apoiar-se numa produção associada ou reagir a incidentes. Os seus princípios: definir antes da ligação as obrigações de continuidade de funcionamento (ride-through), redução de consumo (curtailment) e resposta a incidentes, padronizar as métricas, abrir vias de ligação mais rápidas mediante compromissos de flexibilidade verificáveis e repartir os custos de acordo com os impactos reais. A aliança visa os Estados Unidos, e os seus parceiros de lançamento não são identificados. No seu site, apresenta dois potenciais: 100 GW que poderiam ser desbloqueados na rede existente com data centers moderadamente flexíveis e 733 milhões de dólares de custos evitados por GW de novos data centers flexíveis. A NVIDIA e a Emerald AI já tinham apresentado fábricas de IA flexíveis na CERAWeek, a 31 de março.
🔗 Publicação da NVIDIA sobre a AEMA 🔗 Site da AEMA
Os agentes de marcas entram na publicidade, no ChatGPT e no YouTube
16 de setembro — No mesmo dia, a OpenAI e a Google colocam o agente conversacional de uma marca no formato publicitário, nos Estados Unidos: em teste com anunciantes selecionados na OpenAI e em versão beta, mediante inscrição dos comerciantes, na Google.
ChatGPT Ads testa os Sponsored Agents e liga-se ao HubSpot e ao Shopify
A OpenAI acrescenta IA aos dois lados da sua plataforma ChatGPT Ads. Com os Sponsored Agents, um clique num anúncio no ChatGPT pode abrir uma conversa claramente identificada com um agente patrocinado pela marca, antes de apresentar uma ligação para o respetivo site. A OpenAI esclarece que esta interação é distinta das respostas independentes do ChatGPT e está separada da conversa original.
| Novidade do ChatGPT Ads | Estado em 16 de setembro |
|---|---|
| Sponsored Agents | Em teste com anunciantes selecionados nos Estados Unidos |
| Plugin Ads Manager, campanhas orientadas por prompts | Em implementação |
| Textos e elementos visuais sugeridos no Ads Manager | Em implementação |
| Personalização e tradução do texto | Lançadas, ativáveis opcionalmente (opt-in) |
| Integração com o HubSpot | Disponível |
| Aplicação ChatGPT Ads para o Shopify | Comerciantes dos EUA, outros mercados do ChatGPT Ads a partir de 23 de setembro |
A publicação não indica preços nem o número de anunciantes. Testada no ChatGPT em fevereiro, a publicidade ganhou em maio um Ads Manager em versão beta e self-service (self-service); depois, a OpenAI afirmou, a 31 de agosto, ter alcançado mil milhões de dólares de receita anualizada ao alargar esse self-service.
🔗 Reimaginar a publicidade com IA
Google coloca o Business Agent nos anúncios do YouTube e reforça o comércio agêntico
A Google publica as suas atualizações de comércio agêntico (agentic commerce) para a época festiva. O Business Agent, que chegou ao Search «no início deste ano», segundo a Google, entra em versão beta nos anúncios do YouTube nos Estados Unidos, mediante inscrição dos comerciantes: o espectador pode questionar o agente sobre os produtos sem sair do YouTube. O AI performance insights, que compara a quota de voz (share of voice) de uma marca no AI Mode e no AI Overviews, passa a estar disponível no Merchant Center na Austrália, Canadá, Índia, Nova Zelândia e Estados Unidos. No Merchant Center, o hub de integração do UCP (Universal Commerce Protocol), o protocolo apresentado pela Google a 11 de janeiro, acrescenta a transferência do carrinho para o site do comerciante e testes do percurso de pagamento, com análises a chegar «em breve»; estas funcionalidades são implementadas progressivamente nos Estados Unidos e, depois, na Austrália e no Canadá «no início do próximo ano». A Tapestry (Coach, Kate Spade) já vende através do UCP no Search e na aplicação Gemini. Segundo a Google, as boas práticas dos feeds de produtos proporcionam, em média, mais 5 % de conversões no mês seguinte e, durante testes com a lululemon, os atributos conversacionais da marca foram utilizados em 50 % das recomendações pertinentes do AI Mode.
🔗 Publicação da Google sobre o comércio agêntico
Cohere assina com a Aleph Alpha e lança Confidential Computing no Model Vault
16 de setembro — A Cohere multiplica os anúncios, incluindo dois dirigidos a clientes que querem manter o controlo dos seus dados e da sua tecnologia.
Aleph Alpha: acordo definitivo e dupla sede em Berlim e Toronto
A Cohere e a Aleph Alpha assinaram o acordo definitivo de combinação de negócios (definitive business combination agreement), cujo projeto havia sido anunciado em 24 de abril. O conjunto operará sob o nome Cohere, com mais de 1.000 funcionários, uma dupla sede prevista em Berlim e Toronto e um centro de investigação em Heidelberg, nas instalações da Aleph Alpha. A transação, cujo valor não foi divulgado, continua sujeita às últimas autorizações regulamentares; a sua conclusão é esperada «mais para o final deste ano». Ilhan Scheer, codiretor executivo da Aleph Alpha, tornar-se-á então diretor de operações da Cohere, e Samuel Weinbach, cofundador, diretor de investigação. A parceria com o grupo Schwarz prossegue na STACKIT, a sua cloud soberana.
No government or enterprise should have to choose between capable AI and control over their tech. That belief is exactly why we’re joining forces with Aleph Alpha. Together, we’ll meet the rising global demand for frontier AI that’s both powerful and secure.
🇵🇹 Nenhum governo nem nenhuma empresa deveria ter de escolher entre uma IA de alto desempenho e o controlo da sua tecnologia. É precisamente esta convicção que nos leva a unir forças com a Aleph Alpha. Juntos, responderemos à crescente procura mundial por uma IA de fronteira simultaneamente poderosa e segura. — Aidan Gomez (Cohere), citado pela @cohere no X
🔗 Publicação da Cohere sobre o acordo
Confidential Computing no Model Vault, em acesso antecipado
A Cohere lança o Confidential Computing no Model Vault, a sua plataforma de inferência dedicada e totalmente gerida, para proteger os dados durante o seu processamento, e não apenas quando estão armazenados e em trânsito. São descritos três mecanismos: inferência encriptada de ponta a ponta, isolamento imposto pelo hardware que se estende até à GPU com NVIDIA Confidential Computing e um token de certificação assinado, disponível mediante pedido e verificável com as chaves públicas do fabricante do hardware. A Cohere afirma que ninguém, «nem mesmo nós», pode aceder às cargas de trabalho do cliente, sem mencionar qualquer auditoria independente. O acesso antecipado está reservado a um grupo limitado de clientes beta, sem preço, data de disponibilidade geral ou lista de modelos, e o anúncio limita-se a tweets e a uma página de produto. A funcionalidade tinha sido anunciada como disponível em breve em 9 de setembro.
🔗 Anúncio da Cohere no X 🔗 Página de produto do Model Vault
Mistral impulsiona o Smart Window, o assistente de IA do Firefox
16 de setembro — Numa publicação conjunta, a Mistral AI e a Mozilla anunciam que o Smart Window, o assistente de navegação com IA do Firefox ainda em fase beta, funciona agora com modelos Mistral, sem especificar quais. O assistente ajuda a destrinçar pesquisas complexas e a reunir fontes a partir dos separadores abertos. A Mistral começa por fornecê-lo aos utilizadores em França e na América do Norte, estando o Reino Unido e a Alemanha previstos «mais para o final deste ano». Por predefinição, as conversas não são conservadas nos servidores da Mozilla, e parceiros como a Mistral comprometem-se com a retenção zero de dados (zero data retention). Para a Mistral, que afirma servir «tradicionalmente» as empresas, o acordo abre o acesso ao grande público. Arthur Mensch, cofundador e CEO da Mistral, fala de dois defensores do open source que trabalham em conjunto, e Anthony Enzor-DeMeo, CEO da Mozilla Corporation, considera que um navegador não deve ser um funil de sentido único.
🔗 Publicação conjunta da Mistral e da Mozilla
Grok Build retém as convenções e decisões de um projeto entre sessões
16 de setembro — A SpaceXAI dota o Grok Build, o seu agente de código, de memória. Após cada interação concluída, o Grok relê-a em segundo plano, sem bloquear a sessão, e regista numa nota Markdown aquilo que perdura: convenções da equipa, decisões e respetivas justificações, factos do projeto, como o comando que inicia os testes. O estado das tarefas, as conclusões provisórias, os segredos e aquilo que já está abrangido pelo repositório ou pela sua documentação ficam excluídos. As notas são organizadas por projeto, com um conjunto global para as preferências aplicáveis em todo o lado. O comando /dream agrupa-as em ficheiros temáticos e também é executado automaticamente de forma periódica, enquanto /memory abre um navegador em modo de leitura. Ao regressar a um projeto, o Grok lê os temas da área em que vai trabalhar, mas a conversa em curso prevalece sobre as notas. A memória só se aplica a novas sessões. A versão beta de 25 de maio já indicava uma persistência das decisões entre sessões; a publicação detalha o mecanismo.
Qwen Code v0.24.0 confina o agente ao nível do kernel no Linux e altera os hooks bash
16 de setembro — Dois dias após a v0.23.4, o Qwen Code v0.24.0 adiciona no Linux uma sandbox baseada no kernel através do bubblewrap (bwrap), sem contentor, privilégios root, daemon ou imagem. Mediante ativação, reinicia a CLI por trás de uma vista do sistema de ficheiros em modo de leitura, na qual apenas o espaço de trabalho e alguns diretórios (temporários, cache, Qwen, Git) permanecem graváveis; qwen sandbox apresenta a configuração e --verify testa o confinamento. O autor da PR enumera as suas limitações: ausência de um namespace PID separado, sockets Unix do anfitrião acessíveis e definições do Git e do Qwen modificáveis. Alteração incompatível (breaking change): nos hooks executados em bash, $QWEN_PROJECT_DIR e os seus equivalentes Claude e Gemini, lidos a partir do ambiente em vez de serem substituídos, devem aparecer entre aspas duplas. O web_search tem um limite por sessão (200 por predefinição, 10.000 no máximo), um orçamento como +500k na mensagem dimensiona uma interação completa, e as mensagens entre sessões estão ativadas por predefinição.
Devin lança Code Scans, auditorias de toda a base de código orientadas por um objetivo
16 de setembro — A Cognition lança Code Scans no Devin: parte-se de um objetivo amplo, em vez de uma alteração específica, incluindo, se necessário, critérios próprios (normas da equipa, grelha de acessibilidade, requisitos de uma migração), e o Devin investiga a base de código, prioriza as suas conclusões, discute-as e depois abre as pull requests solicitadas. Iniciada por /scan na aplicação web, já mencionada nas notas de versão de 2 de setembro, a análise adota a arquitetura MapReduce agêntica (Agentic MapReduce) do Devin Security Swarm, apresentada em julho, em quatro fases: planeamento, divisão em lotes, exploração em paralelo e síntese. A Cognition publica dois testes: no Dioxus, uma compilação debug completa de 22 crates passa de 58,6 para 21,0 segundos, ou seja, uma redução de 64%; uma análise de SEO da devin.ai e da cognition.com identifica 44 conclusões, após o que a pontuação Ahrefs da devin.ai passa de 87 para 92 e as suas páginas lentas diminuem 73%. Nenhum preço é especificado.
Claude for Small Business passa para 43 fluxos de trabalho e 27 novas integrações
15 de setembro — Numa publicação que o nosso levantamento de 15 de setembro não tinha identificado, a Anthropic expande o Claude for Small Business, o seu plugin para pequenas empresas lançado em maio com 15 fluxos de trabalho (workflows). Conta agora com 43, com 27 novas integrações, incluindo Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Gusto, Square, Stripe e Zapier, e reivindica mais de 900.000 instalações. Cada fluxo começa em modo de aprovação, e a autonomia é configurada fluxo a fluxo, de forma reversível. A Anthropic relança também a formação: digressão de outono com a Tenex em 10 cidades norte-americanas, mais de 150 organizações de formação certificadas para mais de 750 workshops e 14 webinars de parceiros. A oferta está disponível em todos os planos pagos; o balanço da digressão da primavera tinha sido publicado em 10 de setembro.
🔗 Publicação da Anthropic sobre o Claude for Small Business
ElevenLabs lança Reception, um rececionista de IA para pequenas empresas
16 de setembro — A ElevenLabs lança o Reception, um rececionista de IA para pequenas empresas desenvolvido sobre a sua plataforma ElevenAgents. Responde 24 horas por dia a perguntas sobre os serviços, os horários ou a morada, na língua de quem telefona, e depois marca a reunião no calendário, seja como recurso quando a equipa não atende, seja após o horário de encerramento. O serviço tem o seu próprio site, reception.ai, e pode ser experimentado gratuitamente durante 14 dias, com 30 minutos de chamadas.
| Plano Reception | Preço mensal sem impostos | Minutos de chamadas incluídos |
|---|---|---|
| Basic | 29 dólares | 75 |
| Plus | 79 dólares | 275 |
| Premium | 199 dólares | 1 000 |
| Enterprise | Mediante orçamento | À medida |
Todos os planos incluem mais de 70 línguas, Google Calendar, Calendly, Zapier, webhooks e um servidor MCP.
🔗 Apresentação do Reception, da ElevenAgents 🔗 Preços do Reception
Synthesia disponibiliza a sua Interactive Avatar API, avatares em tempo real a 0,10 euros por minuto
16 de setembro — A Synthesia disponibiliza de forma geral a sua Interactive Avatar API, que integra num produto avatares capazes de ouvir, falar e responder em tempo real. O cliente fornece o seu LLM, a sua base de conhecimentos e a sua lógica; a Synthesia gere o rosto, a voz e a sincronização labial. O avatar entra numa sala LiveKit como participante de vídeo graças a um plugin que, segundo as perguntas frequentes, por enquanto apenas é compatível com agentes LiveKit escritos em Python. A API é faturada com base na utilização, a 0,10 euros por minuto, sem compromisso, com 500 minutos gratuitos. Um plugin Pipecat e uma oferta de ponta a ponta, com LLM, conhecimentos e voz geridos, são anunciados para «brevemente», sem data. A Synthesia tinha publicado em julho o quadro de investigação dos seus modelos de avatares interativos.
🔗 Anúncio da Synthesia no X 🔗 Página Interactive Avatars da Synthesia
Koa, o modelo de CRM da Salesforce construído sobre o Nemotron 3 Super
15 de setembro — Na Dreamforce, a Salesforce apresentou o Koa, o seu primeiro modelo de raciocínio dedicado à gestão da relação com o cliente (CRM), obtido através do pós-treino do NVIDIA Nemotron 3 Super com NeMo RL, NeMo Gym e NeMo AutoModel num conjunto de dados sintético. A Salesforce controla os pesos e executa o modelo na sua própria infraestrutura; segundo a Salesforce, nenhum dado de clientes foi utilizado no treino nem é utilizado na inferência. No CRM Bench, o seu próprio benchmark (atualização de uma oportunidade, encaminhamento de um caso, planeamento de um contacto de seguimento), o Koa iguala ou supera os modelos de ponta com três vezes menos erros, sem que sejam indicados os modelos comparados. Já utilizado internamente no Slack, entra em outubro num programa-piloto como modelo selecionável no Agentforce, nomeadamente na Formula 1 e na Xero, antes de uma disponibilidade geral prevista para o inverno de 2026 nas regiões norte-americanas.
🔗 Publicação da NVIDIA sobre Jensen Huang na Dreamforce
Runway detalha a moderação em tempo real dos seus futuros modelos de vídeo
16 de setembro — A Runway prevê lançar modelos de geração de vídeo em tempo real «nos próximos meses» e explica como os moderará. Na transmissão contínua (streaming), o utilizador vê o vídeo antes de qualquer controlo final. Por isso, a Runway concebeu e testou um sistema mais rápido: verificação acelerada das entradas, moderação síncrona que analisará as imagens do fluxo e interromperá a transmissão assim que surgir conteúdo problemático, seguida do controlo do vídeo completo antes de qualquer transferência ou partilha. O classificador, CoPE-B da Zentropi, é um adaptador LoRA sobre o Gemma-4-26B-A4B-it, uma mistura de especialistas com 25,2 mil milhões de parâmetros, dos quais 3,8 mil milhões ativos; a verificação demora, em média, menos de 0,5 segundos. Nos testes, entradas no limite permitiram que aparecesse brevemente conteúdo proibido antes da interrupção. O sistema juntar-se-á às proteções existentes da Runway, e os vídeos em tempo real incluirão, tal como as suas outras criações, sinais de proveniência C2PA.
Breves
- Zed 1.20.1 adiciona Gemini 3.8 Flash — a versão estável semanal do editor traz também uma animação opcional do cursor, a abertura de ficheiros Markdown numa pré-visualização renderizada e binários para macOS e Linux cerca de 25% mais pequenos; corrige uma falha que podia expor ficheiros privados aos colaboradores através da pesquisa no projeto. 🔗 fonte
- Replit abre os conectores personalizados em versão beta (Custom Connectors) — os administradores de um espaço de trabalho podem declarar uma API REST em HTTPS, autenticada por chave de API, para que o Agent a utilize para além dos conectores oficiais; a documentação menciona os clientes Pro e Enterprise, mas uma caixa informativa reserva a versão beta ao Enterprise. 🔗 fonte
- NVIDIA confia a agentes a portabilidade do TileGym para cuTile Rust — oito dias após o lançamento do CUDA Rust, uma skill multiagente disponibilizada no TileGym portou os 24 operadores públicos da biblioteca, que mantêm, em média, 99,5% do desempenho do cuTile Python em 347 configurações medidas no DGX B200. 🔗 fonte
- OpenAI publica um guia sobre as análises da Admin Console — as vistas Usage, Insights e Outcomes, medindo esta última a proporção de commits integrados com contribuição do Codex, devem associar a utilização do ChatGPT Work e do Codex a resultados; o retorno do investimento de 245% citado é explicitamente hipotético, e a documentação associada continuava indisponível no momento da nossa verificação. 🔗 fonte
- A API da OpenAI regulamenta a criação de chaves — adicionada ao changelog em 15 de setembro, cinco dias após a chegada das datas de expiração, a secção API Key Governance permite que os administradores autorizem apenas chaves de contas de serviço, apenas chaves de projeto detidas por um utilizador ou bloqueiem qualquer nova chave; as chaves existentes não são alteradas. 🔗 fonte
- Copilot: os pedidos de aumento de orçamento chegam à disponibilidade geral — no Copilot Business e Enterprise com faturação baseada na utilização, um membro que tenha esgotado os seus créditos de IA pode pedir um orçamento adicional; os proprietários e gestores de faturação definem o montante e aprovam-no, restabelecendo imediatamente o acesso. 🔗 fonte
- O AI Scan de pull requests já não exige a configuração predefinida do CodeQL — a deteção de vulnerabilidades por IA em pull requests estende-se aos repositórios elegíveis sem esta configuração, em pré-visualização pública para clientes do GitHub Advanced Security no github.com; o GitHub Enterprise Server não é suportado. 🔗 fonte
- As configurações do GitHub Advanced Security passam a ser impostas às organizações — desde 15 de setembro, os administradores empresariais podem impedir que os administradores das organizações, e não apenas os proprietários dos repositórios, alterem as configurações de segurança definidas ao nível da empresa. 🔗 fonte
- GitHub desativa o SHA-1 em HTTPS — conforme anunciado em 20 de abril, o changelog de 15 de setembro confirma o fim do SHA-1 nas ligações HTTPS ao github.com e às suas CDN parceiras, incluindo o GitHub Enterprise Cloud; são afetados os navegadores, os clientes da API e o Git através de HTTPS, mas não o GitHub Enterprise Server. 🔗 fonte
- MiniMax H3 chega em modalidade sem servidor (serverless) à Together AI — anunciado num tweet de 15 de setembro às 16h58, hora do Pacífico, o modelo de vídeo aberto com 33 mil milhões de parâmetros, que gera clipes de 4 a 15 segundos até 2K com som estéreo nativo, surge na plataforma com o preço de 0,1391 dólares por vídeo. 🔗 fonte
- MiniMax apresenta o H3 IP Edition — ao fazer o balanço da sua conferência em Tóquio com a KAGAMI AI, a MiniMax afirma ter apresentado uma edição do H3 associada a propriedades intelectuais japonesas com licenciamento oficial, sem catálogo de licenças, data ou preço. 🔗 fonte
- Runway adiciona cinco modelos de terceiros com a sua coleção Fall 2026 — Fish Audio S2.1 Pro, Cartesia Sonic 3.6, MiniMax H3 Max, FLUX Video Upscale e FLUX Video Edit juntam-se à plataforma, sem preço anunciado; vários já estavam disponíveis noutros locais, como o FLUX Video Upscale na Black Forest Labs desde 20 de agosto e o H3 Max desde 27 de agosto. 🔗 fonte
- Luma lança Camera Angles — publicada em 15 de setembro às 16h26, hora do Pacífico, a funcionalidade do Luma Agents regenera o sujeito de uma única fotografia a partir dos ângulos escolhidos, preservando os detalhes, sem indicação de modelo ou dados quantitativos. 🔗 fonte
- Grok Voice chega à fal — a plataforma de inferência disponibiliza o modelo de voz da SpaceXAI em Speech to Speech e em tempo real; segundo a fal, responde em 0,70 segundos e custa 0,00083 dólares por segundo, estando previsto um workshop em direto com a SpaceXAI para 22 de setembro. 🔗 fonte
- OpenText e Cohere estabelecem uma parceria para os setores regulamentados — anunciada na conferência ALL IN AI de Montreal, a parceria integrará o North e os modelos da Cohere nos agentes OpenText Aviator, que podem ser implementados localmente ou numa cloud privada, pública ou soberana; prevê-se que a oferta conjunta chegue aos clientes no início de 2027. 🔗 fonte
- Manus estabelece parcerias de formação em Singapura — o agente integra a SkillsFuture AI Subscription, que oferece seis meses de acesso gratuito aos singapurenses elegíveis inscritos em determinados cursos de IA, e o Singtel AI Pass; um desafio entre instituições de ensino recebeu mais de 1 100 inscrições, e a Manus lança um convite mundial à participação de parceiros de aprendizagem. 🔗 fonte
- Universidade de Manchester prevê a poluição atmosférica com o Earth-2 — retreinado em dois dias num nó com 8 GPU do supercomputador Isambard-AI, o Earth-2 CorrDiff cobre todo o Reino Unido com uma resolução de 2 a 3 km², e a equipa promete publicar os dados e workflows em open source. 🔗 fonte
- Hospital Infantil de Filadélfia modela corações em poucos segundos — desenvolvido sobre o framework open source MONAI, o serviço do CHOP produz modelos cardíacos que anteriormente exigiam cerca de quatro horas de trabalho, estando previstos aproximadamente 200 casos este ano, e ferramentas desenvolvidas com base no Newton, atualmente em integração, podem reduzir as simulações de colocação de dispositivos a um tempo quase real. 🔗 fonte
- Google publica um estudo sobre os adolescentes norte-americanos e a IA — realizado com a RXN junto de mais de 1 000 jovens dos 13 aos 17 anos, o estudo U.S. Future Report indica que 94% deles utilizaram IA no último ano e que 55% confirmam as respostas recorrendo a outras fontes; não foi anunciado qualquer produto. 🔗 fonte
- Perplexity publica um guia sobre detetores de texto gerado por IA — o seu exemplo, apresentado como hipotético, mostra que um detetor que classifique incorretamente 2% dos textos humanos pode assinalar 64 artigos em 1 000, dos quais 19 escritos por humanos, o que representa quase 30% de erros; o guia recomenda que uma sinalização seja tratada como o início de uma análise. 🔗 fonte
- GiniGEN AI classifica 425 modelos do OpenRouter — publicação da comunidade no blog da Hugging Face: a classificação acrescenta uma latência até ao primeiro token medida em 329 modelos e uma pontuação de qualidade em coreano; apenas 8,5% dos modelos avaliados obtêm um A nas formas honoríficas e 9,4% nas instituições coreanas. 🔗 fonte
O que isto significa
O agente torna-se a interface, e a escolha do modo desaparece. No novo Claude, já não se escolhe entre uma conversa e um espaço de trabalho: o Claude escolhe entre pesquisa na web, ficheiros e código e, em seguida, produz um documento ou uma apresentação. O Delta aplica a mesma lógica à entrega do código, com uma revisão no fio da conversa e um comando /land que encadeia commit, CI e integração em vez da pull request. O Devin Code Scans parte de um objetivo, em vez de uma alteração, e o Grok Build retém, entre sessões, as convenções e decisões de um projeto. O controlo humano muda de lugar sem desaparecer: modo Manual por predefinição no Claude, aprovação da equipa antes da integração no Zed e discussão das conclusões antes de qualquer pull request no Devin.
Os agentes entram também no circuito comercial. A OpenAI testa Sponsored Agents que assumem o seguimento de um anúncio, a Google coloca o Business Agent nos anúncios do YouTube e disponibiliza ferramentas de pagamento com o UCP, e ambas separam o agente da marca do restante: conversa assinalada e distinta das respostas independentes do ChatGPT, por um lado, e versão beta mediante inscrição dos comerciantes, por outro. Para as pequenas empresas, o Claude for Small Business reivindica 43 workflows e mais de 900 000 instalações, enquanto a ElevenLabs vende, a partir de 29 dólares por mês, um rececionista que marca compromissos. A Synthesia cobra 0,10 euros por minuto por um avatar que fala no produto dos seus clientes, e a Salesforce transforma o Koa num modelo selecionável no Agentforce: o agente já não se limita a auxiliar a empresa, dirige-se aos clientes em nome dela.
A confiança torna-se um argumento de venda, e os fornecedores procuram torná-la verificável. A Cohere e a Aleph Alpha destacam a soberania, com uma dupla sede em Berlim e Toronto, e o Model Vault fornece um token de atestação que o cliente controla com as chaves públicas do fabricante do hardware. A Mistral oferece ao Firefox um compromisso de retenção nula, a Salesforce mantém os pesos do Koa na sua infraestrutura, a Runway prevê interromper um fluxo de vídeo assim que apareça conteúdo problemático, a OpenAI permite que os administradores restrinjam a criação de chaves de API e o Qwen Code confina o seu agente ao nível do kernel, publicando a lista das respetivas limitações. As garantias mais sólidas são aquelas que o próprio cliente pode controlar; um benchmark interno como o CRM Bench ou uma afirmação de «nem sequer nós», sem menção de auditoria por terceiros, continuam a ser apenas alegações.
Por fim, a computação esbarra na eletricidade. O Vera Rubin NVL72 apresenta até 3,7 vezes o débito do GB300 NVL72, segundo a NVIDIA, mas os anúncios mais concretos destes dois dias dizem respeito aos megawatts: a Lambda aloja 19 nós dentro do orçamento elétrico de 16, uma fábrica de IA de Santa Clara reduz o consumo de 4 para 3 MW a pedido do seu fornecedor, e a AEMA exige ligações à rede mais rápidas em troca de uma flexibilidade verificável. O débito por rack continua a ser o argumento técnico, mas o acesso à rede determina a rapidez com que esses racks entram em funcionamento.
Fontes
- Claude, Claude Cowork e o chat são agora um único Claude
- Centro de ajuda do Claude, integração do chat e do Cowork
- Boris Cherny no X, o chat e o Cowork começam a integrar-se
- Claude Devs no X, Design, Slides e Docs no Claude Code
- Zed, versão beta pública do Delta
- Zed no X, o comando /land
- NVIDIA, Vera Rubin NVL72 no MLPerf Inference v6.1
- NVIDIA, blog em direto do AI Infra Summit
- NVIDIA, lançamento da AI Energy Management Alliance
- AI Energy Management Alliance, site oficial
- OpenAI, Reinventar a publicidade com IA
- Google, atualizações do comércio agêntico para a época festiva
- Cohere, acordo definitivo com a Aleph Alpha
- Cohere no X, citação de Aidan Gomez
- Cohere no X, Confidential Computing no Model Vault
- Cohere, página do produto Model Vault
- Mistral AI, parceria com a Mozilla
- SpaceXAI, Memory no Grok Build
- Qwen Code, notas da versão v0.24.0
- Cognition, Apresentação do Code Scans
- Claude, novos workflows do Claude for Small Business
- ElevenLabs, Apresentação do Reception
- Reception, preços
- Synthesia no X, Interactive Avatar API
- Synthesia, página Interactive Avatars
- NVIDIA, Jensen Huang na Dreamforce
- Runway, Moderação em tempo real
- Zed, notas da versão 1.20.1
- Replit no X, Custom Connectors em versão beta
- NVIDIA, portabilidade do TileGym para cuTile Rust
- OpenAI, associar a utilização da IA ao valor empresarial
- OpenAI, changelog da API
- GitHub Changelog, pedidos de aumento do orçamento do Copilot
- GitHub Changelog, AI Scan sem a configuração predefinida do CodeQL
- GitHub Changelog, configurações obrigatórias do GitHub Advanced Security
- GitHub Changelog, fim do SHA-1 em HTTPS
- Together AI no X, MiniMax H3 sem servidor
- MiniMax no X, H3 IP Edition
- Runway no X, coleção Fall 2026
- Luma no X, Camera Angles
- fal no X, Grok Voice
- OpenText, parceria com a Cohere
- Manus no X, Aprender IA com o Manus
- NVIDIA, Earth-2 e a poluição atmosférica no Reino Unido
- NVIDIA, o CHOP e a modelação cardíaca
- Google, U.S. Future Report sobre os adolescentes e a IA
- Perplexity, guia sobre detetores de texto gerado por IA
- Hugging Face, classificação GiniGEN AI dos modelos OpenRouter