ai-powered-markdown-translatorArtigo traduzido do francês para o português com gpt-6.1-sol.
A Google Cloud apresentou a 8 de outubro, no Gemini at Work 2026, o agente Gemini: um único agente para todo o trabalho empresarial, que funciona continuamente na cloud e orquestra tanto os modelos Gemini como os modelos Claude. Por sua vez, a HeyGen lança o HeyGen Voice, o seu primeiro modelo de voz desenvolvido internamente, que assume a liderança da classificação Controlled Voice da Artificial Analysis, enquanto a Anthropic disponibiliza no Claude Managed Agents workflows capazes de lançar até 1 000 agentes por execução. Na programação, o Codex aprende a prever a próxima mensagem do utilizador e adota no Windows um novo sandbox baseado nos Microsoft Execution Containers.
Google Cloud lança o agente Gemini, um único agente para todo o trabalho
8 de outubro — No Gemini at Work 2026, a Google Cloud apresentou o agente Gemini, que descreve como um agente único e universal para o trabalho. A partir de um único campo de texto e de uma única API, responde a perguntas, realiza trabalho intelectual, cria imagens e conteúdos multimédia, escreve e executa código. A ideia defendida por Thomas Kurian, CEO da Google Cloud: atribuir-lhe um objetivo em vez de uma sequência de instruções.
O agente funciona continuamente na cloud, com uma única memória, e está presente em todo o lado: web, iOS, Android, Windows, Mac, linha de comandos, Google Workspace, Microsoft 365 e Slack, ou sem interface (headless) em aplicações de terceiros. Uma tarefa de várias horas ou de vários dias continua com o computador fechado. Para trabalhos longos, cria subagentes temporários, cada um com uma identidade, e pode tornar-se um agente colega (coworker agent) com um papel permanente, com o seu próprio endereço @agents.company.com e armazenamento. O modelo passa a ser uma escolha separada: segundo a Google, o agente já orquestra os modelos Gemini e os modelos Claude da Anthropic, devendo seguir-se outros modelos privados e abertos. Chegam versões setoriais em pré-lançamento para as finanças (mais de 50 skills de base, já utilizadas pelo CME Group e pelo Deutsche Bank) e para a área jurídica.
| Componente de controlo anunciado | Papel descrito pela Google |
|---|---|
| Identidade de cada agente | Identidade atestada criptograficamente, permissões por função, registo de auditoria em seu nome |
| Agent Sandbox | Execução isolada, com a sua própria fronteira de rede |
| Agent Gateway | Firewall de rede para a IA, pelo qual passa todo o tráfego do agente |
| Limites de despesa em tempo real | No Cloud Billing, o agente do projeto entra em pausa, com retoma num clique |
A Google Cloud apresenta também os seus números: quase 500 clientes processaram, cada um, mais de 1 000 mil milhões de tokens num ano, e quase 90 % das empresas da Fortune 100 utilizam Gemini Enterprise. A publicação, porém, não indica uma data de disponibilidade nem um preço para o próprio agente; a Google Cloud menciona apenas grandes clientes que o testaram antecipadamente, como a marca desportiva On para a escolha dinâmica do modelo.
🔗 Gemini at Work 2026 (blog da Google Cloud)
Gemini Enterprise disponibiliza Claude Opus 5.5 e Claude Sonnet 5.5 nas ferramentas Antigravity
8 de outubro — No mesmo dia, as notas de versão do Gemini Enterprise permitem aos administradores ativar Claude Opus 5.5 e Claude Sonnet 5.5 no Antigravity 2.0, no Antigravity CLI e nas extensões Antigravity para IDE. O administrador aceita as respetivas condições de utilização diretamente na consola Google Cloud, sem uma conta Anthropic separada.
| Parâmetro de ativação | Valor indicado pela Google |
|---|---|
| Estado predefinido | Modelos de terceiros desativados, ativação pelos administradores |
| Modo de faturação | Por consumo, dentro do limite de despesa do projeto |
| Localizações de inferência | global, us e eu |
| Níveis de raciocínio | Low, Medium (predefinido), High ou Max |
O programador mantém a sua licença Gemini Enterprise e escolhe Claude no seletor de modelos. Os excedentes (overages) têm de ser ativados antes de disponibilizar um modelo de terceiros, cujo custo entra no limite comum a todos os modelos. A mesma página anuncia a disponibilidade geral do Gemini 3.8 Flash em Singapura.
🔗 Notas de versão do Gemini Enterprise
Voz: HeyGen Voice no topo da classificação Controlled Voice, Mistral publica dois modelos para o árabe
9 de outubro — A HeyGen lança o HeyGen Voice, que Joshua Xu apresenta como o primeiro modelo de voz desenvolvido internamente pela empresa, até agora conhecida pelos seus avatares. O modelo está disponível no HeyGen e através da API, a 30 dólares por milhão de caracteres; até 31 de outubro, os utilizadores da API pagam 15 dólares, sendo o desconto aplicado automaticamente.
O argumento vem da Artificial Analysis, que publicou os seus resultados um minuto e meio antes da HeyGen. Na sua classificação Controlled Voice, em que todos os modelos falam com as mesmas 8 vozes clonadas, em inglês americano e britânico, o HeyGen Voice assume o primeiro lugar com um Elo de 1 201 em 1 468 participações. Ocupa aí o primeiro lugar nas categorias Assistentes e Apoio ao cliente, bem como em inglês britânico.
HeyGen Voice takes the #1 spot on the Artificial Analysis Controlled Voice TTS Arena Leaderboard, ahead of Alibaba’s Qwen-Audio-3.1-TTS-Plus and ElevenLabs’ Eleven v4 Turbo
🇵🇹 O HeyGen Voice assume o primeiro lugar na classificação Controlled Voice TTS Arena da Artificial Analysis, à frente do Qwen-Audio-3.1-TTS-Plus da Alibaba e do Eleven v4 Turbo da ElevenLabs. — @ArtificialAnlys no X
| Modelo avaliado | Elo Controlled Voice (9 de outubro) | Preço da API por milhão de caracteres |
|---|---|---|
| HeyGen Voice | 1 201 | 30 dólares (15 até 31 de outubro) |
| Qwen-Audio-3.1-TTS-Plus | 1 182 | 19,3 dólares |
| Eleven v4 Turbo | 1 166 | 40 dólares |
| Eleven v4 | 1 162 | 80 dólares |
Este primeiro lugar tem um âmbito preciso: refere-se à clonagem de voz. Na classificação Provider Voice, em que cada fornecedor utiliza as suas próprias vozes, Eleven v4 Turbo e Eleven v4 continuavam no topo na noite de 9 de outubro, sem HeyGen Voice entre os oito primeiros. Na robustez da pronúncia, HeyGen Voice obtém 83,1 %, o que corresponde ao 10.º lugar entre 29.
Na API, a clonagem é instantânea: uma única gravação, da qual apenas são utilizados os primeiros três minutos, produz uma voz ativa em poucos segundos, sem treino. A síntese é feita de uma só vez (ficheiro WAV a 44,1 kHz) ou em streaming, e foram as definições predefinidas da API que a Artificial Analysis avaliou.
Voxtral Mini 4B Realtime Arabic e LIDstral Arabic: dois modelos da Mistral para o árabe
8 de outubro — A Mistral disponibilizou no Hugging Face, sem anúncio, dois modelos abertos sob a licença Apache 2.0 dedicados ao árabe. Voxtral Mini 4B Realtime Arabic transcreve em streaming os dialetos árabes e o árabe padrão moderno, incluindo quando os falantes mudam de língua a meio da conversa (code-switching). Afinado a partir de Voxtral Mini 4B Realtime, conta com cerca de 4,4 mil milhões de parâmetros. Segundo a sua ficha, foi desenvolvido em conjunto com o Ministério da Transição Digital e da Reforma Administrativa de Marrocos, no âmbito da parceria assinada entre a Mistral e Marrocos em janeiro de 2026, que também produziu dois novos benchmarks, ISMA e Darija in the Wild.
| Modelo publicado | Função do modelo | Resultado segundo a ficha |
|---|---|---|
| Voxtral Mini 4B Realtime Arabic | Transcrição de árabe em streaming | Taxa média de erro por caráter de 8,82 % em 7 benchmarks a 480 ms, face a 7,91 % para Voxtral Transcribe Arabic |
| LIDstral Arabic | Identificação da língua e do dialeto, 51 classes, no processador | F1 de 88,67 % na darija marroquina, face a 71,28 % para GlotLID v3 |
🔗 Voxtral Mini 4B Realtime Arabic no Hugging Face · LIDstral Arabic no Hugging Face
Claude Managed Agents: workflows dinâmicos com até 1 000 agentes por execução
9 de outubro — A Anthropic disponibiliza em beta pública os workflows dinâmicos (dynamic workflows) do Claude Managed Agents, um novo tipo de orquestração multiagente. O agente que conduz a sessão escreve ele próprio um programa, que o servidor executa em segundo plano, lançando muitos agentes por fases antes de combinar os seus resultados. Depois de ativado o tipo multiagent_20261001, é o agente que decide iniciar uma execução.
Uma execução lança até 1 000 agentes, dos quais 64 em simultâneo, tem uma duração predefinida de 24 horas, e uma sessão pode manter 10 execuções abertas. Os seus tokens são faturados como os da sessão e contam para o respetivo orçamento; a Anthropic avisa que podem ser muitos e cita um teste interno com 70 bugs introduzidos numa base de código de 116 000 linhas.
| Configuração do teste da Anthropic | Bugs encontrados em 3 ensaios |
|---|---|
| Agente sozinho | 14, 15 e 27 |
| Workflow dinâmico | 66 em cada ensaio |
🔗 Anúncio de @ClaudeDevs · Documentação das execuções de workflow
Agentes de programação: previsões de mensagens e sandbox MXC para Codex, Claude Code 2.1.296, Vibe CLI 2.26.1
O Codex recebe duas novidades no mesmo dia, enquanto a Anthropic e a Mistral publicam novas versões dos seus agentes de linha de comandos.
Codex prevê a próxima mensagem do utilizador, em beta para os subscritores Pro
9 de outubro — A OpenAI disponibiliza em beta as previsões do compositor (composer predictions) na aplicação de desktop Codex. Quando o Codex termina de responder, pode surgir uma sugestão da próxima mensagem no campo de texto, construída a partir da conversa em curso, sem consultar as memórias nem as aplicações ligadas. A tecla Tab insere-a; o texto continua editável e nunca é enviado automaticamente. A sugestão abrange uma mensagem completa, em vez de completar o texto palavra a palavra.
| Condição da beta | Valor indicado pela OpenAI |
|---|---|
| Plano e idade | ChatGPT Pro pessoal, 18 anos ou mais |
| Conversas e modelos | Conversas locais e SSH, com GPT-6 Astra ou GPT-6.1 Sol |
| Definição predefinida | Ativada, pode ser desativada em General > Composer > Show predictions |
| Custo durante a beta | Fora dos limites de utilização do Codex, sem consumo de créditos |
As mensagens enviadas, incluindo as previsões aceites, continuam a ser contabilizadas normalmente. A funcionalidade não existe no Chat.
🔗 Anúncio de @OpenAIDevs · Artigo de ajuda da OpenAI
Codex no Windows: um sandbox baseado nos Microsoft Execution Containers
9 de outubro — A OpenAI adiciona ao Codex no Windows um modo de sandbox baseado nos Microsoft Execution Containers (MXC), que a Microsoft disponibilizou em versão geral a 7 de outubro. Exige um dispositivo Windows 11 compatível (24H2 build 26100.9278 ou 25H2 build 26200.9278) e promete uma configuração mais rápida, um controlo de rede mais rigoroso e acessos aos ficheiros ajustados com maior precisão.
Segundo a documentação, MXC passa a ser a implementação recomendada: isola os processos de forma nativa, sem configuração aprovada por um administrador, sem contas Windows adicionais nem regras locais de firewall. Os modos elevated e unelevated passam a ser alternativas legadas. A aplicação de desktop escolhe MXC automaticamente para as contas de consumidores; na CLI ou em ambiente empresarial, é ativado com prefer_mxc = true no config.toml, e um administrador pode bloqueá-lo com allow_mxc = false. Estão documentadas duas limitações: a rede gerida exige allow_local_binding = true, e os processos filhos ainda ativos terminam quando o comando em primeiro plano chega ao fim.
🔗 Anúncio de @OpenAIDevs · Documentação do sandbox Windows
Claude Code 2.1.296: compactação específica dos subagentes e modelo único para os agentes de workflow
9 de outubro — A versão Claude Code 2.1.296 conta com 79 entradas, incluindo 56 correções, e não foi acompanhada de nenhum tweet. Oferece sobretudo mais controlo sobre os subagentes.
| Novidade da versão | O que muda |
|---|---|
autoCompactWindow (subagentes, --agents) | Um subagente compacta o seu contexto mais cedo do que a conversa principal |
CLAUDE_CODE_WORKFLOW_SUBAGENT_MODEL | Todos os agentes de um workflow usam o mesmo modelo, os outros subagentes mantêm o seu |
Opção allow_large de Read | Leitura de um ficheiro de texto grande numa única chamada, se o contexto o permitir |
CLAUDE_CODE_OVERLOADED_RETRY_MAX_DELAY_MS | Intervalo máximo mais longo entre duas novas tentativas após um erro 529 |
| Descrições de ferramentas MCP enviadas logo de início | Limite predefinido aumentado de 2 048 para 4 096 caracteres |
/cost e a linha de estado passam a contabilizar as leituras de cache do Sonnet 5.5 a 0,10 dólar por milhão de tokens. Na segurança, a versão corrige hooks PreToolUse geridos que recusavam uma chamada sem terminar o turno, verificações Bash que aprovavam automaticamente determinados comandos que utilizavam BASH_ARGV0, sessões cloud que ignoravam as verificações do modo automático em ações do Claude in Chrome e alterações Edit e NotebookEdit que substituíam todos os caracteres não ASCII de ficheiros não UTF-8, agora recusadas.
🔗 Claude Code 2.1.296 no GitHub
Vibe CLI 2.26.1: o modelo Devstral local removido, um modo não interativo mais completo
9 de outubro — Três dias depois da 2.26.0 e sem tweet, a Mistral lança o Vibe CLI 2.26.1. Apesar do número de versão de correção, a versão conta com 85 entradas (23 adições, 24 alterações, 36 correções, 2 remoções), das quais 37 são para a nova interface em Rust. Remove o modelo Devstral local que vinha incluído: uma configuração que ainda o fixa volta, com um aviso, ao modelo alojado por predefinição. Este passa a oferecer apenas dois níveis de raciocínio, off e high, e declara uma janela de contexto de 256k, pela qual se orienta a compactação automática.
O modo não interativo vibe -p ganha um limite de tempo, a leitura do prompt a partir de um ficheiro ou da entrada padrão, um relatório export.json gravado a cada encerramento e códigos de saída distintos: 1 para um erro de utilização ou de configuração, 2 para uma falha de infraestrutura, 3 para um limite atingido ou uma recusa do modelo. A Rust CLI acrescenta /proxy-setup, um narrador que lê em voz alta o resumo de cada turno, /plugins e /whoami. Novas definições impedem o agente de usar processos em segundo plano ou subagentes, e o conector Document Library continua desativado por predefinição.
🔗 Notas de versão do Vibe CLI 2.26.1
Imagens, vídeos e jogos generativos: Qwen-Image-2.1-Turbo, modo Thinking do Midjourney, Syren da Synthesia, Playground da Google
Um modelo de imagem mais rápido e mais barato, um gerador que revê os seus resultados, um agente que edita vídeos e uma plataforma de jogos sem código.
Qwen-Image-2.1-Turbo: 8 etapas de redução de ruído e 0,016 dólar por imagem
9 de outubro — A Qwen lança o Qwen-Image-2.1-Turbo, um checkpoint acelerado (accelerated checkpoint) do Qwen-Image-2.1 que gera e retoca imagens em 8 etapas de redução de ruído, com a mesma arquitetura de 7 mil milhões de parâmetros. Segundo a Qwen, continua a produzir imagens 2K e aceita retoques em linguagem natural, mas não são publicados dados de qualidade ou de velocidade específicos desta versão. Os pesos estão no Hugging Face e no ModelScope, sob a licença de investigação da Qwen (Qwen Research License). O checkpoint inclui o seu calendário de amostragem em 8 etapas e funciona por predefinição com um CFG de 1.
No mesmo dia, a Qwen disponibiliza oficialmente as API Qwen-Image-2.1 Pro e Turbo; a QwenCloud concede 120 pedidos por minuto ao Turbo.
| Modelo disponibilizado por API (Model Studio) | Preço por imagem | Imagens gratuitas |
|---|---|---|
| qwen-image-2.1-turbo | 0,016 dólar | 10 |
| qwen-image-2.1-pro | 0,04 dólar | 10 |
| qwen-image-2.0-pro | 0,075 dólar | 100 |
🔗 Anúncio da Qwen · Ficha no Hugging Face
A Midjourney testa um modo Thinking e disponibiliza pastas partilhadas no seu site alpha
8 de outubro — O changelog alpha da Midjourney, publicado à noite, apresenta duas funcionalidades numa versão inicial, reservadas por enquanto ao site alpha.midjourney.com. A primeira é um teste: numa imagem produzida com V8.2, em geração ou edição, o botão Rerun (Thinking) pede ao modelo que observe o resultado, identifique onde se afasta do prompt (objetos, disposição, anatomia, texto) e gere novamente. A Midjourney afirma observar melhores resultados na fidelidade ao prompt, na tipografia e na coerência, e considera transformá-lo num modo geral.
A segunda é a partilha de pastas: convidam-se Colaboradores, que geram diretamente na pasta, ou Leitores, e pode-se partilhar por ligação ou até disponibilizar a pasta a qualquer membro da Midjourney. A Midjourney esclarece que a partilha não altera a visibilidade das imagens: sem o modo stealth, continuam a poder aparecer no Explore e nos perfis.
🔗 Changelog alpha da Midjourney · Teste do modo Thinking (Midjourney)
Syren: a Synthesia entrega a criação de vídeo a um agente, em beta
9 de outubro — A Synthesia lança o Syren em beta para todos os seus clientes, incluindo contas gratuitas. Descreve-se o vídeo pretendido, ou fornecem-se documentos, imagens, vídeos, apresentações PowerPoint ou ligações do YouTube, e o Syren entrega um vídeo finalizado com animações gráficas (motion graphics), avatares, voz off, música e planos de apoio (b-roll), que depois se corrige em conversa. Segundo Peter Hill, diretor técnico da Synthesia, o agente escreve todo o vídeo sob a forma de código, que um motor de renderização próprio, utilizado para as animações da Synthesia desde junho, reproduz em tempo real.
Os vídeos duram até 3 minutos, em formato horizontal ou vertical, e são renderizados no navegador. A faturação é feita por créditos, sem preços detalhados, e os administradores Enterprise podem desativar a ferramenta. A aprendizagem automática da identidade da marca a partir dos vídeos existentes é anunciada para breve na publicação. O Syren chega quatro dias depois do HyperFrames Studio da HeyGen e no dia seguinte ao Claude Motion da Anthropic, duas outras ferramentas em que um agente produz o vídeo.
🔗 Apresentação do Syren (Synthesia)
Playground: a Google disponibiliza uma plataforma para criar jogos sem programar
7 de outubro — A Google lança o Playground, uma plataforma de jogos experimental em que se criam, jogam e partilham jogos descrevendo-os com alguns prompts, sem escrever código. Numa interface de conversação, parte-se de uma página em branco, de um exemplo para remixar ou de orientação guiada, ajustando depois, a pedido, a física, as regras, as personagens ou o cenário.
Os jogos funcionam no navegador, tanto no telemóvel como no computador, e podem permanecer privados, ser partilhados por ligação ou integrar a galeria Explore, com classificações e modo multijogador para alguns géneros; cada jogo publicado passa por uma verificação de segurança. O Playground está disponível nos Estados Unidos para pessoas com 18 anos ou mais, com permissões de criação que dependem da subscrição Google AI. Uma integração com o Unity Spark, para jogos 3D mais ambiciosos, é anunciada para breve em beta fechada. A Google não especifica que modelo faz funcionar a plataforma.
🔗 Apresentação do Playground (blog da Google)
Saúde: o estudo clínico do AMIE publicado no The Lancet
8 de outubro — A Google e o Beth Israel Deaconess Medical Center (BIDMC) publicam no The Lancet um estudo prospetivo de viabilidade do AMIE (Articulate Medical Intelligence Explorer), a IA de conversação para diagnóstico da Google; segundo a Google, é a sua primeira publicação na revista principal do Lancet. Os pacientes conversaram com o AMIE até cinco dias antes de uma consulta urgente, e o médico recebia depois a transcrição e um resumo.
| Medida do estudo | Resultado publicado |
|---|---|
| Pacientes incluídos (abril a novembro de 2025), depois acompanhados | 114, depois 98 |
| Interrupções por motivos de segurança | 0 |
| Alucinações detetadas | 1 |
| AMIE útil para preparar a consulta, segundo o médico | 33 casos em 44 (75 %) |
| Diagnósticos concordantes com o diagnóstico final (Google) | 90 % |
É um estudo realizado num único centro, sem grupo de controlo e financiado pela Alphabet, e não constitui uma autorização nem uma implementação: os autores pedem ensaios mais amplos.
🔗 Publicação da Google · O artigo no The Lancet
Investigação na OpenAI: a resposta à carta de três investigadores de quem a empresa se separou
9 de outubro — Numa nota publicada no @OpenAINewsroom em nome dos seus responsáveis pela investigação, a OpenAI responde à carta de três investigadores de quem afirma ter-se separado na semana anterior. Segundo a OpenAI, uma investigação interna concluiu que tinham infringido regras claras sobre o tratamento de informações sensíveis, com uma quebra de confiança que vai além do que é descrito na carta; a OpenAI mantém a sua decisão. Afirma que estas decisões não se devem nem ao facto de terem levantado preocupações de segurança nem a uma intervenção pública, e que não despede nenhum trabalhador por ter manifestado preocupações.
A nota anuncia também:
We are actively finalizing contracts with third-party safety assessors and will announce details in the coming weeks.
🇵🇹 Estamos a finalizar ativamente contratos com avaliadores de segurança externos e anunciaremos os detalhes nas próximas semanas. — @OpenAINewsroom no X
A OpenAI diz concordar com a carta num ponto: preservar a capacidade de monitorização (monitorability) dos modelos de fronteira exige um compromisso de toda a indústria, incluindo a OpenAI. Este artigo divulga a versão da OpenAI; a carta dos investigadores não foi consultada.
Produzir modelos abertos: seis modelos por cerca de 103 dólares com o ML Intern, o escalonador de GPU da Ai2
Dois relatos de experiência sobre a criação de modelos: um sobre agentes, o outro sobre clusters de computação.
ML Intern: seis modelos abertos por cerca de 103 dólares de computação
8 de outubro — Já apresentado aqui a 1 e a 8 de outubro sob outras perspetivas, o modo ML Intern do HuggingChat recebe um primeiro balanço quantitativo no blog da Hugging Face: seis projetos realizados de ponta a ponta, por cerca de 103 dólares de computação no total. Cada um começa com uma mensagem e termina com um modelo público no Hub, incluindo a avaliação. O agente planeia, pede autorização antes de qualquer tarefa de computação paga, executa um teste curto e depois treina, avalia e publica no hardware da Hugging Face.
| Modelo produzido pelo ML Intern | Resultado publicado | Custo de computação |
|---|---|---|
| Pocket Rewriter (0.8B) | 99,7 % de saídas válidas, cerca de um quarto dos tokens do modelo de reescrita de 9B do Qwen-Image 2.1 | Cerca de 16 dólares |
| Citrus Doctor (Qwen3.5-2B) | De 14,9 % para 52,8 % de diagnósticos corretos de doenças dos citrinos | Cerca de 1,90 dólar |
| Dois LoRA para Qwen-Image 2.1 | Mudança do ângulo de visão, rabisco substituído pelo objeto pedido | Cerca de 16 e 24,30 dólares |
| Huggy LoRA (FLUX.2 klein) | LoRA de personagem | Cerca de 7,60 dólares |
| Agate 4 pas | Destilação de um pequeno modelo de imagem, de 50 passos (100 passagens com orientação) para 4 | Cerca de 37 dólares |
O escalonador de GPU da Ai2: a espera mediana passa de 5 minutos para 24 segundos
9 de outubro — A Ai2 detalha o novo escalonador dos seus clusters de GPU, numa publicação assinada por Jeremy Tryba. Milhares de GPU NVIDIA H100, B200 e B300, em clusters de 88 a 1 024 GPU, são partilhadas por cerca de 150 investigadores, com uma procura duas a três vezes superior à oferta. O antigo sistema de prioridades deixava GPU «ocupadas» por tarefas vazias, e todas as cargas acabavam por atingir a prioridade máxima.
O novo baseia-se em orçamentos de tempo de GPU distribuídos ao longo do organograma da investigação, numa partilha justa hierárquica (fair-share) calculada sobre uma janela móvel de sete dias e num «contrato de escalonamento»: cada carga declara uma duração protegida de, no máximo, 8 horas, após a qual pode ser preemptada e recolocada na fila. O tempo não atribuído permanece gratuito, mas sempre preemptível.
| Indicador medido pela Ai2 | Escalonador anterior | Novo escalonador |
|---|---|---|
| Espera mediana, maior cluster H100 | 5 minutos | 24 segundos |
| Espera p90 das cargas de depuração | 2 horas | 30 segundos |
| Horas de GPU devidas fornecidas em 30 dias | — | 98 % |
As reparações que exigem intervenção humana diminuem 74 %. A Ai2 reconhece limitações, como sessões interativas que passam a ser preemptíveis após 8 horas, quando antes podiam durar uma semana, e não publica qualquer código.
Modelos de decisão: pplx-decider-v1.1-27b à frente do Decision Bench, em empate estatístico com outros nove
9 de outubro — Já abordado a 6 e a 8 de outubro, o modelo de decisão da Perplexity obtém um resultado externo. No Decision Bench, benchmark open source da Atlan Frontier Labs (1 071 perguntas fechadas, 36 conjuntos de dados, 15 modelos classificados), o pplx-decider-v1.1-27b alcança a melhor pontuação bruta, 94,5 %, ao custo mais baixo, 0,017 dólar por 1 000 decisões. O site atribui, contudo, a mesma posição aos modelos cujos intervalos de confiança a 95 % se sobrepõem: dez modelos partilham o primeiro lugar.
| Modelo avaliado no Decision Bench | Precisão medida | Custo por 1 000 linhas |
|---|---|---|
| pplx-decider-v1.1-27b | 94,5 % | 0,017 dólar |
| DeepSeek V4.1 Flash | 94,2 % | 0,683 dólar |
| Gemini 3.5 Flash | 94,2 % | 3,32 dólares |
| Jev 1.13 | 93,8 % | 0,044 dólar |
A Perplexity publica também um guia prático (cookbook) para um agente de navegação, em que é o código, nunca o modelo, que decide os cliques, e a v1.1 substitui a v1 na API.
🔗 Sequência de publicações de @perplexitydevs · Classificação do Decision Bench
Grok Bot recebe o seu próprio endereço de e-mail
9 de outubro — O Grok Bot, o agente da SpaceXAI, dispõe agora do seu próprio endereço de e-mail. O Bot pode usá-lo para se registar em serviços, contactar empresas em nome do utilizador ou marcar um encontro com alguém. A funcionalidade é disponibilizada nesse mesmo dia: basta pedir um endereço ao Bot ou mencionar @bot no X e, numa equipa, um administrador tem primeiro de a ativar.
O anúncio limita-se a uma sequência de publicações da conta @bot, divulgada por @grok, sem publicação em x.ai. Não especifica o formato nem o domínio dos endereços, nem os planos abrangidos. Depois do identificador Slack próprio dos Team Bots no final de setembro, o agente ganha assim uma identidade própria para agir externamente.
A ElevenLabs instala-se em Singapura, o seu hub para o Sudeste Asiático
8 de outubro — A ElevenLabs oficializa a sua chegada a Singapura, onde a empresa abre um escritório destinado a servir de hub para o Sudeste Asiático e, de forma mais ampla, para a Ásia-Pacífico. A publicação destaca a infraestrutura já existente: desde julho, as empresas podem alojar os seus dados em Singapura, com opções sem retenção e uma latência reduzida na região.
A ElevenLabs cita sobretudo os seus clientes regionais: Funding Societies, que qualifica potenciais clientes através de IA de conversação em cinco mercados, Boost Bank na Malásia, Salmon Group nas Filipinas, MNC Group na Indonésia ou Rezonate, uma plataforma de saúde utilizada por 60 % dos hospitais públicos de Singapura. Não é indicado o número de trabalhadores. A instalação segue-se às de Bruxelas e Amesterdão, no final de setembro e no início de outubro.
Breves
- Projects no Claude Code — A Anthropic deu acesso a todos os assinantes Pro e Max inscritos na lista de espera. Projects continua em beta: a lista continua aberta, serão concedidos mais acessos conforme a capacidade, e a funcionalidade ainda não está disponível no Team nem no Enterprise, segundo a documentação. 🔗 fonte
- Guia de automações de agentes — Um guia de claude.dev descreve uma implementação de referência no Claude Managed Agents, que lê de forma agendada canais Slack e pull requests GitHub e depois publica um resumo no Slack, e detalha os seus seis componentes e as medidas para lidar com falhas comuns, como não interpretar uma fonte ilegível como um dia tranquilo ou definir o limite de despesa em 3 a 5 vezes o custo de uma execução normal. 🔗 fonte
- Block e Claude Fable — Numa entrevista publicada pela Anthropic, a Block explica que Claude Fable concebe as suas grandes migrações de código e dirige até dezenas de modelos Opus ou Sonnet, chegando a integrar até mil pull requests numa mesma migração; as integrações e as entradas em produção continuam reservadas a humanos, com dupla aprovação das implementações. 🔗 fonte
- A Compliance API do Claude Enterprise — Os seus pontos de acesso (endpoints) de conversação também devolvem, em beta e com a chave existente, as conversas da experiência Claude unificada: uma conversa continuada numa sessão cloud é devolvida como uma só, com o trabalho de Claude em blocos
tool_useetool_result. 🔗 fonte - Codex CLI 0.162.1 — Esta correção da 0.162.0 elimina uma falha do TUI nas perguntas assíncronas com várias linhas e falhas de arranque quando um servidor em segundo plano já iniciado não tinha as mesmas definições de funcionalidades que a CLI. 🔗 fonte
- Plugins por função no ChatGPT Enterprise e Edu — Quando o controlo de acesso baseado em funções (RBAC) está ativado, os proprietários e administradores definem o acesso aos plugins função a função: Available, Install ou Disabled para o espaço de trabalho, Default para que uma função personalizada herde essa definição. 🔗 fonte
- Sophos e OpenAI Daybreak — Segundo a empresa de cibersegurança, os seus agentes criados com Daybreak reduzem o tempo médio de resposta dos casos que tratam de cerca de 38 minutos para cerca de 89 segundos, e 52 % dos seus casos MDR são resolvidos de ponta a ponta pela IA; as ações destrutivas continuam sob supervisão humana. 🔗 fonte
- Asana e o agente de navegação da StackAI — Segundo a Asana, GPT-6 Astra no Codex otimizou este agente em cerca de uma semana: com GPT-6.1 Sol, uma execução de teste custa 0,47 dólar e demora cerca de quatro minutos, sendo 76 vezes mais barata e 5 vezes mais rápida do que a configuração de produção original. 🔗 fonte
- LegalOn e Codex — A LegalOn Technologies afirma ter reduzido em cerca de 65 % os seus custos diários estimados do Codex ao passar de GPT-5.5 em modo rápido ilimitado para uma distribuição de tarefas entre GPT-6 Luna, GPT-6.1 Sol e GPT-6 Astra, com modo rápido a pedido e limites por serviço e por pessoa. 🔗 fonte
- Gemini CLI v0.64.0-preview.1 — Esta preview elimina os falsos positivos do aviso Untrusted Command Flags Detected em comandos shell inofensivos: opções de apenas leitura isentas, variáveis shell preservadas, ciclos permitidos quando cada subcomando tem a sua regra ALLOW. Não foi lançada nenhuma nightly em 9 de outubro, e a versão estável continua a ser a v0.63.0. 🔗 fonte
- Antigravity 2.22.0 — Os plugins podem apresentar a sua própria interface no painel lateral (UI Extensions), as conversas podem ser organizadas arrastando-as de uma secção para outra da barra lateral, e as marcas temporais mostram o nome do mês. 🔗 fonte
- Gemini 3.7 Flash obsoleto — Na API Gemini, as chamadas a
gemini-3.7-flashsão redirecionadas paragemini-3.8-flash, e o antigo agentedeep-research-pro-preview-12-2025será desativado em 23 de outubro, dando lugar adeep-research-preview-04-2026ou adeep-research-max-preview-04-2026. 🔗 fonte - Plugins VST3 e AU para Google Flow Music — Retomando a notícia de 6 de outubro: os Spaces, instrumentos e efeitos criados em linguagem natural, podem ser exportados como plugins para estações de trabalho de áudio digital (Digital Audio Workstations), como o plugin No Chaser do produtor Khris Riddick-Tynes. 🔗 fonte
- Google Earth AI e a saúde pública — Retomando a notícia de 6 de outubro: durante a epidemia de Ebola na RDC, um protótipo de agente de raciocínio geoespacial permitiu ao escritório da OMS para África identificar em poucos minutos 48 localidades expostas e mais de 45 500 pessoas em risco; o modelo PDFM também identifica zonas em risco de cólera com até 8 semanas de antecedência. 🔗 fonte
- Faturação do Copilot code review — Os proprietários de organizações podem imputar à organização proprietária do repositório as revisões pedidas pelos seus membros com licença, em vez de consumir a quota destes, se a utilização paga de AI Credits estiver ativada, e reservar o acionamento das revisões às licenças fornecidas pela organização ou pela empresa. 🔗 fonte
- Copilot CLI 1.0.95 — Agora em versão estável, autentica-se no macOS através do broker nativo do Microsoft Entra, recorrendo ao navegador como alternativa; a versão preliminar 1.0.96-0 indica na cronologia quem decidiu cada permissão: o utilizador, Assisted Permissions, uma política ou o mecanismo alternativo sem supervisão. 🔗 fonte
- GitHub MCP Server 2.0 — Retomando a notícia de 6 de outubro: o servidor MCP oficial do GitHub devolve saídas tipadas, descritas por esquemas de saída (output schemas), para agentes em Code Mode ou Programmatic Tool Calling; estas só são anunciadas aos clientes da especificação MCP 2026-07-28 ou posterior. 🔗 fonte
- Claude Haiku 5.5 no Genspark — O Genspark disponibiliza o modelo no AI Chat, Code Agent e Claw, retomando o argumento da Anthropic de que custa cerca de 75 % menos executar do que Haiku 4.5, sem plano nem preços próprios. 🔗 fonte
- Modelo Meta VR para v0 — A Meta publica com a Vercel um modelo v0 baseado no Immersive Web SDK: descreve-se uma experiência, v0 programa-a e mostra uma pré-visualização, um clique disponibiliza-a na Vercel para a abrir no navegador do Quest; o olhar e as mãos das Meta VR Glasses, previstas para a primavera de 2027, já são suportados. 🔗 fonte
- v0 for teams — v0 apresenta em vídeo esta forma de ver o trabalho dos colegas de equipa, participar nas suas conversas e construir em conjunto; o tweet destaca funcionalidades introduzidas por etapas desde setembro, sem nova tarifa. 🔗 fonte
- DeepSeek Harness 0.2.1-alpha.2 — 26.ª versão preliminar, ainda sem versão estável: o catálogo de plugins instala a pedido os pacotes Claude Code e Codex, surgem dois plugins experimentais (Git Worktrees, tradução do raciocínio), e as instruções globais podem vir de um AGENTS.md partilhado. 🔗 fonte
- OGX 1.5.0 — O antigo Llama Stack, renomeado em abril e retirado da organização meta-llama, acrescenta encaminhamento nativo da API /v1/messages para DeepSeek e Fireworks AI, um fornecedor Text-Embeddings-Inference, pesquisa web Exa e Serply e o cliente MCP 2.x, com quatro alterações que quebram a compatibilidade. 🔗 fonte
- GenIA — A Meta disponibiliza sem anúncio, sob a licença não comercial CC BY-NC 4.0, o código deste trabalho realizado com o Tübingen AI Center: reconstrói objetos 3D a partir de uma imagem, de algumas vistas ou de um vídeo, alinhando no momento da inferência o prior congelado de SAM 3D Objects, sem novo treino. 🔗 fonte
- Etiqueta decision-model no Hub — A Hugging Face dá aos modelos de decisão uma etiqueta própria, com um ícone e um filtro na página Models; os GGUF de decisão são etiquetados automaticamente a partir dos seus metadados llama.cpp. 🔗 fonte
- Darwin-27B-ZTC-v2 — A VIDRAFT anuncia que a nova versão do seu juiz, sob Apache-2.0, assume a liderança do System One Mosaic Benchmark (137 bancos de testes) com uma pontuação Borda de 89,58, à frente de OpenJev-27B (87,50) e Jev 1.13 (85,05); uma classificação declarada pelos seus autores, que a apresentam como um retrato momentâneo de uma tabela pública. 🔗 fonte
- A confiança dos modelos de decisão — Stephen Solka mostra numa publicação da comunidade que GPT-6 Luna Decisions, consultado via OpenRouter, responde «não corresponde» a 600 verificações SHA-256, com 50 % de exatidão e 99,8 % de confiança média; no raciocínio causal, um limiar de 99 % isola 47 respostas corretas em 49, mas abrange apenas 8,2 % dos casos. 🔗 fonte
- openai-math em ambientes de aprendizagem por reforço — FineEnvs adapta a ambientes Harbor 369 dos 405 resultados formalizados em Lean da publicação openai/math: o agente deve demonstrar um teorema num ambiente isolado Lean 4, e Comparator só atribui a recompensa a uma demonstração completa do enunciado exato; conjunto experimental sob Apache-2.0. 🔗 fonte
- JOSIE-2 — Gökdeniz Gülmez publica o relatório técnico desta família de 2B, 4B e 9B, com pós-treino a partir de Qwen3.5 em dois Mac M4, usando cerca de 3 000 exemplos selecionados: em modo de raciocínio, JOSIE-2-4B atinge 95,5 no ARC-Challenge (+12,1) e 69,2 no TruthfulQA (+20,3), em apenas dois bancos de testes. 🔗 fonte
- Gradio 6.30 —
gr.Workflowganha uma vista de aplicação, e o comando Run this node reutiliza os resultados anteriores ainda atualizados em vez de voltar a executar todo o subgrafo;gr.ImageEditorpreserva o canal alfa das imagens carregadas. 🔗 fonte - tokenizers 0.23.3 — Esta correção, apenas do pacote Python, aceita
huggingface_hubv2, o que desbloqueia a instalação de Transformers segundo as notas, e reverte uma alteração da 0.23.1 que quebrava a compatibilidade no truncamento. 🔗 fonte - Revisão científica por IA — A Sakana AI apresenta um artigo aceite na TMLR: um banco de testes insere afirmações contraditórias em artigos para verificar se os revisores de IA as detetam, e o seu sistema Multi-Layered Review deteta mais do que os outros sistemas testados, segundo o anúncio da Sakana AI, que não apresenta números. 🔗 fonte
- Suno Studio — Os clips alinham-se melhor com o primeiro tempo e alongam-se para acompanhar o tempo do projeto, os fades tornam-se exponenciais ou logarítmicos, e o sintetizador, o teclado e as vistas dos plugins podem ser destacados, até para um segundo ecrã; Studio está incluído na assinatura Premier. 🔗 fonte
- World Models’ Last Exam in Physics — Neste exame de física da Einsia para modelos de vídeo (40 tarefas, 9 categorias, oito modelos), Seedance 2.5 lidera com 57,76 em 100, à frente de MiniMax H3 (54,89), o melhor modelo aberto segundo a MiniMax, e Cosmos 3 Super da NVIDIA (42,46); um benchmark de terceiros. 🔗 fonte
- Simulações Omniverse construídas por agentes — O blog da NVIDIA mostra equipas da empresa que recorrem a GPT-6 Astra, e num caso a Claude Fable 5, para montar simulações com as bibliotecas ovphysx, ovstage, ovrtx e ovui, incluindo gémeos digitais criados ou melhorados em cerca de três dias; nenhum produto novo. 🔗 fonte
- A gestão de uma loja Shopify — Depois de ligar a loja, Grok Bot pode verificar encomendas, acompanhar os stocks e manter as fichas dos produtos atualizadas; não são especificados plano nem limite. 🔗 fonte
- A pesquisa no X — Retomando a notícia de 7 de outubro: Grok Bot pode pesquisar, ler e monitorizar o X para todos os utilizadores, sem configurar o conector X, por exemplo para acompanhar comentários sobre um produto ou receber um resumo semanal do seu setor; no final de agosto, ainda era necessário ligar a conta. 🔗 fonte
- Grokipedia v0.3 — Segundo a sua conta oficial, a enciclopédia escrita por Grok publicou numa semana mais de 4 400 artigos pedidos por leitores e fez mais de 2 200 alterações por dia, com uma média de 78 fontes por novo artigo; uma página transmite agora as suas alterações em direto. 🔗 fonte
- A CLI mistral 0.8.0 —
mistral apps deploytambém implementa os workers de workflows e todos os módulos de uma só vez, incluindo em integração contínua com uma simples chave API, emistral apps devinicia uma base de dados Postgres local no Docker; em contrapartida, o.envdo diretório atual deixa de ser lido. 🔗 fonte - O SDK Python da Mistral 3.2.0 — As chamadas de chat e de agentes aceitam probabilidades logarítmicas (logprobs), tanto na resposta como no prompt, assim como
top_k, uma penalização de repetição e um número mínimo de tokens; versão gerada automaticamente, sem anúncio. 🔗 fonte - Qwen Code v0.25.1-preview.1 — Segunda versão preliminar da v0.25.1 em três dias, com 16 funcionalidades e 27 novas correções, incluindo colaboração entre vários agentes centrada na sessão e hooks PreToolUse que alteram a entrada de uma ferramenta com revalidação completa; a versão estável ainda não foi lançada. 🔗 fonte
- Claude Haiku 5.5 na Agent API da Perplexity — Retomando a notícia de 7 de outubro: a Agent API aceita
anthropic/claude-haiku-5-5aos preços da Anthropic, 0,10 dólar por milhão de tokens de entrada e 0,50 de saída até 100 000 tokens de entrada, depois 0,50 e 2,50 acima desse limite. 🔗 fonte - Inferência partilhada ou dedicada — Um guia da Cohere para Embed e Rerank estabelece que a forma dos pedidos conta mais do que o seu número e calcula limiares de rentabilidade ilustrativos face a uma instância dedicada com uma GPU NVIDIA A10: cerca de 4 pedidos por minuto para documentos longos, 20 para um catálogo, 29 para a reclassificação (reranking). 🔗 fonte
- Agente ou MCP — A Perplexity publica um guia que distingue o agente, que decide, de MCP, que o liga às ferramentas, com uma tabela para orientar a escolha, o exemplo de uma loja online e quatro riscos com as respetivas salvaguardas; segundo o guia, Claude, ChatGPT ou Cursor podem confiar uma tarefa a Computer através do servidor MCP da Perplexity. 🔗 fonte
O que isto significa
Um agente orquestra agora muitos outros, e cada um recebe uma identidade. O agente Gemini lança subagentes, cada um com a sua própria identidade, e pode tornar-se um agente colega com o seu próprio endereço; Claude Managed Agents permite que um agente escreva um programa que lança até 1 000 agentes; Grok Bot recebe um endereço de e-mail para agir no exterior, e a Block confia a Claude Fable a direção de dezenas de modelos numa mesma migração. A questão que ganha destaque já não é saber se o agente consegue executar a tarefa, mas como mantê-lo sob controlo. A Google responde com Agent Gateway, Agent Sandbox, um registo de auditoria em nome de cada agente e limites de despesa em tempo real; a Anthropic, com um orçamento de sessão que suspende todas as execuções assim que é atingido; a OpenAI, com um sandbox Windows mais rigoroso quanto à rede e aos ficheiros.
A utilização de vários modelos está a consolidar-se nas próprias plataformas. A Google, que desenvolve Gemini, coloca o seu próprio agente a orquestrar modelos Claude, separa explicitamente a escolha do modelo da escolha do agente e disponibiliza Claude Opus 5.5 e Sonnet 5.5 no Antigravity, faturados dentro do mesmo limite de despesa que os seus modelos. A Genspark e a Agent API da Perplexity adicionam Claude Haiku 5.5 nos dias seguintes ao seu lançamento, a LegalOn distribui o trabalho de código por três modelos da OpenAI conforme a natureza das tarefas, e a Block desenvolve um seletor automático de modelos.
O custo unitário continua a baixar, e cada anúncio apresenta os números: 0,016 dólares por imagem com Qwen-Image-2.1-Turbo, 2,5 vezes menos do que a versão Pro; 15 dólares por milhão de caracteres com HeyGen Voice até 31 de outubro, depois 30, menos do que Eleven v4 Turbo; 0,017 dólares por 1 000 decisões com pplx-decider-v1.1-27b; seis modelos publicados no Hub por cerca de 103 dólares de computação com ML Intern. Os primeiros lugares exigem, porém, uma leitura atenta: HeyGen Voice só ocupa o primeiro lugar na classificação com vozes controladas, e pplx-decider partilha a sua posição com outros nove modelos cujos intervalos de confiança se sobrepõem.
Na saúde, a prudência continua a ser necessária. O estudo de AMIE publicado no The Lancet é um estudo de viabilidade, realizado num único centro, sem grupo de controlo e financiado pela Alphabet: 98 pacientes, nenhuma conversa interrompida por motivos de segurança, uma alucinação identificada. É uma etapa rumo a ensaios mais alargados, que os próprios autores pedem, e não uma autorização nem uma disponibilização aos pacientes.
Fontes
- Gemini at Work 2026 (blog Google Cloud)
- Notas de versão do Gemini Enterprise
- Anúncio de HeyGen Voice (@HeyGen)
- Resultados da Artificial Analysis (@ArtificialAnlys)
- Voxtral Mini 4B Realtime Arabic (Hugging Face)
- LIDstral Arabic (Hugging Face)
- Workflows dinâmicos de Claude Managed Agents (@ClaudeDevs)
- Documentação das execuções de workflow (Claude Platform)
- Previsões do compositor no Codex (@OpenAIDevs)
- Artigo de ajuda sobre as previsões do compositor (OpenAI)
- Sandbox MXC para o Codex no Windows (@OpenAIDevs)
- Documentação do sandbox Windows (ChatGPT Learn)
- Claude Code 2.1.296 (GitHub)
- Vibe CLI 2.26.1 (GitHub)
- Qwen-Image-2.1-Turbo (@Alibaba_Qwen)
- Qwen-Image-2.1-Turbo (Hugging Face)
- Changelog alpha do Midjourney
- Teste do modo Thinking (Midjourney)
- Syren (Synthesia)
- Playground (blog Google)
- Estudo clínico de AMIE (blog Google)
- Estudo de AMIE no The Lancet
- Nota dos responsáveis pela investigação da OpenAI (@OpenAINewsroom)
- Seis modelos com ML Intern (blog Hugging Face)
- Escalonador de GPU da Ai2 (blog Ai2)
- pplx-decider-v1.1-27b no Decision Bench (@perplexitydevs)
- Classificação do Decision Bench
- Endereço de e-mail de Grok Bot (@bot)
- ElevenLabs em Singapura (blog ElevenLabs)
- Projects no Claude Code (@ClaudeDevs)
- Criar automações eficazes com agentes (claude.dev)
- Block e Claude Fable (claude.com)
- Notas de versão da Claude Platform
- Codex CLI 0.162.1 (GitHub)
- Notas de versão do ChatGPT Enterprise e Edu
- Sophos e OpenAI Daybreak (OpenAI)
- Asana e o agente de navegação da StackAI (OpenAI)
- LegalOn e Codex (OpenAI)
- Gemini CLI v0.64.0-preview.1 (GitHub)
- Changelog do Antigravity
- Notas de versão da API Gemini
- Plugins do Google Flow Music (blog Google)
- Google Earth AI e a saúde pública (blog Google)
- Faturação de Copilot code review (changelog GitHub)
- Copilot CLI 1.0.95 (GitHub)
- GitHub MCP Server 2.0.0 (GitHub)
- Claude Haiku 5.5 no Genspark (@genspark_ai)
- Modelo Meta VR para o v0 (Meta)
- v0 para equipas (@v0)
- DeepSeek Harness 0.2.1-alpha.2 (GitHub)
- OGX 1.5.0 (GitHub)
- GenIA (GitHub)
- Modelos de decisão no Hub (changelog Hugging Face)
- Darwin-27B-ZTC-v2 e o System One Mosaic Benchmark (blog Hugging Face)
- A confiança dos modelos de decisão (blog Hugging Face)
- FineEnvs/openai-math (Hugging Face)
- Relatório técnico de JOSIE-2 (blog Hugging Face)
- Gradio 6.30.0 (GitHub)
- tokenizers 0.23.3 (GitHub)
- Revisão científica por IA (@SakanaAILabs)
- Atualização do Suno Studio (@suno)
- Último exame de física dos World Models (Einsia)
- Simulações Omniverse construídas por agentes (blog NVIDIA)
- Grok Bot e Shopify (@bot)
- Grok Bot e a pesquisa no X (@bot)
- Balanço do Grokipedia v0.3 (@Grokipedia)
- CLI mistral 0.8.0 (GitHub)
- SDK Python da Mistral 3.2.0 (GitHub)
- Qwen Code v0.25.1-preview.1 (GitHub)
- Modelos da Agent API (Perplexity)
- Inferência partilhada ou dedicada para Embed e Rerank (blog Cohere)
- Agente ou MCP (blog Perplexity)