ai-powered-markdown-translatorArtigo traduzido do fr para o pt com gpt-5.4-mini.
Em 18 de agosto de 2026, a OpenAI publica um relatório detalhando por que desacelerou o treinamento de seus modelos mais recentes diante das capacidades cibernéticas críticas de um modelo chamado Astra, enquanto a Warp lança uma infraestrutura agentiva para empresas e o Claude Code lança um skill de design de interface. Em torno desses três grandes anúncios, dezoito outras novidades cobrem Anthropic, ferramentas de código, pesquisa aberta em IA e plataformas de geração de mídia.
OpenAI desacelera a implantação de seus modelos diante das capacidades cibernéticas críticas de Astra
18 de agosto — A OpenAI explica por que a empresa desacelerou a implantação de seus modelos recentes. Dois eventos motivaram essa decisão: o incidente de segurança OpenAI-Hugging Face ocorrido durante a avaliação de um modelo, e evidências preliminares de que um dos próximos modelos, chamado Astra, poderia ultrapassar o limite de « capacidade cibernética crítica » definido pelo seu Preparedness Framework.
A OpenAI observou uma pausa de duas semanas no treinamento por reforço (RL) em seus modelos mais recentes destinados à implantação, enquanto endurecia e fazia red-teaming de seus ambientes de pesquisa. A maior corrida de RL de fronteira planejada continua suspensa, enquanto treinamentos em menor escala validam as novas proteções.
| Proteção | Detalhe |
|---|---|
| Monitoramento | Classificadores por token, alerta direcionado em até 30 minutos |
| Alinhamento | Redução de ações nocivas ou não autorizadas |
| Segurança | Isolamento de rede reforçado, sandboxes para código não confiável |
| Custo induzido | Cerca de 20 % de computação de inferência monitorada a mais |
Esse monitoramento é obrigatório para qualquer treinamento RL e qualquer avaliação com ferramentas a partir do nível « Sol »; desde 7 de agosto, uma exigência adicional se aplica a toda inferência de Astra com ferramentas. A OpenAI prevê um relatório técnico sobre o incidente da Hugging Face e uma evolução de seu Preparedness Framework com organizações externas.
As models become more capable, the risks associated with developing and testing them internally also grow. We temporarily paused reinforcement learning (RL) training on our latest models intended for deployment for two weeks while we hardened and red-teamed our research environments and expanded monitoring coverage. Our largest planned frontier RL run remains on hold while smaller-scale training and evaluations validate these safeguards and establish more evidence of alignment.
🇵🇹 À medida que os modelos se tornam mais capazes, os riscos ligados ao seu desenvolvimento e aos testes internos também aumentam. Temporariamente pausamos o treinamento por reforço (RL) em nossos modelos mais recentes destinados à implantação por duas semanas, enquanto endurecemos e fazemos red-teaming de nossos ambientes de pesquisa e ampliamos a cobertura do nosso monitoramento. Nossa maior corrida de RL de fronteira planejada continua suspensa enquanto treinamentos e avaliações em menor escala validam essas proteções e estabelecem mais evidências de alinhamento. — @OpenAI em X
🔗 OpenAI — Ritmando o desenvolvimento dos modelos
Warp lança Warp Factories, infraestrutura para as cloud software factories
18 de agosto — A Warp anuncia Warp Factories, uma infraestrutura aberta destinada a empresas que constroem seus próprios ciclos de automação em torno do ciclo de vida de software: agentes na nuvem triagem, especificam, implementam, revisam e verificam o trabalho, com humanos mantidos no loop nos pontos-chave de decisão. O anúncio identifica dois problemas apontados pelos responsáveis de engenharia: a dificuldade de medir o retorno sobre investimento dos agentes de codificação ao longo do tempo, e a governança, já que cada desenvolvedor configurando seu próprio agente cria pontos cegos de segurança.
No plano técnico, as factories são configuradas como código — a analogia reivindicada é « Terraform para a configuração de agentes » — e aceitam qualquer modelo ou harness, inclusive Claude Code ou Codex diretamente como harness. Os agentes dispõem de acesso computer use em Linux e Mac para reproduzir bugs e provar a correção de uma mudança, com compartilhamento de gravações nas pull requests. Um painel, uma API e um SDK medem custo e velocidade, com agentes de autoaperfeiçoamento configuráveis.
A Warp afirma automatizar hoje cerca de 30 % de suas próprias tarefas por meio de suas factories internas e antecipa um crescimento rápido dessa taxa. A empresa abre o acesso a um número limitado de empresas a partir de hoje, com uma oferta de 10 000 dólares em créditos de uso factory para alguns clientes selecionados.
Introducing Warp Factories: open, flexible infrastructure for building cloud software factories. - Configure your factory as code - Use any model and any harness - Measure quality with evals and benchmarks on your own data - Built-in self-improvement and memory
🇵🇹 Apresentando Warp Factories: infraestrutura aberta e flexível para construir cloud software factories. Configure sua factory como código. Use qualquer modelo e qualquer harness. Meça a qualidade com avaliações e benchmarks em seus próprios dados. Autoaperfeiçoamento e memória integrados. — @warpdotdev em X
Claude Code lança o skill /design em pesquisa preliminar
17 de agosto — A Anthropic lança um novo skill /design para Claude Code, atualmente em pesquisa preliminar. Essa funcionalidade traz para o CLI e o aplicativo Desktop o workflow de artboards do Claude Design, construído sobre o sistema de artifacts existente. O comando /design gera vários artboards editáveis representando propostas de interface de usuário: o usuário escolhe a que lhe convém, ajusta-a e depois pede ao Claude que a implemente no código.
Esse lançamento aproxima o Claude Code de um uso de design de interface, até aqui mais reservado a ferramentas dedicadas, ao integrá-lo diretamente ao fluxo de trabalho do desenvolvedor no terminal ou no Desktop. A funcionalidade está disponível para os planos Pro, Max, Team e Enterprise, e requer uma atualização do Claude Code para ser testada. Nenhum detalhe adicional (limitações da research preview, roadmap, exemplos visuais) foi fornecido além desse anúncio de lançamento.
Claude Code can design now. The new /design skill (research preview) brings Claude Design’s artboard workflow into the CLI and Desktop, built on artifacts. Run /design to get editable artboards for your UI — pick one, tweak it, then have Claude implement it.
🇵🇹 Agora o Claude Code pode projetar interfaces. O novo skill /design (pesquisa preliminar) traz o workflow de artboards do Claude Design para o CLI e o Desktop, construído sobre os artifacts. Inicie /design para obter artboards editáveis para sua interface — escolha um, ajuste-o e depois peça ao Claude para implementá-lo. — @ClaudeDevs em X
🔗 Disponibilidade Pro, Max, Team, Enterprise
Anthropic: Cowork generalizado, limites prorrogados, CPU otimizada
Três anúncios da Anthropic do dia dizem respeito ao acesso e ao desempenho do Claude Code e do Cowork.
Claude Cowork disponível no mobile e na web para todos os planos pagos
18 de agosto — Claude Cowork, o ambiente colaborativo da Anthropic, agora está acessível no mobile e na web para todos os planos pagos (Pro, Max, Team e Enterprise). Até aqui mencionado principalmente em torno de seu painel lateral compartilhado entre desktop, web e mobile, este anúncio marca uma generalização do acesso e não uma nova funcionalidade: os usuários pagos agora encontram suas sessões Cowork a partir de qualquer um desses três pontos de entrada, sem detalhes adicionais sobre a interface ou eventuais limitações móveis.
Aumento de 50 % dos limites semanais do Claude Code prorrogado até 31 de agosto
18 de agosto — A Anthropic prorroga até 31 de agosto o aumento de 50 % dos limites de uso semanais do Claude Code, inicialmente temporário. A equipe espera tornar essa mudança permanente, mas adverte que a forte demanda por seus modelos pode causar tensões de capacidade nas próximas semanas, sem data definitiva para uma decisão final. Este anúncio se insere em uma série de comunicações recentes em torno do desempenho e do uso do Claude Code, refletindo uma pressão contínua da demanda sobre a infraestrutura do produto.
🔗 Anúncio de limites do Claude Code
Claude Code CLI usa duas vezes menos CPU no p99
18 de agosto — Um patch agora faz o coletor de lixo (garbage collector) do Bun, o runtime JavaScript da ferramenta, esperar a inatividade do processo antes de ser executado. Antes, o disparo ocorria com um temporizador fixo, potencialmente no meio de uma rodada de conversa, no momento em que o Claude Code mais solicitava o processador. Resultado: o CLI agora usa duas vezes menos CPU no percentil 99, na continuidade de outras otimizações de desempenho comunicadas no início de agosto.
🔗 Anúncio de otimização de CPU
Agentes de codificação: chat por voz e SSH nativo
Amp e Warp complementam seus agentes de codificação com novos modos de interação.
Amp lança chat por voz em tempo real com Puck
18 de agosto — Amp adiciona a conversação por voz em tempo real com Puck, seu agente assistente, impulsionada por gpt-realtime-2.1, que delega o trabalho ao agente Puck já existente (alimentado por GPT-5.6 Sol) e resume a resposta em voz alta enquanto o texto completo continua aparecendo no fio de conversa. A Amp destaca vários casos de uso: coordenar trabalho em paralelo, obter pontos de progresso ou fazer ler em voz alta mensagens relevantes do Slack, tanto no escritório quanto em trânsito.
Amp lança tarifa educacional de 10 dólares por mês
18 de agosto — Estudantes e professores agora podem assinar Amp Megawatt Edu por 10 dólares por mês, ou seja, metade da tarifa habitual. A oferta inclui o agente de fronteira da Amp, as orbs (máquinas remotas para agentes sem supervisão), hospedagem de código ilimitada (pública e privada), 750 horas de uso de orb por ano e 10 dólares em créditos mensais. Os assinantes podem vincular uma assinatura existente do ChatGPT para acessar GPT-5.6, ou uma assinatura X Premium+/SuperGrok para Grok 4.6; nenhuma verificação rígida do status de estudante é implementada.
Warp Agent CLI adiciona suporte SSH nativo
17 de agosto — O Warp Agent CLI, gratuito para baixar e compatível com BYOK e assinaturas Grok, agora permite convidar o agente diretamente para uma sessão SSH já ativa — inclusive em vim, um REPL SQL ou outras interfaces de texto — em vez de se limitar à execução de comandos pontuais. Nenhuma CLI adicional é necessária na máquina remota: o comando ! ssh basta para trabalhar ao lado do agente diretamente na sessão.
OpenAI: adolescentes, DevDay global e impacto agentivo
Quatro anúncios da OpenAI do dia cobrem a segurança de jovens usuários, o internacional e o impacto concreto do Codex.
ChatGPT for Teens: proteções reforçadas e parceria educacional com CodeAI
18 de agosto — A OpenAI lança ChatGPT for Teens, experiência dedicada a adolescentes combinando o Study Mode, lembretes antiatalho capazes de detectar um desvio de dever de casa, quizzes e visualizações pedagógicas, além de Study Hours programáveis pelos adolescentes ou pelos pais. O sistema muda automaticamente para essa experiência para qualquer usuário estimado como menor de idade, com novas avaliações « menos de 18 anos » publicadas nas system cards (automutilação, transtornos alimentares, violência, conteúdo sexual). Em paralelo, uma parceria de destaque com CodeAI prevê, ao longo de um ano, um conselho consultivo sobre o desenvolvimento infantil, a expansão do programa « Hour of AI », um « Builders Challenge » para alunos do ensino médio e apoio ao curso gratuito « AI Foundations ».
DevDay Exchange: OpenAI globaliza seu evento para desenvolvedores
18 de agosto — A partir de outubro de 2026, a OpenAI lança DevDay Exchange, uma série de eventos para desenvolvedores em oito cidades: Bengaluru, Tóquio, Seul, Berlim, Paris, Londres, São Paulo e Cidade do México. O objetivo declarado é permitir que os builders troquem sobre seus projetos reais e conheçam diretamente as equipes da OpenAI que desenvolvem as ferramentas (API, Codex, ChatGPT Work). Nenhum detalhe sobre o formato exato ou as inscrições é fornecido nesta fase.
Asana realiza cinco anos de trabalho de engenharia em duas semanas com Codex
18 de agosto — A Asana usou o Codex para remover o Enzyme, um sistema de teste obsoleto que bloqueava a modernização de sua stack frontend. Um projeto estimado em cerca de cinco anos de trabalho e 6 milhões de dólares foi concluído em 1,5 semana de esforço de engenharia distribuída ao longo de duas semanas corridas, por um custo total de cerca de 12 000 dólares. A partir de um prompt de cinco frases, até quatro agentes Codex trabalharam em paralelo em cópias distintas da base de código, com um engenheiro validando cada mudança duas vezes por dia.
OpenAI lança uma iniciativa para reforçar o controle democrático da IA em segurança nacional
18 de agosto — A OpenAI anuncia uma iniciativa dotada de 5 milhões de dólares para ajudar as instituições de controle democrático a supervisionar o uso de IA na segurança nacional, por meio de formação, suporte técnico e créditos da OpenAI. Três princípios orientam esse trabalho: a IA deve reforçar e não substituir o julgamento institucional, o uso governamental deve permanecer rastreável para os órgãos de controle autorizados, e a IA deve dar a essas instituições os meios para agir na escala exigida. Ao longo de um ano, a OpenAI prevê pilotar ferramentas de rastreabilidade das decisões governamentais assistidas por IA, mantendo as instituições participantes o controle das evidências.
🔗 Controle democrático e segurança nacional
Pesquisa e modelos abertos
Quatro publicações de pesquisa ilustram o que a abertura dos pesos e dos dados permite demonstrar.
Sentence Transformers v6.0: os modelos multivetoriais ColBERT em primeira classe
18 de agosto — A Hugging Face publica a versão 6.0 do Sentence Transformers com a adição de MultiVectorEncoder, que coloca os modelos de interação tardia no estilo ColBERT no mesmo nível que os modelos densos, esparsos e re-ranker já suportados. Cada token do documento mantém seu próprio vetor, e a pontuação final soma a similaridade máxima de cada token da consulta (operador MaxSim). No benchmark NanoBEIR (13 conjuntos de dados), a versão multivetorial obtém um NDCG@10 médio de 0,6868 contra 0,6764 para a versão densa equivalente, ao custo de um armazenamento maior (cerca de 92 MB compactados para 4 874 passagens). A biblioteca também adiciona suporte a Flash Attention, multiplicando a vazão por 2,44 em precisão fp16.
Ai2: Olmo 3 revela um atalho morfológico nas respostas médicas dos LLM
18 de agosto — Pesquisadores da UT Austin, da Northeastern University e do MD Anderson Cancer Center usaram o Olmo 3 (7B Instruct), modelo totalmente aberto da Ai2, para verificar se os modelos respondem a perguntas sobre medicamentos com base em conhecimento real ou explorando a estrutura do nome (o sufixo “-pril” indica um inibidor da ECA, por exemplo). Para 51 a 59 % dos medicamentos testados, a resposta do modelo ao nome real é mal distinguível de sua resposta a um nome inventado. O acesso aos pesos, dados e checkpoints intermediários do Olmo permitiu rastrear esse atalho até os dados de treinamento — uma rastreabilidade impossível com modelos proprietários.
IBM Research: calibrar a memória agentiva de acordo com o modelo
18 de agosto — Um novo artigo da série ALTK-Evolve da IBM Research mostra que a memória agentiva — instruções destiladas do trabalho passado de um agente — deve ser dosada de acordo com a capacidade do modelo subjacente. Testada em oito modelos: gpt-oss-120b ganha +16,1 pontos de taxa de conclusão de tarefas com uma recuperação seletiva direcionada para apenas +5 % de tokens; DeepSeek-V3.2 avança +9,5 pontos com a injeção completa das instruções; GLM-5 não mostra nenhum ganho mensurável, um caso de saturação. Constatação contraintuitiva: a estratégia menos cara muitas vezes entrega a melhor precisão para os modelos mais fracos.
🔗 ALTK-Evolve — memória agentiva
AlphaEvolve contribui para um novo recorde na multiplicação de matrizes
18 de agosto — O Google DeepMind anuncia um novo recorde para ômega (ω), o expoente teórico da velocidade máxima para multiplicar matrizes, com ω < 2,371177. Esse resultado vem de um esforço conjunto entre o Google DeepMind, colaboradores acadêmicos e AlphaEvolve, o agente de codificação impulsionado por Gemini já conhecido por ter melhorado vários algoritmos em 2025. A multiplicação de matrizes sustenta grande parte da computação moderna, incluindo o treinamento e a inferência de modelos de IA — portanto, um ganho teórico sobre esse expoente vai além da pesquisa acadêmica.
Economia da inferência: A/B testing e cascata de custos
Duas publicações da Together AI medem o custo real de colocar modelos em produção e compará-los.
Together AI lança o A/B testing de modelos no nível dos endpoints
18 de agosto — A Together AI integra o A/B testing diretamente à camada de endpoint em vez de ao código da aplicação: um experimento associa um modelo de controle e até 20 variantes, cada uma com uma porcentagem fixa de tráfego (95/5, 80/20, 50/50), independente do número de réplicas. As atualizações se propagam em 30 a 60 segundos com proteção por etag contra sobrescritas concorrentes. Uma vez identificado um vencedor, ele é promovido por implantação blue-green e então o experimento é removido: 100 % do tráfego volta ao controle sem lógica residual para limpar do lado do cliente.
DeepSeek V4 Pro contra GPT-5.6 Sol e Claude Fable 5 no DeepSWE: custo e cascata
17/18 de agosto — A Together AI publica dois benchmarks independentes de 904 rollouts cada (113 tarefas, 4 tentativas) comparando DeepSeek V4 Pro 0813 com GPT-5.6 Sol e Claude Fable 5 no DeepSWE, banco de testes de engenharia de software.
| Comparação | Pass@1 Pro | Pass@1 concorrente | Custo do rollout Pro | Custo do concorrente | Cascata Pro-first |
|---|---|---|---|---|---|
| Pro vs GPT-5.6 Sol | 62,8 % | 72,7 % | 0,24 $ | 8,37 $ (35x) | 83,0 % a 3,35 $/tarefa |
| Pro vs Claude Fable 5 | 62,8 % | 69,7 % | 0,24 $ | 21,63 $ (90x) | 82,7 % a 8,28 $/tarefa |
Em pass@4, o Pro recupera a vantagem nos dois casos (88,5 % contra 85,8 % frente a Sol, 88,5 % contra 84,1 % frente a Fable). A cascata “Pro-first” — executar o Pro primeiro, escalar apenas em caso de falha — supera cada modelo isoladamente por uma fração do custo.
🔗 Benchmark DeepSWE — GPT-5.6 Sol
Produtos por email e áudio generativo
Perplexity Computer acessível por email
18 de agosto — Computer, o agente de ação da Perplexity, passa a ficar acessível por email para todos os seus usuários: basta enviar, encaminhar ou colocar em cópia computer@perplexity.com em qualquer conversa para disparar uma tarefa. Cada tarefa por email é executada como uma sessão normal do Computer, consultável na web e no celular, com o mesmo registro de auditoria das tarefas iniciadas pelo aplicativo.
Stability AI lança um plugin DAW e uma nova interface web para Stable Audio 3.0
18 de agosto — A Stability AI anuncia duas ferramentas em beta para o Stable Audio 3.0, ambas baseadas em modelos “commercially-safe” cujos resultados pertencem ao usuário. O plugin DAW (macOS AU/VST3, Apple Silicon e Intel) gera áudio diretamente como faixa instrumental sincronizada ao tempo, com sequências curtas de até seis minutos. A interface web aprimorada em stableaudio.com adiciona prompts direcionais para ajustar uma geração, a transformação áudio-para-áudio, a mixagem multifaixa e efeitos por faixa. Essas ferramentas aproximam o Stable Audio dos fluxos profissionais de produção musical, em um terreno onde Suno e Pika já oferecem alternativas concorrentes.
🔗 Stable Audio 3.0 — novas ferramentas
Breves
- O Hub Hugging Face ultrapassa 3 milhões de modelos — novo marco para a plataforma comunitária de referência de modelos abertos. 🔗 Tweet
- Sakana Namazu disponível no OpenRouter e no Vercel AI Gateway — o modelo que alimenta o Sakana Chat, especializado em japonês e contexto de negócios, passa a estar acessível nessas duas plataformas de distribuição. 🔗 Tweet
- Ai2 pré-visualiza o MolmoMotion antes de seu webinar de 20 de agosto — extensão do Molmo para a previsão de trajetórias 3D a partir de instruções em linguagem natural, com pesos e dados abertos anunciados para breve. 🔗 Tweet
- Together AI: a adoção de modelos abertos acelera — um estudo da Brex citado pela Together AI mostra 14 dos 25 fornecedores de software de crescimento mais rápido atendendo IA; o uso de tokens na Together passou de 30 bilhões por mês para 400 mil bilhões em um ano. 🔗 Tweet
- Josh Woodward detalha o roadmap do app Gemini — ferramentas Workspace revisadas em teste, melhoria do tool calling com Gemini 3.7 Flash, nova interface Projects e 49 conectores agora suportados. 🔗 Tweet
- HeyGen lança os Brand Kits — fontes, logo, códigos hexadecimais e glossário de pronúncia pré-configurados para que cada vídeo de avatar gerado permaneça em conformidade com a identidade da marca, sem retrabalho. 🔗 Tweet
- NVIDIA constrói TensorRT Model Connect com agentes Codex — ferramenta em prévia para conversão de modelos Hugging Face para TensorRT, desenvolvida inteiramente com agentes Codex sob supervisão humana, projeto open source. 🔗 Tweet
- Cohere — Aidan Gomez sobre soberania digital — o CEO alerta para a concentração do mercado tecnológico global em torno de poucos atores e defende evitar qualquer ponto único de falha. 🔗 Tweet
O que isso significa
A governança da IA agora se traduz em medidas concretas, e não mais em princípios. A pausa de duas semanas na OpenAI diante das capacidades cibernéticas da Astra, a iniciativa de 5 milhões de dólares para equipar o controle democrático em segurança nacional e as proteções reforçadas do ChatGPT for Teens formam um mesmo movimento: os laboratórios documentam publicamente os limites que impõem a si mesmos, com números verificáveis (20 % de sobrecusto de computação, alerta em menos de 30 minutos) em vez de simples declarações de intenção.
A infraestrutura agentiva está se tornando, por si só, um produto completo. A Warp Factories oferece uma camada de governança e medição de ROI para agentes de codificação corporativa, o Claude Code amplia seu escopo para o design de interface com /design, e a Amp adiciona uma camada de voz ao seu agente Puck enquanto a Warp abre seus agentes para sessões SSH ativas. Nos quatro casos, a questão vai além da geração de código: trata-se de dar aos agentes controle direto sobre fluxos inteiros de trabalho, com governança e controle humano integrados.
A abertura dos pesos e dos dados continua a produzir um valor científico que os modelos proprietários não conseguem oferecer. A descoberta da Ai2 sobre o atalho morfológico dos LLM em farmacologia só foi possível porque o Olmo 3 expõe seus dados de treinamento; o artigo da IBM Research sobre memória agentiva quantifica ganhos diferenciados por modelo (gpt-oss-120b, DeepSeek-V3.2, GLM-5) graças a testes reproduzíveis; e a marca de 3 milhões de modelos no Hub Hugging Face ilustra a escala que esse ecossistema aberto está alcançando.
O custo da inferência continua a estruturar as escolhas de produto mais do que o desempenho bruto. Diante de GPT-5.6 Sol e Claude Fable 5, o DeepSeek V4 Pro perde em pass@1, mas vence com folga na relação custo-benefício, e uma simples cascata “Pro-first” reduz a maior parte da diferença de precisão por uma fração do custo. A Together AI leva essa lógica até a própria infraestrutura com seu A/B testing no nível dos endpoints — a comparação de modelos em produção torna-se uma funcionalidade de plataforma, e não mais uma questão de código de aplicação.
Fontes
- OpenAI — Pacing model development
- OpenAI — tweet pacing model development
- Warp Factories — anúncio
- Warp Factories — detalhes no X
- Claude Code — skill /design
- Claude Code — disponibilidade /design
- Claude Cowork — mobile e web
- Claude Code — limites semanais
- Claude Code — otimização de CPU
- Amp — Talk to Puck
- Amp — tarifa educacional
- Warp Agent CLI — suporte SSH
- OpenAI — ChatGPT for Teens
- OpenAI Devs — DevDay Exchange
- OpenAI — estudo de caso Asana
- OpenAI — controle democrático em segurança nacional
- Hugging Face — Sentence Transformers v6.0
- Ai2 — Olmo 3 e atalho morfológico
- IBM Research — ALTK-Evolve memória agentiva
- Google DeepMind — recorde de ômega AlphaEvolve
- Together AI — A/B testing endpoints
- Together AI — DeepSeek V4 Pro vs GPT-5.6 Sol
- Perplexity — Computer por email
- Stability AI — Stable Audio 3.0
- Hugging Face — 3 milhões de modelos
- Sakana Namazu — OpenRouter e Vercel
- Ai2 — MolmoMotion
- Together AI — estudo Brex
- Josh Woodward — roadmap do app Gemini
- HeyGen — Brand Kits
- NVIDIA — TensorRT Model Connect
- Cohere — Aidan Gomez sobre soberania digital