ai-powered-markdown-translatorArtigo traduzido do fr para o pt com gpt-5.4-mini.
Em 17 de agosto de 2026, OpenAI e NVIDIA garantem conjuntamente um enorme site de infraestrutura de IA em Ohio, enquanto Cursor lança em beta sua própria plataforma de hospedagem de código, Origin. Em torno desses dois grandes anúncios, DeepSeek V4 Pro continua sua implantação multivendedor, GitHub detalha seus canvases agênticos e uma otimização espetacular de sua busca de código, e Google lança o Sheets canvas para transformar planilhas em miniaplicativos.
OpenAI e NVIDIA garantem um site de IA de 8 GW-IT em Ohio
17 de agosto — OpenAI, NVIDIA e SB Energy anunciam no mesmo dia, sob dois ângulos complementares, um acordo conjunto para garantir um enorme site de infraestrutura de IA no campus tecnológico PORTS-Pike, no condado de Pike (Ohio) — um antigo site de difusão gasosa de Portsmouth. NVIDIA e SB Energy garantem as capacidades de terreno, energia e edifício (land, power and shell) em uma implantação inicial de 4,25 gigawatts, extensível em mais 3,75 gigawatts, num acordo de 20 anos faseado entre 2028 e 2030. OpenAI, locatária operadora, visa cerca de 8 gigawatts-IT no total com o apoio do Departamento de Energia dos EUA (DOE).
O projeto deve criar 35 000 empregos na construção ao longo de seis anos, depois 2 500 empregos de operação de longo prazo. O resfriamento será feito em circuito fechado e a ar, com recirculação da água. OpenAI investe 40 milhões de dólares em um fundo comunitário local (além dos 40 milhões já comprometidos pela SB Energy) e disponibiliza até 84 milhões de dólares em créditos Codex para cerca de 844 000 estudantes elegíveis de Ohio durante o ano acadêmico de 2026-2027. Do lado da NVIDIA, cada geração de GPU implantada no site poderia representar cerca de 1,5 milhão de chips, ou 150 a 200 bilhões de dólares em receita — no âmbito de um compromisso de computação OpenAI/NVIDIA até 2030 estimado entre 12 e 16 gigawatts (cerca de 600 bilhões de dólares).
| Métrica | Valor |
|---|---|
| Capacidade visada (OpenAI) | ~8 GW-IT |
| Capacidade inicial (NVIDIA/SB Energy) | 4,25 GW (+3,75 GW extensível) |
| Duração do acordo LPS | 20 anos, faseado 2028-2030 |
| Empregos na construção | 35 000 em 6 anos |
| Créditos Codex para estudantes de Ohio | até 84 M$ para ~844 000 estudantes |
| Compromisso OpenAI/NVIDIA até 2030 | 12-16 GW (~600 B$) |
“OpenAI has entered into an agreement to secure approximately 8 gigawatts-IT at the PORTS-Pike Technology Campus in Pike County, Ohio, working with SB Energy, NVIDIA, and the U.S. Department of Energy.”
🇵🇹 OpenAI firmou um acordo para garantir cerca de 8 gigawatts-IT no campus tecnológico PORTS-Pike, no condado de Pike, em Ohio, em colaboração com SB Energy, NVIDIA e o Departamento de Energia dos EUA. — Comunicado oficial da OpenAI
🔗 NVIDIA — garantir a infraestrutura da inteligência
Cursor lança Origin, sua plataforma de hospedagem de código
17 de agosto — Cursor lança em beta o Origin, uma plataforma de hospedagem de repositórios integrada diretamente ao seu editor, pensada para a escala de agentes (agent scale) em vez de ser apenas um concorrente do GitHub. O lançamento começa para todos os assinantes dos planos pagos, com opção de exclusão para organizações enterprise.
Os repositórios criados no Origin são acessíveis por meio de URLs cursor.com/codebase/[nom], e continua sendo possível sincronizar em paralelo repositórios GitHub existentes — em tempo real, com o GitHub permanecendo como fonte de verdade para os pushes. Em relação a pull requests, Cursor oferece uma experiência completa (timeline, commits, checks, diffs) com sincronização bidirecional: um comentário postado no Cursor aparece no GitHub em poucos segundos. Os agentes de IA podem responder a perguntas sobre o código, fazer modificações, atualizar pull requests e enviar branches diretamente da visualização do repositório.
Cursor fechou parcerias de integração antes do lançamento com Vercel (implantações de pré-visualização), Depot e Buildkite (CI/CD compatível com os workflows GitHub Actions existentes), com outras integrações anunciadas para breve.
“Origin, our code hosting platform, is now live. It’s fast, easy to use, and deeply integrated with Cursor. Get started by syncing your repos from GitHub.”
🇵🇹 Origin, nossa plataforma de hospedagem de código, já está no ar. Ela é rápida, fácil de usar e profundamente integrada ao Cursor. Para começar, sincronize seus repositórios a partir do GitHub. — @cursor_ai no X
🔗 Changelog do Cursor — hospedagem de código do Origin
Replit reforça sua segurança com pen tests black-box
17 de agosto — Replit adiciona pen tests black-box (testes de intrusão em caixa-preta) à sua oferta de segurança, em complemento aos scans white-box já disponíveis. O scanner opera pela interface de rede e navegador da aplicação, comportando-se primeiro como um visitante não autenticado e depois como um usuário autenticado comum, revelando funcionalidades reais, inclusive aquelas sem botão visível.
Os resultados das duas abordagens raramente se sobrepõem, segundo a Replit: o black-box detectou painéis admin desprotegidos e pontos de extremidade vulneráveis a negação de serviço que o white-box deixou passar, enquanto o white-box identificou bugs de lógica de autorização invisíveis do exterior. Três níveis são propostos no Security Center de cada projeto: nível 1 gratuito (verificação de dependências), nível 2 (scan white-box) e nível 3 (combinação dos dois). Assim que uma vulnerabilidade é confirmada, o Replit Agent pode corrigi-la com um clique.
🔗 Anúncio da Replit — pen tests black-box
Modelos abertos e inferência: DeepSeek, Yutori, alocação de GPU
Três publicações em torno do ecossistema Together AI e Hugging Face ilustram a disputa em curso sobre o custo e a eficiência da inferência.
DeepSeek V4 Pro 0813: implantação multivendedor e benchmark DeepSWE
16 de agosto — DeepSeek V4 Pro, cujo lançamento em pesos abertos já havia sido coberto em 13 de agosto, continua sua implantação sob a revisão “0813”: Together AI e Novita confirmam ambos seu suporte, com a arquitetura de 1,6T de parâmetros em mistura de especialistas (Mixture of Experts), a janela de contexto de 1M de tokens e três modos de raciocínio (codificação, agentes, raciocínio complexo). No benchmark de engenharia de software DeepSWE, Together AI mede uma pontuação de 88,5% de pass@4 para um custo de 0,24 $ por tarefa — 35 vezes mais barato que GPT-5.6 Sol e 90 vezes mais barato que Fable 5.
🔗 Together AI — DeepSeek V4 Pro 0813
Yutori implanta seu modelo de agentes Navigator na Together AI
16 de agosto — Together AI destaca Navigator, o modelo de agentes de navegação web (browser-use) da startup Yutori. Esses agentes operam em loops curtos — captura de tela, ação, repetição, às vezes dezenas de vezes por tarefa — o que torna o custo de inferência particularmente sensível. Segundo a Together AI, Navigator supera o desempenho dos modelos de referência, ao mesmo tempo que é duas vezes mais rápido na inferência e 4 a 5 vezes mais barato.
🔗 Together AI — Yutori Navigator
Um alocador de GPU sob restrição recupera até 33 pontos de utilização do cluster
17 de agosto — A equipe Dharma-AI publica no Hugging Face a segunda parte de seu estudo sobre a gestão de clusters GPU. Seu “alocador de GPU sob restrição” substitui o escalonamento FIFO por uma otimização em uma janela de 24 horas, respeitando a contiguidade das GPUs e as curvas de demanda em tempo real. Em sete cenários testados, os ganhos de utilização variam de 51,6% a 72,4% em regime misto, chegando a 53,6% a 87,0% em cargas de treinamento. Um teste com prioridade uniforme confirma um ganho de 23,1% independente do sinal de prioridade, e um cluster de 64 GPUs mantém um ganho de valor de 15,9% com uma latência de alocação de 15 ms.
🔗 Hugging Face — alocador de GPU Dharma-AI
Gemini: Sheets canvas transforma planilhas em miniaplicativos
17 de agosto — Google lança o Sheets canvas, que se apoia no Gemini 3.7 Flash para transformar uma planilha Google Sheets clássica em um miniaplicativo interativo, sem escrever código. Ao contrário das ferramentas de prototipagem habituais que geram uma interface fixa a partir de uma exportação estática, o Sheets canvas analisa nativamente o esquema da planilha (colunas, tipos de dados, relações) para construir componentes de interface funcionais — uma tabela de simulação “e se” vira, por exemplo, um conjunto de controles deslizantes ajustando projeções financeiras em tempo real.
A particularidade destacada é a sincronização bidirecional: as interações no miniapp são refletidas em tempo real na planilha subjacente, e vice-versa. O usuário pode então refinar o aplicativo por simples conversa, com o Gemini mantendo o contexto para iterar sem recomeçar do zero. O Sheets canvas está disponível agora para assinantes Google AI Pro e Ultra, e sua implantação foi anunciada para contas Google Workspace business e educação em algumas ofertas.
🔗 Google AI — anúncio do Sheets canvas
GitHub Copilot: canvases, busca de código e revisões configuráveis
O GitHub publica três anúncios técnicos e de produto entre 16 e 17 de agosto, em torno da condução de workflows agênticos e do desempenho de seu mecanismo de busca.
Os canvases tornam os workflows agênticos visíveis e controláveis
17 de agosto — GitHub detalha os “canvases”, uma superfície de trabalho persistente e compartilhada no app Copilot para acompanhar workflows agênticos complexos sem perdê-los na rolagem do chat. A abordagem se baseia em quatro princípios: definir o estado do workflow, destacar os pontos de decisão, persistir imediatamente os progressos e manter pontos explícitos de aprovação humana. Dois canvases concretos ilustram a abordagem — um “Java Modernization Studio” organizando uma migração em fases (avaliação, correção, validação, entrega), e um “Site Studio” gerenciando a criação de conteúdo com seções editáveis e acompanhamento de revisão — ambos públicos no repositório awesome-copilot. O autor menciona um custo de cerca de 2 000 a 3 000 créditos de IA por canvas.
🔗 GitHub — como os canvases tornam os workflows agênticos controláveis
Busca de código: o case-folding roda a mais de 45 GiB/s em um único núcleo
16 de agosto — GitHub publica um relato de experiência sobre a otimização do case-folding (normalização de caixa para comparação sem distinção de maiúsculas e minúsculas) em seu mecanismo de busca Blackbird, que indexa mais de 180 milhões de repositórios e 480 To de código. A otimização mais significativa é contraintuitiva: remover um ramo de saída antecipada em vez de adicionar um, o que permite ao LLVM vetorizá-lo completamente por meio de instruções NEON.
| Versão | Taxa de transferência |
|---|---|
| Ingênua (com saída antecipada) | 3,1 GiB/s |
| Loop totalmente sem ramificações | mais de 45 GiB/s |
| Pior caso (folding integral, não-ASCII) | 869 MiB/s |
A equipe publica o resultado na forma de uma crate Rust open source chamada casefold.
“GitHub case-folds every byte of code search at over 45 GiB/s on one core. The biggest win came from removing an early-exit branch, not adding one.”
🇵🇹 O GitHub aplica o case-folding a cada byte da sua busca de código a mais de 45 GiB/s em um único núcleo. O maior ganho veio da remoção de um ramo de saída antecipada, não de sua adição. — @github no X
🔗 GitHub — case-folding do código-fonte na velocidade da memória
Copilot code review: a profundidade Balanced passa a disponibilidade geral
16 de agosto — GitHub Copilot agora permite escolher a profundidade das revisões automáticas de código nas pull requests: “Balanced” (análise mais aprofundada, mudanças complexas) passa para disponibilidade geral, ao lado de “Lite” (mudanças simples e rápidas de validar). A configuração pode ser definida por padrão no nível da organização ou do repositório, ou escolhida pontualmente ao solicitar a revisão de uma PR específica.
🔗 GitHub — profundidade Balanced em disponibilidade geral
OpenAI: cibersegurança defensiva e ganhos de eficiência do GPT-5.6 Sol
The Defender’s Window — a estratégia de cibersegurança defensiva da OpenAI
17 de agosto — Greg Brockman, presidente da OpenAI, retorna ao incidente de segurança OpenAI-Hugging Face, apresentado como um ponto de virada: um coletivo agêntico encadeou falhas para penetrar na infraestrutura de pesquisa da OpenAI e na infraestrutura de produção de outra empresa. A OpenAI lembra ter restringido a difusão de suas capacidades cyber apenas a “defensores confiáveis”, mas observa que outros laboratórios publicam modelos de pesos abertos com capacidades ofensivas próximas da fronteira — último exemplo citado, o GLM-5.3 da Z.ai, previsto para o fim de agosto. A OpenAI agora treina seus modelos para produzir código “superhumanamente seguro” e aposta em suas capacidades de prova matemática para verificar formalmente a segurança de softwares.
Anedota concreta: após o incidente, Brockman pediu ao ChatGPT Work (GPT-5.6 Sol) para auditar a segurança do seu próprio site. Em cerca de 15 minutos, a ferramenta detectou 13 problemas — DNS mal configurado permitindo a falsificação de e-mails, jQuery obsoleto, tráfego Cloudflare→AWS não criptografado — e então os corrigiu em cerca de uma hora, sem intervenção humana intensa.
🔗 OpenAI — The Defender’s Window
GPT-5.6 Sol — ganhos de eficiência medidos em clientes e no ARC-AGI-3
17 de agosto — Graças ao retained reasoning e à compactação, a pontuação do GPT-5.6 Sol no ARC-AGI-3 passou de 13,3% para 38,3%, consumindo cerca de 6 vezes menos tokens de saída. Dois retornos concretos de clientes: a startup imobiliária hypha_ai manteve 98% da precisão do GPT-5.5 enquanto reduzia o custo por 18 ao migrar para o GPT-5.6 Luna, e a RogoAI (pesquisa financeira) usou a chamada programática de ferramentas para igualar a qualidade de suas avaliações com 21% menos tokens de entrada.
🔗 OpenAI Devs — ganhos de eficiência do GPT-5.6 Sol
Geração de mídia: ElevenLabs no Claude, Seedance 2.5 na Pika e Luma
ElevenLabs lança seu servidor MCP, disponível diretamente no Claude
17 de agosto — ElevenLabs oferece um servidor MCP (Model Context Protocol) oficial para gerenciar seus agentes de voz e de chat diretamente a partir do Claude, sem sair do ambiente de trabalho: consultar o desempenho recente, criar novos agentes, atualizar configurações, estimar o custo em tokens LLM antes de validar uma mudança. A autenticação é feita via OAuth, sem servidor a hospedar nem chaves API para administrar, com controle deixado para a equipe sobre o que os agentes podem de fato consultar ou modificar.
🔗 ElevenLabs — anúncio do servidor MCP
Seedance 2.5 em 1080p chega ao Pika API Club e à Luma com upscale 4K
17 de agosto — Após seu acesso antecipado no Runway em 15 de agosto, Seedance 2.5 em resolução 1080p continua sua expansão entre parceiros de terceiros. A Pika Labs o disponibiliza via seu Pika API Club, anunciando uma tarifa até 60 % mais barata que a concorrência. A Luma Labs anuncia no mesmo dia a disponibilidade de Seedance 2.5 em 1080p, com uma funcionalidade adicional: o upscale para 4K diretamente em sua plataforma.
🔗 Pika Labs — Seedance 2.5 no Pika API Club
Breves
- ABC Legal implanta mais de 50 agentes com Claude Managed Agents — 1 100 funcionários, até 50 % de redução de custo em algumas tarefas jurídicas, ciclo de feedback semanal via Slack e pull requests. 🔗 Claude
- A equipe Diffusers da Hugging Face integra quatro novos modelos abertos em uma semana — MiniMax H3 (vídeo/áudio), LTX2.5 (vídeo/áudio), Wan Animate 2 e MiniMax Music 3. 🔗 Tweet
- datatrove 0.10.0 executa pipelines no Hugging Face Jobs sem cluster Slurm — novo
JobsPipelineExecutore suporte aos buckets de armazenamento do Hugging Face comoDataFolder. 🔗 Tweet - Together AI hospeda os modelos de geração de código da Relace AI — treinados em clusters GPU dedicados ao programa Y Combinator. 🔗 Tweet
- No ICML, Tri Dao destaca que os modelos abertos estão se aproximando dos labs fechados — agora com apenas alguns meses de atraso, impulsionados pelos avanços da pilha de serviço (núcleos, motores de inferência, decodificação especulativa). 🔗 Tweet
- Google, Gemini e Pixel oficializam uma parceria com cinco clubes de futebol europeus — Arsenal, FC Barcelona, Bayern de Munique, Liverpool e PSG, com um compromisso de visibilidade equivalente para o futebol feminino. 🔗 Google
- OpenClaw: teaser do GitHub no X — a conta do GitHub menciona um projeto chamado OpenClaw, sem detalhes adicionais disponíveis. 🔗 Tweet
- MiniMax-H3 reivindica um ganho de 4,44x na RTX 4090 — novo núcleo CuTe DSL dedicado SM89 para o mecanismo de atenção Sol-Attn. 🔗 Tweet
- Alibaba organiza uma sessão ao vivo com os criadores do Wan3.0 em 19 de agosto — com os parceiros Magnific, fal, OpenArt e KoyalAI, às 15h UTC. 🔗 Tweet
- Kling apresenta o efeito « Hitchcock Zoom » — novo efeito de geração de vídeo inspirado no zoom-travelling inverso popularizado por Alfred Hitchcock. 🔗 Tweet
- MiniMax H3 com -50 % na geração 2K via Magnific até 1º de setembro — desconto anunciado durante um evento em San Francisco. 🔗 Tweet
- GPT-5.6 Sol pela metade do preço no AI Gateway (Vercel) e no OpenRouter — promoções temporárias de 50 % até 18 de setembro de 2026, aplicadas automaticamente ao uso. 🔗 Tweet
- OpenAI financia 14 projetos de pesquisa em políticas públicas para a era da IA — 1 milhão de dólares em financiamento e até 1 milhão de dólares em créditos de API, distribuídos por 5 países/regiões. 🔗 OpenAI
- Codex em destaque por meio de retornos de uso — um criador de conteúdo (mais de 1,5 milhão de inscritos) conduz sua atividade com o Codex, e um funcionário da OpenAI o usa como assistente interno de edição de vídeo. 🔗 Tweet
O que isso significa
A escala da infraestrutura de IA ultrapassa um novo limiar físico e financeiro. O site de Ohio reúne sozinho 8 gigawatts-IT previstos, 35 000 empregos na construção e um compromisso de computação OpenAI/NVIDIA estimado em 600 bilhões de dólares até 2030 — um canteiro de obras que agora se compara a projetos industriais ou energéticos nacionais, e não a um simples data center. A mecânica de financiamento revelada pela NVIDIA (apoio parcial aos pagamentos de aluguel e energia, em vez de financiamento integral) também mostra que até os maiores laboratórios de IA precisam recorrer a estruturas financeiras específicas para absorver esse nível de gasto.
A hospedagem de código torna-se, por si só, um campo de batalha agêntico. O Cursor lança o Origin para não depender mais do GitHub na infraestrutura que executa seus agentes, o GitHub responde com canvases para tornar os workflows agênticos controláveis em vez de perdidos no chat, e o Replit adiciona pen tests black-box para que seu próprio Agent possa corrigir o que detectar com um clique. Nos três casos, o objetivo converge: dar aos agentes uma tomada direta e segura sobre o ciclo de vida do código, e não apenas sobre sua geração.
O custo da inferência continua caindo mais rápido do que as capacidades aumentam. O DeepSeek V4 Pro processa DeepSWE por 35 vezes menos que o GPT-5.6 Sol, o Yutori Navigator roda de 4 a 5 vezes mais barato que os modelos de referência, e o próprio GPT-5.6 Sol avança de 13,3 % para 38,3 % no ARC-AGI-3 consumindo 6 vezes menos tokens — na mesma semana em que Tri Dao destaca no ICML que os modelos abertos estão fechando a lacuna de qualidade em poucos meses. O alocador de GPU sob restrição da Dharma-AI acrescenta uma dimensão complementar: parte desses ganhos já não vem do modelo, mas do próprio escalonamento dos clusters.
Por fim, o rigor técnico volta a ser um argumento de comunicação em si. O GitHub multiplica por 15 a vazão da sua busca de código ao remover código em vez de adicioná-lo, e a OpenAI detalha como uma auditoria de segurança com GPT-5.6 Sol corrigiu 13 falhas reais em uma hora — duas maneiras diferentes de mostrar, com números em mãos, que a engenharia detalhada ainda é o que distingue um anúncio de produto de uma demonstração de competência.
Fontes
- OpenAI — A OpenAI se junta ao projeto PORTS-Pike
- NVIDIA — proteger a infraestrutura da inteligência
- Cursor — anúncio do Origin no X
- Cursor — changelog de hospedagem de código do Origin
- Replit — pen tests black-box
- Together AI — DeepSeek V4 Pro 0813
- Together AI — Yutori Navigator
- Hugging Face — alocador de GPU Dharma-AI
- Google AI — anúncio do Sheets canvas
- GitHub — canvases no app do Copilot
- GitHub — case-folding no X
- GitHub — case-folding à velocidade da memória
- GitHub — Copilot code review Balanced no X
- OpenAI — The Defender’s Window
- OpenAI Devs — eficiência do GPT-5.6 Sol
- ElevenLabs — servidor MCP
- Pika Labs — Seedance 2.5 1080p
- Claude — estudo de caso ABC Legal
- Hugging Face Diffusers — quatro novos modelos
- datatrove 0.10.0
- Together AI — Relace AI
- Together AI — Tri Dao no ICML
- Google — parceria de futebol
- GitHub — teaser do OpenClaw
- MiniMax-H3 — ganho na RTX 4090
- Alibaba Wan — sessão ao vivo
- Kling — efeito Hitchcock Zoom
- MiniMax H3 — promoção Magnific
- OpenRouter — promoção GPT-5.6 Sol
- OpenAI — financiamento de pesquisa em políticas públicas
- Peter Yang — depoimentos sobre o Codex