ai-powered-markdown-translatorArtículo traducido del fr al es con gpt-5.4-mini.
El 11 de agosto de 2026, la aplicación Gemini supera los mil millones de usuarios mensuales, convirtiéndose en el producto de crecimiento más rápido de la historia de Google. NVIDIA publica Nemotron 3.5 Lightning y su biblioteca de enrutamiento NeMo Switchyard, Mistral abre su plataforma a modelos de terceros y reúne una coalición de cómputo europea, y Alibaba presenta Wan-Animate-2, una importante actualización de su modelo de animación open source. También en el menú: anuncios de ChatGPT ampliados a cinco nuevos mercados, nuevas herramientas para desarrolladores y una larga lista de anuncios en generación de medios.
Gemini supera los mil millones de usuarios mensuales
La aplicación Gemini ha superado oficialmente los mil millones de usuarios mensuales activos, convirtiéndose, según Google, en el producto de crecimiento más rápido de toda la historia de la empresa. El anuncio fue difundido tanto por la cuenta oficial @GeminiApp como por Josh Woodward, que dirige los equipos de Gemini y Labs en Google.
Google acompaña el anuncio con un balance cuantificado sobre los usos que han impulsado este crecimiento:
| Uso medido | Dato |
|---|---|
| Interacciones de voz | El 63 % de los usuarios utiliza la voz |
| Sesiones Gemini Live | 1 de cada 5 usa la cámara en vivo o el uso compartido de pantalla |
| Solicitudes escolares | El 38 % incluye un archivo adjunto (fichero) |
| Generación de imágenes | Más de 150 millones de imágenes producidas cada día |
| Automatización Android | Acciones automatizadas en más de 40 aplicaciones |
| Usuarios iOS | Más de 100 millones de usuarios activos en dispositivos Apple |
Estas cifras ilustran una diversificación de los usos más allá del simple chat de texto: voz, cámara, uso compartido de pantalla, generación multimedia y automatización entre aplicaciones (reserva de restaurante, pedido de VTC) aparecen como motores importantes de la adopción.
🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.
🇪🇸 🚀 ¡Mil millones para Gemini! Nuestro objetivo sigue siendo convertirlo en el asistente más personal, proactivo y potente. — @GeminiApp en X
🔗 Anuncio oficial en el blog de Google
NVIDIA lanza Nemotron 3.5 Lightning y NeMo Switchyard para agentes de gran volumen
NVIDIA amplía su familia de modelos abiertos Nemotron 3 con Nemotron 3.5 Lightning, un MoE híbrido de 30 mil millones de parámetros (3 mil millones activos) diseñado para la ejecución de tareas agenticas de gran volumen — llamada de herramientas, validación de resultados, delegación de tareas — en lugar del razonamiento complejo. Disponible en NVFP4 y BF16 con un contexto de hasta 1 millón de tokens, el modelo reivindica hasta 4 veces el rendimiento de salida de modelos comparables y un 30 % de ganancia de tiempo en la finalización de tareas. En PinchBench, alcanza un 86 % de precisión al completar 10 000 tareas un 35 % más rápido que Qwen3.6 35B con precisión equivalente.
El modelo se distribuye con pesos, datos de entrenamiento y recetas, y está disponible en Hugging Face, ModelScope, OpenRouter y build.nvidia.com. Together AI es socio de lanzamiento desde el primer día (day-0), con capacidad reservada mediante su oferta Dedicated Model Inference para cargas de trabajo agenticas de gran volumen.
En paralelo, NVIDIA publica NeMo Switchyard, una biblioteca open source que enruta cada solicitud al modelo más adecuado (calidad, latencia, coste) sin reescribir la aplicación — reservando los modelos frontera para el razonamiento complejo y Lightning para la ejecución especializada. NVIDIA afirma un coste de finalización de tareas reducido a casi un tercio del de Opus 4.8 por sí solo. Se citan socios concretos: Boomi enruta el 59 % de su tráfico a un modelo fine-tuned más rápido, Cognition reduce su coste medio en un 28 %, y Ramp combina modelo y enrutamiento para un 59 % de coste y un 32 % menos de tiempo de ejecución.
🔗 Entrada oficial de NVIDIA · Anuncio del modelo en X
Alibaba presenta Wan-Animate-2, una importante actualización de su animación de personajes open source
Alibaba (equipo Wan) publica Wan-Animate-2, descrito como una importante actualización de su modelo open source de animación de personajes. Se destacan cuatro capacidades: una animación de alta fidelidad que reproduce movimientos y microexpresiones a través de humanos, dibujos animados, robots y animales; la animación multi-personaje, en la que cada personaje conserva su propia identidad y movimiento dentro de una misma escena; un control de cámara pilotado por texto (por ejemplo, «vista desde arriba»), desacoplado del vídeo fuente; y una generación en streaming en tiempo real, produciendo secuencias de longitud arbitraria chunk por chunk sin acumulación observable de error.
En el plano técnico, Alibaba abandona los esqueletos de pose explícitos en favor del propio vídeo de referencia como priori de movimiento, con una arquitectura Dual-Branch DiT (Diffusion Transformer), un codificado temporal Time-Align RoPE y una atención dispersa (Sparse-Ref Attention) para limitar el cálculo sin pérdida de calidad. El control de cámara se apoya en una LoRA entrenada sobre unos 50 000 ejemplos multi-vista de Unreal Engine.
El modelo es open source, disponible desde ahora en ModelScope, Hugging Face y GitHub, con demo en línea. Según la campaña «Local AI» de agosto de NVIDIA, sus 14 mil millones de parámetros generan entre 16 y 26 veces más rápido en sistemas RTX que las alternativas, confirmando su optimización para un despliegue local en hardware de consumo.
🔗 Detalles técnicos y cifras de NVIDIA · Anuncio en X
Mistral lanza la inferencia regional, abre su plataforma a GLM-5.2 y reúne una coalición de cómputo europea
Mistral se posiciona como el único laboratorio de IA europeo que combina selección regional de inferencia y garantías de servicio. La empresa, ya inmersa en una carrera tarifaria y técnica frente a OpenAI, Google y los actores chinos, apuesta aquí por un posicionamiento distinto: la soberanía y la previsibilidad del servicio, en lugar de la simple carrera por los benchmarks. Dos novedades en la plataforma:
| Funcionalidad | Estado | Descripción |
|---|---|---|
| Mistral Regional Endpoints | Disponible | Elección de Europa o Estados Unidos para la ejecución de la inferencia |
| Mistral Priority Tier | Vista pública | SLA de disponibilidad y límites de caudal personalizados |
Otro aspecto notable: la plataforma Mistral se abre a modelos de terceros, empezando por GLM-5.2 de Z.ai, que se beneficiará de los mismos controles regionales y compromisos de servicio que los modelos Mistral — una primera convergencia entre ambos actores, hasta ahora competidores directos en el segmento de modelos abiertos asequibles.
Por último, Mistral lanza las European Compute Units (ECU), un mecanismo que convierte compromisos plurianuales de empresas en acceso a su infraestructura de cómputo, con el objetivo de 1 GW de capacidad para 2030 — el equivalente a la potencia consumida por una gran ciudad. Los socios fundadores anunciados son ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman y CEO), Amadeus (Luis Maroto, CEO) y Caisse des Dépôts (Olivier Sichel, CEO) — una mezcla de industriales, transporte y finanzas públicas que ilustra la ambición de construir una cadena de cómputo europea independiente de los hyperscalers estadounidenses.
OpenAI lanza los anuncios de ChatGPT en Reino Unido, México, Brasil, Japón y Corea del Sur
OpenAI da un nuevo paso en el despliegue de la publicidad dentro de ChatGPT. Lanzado en pruebas en Estados Unidos en febrero de 2026 para las ofertas Free y Go, y luego ampliado a Canadá, Australia y Nueva Zelanda en marzo, el programa publicitario se lanza ahora oficialmente en cinco nuevos mercados: Reino Unido, México, Brasil, Japón y Corea del Sur. Las ofertas Plus, Pro, Business, Enterprise y Education siguen sin publicidad, y se prevén otros mercados antes de final de año.
El principio sigue siendo el mismo: los anuncios nunca influyen en las respuestas de ChatGPT, permanecen claramente etiquetados como patrocinados y visualmente separados de la respuesta orgánica. La segmentación se basa en el tema de la conversación en curso y en el historial de interacciones publicitarias pasadas, sin dar nunca a los anunciantes acceso a las conversaciones ni a los datos personales — solo reciben estadísticas agregadas (vistas, clics).
En cuanto al control del usuario, ChatGPT permite ocultar un anuncio, consultar por qué se mostró, eliminar sus datos publicitarios con un solo gesto y gestionar la personalización en cualquier momento. No se muestra publicidad a cuentas de menores identificados o presuntos, ni cerca de temas sensibles (salud, salud mental, política). Según OpenAI, el piloto no mostró ningún impacto medido en la confianza de los usuarios, lo que ha motivado esta ampliación progresiva.
Ecosistema open source e inferencia
webAI Intelligence Lab publica TwiL-LM3, modelo de razonamiento 3B que supera a GPT-OSS-120B
El laboratorio webAI Intelligence Lab (Austin) publica TwiL-LM3, su primer modelo de razonamiento formal en open source. Con solo 3 mil millones de parámetros, afirma superar a GPT-OSS-120B de OpenAI en 4 de los 5 benchmarks de razonamiento formal probados — es decir, unos 40 veces menos parámetros para una inferencia 2,6 veces más rápida. Entrenado sobre datos verificados y propietarios en lugar de contenido web recopilado automáticamente, el modelo apunta a la informática en el borde (edge): se anuncia capaz de funcionar desde un Raspberry Pi hasta un iPhone, sin depender de la nube.
Meta prepara una versión con pesos abiertos de Muse Spark 1.2
En el hilo que anuncia Muse Glimmer, Alexandr Wang (Meta Superintelligence Labs) indica que Meta publicará próximamente una versión con pesos abiertos de Muse Spark 1.2 — hasta ahora el modelo propietario que impulsa al agente de código en terminal Muse Code. No se da ninguna fecha precisa, pero el anuncio confirma un giro de Meta hacia más pesos abiertos en toda su gama Muse, en la continuidad de la apertura inmediata de los pesos de Muse Glimmer bajo licencia Apache 2.0.
Zuckerberg publica un texto sobre la filosofía de IA de Meta
El mismo día, Mark Zuckerberg publica un texto afirmando que «todo el mundo debería tener acceso a la superinteligencia», detallando la filosofía y los valores de Meta para construir un futuro positivo de la IA. El mensaje acompaña el lanzamiento de Muse Glimmer, posicionando la apertura de los pesos como una decisión de fondo más que como un simple argumento de marketing, y se inscribe en una comunicación más amplia de Meta sobre su estrategia de pesos abiertos esa misma semana.
Lightricks presenta LTX-2.5, una actualización importante de su world model abierto
Lightricks publica LTX-2.5, nueva versión de su «world model» ya utilizado para cine, robótica y flujos de trabajo en tiempo real. La actualización promete una fidelidad de píxel superior, escenas multi-plano que se mantienen coherentes de un corte a otro, y una base preentrenada pensada para ser afinada (fine-tuned) según distintos dominios, mediante un nuevo renderizado llamado Diffusion Fidelity Rendering. El equipo presenta LTX-2.5 como una fundación abierta más que como una herramienta alquilada.
IBM Research publica ALTK-Evolve, una memoria agentica menos exigente en tokens que ACE
IBM Research publica ALTK-Evolve, un sistema que permite a los agentes de IA aprender de sus fracasos pasados sin reentrenamiento, calibrando la cantidad de instrucciones reinyectadas según la capacidad del modelo utilizado — a diferencia de ACE (Agentic Context Engineering), que entrega todo su «playbook» en cada etapa. En el benchmark AppWorld con DeepSeek-V3.2, ALTK-Evolve alcanza un 89,3 % de tareas completadas por 263K tokens por tarea, frente a un 80,4 % y 634K tokens para ACE. Con gpt-oss-120b, obtiene una precisión igual o mejor por alrededor del 40 % del coste de inferencia de ACE.
Together AI, IBM y NVIDIA se asocian para la inferencia empresarial en IBM Cloud
Together AI anuncia una colaboración con IBM y NVIDIA para llevar inferencia de IA de nivel empresarial a IBM Cloud, mediante un clúster dedicado de GPU NVIDIA B300 con red Spectrum-X — una primicia en esta plataforma, impulsada por la plataforma de inferencia de producción de Together AI. La oferta apunta a las empresas ya clientes de IBM Cloud que desean desplegar cargas de trabajo de IA sin migrar a otro proveedor cloud.
Herramientas para desarrolladores: Amp, Replit, GitHub Copilot y Manus
Amp lanza los plugins y skills globales para los orbs
Amp (Sourcegraph) introduce un sistema centralizado de plugins y skills alojados por Amp, disponible en cualquier lugar donde funcione Amp, especialmente en los orbs. Coexisten dos niveles: un nivel personal, sandbox experimental con recarga en caliente (live reloading) en el mismo hilo de conversación, y un nivel espacio de trabajo, gestionado por los administradores y cargado por defecto para todo el equipo. Los elementos personales pueden compartirse con el espacio de trabajo, y el versionado se gestiona de forma nativa (actualización a la última versión, detección de skills obsoletos).
Replit MCP beta: crear, cargar, buscar y publicar una app vía MCP
Replit refuerza su beta MCP (Model Context Protocol) con nuevas capacidades: crear, cargar, buscar y publicar una aplicación directamente vía MCP, sin pasar por la interfaz web. El objetivo declarado es permitir construir software real en Replit desde cualquier cliente MCP compatible — editor, agente autónomo u herramienta de terceros — en lugar de quedar limitado a la interfaz de Replit en sí. Esta ampliación confirma la estrategia de Replit de exponer su plataforma como una pieza programable para los flujos de trabajo agenticos.
MAI-Code-1.1-Flash llega a GitHub Copilot, MAI-Code-1-Flash queda obsoleto
El último modelo de código compacto de Microsoft, MAI-Code-1.1-Flash, se despliega en GitHub Copilot con soporte nativo de visión y mejoras en calidad de código, seguimiento de instrucciones y uso de herramientas. Cuesta un 73 % menos que MAI-Code-1-Flash, con un multiplicador de solicitud premium de 0,25× para los suscriptores anuales. Seleccionado automáticamente en Free y Student, disponible para selección manual en Pro, Pro+, Max, Business y Enterprise. En paralelo, GitHub anuncia la descontinuación de MAI-Code-1-Flash el 10 de septiembre de 2026.
Manus volverá a ser una empresa independiente
Manus anuncia que vuelve a ser una empresa independiente. Para cumplir con los requisitos regulatorios de ciertas jurisdicciones, una parte de los usuarios deberá guardar sus datos antes del 23 de agosto de 2026 (7:59, hora de Singapur) y luego iniciar una restauración a partir del 25 de agosto de 2026 (8:00, hora de Singapur). Los usuarios afectados serán avisados por correo electrónico y notificación in-app; no se prevé facturación durante la transición, con bonificaciones de bienvenida incluidas.
Generación de medios: Wan CLI, Motif 3, Luma Scenes y alimentación de 800 VDC
Wan CLI: Alibaba permite controlar Wan directamente desde los agentes
Alibaba publica Wan CLI, una nueva herramienta de línea de comandos que permite llamar a la plataforma Wan directamente desde agentes para generar imágenes y vídeos de forma programática. Los créditos consumidos siguen completamente sincronizados con la cuenta Wan Video del usuario, evitando una doble gestión de la facturación entre la interfaz web y el uso automatizado. La instalación se realiza recuperando un comando desde el panel de Wan y pegándolo en el agente, con un tutorial en vídeo proporcionado para empezar.
Motif 3: primer modelo frontera coreano entrenado en GPU NVIDIA B200
La startup coreana Motif Technologies lanza Motif 3 Base y Motif 3, sus primeros modelos orientados a la carrera de los LLM frontera, desarrollados con el apoyo del Ministerio coreano de Ciencia y entrenados en GPU NVIDIA B200. Motif 3 está construido sobre Motif 3 Base mediante posentrenamiento usando NVIDIA NeMo-RL. En colaboración con NVIDIA, el equipo también publica una versión NVFP4 (precisión reducida optimizada por NVIDIA). El conjunto estará disponible en Hugging Face con un informe técnico, y NVIDIA ha elogiado este lanzamiento como un ejemplo del dinamismo del ecosistema de IA coreano.
Luma Scenes: producción de vídeo por escenas, impulsada por Uni-1
Luma AI lanza Luma Scenes, una herramienta que permite afinar, temporizar y validar cada escena individualmente antes del render final, respondiendo al problema clásico de producir muchas variantes para quedarse solo con una utilizable, con el riesgo de que una escena fallida comprometa toda una producción. La herramienta amplía Luma Layers (edición por capas, a finales de julio), confirmando la orientación de Luma hacia el control granular más que hacia la generación con un solo clic, con un flujo de trabajo más cercano al montaje tradicional.
Ideogram Ad Resizer: un diseño, todos los formatos publicitarios
Ideogram lanza Ad Resizer: a partir de un diseño único y de los emplazamientos publicitarios objetivo, la herramienta genera automáticamente un conjunto completo de formatos listos para campaña (Instagram, Facebook, YouTube, televisión conectada, display, impresión), incluidos ratios extremos difíciles de recortar manualmente. Disponible de inmediato en la aplicación y vía API, para integrarse en pipelines automatizados de producción publicitaria: un caso de uso de marketing concreto para equipos creativos multicanal.
HeyGen for Real Estate: lanzamiento oficial con tres formatos de vídeo para agentes inmobiliarios
HeyGen lanza oficialmente HeyGen for Real Estate, con tres formatos de vídeo pensados para agentes inmobiliarios que aparecen ellos mismos en pantalla sin cámara ni edición: el objetivo es permitirles publicar varias veces al día sin sacrificar la presencia visual que exige este sector. Oferta de incentivo: los inscritos al plan Creator en las 12 horas siguientes al anuncio reciben acceso White Glove gratuito durante 30 días (solo Estados Unidos). HeyGen menciona una posible expansión a otras pequeñas empresas más allá del sector inmobiliario.
NVIDIA detalla la arquitectura de alimentación 800 VDC de las futuras «AI factories»
NVIDIA, junto con Google y Microsoft, detalla a través de Open Compute Project una arquitectura de alimentación en corriente continua de 800 voltios, que reduce los pasos de conversión eléctrica entre la red y las GPU para sostener la densidad de cálculo de las futuras generaciones de aceleradores. Más de 80 fabricantes ya están trabajando en productos conformes. Despliegue en varias etapas: arquitectura híbrida «Power Rack» desde el segundo semestre de 2026, «Row Power Center» en 2027 y luego instalaciones nativas 800 VDC en la próxima década.
🔗 Publicación oficial de NVIDIA
Qwen, Z.ai y OpenAI: nuevos modelos y sincronización de agentes
Qwen3.8-27B: pesos abiertos anunciados para esta semana
Alibaba Qwen confirma que los pesos abiertos de Qwen3.8-27B se publicarán esta semana, una nueva talla dentro de la familia Qwen3.8 tras el modelo insignia Qwen3.8-Max ya cubierto a principios de agosto. El equipo presenta este nuevo modelo como superior a Qwen3.6-27B en codificación agentica, un rendimiento ya muy bien recibido por la comunidad de desarrolladores que esperaba esta talla intermedia desde hace varias semanas.
Z.ai: ZCode alcanza 1 millón de usuarios, reinicio de los límites del GLM Coding Plan
Z.ai anuncia que ZCode, su herramienta de codificación basada en los modelos GLM, supera el millón de usuarios. Como agradecimiento, la empresa reinicia los límites de uso de todos los suscriptores del GLM Coding Plan y despliega una actualización destinada a transformar mejor las capacidades de razonamiento de largo horizonte en trabajo efectivamente terminado, con una tasa de éxito de caché del 98 %, ofreciendo aproximadamente 1,8 veces más uso para los suscriptores.
La app de escritorio de ChatGPT disponible en preversión en Linux, con Codex
OpenAI amplía su aplicación de escritorio a Linux, hasta ahora reservada a macOS y Windows. La preversión cubre cuatro distribuciones principales — Ubuntu 24.04/26.04 LTS, Debian 13 y Fedora 43/44 — con paquetes .deb/.rpm en x64 y ARM64. La app reúne ChatGPT, ChatGPT Work y Codex en una misma interfaz nativa, con acceso a proyectos y flujos de trabajo de navegador compatibles, sin cambiar de entorno de trabajo.
Codex y ChatGPT Work importan el trabajo de otros agentes de IA
Nueva funcionalidad para ChatGPT Work y Codex: mantener el trabajo existente, realizado con otros agentes de IA, sincronizado con el ecosistema de OpenAI. Concretamente, los usuarios pueden importar proyectos, conversaciones, skills y plugins, consultar un historial de importación y activar una sincronización automática en los ajustes. Disponible desde ahora en la aplicación de escritorio ChatGPT, para reducir la fricción del cambio de herramienta en lugar de empezar de cero con una configuración completamente nueva.
Breves
- Bug de facturación de Fable resuelto, 196 reembolsos — Anthropic confirma la resolución completa de un bug de caché de configuración que mostraba erróneamente excesos; 196 usuarios reembolsados y acreditados como compensación. 🔗 Tweet
- v0 (Vercel) rediseña su barra lateral — conversaciones agrupadas por proyecto, indicadores de estado en tiempo real, tarjetas de vista previa al pasar el cursor. 🔗 Tweet
- Amp aumenta el tamaño de disco de los orbs a 60 GB — frente a 40 GB antes, sin sobrecoste para los nuevos orbs. 🔗 Tweet
- DeepSeek V4 Flash 0731 disponible para fine-tuning en Together AI — especialización mediante SFT o DPO y luego despliegue en producción. 🔗 Tweet
- Together AI detalla una segunda parte sobre el autoscaling de su inferencia dedicada — tres políticas probadas bajo la misma carga; solo una se adaptó realmente. 🔗 Tweet
- Hugging Face lanza la Open Model Series — nueva serie de vídeo pedagógica sobre modelos abiertos y su uso local. 🔗 Tweet
- FC Barcelona se une a la साझnership Google Pixel / Gemini — nuevos socios oficiales del club, tras una asociación similar con el Bayern Munich. 🔗 Tweet
- Informe de uso de Copilot: detalle de los tokens por modelo — tokens de entrada, salida y caché ahora visibles detrás de los créditos de IA consumidos. 🔗 Changelog
- GitHub destaca el agente Rubber Duck de Copilot — en un artículo de carrera sobre las habilidades de los desarrolladores junior; el agente usa un segundo modelo para criticar el código generado. 🔗 Tweet
- Perplexity Computer: GitHub, conector más utilizado — mayoritariamente por no desarrolladores (4 de cada 5). 🔗 Tweet
- Suno Studio 2.0 (teaser) — nueva versión del entorno de producción musical de Suno, sin más detalles. 🔗 Tweet
- ElevenLabs Summit en Nueva York el 11 de noviembre — jornada de conferencias que reúne a líderes tecnológicos y empresariales; candidaturas abiertas. 🔗 Tweet
- FLUX 3 Video confirma el puesto n.º 2 mundial — Black Forest Labs prolonga el acceso gratuito al playground hasta el 16 de agosto y adelanta 4K y edición de vídeo. 🔗 Tweet
- Seedance 2.5 en Runway añade 50 referencias de personajes — y clips sincronizados con una pista musical. 🔗 Tweet
- P-Image-Ideogram disponible en Runway — genera una imagen en tan solo 0,6 segundos, con cuatro modos de calidad. 🔗 Tweet
- Kimi K3 disponible en Databricks — nuevo canal de distribución para el modelo de Moonshot AI. 🔗 Tweet
- Zapier transforma su marketing con ChatGPT Work — reducción de abandonos en el embudo de leads, reporting automatizado. 🔗 OpenAI
- Virgin Atlantic optimiza sus recorridos de cliente con ChatGPT Work — búsqueda y planificación de producto aceleradas. 🔗 OpenAI
- Cohere — Aidan Gomez detalla la estrategia open source y soberana — modelos personalizables, asequibles y seguros como hilo conductor. 🔗 Tweet
Lo que significa
La escala de uso de la IA de consumo cambia de registro: con mil millones de usuarios mensuales, Gemini entra en el círculo muy reducido de los productos de Google más masivos, impulsado por usos que van mucho más allá del chat de texto (voz, cámara, automatización). En paralelo, OpenAI extiende sus anuncios de ChatGPT a cinco nuevos mercados, una señal de que la monetización a gran escala de los asistentes conversacionales se está convirtiendo en una prioridad estratégica una vez que la base de usuarios es lo suficientemente amplia y fiel.
En cuanto a la infraestructura, la jornada ilustra un giro hacia la ejecución agentica especializada más que hacia el mero razonamiento frontera. NVIDIA propone con Nemotron 3.5 Lightning y NeMo Switchyard un modelo económico explícito: reservar los modelos costosos para la planificación compleja y delegar la ejecución de alto volumen a modelos más ligeros y baratos, con ahorros medidos en varios socios. IBM Research (ALTK-Evolve) y Together AI (autoscaling, asociación con IBM Cloud) profundizan en la misma línea económica de la inferencia, mientras que Mistral estructura su propio esfuerzo de soberanía con las European Compute Units y la inferencia regional.
La apertura de pesos sigue extendiéndose a nuevos actores y nuevas modalidades: Wan-Animate-2 de Alibaba, TwiL-LM3 de webAI, Qwen3.8-27B en camino, la promesa de Meta sobre Muse Spark 1.2 e incluso un primer modelo frontera coreano (Motif 3) construido sobre la pila técnica de NVIDIA. Esta diversificación geográfica y modal — texto, animación, razonamiento integrado — confirma que el open source ya no es patrimonio exclusivo de un pequeño número de laboratorios occidentales.
Por último, la herramienta agentica para desarrolladores sigue profesionalizándose: Amp y Replit añaden capas de gestión (plugins globales, MCP ampliado), GitHub refuerza su oferta de modelos de bajo coste y OpenAI construye puentes explícitos entre ecosistemas competidores al permitir que Codex y ChatGPT Work importen el trabajo realizado en otros sitios, una apuesta por la portabilidad más que por el encierro, en un momento en que los desarrolladores hacen malabares con varios agentes de IA en paralelo.
Fuentes
- Gemini — mil millones de usuarios
- Gemini — anuncio en X
- NVIDIA — Nemotron 3.5 Lightning y NeMo Switchyard
- Alibaba Wan — Wan-Animate-2
- NVIDIA — cifras Local AI (Wan-Animate-2)
- Mistral — inferencia regional, GLM-5.2, coalición de cálculo
- OpenAI — anuncios de ChatGPT
- webAI — TwiL-LM3
- Meta — Muse Spark 1.2 (Alexandr Wang)
- Zuckerberg — filosofía de IA de Meta
- IBM Research — ALTK-Evolve
- Together AI, IBM, NVIDIA — inferencia IBM Cloud
- Amp — plugins y skills globales
- Replit — MCP beta
- GitHub — MAI-Code-1.1-Flash
- Manus — empresa independiente
- Alibaba Wan — Wan CLI
- Motif Technologies — Motif 3
- Luma AI — Luma Scenes
- Ideogram — Ad Resizer
- HeyGen — for Real Estate
- NVIDIA — arquitectura 800 VDC
- Alibaba Qwen — Qwen3.8-27B
- Z.ai — ZCode 1 millón de usuarios
- OpenAI — ChatGPT desktop app Linux
- OpenAI — importación de agentes en Codex/ChatGPT Work
- Anthropic — bug de facturación de Fable resuelto
- v0 — rediseño de la barra lateral
- Amp — orbs a 60 GB
- Together AI — DeepSeek V4 Flash 0731 fine-tuning
- Together AI — autoscaling inferencia dedicada
- Hugging Face — Open Model Series
- FC Barcelona — asociación Google Pixel / Gemini
- GitHub — informe de uso de Copilot por modelo
- GitHub — agente Rubber Duck
- Perplexity Computer — conector GitHub
- Suno — Suno Studio 2.0
- ElevenLabs — Summit New York
- Black Forest Labs — FLUX 3 Video
- Runway — Seedance 2.5
- Runway — P-Image-Ideogram
- Kimi Moonshot — K3 en Databricks
- OpenAI — Zapier
- OpenAI — Virgin Atlantic
- Cohere — estrategia open source y soberana