Buscar

Gemini supera la barrera de los mil millones en usuarios activos, NVIDIA lanza Nemotron 3.5 Lightning, Mistral reúne una coalición de cómputo europea

Artículo generado por inteligencia artificial
Gemini supera la barrera de los mil millones en usuarios activos, NVIDIA lanza Nemotron 3.5 Lightning, Mistral reúne una coalición de cómputo europea

ai-powered-markdown-translator

Artículo traducido del fr al es con gpt-5.4-mini.

Ver proyecto en GitHub ↗

El 11 de agosto de 2026, la aplicación Gemini supera los mil millones de usuarios mensuales, convirtiéndose en el producto de crecimiento más rápido de la historia de Google. NVIDIA publica Nemotron 3.5 Lightning y su biblioteca de enrutamiento NeMo Switchyard, Mistral abre su plataforma a modelos de terceros y reúne una coalición de cómputo europea, y Alibaba presenta Wan-Animate-2, una importante actualización de su modelo de animación open source. También en el menú: anuncios de ChatGPT ampliados a cinco nuevos mercados, nuevas herramientas para desarrolladores y una larga lista de anuncios en generación de medios.


Gemini supera los mil millones de usuarios mensuales

La aplicación Gemini ha superado oficialmente los mil millones de usuarios mensuales activos, convirtiéndose, según Google, en el producto de crecimiento más rápido de toda la historia de la empresa. El anuncio fue difundido tanto por la cuenta oficial @GeminiApp como por Josh Woodward, que dirige los equipos de Gemini y Labs en Google.

Google acompaña el anuncio con un balance cuantificado sobre los usos que han impulsado este crecimiento:

Uso medidoDato
Interacciones de vozEl 63 % de los usuarios utiliza la voz
Sesiones Gemini Live1 de cada 5 usa la cámara en vivo o el uso compartido de pantalla
Solicitudes escolaresEl 38 % incluye un archivo adjunto (fichero)
Generación de imágenesMás de 150 millones de imágenes producidas cada día
Automatización AndroidAcciones automatizadas en más de 40 aplicaciones
Usuarios iOSMás de 100 millones de usuarios activos en dispositivos Apple

Estas cifras ilustran una diversificación de los usos más allá del simple chat de texto: voz, cámara, uso compartido de pantalla, generación multimedia y automatización entre aplicaciones (reserva de restaurante, pedido de VTC) aparecen como motores importantes de la adopción.

🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.

🇪🇸 🚀 ¡Mil millones para Gemini! Nuestro objetivo sigue siendo convertirlo en el asistente más personal, proactivo y potente.@GeminiApp en X

🔗 Anuncio oficial en el blog de Google


NVIDIA lanza Nemotron 3.5 Lightning y NeMo Switchyard para agentes de gran volumen

NVIDIA amplía su familia de modelos abiertos Nemotron 3 con Nemotron 3.5 Lightning, un MoE híbrido de 30 mil millones de parámetros (3 mil millones activos) diseñado para la ejecución de tareas agenticas de gran volumen — llamada de herramientas, validación de resultados, delegación de tareas — en lugar del razonamiento complejo. Disponible en NVFP4 y BF16 con un contexto de hasta 1 millón de tokens, el modelo reivindica hasta 4 veces el rendimiento de salida de modelos comparables y un 30 % de ganancia de tiempo en la finalización de tareas. En PinchBench, alcanza un 86 % de precisión al completar 10 000 tareas un 35 % más rápido que Qwen3.6 35B con precisión equivalente.

El modelo se distribuye con pesos, datos de entrenamiento y recetas, y está disponible en Hugging Face, ModelScope, OpenRouter y build.nvidia.com. Together AI es socio de lanzamiento desde el primer día (day-0), con capacidad reservada mediante su oferta Dedicated Model Inference para cargas de trabajo agenticas de gran volumen.

En paralelo, NVIDIA publica NeMo Switchyard, una biblioteca open source que enruta cada solicitud al modelo más adecuado (calidad, latencia, coste) sin reescribir la aplicación — reservando los modelos frontera para el razonamiento complejo y Lightning para la ejecución especializada. NVIDIA afirma un coste de finalización de tareas reducido a casi un tercio del de Opus 4.8 por sí solo. Se citan socios concretos: Boomi enruta el 59 % de su tráfico a un modelo fine-tuned más rápido, Cognition reduce su coste medio en un 28 %, y Ramp combina modelo y enrutamiento para un 59 % de coste y un 32 % menos de tiempo de ejecución.

🔗 Entrada oficial de NVIDIA · Anuncio del modelo en X


Alibaba presenta Wan-Animate-2, una importante actualización de su animación de personajes open source

Alibaba (equipo Wan) publica Wan-Animate-2, descrito como una importante actualización de su modelo open source de animación de personajes. Se destacan cuatro capacidades: una animación de alta fidelidad que reproduce movimientos y microexpresiones a través de humanos, dibujos animados, robots y animales; la animación multi-personaje, en la que cada personaje conserva su propia identidad y movimiento dentro de una misma escena; un control de cámara pilotado por texto (por ejemplo, «vista desde arriba»), desacoplado del vídeo fuente; y una generación en streaming en tiempo real, produciendo secuencias de longitud arbitraria chunk por chunk sin acumulación observable de error.

En el plano técnico, Alibaba abandona los esqueletos de pose explícitos en favor del propio vídeo de referencia como priori de movimiento, con una arquitectura Dual-Branch DiT (Diffusion Transformer), un codificado temporal Time-Align RoPE y una atención dispersa (Sparse-Ref Attention) para limitar el cálculo sin pérdida de calidad. El control de cámara se apoya en una LoRA entrenada sobre unos 50 000 ejemplos multi-vista de Unreal Engine.

El modelo es open source, disponible desde ahora en ModelScope, Hugging Face y GitHub, con demo en línea. Según la campaña «Local AI» de agosto de NVIDIA, sus 14 mil millones de parámetros generan entre 16 y 26 veces más rápido en sistemas RTX que las alternativas, confirmando su optimización para un despliegue local en hardware de consumo.

🔗 Detalles técnicos y cifras de NVIDIA · Anuncio en X


Mistral lanza la inferencia regional, abre su plataforma a GLM-5.2 y reúne una coalición de cómputo europea

Mistral se posiciona como el único laboratorio de IA europeo que combina selección regional de inferencia y garantías de servicio. La empresa, ya inmersa en una carrera tarifaria y técnica frente a OpenAI, Google y los actores chinos, apuesta aquí por un posicionamiento distinto: la soberanía y la previsibilidad del servicio, en lugar de la simple carrera por los benchmarks. Dos novedades en la plataforma:

FuncionalidadEstadoDescripción
Mistral Regional EndpointsDisponibleElección de Europa o Estados Unidos para la ejecución de la inferencia
Mistral Priority TierVista públicaSLA de disponibilidad y límites de caudal personalizados

Otro aspecto notable: la plataforma Mistral se abre a modelos de terceros, empezando por GLM-5.2 de Z.ai, que se beneficiará de los mismos controles regionales y compromisos de servicio que los modelos Mistral — una primera convergencia entre ambos actores, hasta ahora competidores directos en el segmento de modelos abiertos asequibles.

Por último, Mistral lanza las European Compute Units (ECU), un mecanismo que convierte compromisos plurianuales de empresas en acceso a su infraestructura de cómputo, con el objetivo de 1 GW de capacidad para 2030 — el equivalente a la potencia consumida por una gran ciudad. Los socios fundadores anunciados son ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman y CEO), Amadeus (Luis Maroto, CEO) y Caisse des Dépôts (Olivier Sichel, CEO) — una mezcla de industriales, transporte y finanzas públicas que ilustra la ambición de construir una cadena de cómputo europea independiente de los hyperscalers estadounidenses.

🔗 Anuncio oficial de Mistral


OpenAI lanza los anuncios de ChatGPT en Reino Unido, México, Brasil, Japón y Corea del Sur

OpenAI da un nuevo paso en el despliegue de la publicidad dentro de ChatGPT. Lanzado en pruebas en Estados Unidos en febrero de 2026 para las ofertas Free y Go, y luego ampliado a Canadá, Australia y Nueva Zelanda en marzo, el programa publicitario se lanza ahora oficialmente en cinco nuevos mercados: Reino Unido, México, Brasil, Japón y Corea del Sur. Las ofertas Plus, Pro, Business, Enterprise y Education siguen sin publicidad, y se prevén otros mercados antes de final de año.

El principio sigue siendo el mismo: los anuncios nunca influyen en las respuestas de ChatGPT, permanecen claramente etiquetados como patrocinados y visualmente separados de la respuesta orgánica. La segmentación se basa en el tema de la conversación en curso y en el historial de interacciones publicitarias pasadas, sin dar nunca a los anunciantes acceso a las conversaciones ni a los datos personales — solo reciben estadísticas agregadas (vistas, clics).

En cuanto al control del usuario, ChatGPT permite ocultar un anuncio, consultar por qué se mostró, eliminar sus datos publicitarios con un solo gesto y gestionar la personalización en cualquier momento. No se muestra publicidad a cuentas de menores identificados o presuntos, ni cerca de temas sensibles (salud, salud mental, política). Según OpenAI, el piloto no mostró ningún impacto medido en la confianza de los usuarios, lo que ha motivado esta ampliación progresiva.

🔗 Anuncio oficial de OpenAI


Ecosistema open source e inferencia

webAI Intelligence Lab publica TwiL-LM3, modelo de razonamiento 3B que supera a GPT-OSS-120B

El laboratorio webAI Intelligence Lab (Austin) publica TwiL-LM3, su primer modelo de razonamiento formal en open source. Con solo 3 mil millones de parámetros, afirma superar a GPT-OSS-120B de OpenAI en 4 de los 5 benchmarks de razonamiento formal probados — es decir, unos 40 veces menos parámetros para una inferencia 2,6 veces más rápida. Entrenado sobre datos verificados y propietarios en lugar de contenido web recopilado automáticamente, el modelo apunta a la informática en el borde (edge): se anuncia capaz de funcionar desde un Raspberry Pi hasta un iPhone, sin depender de la nube.

🔗 Tuit oficial

Meta prepara una versión con pesos abiertos de Muse Spark 1.2

En el hilo que anuncia Muse Glimmer, Alexandr Wang (Meta Superintelligence Labs) indica que Meta publicará próximamente una versión con pesos abiertos de Muse Spark 1.2 — hasta ahora el modelo propietario que impulsa al agente de código en terminal Muse Code. No se da ninguna fecha precisa, pero el anuncio confirma un giro de Meta hacia más pesos abiertos en toda su gama Muse, en la continuidad de la apertura inmediata de los pesos de Muse Glimmer bajo licencia Apache 2.0.

🔗 Tuit oficial

Zuckerberg publica un texto sobre la filosofía de IA de Meta

El mismo día, Mark Zuckerberg publica un texto afirmando que «todo el mundo debería tener acceso a la superinteligencia», detallando la filosofía y los valores de Meta para construir un futuro positivo de la IA. El mensaje acompaña el lanzamiento de Muse Glimmer, posicionando la apertura de los pesos como una decisión de fondo más que como un simple argumento de marketing, y se inscribe en una comunicación más amplia de Meta sobre su estrategia de pesos abiertos esa misma semana.

🔗 Tuit oficial

Lightricks presenta LTX-2.5, una actualización importante de su world model abierto

Lightricks publica LTX-2.5, nueva versión de su «world model» ya utilizado para cine, robótica y flujos de trabajo en tiempo real. La actualización promete una fidelidad de píxel superior, escenas multi-plano que se mantienen coherentes de un corte a otro, y una base preentrenada pensada para ser afinada (fine-tuned) según distintos dominios, mediante un nuevo renderizado llamado Diffusion Fidelity Rendering. El equipo presenta LTX-2.5 como una fundación abierta más que como una herramienta alquilada.

🔗 Tuit oficial

IBM Research publica ALTK-Evolve, una memoria agentica menos exigente en tokens que ACE

IBM Research publica ALTK-Evolve, un sistema que permite a los agentes de IA aprender de sus fracasos pasados sin reentrenamiento, calibrando la cantidad de instrucciones reinyectadas según la capacidad del modelo utilizado — a diferencia de ACE (Agentic Context Engineering), que entrega todo su «playbook» en cada etapa. En el benchmark AppWorld con DeepSeek-V3.2, ALTK-Evolve alcanza un 89,3 % de tareas completadas por 263K tokens por tarea, frente a un 80,4 % y 634K tokens para ACE. Con gpt-oss-120b, obtiene una precisión igual o mejor por alrededor del 40 % del coste de inferencia de ACE.

🔗 Entrada de Hugging Face

Together AI, IBM y NVIDIA se asocian para la inferencia empresarial en IBM Cloud

Together AI anuncia una colaboración con IBM y NVIDIA para llevar inferencia de IA de nivel empresarial a IBM Cloud, mediante un clúster dedicado de GPU NVIDIA B300 con red Spectrum-X — una primicia en esta plataforma, impulsada por la plataforma de inferencia de producción de Together AI. La oferta apunta a las empresas ya clientes de IBM Cloud que desean desplegar cargas de trabajo de IA sin migrar a otro proveedor cloud.

🔗 Tuit oficial


Herramientas para desarrolladores: Amp, Replit, GitHub Copilot y Manus

Amp lanza los plugins y skills globales para los orbs

Amp (Sourcegraph) introduce un sistema centralizado de plugins y skills alojados por Amp, disponible en cualquier lugar donde funcione Amp, especialmente en los orbs. Coexisten dos niveles: un nivel personal, sandbox experimental con recarga en caliente (live reloading) en el mismo hilo de conversación, y un nivel espacio de trabajo, gestionado por los administradores y cargado por defecto para todo el equipo. Los elementos personales pueden compartirse con el espacio de trabajo, y el versionado se gestiona de forma nativa (actualización a la última versión, detección de skills obsoletos).

🔗 Global Plugins and Skills

Replit MCP beta: crear, cargar, buscar y publicar una app vía MCP

Replit refuerza su beta MCP (Model Context Protocol) con nuevas capacidades: crear, cargar, buscar y publicar una aplicación directamente vía MCP, sin pasar por la interfaz web. El objetivo declarado es permitir construir software real en Replit desde cualquier cliente MCP compatible — editor, agente autónomo u herramienta de terceros — en lugar de quedar limitado a la interfaz de Replit en sí. Esta ampliación confirma la estrategia de Replit de exponer su plataforma como una pieza programable para los flujos de trabajo agenticos.

🔗 Tuit oficial

MAI-Code-1.1-Flash llega a GitHub Copilot, MAI-Code-1-Flash queda obsoleto

El último modelo de código compacto de Microsoft, MAI-Code-1.1-Flash, se despliega en GitHub Copilot con soporte nativo de visión y mejoras en calidad de código, seguimiento de instrucciones y uso de herramientas. Cuesta un 73 % menos que MAI-Code-1-Flash, con un multiplicador de solicitud premium de 0,25× para los suscriptores anuales. Seleccionado automáticamente en Free y Student, disponible para selección manual en Pro, Pro+, Max, Business y Enterprise. En paralelo, GitHub anuncia la descontinuación de MAI-Code-1-Flash el 10 de septiembre de 2026.

🔗 Changelog de GitHub

Manus volverá a ser una empresa independiente

Manus anuncia que vuelve a ser una empresa independiente. Para cumplir con los requisitos regulatorios de ciertas jurisdicciones, una parte de los usuarios deberá guardar sus datos antes del 23 de agosto de 2026 (7:59, hora de Singapur) y luego iniciar una restauración a partir del 25 de agosto de 2026 (8:00, hora de Singapur). Los usuarios afectados serán avisados por correo electrónico y notificación in-app; no se prevé facturación durante la transición, con bonificaciones de bienvenida incluidas.

🔗 Tweet oficial


Generación de medios: Wan CLI, Motif 3, Luma Scenes y alimentación de 800 VDC

Wan CLI: Alibaba permite controlar Wan directamente desde los agentes

Alibaba publica Wan CLI, una nueva herramienta de línea de comandos que permite llamar a la plataforma Wan directamente desde agentes para generar imágenes y vídeos de forma programática. Los créditos consumidos siguen completamente sincronizados con la cuenta Wan Video del usuario, evitando una doble gestión de la facturación entre la interfaz web y el uso automatizado. La instalación se realiza recuperando un comando desde el panel de Wan y pegándolo en el agente, con un tutorial en vídeo proporcionado para empezar.

🔗 Tweet oficial

Motif 3: primer modelo frontera coreano entrenado en GPU NVIDIA B200

La startup coreana Motif Technologies lanza Motif 3 Base y Motif 3, sus primeros modelos orientados a la carrera de los LLM frontera, desarrollados con el apoyo del Ministerio coreano de Ciencia y entrenados en GPU NVIDIA B200. Motif 3 está construido sobre Motif 3 Base mediante posentrenamiento usando NVIDIA NeMo-RL. En colaboración con NVIDIA, el equipo también publica una versión NVFP4 (precisión reducida optimizada por NVIDIA). El conjunto estará disponible en Hugging Face con un informe técnico, y NVIDIA ha elogiado este lanzamiento como un ejemplo del dinamismo del ecosistema de IA coreano.

🔗 Tweet oficial

Luma Scenes: producción de vídeo por escenas, impulsada por Uni-1

Luma AI lanza Luma Scenes, una herramienta que permite afinar, temporizar y validar cada escena individualmente antes del render final, respondiendo al problema clásico de producir muchas variantes para quedarse solo con una utilizable, con el riesgo de que una escena fallida comprometa toda una producción. La herramienta amplía Luma Layers (edición por capas, a finales de julio), confirmando la orientación de Luma hacia el control granular más que hacia la generación con un solo clic, con un flujo de trabajo más cercano al montaje tradicional.

🔗 Tweet oficial

Ideogram Ad Resizer: un diseño, todos los formatos publicitarios

Ideogram lanza Ad Resizer: a partir de un diseño único y de los emplazamientos publicitarios objetivo, la herramienta genera automáticamente un conjunto completo de formatos listos para campaña (Instagram, Facebook, YouTube, televisión conectada, display, impresión), incluidos ratios extremos difíciles de recortar manualmente. Disponible de inmediato en la aplicación y vía API, para integrarse en pipelines automatizados de producción publicitaria: un caso de uso de marketing concreto para equipos creativos multicanal.

🔗 Tweet oficial

HeyGen for Real Estate: lanzamiento oficial con tres formatos de vídeo para agentes inmobiliarios

HeyGen lanza oficialmente HeyGen for Real Estate, con tres formatos de vídeo pensados para agentes inmobiliarios que aparecen ellos mismos en pantalla sin cámara ni edición: el objetivo es permitirles publicar varias veces al día sin sacrificar la presencia visual que exige este sector. Oferta de incentivo: los inscritos al plan Creator en las 12 horas siguientes al anuncio reciben acceso White Glove gratuito durante 30 días (solo Estados Unidos). HeyGen menciona una posible expansión a otras pequeñas empresas más allá del sector inmobiliario.

🔗 Tweet oficial

NVIDIA detalla la arquitectura de alimentación 800 VDC de las futuras «AI factories»

NVIDIA, junto con Google y Microsoft, detalla a través de Open Compute Project una arquitectura de alimentación en corriente continua de 800 voltios, que reduce los pasos de conversión eléctrica entre la red y las GPU para sostener la densidad de cálculo de las futuras generaciones de aceleradores. Más de 80 fabricantes ya están trabajando en productos conformes. Despliegue en varias etapas: arquitectura híbrida «Power Rack» desde el segundo semestre de 2026, «Row Power Center» en 2027 y luego instalaciones nativas 800 VDC en la próxima década.

🔗 Publicación oficial de NVIDIA


Qwen, Z.ai y OpenAI: nuevos modelos y sincronización de agentes

Qwen3.8-27B: pesos abiertos anunciados para esta semana

Alibaba Qwen confirma que los pesos abiertos de Qwen3.8-27B se publicarán esta semana, una nueva talla dentro de la familia Qwen3.8 tras el modelo insignia Qwen3.8-Max ya cubierto a principios de agosto. El equipo presenta este nuevo modelo como superior a Qwen3.6-27B en codificación agentica, un rendimiento ya muy bien recibido por la comunidad de desarrolladores que esperaba esta talla intermedia desde hace varias semanas.

🔗 Tweet oficial

Z.ai: ZCode alcanza 1 millón de usuarios, reinicio de los límites del GLM Coding Plan

Z.ai anuncia que ZCode, su herramienta de codificación basada en los modelos GLM, supera el millón de usuarios. Como agradecimiento, la empresa reinicia los límites de uso de todos los suscriptores del GLM Coding Plan y despliega una actualización destinada a transformar mejor las capacidades de razonamiento de largo horizonte en trabajo efectivamente terminado, con una tasa de éxito de caché del 98 %, ofreciendo aproximadamente 1,8 veces más uso para los suscriptores.

🔗 Tweet oficial

La app de escritorio de ChatGPT disponible en preversión en Linux, con Codex

OpenAI amplía su aplicación de escritorio a Linux, hasta ahora reservada a macOS y Windows. La preversión cubre cuatro distribuciones principales — Ubuntu 24.04/26.04 LTS, Debian 13 y Fedora 43/44 — con paquetes .deb/.rpm en x64 y ARM64. La app reúne ChatGPT, ChatGPT Work y Codex en una misma interfaz nativa, con acceso a proyectos y flujos de trabajo de navegador compatibles, sin cambiar de entorno de trabajo.

🔗 Tweet oficial

Codex y ChatGPT Work importan el trabajo de otros agentes de IA

Nueva funcionalidad para ChatGPT Work y Codex: mantener el trabajo existente, realizado con otros agentes de IA, sincronizado con el ecosistema de OpenAI. Concretamente, los usuarios pueden importar proyectos, conversaciones, skills y plugins, consultar un historial de importación y activar una sincronización automática en los ajustes. Disponible desde ahora en la aplicación de escritorio ChatGPT, para reducir la fricción del cambio de herramienta en lugar de empezar de cero con una configuración completamente nueva.

🔗 Tweet oficial


Breves

  • Bug de facturación de Fable resuelto, 196 reembolsos — Anthropic confirma la resolución completa de un bug de caché de configuración que mostraba erróneamente excesos; 196 usuarios reembolsados y acreditados como compensación. 🔗 Tweet
  • v0 (Vercel) rediseña su barra lateral — conversaciones agrupadas por proyecto, indicadores de estado en tiempo real, tarjetas de vista previa al pasar el cursor. 🔗 Tweet
  • Amp aumenta el tamaño de disco de los orbs a 60 GB — frente a 40 GB antes, sin sobrecoste para los nuevos orbs. 🔗 Tweet
  • DeepSeek V4 Flash 0731 disponible para fine-tuning en Together AI — especialización mediante SFT o DPO y luego despliegue en producción. 🔗 Tweet
  • Together AI detalla una segunda parte sobre el autoscaling de su inferencia dedicada — tres políticas probadas bajo la misma carga; solo una se adaptó realmente. 🔗 Tweet
  • Hugging Face lanza la Open Model Series — nueva serie de vídeo pedagógica sobre modelos abiertos y su uso local. 🔗 Tweet
  • FC Barcelona se une a la साझnership Google Pixel / Gemini — nuevos socios oficiales del club, tras una asociación similar con el Bayern Munich. 🔗 Tweet
  • Informe de uso de Copilot: detalle de los tokens por modelo — tokens de entrada, salida y caché ahora visibles detrás de los créditos de IA consumidos. 🔗 Changelog
  • GitHub destaca el agente Rubber Duck de Copilot — en un artículo de carrera sobre las habilidades de los desarrolladores junior; el agente usa un segundo modelo para criticar el código generado. 🔗 Tweet
  • Perplexity Computer: GitHub, conector más utilizado — mayoritariamente por no desarrolladores (4 de cada 5). 🔗 Tweet
  • Suno Studio 2.0 (teaser) — nueva versión del entorno de producción musical de Suno, sin más detalles. 🔗 Tweet
  • ElevenLabs Summit en Nueva York el 11 de noviembre — jornada de conferencias que reúne a líderes tecnológicos y empresariales; candidaturas abiertas. 🔗 Tweet
  • FLUX 3 Video confirma el puesto n.º 2 mundial — Black Forest Labs prolonga el acceso gratuito al playground hasta el 16 de agosto y adelanta 4K y edición de vídeo. 🔗 Tweet
  • Seedance 2.5 en Runway añade 50 referencias de personajes — y clips sincronizados con una pista musical. 🔗 Tweet
  • P-Image-Ideogram disponible en Runway — genera una imagen en tan solo 0,6 segundos, con cuatro modos de calidad. 🔗 Tweet
  • Kimi K3 disponible en Databricks — nuevo canal de distribución para el modelo de Moonshot AI. 🔗 Tweet
  • Zapier transforma su marketing con ChatGPT Work — reducción de abandonos en el embudo de leads, reporting automatizado. 🔗 OpenAI
  • Virgin Atlantic optimiza sus recorridos de cliente con ChatGPT Work — búsqueda y planificación de producto aceleradas. 🔗 OpenAI
  • Cohere — Aidan Gomez detalla la estrategia open source y soberana — modelos personalizables, asequibles y seguros como hilo conductor. 🔗 Tweet

Lo que significa

La escala de uso de la IA de consumo cambia de registro: con mil millones de usuarios mensuales, Gemini entra en el círculo muy reducido de los productos de Google más masivos, impulsado por usos que van mucho más allá del chat de texto (voz, cámara, automatización). En paralelo, OpenAI extiende sus anuncios de ChatGPT a cinco nuevos mercados, una señal de que la monetización a gran escala de los asistentes conversacionales se está convirtiendo en una prioridad estratégica una vez que la base de usuarios es lo suficientemente amplia y fiel.

En cuanto a la infraestructura, la jornada ilustra un giro hacia la ejecución agentica especializada más que hacia el mero razonamiento frontera. NVIDIA propone con Nemotron 3.5 Lightning y NeMo Switchyard un modelo económico explícito: reservar los modelos costosos para la planificación compleja y delegar la ejecución de alto volumen a modelos más ligeros y baratos, con ahorros medidos en varios socios. IBM Research (ALTK-Evolve) y Together AI (autoscaling, asociación con IBM Cloud) profundizan en la misma línea económica de la inferencia, mientras que Mistral estructura su propio esfuerzo de soberanía con las European Compute Units y la inferencia regional.

La apertura de pesos sigue extendiéndose a nuevos actores y nuevas modalidades: Wan-Animate-2 de Alibaba, TwiL-LM3 de webAI, Qwen3.8-27B en camino, la promesa de Meta sobre Muse Spark 1.2 e incluso un primer modelo frontera coreano (Motif 3) construido sobre la pila técnica de NVIDIA. Esta diversificación geográfica y modal — texto, animación, razonamiento integrado — confirma que el open source ya no es patrimonio exclusivo de un pequeño número de laboratorios occidentales.

Por último, la herramienta agentica para desarrolladores sigue profesionalizándose: Amp y Replit añaden capas de gestión (plugins globales, MCP ampliado), GitHub refuerza su oferta de modelos de bajo coste y OpenAI construye puentes explícitos entre ecosistemas competidores al permitir que Codex y ChatGPT Work importen el trabajo realizado en otros sitios, una apuesta por la portabilidad más que por el encierro, en un momento en que los desarrolladores hacen malabares con varios agentes de IA en paralelo.


Fuentes