Buscar

MiniMax lanza H3 con pesos abiertos anunciados, Together AI reclama un crecimiento de tokens multiplicado por 10000, GitHub bloquea los tokens npm en riesgo

Artículo generado por inteligencia artificial
MiniMax lanza H3 con pesos abiertos anunciados, Together AI reclama un crecimiento de tokens multiplicado por 10000, GitHub bloquea los tokens npm en riesgo

ai-powered-markdown-translator

Artículo traducido del fr al es con gpt-5.4-mini.

Ver proyecto en GitHub ↗

MiniMax lanza H3, un modelo multimodal generalista con sonido estéreo nativo y pesos abiertos anunciados «en los próximos días». Together AI reivindica un crecimiento espectacular de su volumen de tokens servidos, mientras que GitHub endurece la seguridad de los tokens npm después de una oleada de ataques por toma de control de cuentas. En torno a estos tres temas, la jornada es especialmente densa en generación de imágenes y vídeo (Runway, Wan Video, Luma, Black Forest Labs, Ideogram), herramientas para agentes de código (Devin, Replit, GitHub Actions) y transición de modelos en OpenAI y Google.


MiniMax H3 : un modèle multimodal généraliste, poids ouverts annoncés

31 de julio — MiniMax lanza H3, descrito como un modelo de generación multimodal generalista. A diferencia de las generaciones anteriores (Hailuo 01 y 02), que separaban las tareas por modelo especializado, H3 unifica esas capacidades en un solo modelo capaz de comprender un contexto que mezcla texto, imagen, vídeo y audio. Su característica más destacada es el sonido estéreo nativo generado junto con el vídeo, en secuencias de hasta 15 segundos en resolución 2K.

MiniMax pone en primer plano un posicionamiento precio-rendimiento agresivo: en 2K, el precio por segundo sería inferior a un tercio del de los modelos «mainstream», y en 768p, inferior a la mitad del precio del 720p de esos mismos modelos. H3 se apoya en varias piezas propietarias (Contextual Omni Representation, H3-VAE, H3-Omni Transformer, In-Context Regeneration) y gestiona la edición de forma generalizada: imagen a imagen, imagen a vídeo, audio a audio, transferencia de movimiento vídeo a vídeo, con un renderizado preciso del texto y de los elementos de marca, un punto a menudo débil en los modelos de generación de vídeo.

MiniMax también anuncia la próxima apertura de los pesos del modelo, presentada como una forma de acelerar la compatibilidad hardware y de apoyar a la comunidad open source en un sector históricamente dominado por modelos cerrados. El lanzamiento se acompaña de un despliegue day-0 en una quincena de socios, entre ellos Runway, Pika, Leonardo.Ai, OpenRouter y Krea.

CaracterísticaDetalle
Resolución2K por defecto
Duración máxima15 segundos
AudioEstéreo nativo, generado conjuntamente
Precio en 2KMenos de un tercio del precio/segundo de los modelos mainstream
Precio en 768pMenos de la mitad del precio del 720p mainstream
Pesos abiertosAnunciados «en los próximos días»

MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities — Today, we’re launching MiniMax H3, a general-purpose multimodal generation model. H3 understands unified context across text, images, video, and audio, generating video with native stereo sound, up to 15 seconds at 2K resolution.

🇪🇸 MiniMax H3: un modelo abierto que borra las fronteras entre tareas y modalidades — Hoy lanzamos MiniMax H3, un modelo de generación multimodal generalista. H3 comprende un contexto unificado a través del texto, las imágenes, el vídeo y el audio, generando vídeos con sonido estéreo nativo, de hasta 15 segundos en resolución 2K.@MiniMax_AI en X

🔗 Hilo complementario — @MiniMax_AI en X


Grok Imagine Video 1.5 disponible en Runway

1 de agosto — Runway sigue ampliando su catálogo de modelos de terceros al integrar Grok Imagine Video 1.5, la versión en vídeo del modelo de generación de xAI, accesible directamente desde su plataforma. La integración se enmarca en la estrategia de Runway de agregar los modelos frontera de varios editores —ya había acogido MiniMax H3 la víspera— dentro de una misma plataforma de producción creativa, en lugar de apostar solo por sus propios modelos Gen.

🔗 Anuncio — @runwayml en X


Wan Video (Alibaba) lanza un modo Realtime para el boceto y el texto

31 de julio — Alibaba ha publicado, en la sección Labs de wan video, un modo Realtime que permite transformar un boceto en una escena fotorrealista a medida que se dibuja: figura estilizada, rectángulo aproximado, unos cuantos trazos, sin paso de generación explícito ni botón «generate». Ese mismo día, Alibaba presentó un segundo modo Realtime, esta vez para el texto: la imagen se retoca en directo a medida que el usuario escribe una descripción, frase a frase, sin pantalla de carga. Estas dos funciones acercan la experiencia de generación de imágenes a una interacción continua al estilo dibujo o procesador de texto, en lugar de un ciclo clásico de prompt/generación.

🔗 Anuncio — @Alibaba_Wan en X


Luma lanza Layers, edición de imágenes por capas impulsada por Uni-1

30 de julio — Luma ha desplegado Layers dentro de Luma Agents, impulsada por su modelo Uni-1. La idea: pedir al agente que extraiga las capas de una imagen existente (generada por Luma o importada por el usuario), y luego modificar un elemento concreto mediante simple conversación, preservando intacto el resto de la imagen —ya sea el producto destacado, el fondo o un texto. Luma ilustra la función con dos ejemplos: el rediseño completo de un cartel de rebranding a partir de un simple JPG plano, y la adición de un objeto aislado en una escena sin retocar la iluminación ni el decorado. El objetivo es permitir retoques precisos e iterativos, en lugar de regenerar una imagen entera para cambiar un solo detalle.

🔗 Anuncio — @LumaLabsAI en X


Black Forest Labs revela un adelanto de FLUX 3

30 de julio — Black Forest Labs (BFL), la editorial de los modelos FLUX, ha ofrecido un primer adelanto público de su próximo modelo, FLUX 3, a través de un acceso temporal de 48 horas en el agente Hermes de Nous Research. Este agente encadena varios planes generados para producir un cortometraje completo a partir de un único prompt de principio a fin. El anuncio va acompañado de un concurso de cortometrajes organizado por Nous Research durante toda la semana, y de una presentación presencial de FLUX 3 durante un evento de BFL en San Francisco el viernes siguiente. BFL no ha comunicado por ahora ni fecha de disponibilidad general ni detalles técnicos sobre las capacidades del modelo.

🔗 Anuncio — @bfl_ai en X


Ideogram lanza P-Image-Ideogram, familia de modelos Pareto-óptimos con Pruna AI

30 de julio — Ideogram ha lanzado, en colaboración con Pruna AI, una nueva familia de modelos de imagen bautizada P-Image-Ideogram, optimizada simultáneamente para calidad, velocidad y coste. El modelo ofrece cuatro modos de calidad (Very low, Low, Medium, High), generación nativa en 1K y 2K, y una tarifa de inicio de 0,003 dólar por imagen, con una latencia anunciada entre 3 y 8 segundos según el modo. En el ranking Design Arena (votos humanos en ciego), Ideogram reivindica una nueva frontera de Pareto preferencia/coste y preferencia/velocidad: en 1K, el modo más económico cuesta 0,3 ¢/imagen para una generación de unos 3 segundos, es decir, aproximadamente 8,6 veces más rápido que la media de los modelos evaluados. Despliegue inmediato en una quincena de plataformas asociadas, entre ellas ComfyUI, Runware, Replicate, Leonardo.Ai y Together AI.

Modo de calidadResoluciónPrecio en 1KLatencia aproximada
Very low1K/2K nativo0,3 ¢/imagen~3 s
Low1K/2K nativo0,75 ¢/imagen~3 s
Medium1K/2K nativono especificadohasta 8 s
High1K/2K nativono especificadohasta 8 s

🔗 Anuncio — @ideogram_ai en X


Devin lanza Outposts, ejecución nativa de aplicaciones en cualquier ordenador

31 de julio — Cognition, la editorial de Devin, ha anunciado una nueva funcionalidad bautizada Outposts. Permite al agente Devin ejecutar y probar de forma nativa aplicaciones directamente en cualquier ordenador, en lugar de depender únicamente de entornos cloud aislados. Esta capacidad se enmarca en la continuidad de los anuncios recientes de Cognition sobre la ejecución nativa —soporte iOS nativo mediante agentes cloud macOS, anunciado la víspera— y busca ampliar el perímetro de las tareas que Devin puede asumir de principio a fin, incluidas las configuraciones de hardware o software específicas del puesto del usuario.

🔗 Anuncio — @cognition en X


Replit despliega Model Selector, Follow-up Tasks y una nueva página de uso

31 de julio — En su resumen semanal «This Week in Replit», Replit detalla varias novedades. Model Selector ya está disponible para los planes Core y Pro, con una selección ampliada que incluye modelos de pesos abiertos además de los modelos propietarios: el usuario mantiene el control o deja que Replit recomiende automáticamente. Follow-up Tasks pasa a disponibilidad para todos los usuarios esta semana: después de completar una tarea, el Agent propone pasos siguientes activables con un clic, ejecutados en segundo plano. Dos ajustes completan la semana: una página de uso reconstruida que ofrece seguimiento casi en tiempo real por fecha, recurso, proyecto, workspace, grupo y usuario, y una sesión de usuario prolongada (desconexión por defecto ampliada de 7 a 14 días).

FuncionalidadEstado
Model SelectorEn línea, planes Core y Pro, modelos abiertos incluidos
Follow-up TasksDesplegado para todos los usuarios
Página de usoReconstruida, seguimiento casi en tiempo real
Duración de sesiónAmpliada de 7 a 14 días

🔗 Anuncio — @Replit en X


Together AI : escalado de la inferencia abierta

Together AI multiplica esta semana los anuncios en torno a la inferencia dedicada, en dos ángulos distintos: una cifra de crecimiento espectacular en el uso y un artículo técnico detallado sobre el autoscaling de la infraestructura subyacente.

Un crecimiento de tokens servidos multiplicado por más de 10 000

1 de agosto — Together AI muestra una cifra de crecimiento llamativa: su volumen de tokens servidos habría pasado de 30 mil millones al mes a 400 000 mil millones (400 billones) al mes, es decir, más de 10 000 veces. La empresa explica este avance por la migración de cargas de trabajo a gran escala hacia modelos de pesos abiertos en lugar de API propietarias cerradas. La cifra se presenta sin un periodo de referencia preciso, lo que limita su valor comparativo.

Josh had to stop @vipulved and ask him to repeat the number: @wolfejosh Together AI went from serving 30B tokens a month to 400T. Over 10,000x growth as AI-native companies and enterprises move scaled workloads to open model.

🇪🇸 Josh tuvo que interrumpir a @vipulved y pedirle que repitiera la cifra: Together AI pasó de 30 mil millones de tokens servidos al mes a 400 000 mil millones. Un crecimiento de más de 10 000 veces, impulsado por la migración de empresas AI-native y grandes cuentas hacia modelos abiertos para sus cargas de trabajo a gran escala.@togethercompute en X

Ocho métricas para pilotar el autoscaling de la inferencia dedicada

31 de julio — Together AI publica un artículo técnico sobre el autoscaling de su Dedicated Model Inference. El punto de partida: las métricas clásicas heredadas del mundo web (uso de CPU/GPU) no reflejan la presión real de un motor de inferencia LLM: una GPU puede mostrar un 60 % de uso mientras su cola ya está saturada, porque el uso mide la intensidad de cálculo, no la carga en espera. El artículo detalla ocho métricas nativas de inferencia, agrupadas en tres familias (concurrencia, SLO, eficiencia), y recomienda inflight_requests como métrica por defecto. También cuantifica el coste real de un cold start en GPU H100: unos 86 segundos para un modelo base, 145 segundos para un fine-tune de 18 GB, y unos 2,5 minutos para añadir una réplica.

Paso medidoDuración en 1×H100
Despliegue de modelo base86 s
Despliegue de fine-tune (18 GB)145 s
Escalado de 1 a 2 réplicas~2,5 min

🔗 Artículo técnico completo


Ai2 — un estudio basado en infini-gram rastrea la lengua prestada en los libros escritos por IA

31 de julio — Ai2 (Allen Institute for AI) destaca un estudio construido sobre su motor infini-gram, una herramienta que indexa corpus masivos de texto y cuenta la frecuencia exacta de aparición de cualquier frase, permitiendo rastrear las fuentes probables de una formulación. El equipo de Tuhin Chakrabarty (Stony Brook University) aisló «expresiones raras» —giros que aparecen en como máximo cinco libros de Google Books y están ausentes de la web indexada— y comparó su tasa de presencia entre libros autopublicados con alto contenido de IA detectado, libros autopublicados sin IA detectada y literatura premiada. Resultado: los libros con alto contenido de IA muestran una proporción claramente mayor de expresiones raras, lo que sugiere una dependencia más marcada de los patrones procedentes de los datos de entrenamiento.

Grupo evaluadoCobertura en expresiones raras
Top 200 autopublicados, IA fuertemente detectada41,6 %
Top 200 autopublicados, IA no detectada37,2 %
Literatura premiada o nominada (referencia)19,1 %

🔗 Artículo completo — Ai2


Gemini 3.5 Flash Cyber, un modelo dedicado a la ciberseguridad con acceso restringido

31 de julio — Google ha añadido discretamente un nuevo miembro a su familia de modelos Flash: Gemini 3.5 Flash Cyber. A diferencia de las versiones de consumo anunciadas este mes (3.6 Flash, 3.5 Flash-Lite), este modelo apunta a un uso muy específico —detectar y corregir vulnerabilidades de software a gran escala— y sigue siendo un modelo económico optimizado para ese único caso de uso. El acceso está deliberadamente restringido a gobiernos y socios de confianza, lo que lo convierte en una herramienta de ciberseguridad defensiva más que en un producto comercial abierto a todos. No hay página de producto dedicada, ni benchmarks ni detalles de arquitectura que acompañen este anuncio: la única fuente disponible es un hilo resumen quincenal de @GoogleAI, lo que limita la profundidad de lo que puede decirse por ahora.

El mismo hilo resumen anuncia además Collections en Gemini Notebook (antes NotebookLM), una nueva forma de agrupar sus notebooks. De nuevo, una sola frase, sin captura ni documentación asociada.

🔗 Hilo resumen — @GoogleAI en X


Copilot retira la compatibilidad con Gemini 2.5 Pro y Gemini 3 Flash

31 de julio — GitHub retira Gemini 2.5 Pro y Gemini 3 Flash de todas sus experiencias de Copilot (Chat, inline edits, modos ask y agent, completions de código), sin que se requiera ninguna acción por parte del usuario — los modelos desaparecen automáticamente de los selectores. Se invita a los usuarios a cambiar a Gemini 3.1 Pro (Preview) y Gemini 3.6 Flash. En el plano de administración, las organizaciones Enterprise deben verificar que sus políticas de modelos permitan estos sustitutos antes de que sus equipos los vean en el selector de Copilot Chat en VS Code y github.com. Esta despriorización ilustra el ritmo rápido de rotación de los modelos ofrecidos en Copilot, donde las versiones Gemini de generación anterior ceden el lugar a las iteraciones más recientes de Google.

🔗 Changelog oficial


npm restringe los tokens GAT para eludir 2FA

31 de julio — GitHub limita lo que pueden hacer los tokens de acceso granulares (GAT) de npm configurados para eludir la autenticación de dos factores (2FA). Hasta ahora, un token de este tipo filtrado podía servir para tomar el control completo de una cuenta: crear otros tokens, añadir un mantenedor, modificar los permisos de acceso a un paquete. A partir de ahora, estas operaciones sensibles requieren un desafío 2FA interactivo, incluso para un token normalmente exento de 2FA. La medida entra en vigor de inmediato; una segunda etapa está prevista para enero de 2027, fecha en la que estos tokens también perderán su capacidad de publicar paquetes directamente, lo que empuja a los equipos de automatización hacia la publicación de confianza (trusted publishing, basada en OIDC). Solo se ven afectados los tokens de npm: los tokens clásicos de GitHub (PAT, GitHub App, Actions) siguen funcionando sin cambios. Es una respuesta directa a la oleada de ataques por toma de control de paquetes npm observada en los últimos meses en el ecosistema open source.

🔗 Changelog oficial


Sintaxis self-repository para referenciar acciones en GitHub Actions

30 de julio — GitHub Actions introduce una nueva sintaxis, $/, para referenciar una acción o un workflow reutilizable ubicado en el mismo repositorio que el workflow que lo invoca. Hasta ahora, este tipo de referencia interna obligaba bien a usar ./ junto con un paso explícito de checkout, bien a fijar una versión de forma rígida. Con $/, la referencia apunta automáticamente al commit exacto en ejecución, sin paso de checkout adicional, y funciona en todos los lugares donde se utilizaba ./: pasos de workflow, acciones compuestas, composición anidada y llamadas a workflows reutilizables. Esta novedad requiere un runner en la versión 2.336.0 o más reciente. Su principal interés: permitir a las organizaciones aplicar políticas que exigen anclar las acciones a SHA de commit completos, manteniendo al mismo tiempo referencias internas sincronizadas automáticamente con el ref en ejecución.

🔗 Changelog oficial


OpenAI retira GPT-5.4 y GPT-5.4 mini de ChatGPT el 31 de agosto

31 de julio — OpenAI anunció la retirada de GPT-5.4 y GPT-5.4 mini de la interfaz ChatGPT para los usuarios conectados mediante una cuenta, a partir del 31 de agosto. No obstante, ambos modelos siguen siendo accesibles a través de la API de OpenAI, así como en las sesiones Codex autenticadas con clave API — una distinción que afecta, por tanto, a los usuarios de la app/web de ChatGPT, pero no a los desarrolladores que pasan por la API o Codex con clave API. Este anuncio se inscribe en la continuidad de la actualización tarifaria GPT-5.6 (Luna/Terra) de finales de julio, que acelera el giro de la gama ChatGPT hacia los modelos más recientes.

🔗 Anuncio — @OpenAIDevs en X


ImageGen en Codex CLI: nueva lightbox y canvas

30 de julio — OpenAI Devs ha actualizado la función ImageGen integrada en Codex CLI con una nueva interfaz de tipo «lightbox» y un canvas dedicado. Esta evolución busca simplificar la exploración y el refinamiento de las imágenes generadas directamente en el flujo de trabajo de Codex, sin cambiar de contexto. Se trata de una mejora de usabilidad más que de un nuevo modelo, pero afecta directamente a la herramienta CLI seguida con prioridad en OpenAI.

🔗 Anuncio — @OpenAIDevs en X


Breves

  • Amp — inicio de orbs un 20 % más rápido, asistente Puck pasado a GPT-5.6 Sol — Amp anuncia un inicio de los orbs (máquinas remotas) aproximadamente un 20 % más rápido y cambia su asistente Puck a GPT-5.6 Sol tras comentarios de usuarios muy críticos. 🔗 fuente
  • Hugging Face despliega un endpoint público gratuito para DeepSeek-V4-Flash-0731 — Un empleado de Hugging Face pone en línea, el mismo día de su lanzamiento, un endpoint gratuito sin token, compatible con OpenAI, para probar el modelo. 🔗 fuente
  • Sakana AI — 5.º puesto en el CTF OSINT Diver 2026 — Un equipo de defensa/inteligencia de Sakana AI, utilizando un agente OSINT basado en Fugu-ultra 1.1, termina 5.º entre más de 850 equipos participantes. 🔗 fuente
  • Kimi K3 en Together AI — precio más bajo y mejor tasa de caché según OpenRouter — Datos del panel de OpenRouter muestran que Together AI ofrece una de las tarifas más bajas para Kimi K3, con una de las mejores tasas de acierto de caché de prompt. 🔗 fuente
  • Un modelo de vídeo abierto (Marlin-2B) hace consultables 370 horas de archivos públicos por unos 10 dólares — Un miembro de la comunidad indexa 1.864 películas de los Prelinger Archives con Marlin-2B en Hugging Face Jobs, generando 23.148 momentos buscables. 🔗 fuente
  • GitHub encuesta el uso de herramientas de accesibilidad por parte de los desarrolladores — Encuesta abierta hasta el 31 de agosto de 2026 entre desarrolladores con discapacidad sobre sus usos de las tecnologías de accesibilidad. 🔗 fuente
  • Seedance 2.5 anunciado también en Luma — Luma adelanta la próxima llegada de Seedance 2.5 a su plataforma, sin fecha precisada. 🔗 fuente
  • Ideogram Object Remover disponible en Runware — La herramienta de eliminación de objetos de Ideogram presume de la mejor puntuación FID en el benchmark OmniEraser, sin prompt requerido. 🔗 fuente
  • SGLang añade compatibilidad con Inkling-Small en el clúster NVIDIA DGX Spark — Rendimiento medido de 24 tokens/segundo en concurrencia 1, en 2 sistemas DGX Spark conectados en ConnectX-7. 🔗 fuente
  • ChatGPT desktop — vista Actividad y acceso rápido a Voz mediante el icono de animal — Nueva vista Activity que agrupa conversaciones pendientes y actualizaciones de proyectos, además de un acceso rápido a ChatGPT Voice. 🔗 fuente
  • Diez avances en matemáticas e informática teórica — OpenAI comparte diez resultados sobre problemas abiertos en geometría, criptografía y complejidad; contenido detallado no consultable, fuente bloqueada a los robots. 🔗 fuente
  • Avanzar en una IA responsable en Europa — OpenAI presenta sus prácticas de seguridad, transparencia y procedencia en apoyo a la gobernanza de la IA en Europa frente al AI Act; contenido detallado no consultable, fuente bloqueada. 🔗 fuente
  • Univé construye una fuerza laboral preparada para la IA con ChatGPT Enterprise — Estudio de caso de la aseguradora neerlandesa Univé sobre el despliegue de ChatGPT Enterprise; contenido detallado no consultable, fuente bloqueada. 🔗 fuente
  • OpenAI afirma haber desmantelado una red de estafa con base en Camboya — Uso de ChatGPT para fraudes de inversión, sentimentales, de apuestas y de suplantación de identidad; contenido detallado no consultable, fuente bloqueada. 🔗 fuente
  • avatarin construye un agente retail 24/7 con GPT-Realtime — Soporte al cliente multilingüe para Yamada Denki: 30.000 usuarios en dos semanas, 92 % de opiniones positivas según el resumen oficial; contenido detallado no consultable, fuente bloqueada. 🔗 fuente

Lo que esto significa

La generación media acelera su carrera hacia la distribución amplia y la edición conversacional. MiniMax H3 toma la delantera con un modelo unificado texto/imagen/vídeo/audio y pesos abiertos prometidos «en los próximos días», desplegado day-0 en una quincena de socios. El mismo movimiento se observa en Ideogram (P-Image-Ideogram, cuatro modos de calidad y una tarifa desde 0,003 dólar por imagen), Wan Video (modo Realtime sin botón «generate») y Luma (Layers, edición de una capa a la vez por conversación): el valor añadido ya no depende solo de la calidad bruta de un modelo, sino de la velocidad de iteración y de la integración multiplataforma desde el lanzamiento. Black Forest Labs, con una vista previa de 48 horas de FLUX 3 reservada a un agente tercero, adopta un enfoque inverso: adelanto controlado en lugar de disponibilidad general inmediata.

La inferencia de modelos abiertos cambia de escala, y su uso se documenta tanto como la técnica. Together AI reivindica un crecimiento de más de 10.000 veces de su volumen de tokens servidos en un mes, impulsado por la migración de empresas hacia modelos abiertos, y publica en paralelo un artículo técnico detallado sobre los límites de las métricas clásicas de autoscaling para la inferencia LLM. Como complemento, el estudio de Ai2 construido sobre infini-gram aporta una perspectiva inesperada sobre esa misma ola de modelos abiertos: documenta, a partir de libros autopublicados, hasta qué punto los textos generados por IA siguen siendo cercanos a las formulaciones encontradas durante el entrenamiento — un recordatorio de que la escalabilidad de la inferencia no borra las cuestiones de fondo sobre la originalidad de los contenidos producidos.

Las herramientas para agentes de código y la seguridad de la cadena de suministro avanzan en paralelo, no siempre en la misma dirección. Devin amplía su perímetro de ejecución a cualquier ordenador con Outposts, Replit multiplica las funciones de autonomía (Follow-up Tasks, Model Selector) y GitHub Actions simplifica la referencia a acciones internas con la sintaxis $/. Al mismo tiempo, GitHub refuerza la seguridad de npm imponiendo un desafío 2FA interactivo incluso a los tokens configurados para eludirlo, en respuesta directa a la oleada de tomas de control de cuentas observada en los últimos meses — una señal de que la creciente automatización de los agentes viene acompañada de un endurecimiento paralelo de los controles de acceso.

Dos actores restringen el acceso a algunos de sus modelos, por razones distintas. OpenAI retira GPT-5.4 y GPT-5.4 mini de ChatGPT para los usuarios conectados a partir del 31 de agosto, manteniéndolos al mismo tiempo disponibles vía API — una aclaración de gama más que una retirada pura. Google, por su parte, reserva Gemini 3.5 Flash Cyber, un modelo económico dedicado a la detección y corrección de vulnerabilidades de software, únicamente a gobiernos y socios de confianza: una señal de que algunos laboratorios distinguen ahora explícitamente entre modelos de uso defensivo restringido y modelos de consumo general.


Fuentes