ai-powered-markdown-translatorArtículo traducido del fr al es con gpt-5.4-mini.
El 22 de agosto, Anthropic abre Claude Code Remote Control al inicio de sesiones desde el teléfono, mientras Google dota a Antigravity de una funcionalidad equivalente para pilotar sus agentes a distancia. En cuanto a los modelos, dos comparativas de Together AI muestran que el modelo abierto GLM-5.3 iguala o supera a GPT-5.6 Sol y Claude Fable 5 en el benchmark DeepSWE, por una fracción del coste. Perplexity detalla además la arquitectura de Brain, su memoria agéntica versionada con Git, y NotebookLM pasa a estar accesible para todos los usuarios con una integración en el Modo IA de Google Search. En el menú también: Replit revisa sus modos de agente, Runway abre una oferta de licencia de modelos, OpenAI refuerza su control de costes de API y su suite de seguridad Codex, y Grok Bot amplía su acceso.
Claude Code Remote Control: fiabilidad reforzada e inicio de sesión desde el teléfono
22 de agosto — Anthropic publica en X un hilo que detalla varios correctivos de fiabilidad para Remote Control, la funcionalidad que permite pilotar una sesión de Claude Code desde un teléfono mientras se ejecuta en un ordenador remoto. La sincronización de estado entre teléfono y máquina ya no deja una sesión fantasma visible tras cerrar Claude Code; los cortes de red (cambio de Wi‑Fi, cierre de la tapa) activan ahora una reconexión automática, y la apertura de sesiones voluminosas se acelera notablemente en iOS. Tres comandos slash ganan un comportamiento móvil dedicado (/clear, /compact, /diff). Novedad de producto: ahora es posible iniciar una sesión directamente desde el teléfono: cualquier máquina que ejecute claude remote-control aparece como una tarjeta de dispositivo en la pestaña Code, seleccionable para lanzar la sesión a distancia.
Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.
🇪🇸 Tu teléfono permanece ahora sincronizado con lo que se ejecuta en tu máquina. Reanudar una sesión en tu portátil mantiene el teléfono en la sesión activa en lugar de archivarlo. Cuando Claude Code termina, tu teléfono lo muestra sin conexión en unos segundos en lugar de dejar visible una sesión obsoleta. — @ClaudeDevs en X
🔗 Hilo completo en X 🔗 Documentación de Remote Control
Replit: Conversations, modos de Agent renombrados (Power/Max), Routines y Memories en beta
22 de agosto — Replit publica su resumen semanal This Week in Replit, con tres novedades inéditas. Conversations permite iniciar una idea de aplicación con una fase de investigación e ideación conversacional antes de pasar a la construcción, sin perder el contexto acumulado, un problema frecuente cuando esa fase empezaba en otro asistente IA. Los modos del Agent se renombran: el antiguo modo Economy pasa a llamarse Power, el antiguo modo Power pasa a llamarse Max, con el mismo coste en ambos. Por último, Routines y Memories llegan a beta: las Routines programan la ejecución de una tarea a partir de una conversación y devuelven el resultado automáticamente, apoyadas en un sistema de memoria persistente. Estos anuncios se presentaron en directo durante el Friday Showcase de Replit.
Together AI compara GLM-5.3 con GPT-5.6 Sol y Claude Fable 5 en DeepSWE
21 de agosto — Together AI publica el mismo día dos comparativas independientes que enfrentan GLM-5.3, el último modelo abierto de Zhipu/Z.ai, a dos referentes cerrados en DeepSWE, su benchmark de ingeniería de software (113 tareas, 4 intentos por configuración, esfuerzo máximo, 904 ejecuciones en total). Frente a GPT-5.6 Sol, GLM-5.3 cede en el primer intento pero lo alcanza ya en el segundo y lo supera en el cuarto, con un coste mucho menor. Frente a Claude Fable 5, la diferencia inicial es casi nula y se amplía claramente a favor de GLM-5.3 con los intentos múltiples; Claude Fable 5 aparece como la configuración más cara de la comparativa. Una cascada GLM-5.3 hacia Sol, que solo escala en caso de fallo de las pruebas, alcanza un 85,9 % de éxito a 6,61 dólares por tarea, un resultado mejor que un router oráculo perfecto (83,8 %).
| Comparación probada | Puntuación en el primer intento | Puntuación tras 4 intentos | Coste por ejecución |
|---|---|---|---|
| GLM-5.3 vs GPT-5.6 Sol | 69,0 % vs 72,7 % | 87,6 % vs 85,8 % | 3,99 $ vs 8,37 $ (2,1× más barato) |
| GLM-5.3 vs Claude Fable 5 | 69,0 % vs 69,7 % | 87,6 % vs 84,1 % | 3,99 $ vs 21,63 $ (5,4× más barato) |
Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.
🇪🇸 No elijas un solo modelo. Haz que GLM-5.3 se ejecute primero y escala hacia GPT-5.6 Sol cuando fallen las pruebas. Esta cascada resuelve el 85,9 % de las tareas DeepSWE a 6,61 dólares cada una. Sol por sí solo resuelve el 72,7 % a 8,37 dólares. Trece puntos más, 21 % más barato. — Together AI, blog oficial
🔗 Comparativa GLM-5.3 vs Claude Fable 5
NotebookLM disponible para todos los usuarios, integrado en el Modo IA de Google Search
21 de agosto — La cuenta X de NotebookLM, rebautizada como Gemini Notebook, anuncia que la experiencia «Notebook» renovada ya está disponible para todos los usuarios en la web (se anuncia una versión móvil próximamente), tras un despliegue progresivo. Otro cambio estructural: los notebooks ahora son accesibles directamente desde el Modo IA de Google Search, lo que acerca la herramienta de síntesis documental al motor de búsqueda principal de Google. El anuncio incluye también dos correcciones en el lado de Chat: una mejor representación y copia y pegado de ecuaciones matemáticas, y la corrección de un bug que mostraba los números al revés en los idiomas que se escriben de derecha a izquierda (árabe, hebreo). Se prometen otras novedades en las próximas semanas.
OpenAI añade un seguimiento del gasto por clave API a los paneles Usage and Spend
21 de agosto — OpenAI añade una granularidad por clave API a los paneles Usage and Spend de su plataforma para desarrolladores. Hasta ahora agregado a nivel de organización o de proyecto, el seguimiento del gasto permite ahora aislar la contribución de cada clave API individual, para identificar con precisión qué aplicaciones o qué flujos de trabajo pesan más en la factura. La funcionalidad se acompaña de límites de gasto configurables a nivel de organización o de proyecto, con la posibilidad de fijar límites estrictos que cortan automáticamente el tráfico una vez alcanzado el tope. Estos controles están accesibles desde la interfaz de la API Platform y a través de la Admin API, para integrarlos en flujos de trabajo programáticos. OpenAI presenta esta actualización como complementaria a la bajada tarifaria de GPT-5.6 Sol anunciada el mismo día.
Codex Security: guía práctica y CLI open source para la defensa cibernética (Daybreak)
21 de agosto — OpenAI publica una guía que detalla el ecosistema Daybreak, su plataforma de defensa cibernética asistida por IA, desde el triaje inicial en ChatGPT hasta la producción de un parche verificado. El punto más concreto para los desarrolladores es la Codex Security CLI, una herramienta open source publicada como paquete npm (@openai/codex-security), utilizable para escanear un repositorio local (npx @openai/codex-security scan .) e integrable en CI/CD (GitHub Actions, GitLab CI/CD) con exportación en formato SARIF. Novedad destacable: el bulk-scan, que audita toda una cartera de repositorios a partir de un inventario CSV, con reanudación tras interrupción y parámetros de concurrencia configurables. OpenAI distingue también dos niveles de acceso: Daybreak Blue (triaje de vulnerabilidades, validación de parches) para defensores aprobados, y Daybreak Red (investigación avanzada de vulnerabilidades, red teaming), reservado a un número más reducido de usos autorizados. Codex Security cloud ya ha analizado más de 30 millones de commits en más de 30 000 bases de código.
Grok Bot amplía su acceso a más planes y se vuelve gratis en modo de prueba
21 de agosto — Diez días después de su lanzamiento en beta, Grok Bot amplía su acceso a una gama más amplia de planes: SuperGrok Plus, SuperGrok Heavy, así como las ofertas de Cursor (Pro+, Ultra y todos los planes Teams). Los usuarios fuera de esos planes se benefician ahora de una prueba gratuita con uso limitado. Estos agentes IA autónomos disponen de su propio entorno cloud con acceso a navegador y terminal, para tareas como la prospección comercial, la creación de sitios web completos (compra de dominio y despliegue incluidos), el triado de bandejas de entrada, el soporte al cliente o la toma de notas en reuniones. Varios Bots pueden ejecutarse en paralelo en un mismo grupo, y un modo «routine» permite que un Bot aprenda una tarea observando al usuario ejecutarla una primera vez. Hay una lista de espera para empresas abierta para los despliegues a mayor escala.
Runway detalla su estrategia empresarial y una oferta de licencia de modelos
21 de agosto — El nuevo director comercial de Runway, Sean Holcombe, detalla en un artículo la estrategia empresarial de la compañía: ingresos más que duplicados en el año, retención neta superior al 300 %, y marcada expansión internacional (Europa por encima del 20 % de la base empresarial, Japón convertido en el primer mercado asiático). El anuncio más estructural es la apertura de una oferta de licencia de modelos: en lugar de un acceso facturado por uso vía API, algunos clientes empresariales podrán recibir pesos de modelos cerrados y un framework propio de entrenamiento/inferencia para alojar y ajustar directamente en su propio entorno. Runway apunta a cuatro perfiles: empresas con propiedad intelectual creativa propia, plataformas que ya disponen de capacidad de cómputo, organizaciones sometidas a fuertes restricciones regulatorias, y actores de muy alto volumen.
Perplexity detalla Brain, el sistema de memoria agéntica de Computer
19 de agosto — Perplexity detalla el funcionamiento de Brain, el sistema de memoria persistente de Computer, su agente local. En lugar de una base vectorial clásica, Brain organiza la memoria en forma de un wiki de conocimiento versionado con Git, repartido en tres capas dentro del sistema de archivos del sandbox: knowledge/ (el wiki), notes/ (extractos destilados) y sessions/ (transcripciones en bruto). Un «Memory Agent» dedicado carga bajo demanda los archivos pertinentes en lugar de copiar todo el árbol cada vez que se inicia, mientras que agentes en segundo plano bautizados como «Dream» mantienen el wiki fuera de línea en cuatro etapas, con verificaciones antes de la publicación.
| Métrica evaluada | Sin Brain | Con Brain |
|---|---|---|
| Precisión (benchmark interno, 640 preguntas) | 0,600 | 0,661 |
| Recuperación de evidencias (benchmark interno) | 0,573 | 0,625 |
| Precisión en producción (últimos 30 días) | testigo | +9,3 puntos |
Breves
- Devin (Cognition) — descuento adicional del 20 % sobre GPT-5.6 Sol — OpenAI añade una bajada del 20 % al precio de GPT-5.6 Sol durante 3 meses, que se suma al descuento del 70 % ya vigente desde el 18 de agosto: la reducción acumulada en Devin Desktop y CLI alcanza ahora el 76 % hasta el 3 de octubre de 2026. 🔗 Anuncio
- Google Antigravity 2.9.1 — Remote Control para pilotar sus agentes a distancia — Nueva funcionalidad que permite iniciar y supervisar una sesión de agente local desde cualquier navegador, con mejoras de rendimiento y mejor recuperación tras errores. 🔗 Changelog
- Auto model selection al -30 % para Copilot Max — Promoción sobre la selección automática de modelo (Claude, GPT o Microsoft AI) para los suscriptores de Copilot Max, válida hasta el 30 de septiembre de 2026. 🔗 Anuncio · 🔗 Fecha de fin
- GitHub Universe 2026 — relanzamiento de la venta de entradas — Relanzamiento de marketing de la conferencia GitHub Universe 2026 mediante un breve vídeo, sin anuncio de producto asociado. 🔗 Vídeo
- Midjourney — changelog mayor para la alpha del sitio — Dos semanas de correcciones UX en alpha.midjourney.com: carpetas de proyectos, retorno de Upscale/Zoom/Vary, persistencia de los ajustes y correcciones de rendimiento. 🔗 Changelog
- MiniMax deja entrever el lanzamiento del modelo M3 en SambaNova — En respuesta a un anuncio enigmático de SambaNova, MiniMax insinúa la próxima llegada de un modelo M3, sin especificaciones ni fecha de salida comunicadas. 🔗 Tweet
- Grok 4.6 disponible en Google Enterprise Agent Platform — El modelo entra en Model Garden (antes Vertex AI), con una ventana de contexto de 500 000 tokens y una tarificación de 2 $ / 6 $ por millón de tokens de entrada/salida. 🔗 Anuncio
- Cohere activa un modo local para la dictado de voz vía superwhisper — El modo «Go Local» combina Cohere Transcribe y el modelo abierto S1-mini (0,6 mil millones de parámetros) de superwhisper, con transcripción completamente en el dispositivo. 🔗 Anuncio
Lo que significa
Dos anuncios independientes, sin relación entre sí, convergen hoy en un mismo movimiento: desacoplar el control de un agente IA de la máquina en la que realmente se ejecuta. En Anthropic, Claude Code Remote Control permite ahora iniciar una sesión directamente desde el teléfono, con reconexión automática y sincronización del estado entre dispositivos. En Google, Antigravity introduce su propia función «Remote Control»: pilotar y supervisar una sesión de agente local desde cualquier navegador. En ambos casos, el cálculo y la ejecución siguen anclados en el equipo de trabajo —es la ventana de control la que se vuelve móvil. Este desacoplamiento responde a un uso ya habitual: lanzar una tarea larga en su máquina de desarrollo y luego seguirla y retomar el control desde otro dispositivo, sin interrumpir nunca la ejecución en curso.
El segundo movimiento visible hoy afecta a la economía de los modelos. Los dos comparativos de Together AI muestran a GLM-5.3, un modelo abierto de Zhipu/Z.ai, igualar o superar a GPT-5.6 Sol y Claude Fable 5 en un mismo benchmark de ingeniería de software, por un coste de 2 a 5 veces inferior. No es un caso aislado: la misma semana, xAI multiplica las integraciones en la nube para Grok 4.6 (Google Enterprise Agent Platform después de GitHub Copilot y Amazon Bedrock), OpenAI concede un descuento acumulado del 76 % sobre GPT-5.6 Sol a los usuarios de Devin, y Replit amplía sus propios modos de agente. La competencia ya no se juega solo en la capacidad bruta de los modelos, sino en la relación coste-eficacia y la disponibilidad multiplataforma —un terreno en el que los modelos abiertos, combinados con estrategias de cascada entre modelos, se convierten en argumentos comerciales por derecho propio frente a los modelos cerrados.
Un tercer hilo, más discreto, atraviesa también la jornada: la memoria persistente se convierte en un bloque de infraestructura por derecho propio para los agentes IA. Perplexity detalla la arquitectura de Brain, un wiki de conocimientos versionado con Git que estructura la memoria de su agente Computer en lugar de apilarla en una base vectorial clásica, con ganancias medidas en precisión y recuperación de las pruebas. Al mismo tiempo, Google amplía el acceso a la experiencia Notebook renovada de NotebookLM y la integra directamente en el Modo IA de Google Search, acercando un poco más la herramienta de síntesis documental al motor de búsqueda principal. En ambos casos, el valor añadido ya no proviene solo del modelo subyacente, sino de la manera en que el historial y los conocimientos acumulados se organizan, recuperan y reutilizan de una sesión a otra.
Un último ángulo concierne a la madurez de las herramientas destinadas a los equipos técnicos y de seguridad en la empresa. OpenAI añade un seguimiento del gasto por clave API y límites estrictos configurables a sus paneles, justo cuando publica una guía detallada sobre Codex Security, con una CLI de código abierto capaz de auditar toda una cartera de repositorios. Estos dos anuncios, publicados el mismo día por el mismo equipo, dibujan una respuesta coherente a una preocupación compartida por las organizaciones que despliegan agentes IA a gran escala: mantener un control preciso sobre los costes y la superficie de seguridad, sin renunciar a la velocidad que prometen estas herramientas.
Fuentes
- Claude Code Remote Control — hilo completo
- Claude Code Remote Control — cita de sincronización
- Documentación Remote Control
- Replit — This Week in Replit
- Together AI — GLM-5.3 vs GPT-5.6 Sol en DeepSWE
- Together AI — GLM-5.3 vs Claude Fable 5 en DeepSWE
- NotebookLM — anuncio en X
- OpenAI — Usage and Spend por clave API
- OpenAI — Codex Security y Daybreak
- Grok Bot — anuncio en X
- Grok Bot — detalles de x.ai
- Runway — estrategia empresarial y licencia de modelos
- Perplexity — Brain, memoria agéntica de Computer
- Devin — descuento adicional sobre GPT-5.6 Sol
- Google Antigravity — registro de cambios 2.9.1
- GitHub — selección automática de modelo al -30 %
- GitHub — selección automática de modelo, fecha de fin
- GitHub Universe 2026 — reanudación de la venta de entradas
- Midjourney — registro de cambios alpha
- MiniMax — anuncio del modelo M3
- Grok 4.6 — Google Enterprise Agent Platform
- Cohere — modo local superwhisper