Buscar

Replit lanza Ramp for Agents para agentes financieros autónomos, GitHub publica un dataset multilingüe de 40M repositorios, HeyGen abre la salida de vídeo WebM transparente

Replit lanza Ramp for Agents para agentes financieros autónomos, GitHub publica un dataset multilingüe de 40M repositorios, HeyGen abre la salida de vídeo WebM transparente

ai-powered-markdown-translator

Artículo traducido del fr al es con gpt-5.4-mini.

Ver proyecto en GitHub ↗

El 11 de julio, los agentes salen del código para tocar el mundo real: Replit asocia su agente con Ramp para incorporar una empresa y gestionar tesorería, facturas y gastos de forma autónoma, GitHub publica un dataset open source de más de 40 millones de repositorios sobre la distribución lingüística del código, y HeyGen encadena dos anuncios para desarrolladores —salida de vídeo WebM transparente y montaje automático sincronizado sobre vídeos hablados—. Pika demuestra por su parte capacidades avanzadas de edición de vídeo mediante un modelo que denomina «Gemini Omni», una atribución no confirmada por Google a día de hoy. Cinco breves completan el panorama, desde la línea de llamada vocal de Together AI hasta la alianza de infraestructura de Cohere con NVIDIA y CoreWeave.


Replit lanza Ramp for Agents: sus agentes gestionan ahora las finanzas de la empresa

11 de julio — Replit anunció una asociación con Ramp, plataforma de gestión financiera y de tarjetas corporativas, que permite a su agente ir más allá de la generación de código para hacerse cargo de trámites financieros reales. En concreto, el agente de Replit ahora puede acompañar la creación de una sociedad (incorporation), presentar una solicitud de cuenta Ramp para esa entidad y, después, preparar la empresa para gastar dinero, pagar sus facturas y gestionar su tesorería, todo ello desde una conversación en lenguaje natural.

El lanzamiento se inscribe en la continuidad de la estrategia de Replit, que ya abrió su agente al comercio electrónico (integración con Shopify, junio de 2026) y a la descubribilidad (SEO Agent, junio de 2026). El producto pasa por una página dedicada operada por Ramp, «Finance for the Agent Economy», que proporciona a los agentes tarjetas, transferencias y cuentas bancarias con controles integrados para encuadrar cada dólar gastado.

“Ramp for Agents.

Replit Agent can now incorporate your company, apply for Ramp, and get your business ready to spend, pay bills, and manage money.

Every company used to start with paperwork. The next one starts with a prompt.”

🇪🇸 Ramp for Agents. Replit Agent ahora puede incorporar tu empresa, solicitar Ramp y preparar tu negocio para gastar, pagar facturas y gestionar dinero. Antes cada empresa empezaba con papeleo; la siguiente empieza con un prompt.@Replit en X


GitHub publica el Multilingual Repositories Dataset

11 de julio — GitHub ha publicado el GitHub Multilingual Repositories Dataset, un nuevo conjunto de datos open source destinado a investigadores y desarrolladores que trabajan en IA multilingüe. Cubre más de 40 millones de repositorios y más de 80 millones de líneas de clasificación, y cartografía dónde viven los README, issues y pull requests redactados en un idioma distinto del inglés en la plataforma.

Indicador medidoValor medido
Repositorios cubiertos40M+
Líneas de clasificación80M+
Repositorios README en portugués (idioma dominante)3M+
Idioma dominante de los textos de issuesCoreano

Las cifras destacadas por GitHub revelan tendencias lingüísticas concretas: el coreano domina los textos de issues, mientras que el portugués encabeza los README, con más de 3 millones de repositorios afectados. No se trata de una funcionalidad de Copilot propiamente dicha, sino de una publicación de investigación y de datos abiertos, en continuidad con el posicionamiento de GitHub como plataforma de desarrollo impulsada por IA.

🔗 Tweet @github — Multilingual Repositories Dataset


Pika edita vídeos con un modelo que denomina «Gemini Omni»

11 de julio — Pika publicó una demostración en vídeo que pone en primer plano funciones avanzadas de edición aplicadas a un vídeo importado por el usuario: cambio de fondo, cambio de ángulo de cámara, cambio de vestuario, añadido de efectos visuales e incluso doblaje de la voz en francés —todo ello presentado por Pika como posible «with Gemini Omni».

“Drop in your video and change the background, change the angle, swap the outfit, add visual effects, even make it speak French — all with Gemini Omni”

🇪🇸 Importa tu vídeo y cambia el fondo, cambia el ángulo, cambia el vestuario, añade efectos visuales, incluso haz que hable en francés: todo ello con Gemini Omni.@pika_labs en X

Precaución editorial: el nombre «Gemini Omni» no aparece en ningún anuncio oficial de Google o DeepMind a día de hoy —el rastreo dedicado a los anuncios de Gemini no detectó ninguna novedad este 11 de julio. Se trata del nombre utilizado por la propia Pika para designar el modelo subyacente a esta funcionalidad; su existencia y su naturaleza exactas no están establecidas de forma independiente. Esta noticia debe leerse como una funcionalidad anunciada por Pika, y no como un lanzamiento de producto confirmado por Google.

Compromiso moderado para la cuenta (15 000 visualizaciones, 80 likes), claramente por debajo de las publicaciones principales de Pika —señal de un anuncio de funcionalidad más que de un lanzamiento de producto insignia.


HeyGen refuerza su ecosistema para desarrolladores: vídeo transparente y montaje automatizado

Dos anuncios el mismo día para HeyGen, uno sobre el formato de salida de vídeo y otro sobre la automatización del montaje.

Salida de vídeo WebM transparente en API, CLI y MCP

11 de julio — HeyGen anunció una nueva opción de salida de vídeo en su API, su CLI y su servidor MCP: el formato WebM con canal alfa transparente. Al definir el parámetro output_format: "webm" en el endpoint /v3/videos, los vídeos de avatar generados vuelven con un fondo realmente transparente (canal alfa nativo), sin recurrir a un fondo verde (green screen) para recortar después.

Esta funcionalidad está dirigida a desarrolladores que integran vídeos de avatar en producciones más amplias —edición, superposiciones, integración en escenas 3D. El hilo asociado ilustra un ejemplo concreto: un avatar compuesto directamente en una escena three.js al estilo Minecraft.

🔗 Tweet @HeyGen — salida WebM transparente

La «Talking-Head-Recut Skill» sincroniza los gráficos sobre un vídeo hablado

11 de julio — Sexto episodio de una serie de demostraciones diarias en torno a HyperFrames, el entorno de producción de vídeo impulsado por agentes de HeyGen: la «Talking-Head-Recut Skill» superpone gráficos de composición (títulos animados, contadores, tarjetas, citas) sobre un vídeo de tipo «cabeza parlante», sincronizados automáticamente con el discurso pronunciado. El agente lee la transcripción, decide qué elementos merecen un gráfico y luego dibuja cada tarjeta según la identidad visual proporcionada.

La demostración ilustra el funcionamiento de extremo a extremo a partir de un único prompt: búsqueda de un tema de actualidad (el anuncio GPT-5.6 de OpenAI), guion con fuentes, avatar generado directamente desde la CLI de HeyGen, identidad visual tomada en directo de chatgpt.com y render final con subtítulos y música, sin editor de vídeo ni cámara. La skill está documentada como open source en GitHub.

🔗 Tweet @HeyGen — Talking-Head-Recut Skill 🔗 GitHub — talking-head-recut skill


Breves

  • Together AI lanza una línea de llamada vocal — un tuit minimalista («Why type when you can call?») enlaza con docs.together.ai/call, que abre un marcador telefónico (+1 415-723-8167, ext. 676) que pone en contacto a la persona que llama con un asistente de voz impulsado por la plataforma de inferencia de Together AI, sin artículo de blog asociado. 🔗 Tweet @togethercompute
  • Pika pone en línea un servidor MCP experimentalexperiment.pika.art («Pika MCP – Make Your Agent Creative») permite a agentes IA invocar las capacidades creativas de generación y edición de vídeo de Pika directamente desde su entorno agéntico. 🔗 Tweet @pika_labs
  • MiniMax y Fireworks AI optimizan el kernel M3 en Blackwell — un nuevo kernel «KV-stationary» desarrollado por Fireworks AI para el modelo abierto M3 de MiniMax lee cada bloque seleccionado una sola vez, preservando las ganancias de la sparse attention y alcanzando alrededor de 980 TFLOP/s en una GPU B200. 🔗 Tweet @MiniMax_AI
  • GPT-Live desplegado al 100 % en todo el mundo — la funcionalidad de voz full-duplex de OpenAI, lanzada el 8 de julio, alcanza su despliegue completo en ChatGPT; OpenAI duplica temporalmente el límite de uso de voz durante el fin de semana del 11 al 12 de julio. 🔗 Tweet @athyuttamre
  • Cohere pone en valor su asociación con NVIDIA y CoreWeave — comunicación institucional en X sobre la fiabilidad y la protección de la infraestructura para las grandes empresas que despliegan IA, sin detalle técnico ni artículo asociado. 🔗 Tweet @cohere

Qué significa esto

La producción de vídeo se está convirtiendo en un pipeline totalmente impulsado por agentes, desde el montaje hasta la distribución. HeyGen elimina una etapa técnica clásica —el recorte del fondo verde— al hacer que el canal alfa sea nativo en API, CLI y MCP, y automatiza la sincronización de gráficos sobre vídeos hablados mediante su Talking-Head-Recut Skill: un solo prompt basta ahora para producir un vídeo con fuentes, composición y subtítulos sin cámara ni editor. Pika empuja la misma lógica del lado de la posproducción, con un modelo que denomina «Gemini Omni» para cambiar fondo, ángulo y vestuario de un vídeo existente —una atribución que, a falta de confirmación oficial de Google, ilustra también una tendencia a bautizar piezas técnicas para darles un aire de potencia, que conviene tomar con la prudencia debida.

Los agentes salen del código para tocar la administración y las finanzas de una empresa. Ramp for Agents permite al agente de Replit incorporar una sociedad, abrir una cuenta Ramp y gestionar tesorería y facturas —un territorio que, hasta ahora, seguía siendo estrictamente humano. El mismo movimiento se ve, a menor escala, en Pika MCP, que abre las capacidades creativas de Pika a agentes IA de terceros mediante un servidor MCP experimental: el agente ya no se limita a producir, también orquesta servicios de terceros por cuenta del usuario.

Las bases de la IA multilingüe y de la inferencia a gran escala siguen abriéndose. El Multilingual Repositories Dataset de GitHub documenta, a escala de 40 millones de repositorios, dónde viven realmente el coreano, el portugués y las demás lenguas del código mundial: un recurso para cualquier investigador que trabaje en modelos multilingües. El kernel KV-stationary desarrollado por Fireworks AI para el M3 de MiniMax ilustra el mismo trabajo de infraestructura del lado de la inferencia, preservando en Blackwell las ganancias teóricas de la sparse attention. La alianza reforzada de Cohere con NVIDIA y CoreWeave completa este panorama: la fiabilidad de la infraestructura se convierte en un argumento de venta en sí mismo para la IA empresarial.

La voz se está instalando como un canal de producto en toda regla, más que como una simple función anexa. GPT-Live alcanza su despliegue completo en OpenAI apenas tres días después de su lanzamiento, con límites duplicados para incentivar la prueba; Together AI, por su parte, abre una línea telefónica que conecta directamente a la persona que llama con un asistente de voz impulsado por su plataforma de inferencia. Dos enfoques distintos —uno integrado en una aplicación existente, el otro accesible desde un teléfono clásico— para la misma apuesta: la interfaz de voz se convierte en un punto de entrada completo a los modelos, no solo en una opción entre otras.


Fuentes