بحث

Replit تطلق Ramp for Agents للوكلاء الماليين المستقلين، وGitHub تنشر مجموعة بيانات متعددة اللغات تضم 40 مليون مستودع، وHeyGen تتيح إخراج فيديو WebM شفافًا

مقال من إنشاء الذكاء الاصطناعي
Replit تطلق Ramp for Agents للوكلاء الماليين المستقلين، وGitHub تنشر مجموعة بيانات متعددة اللغات تضم 40 مليون مستودع، وHeyGen تتيح إخراج فيديو WebM شفافًا

ai-powered-markdown-translator

مقال مترجم من الفرنسية إلى العربية باستخدام gpt-5.6-sol.

عرض المشروع على GitHub ↗

في 11 يوليو، تجاوز الوكلاء حدود الشيفرة ليتفاعلوا مع العالم الحقيقي: تربط Replit وكيلها بمنصة Ramp لتأسيس شركة وإدارة السيولة والفواتير والمصروفات بصورة مستقلة، وتنشر GitHub مجموعة بيانات مفتوحة المصدر تضم أكثر من 40 مليون مستودع حول التوزيع اللغوي للشيفرات، فيما تعلن HeyGen عن ميزتين للمطورين تباعًا — إخراج فيديو WebM شفاف ومونتاج آلي متزامن مع مقاطع الفيديو الناطقة. ومن جانبها، تستعرض Pika إمكانات متقدمة لتحرير الفيديو عبر نموذج تسميه «Gemini Omni»، وهي نسبة لم تؤكدها Google حتى الآن. وتُكمل خمس أخبار موجزة المشهد، من خط المكالمات الصوتية لدى Together AI إلى شراكة Cohere في مجال البنية التحتية مع NVIDIA وCoreWeave.


Replit تطلق Ramp for Agents: وكلاؤها يديرون الآن الشؤون المالية للشركات

11 يوليو — أعلنت Replit عن شراكة مع Ramp، وهي منصة لإدارة الشؤون المالية وبطاقات الشركات، تتيح لوكيلها تجاوز توليد الشيفرات لتولي إجراءات مالية حقيقية. وعمليًا، يستطيع وكيل Replit الآن المساعدة في تأسيس شركة، وتقديم طلب لفتح حساب Ramp لهذا الكيان، ثم إعداد الشركة لإنفاق الأموال ودفع فواتيرها وإدارة سيولتها — انطلاقًا من محادثة باللغة الطبيعية.

يأتي الإطلاق امتدادًا لاستراتيجية Replit، التي سبق أن أتاحت لوكيلها العمل في التجارة الإلكترونية (تكامل Shopify، يونيو 2026) وتحسين قابلية الاكتشاف (SEO Agent، يونيو 2026). وتعتمد الخدمة على صفحة مخصصة تديرها Ramp بعنوان «Finance for the Agent Economy»، توفر للوكلاء بطاقات وتحويلات وحسابات مصرفية مع ضوابط مدمجة لتنظيم كل دولار يُنفق.

“Ramp for Agents.

Replit Agent can now incorporate your company, apply for Ramp, and get your business ready to spend, pay bills, and manage money.

Every company used to start with paperwork. The next one starts with a prompt.”

🇸🇦 Ramp for Agents. أصبح بإمكان وكيل Replit الآن تأسيس شركتك، والتقدم بطلب للحصول على حساب Ramp، وإعداد شركتك لإنفاق الأموال ودفع فواتيرها وإدارة سيولتها. كانت كل شركة تبدأ في السابق بأعمال ورقية — أما الشركة التالية فتبدأ بموجّه.@Replit على X


GitHub تنشر مجموعة بيانات Multilingual Repositories Dataset

11 يوليو — نشرت GitHub مجموعة GitHub Multilingual Repositories Dataset، وهي مجموعة بيانات جديدة مفتوحة المصدر مخصصة للباحثين والمطورين العاملين في مجال الذكاء الاصطناعي متعدد اللغات. وتشمل أكثر من 40 مليون مستودع وأكثر من 80 مليون سطر تصنيف، وترسم خريطة لمواضع ملفات README وissues وpull requests المكتوبة على المنصة بلغات غير الإنجليزية.

المؤشر المقاسالقيمة المقاسة
المستودعات المشمولة40M+
أسطر التصنيف80M+
مستودعات README بالبرتغالية (اللغة المهيمنة)3M+
اللغة المهيمنة في نصوص issuesالكورية

تكشف الأرقام التي أبرزتها GitHub عن توجهات لغوية ملموسة: تهيمن الكورية على نصوص issues، بينما تتصدر البرتغالية ملفات README، مع أكثر من 3 ملايين مستودع معني. ولا يتعلق الأمر بميزة Copilot بحد ذاتها، بل بنشر بحث وبيانات مفتوحة، امتدادًا لمكانة GitHub بوصفها منصة تطوير مدعومة بالذكاء الاصطناعي.

🔗 منشور @github — Multilingual Repositories Dataset


Pika تحرر مقاطع الفيديو باستخدام نموذج تسميه «Gemini Omni»

11 يوليو — نشرت Pika عرضًا توضيحيًا بالفيديو يبرز وظائف تحرير متقدمة تُطبّق على مقطع فيديو يرفعه المستخدم: تغيير الخلفية، وتغيير زاوية الكاميرا، وتغيير الملابس، وإضافة مؤثرات بصرية، بل وحتى دبلجة الصوت إلى الفرنسية — وكل ذلك تقدمه Pika بوصفه ممكنًا «باستخدام Gemini Omni».

“Drop in your video and change the background, change the angle, swap the outfit, add visual effects, even make it speak French — all with Gemini Omni”

🇸🇦 استورد مقطع الفيديو الخاص بك وغيّر الخلفية، وغيّر الزاوية، وغيّر الملابس، وأضف مؤثرات بصرية، بل واجعله يتحدث بالفرنسية — كل ذلك باستخدام Gemini Omni.@pika_labs على X

تنبيه تحريري: لا يظهر اسم «Gemini Omni» في أي إعلان رسمي صادر عن Google أو DeepMind حتى الآن — ولم يرصد المسح المخصص لإعلانات Gemini أي مستجدات في 11 يوليو. فهذا هو الاسم الذي تستخدمه Pika نفسها للإشارة إلى النموذج الأساسي لهذه الوظيفة؛ ولم يُثبت وجوده أو طبيعته الدقيقة بصورة مستقلة. لذا ينبغي قراءة هذا الخبر بوصفه ميزة أعلنت عنها Pika، لا إطلاق منتج أكدته Google.

حظي المنشور بتفاعل متوسط بالنسبة إلى الحساب (15 ألف مشاهدة و80 إعجابًا)، وهو أقل بكثير من منشورات Pika الرئيسية — ما يشير إلى إعلان عن ميزة بدلًا من إطلاق منتج بارز.


HeyGen تعزز منظومتها للمطورين: فيديو شفاف ومونتاج آلي

إعلانان في اليوم نفسه من HeyGen، أحدهما يتعلق بصيغة إخراج الفيديو والآخر بأتمتة المونتاج.

إخراج فيديو WebM شفاف عبر API وCLI وMCP

11 يوليو — أعلنت HeyGen عن خيار جديد لإخراج الفيديو عبر API وCLI وخادم MCP الخاص بها: صيغة WebM مع قناة ألفا شفافة. وعند تعيين المعامل output_format: "webm" على نقطة النهاية /v3/videos، تعود مقاطع فيديو الصور الرمزية المُنشأة بخلفية شفافة فعلًا (قناة ألفا أصلية)، من دون اللجوء إلى خلفية خضراء (green screen) لإزالتها لاحقًا.

تستهدف هذه الميزة المطورين الذين يدمجون مقاطع فيديو الصور الرمزية ضمن إنتاجات أوسع — مثل المونتاج والتراكبات والدمج في مشاهد ثلاثية الأبعاد. ويوضح المنشور المتسلسل المرتبط بها مثالًا عمليًا: صورة رمزية مدمجة مباشرة في مشهد three.js بأسلوب Minecraft.

🔗 منشور @HeyGen — إخراج WebM شفاف

مهارة «Talking-Head-Recut Skill» تزامن الرسومات مع فيديو ناطق

11 يوليو — في الحلقة السادسة من سلسلة عروض توضيحية يومية حول HyperFrames، بيئة إنتاج الفيديو التي يديرها وكيل HeyGen: تضع مهارة «Talking-Head-Recut Skill» رسومات توضيحية (عناوين متحركة، وعدادات، وبطاقات، واقتباسات) فوق فيديو من نوع «الرأس الناطق»، مع مزامنتها آليًا مع الكلام المنطوق. يقرأ الوكيل النص المفرغ، ويقرر العناصر التي تستحق تمثيلًا رسوميًا، ثم يرسم كل بطاقة وفق الهوية البصرية المقدمة.

يوضح العرض آلية العمل الكاملة انطلاقًا من موجّه واحد: البحث عن موضوع إخباري (إعلان OpenAI عن GPT-5.6)، وكتابة نص موثق بالمصادر، وإنشاء صورة رمزية مباشرة عبر CLI الخاص بـHeyGen، واستقاء الهوية البصرية مباشرة من chatgpt.com، ثم إخراج النتيجة النهائية مع ترجمة مكتوبة وموسيقى — من دون محرر فيديو أو كاميرا. والمهارة موثقة بوصفها مفتوحة المصدر على GitHub.

🔗 منشور @HeyGen — Talking-Head-Recut Skill 🔗 GitHub — مهارة talking-head-recut


أخبار موجزة

  • Together AI تطلق خطًا للمكالمات الصوتية — يحيل منشور مقتضب («لماذا تكتب بينما يمكنك الاتصال؟») إلى docs.together.ai/call، الذي يفتح لوحة اتصال هاتفي (+1 415-723-8167، تحويلة 676) تصل المتصل بمساعد صوتي مدعوم بمنصة الاستدلال التابعة لـTogether AI، من دون مقال مرتبط على المدونة. 🔗 منشور @togethercompute
  • Pika تتيح خادم MCP تجريبيًا — يتيح experiment.pika.art («Pika MCP – اجعل وكيلك مبدعًا») لوكلاء الذكاء الاصطناعي استدعاء إمكانات Pika الإبداعية في توليد الفيديو وتحريره مباشرة من بيئتهم الوكيلة. 🔗 منشور @pika_labs
  • MiniMax وFireworks AI تحسّنان kernel ‏M3 على Blackwell — يقرأ kernel جديد من نوع «KV-stationary»، طورته Fireworks AI لنموذج M3 المفتوح من MiniMax، كل كتلة محددة مرة واحدة فقط، محافظًا على مكاسب الانتباه المتناثر (sparse attention) ومحققًا نحو 980 TFLOP/s على وحدة GPU من طراز B200. 🔗 منشور @MiniMax_AI
  • نشر GPT-Live بنسبة 100% في جميع أنحاء العالم — بلغت ميزة OpenAI الصوتية مزدوجة الاتجاه بالكامل، التي أُطلقت في 8 يوليو، مرحلة النشر الكامل على ChatGPT؛ وتضاعف OpenAI مؤقتًا حد الاستخدام الصوتي لعطلة نهاية الأسبوع في 11 و12 يوليو. 🔗 منشور @athyuttamre
  • Cohere تسلط الضوء على شراكتها مع NVIDIA وCoreWeave — تواصل مؤسسي على X حول موثوقية البنية التحتية وحمايتها للشركات الكبرى التي تنشر الذكاء الاصطناعي، من دون تفاصيل تقنية أو مقال مرتبط. 🔗 منشور @cohere

ما الذي يعنيه ذلك

يتحول إنتاج الفيديو إلى مسار عمل يديره الوكيل بالكامل، من المونتاج إلى التوزيع. تلغي HeyGen خطوة تقنية تقليدية — إزالة الخلفية الخضراء — عبر إتاحة قناة ألفا أصلية في API وCLI وMCP، وتؤتمت مزامنة الرسومات مع مقاطع الفيديو الناطقة باستخدام Talking-Head-Recut Skill: بات موجّه واحد كافيًا لإنتاج فيديو موثق بالمصادر ومصمم ومزود بترجمة مكتوبة، من دون كاميرا أو محرر. وتدفع Pika بالمنطق نفسه في مرحلة ما بعد الإنتاج، باستخدام نموذج تسميه «Gemini Omni» لتغيير خلفية مقطع فيديو موجود وزاويته وملابسه — وهي نسبة توضح أيضًا، في ظل غياب تأكيد رسمي من Google، نزعة إطلاق ألقاب على المكونات التقنية لإضفاء هالة من القوة عليها، وينبغي التعامل معها بالحذر اللازم.

يتجاوز الوكلاء حدود الشيفرة إلى الشؤون الإدارية والمالية للشركات. يتيح Ramp for Agents لوكيل Replit تأسيس شركة وفتح حساب Ramp وإدارة السيولة والفواتير — وهو مجال ظل حتى الآن حكرًا على البشر. ويظهر التوجه نفسه، على نطاق أصغر، في Pika MCP، الذي يتيح إمكانات Pika الإبداعية لوكلاء ذكاء اصطناعي تابعين لجهات خارجية عبر خادم MCP تجريبي: لم يعد الوكيل يكتفي بالإنتاج، بل بات ينسق خدمات خارجية نيابة عن المستخدم.

تواصل أسس الذكاء الاصطناعي متعدد اللغات والاستدلال واسع النطاق انفتاحها. توثق Multilingual Repositories Dataset من GitHub، على نطاق 40 مليون مستودع، مواضع الاستخدام الفعلية للكورية والبرتغالية وغيرها من لغات عالم الشيفرات — وهي مورد لكل باحث يعمل على نماذج متعددة اللغات. ويجسد kernel من نوع KV-stationary، الذي طورته Fireworks AI لنموذج M3 من MiniMax، العمل نفسه على البنية التحتية من جانب الاستدلال، عبر الحفاظ على المكاسب النظرية للانتباه المتناثر على Blackwell. وتُكمل شراكة Cohere المعززة مع NVIDIA وCoreWeave هذا المشهد: إذ تتحول موثوقية البنية التحتية إلى حجة تسويقية قائمة بذاتها للذكاء الاصطناعي المؤسسي.

يترسخ الصوت بوصفه قناة منتج قائمة بذاتها، لا مجرد ميزة جانبية. يصل GPT-Live إلى النشر الكامل لدى OpenAI بعد ثلاثة أيام فقط من إطلاقه، مع مضاعفة الحدود لتشجيع التجربة؛ ومن جانبها، تفتح Together AI خطًا هاتفيًا يصل المتصل مباشرة بمساعد صوتي مدعوم بمنصة الاستدلال التابعة لها. نهجان مختلفان — أحدهما مدمج في تطبيق قائم والآخر متاح عبر هاتف تقليدي — للرهان نفسه: تصبح الواجهة الصوتية نقطة دخول قائمة بذاتها إلى النماذج، لا مجرد خيار بين خيارات أخرى.


المصادر