ai-powered-markdown-translatorمقالة مترجمة من الفرنسية إلى العربية باستخدام gpt-5.4-mini.
في 11 يوليو، خرج الوكلاء من حدود الشيفرة ليمسّوا العالم الحقيقي: Replit تربط وكيلها بـ Ramp لتأسيس شركة وإدارة الخزينة والفواتير والمصروفات بصورة مستقلة، وGitHub تنشر مجموعة بيانات مفتوحة المصدر تضم أكثر من 40 مليون مستودع عن التوزيع اللغوي للشيفرة، بينما تواصل HeyGen إعلانين موجّهين للمطورين — إخراج فيديو WebM شفاف ومونتاج تلقائي متزامن على مقاطع فيديو منطوقة. ومن جانبها، تعرض Pika قدرات تحرير فيديو متقدمة عبر نموذج تسميه «Gemini Omni»، وهي نسبة لم تؤكدها Google حتى الآن. وتكمل خمس أخبار قصيرة المشهد، من خط الاتصال الصوتي لدى Together AI إلى شراكة البنية التحتية لدى Cohere مع NVIDIA وCoreWeave.
Replit تطلق Ramp for Agents: وكلاؤها يديرون شؤون الشركة المالية الآن
11 يوليو — أعلنت Replit عن شراكة مع Ramp، منصة إدارة المالية وبطاقات الشركات، تتيح لوكيلها تجاوز توليد الشيفرة إلى تولي مهام مالية حقيقية. عمليًا، يمكن لوكيل Replit الآن المساعدة في تأسيس شركة (incorporation)، وتقديم طلب للحصول على حساب Ramp لهذه الكيان، ثم إعداد الشركة لإنفاق المال ودفع الفواتير وإدارة الخزينة — كل ذلك من خلال محادثة بلغة طبيعية.
يأتي هذا الإطلاق استمرارًا لاستراتيجية Replit، التي فتحت وكيلها بالفعل أمام التجارة الإلكترونية (تكامل Shopify، يونيو 2026) وإمكانية الاكتشاف (SEO Agent، يونيو 2026). ويعبر المنتج صفحة مخصصة تديرها Ramp بعنوان «Finance for the Agent Economy»، توفر للوكلاء بطاقات وتحويلات وحسابات مصرفية مع ضوابط مدمجة لتنظيم كل دولار يُنفق.
“Ramp for Agents.
يمكن لوكيل Replit الآن تأسيس شركتك، والتقدم للحصول على Ramp، وتجهيز عملك للإنفاق ودفع الفواتير وإدارة الأموال.
Every company used to start with paperwork. The next one starts with a prompt.”
🇸🇦 Ramp for Agents. يمكن لوكيل Replit الآن تأسيس شركتك، والتقدم للحصول على Ramp، وتجهيز عملك للإنفاق ودفع الفواتير وإدارة الأموال. كانت كل شركة تبدأ يومًا ما بأوراقٍ ورقية — أما التالية فتبدأ بـ prompt. — @Replit على X
GitHub تنشر Multilingual Repositories Dataset
11 يوليو — نشرت GitHub مجموعة البيانات GitHub Multilingual Repositories Dataset، وهي مجموعة بيانات مفتوحة المصدر جديدة موجهة إلى الباحثين والمطورين الذين يعملون على الذكاء الاصطناعي متعدد اللغات. وتغطي أكثر من 40 مليون مستودع وأكثر من 80 مليون سطر تصنيف، مع رسم خرائط لمواضع وجود README وissues وpull requests المكتوبة بلغة غير الإنجليزية على المنصة.
| المؤشر المقاس | القيمة المقاسة |
|---|---|
| المستودعات المغطاة | 40M+ |
| أسطر التصنيف | 80M+ |
| مستودعات README بالبرتغالية (اللغة السائدة) | 3M+ |
| اللغة السائدة في نصوص issues | الكورية |
تكشف الأرقام التي تبرزها GitHub عن اتجاهات لغوية ملموسة: فالكورية تهيمن على نصوص issues، بينما تتصدر البرتغالية README، مع أكثر من 3 ملايين مستودع معني. ولا يتعلق الأمر بميزة Copilot بالمعنى الدقيق، بل بنشر بحثي وبيانات مفتوحة، في امتداد لموقع GitHub كمنصة تطوير مدعومة بالذكاء الاصطناعي.
🔗 تغريدة @github — Multilingual Repositories Dataset
Pika تعدّل الفيديوهات بنموذج تسميه «Gemini Omni»
11 يوليو — نشرت Pika عرضًا فيديو يبرز وظائف تحرير متقدمة مطبقة على فيديو يرفعه المستخدم: تغيير الخلفية، تغيير زاوية الكاميرا، تغيير الزي، إضافة مؤثرات بصرية، وحتى دبلجة الصوت إلى الفرنسية — وكل ذلك تقدمه Pika على أنه ممكن «with Gemini Omni».
“Drop in your video and change the background, change the angle, swap the outfit, add visual effects, even make it speak French — all with Gemini Omni”
🇸🇦 ارفع فيديوك وغيّر الخلفية، وغيّر الزاوية، وغيّر الزي، وأضف مؤثرات بصرية، واجعله يتحدث بالفرنسية — وكل ذلك مع Gemini Omni. — @pika_labs على X
تنبيه تحريري: اسم «Gemini Omni» لا يظهر في أي إعلان رسمي من Google أو DeepMind حتى الآن — ولم يسفر الفحص المخصص لإعلانات Gemini عن أي خبر في 11 يوليو. هذا هو الاسم الذي تستخدمه Pika نفسها للإشارة إلى النموذج الأساسي لهذه الميزة؛ أما وجوده وطبيعته الدقيقة فلا يثبتان بصورة مستقلة. ينبغي قراءة هذا الخبر على أنه ميزة أعلنتها Pika، لا إطلاقًا لمنتج تؤكده Google.
الاهتمام كان متوسطًا بالحساب (15 ألف مشاهدة، و80 إعجابًا)، وهو أقل بكثير من المنشورات الكبرى لـ Pika — ما يشير إلى إعلان ميزة أكثر منه إطلاق منتج رئيسي.
HeyGen تعزز منظومتها للمطورين: فيديو شفاف ومونتاج مؤتمت
إعلانان في اليوم نفسه من HeyGen، أحدهما يتعلق بصيغة إخراج الفيديو، والآخر بأتمتة المونتاج.
إخراج فيديو WebM شفاف عبر API وCLI وMCP
11 يوليو — أعلنت HeyGen خيارًا جديدًا لإخراج الفيديو على API وCLI وخادم MCP الخاص بها: صيغة WebM مع قناة ألفا شفافة. وبضبط المعامل output_format: "webm" على نقطة النهاية /v3/videos, تعود مقاطع الفيديو المولدة للأفاتار بخلفية شفافة فعلية (قناة ألفا أصلية)، من دون اللجوء إلى خلفية خضراء (green screen) لإزالتها لاحقًا.
تستهدف هذه الميزة المطورين الذين يدمجون مقاطع فيديو الأفاتار في إنتاجات أوسع — المونتاج، الطبقات فوق الصور، أو الدمج داخل مشاهد ثلاثية الأبعاد. ويعرض الخيط المصاحب مثالًا عمليًا: أفاتار مركب مباشرة داخل مشهد three.js بأسلوب Minecraft.
🔗 تغريدة @HeyGen — إخراج WebM شفاف
«Talking-Head-Recut Skill» تزامن الرسوم مع فيديو منطوق
11 يوليو — الحلقة السادسة من سلسلة عروض يومية حول HyperFrames، بيئة إنتاج الفيديو المدارة بالوكيل لدى HeyGen: تقوم «Talking-Head-Recut Skill» بوضع رسوم تزيينية (عناوين متحركة، عدادات، بطاقات، اقتباسات) فوق فيديو من نوع «الرأس المتحدث»، مع مزامنتها تلقائيًا مع الكلام المنطوق. يقرأ الوكيل النص المنقول، ويقرر العناصر التي تستحق رسمًا، ثم يرسم كل بطاقة وفق الهوية البصرية المقدمة.
يُظهر العرض طريقة العمل من البداية إلى النهاية انطلاقًا من prompt واحد: البحث عن موضوع إخباري (إعلان GPT-5.6 من OpenAI)، وسيناريو موثق بالمصادر، وأفاتار يتم توليده مباشرة من CLI الخاصة بـ HeyGen، وهوية بصرية مأخوذة مباشرة من chatgpt.com، ثم إخراج نهائي مع الترجمة الفورية والموسيقى — من دون محرر فيديو أو كاميرا. والـ skill موثق كمصدر مفتوح على GitHub.
🔗 تغريدة @HeyGen — Talking-Head-Recut Skill 🔗 GitHub — talking-head-recut skill
أخبار قصيرة
- Together AI تطلق خط اتصال صوتي — تغريدة مقتضبة («Why type when you can call?”) تشير إلى
docs.together.ai/call، الذي يفتح رقمًا هاتفيًا (+1 415-723-8167, ext. 676) يربط المتصل بمساعد صوتي مدعوم بمنصة الاستدلال لدى Together AI، من دون مقالة مدونة مرافقة. 🔗 تغريدة @togethercompute - Pika تطرح خادم MCP تجريبيًا —
experiment.pika.art(«Pika MCP – Make Your Agent Creative») يتيح لوكلاء الذكاء الاصطناعي استدعاء قدرات Pika الإبداعية في توليد الفيديو وتحريره مباشرة من بيئتهم الوكيلية. 🔗 تغريدة @pika_labs - MiniMax وFireworks AI يحسّنان kernel M3 على Blackwell — kernel جديد من نوع «KV-stationary» طورته Fireworks AI لنموذج M3 المفتوح من MiniMax يقرأ كل كتلة مختارة مرة واحدة فقط، محافظًا على مكاسب sparse attention، ويصل إلى نحو 980 TFLOP/s على GPU B200. 🔗 تغريدة @MiniMax_AI
- GPT-Live يُنشر بنسبة 100% حول العالم — الميزة الصوتية full-duplex من OpenAI، التي أُطلقت في 8 يوليو، تصل إلى نشرها الكامل على ChatGPT؛ وتضاعف OpenAI مؤقتًا حد الاستخدام الصوتي لعطلة نهاية أسبوع 11-12 يوليو. 🔗 تغريدة @athyuttamre
- Cohere تبرز شراكتها مع NVIDIA وCoreWeave — تواصل مؤسسي على X حول الاعتمادية وحماية البنية التحتية للشركات الكبرى التي تنشر الذكاء الاصطناعي، من دون تفاصيل تقنية أو مقالة مرفقة. 🔗 تغريدة @cohere
ماذا يعني هذا
إنتاج الفيديو يتحول إلى خط أنابيب يُدار بالكامل بواسطة الوكيل، من المونتاج إلى التوزيع. تزيل HeyGen خطوة تقنية كلاسيكية — إزالة الخلفية الخضراء — عبر جعل قناة ألفا أصلية متاحة على API وCLI وMCP، وتؤتمت مزامنة الرسوم على الفيديوهات المنطوقة عبر Talking-Head-Recut Skill: يكفي الآن prompt واحد لإنتاج فيديو موثق بالمصادر ومصمم ومرفق بالترجمة الفورية من دون كاميرا أو محرر. وتدفع Pika المنطق نفسه في مرحلة ما بعد الإنتاج، عبر نموذج تسميه «Gemini Omni» لتغيير الخلفية والزاوية والزي في فيديو موجود — وهي نسبة، لعدم وجود تأكيد رسمي من Google، تعكس أيضًا ميلًا إلى إطلاق أسماء على اللبنات التقنية لمنحها هالة من القوة، مع أخذ الحذر اللازم.
الوكلاء يخرجون من الشيفرة إلى الشؤون الإدارية والمالية للشركة. تتيح Ramp for Agents لوكيل Replit تأسيس شركة، وفتح حساب Ramp، وإدارة الخزينة والفواتير — وهو مجال كان حتى الآن بشريًا بحتًا. ويظهر الاتجاه نفسه، على نطاق أصغر، في Pika MCP، الذي يفتح القدرات الإبداعية لـ Pika أمام وكلاء ذكاء اصطناعي خارجيين عبر خادم MCP تجريبي: فالوكيل لم يعد يكتفي بالإنتاج، بل ينسق خدمات الأطراف الثالثة نيابةً عن المستخدم.
تواصل البنى التحتية للذكاء الاصطناعي متعدد اللغات والاستدلال واسع النطاق الانفتاح. توثق مجموعة بيانات GitHub Multilingual Repositories Dataset، على مستوى 40 مليون مستودع، المكان الحقيقي لوجود الكورية والبرتغالية وغيرها من لغات الشيفرة العالمية — وهي مورد لكل باحث يعمل على النماذج متعددة اللغات. أما kernel KV-stationary الذي طورته Fireworks AI لنموذج M3 من MiniMax فيجسد العمل نفسه على مستوى البنية التحتية للاستدلال، إذ يحافظ على المكاسب النظرية لـ sparse attention على Blackwell. وتكمل شراكة Cohere المعززة مع NVIDIA وCoreWeave هذه الصورة: فالاعتمادية في البنية التحتية تتحول إلى حجة بيع قائمة بذاتها لذكاء الأعمال.
الصوت يثبت نفسه قناة منتج قائمة بذاتها، لا مجرد ميزة ملحقة. يصل GPT-Live إلى نشره الكامل لدى OpenAI بعد ثلاثة أيام فقط من إطلاقه، مع مضاعفة الحدود لتشجيع التجربة؛ وفي المقابل، تفتح Together AI خطًا هاتفيًا يربط المتصل مباشرة بمساعد صوتي مدعوم بمنصة الاستدلال الخاصة بها. مقاربتان مختلفتان — إحداهما مدمجة في تطبيق قائم، والأخرى متاحة من هاتف تقليدي — للرهان نفسه: واجهة الصوت تصبح نقطة دخول قائمة بذاتها إلى النماذج، لا مجرد خيار من بين خيارات.
المصادر
- تغريدة @Replit — Ramp for Agents
- تغريدة @github — Multilingual Repositories Dataset
- تغريدة @pika_labs — تحرير فيديو مع «Gemini Omni»
- تغريدة @HeyGen — إخراج WebM شفاف
- تغريدة @HeyGen — Talking-Head-Recut Skill
- GitHub — talking-head-recut skill
- تغريدة @togethercompute — خط الاتصال الصوتي
- تغريدة @pika_labs — Pika MCP
- تغريدة @MiniMax_AI — kernel M3 على Blackwell
- تغريدة @athyuttamre — GPT-Live يُنشر بنسبة 100%
- تغريدة @cohere — شراكة NVIDIA وCoreWeave