بحث

Google Cloud تطلق وكيل Gemini للعمل، وHeyGen Voice وسير العمل الديناميكي في Claude Managed Agents

ai-powered-markdown-translator

مقال مترجم من الفرنسية إلى العربية باستخدام gpt-6.1-sol.

عرض المشروع على GitHub ↗

قدمت Google Cloud في 8 أكتوبر، خلال Gemini at Work 2026، وكيل Gemini: وكيل واحد لجميع أعمال المؤسسات، يعمل باستمرار في السحابة وينسق استخدام نماذج Gemini ونماذج Claude على حد سواء. ومن جانبها، أطلقت HeyGen نموذج HeyGen Voice، أول نموذج صوتي تطوره داخليًا، والذي يتصدر تصنيف Controlled Voice لدى Artificial Analysis، بينما أتاحت Anthropic في Claude Managed Agents سير عمل قادرًا على إطلاق ما يصل إلى 1 000 وكيل لكل تنفيذ. وفي مجال البرمجة، يتعلم Codex توقع رسالة المستخدم التالية، ويعتمد على Windows بيئة معزولة جديدة تستند إلى Microsoft Execution Containers.


Google Cloud تطلق وكيل Gemini، وكيلًا واحدًا لجميع الأعمال

8 أكتوبر — خلال Gemini at Work 2026، قدمت Google Cloud وكيل Gemini، الذي تصفه بأنه وكيل واحد شامل للعمل. ومن خلال حقل إدخال واحد وAPI واحدة، يجيب عن الأسئلة، ويتولى العمل الفكري، وينشئ الصور والوسائط، ويكتب الشيفرة وينفذها. والفكرة التي يدافع عنها توماس كوريان، الرئيس التنفيذي لـGoogle Cloud، هي تكليفه بهدف بدلًا من سلسلة تعليمات.

يعمل الوكيل باستمرار في السحابة بذاكرة واحدة، ويتوفر في كل مكان: الويب وiOS وAndroid وWindows وMac وسطر الأوامر وGoogle Workspace وMicrosoft 365 وSlack، أو بلا واجهة (headless) داخل تطبيقات خارجية. وتستمر المهمة التي تستغرق ساعات أو أيامًا حتى مع إغلاق الحاسوب. وللأعمال الطويلة، ينشئ وكلاء فرعيين مؤقتين لكل منهم هوية، ويمكنه أن يصبح وكيلًا زميلًا (coworker agent) بدور دائم، وله عنوان @agents.company.com ومساحة تخزين خاصان به. ويصبح اختيار النموذج مستقلًا: فوفقًا لـGoogle، ينسق الوكيل بالفعل استخدام نماذج Gemini ونماذج Claude من Anthropic، على أن تتبعها نماذج أخرى مغلقة ومفتوحة. وتصل نسخ قطاعية في إصدار معاينة للتمويل، بأكثر من 50 مهارة أساسية تستخدمها بالفعل CME Group وDeutsche Bank، وللمجال القانوني.

مكوّن التحكم المعلنالدور كما تصفه Google
هوية كل وكيلهوية موثقة تشفيريًا، وصلاحيات حسب الدور، وسجل تدقيق باسمه
Agent Sandboxتنفيذ معزول، بحدود شبكية خاصة به
Agent Gatewayجدار حماية شبكي للذكاء الاصطناعي، تمر عبره جميع حركة بيانات الوكيل
حدود الإنفاق في الوقت الفعليفي Cloud Billing، يتوقف وكيل المشروع مؤقتًا، ويُستأنف بنقرة واحدة

وتعرض Google Cloud أرقامها أيضًا: عالج كل واحد من نحو 500 عميل أكثر من 1 000 مليار رمز خلال عام، وتستخدم نحو 90 % من شركات Fortune 100 منصة Gemini Enterprise. لكن المقال لا يحدد موعد توفر الوكيل نفسه ولا سعره؛ إذ تكتفي Google Cloud بذكر عملاء كبار اختبروه مسبقًا، مثل العلامة الرياضية On لاختيار النموذج ديناميكيًا.

🔗 Gemini at Work 2026 (مدونة Google Cloud)

Gemini Enterprise تتيح Claude Opus 5.5 وClaude Sonnet 5.5 في أدوات Antigravity

8 أكتوبر — في اليوم نفسه، تتيح ملاحظات إصدار Gemini Enterprise للمسؤولين تفعيل Claude Opus 5.5 وClaude Sonnet 5.5 في Antigravity 2.0 وAntigravity CLI وامتدادات Antigravity لبيئات IDE. ويقبل المسؤول شروط استخدامهما مباشرة في وحدة تحكم Google Cloud، من دون حساب Anthropic منفصل.

إعداد التفعيلالقيمة التي تحددها Google
الحالة الافتراضيةالنماذج الخارجية معطلة، ويُفعّلها المسؤولون
طريقة الفوترةحسب الاستهلاك، ضمن سقف إنفاق المشروع
مواقع الاستدلالglobal وus وeu
مستويات التفكيرLow وMedium (الافتراضي) وHigh أو Max

يحتفظ المطور بترخيص Gemini Enterprise ويختار Claude من محدد النماذج. ويجب تفعيل التجاوزات (overages) قبل إتاحة نموذج خارجي، وتدخل تكلفته ضمن السقف المشترك لجميع النماذج. وتعلن الصفحة نفسها أيضًا توفر Gemini 3.8 Flash بشكل عام في سنغافورة.

🔗 ملاحظات إصدار Gemini Enterprise


الصوت: HeyGen Voice يتصدر تصنيف Controlled Voice، وMistral تنشر نموذجين للعربية

9 أكتوبر — أطلقت HeyGen نموذج HeyGen Voice، الذي يقدمه جوشوا شو بوصفه أول نموذج صوتي تطوره الشركة داخليًا، بعدما اشتهرت حتى الآن بشخصياتها الافتراضية. ويتوفر النموذج داخل HeyGen وعبر API، بسعر 30 دولارًا لكل مليون حرف؛ وحتى 31 أكتوبر، يدفع مستخدمو API مبلغ 15 دولارًا، ويُطبّق الخصم تلقائيًا.

ويستند هذا الطرح إلى Artificial Analysis، التي نشرت نتائجها قبل HeyGen بدقيقة ونصف. ففي تصنيف Controlled Voice، حيث تتحدث جميع النماذج بالأصوات المستنسخة الـ8 نفسها، بالإنجليزية الأمريكية والبريطانية، يحتل HeyGen Voice المركز الأول بتصنيف Elo يبلغ 1 201 في 1 468 ظهورًا. ويتصدر فيه فئتي المساعدين وخدمة العملاء، وكذلك الإنجليزية البريطانية.

HeyGen Voice takes the #1 spot on the Artificial Analysis Controlled Voice TTS Arena Leaderboard, ahead of Alibaba’s Qwen-Audio-3.1-TTS-Plus and ElevenLabs’ Eleven v4 Turbo

🇸🇦 يتصدر HeyGen Voice تصنيف Controlled Voice TTS Arena لدى Artificial Analysis، متقدمًا على Qwen-Audio-3.1-TTS-Plus من Alibaba وEleven v4 Turbo من ElevenLabs. — @ArtificialAnlys على X

النموذج المُقيّمElo في Controlled Voice (9 أكتوبر)سعر API لكل مليون حرف
HeyGen Voice1 20130 دولارًا (15 حتى 31 أكتوبر)
Qwen-Audio-3.1-TTS-Plus1 18219,3 دولارًا
Eleven v4 Turbo1 16640 دولارًا
Eleven v41 16280 دولارًا

لهذا المركز الأول نطاق محدد: فهو يتعلق باستنساخ الصوت. أما في تصنيف Provider Voice، حيث يستخدم كل مزود أصواته الخاصة، فقد ظل Eleven v4 Turbo وEleven v4 في الصدارة مساء 9 أكتوبر، ولم يكن HeyGen Voice ضمن المراكز الثمانية الأولى. وفي موثوقية النطق، يحقق HeyGen Voice نسبة 83,1 %، أي المركز 10 من أصل 29.

وعلى مستوى API، يكون الاستنساخ فوريًا: يكفي تسجيل واحد، لا تُستخدم منه إلا الدقائق الثلاث الأولى، للحصول على صوت جاهز للاستخدام في بضع ثوانٍ، من دون تدريب. ويُجرى توليد الصوت دفعة واحدة، في ملف WAV بتردد 44,1 kHz، أو عبر البث المتدفق، وقد قيّمت Artificial Analysis إعدادات API الافتراضية.

🔗 إعلان HeyGen

Voxtral Mini 4B Realtime Arabic وLIDstral Arabic: نموذجان من Mistral للعربية

8 أكتوبر — نشرت Mistral على Hugging Face، من دون إعلان، نموذجين مفتوحين بترخيص Apache 2.0 مخصصين للعربية. وينسخ Voxtral Mini 4B Realtime Arabic الكلام باللهجات العربية والعربية الفصحى المعاصرة عبر البث المتدفق، بما في ذلك عندما ينتقل المتحدثون بين اللغات أثناء المحادثة (code-switching). وقد خضع لضبط دقيق انطلاقًا من Voxtral Mini 4B Realtime، ويضم نحو 4,4 مليار معلمة. ووفقًا لبطاقته، طُوّر بالاشتراك مع وزارة الانتقال الرقمي وإصلاح الإدارة المغربية، في إطار الشراكة الموقعة بين Mistral والمغرب في يناير 2026، والتي أنتجت أيضًا اختباري أداء جديدين، هما ISMA وDarija in the Wild.

النموذج المنشوروظيفة النموذجالنتيجة وفقًا للبطاقة
Voxtral Mini 4B Realtime Arabicنسخ الكلام بالعربية عبر البث المتدفقمتوسط معدل الخطأ لكل حرف 8,82 % على 7 اختبارات أداء عند 480 ms، مقابل 7,91 % لـVoxtral Transcribe Arabic
LIDstral Arabicتحديد اللغة واللهجة، 51 فئة، على المعالجدرجة F1 تبلغ 88,67 % على الدارجة المغربية، مقابل 71,28 % لـGlotLID v3

🔗 Voxtral Mini 4B Realtime Arabic على Hugging Face · LIDstral Arabic على Hugging Face


Claude Managed Agents: سير عمل ديناميكي يصل إلى 1 000 وكيل لكل تنفيذ

9 أكتوبر — أتاحت Anthropic في إصدار تجريبي عام سير العمل الديناميكي (dynamic workflows) في Claude Managed Agents، وهو نوع جديد من التنسيق بين وكلاء متعددين. ويكتب الوكيل الذي يقود الجلسة برنامجًا بنفسه، ثم ينفذه الخادم في الخلفية بإطلاق عدد كبير من الوكلاء على مراحل، قبل دمج نتائجهم. وبمجرد تفعيل النوع multiagent_20261001، يصبح الوكيل هو من يقرر إطلاق تنفيذ.

يطلق كل تنفيذ ما يصل إلى 1 000 وكيل، منهم 64 في الوقت نفسه، ويستمر 24 ساعة افتراضيًا، ويمكن للجلسة أن تحتفظ بـ10 عمليات تنفيذ مفتوحة. وتُفوْتر رموزه مثل رموز الجلسة وتُحتسب ضمن ميزانيتها؛ وتحذر Anthropic من أنها قد تكون كثيرة، وتذكر اختبارًا داخليًا على 70 خللًا زُرعت في قاعدة شيفرة تضم 116 000 سطر.

إعداد اختبار Anthropicالأخطاء المكتشفة في 3 تجارب
وكيل منفرد14، 15 و27
سير عمل ديناميكي66 في كل تجربة

🔗 إعلان @ClaudeDevs · وثائق عمليات تنفيذ سير العمل


وكلاء البرمجة: توقعات الرسائل وبيئة MXC المعزولة في Codex، وClaude Code 2.1.296، وVibe CLI 2.26.1

يتلقى Codex ميزتين جديدتين في اليوم نفسه، بينما تنشر Anthropic وMistral إصدارات جديدة من وكلائهما في سطر الأوامر.

Codex يتوقع رسالة المستخدم التالية، في إصدار تجريبي لمشتركي Pro

9 أكتوبر — أتاحت OpenAI في إصدار تجريبي توقعات محرر الرسائل (composer predictions) في تطبيق Codex لسطح المكتب. وعندما ينتهي Codex من الإجابة، قد يظهر اقتراح للرسالة التالية في حقل الإدخال، بناءً على المحادثة الحالية، من دون البحث في الذكريات أو التطبيقات المتصلة. ويُدرجه مفتاح Tab؛ ويظل النص قابلًا للتعديل ولا يُرسل تلقائيًا أبدًا. ويشمل الاقتراح رسالة كاملة، وليس إكمالًا كلمة بكلمة.

شرط الإصدار التجريبيالقيمة التي تحددها OpenAI
الاشتراك والعمراشتراك ChatGPT Pro شخصي، لعمر 18 سنة فما فوق
المحادثات والنماذجمحادثات محلية وعبر SSH، مع GPT-6 Astra أو GPT-6.1 Sol
الإعداد الافتراضيمفعّل، ويمكن تعطيله في General > Composer > Show predictions
التكلفة أثناء التجربةلا تُحتسب ضمن حدود استخدام Codex، ولا تستهلك أرصدة

تظل الرسائل المُرسلة، بما فيها التوقعات المقبولة، تُحتسب بالطريقة المعتادة. ولا تتوفر هذه الميزة في Chat.

🔗 إعلان @OpenAIDevs · مقال المساعدة من OpenAI

Codex على Windows: بيئة معزولة تستند إلى Microsoft Execution Containers

9 أكتوبر — أضافت OpenAI إلى Codex على Windows وضعًا للعزل يستند إلى Microsoft Execution Containers ‏(MXC)، التي أتاحت Microsoft استخدامها بشكل عام في 7 أكتوبر. ويتطلب جهاز Windows 11 متوافقًا (24H2 build 26100.9278 أو 25H2 build 26200.9278)، ويَعِد بإعداد أسرع، وتحكم شبكي أكثر صرامة، وضبط أدق لصلاحيات الوصول إلى الملفات.

ووفقًا للوثائق، يصبح MXC التنفيذ الموصى به: فهو يعزل العمليات بصورة أصلية، من دون إعداد يوافق عليه مسؤول، أو حسابات Windows إضافية، أو قواعد جدار حماية محلية. ويصبح الوضعان elevated وunelevated بديلين احتياطيين موروثين. ويختار تطبيق سطح المكتب MXC تلقائيًا لحسابات الأفراد؛ أما في CLI أو في المؤسسات، فيُفعّل باستخدام prefer_mxc = true في config.toml، ويمكن للمسؤول حظره باستخدام allow_mxc = false. وتوثق الوثائق قيدين: تتطلب الشبكة المُدارة allow_local_binding = true، وتتوقف العمليات الفرعية المتبقية عند انتهاء الأمر الذي يعمل في المقدمة.

🔗 إعلان @OpenAIDevs · وثائق البيئة المعزولة على Windows

Claude Code 2.1.296: ضغط سياق خاص بالوكلاء الفرعيين ونموذج موحّد لوكلاء سير العمل

9 أكتوبر — يتضمن Claude Code 2.1.296 عددًا من البنود يبلغ 79، منها 56 إصلاحًا، ولم ترافقه أي تغريدة. ويمنح خصوصًا مزيدًا من التحكم في الوكلاء الفرعيين.

الميزة الجديدة في الإصدارما الذي تغيره
autoCompactWindow (الوكلاء الفرعيون، --agents)يضغط الوكيل الفرعي سياقه في وقت أبكر من المحادثة الرئيسية
CLAUDE_CODE_WORKFLOW_SUBAGENT_MODELجميع وكلاء سير العمل على نموذج واحد، بينما يحتفظ الوكلاء الفرعيون الآخرون بنماذجهم
الخيار allow_large في Readقراءة ملف نصي كبير باستدعاء واحد، إذا سمح السياق بذلك
CLAUDE_CODE_OVERLOADED_RETRY_MAX_DELAY_MSمدة انتظار قصوى أطول بين محاولتي إعادة التنفيذ بعد خطأ 529
إرسال أوصاف أدوات MCP منذ البدايةرفع الحد الافتراضي من 2 048 إلى 4 096 حرفًا

يحتسب كلٌّ من /cost وسطر الحالة الآن قراءات ذاكرة التخزين المؤقت لـSonnet 5.5 بسعر 0,10 دولار لكل مليون رمز. وفي الجانب الأمني، يصحح الإصدار آليات hooks PreToolUse مُدارة كانت ترفض استدعاءً من دون إنهاء الدور، وفحوصات Bash كانت توافق تلقائيًا على بعض الأوامر التي تستخدم BASH_ARGV0، وجلسات سحابية كانت تتجاوز فحوصات وضع auto عند تنفيذ إجراءات Claude in Chrome، وتعديلات Edit وNotebookEdit التي كانت تستبدل جميع المحارف غير التابعة لـASCII في الملفات غير المشفرة بصيغة UTF-8، والتي أصبحت مرفوضة الآن.

🔗 Claude Code 2.1.296 على GitHub

Vibe CLI 2.26.1 : إزالة نموذج Devstral المحلي، وتوسيع الوضع غير التفاعلي

9 أكتوبر — بعد ثلاثة أيام من إصدار 2.26.0 ومن دون تغريدة، تُصدر Mistral نسخة Vibe CLI 2.26.1. رغم أن رقمها يشير إلى إصدار تصحيحي، تضم النسخة 85 بندًا (23 إضافة، و24 تغييرًا، و36 إصلاحًا، وإزالتين)، منها 37 تخص الواجهة الجديدة المكتوبة بلغة Rust. وتزيل نموذج Devstral المحلي الذي كان مضمّنًا: إذا ظل الإعداد يثبّته، فإنه يعود إلى النموذج المستضاف الافتراضي مع إظهار تحذير. ولم يعد هذا النموذج يتيح سوى مستويين للتفكير، off وhigh، ويعلن نافذة سياق بحجم 256k تتوافق معها عملية الضغط التلقائي.

يحصل الوضع غير التفاعلي vibe -p على حد زمني، وإمكانية قراءة التوجيه من ملف أو من الإدخال القياسي، وتقرير export.json يُكتب عند كل خروج، ورموز خروج منفصلة: 1 لخطأ في الاستخدام أو الإعداد، و2 لعطل في البنية التحتية، و3 لبلوغ حد أو لرفض النموذج. وتضيف Rust CLI ميزة /proxy-setup، وراويًا يقرأ ملخص كل جولة بصوت عالٍ، و/plugins و/whoami. وتمنع إعدادات جديدة الوكيل من تشغيل عمليات في الخلفية أو استخدام وكلاء فرعيين، بينما يظل موصل Document Library معطّلًا افتراضيًا.

🔗 ملاحظات إصدار Vibe CLI 2.26.1


الصور والفيديوهات والألعاب التوليدية : Qwen-Image-2.1-Turbo، ووضع Thinking في Midjourney، وSyren من Synthesia، وPlayground من Google

نموذج صور أسرع وأقل تكلفة، ومولّد يراجع ما أنتجه، ووكيل يحرّر الفيديوهات، ومنصة ألعاب دون كتابة كود.

Qwen-Image-2.1-Turbo : 8 خطوات لإزالة الضوضاء و0,016 دولار للصورة

9 أكتوبر — تنشر Qwen نموذج Qwen-Image-2.1-Turbo، وهو نقطة تحقق مُسرّعة (accelerated checkpoint) من Qwen-Image-2.1 تولّد الصور وتعدّلها في 8 خطوات لإزالة الضوضاء، على البنية نفسها التي تضم 7 مليارات معلمة. وبحسب Qwen، فإنه لا يزال ينتج صورًا بدقة 2K ويقبل تعديلات باللغة الطبيعية، لكن لم تُنشر أي أرقام عن الجودة أو السرعة تخص هذا الإصدار. الأوزان متاحة على Hugging Face وModelScope، بموجب رخصة Qwen البحثية (Qwen Research License). وتتضمن نقطة التحقق جدول أخذ العينات الخاص بها من 8 خطوات، وتعمل افتراضيًا بقيمة CFG تبلغ 1.

وفي اليوم نفسه، تتيح Qwen رسميًا واجهات API لنموذجي Qwen-Image-2.1 Pro وTurbo؛ وتمنح QwenCloud نموذج Turbo معدلًا قدره 120 طلبًا في الدقيقة.

النموذج المقدَّم عبر API (Model Studio)السعر لكل صورةالصور المجانية
qwen-image-2.1-turbo0,016 دولار10
qwen-image-2.1-pro0,04 دولار10
qwen-image-2.0-pro0,075 دولار100

🔗 إعلان Qwen · بطاقة النموذج على Hugging Face

Midjourney تختبر وضع Thinking وتتيح المجلدات المشتركة على موقعها التجريبي

8 أكتوبر — يعرض سجل تغييرات النسخة التجريبية من Midjourney، المنشور مساءً، ميزتين في مرحلة مبكرة، تقتصران حاليًا على موقع alpha.midjourney.com. الأولى اختبار: عند توليد صورة باستخدام V8.2 أو تعديلها، يطلب زر Rerun (Thinking) من النموذج النظر في النتيجة، وتحديد مواضع ابتعادها عن التوجيه (العناصر، والتخطيط، والتشريح، والنص)، ثم توليدها مجددًا. وتقول Midjourney إنها تلاحظ نتائج أفضل في الالتزام بالتوجيه، وجودة الكتابة، والاتساق، وتفكر في تحويله إلى وضع عام.

أما الثانية فهي مشاركة المجلدات: يمكن دعوة متعاونين يولّدون الصور مباشرة داخل المجلد، أو قرّاء، ويمكن مشاركته عبر رابط، بل وفتحه لأي عضو في Midjourney. وتوضح Midjourney أن المشاركة لا تغيّر مدى ظهور الصور: دون وضع stealth، يمكن أن تظل ظاهرة على Explore وفي الملفات الشخصية.

🔗 سجل تغييرات النسخة التجريبية من Midjourney · اختبار وضع Thinking (Midjourney)

Syren : Synthesia تسند إنشاء الفيديو إلى وكيل في نسخة تجريبية

9 أكتوبر — تطلق Synthesia نسخة تجريبية من Syren لجميع عملائها، بما في ذلك الحسابات المجانية. يصف المستخدم الفيديو المطلوب، أو يقدّم مستندات أو صورًا أو فيديوهات أو عروض PowerPoint أو روابط YouTube، فيسلّم Syren فيديو مكتملًا يضم رسومًا متحركة (motion graphics) وشخصيات افتراضية وتعليقًا صوتيًا وموسيقى ولقطات تكميلية (b-roll)، يمكن تعديله لاحقًا عبر المحادثة. وبحسب بيتر هيل، المدير التقني في Synthesia، يكتب الوكيل الفيديو بأكمله على هيئة كود، يعرضه مباشرة محرك عرض طوّرته الشركة داخليًا وتستخدمه في رسوم Synthesia المتحركة منذ يونيو.

تصل مدة الفيديوهات إلى 3 دقائق، بتنسيق أفقي أو عمودي، وتُعرض داخل المتصفح. وتُحتسب التكلفة بوحدات رصيد، دون تسعير مفصّل، ويمكن لمسؤولي Enterprise تعطيل الأداة. ويعلن المقال قرب إتاحة تعلّم هوية العلامة التجارية تلقائيًا من الفيديوهات الموجودة. ويأتي Syren بعد أربعة أيام من HyperFrames Studio من HeyGen، وبعد يوم واحد من Claude Motion من Anthropic، وهما أداتان أخريان ينتج فيهما وكيل الفيديو.

🔗 تقديم Syren (Synthesia)

Playground : Google تتيح منصة لإنشاء الألعاب دون كتابة كود

7 أكتوبر — تطلق Google منصة Playground، وهي منصة ألعاب تجريبية يمكن فيها إنشاء الألعاب ولعبها ومشاركتها بوصفها في بضعة توجيهات، دون كتابة كود. وفي واجهة محادثة، يبدأ المستخدم من صفحة فارغة، أو مثال يعيد تعديله، أو مسار إرشادي، ثم يضبط عند الطلب الفيزياء أو القواعد أو الشخصيات أو البيئة.

تعمل الألعاب في المتصفح، على الهاتف والحاسوب، ويمكن إبقاؤها خاصة، أو مشاركتها برابط، أو إضافتها إلى معرض Explore، مع قوائم ترتيب ولعب متعدد اللاعبين لبعض الأنواع؛ وتخضع كل لعبة منشورة لفحص أمني. وتتاح Playground في الولايات المتحدة لمن يبلغون 18 عامًا فأكثر، بصلاحيات إنشاء تعتمد على اشتراك Google AI. كما أُعلن عن قرب إتاحة تكامل مع Unity Spark في نسخة تجريبية مغلقة، لإنشاء ألعاب 3D أكثر طموحًا. ولم تحدد Google النموذج الذي يشغّل المنصة.

🔗 تقديم Playground (مدونة Google)


الصحة : نشر الدراسة السريرية لـ AMIE في The Lancet

8 أكتوبر — تنشر Google ومركز Beth Israel Deaconess Medical Center (BIDMC) في The Lancet دراسة استشرافية لجدوى AMIE (Articulate Medical Intelligence Explorer)، وهو نظام الذكاء الاصطناعي الحواري للتشخيص من Google؛ وبحسب Google، فهذا أول بحث لها يُنشر في مجلة The Lancet الرئيسية. وتحادث المرضى مع AMIE قبل استشارة عاجلة بما يصل إلى خمسة أيام، ثم تلقّى الطبيب نص المحادثة وملخصًا.

مقياس الدراسةالنتيجة المنشورة
المرضى المشمولون (من أبريل إلى نوفمبر 2025)، ثم الذين جرت متابعتهم114, ثم 98
حالات الإيقاف لأسباب تتعلق بالسلامة0
الهلوسات المرصودة1
فائدة AMIE في التحضير للزيارة، بحسب الطبيب33 حالة من أصل 44 (75 %)
التشخيصات المتوافقة مع التشخيص النهائي (Google)90 %

أُجريت الدراسة في موقع واحد، دون مجموعة ضابطة وبتمويل من Alphabet، وهي لا تمثل ترخيصًا أو نشرًا فعليًا: يدعو مؤلفوها إلى تجارب أوسع.

🔗 مقال Google · المقال في The Lancet


الأبحاث في OpenAI : الرد على رسالة ثلاثة باحثين أنهت الشركة علاقتها بهم

9 أكتوبر — في مذكرة نُشرت على @OpenAINewsroom باسم مسؤولي الأبحاث لديها، ترد OpenAI على رسالة ثلاثة باحثين تقول إنها أنهت علاقتها بهم في الأسبوع السابق. وبحسب OpenAI، خلص تحقيق داخلي إلى أنهم خالفوا قواعد واضحة بشأن التعامل مع معلومات حساسة، وأدى ذلك إلى فقدان الثقة لأسباب تتجاوز ما تعرضه رسالتهم؛ وتتمسك OpenAI بقرارها. وتؤكد أن هذه القرارات لا تتعلق بإثارة مخاوف بشأن السلامة أو بالتحدث علنًا، وأنها لا تفصل أي موظف بسبب التعبير عن مخاوفه.

وتعلن المذكرة أيضًا:

We are actively finalizing contracts with third-party safety assessors and will announce details in the coming weeks.

🇸🇦 نعكف على استكمال عقود مع جهات خارجية لتقييم السلامة، وسنعلن تفاصيلها خلال الأسابيع المقبلة. — @OpenAINewsroom على X

وتقول OpenAI إنها تتفق مع الرسالة في نقطة واحدة: الحفاظ على قابلية مراقبة (monitorability) النماذج الرائدة يتطلب التزامًا من القطاع بأكمله، بما فيه OpenAI. وينقل هذا المقال رواية OpenAI؛ ولم تُراجَع رسالة الباحثين.


بناء نماذج مفتوحة : ستة نماذج بنحو 103 دولارات باستخدام ML Intern، ومجدول GPU لدى Ai2

تجربتان في بناء النماذج: إحداهما من جانب الوكيل، والأخرى من جانب عناقيد الحوسبة.

ML Intern : ستة نماذج مفتوحة بنحو 103 دولارات من الحوسبة

8 أكتوبر — بعد عرضه هنا في 1 و8 أكتوبر من زوايا أخرى، يحصل وضع ML Intern في HuggingChat على أول حصيلة رقمية في مدونة Hugging Face: ستة مشاريع أُنجزت من البداية إلى النهاية، بتكلفة حوسبة إجمالية تبلغ نحو 103 دولارات. يبدأ كل مشروع برسالة وينتهي بنموذج متاح للعامة على Hub، بما في ذلك التقييم. يخطط الوكيل، ويطلب الإذن قبل أي مهمة حوسبة مدفوعة، ويشغّل اختبارًا قصيرًا، ثم يدرّب النموذج ويقيّمه وينشره باستخدام عتاد Hugging Face.

النموذج الذي أنتجه ML Internالنتيجة المنشورةتكلفة الحوسبة
Pocket Rewriter (0.8B)99,7 % من المخرجات صالحة، ونحو ربع عدد الرموز في نموذج إعادة الصياغة بحجم 9B الخاص بـ Qwen-Image 2.1نحو 16 دولارًا
Citrus Doctor (Qwen3.5-2B)من 14,9 % إلى 52,8 % من التشخيصات الصحيحة لأمراض الحمضياتنحو 1,90 دولار
نموذجا LoRA لـ Qwen-Image 2.1تغيير زاوية الرؤية، واستبدال خربشة بالعنصر المطلوبنحو 16 و24,30 دولارًا
Huggy LoRA (FLUX.2 klein)LoRA لشخصيةنحو 7,60 دولارات
Agate بـ 4 خطواتتقطير نموذج صور صغير، من 50 خطوة (100 تمريرة مع التوجيه) إلى 4نحو 37 دولارًا

🔗 مقال Hugging Face

مجدول GPU لدى Ai2 : انخفاض مدة الانتظار الوسيطة من 5 دقائق إلى 24 ثانية

9 أكتوبر — تعرض Ai2 تفاصيل المجدول الجديد لعناقيد GPU لديها، في مقال كتبه جيريمي تريبا. يتشارك نحو 150 باحثًا آلاف وحدات GPU من NVIDIA H100 وB200 وB300، ضمن عناقيد تضم من 88 إلى 1 024 وحدة GPU، بطلب يعادل ضعفي العرض إلى ثلاثة أضعافه. وكان النظام القديم القائم على الأولويات يترك مهام فارغة «تحتجز» وحدات GPU، وينتهي فيه جميع أعباء العمل عند أعلى أولوية.

يعتمد النظام الجديد على ميزانيات وقت GPU موزّعة على مستويات الهيكل التنظيمي للأبحاث، وتقاسم عادل هرمي (fair-share) يُحسب على أساس نافذة متحركة من سبعة أيام، و«عقد جدولة»: يعلن كل عبء عمل مدة محمية لا تتجاوز 8 ساعات، يمكن بعدها مقاطعته وإعادته إلى قائمة الانتظار. ويظل الوقت غير المخصّص مجانيًا، لكنه يبقى قابلًا للمقاطعة دائمًا.

المؤشر الذي تقيسه Ai2المجدول القديمالمجدول الجديد
مدة الانتظار الوسيطة، أكبر عنقود H1005 دقائق24 ثانية
مدة الانتظار p90 لأعباء تصحيح الأخطاء2 ساعة30 ثانية
ساعات GPU المستحقة التي جرى توفيرها خلال 30 يومًا—98 %

تنخفض الإصلاحات التي تتطلب تدخلًا بشريًا بنسبة 74 %. وتقر Ai2 بوجود قيود، مثل الجلسات التفاعلية التي تصبح قابلة للمقاطعة بعد 8 ساعات، بعدما كان يمكن أن تستمر أسبوعًا، ولا تنشر أي كود.

🔗 مقال Ai2


نماذج القرار : pplx-decider-v1.1-27b يتصدر Decision Bench، في تعادل إحصائي مع تسعة نماذج أخرى

9 أكتوبر — يحصل نموذج القرار من Perplexity، الذي جرت تغطيته في 6 و8 أكتوبر، على نتيجة خارجية. ففي Decision Bench، وهو اختبار مفتوح المصدر من Atlan Frontier Labs (1 071 سؤالًا مغلقًا، و36 مجموعة بيانات، و15 نموذجًا مصنّفًا)، يحقق pplx-decider-v1.1-27b أعلى نتيجة خام، 94,5 %، بأقل تكلفة، 0,017 دولار لكل 1 000 قرار. لكن الموقع يمنح الترتيب نفسه للنماذج التي تتداخل فترات ثقتها البالغة 95 %: تتقاسم عشرة نماذج المركز الأول.

النموذج المقيَّم على Decision Benchالدقة المقاسةالتكلفة لكل 1 000 صف
pplx-decider-v1.1-27b94,5 %0,017 دولار
DeepSeek V4.1 Flash94,2 %0,683 دولار
Gemini 3.5 Flash94,2 %3,32 دولارات
Jev 1.1393,8 %0,044 دولار

وتنشر Perplexity أيضًا دليلًا عمليًا (cookbook) لوكيل تصفح، يقرر فيه الكود النقرات، ولا يتولى النموذج ذلك أبدًا، ويحل الإصدار v1.1 محل v1 في API.

🔗 سلسلة منشورات @perplexitydevs · ترتيب Decision Bench


Grok Bot يحصل على عنوان بريد إلكتروني خاص به

9 أكتوبر — أصبح لدى Grok Bot، وكيل SpaceXAI، عنوان بريد إلكتروني خاص به. ويمكن لـ Bot استخدامه للتسجيل في خدمات، أو التواصل مع شركات نيابة عن المستخدم، أو تحديد موعد مع شخص ما. وتُطرح الميزة في اليوم نفسه: يكفي طلب عنوان من Bot أو الإشارة إلى @bot على X، وفي الفرق، يتعين على المسؤول تفعيلها أولًا.

يقتصر الإعلان على سلسلة منشورات من حساب @bot، أعاد @grok نشرها، دون مقال على x.ai. ولا يحدد شكل العناوين أو نطاقها، ولا خطط الاشتراك المعنية. وبعد معرّف Slack الخاص بـ Team Bots في أواخر سبتمبر، يحصل الوكيل بذلك على هوية تخصه للعمل خارج المنصة.

🔗 إعلان Grok Bot


ElevenLabs تستقر في سنغافورة، مركزها لجنوب شرق آسيا

8 أكتوبر — تعلن ElevenLabs رسميًا دخولها سنغافورة، حيث تفتح الشركة مكتبًا ليكون مركزًا لجنوب شرق آسيا، ولمنطقة آسيا والمحيط الهادئ على نطاق أوسع. ويسلط المقال الضوء على البنية التحتية القائمة بالفعل: منذ يوليو، تستطيع الشركات استضافة بياناتها في سنغافورة، مع خيارات لعدم الاحتفاظ بالبيانات وزمن استجابة أقل في المنطقة.

وتذكر ElevenLabs خصوصًا عملاءها في المنطقة: Funding Societies، التي تؤهّل عملاءها المحتملين باستخدام الذكاء الاصطناعي الحواري في خمسة أسواق، وBoost Bank في ماليزيا، وSalmon Group في الفلبين، وMNC Group في إندونيسيا، وRezonate، وهي منصة صحية تستخدمها 60 % من المستشفيات الحكومية في سنغافورة. ولم تُذكر أي أرقام لعدد العاملين. ويأتي هذا التوسع بعد افتتاح مكاتب في بروكسل وأمستردام، في أواخر سبتمبر ومطلع أكتوبر.

🔗 مقال ElevenLabs


موجز الأخبار

  • Projects في Claude Code — أتاحت Anthropic الوصول لجميع مشتركي Pro وMax المسجلين في قائمة الانتظار. ولا تزال Projects في المرحلة التجريبية: تظل القائمة مفتوحة، وستُتاح إمكانية الوصول لمزيد من المستخدمين حسب السعة المتاحة، ولم تُطرح الميزة بعد في Team أو Enterprise، وفقًا للوثائق. 🔗 المصدر
  • دليل أتمتة الوكلاء — يصف دليل على claude.dev تنفيذًا مرجعيًا باستخدام Claude Managed Agents، يقرأ قنوات Slack وطلبات السحب على GitHub وفق جدول زمني ثم ينشر ملخصًا في Slack، ويفصّل مكوناته الستة وتدابير التعامل مع الأعطال الشائعة، مثل عدم اعتبار تعذّر قراءة مصدر دليلًا على هدوء اليوم، أو تحديد سقف الإنفاق بما يعادل 3 إلى 5 أضعاف تكلفة التشغيل المعتاد. 🔗 المصدر
  • Block وClaude Fable — في مقابلة نشرتها Anthropic، توضح Block أن Claude Fable يخطط لعمليات ترحيل شيفراتها الكبيرة ويوجه ما يصل إلى عشرات نماذج Opus أو Sonnet، وصولًا إلى دمج ما يصل إلى ألف طلب سحب في عملية ترحيل واحدة؛ ويظل الدمج والنشر في بيئة الإنتاج من اختصاص البشر، مع اشتراط موافقتين على عمليات النشر. 🔗 المصدر
  • Compliance API في Claude Enterprise — تعيد نقاط نهاية المحادثات (endpoints) أيضًا، في المرحلة التجريبية وباستخدام المفتاح الحالي، محادثات تجربة Claude الموحدة: تُعاد المحادثة التي استُكملت في جلسة سحابية كمحادثة واحدة، مع عمل Claude ضمن كتل tool_use وtool_result. 🔗 المصدر
  • Codex CLI 0.162.1 — يزيل هذا الإصلاح للإصدار 0.162.0 انهيار واجهة TUI عند عرض أسئلة غير متزامنة متعددة الأسطر، وإخفاقات بدء التشغيل عندما تختلف إعدادات ميزات خادم يعمل مسبقًا في الخلفية عن إعدادات CLI. 🔗 المصدر
  • الإضافات حسب الدور في ChatGPT Enterprise وEdu — عند تفعيل التحكم في الوصول القائم على الأدوار (RBAC)، يضبط المالكون والمسؤولون الوصول إلى الإضافات لكل دور على حدة: Available أو Install أو Disabled لمساحة العمل، وDefault لكي يرث الدور المخصص هذا الإعداد. 🔗 المصدر
  • Sophos وOpenAI Daybreak — وفقًا لشركة الأمن السيبراني، تقلّص وكلاؤها المبنيون باستخدام Daybreak متوسط زمن الاستجابة للحالات التي يعالجونها من نحو 38 دقيقة إلى نحو 89 ثانية، ويحل الذكاء الاصطناعي 52 % من حالات MDR لديها من البداية إلى النهاية؛ وتظل الإجراءات التدميرية تحت إشراف بشري. 🔗 المصدر
  • Asana ووكيل التصفح من StackAI — وفقًا لـ Asana، حسّن GPT-6 Astra في Codex هذا الوكيل خلال نحو أسبوع: باستخدام GPT-6.1 Sol، تبلغ تكلفة تشغيل اختباري 0,47 دولار ويستغرق نحو أربع دقائق، أي أقل تكلفة بـ 76 مرة وأسرع بـ 5 مرات من إعداد الإنتاج الأصلي. 🔗 المصدر
  • LegalOn وCodex — تقول LegalOn Technologies إنها خفّضت تكاليفها اليومية المقدّرة لاستخدام Codex بنحو 65 % عبر الانتقال من GPT-5.5 في الوضع السريع غير المحدود إلى توزيع المهام بين GPT-6 Luna وGPT-6.1 Sol وGPT-6 Astra، مع تفعيل الوضع السريع عند الطلب ووضع سقوف لكل قسم ولكل شخص. 🔗 المصدر
  • Gemini CLI v0.64.0-preview.1 — يزيل هذا الإصدار التجريبي الإنذارات الكاذبة لتحذير Untrusted Command Flags Detected عند استخدام أوامر صدفة غير ضارة: تُستثنى خيارات القراءة فقط، وتُحفظ متغيرات الصدفة، وتُسمح الحلقات عندما تكون لكل أمر فرعي قاعدة ALLOW خاصة به. ولم يصدر أي إصدار ليلي في 9 أكتوبر، ويظل الإصدار المستقر هو v0.63.0. 🔗 المصدر
  • Antigravity 2.22.0 — يمكن للإضافات عرض واجهتها الخاصة في اللوحة الجانبية (UI Extensions)، ويمكن ترتيب المحادثات بالسحب والإفلات من قسم إلى آخر في الشريط الجانبي، وتعرض الطوابع الزمنية اسم الشهر. 🔗 المصدر
  • إيقاف التوصية باستخدام Gemini 3.7 Flash — في Gemini API، تُعاد توجيه الاستدعاءات إلى gemini-3.7-flash نحو gemini-3.8-flash، وسيُوقف الوكيل القديم deep-research-pro-preview-12-2025 في 23 أكتوبر، لصالح deep-research-preview-04-2026 أو deep-research-max-preview-04-2026. 🔗 المصدر
  • إضافات VST3 وAU لـ Google Flow Music — من أخبار 6 أكتوبر: يمكن تصدير Spaces، وهي الآلات الموسيقية والمؤثرات المنشأة باللغة الطبيعية، كإضافات لمحطات العمل الصوتية الرقمية (Digital Audio Workstations)، مثل إضافة No Chaser للمنتج كريس ريديك تاينز. 🔗 المصدر
  • Google Earth AI والصحة العامة — من أخبار 6 أكتوبر: خلال تفشي الإيبولا في جمهورية الكونغو الديمقراطية، أتاح نموذج أولي لوكيل استدلال جغرافي مكاني للمكتب الإقليمي لأفريقيا في منظمة الصحة العالمية تحديد 48 منطقة مأهولة معرّضة للوباء وأكثر من 45 500 شخص معرّض للخطر خلال دقائق؛ ويحدد نموذج PDFM أيضًا المناطق المعرّضة لخطر الكوليرا قبل ما يصل إلى 8 أسابيع. 🔗 المصدر
  • فوترة Copilot code review — يمكن لمالكي المؤسسات تحميل تكلفة المراجعات التي يطلبها أعضاؤهم الحاصلون على تراخيص على المؤسسة المالكة للمستودع، بدلًا من استهلاك حصص الأعضاء، إذا كان الاستخدام المدفوع لـ AI Credits مفعّلًا، وقصر طلب المراجعات على التراخيص التي توفرها المؤسسة أو الشركة. 🔗 المصدر
  • Copilot CLI 1.0.95 — أصبح هذا الإصدار مستقرًا، ويجري المصادقة على macOS عبر وسيط Microsoft Entra الأصلي، مع اللجوء إلى المتصفح عند تعذّر ذلك؛ ويوضح الإصدار التجريبي 1.0.96-0 في الخط الزمني الجهة التي حسمت كل إذن: المستخدم، أو Assisted Permissions، أو سياسة، أو الآلية البديلة التي تعمل دون إشراف. 🔗 المصدر
  • GitHub MCP Server 2.0 — من أخبار 6 أكتوبر: يعيد خادم MCP الرسمي من GitHub مخرجات ذات أنواع محددة، تصفها مخططات للمخرجات (output schemas)، للوكلاء العاملين في Code Mode أو باستخدام استدعاء الأدوات برمجيًا؛ ولا يُعلن عن هذه المخرجات إلا للعملاء الذين يستخدمون مواصفة MCP 2026-07-28 أو أحدث. 🔗 المصدر
  • Claude Haiku 5.5 في Genspark — تتيح Genspark النموذج في AI Chat وCode Agent وClaw، مستندةً إلى طرح Anthropic بأنه أقل تكلفة في التشغيل بنحو 75 % من Haiku 4.5، دون باقة أو تسعيرة خاصة به. 🔗 المصدر
  • قالب Meta VR لـ v0 — تنشر Meta بالتعاون مع Vercel قالبًا لـ v0 يستند إلى Immersive Web SDK: يصف المستخدم تجربة، فيكتب v0 شيفرتها ويعرض معاينتها، وتنشرها نقرة واحدة على Vercel لفتحها في متصفح Quest؛ ويدعم القالب بالفعل تتبّع النظر واليدين في Meta VR Glasses، المتوقع طرحها في ربيع 2027. 🔗 المصدر
  • v0 for teams — تعرض v0 في فيديو طريقة الاطلاع على عمل زملاء الفريق، والانضمام إلى محادثاتهم، والبناء معًا؛ وتبرز التغريدة ميزات وصلت على مراحل منذ سبتمبر، دون تسعيرة جديدة. 🔗 المصدر
  • DeepSeek Harness 0.2.1-alpha.2 — الإصدار التجريبي السادس والعشرون، ولا يزال دون إصدار مستقر: يثبّت كتالوج الإضافات حزم Claude Code وCodex عند الطلب، وتظهر إضافتان تجريبيتان هما Git Worktrees وترجمة الاستدلال، ويمكن جلب التعليمات العامة من ملف AGENTS.md مشترك. 🔗 المصدر
  • OGX 1.5.0 — يضيف Llama Stack سابقًا، الذي تغيّر اسمه في أبريل وخرج من مؤسسة meta-llama، تمريرًا أصليًا لواجهة API /v1/messages إلى DeepSeek وFireworks AI، ومزوّد Text-Embeddings-Inference، والبحث على الويب عبر Exa وSerply، وعميل MCP 2.x، مع أربعة تغييرات تكسر التوافق. 🔗 المصدر
  • GenIA — تنشر Meta دون إعلان، بموجب الترخيص غير التجاري CC BY-NC 4.0، شيفرة هذا العمل المنجز بالتعاون مع Tübingen AI Center: يعيد بناء أجسام ثلاثية الأبعاد من صورة واحدة أو بضعة مناظير أو فيديو، عبر مواءمة المعرفة المسبقة المجمّدة في SAM 3D Objects وقت الاستدلال، دون إعادة تدريب. 🔗 المصدر
  • وسم decision-model على Hub — تمنح Hugging Face نماذج القرار وسمًا خاصًا بها، مع أيقونة ومرشّح في صفحة Models؛ وتُوسم ملفات GGUF الخاصة بالقرار تلقائيًا استنادًا إلى بياناتها الوصفية في llama.cpp. 🔗 المصدر
  • Darwin-27B-ZTC-v2 — تعلن VIDRAFT أن الإصدار الجديد من نموذج التحكيم لديها، المتاح بموجب Apache-2.0، يتصدر System One Mosaic Benchmark الذي يضم 137 اختبارًا، بدرجة Borda تبلغ 89,58، متقدمًا على OpenJev-27B بدرجة 87,50 وJev 1.13 بدرجة 85,05؛ وهو ترتيب يعلنه مطوروه ويقدمونه باعتباره لقطة من جدول ترتيب عام. 🔗 المصدر
  • ثقة نماذج القرار — يبيّن ستيفن سولكا في تدوينة مجتمعية أن GPT-6 Luna Decisions، عند استدعائه عبر OpenRouter، يجيب «لا يتطابق» في 600 عملية تحقق باستخدام SHA-256، بدقة 50 % ومتوسط ثقة 99,8 %؛ وفي الاستدلال السببي، تتيح عتبة 99 % انتقاء 47 إجابة صحيحة من أصل 49، لكنها لا تغطي سوى 8,2 % من الحالات. 🔗 المصدر
  • openai-math في بيئات التعلّم المعزّز — تنقل FineEnvs إلى بيئات Harbor عددًا قدره 369 من أصل 405 نتائج مصاغة رسميًا بلغة Lean في منشور openai/math: على الوكيل إثبات مبرهنة داخل بيئة Lean 4 معزولة، ولا يمنح Comparator المكافأة إلا لإثبات كامل للصياغة المحددة دون تغيير؛ وهي مجموعة تجريبية بموجب Apache-2.0. 🔗 المصدر
  • JOSIE-2 — ينشر غوكدنيز غولمز التقرير التقني لهذه العائلة بأحجام 2B و4B و9B، التي خضعت لتدريب لاحق انطلاقًا من Qwen3.5 على جهازي Mac M4، باستخدام نحو 3 000 مثال مختار: في وضع الاستدلال، يحقق JOSIE-2-4B درجة 95,5 على ARC-Challenge بزيادة (+12,1)، و69,2 على TruthfulQA بزيادة (+20,3)، على اختبارين معياريين فقط. 🔗 المصدر
  • Gradio 6.30 — يضيف gr.Workflow عرضًا للتطبيق، ويعيد أمر «تشغيل هذه العقدة» استخدام نتائج العقد السابقة التي لا تزال محدّثة بدلًا من إعادة تنفيذ الرسم الفرعي بأكمله؛ ويحافظ gr.ImageEditor على قناة ألفا للصور المحمّلة. 🔗 المصدر
  • tokenizers 0.23.3 — يقبل هذا الإصلاح، المقتصر على حزمة Python، الإصدار v2 من huggingface_hub، مما يزيل عائق تثبيت Transformers وفقًا للملاحظات، ويتراجع عن تغيير في الإصدار 0.23.1 كسر التوافق في اقتطاع النصوص. 🔗 المصدر
  • المراجعة العلمية بالذكاء الاصطناعي — تعرض Sakana AI ورقة بحثية قُبلت في TMLR: يُدرج اختبار معياري ادعاءات متناقضة داخل أوراق بحثية للتحقق من قدرة المراجعين بالذكاء الاصطناعي على رصدها، ويكشف نظامها Multi-Layered Review عددًا أكبر منها مقارنة بالأنظمة الأخرى المختبرة، وفقًا لإعلان Sakana AI الذي لا يورد أي أرقام. 🔗 المصدر
  • Suno Studio — تتزامن المقاطع بشكل أفضل مع الضربة الأولى وتتمدد لمجاراة إيقاع المشروع، وتصبح انتقالات التلاشي أسّية أو لوغاريتمية، ويمكن فصل المُركّب الصوتي ولوحة المفاتيح وعروض الإضافات وعرضها حتى على شاشة ثانية؛ ويشمل اشتراك Premier خدمة Studio. 🔗 المصدر
  • World Models’ Last Exam in Physics — في اختبار الفيزياء هذا من Einsia لنماذج الفيديو، والذي يضم 40 مهمة و9 فئات وثمانية نماذج، يتصدر Seedance 2.5 بدرجة 57,76 من 100، متقدمًا على MiniMax H3 بدرجة 54,89، وهو أفضل نموذج مفتوح وفقًا لـ MiniMax، وCosmos 3 Super من NVIDIA بدرجة 42,46؛ وهو اختبار معياري من جهة خارجية. 🔗 المصدر
  • محاكاة Omniverse يبنيها الوكلاء — تعرض مدونة NVIDIA فرقًا من الشركة تستعين بـ GPT-6 Astra، وفي حالة واحدة بـ Claude Fable 5، لتجميع محاكاة باستخدام مكتبات ovphysx وovstage وovrtx وovui، منها توائم رقمية أُنشئت أو حُسّنت خلال نحو ثلاثة أيام؛ ولا يتضمن ذلك منتجًا جديدًا. 🔗 المصدر
  • إدارة متجر Shopify — بعد ربط المتجر، يمكن لـ Grok Bot التحقق من الطلبات، ومتابعة المخزون، وتحديث صفحات المنتجات؛ ولم تُحدّد أي باقة أو حدود. 🔗 المصدر
  • البحث على X — من أخبار 7 أكتوبر: يمكن لـ Grok Bot البحث في X وقراءته ومراقبته لجميع المستخدمين، دون إعداد موصل X، مثلًا لمتابعة الآراء حول منتج أو تلقي ملخص أسبوعي عن القطاع؛ وفي أواخر أغسطس، كان لا يزال يتعين ربط الحساب. 🔗 المصدر
  • Grokipedia v0.3 — وفقًا لحسابها الرسمي، نشرت الموسوعة التي يكتبها Grok خلال أسبوع أكثر من 4 400 مقالة طلبها القراء، وأجرت أكثر من 2 200 تعديل يوميًا، بمتوسط 78 مصدرًا لكل مقالة جديدة؛ وتعرض صفحة الآن تعديلاتها مباشرة. 🔗 المصدر
  • mistral CLI 0.8.0 — ينشر mistral apps deploy أيضًا عمليات تنفيذ مسارات العمل وجميع الوحدات دفعة واحدة، بما في ذلك ضمن التكامل المستمر باستخدام مفتاح API فقط، ويشغّل mistral apps dev قاعدة Postgres محلية في Docker؛ وفي المقابل، لم يعد يُقرأ .env الموجود في المجلد الحالي. 🔗 المصدر
  • Mistral Python SDK 3.2.0 — تقبل استدعاءات المحادثة والوكلاء الاحتمالات اللوغاريتمية (logprobs) للإجابة والموجّه على السواء، إضافةً إلى top_k، وعقوبة للتكرار، وحد أدنى لعدد الرموز؛ وهو إصدار مولّد تلقائيًا، دون إعلان. 🔗 المصدر
  • Qwen Code v0.25.1-preview.1 — ثاني إصدار تجريبي من v0.25.1 خلال ثلاثة أيام، مع 16 ميزة و27 إصلاحًا جديدًا، منها تعاون متعدد الوكلاء يتمحور حول الجلسة، وخطافات PreToolUse تعدّل مدخلات الأداة مع إعادة تحقق كاملة؛ ولم يصدر الإصدار المستقر بعد. 🔗 المصدر
  • Claude Haiku 5.5 في Agent API من Perplexity — من أخبار 7 أكتوبر: تقبل Agent API النموذج anthropic/claude-haiku-5-5 بتسعيرة Anthropic، وهي 0,10 دولار لكل مليون رمز إدخال و0,50 لكل مليون رمز إخراج حتى 100 000 رمز إدخال، ثم 0,50 و2,50 عند تجاوز ذلك. 🔗 المصدر
  • استدلال مشترك أو مخصص — يوضح دليل من Cohere لاستخدام Embed وRerank أن شكل الطلبات أهم من عددها، ويحسب عتبات توضيحية للجدوى الاقتصادية مقارنةً بمثيل مخصص يستخدم وحدة GPU واحدة من طراز NVIDIA A10: نحو 4 طلبات في الدقيقة للمستندات الطويلة، و20 لكتالوج، و29 لإعادة الترتيب (reranking). 🔗 المصدر
  • وكيل أو MCP — تنشر Perplexity دليلًا يميز بين الوكيل الذي يتخذ القرارات، وMCP الذي يربطه بالأدوات، مع جدول للاختيار، ومثال لمتجر إلكتروني، وأربعة مخاطر وتدابير الوقاية منها؛ ووفقًا للدليل، يمكن لـ Claude أو ChatGPT أو Cursor إسناد مهمة إلى Computer عبر خادم MCP من Perplexity. 🔗 المصدر

ما الذي يعنيه ذلك

بات وكيل واحد ينسّق عمل كثير من الوكلاء الآخرين، ويحصل كل منهم على هوية. يطلق وكيل Gemini وكلاء فرعيين لكل منهم هويته الخاصة، ويمكن أن يصبح وكيلًا زميلًا له عنوانه الخاص؛ وتتيح Claude Managed Agents لوكيل كتابة برنامج يطلق ما يصل إلى 1 000 وكيل؛ ويحصل Grok Bot على عنوان بريد إلكتروني ليعمل خارج المنصة، وتعهد Block إلى Claude Fable بقيادة عشرات النماذج في عملية ترحيل واحدة. لم يعد السؤال المطروح هو ما إذا كان الوكيل قادرًا على أداء العمل، بل كيفية ضبطه. تجيب Google عن ذلك عبر Agent Gateway وAgent Sandbox وسجل تدقيق باسم كل وكيل وحدود للإنفاق تُطبَّق في الوقت الفعلي؛ وتجيب Anthropic بميزانية للجلسة تُعلّق جميع عمليات التنفيذ بمجرد بلوغها؛ أما OpenAI فتقدّم بيئة معزولة على Windows تفرض قيودًا أشد على الشبكة والملفات.

بدأ استخدام نماذج متعددة يترسّخ لدى المنصات نفسها. تتيح Google، التي تطوّر Gemini، لوكيلها الخاص تنسيق عمل نماذج Claude، وتفصل بوضوح بين اختيار النموذج واختيار الوكيل، وتتيح Claude Opus 5.5 وSonnet 5.5 في Antigravity، مع احتساب تكلفتهما ضمن حد الإنفاق نفسه المطبّق على نماذجها. وتضيف Genspark وAgent API من Perplexity نموذج Claude Haiku 5.5 خلال الأيام التالية لإطلاقه، وتوزّع LegalOn أعمال البرمجة على ثلاثة نماذج من OpenAI بحسب طبيعة المهام، وتبني Block آلية لاختيار النموذج تلقائيًا.

تواصل تكلفة الوحدة انخفاضها، ويقدّم كل إعلان أرقامًا محددة: 0,016 دولار للصورة مع Qwen-Image-2.1-Turbo، أي أرخص بمقدار 2,5 مرة من إصدار Pro؛ و15 دولارًا لكل مليون حرف مع HeyGen Voice حتى 31 أكتوبر، ثم 30 دولارًا، وهي تكلفة أقل من Eleven v4 Turbo؛ و0,017 دولار لكل 1 000 قرار مع pplx-decider-v1.1-27b؛ وستة نماذج منشورة على Hub بتكلفة حوسبة تبلغ نحو 103 دولارات باستخدام ML Intern. أما المراكز الأولى فتتطلب قراءة متأنية: لا يتصدر HeyGen Voice إلا التصنيف الذي تُضبط فيه الأصوات، ويتقاسم pplx-decider مركزه مع تسعة نماذج أخرى تتداخل فترات الثقة الخاصة بها.

في مجال الصحة، يظل الحذر ضروريًا. دراسة AMIE المنشورة في The Lancet هي دراسة جدوى أُجريت في موقع واحد، من دون مجموعة ضابطة وبتمويل من Alphabet: شملت 98 مريضًا، ولم تُوقَف أي محادثة لأسباب تتعلق بالسلامة، ورُصدت هلوسة واحدة. إنها خطوة نحو تجارب أوسع يطالب بها المؤلفون أنفسهم، وليست تصريحًا بالاستخدام ولا نشرًا للنظام لخدمة المرضى.


المصادر