بحث

Google تطلق Gemini 3.8 Live، وSalesforce تصل إلى Claude، وGPT-5.5 سيغادر ChatGPT في 14 أكتوبر

ai-powered-markdown-translator

مقال مترجم من الفرنسية إلى العربية باستخدام gpt-5.6-sol.

عرض المشروع على GitHub ↗

هذا الثلاثاء، تطلق Google نموذجي Gemini 3.8 Live وGemini 3.8 Live Extended Thinking، وهما نموذجان للحوار الصوتي في الوقت الفعلي قادران على استدعاء الأدوات في الخلفية من دون قطع المحادثة. وتنشر Anthropic ثلاثة إصدارات من Claude Code وتُدخل Salesforce إلى Claude، بينما تحدد OpenAI يوم 14 أكتوبر موعدًا لإزالة GPT-5.5 من ChatGPT وCodex. كما تشق الوكلاء طريقها إلى قنوات التوزيع القائمة، بدءًا من HP التي تثبّت Perplexity مسبقًا وصولًا إلى بيع Devin على AWS Marketplace، فيما تكشف NVIDIA تفاصيل مكوّنين من منصتها Vera Rubin.


Gemini 3.8 Live و3.8 Live Extended Thinking، نموذجان صوتيان ينفذان المهام أثناء التحدث

15 سبتمبر — تطلق Google نموذجين للحوار الصوتي في الوقت الفعلي، قدّمهما فريق Gemini Audio. يستهدف Gemini 3.8 Live قابلية التوسع والسرعة والتكلفة: فهو يقبل مدخلات مرئية في وقت شبه حقيقي وينتقل تلقائيًا بين 97 لغة أثناء المحادثة. أما Gemini 3.8 Live Extended Thinking فهو موجّه إلى المهام التي تتطلب استدلالًا متعدد الخطوات: إذ يستدل ويتحدث في الوقت نفسه، ويؤكد الاستلام بعبارات تمهيدية قصيرة، ويعلّق على تقدم مهامه الخلفية؛ ويمكن ضبط مستوى تفكيره في API. وينفذ النموذجان استدعاءات الأدوات وواجهات API في الخلفية (asynchronous function calling) مع استمرار الاستجابة الصوتية.

The models talk, think, and handle tasks in the background without breaking your flow.

🇸🇦 تتحدث النماذج وتفكر وتدير المهام في الخلفية من دون مقاطعة سياق محادثتك.@GoogleDeepMind على X

وتسلط Google الضوء أيضًا على الدقة في البيانات الأبجدية الرقمية المُملاة، مثل رموز التأكيد أو أرقام الملفات، وتقدم هذه النماذج بوصفها بديلًا أبسط للبنى المتسلسلة التي تربط بين النسخ ومعالجة النص والتركيب الصوتي. ووفقًا لبطاقة نموذج Gemini 3.8 Audio، يستند النموذجان إلى Gemini 3 Pro، ويقبلان الصوت والصور والفيديو والنص ضمن سياق يبلغ 128K tokens، وينتجان ما يصل إلى 64K tokens في المخرجات، ويعتمدان على معرفة متوقفة عند يناير 2025.

التصنيف أو المعيارالنموذج المقيّمالنتيجة التي نشرتها Google
مؤشر جودة تحويل الكلام إلى كلام (Artificial Analysis)3.8 Live Extended Thinking82,6 (المركز الأول)
τ-Voice3.8 Live Extended Thinking68,6 %
τ-Voice-banking (Sierra)3.8 Live Extended Thinking35,1 %
Big Bench Audio3.8 Live Extended Thinking97,7 %
Speech Agent Arena (Artificial Analysis)3.8 Liveالمركز الثاني

تدير جهات خارجية هذه التصنيفات، لكن النتائج المذكورة هي التي تنشرها Google. وفي Live API، تقدّر Google تكلفة النموذجين بـ0,005 دولار لكل دقيقة صوت واردة و0,018 دولار لكل دقيقة صوت صادرة، استنادًا إلى 3 دولارات لكل مليون tokens في الإدخال و12 دولارًا في الإخراج؛ وتذكر Agora وFishjam وLangChain وLiveKit وPipecat وVercel وVision Agents بوصفها جهات تكامل.

قناة التوزيعGemini 3.8 LiveGemini 3.8 Live Extended Thinking
Gemini API وGoogle AI Studioابتداءً من 15 سبتمبرابتداءً من 15 سبتمبر
Gemini Enterpriseمعاينة خاصةمعاينة خاصة
الجمهور العامSearch LiveGemini Live، وDocs Live (لمشتركي Google AI Pro وUltra)، وGmail Live وKeep Live (لجميع مشتركي Google AI)

في Search Live، يوجه النموذج المستخدم خطوة بخطوة في استكشاف الأعطال وإصلاحها في الوقت الفعلي. وتحمل جميع المواد الصوتية المُنشأة العلامة المائية غير المرئية SynthID.

🔗 تقديم Gemini 3.8 Live و3.8 Live Extended Thinking 🔗 تدوينة المطورين حول Live API 🔗 بطاقة نموذج Gemini 3.8 Audio


Claude Code من 2.1.271 إلى 2.1.273: الوضع السريع في Remote، وشبكة لكل أمر، وأذونات أكثر إحكامًا

15 سبتمبر — تنشر Anthropic ثلاثة إصدارات من Claude Code في أكثر قليلًا من 22 ساعة، صدر أولها بعد منتصف الليل بقليل بتوقيت باريس.

الإصدار المنشورالتاريخ والوقت (UTC)محتوى الملاحظات
2.1.27114 سبتمبر، 22:1296 سطرًا: الوضع السريع في Remote، وallowed_domains لكل أمر، وomitClaudeMd، و--accept-command
2.1.27215 سبتمبر، 00:42سطر واحد: إصلاحات للأخطاء وتحسينات للموثوقية
2.1.27315 سبتمبر، 20:2364 سطرًا: ترويسات لبوابات LLM، ونسخ جلسات Remote Control، ومصنّف محلي على Bedrock وVertex وFoundry

يفتح الإصدار 2.1.271 الوضع السريع (fast mode) لجلسات Claude Code Remote، سواء في السحابة أو على مشغلات ذاتية الاستضافة (self-hosted runners)، حيثما تسمح المؤسسة بذلك. وفي الوضع التلقائي مع صندوق الحماية، تقبل Bash وPowerShell وMonitor قائمة allowed_domains لكل أمر: تُفحص المضيفات المطلوبة مع الأمر وتُفتح له وحده، فيما تُرفض المضيفات الأخرى. ويشغّل الحقل omitClaudeMd في frontmatter الخاص بالوكلاء وكيلًا فرعيًا من دون ملفات CLAUDE.md الخاصة بالمستخدم والمشروع والمحلية، مع استمرار تحميل ملفات السياسات المُدارة، ولا يقبل claude plugin install --accept-command <sha256> سوى الأمر المطابق تمامًا لما عُرض خلال انتقال سابق في --json، بدلًا من -y. ويتيح الإصدار 2.1.273 نسخ (fork) جلسة بدأت باستخدام claude --remote-control من تطبيق Claude، لتعمل الجلسة المنسوخة بعد ذلك في الخلفية على الحاسوب. كما ينبه عند انقطاع اتصال خادم MCP وتوقف إعادة الاتصال التلقائية، ويضيف ترويسات طلب لبوابات LLM تُفعّل بواسطة CLAUDE_CODE_GATEWAY_HINT_HEADERS=1.

العنصر المعدّلالسلوك الجديد
عودة وكيل فرعي في الوضع التلقائياستدعاء مخصص لإعادة التحكم (hand-back call) يفحصه مصنّف الأمان، بدلًا من فحص لاحق لرسالته الأخيرة
أوامر ! الخاصة بالـskills وأوامر slash في الوضع التلقائيقواعد أذونات الوضع الافتراضي بدلًا من المصنّف
عمليات مراقبة Monitorمهلة إلزامية لا تتجاوز 30 دقيقة (10 في تنفيذ -p)، مع إخطار Claude لإعادة تفعيلها
مسارات العمل الديناميكيةتوقف مؤقت عند بلوغ حد الاستخدام واستئناف تلقائي عند إعادة التعيين، بدلًا من التخلي عن الوكلاء
الوضع التلقائي على Bedrock وVertex وFoundry (2.1.273)مصنّف محلي افتراضيًا في الوقت الحالي، وCLAUDE_CODE_AUTO_MODE_SERVER=1 لاستخدام مصنّف المنصة

ويصلح الإصداران أيضًا عدة ضوابط للأذونات. فقد كانت أوامر تحتوي على shell فرعي، أو تغييري مجلد، أو سلسلة cd + git تتجاوز المطالبة ضمن permissions.blockReadsOutsideWorkingDirectories، وكان بإمكان shell فرعي إخفاء rm خطير في وضع تجاوز الأذونات (bypass). كما كانت إعدادات MCP المفروضة عبر MDM أو managed-settings.json تُتجاهل بمجرد وجود إعدادات مُدارة من جانب الخادم. وكان /resume و/teleport يحتفظان بتتبّع الملفات المقروءة من المحادثة السابقة، ما كان يتيح لـClaude تعديل ملفات لم تقرأها المحادثة المستأنفة قط. وأخيرًا، كان مقياس السياق يحتسب جولات أداة advisor بنحو ضعف حجمها، مما كان يؤدي إلى تشغيل الضغط التلقائي عند نحو منتصف النافذة.

لا تذكر أي من ملاحظات الإصدارات الثلاثة Claude Mods التي أُعلن عنها في 14 سبتمبر؛ إلا أن مختبرين من المجتمع يرون في issue #91870 أن الإصدار 2.1.272 أثّر بالفعل في نطاقها.

🔗 ملاحظات إصدار Claude Code 2.1.271 🔗 ملاحظات إصدار Claude Code 2.1.273


Salesforce in Claude، إضافة للمبيعات في إصدار تجريبي للمؤسسات المعتمدة

15 سبتمبر — تطلق Anthropic إصدارًا تجريبيًا من Salesforce in Claude، الذي يجلب إلى Claude حسابات مندوب المبيعات وفرصه ومسار مبيعاته. وتعرض التدوينة إضافة صُممت بالتعاون مع Salesforce، في حين ينسب مركز المساعدة إلى Salesforce بناء 37 من skills المبيعات الخاصة بها: البحث عن الحسابات، والتحضير للمكالمات، ومراجعة مسار المبيعات، وتحديث CRM. ويرافقها موصلان، أحدهما لـSalesforce للقراءة والكتابة، والآخر لـSlack من أجل قنوات الأعمال ومحادثات الفرق.

تظل Salesforce نظام السجل المرجعي: يتصل كل مندوب مبيعات ببيانات اعتماده الخاصة، ولا يقرأ Claude إلا ما تسمح به أذوناته في Salesforce، ويجب الموافقة افتراضيًا على كل عملية كتابة. وتعمل الإضافة في الدردشة وفي Claude Cowork (على الويب وسطح المكتب). ويشمل الإصدار التجريبي الخطط المدفوعة، لكن فقط للمؤسسات التي تقبلها Salesforce عبر التسجيل في الإصدار التجريبي وتمتلك أحدث إصدار مؤسسي من Sales Cloud؛ ويطلب مسؤولو Salesforce لديها الوصول عبر AgentExchange. وقد نشرتها GitLab وSiemens وLegora، ويستخدمها 7 000 مندوب مبيعات في Salesforce.

🔗 جلب Salesforce إلى Claude 🔗 إعداد Salesforce in Claude للمؤسسة


سيغادر GPT-5.5 خدمات ChatGPT وChatGPT Work وCodex في 14 أكتوبر، لكنه سيبقى في API

15 سبتمبر — تعلن OpenAI على X إنهاء توفر GPT-5.5 في تطبيقاتها، وهو ما أُدرج بالفعل في سجل تغييرات ChatGPT وCodex بتاريخ 14 سبتمبر. وفي 14 أكتوبر، سيغادر النموذج ChatGPT وChatGPT Work وCodex في جميع الخطط: الجمهور العام، وBusiness، وEnterprise، وEdu.

الواجهة المعنيةالوضع في 14 أكتوبر
ChatGPT وChatGPT Workإزالة GPT-5.5 من جميع الخطط
Codex مع تسجيل الدخول عبر ChatGPTإزالة GPT-5.5، مع طلب الانتقال إلى gpt-5.6-sol
Codex باستخدام مفتاح APIاستمرار توفر GPT-5.5
OpenAI APIاستمرار توفر GPT-5.5

بالنسبة إلى Codex مع تسجيل الدخول عبر ChatGPT، تطلب الوثائق استبدال gpt-5.5 في كل موضع اختير فيه صراحةً: الإعدادات الافتراضية لمساحة العمل، والإعدادات المحفوظة، والتكوينات المُدارة، والوكلاء المخصصون، والمهام المجدولة، والبرامج النصية. كما تذكر رسالة حساب @ChatGPT نموذج GPT-6 Astra بوصفه بديلًا في Codex. ويحذر دليل المسؤولين من أن تغيير النموذج الافتراضي لا يمنح الوصول إليه: إذ يجب التحقق، لكل عميل على حدة، من أن البديل متاح للمستخدمين المعنيين. وتكرر OpenAI مهلة الإشعار المسبق البالغة شهرًا التي طُبقت على GPT-5.4 وGPT-5.4 mini، اللذين أُزيلا من Codex في 31 أغسطس للمستخدمين المسجلين عبر ChatGPT، بعد إعلان صدر في 31 يوليو.

🔗 سجل تغييرات ChatGPT وCodex 🔗 رسالة @ChatGPT على X


تثبّت HP تطبيق Perplexity مسبقًا على حواسيب Windows، مع اتصال بـAutodesk Revit

15 سبتمبر — تعلن Perplexity وHP التثبيت المسبق لتطبيق Perplexity لنظام Windows في شريط المهام على حواسيب الشركة المصنّعة، بدءًا من محطة العمل المحمولة ZBook Ultra G3a المجهزة بمعالجات AMD Ryzen AI Max PRO من سلسلة 400؛ وستتبعها طرازات أخرى خلال الأشهر المقبلة، من دون قائمة أو أسعار أو موعد. ووفقًا للتدوينة، تتيح قدرات الذكاء الاصطناعي المحلية في ZBook Ultra G3a تنفيذ المهام المعتادة باستخدام Portable Computer، وهو الإصدار المحلي من الوكيل الذي يعمل من دون أرصدة سحابية ومن دون اتصال، لكن توفره يعتمد على تهيئة الجهاز: لا تسرد التدوينة التهيئات المتوافقة، في حين كان إصدار Windows المنشور في اليوم السابق يتطلب GPU من نوع NVIDIA RTX بذاكرة فيديو لا تقل عن 24 غيغابايت.

ويتصل Portable Computer أيضًا بـAutodesk Revit، برنامج نمذجة معلومات البناء (Building Information Modeling)، عبر خادم MCP الخاص بـRevit 2027، والمتاح في معاينة تقنية (Tech Preview) بوصفه وحدة مستقلة. ويقتصر الوصول على القراءة: يجيب الوكيل عن أسئلة بشأن النموذج، مثل عدد أبواب أحد الطوابق أو درجة مقاومتها للحريق، ويصدّر العروض وملفات PDF والجداول من دون تعديلها. ويتاح Personal Computer for Windows لمشتركي Pro وMax وEnterprise على Windows 10 و11.

🔗 وصول Perplexity إلى مزيد من حواسيب Windows مع HP


توقّع Cognition اتفاقًا مع AWS وتطلق macOS في Devin Cloud

15 سبتمبر — تنشر Cognition إعلانين في اليوم نفسه، تربط بينهما البنية التحتية: فأجهزة Mac التي يبني عليها Devin تطبيقات Apple الآن هي مضيفات AWS EC2 Mac.

اتفاقية تعاون استراتيجي مع AWS

أبرمت Cognition وAmazon Web Services اتفاقية تعاون استراتيجي (Strategic Collaboration Agreement) متعددة السنوات، من دون أن تحدد التدوينة قيمتها أو مدتها الدقيقة. وهناك عنصران مطبّقان بالفعل: يمكن شراء Devin عبر AWS Marketplace، ويمكن استخدام Agent Toolkit for AWS مباشرة داخل Devin. وتجري دراسة عمليات تكامل أعمق مع بيئات AWS الخاصة بالعملاء، من دون جدول زمني محدد. ويُنشر Devin في بيئة أحادية المستأجر (single-tenant)، ضمن منطقة AWS التي يختارها العميل، مع الاحتفاظ بالبيانات داخل VPC مخصص وتخصيص آلة افتراضية لكل جلسة، تُحذف عند انتهاء العمل.

العميل الذي ذكرته Cognitionالنتيجة المعلنة
Mercedes-Benzتحليل أكثر من 200,000 سطر من COBOL، وتقليص مشروع قُدّرت مدته بثمانية أشهر إلى ثمانية أيام
شركة تصنيع سيارات لم يُكشف اسمهاترحيل تدفق COBOL من 25,000 سطر من حاسوب مركزي (mainframe) إلى AWS Lambda، بتكلفة تقديرية أقل بنسبة 73%

🔗 تدوينة Cognition حول الاتفاقية مع AWS

وصول macOS إلى Devin Cloud

في 31 يوليو، كانت Cognition قد عرضت بالفعل وكلاء Devin سحابيين يعملون بنظام macOS، مع Xcode ومحاكي iOS. ويقدم إطلاق 15 سبتمبر في Devin Cloud، لبناء تطبيقات iPhone وiPad وMac والتحقق منها، عدة مزايا جديدة: يرسل Devin عبر Slack تسجيل شاشة لاختباراته، ويوفر رابط TestFlight لتثبيت التطبيق، كما تعرض لوحة iOS Simulator جديدة التطبيق أثناء تشغيله. ويتحكم الوكيل أيضًا في التطبيقات من خلال شجرة إمكانية الوصول الخاصة بها، المتاحة لأداة استخدام الحاسوب (computer use) لديه: يستعلم عن عنصر تحكم بحسب دوره واسمه، ويتفاعل معه، ثم يعيد قراءة الشجرة، مع استمرار استخدام لقطات الشاشة لتقييم المظهر. وتعتمد هذه الطبقة على accessibility-cli مفتوح المصدر من Dioxus، الذي انضم فريقه إلى Cognition في 10 سبتمبر.

تعمل آلات macOS الافتراضية باستخدام Virtualization.framework من Apple على أجهزة Mac فعلية من AWS EC2 Mac، مع إضافة واجهة NBD (Network Block Device) إلى نظام اللقطات (snapshots) لاستئناف جلسة من دون إبقاء الجهاز قيد التشغيل. وتحل بوابة Ethernet ضمن مساحة المستخدم محل NAT المُدار من Apple لتطبيق سياسة الشبكة الخاصة بكل جلسة. ولم يُحدد السعر أو العرض المعني.

🔗 جلب macOS إلى Devin


15 سبتمبر — تشرح تدوينتان في المدونة التقنية لـNVIDIA كيف توفر منصة Vera Rubin الطاقة أثناء الاستدلال وكيف تتحمل أعطال شبكتها. والأرقام الواردة أدناه مقدمة من NVIDIA.

Groq 3 LPX، تنفيذ حتمي لتقليل هامش الجهد

جرت تغطية دخول Groq 3 LPX مرحلة الإنتاج هنا في 24 أغسطس؛ وتشرح هذه التدوينة آليته. فقبل التنفيذ، يحدد مترجم شرائح LPU، بدقة دورة الساعة، توقيت كل عملية حسابية وكل عملية نقل بيانات عبر الشرائح الـ256 في الرف، ما يتيح له التنبؤ بسحب التيار. وتستفيد من ذلك تقنيتان: تطلب Preemptive Power (PEP) من شبكة إمداد الطاقة رفع الجهد قبيل ذروة الطلب، بينما تطيل Clock Period Synthesis (CPS) دورات الساعة التي يرتفع فيها التيار بأسرع وتيرة. والهدف هو تقليل هامش الجهد (voltage guardband) الذي تحتفظ به كل دائرة، وهو مكلف لأن القدرة تزداد مع مربع الجهد: فزيادة الجهد بنسبة 10% تعني زيادة القدرة بنسبة 21%.

في الاختبارات الداخلية، انخفض هبوط الجهد بأكثر من 60%. وتقدّر NVIDIA أنه عند تشغيل حمل مماثل، قد تنخفض القدرة المطلوبة بنسبة «منخفضة من خانتين» (low-double-digit) مقارنة بنظام غير حتمي مماثل. وستصل عناصر التحكم هذه إلى Vera Rubin في النصف الثاني من عام 2026.

🔗 تدوينة NVIDIA حول التنفيذ الحتمي لـGroq 3 LPX

يربط NVLink 6 وحدات Rubin GPU الـ72 في رف Vera Rubin NVL72 ضمن نطاق واحد؛ وكانت سرعة تمرير الحزم التي تقول NVIDIA إنها تفوق بدائل Ethernet العامة بعشرة أضعاف قد ذُكرت هنا بالفعل في 21 يوليو. وتفصّل التدوينة هذه المرة القدرة على تحمل الأعطال، طبقةً تلو الأخرى.

مستوى الحزمةالآلية التي وصفتها NVIDIA
الطبقة الماديةتصحيح أخطاء خفيف، مدعوم بإعادة إرسال على مستوى الطبقة المادية (Physical Layer Retry)
طبقة الربطتحكم في التدفق قائم على الاعتمادات (credit-based flow control)، يمنع فقدان الحزم بحكم التصميم
إدارة الروابطاسترداد برمجي في نحو 1.5 ثانية عبر NMX Controller
خدمة الاستدلالShadow Engine Recovery ‏(NVIDIA Dynamo): تقليص الانقطاع من 283 إلى 7.3 ثانية على GPU B200
نقاط تحقق متعددة العقددعم cuda-checkpoint بواسطة NCCL في إصدار أولي، مع توقع الإتاحة العامة بحلول نهاية العام

لا يرسل التحكم في التدفق القائم على الاعتمادات حزمةً إلا إذا كانت القفزة التالية تملك مساحة لاستقبالها، بينما يعتمد Ethernet على PFC وECN. أما Shadow Engine Recovery، فيحتفظ بنسخة مطابقة من محرك الاستدلال مهيأة مسبقًا ولها وحدات اتصال NCCL خاصة بها.

🔗 تدوينة NVIDIA حول مرونة NVLink 6


Gemini Notebook يعلن المحادثة الصوتية مع دفاتر الملاحظات ومسجلًا صوتيًا

15 سبتمبر — بالتزامن مع بدء العام الجامعي، يغيّر Gemini Notebook مظهره ويعلن سلسلة من أدوات الدراسة، لا يزال معظمها مرتقبًا.

أداة الدراسة المعلنةالإتاحة المحددة
محادثة صوتية آنية مع دفاتر الملاحظات، على الأجهزة المحمولة، بما يقارب 100 لغةهذا الأسبوع للمشتركين البالغين في Google AI Ultra، وقريبًا لمشتركي Google AI Pro وغيرهم
مسجل صوتي داخل تطبيق الأجهزة المحمولةبدءًا من الأسبوع المقبل
معاينات تعليمية تفاعلية في Reportsخلال الأسابيع المقبلة، لجميع المستخدمين
اختبارات بإجابات قصيرة أو باختيارات متعددة أو بملء الفراغاتخلال الأسابيع المقبلة، لجميع المستخدمين
Short Video Overviews بأكثر من 80 لغة، قابلة للمشاركةمتاحة الآن، مقارنة بأكثر من 70 لغة في 1 سبتمبر

ستجيب المحادثة الصوتية اعتمادًا على مصادر دفتر الملاحظات، وسيكون من الممكن مقاطعتها صوتيًا، بينما سيسجل المسجل محاضرة أو فكرة مباشرة داخل دفتر الملاحظات، إلى جانب المصادر. وستجمع المعاينات التعليمية بين الملخصات والرسوم المعلوماتية والاختبارات وبطاقات المراجعة (flashcards). وفي ما يتعلق بعروض الطلاب، التي سبق تقديمها في أغسطس، توضح Google أن سنة Google AI Pro المجانية للطلاب الأمريكيين ترفع الحدود في Gemini Notebook إلى أربعة أضعاف، وأن سنة Google AI Plus المقدمة في أكثر من 140 سوقًا أخرى تضاعفها.

🔗 حسّن روتينك الدراسي باستخدام أدوات Gemini Notebook الجديدة


Antigravity 2.14.0 يتيح الطرفية المدمجة وGit لحسابات Enterprise وBusiness

15 سبتمبر — يتيح Antigravity 2.14.0، الذي يتضمن 10 تحسينات و18 إصلاحًا، لحسابات Enterprise وBusiness الطرفية المدمجة والتحكم في إصدارات Git ضمن الشريط الجانبي، بعدما وصلا مع الإصدار 2.10.0 في 24 أغسطس إلى الحسابات الأخرى. وأصبحت المحادثات ذات السجل الطويل جدًا تُحمّل بسرعة أكبر وتستهلك ذاكرة أقل، كما أُزيل تحليل زائد للـskills والقواعد وملفات التخصيص كان يُعاد تشغيله مع كل رسالة.

ومن بين الإصلاحات، لم يعد خطأ مؤقت في الخدمة ينهي الجلسة، بل تُعاد المحاولة مع مهلة متزايدة لمدة اثنتي عشرة دقيقة تقريبًا. ولم تعد الوكلاء الفرعية المكتملة تظهر بوصفها نشطة فتحجب الرسائل اللاحقة إلى حين إعادة التشغيل، كما أُصلح تسرب للذاكرة مرتبط بمخرجات أوامر الطرفية. ويشير عنوان الإصدار إلى نظام أذونات جديد، لكن الملاحظات تقتصر في هذا الشأن على إعادة تسمية قسم الإعدادات العامة إلى «Global Permissions» وخيار وراثة إعدادات المشروع إلى «Inherit Global».

🔗 سجل تغييرات Google Antigravity


IBM Research تقلّص إلى النصف فجوة اتساق وكيل باستخدام ALTK-Evolve

15 سبتمبر — نشرت IBM Research على مدونة Hugging Face الجزء الثالث من سلسلتها ALTK-Evolve، المخصص هذه المرة لاتساق تنفيذ الوكلاء. ففي 168 مهمة من AppWorld، ينجح وكيل ReAct يعمل باستخدام GPT-4.1 مضبوط على درجة حرارة 0 في 77.4% في المتوسط من عمليات التنفيذ عبر خمس محاولات (Mean@5)، لكنه ينجح في المحاولات الخمس كلها في 53.0% فقط من المهام (Pass^5). وتطلق IBM على هذا الفرق البالغ 24.4 نقطة اسم فجوة الاتساق (consistency gap).

يحدد Consistency Analyzer القرارات غير المستقرة انطلاقًا من مسار واحد مسجل: إذ يعيد تشغيل كل خطوة بلا اتصال، طالبًا خمس عمليات إكمال، من دون حقيقة مرجعية، ومن دون إعادة تشغيل المهمة، ومن دون الوصول إلى logits. وتتحول الخطوات الهشة إلى إرشادات للاتساق (consistency guidelines)، تُحقن وقت الاستدلال.

إعداد الوكيلدرجة Mean@5درجة Pass^5فجوة الاتساق
ReAct GPT-4.1 من دون إرشادات77.4%53.0%24.4 نقطة
ReAct GPT-4.1 مع إرشادات الاتساق81.0%69.0%12.0 نقطة

على gpt-oss-120b، ترتفع Pass^5 من 10.1% إلى 16.1%. وقد دُمج Analyzer وتوليد الإرشادات في مستودع ALTK-Evolve مفتوح المصدر.

🔗 تدوينة IBM Research على مدونة Hugging Face


Aillis تعتمد Sakana Namazu في Evidence Finder، بنسبة 96.4% في الامتحان الوطني الياباني للطب

14 سبتمبر — تعتمد Aillis، وهي شركة يابانية تصمم أجهزة طبية قائمة على التعلم الآلي، نموذج Sakana Namazu، وهو LLM متخصص في اللغة اليابانية أطلقته Sakana AI مطلع أغسطس، ضمن Evidence Finder، أداة البحث عن الأدلة المخصصة للأطباء. ونُشر البيان في الساعة 11 صباحًا بتوقيت طوكيو، ثم أعادت Sakana AI نشره على X في اليوم نفسه عند الساعة 3:30 مساءً بتوقيت المحيط الهادئ، بعد رصدنا الصادر في 14 سبتمبر. ويكتب Evidence Finder، انطلاقًا من الأدبيات الطبية، إجابات تستشهد بمراجعها، وتتحقق ميزة Verify لديه من وجود تلك المراجع؛ كما تبدأ الشركتان عملًا مشتركًا حول الاستخدامات الطبية.

حصل إصدار Evidence Finder المعتمد على Sakana Namazu على 96.4% (482 نقطة من 500) في الدورة الـ120 من الامتحان الوطني الياباني للطب، في فبراير 2026. ووفقًا لرصد Aillis في 1 سبتمبر، فهذه أفضل نتيجة بين نماذج الأساس المحلية التي عيّنها برنامج GENIAC التابع لوزارة الاقتصاد اليابانية. ويتضمن البيان تحفظين: رُفعت قيود المنتج في هذا الاختبار، ومنها رفض الأسئلة المصورة، في حين أن الخدمة التجارية لا تعالج إلا الأسئلة النصية، كما أن Evidence Finder ليس جهازًا طبيًا.

🔗 بيان Aillis على PR Times 🔗 إعادة نشر Sakana AI على X


Google تقيس استخدام الذكاء الاصطناعي وتأثيره الاجتماعي بالأرقام

15 سبتمبر — نشرت Google في اليوم نفسه سلسلتين من التدوينات المخصصة للاستخدام الفعلي للذكاء الاصطناعي وتداعياته الاجتماعية.

إتاحة AI & Economy ATLAS للجمهور، مع دراسة عن العلماء

أصبح AI & Economy ATLAS، وهو البرنامج البحثي التابع لمكتب كبير الاقتصاديين في Google، والذي استُمدت منه الأرقام المتعلقة بالإجراءات الإدارية المذكورة هنا في 9 سبتمبر، تجربة تفاعلية متاحة للجميع: ويمكن فيها مقارنة استخدام الذكاء الاصطناعي حسب المهنة، وفي المنزل، وبلدًا ببلد.

مؤشر ATLAS المُبرزالقيمة التي نشرتها Google
الهند: حصة مهن الفنون والتصميم والإعلام من الاستخدام المهني للذكاء الاصطناعي19%، أي 1.6 ضعف المتوسط العالمي
الولايات المتحدة: حصة الحوسبة والرياضيات30%، أي ضعف بقية العالم
البرازيل وألمانيا: حصة المهام اليدوية، مثل تشخيص المعدات7%، مقابل 4% في اليابان

تشير دراسة أجرتها Google وGoogle DeepMind وMIT FutureTech، استنادًا إلى تحليل 2,600 نموذج متخصص للذكاء الاصطناعي واستطلاع شمل أكثر من 600 عالم أمريكي وبريطاني، إلى أن ما يقرب من نصفهم يستخدمون الذكاء الاصطناعي يوميًا، ويقولون إنهم يوفرون أقل بقليل من 7 ساعات أسبوعيًا. ويشير المؤلفون أيضًا إلى السلبيات: الوقت المستغرق في التحقق من مخرجات الذكاء الاصطناعي، وتنامي قائمة الفرضيات غير المختبرة بانتظار التجارب المادية وعمليات التحقق السريرية.

🔗 رؤى جديدة من AI & Economy ATLAS التابع لـGoogle

الذكاء الاصطناعي من أجل التأثير المجتمعي: اللغات، والفائزون بدعم Google.org، وFireSat

تعمل تقنيات المجموعة بأكثر من 300 لغة وفقًا لـ Google، يتحدث بها أكثر من 7 مليارات شخص، كما أُنشئت عدة مجموعات بيانات بالتعاون مع شركاء محليين. وتعرض Google أيضًا Language Explorer، وهي أداة تفاعلية تعرض بصريًا قاعدة LinguaMeta المفتوحة.

المبادرة التي ذكرتها Googleالرقم المُعلن
WAXAL، مجموعة بيانات صوتية مفتوحة27 لغة من أفريقيا جنوب الصحراء
Project Vaaniأكثر من 30,000 ساعة من الكلام بـ109 لغات
Google.org Impact Challenge: AI for Government Innovation15 فائزًا، و30 مليون دولار، وأكثر من 2,600 طلب
FireSatأول دفعة من الأقمار الصناعية التشغيلية في المدار، مع استهداف نحو 50 قمرًا بحلول 2030 للحصول على صورة كل 20 دقيقة
Planetary Prediction Engine، الذي عُرض في أواخر أغسطسرصد 83% من بؤر تفشي Ebola الناشئة مسبقًا في جمهورية الكونغو الديمقراطية، وفقًا لـ Google

يحصل الفائزون بدعم Google.org، ومنهم Code for America لخدمات الإقرار الضريبي وجامعة Johns Hopkins للسلامة على الطرق، على إرشاد تطوعي من مهندسي Google، ويصممون مشروعاتهم باعتبارها نماذج مفتوحة المصدر قابلة لإعادة الاستخدام.

🔗 الذكاء الاصطناعي للجميع بكل اللغات 🔗 15 منظمة تُحدث تحولًا في الخدمة العامة بالذكاء الاصطناعي 🔗 بناء الذكاء الاصطناعي لتسريع العلوم وتحسين الحياة 🔗 اكتشاف حرائق الغابات بالذكاء الاصطناعي


موجز الأخبار

  • Anthropic تنشر دليلًا لنشر Claude داخل فرق المبيعات — صدر في اليوم نفسه الذي صدر فيه Salesforce in Claude، ويُعرض بناء مؤسسة إيرادات قائمة على الذكاء الاصطناعي في تدوينة تذكر عميلين: تقول Cox Communications إنها حققت عائدًا يعادل 7 أضعاف استثمارها في السنة الأولى، وخفّضت تكلفة التحقق من بيانات العملاء المحتملين وإثرائها بنسبة 86%، مع ارتفاع الدقة من 18% إلى 97%، كما يستخدم 88% من موظفي Cyera البالغ عددهم نحو 1,500 موظف Claude أسبوعيًا. 🔗 المصدر
  • Perplexity تنشر دليلًا عن الذكاء الاصطناعي الخفي (الذكاء الاصطناعي الخفي) — لا تقدم التدوينة أي بيانات خاصة بها، بل تجمع نتائج استطلاعات أجرتها جهات خارجية: يقول نحو نصف الموظفين إنهم خالفوا قواعد مؤسساتهم باستخدام الذكاء الاصطناعي (KPMG)، ويشير 82% من المشاركين في استطلاع أجرته Cloud Security Alliance إلى وجود وكلاء مجهولين على أنظمة مؤسساتهم. وتُختتم بحجة ترويجية لصالح Perplexity Enterprise وComet for Enterprise، من دون أي ميزة جديدة. 🔗 المصدر
  • v0 يصبح محايدًا تجاه النماذج (محايد تجاه النماذج) — وفقًا لتغريدة مقتضبة، توفر أداة إنشاء التطبيقات من Vercel نماذج رائدة ورخيصة ومفتوحة وسريعة تُقدَّم عبر Vercel AI Gateway، من بينها Claude وGPT وKimi وGLM وGrok وDeepSeek؛ من دون تحديد القائمة الكاملة أو الأسعار أو الخطط المعنية. 🔗 المصدر
  • Warp تكشف أرقام مصنعها البرمجي الداخلي — في تدوينة تعرض منهجية من ثلاث مراحل (الزحف، والمشي، والركض) لتبنّي المصنع البرمجي (مصنع البرمجيات)، يوضح Zach Lloyd، الرئيس التنفيذي لـWarp، أن مصنع الشركة يؤتمت نحو 75% من التغييرات في warp.dev، موقعها التسويقي؛ ولا تزال Warp Factories متاحة في مرحلة الوصول المبكر، مع منح الشركات المؤهلة استخدامًا بقيمة 10,000 دولار. 🔗 المصدر
  • Kimi Code 0.43.1 يصلح أسراب الوكلاء الفرعيين — بعد أقل من 19 ساعة على إصدار 0.43.0، نشرت Moonshot AI سبعة إصلاحات، منها تحرير الذاكرة عند انتهاء وكيل فرعي، وتخفيف عبء العرض وحلقة الأحداث في الأسراب الكبيرة، وجعل Ctrl+C يوقف الوكلاء الفرعيين فقط بدلًا من إغلاق واجهة CLI بأكملها. 🔗 المصدر
  • Gemini CLI v0.60.0 ينتقل إلى الإصدار المستقر — يتبنى الإصدار من دون تغيير النسخة التجريبية المؤرخة في 8 سبتمبر وتغييرات التقوية الأحد عشر فيها، فيما يفتتح v0.61.0-preview.0 السلسلة التالية بثلاثة إصلاحات سبق نشرها في الإصدار الليلي وإصلاح لحلقة الوكيل. 🔗 المصدر
  • Copilot يقترح القيم المسموح بها للخصائص المخصصة للمستودعات — عند إنشاء خاصية مخصصة (خاصية مخصصة) لمؤسسة أو منظمة، يقترح Copilot قيمًا يمكن قبولها بنقرة واحدة؛ والميزة متاحة في معاينة عامة لمشتركي Copilot Business وEnterprise، تحت تحكم سياسة «اقتراحات الخصائص المخصصة للمستودعات». 🔗 المصدر
  • Grok Imagine يعدّل النص داخل الصور، في إصدار تجريبي — تتيح أداة توليد الصور ومقاطع الفيديو من SpaceXAI تنقيح النص الموجود في أي صورة، مثل دعوة أو ملصق أو إعلان؛ ولا يحدد الإعلان الخطط أو المنصات أو النموذج المستخدم. 🔗 المصدر
  • MiniMax H3 يتجاوز ضعفي السرعة الفعلية في إزالة الضوضاء — في تغريدة نُشرت في 14 سبتمبر عند الساعة 16:34 بتوقيت المحيط الهادئ، بعد رصدنا في اليوم نفسه، توضح MiniMax أن H3، باستخدام SGLang-Diffusion وVDN-H3، يولّد مقطع فيديو بدقة 768p ومدته 14.4 ثانية خلال 9.0 ثوانٍ على 8 وحدات GPU من طراز B200، من دون تراجع مقاس في الجودة، امتدادًا لمنظومة H3 التي جرى حصرها في 14 سبتمبر. 🔗 المصدر
  • Retrieve-for-Train يقطّر التعلم المعزز في نموذج انتشار صغير — يستند هذا العمل من Google Research إلى ورقة بحثية في ICML 2026، ويدرّب مرة واحدة وفي وضع غير متصل نموذجًا يضم 4B من المعلمات باستخدام التعلم المعزز (التعلم المعزز) لإنتاج استعلامات فرعية متنوعة، ثم يقطّر هذا السلوك في نموذج انتشار يضم 53.9 مليون معلمة يولّد المجموعة كاملة في تمريرة واحدة، مع تسريع يتراوح بين 12 و20 ضعفًا. 🔗 المصدر
  • NVIDIA تضع أرقامًا للمفاضلة بين النموذج الكثيف ومزيج الخبراء (مزيج الخبراء، MoE) — تقارن هذه التدوينة التعليمية Gemma 4 31B وQwen3.8-27B وNemotron 3.5 Lightning وMistral Small 4 استنادًا إلى بيانات Artificial Analysis المسجلة في 31 أغسطس: يعمل Lightning، الذي يضم 30B من المعلمات منها 3B نشطة، بسرعة تفوق Qwen3.8-27B بما بين 4 و5 مرات مقابل جزء من أربعة عشر من السعر، لكن بدرجة قدرة تقل عن نصف درجته. 🔗 المصدر
  • NVIDIA FLARE 2.9 يضيف Slurm — يتيح إطار التعلم الاتحادي (التعلم الاتحادي)، الذي يدعم Docker وKubernetes منذ الإصدار 2.8، الآن تشغيل البيئات الثلاث معًا داخل اتحاد واحد، ويقدم وصفًا قابلًا للنقل لموارد كل مهمة. 🔗 المصدر
  • Sakana Marlin يضيف القراءة التفاعلية والتصدير إلى PowerPoint — من خلال القراءة التفاعلية (القراءة التفاعلية)، يتيح مساعد البحث المستقل من Sakana AI توجيه أسئلة إلى الوكيل حول تقريره وفتح مصدر مذكور يدعم الادعاء؛ كما يصدّر عروض PowerPoint قابلة للتعديل تتضمن عناوين URL لمصادرها. 🔗 المصدر
  • ShadowPEFT ينضم إلى مكتبة PEFT — تدوينة مجتمعية: دُمجت الطريقة، التي تربط بالنموذج المجمّد شبكة «شبحية» صغيرة قابلة للفصل، في الفرع الرئيسي لـPEFT، وستُطرح في إصدارها المقبل؛ وعلى Llama-3.2-3B، قاس مؤلفوها نتيجة 48.1% على GSM8K مقابل 46.9% لـLoRA، لكن مع ذروة استهلاك ذاكرة تبلغ 28.2 GB مقابل 22.3 GB. 🔗 المصدر
  • RiverRider يقيس تحديد موضع الملفات مقارنةً بالعشوائية — مساهمة فردية: في SWE-bench Verified، يضع مُرمّز محلي يضم 33 مليون معلمة الملف الصحيح في المرتبة الأولى في 45.8% من الحالات، لكن خط أساس يستخدم استعلامات معاد ترتيبها عشوائيًا يعثر عليه بالفعل ضمن أول 50 نتيجة في 24.4% من الحالات، ما يخفض نسبة الإشارة إلى العشوائية من 45.8 إلى 3.9. 🔗 المصدر
  • EcoHash يضاعف التزامن على RTX PRO 6000 مع Qwen3.8-27B — تدوينة من مزود للاستدلال، سبق الاستشهاد به في 14 سبتمبر بشأن موضوع آخر، استنادًا إلى قياسات على خدمته الخاصة: يؤدي تفعيل رأس التنبؤ متعدد الرموز (التنبؤ متعدد الرموز، MTP) الخاص بالنموذج في vLLM 0.27.1 إلى خفض زمن الرمز من 22 إلى 13 ms ورفع التزامن المستدام من 32 إلى 64 طلبًا، وهو حد تحقق في تجربتين من أصل أربع، مقابل استهلاك 23% من سعة ذاكرة KV المؤقتة. 🔗 المصدر
  • DINO-X ينشر نموذجًا بحثيًا للأوعية الكبدية، مع إخفاقاته — نموذج مجتمعي مخصص للأبحاث: يحقق نموذج ViT-Base هذا، الذي يضم 86 مليون معلمة، قيمة AUROC خارجية تبلغ 0.9413 على 17,639 مقطعًا من فحوص التصوير المقطعي، كما ينشر مؤلفه نتائجه السلبية، ومنها نموذج متخصص في القولون حقق 0.6529 ولم يُنشر. 🔗 المصدر

ما الذي يعنيه ذلك

أصبح الصوت واجهة متكاملة للوكلاء. يستدعي Gemini 3.8 Live ومتغيره Extended Thinking الأدوات في الخلفية بينما تستمر الإجابة، ويوليان عناية لدقة الرموز والأرقام المُملاة، مع تكلفة تقديرية لكل دقيقة صوتية. وتضع Google على الفور متغير Extended Thinking، الذي يعلّق على تقدم مهامه في الخلفية، داخل أدوات العمل لديها إلى جانب Docs Live وGmail Live وKeep Live، فيما يعلن Gemini Notebook من جهته عن محادثة صوتية مرتكزة إلى مصادر كل دفتر. وهكذا ينتقل الرهان من جودة الصوت إلى ما ينجزه النموذج أثناء حديثه.

يتمثل الخيط الثاني في التوزيع: تدخل الوكلاء إلى أدوات الأعمال عبر قنوات قائمة بالفعل. يصل Salesforce in Claude مع مهارات للمبيعات، وموصلات إلى CRM وSlack، وموافقة على كل عملية كتابة؛ وتثبّت HP تطبيق Perplexity مسبقًا في شريط مهام حواسيبها وتربطه بنماذج Revit بصلاحية القراءة فقط؛ ويمكن شراء Devin عبر AWS Marketplace ونشره داخل VPC مخصص. وفي كل حالة، يأتي الوكيل إلى الأداة التي تستخدمها الشركة بالفعل، مصحوبًا بضوابطها: صلاحيات Salesforce الخاصة بمندوب المبيعات، والوصول للقراءة فقط إلى Revit، وVPC مخصص لدى AWS.

يتعلق الخيط الثالث بالموثوقية والتحكم. تجعل إصدارات Claude Code رقم 2.1.271 و2.1.273 المصنّف يراجع مخرجات الوكلاء الفرعيين، وتفتح الشبكة أمرًا بأمر، وتصلح طرق تجاوز الصلاحيات عبر الأغلفة الفرعية أو إعدادات MDM المتجاهلة. وتُظهر IBM Research أن وكيلًا مضبوطًا على درجة حرارة 0 قد ينجح في 77.4% من تشغيلاته في المتوسط، لكنه ينجح في التشغيلات الخمسة كلها في 53.0% فقط من المهام، وتوصي بنشر Pass^k إلى جانب المتوسط. وتطبق NVIDIA المتطلب نفسه على العتاد: يستعيد NVLink 6 الاتصال خلال نحو 1.5 ثانية، ويخفض Shadow Engine Recovery انقطاع الاستدلال من 283 إلى 7.3 ثانية. ولم يعد السؤال يقتصر على ما إذا كان الوكيل ينجح، بل أصبح يشمل ما إذا كان ينجح في كل مرة، ضمن حدود قابلة للتحقق.

يتعلق الخيط الأخير بالوتيرة. ستسحب OpenAI نموذج GPT-5.5 من تطبيقاتها بعد شهر من الإعلان، كما فعلت مع GPT-5.4 قبله، وتطلب استبدال المعرّف في كل موضع يُختار فيه صراحةً، بما في ذلك المهام المجدولة والبرامج النصية. وعلى جانب الأدوات، ينشر Claude Code ثلاثة إصدارات خلال 22 ساعة، ويطرح Kimi Code إصلاحًا بعد أقل من 19 ساعة على إصداره السابق، وينقل Gemini CLI النسخة التجريبية الصادرة في 8 سبتمبر إلى الإصدار المستقر بعد أسبوع. وفي الوقت نفسه، يعلن v0، الذي كان حتى الآن يضيف النماذج واحدًا تلو الآخر إلى أداة الاختيار، أنه أصبح محايدًا تجاه النماذج ويعتمد على Vercel AI Gateway: وهكذا يصبح النموذج فيه مكوّنًا قابلًا للاستبدال.


المصادر