ai-powered-markdown-translatorمقال مترجم من الفرنسية إلى العربية باستخدام gpt-5.6-sol.
يخرج GPT-6 Astra من النشر المحدود بعد أربع وعشرين ساعة من إطلاقه: يصبح النموذج متاحًا لخطط Pro وEnterprise وBusiness Premium، ويدخل مرحلة التوفر العام في GitHub Copilot، ويحقق أعلى نتيجة تقيسها Perplexity على الإطلاق في معيارها للبحث الموثّق. ومن جانبها، تنشر Anthropic أول برهان لمبرهنة فيرما الأخيرة تحقّق منه الحاسوب، كتبه Claude في أحد عشر يومًا. ويفتح GitHub مشروع HydraFusion، وهو وضع يختار بنفسه النموذج وسير العمل لكل مهمة، وتنشر Google نموذج Lyria 3.5 في تطبيق Gemini، وتتيح SpaceXAI منتج Grok Bot للشركات مع توثيق وكيل مشتريات عثر لدى جهة عمله نفسها على وفورات تتجاوز 100,000 دولار.
يخرج GPT-6 Astra من النشر المحدود ويدخل مرحلة التوفر العام في Copilot
4 سبتمبر — تعلن OpenAI في الساعة 22:13 بتوقيت باريس أن GPT-6 Astra يغادر مرحلة النشر المحدود. وأصبح النموذج متاحًا لجميع مستخدمي Pro وEnterprise وBusiness Premium في ChatGPT Work وCodex، كما تتيحه API الآن دون قيود، بعدما كان إعلان 3 سبتمبر لا يزال يربط إتاحته بالنشر التدريجي. أما مشتركو Plus ومستخدمو Business فسيتعين عليهم الانتظار بضعة أيام إضافية، وفق توضيح ورد في الرسالة نفسها.
| المنصة المعنية | الإتاحة في 4 سبتمبر |
|---|---|
| API الخاصة بـOpenAI | متاح دون قيود |
| ChatGPT Work وCodex، خطة Pro | متاح |
| Enterprise وBusiness Premium | متاح |
| Plus وخطط Business الأخرى | تأخير لبضعة أيام |
توفر عام في GitHub Copilot، بالسعر العام منذ اليوم الأول
في اليوم نفسه، يدخل GPT-6 Astra مرحلة التوفر العام في GitHub Copilot. ويركز GitHub على أسلوب عمل النموذج أكثر من نتائجه: ففي اختباراته الداخلية، يخطط Astra ويتحقق أثناء التنفيذ، ويدمج التشخيص مع التحقق، ويؤكد نتائجه بنفسه قبل إعلان اكتمال المهمة، ما يمنحه أداءً أفضل في المهام الطويلة بخطوات أقل من نماذج OpenAI السابقة. ولم يرفق الإعلان أي أرقام لمعايير الأداء.
يظهر النموذج على عشر منصات، من Visual Studio Code وواجهات IDE الخاصة بـJetBrains إلى Copilot CLI وGitHub Mobile وXcode وEclipse، لكنه يظل مخصصًا لخطط Pro+ وMax وBusiness وEnterprise. أما Copilot Pro فغير مشمول. وتجدر الإشارة إلى مسألة الفوترة: يُحاسب استخدام Astra وفق السعر العام للمورّد بنظام الدفع حسب الاستخدام، من دون فترة ترويجية، بينما يستفيد Gemini 3.8 Flash، الذي وصل في اليوم السابق، من تسعير تمهيدي حتى 31 ديسمبر 2026.
تمنحه Perplexity أفضل نتيجة لها على WANDR
نشرت Perplexity في 3 سبتمبر عند الساعة 23:10 نتيجة Astra على WANDR، وهو معيارها الداخلي للبحث الموثّق واسع النطاق. وحقق النموذج نتيجة 0,682 بتكلفة 11,98 دولارًا لكل مهمة، وهي أعلى نتيجة بين جميع النماذج التي اختبرتها الشركة.
| النموذج المُقيَّم | نتيجة WANDR | التكلفة لكل مهمة | تاريخ نشر القياس |
|---|---|---|---|
| GPT-6 Astra | 0,682 | 11,98 دولارًا | 3 سبتمبر 2026 |
| Claude Fable 5.1 | 0,601 | 12,76 دولارًا | 1 سبتمبر 2026 |
وتورد Perplexity أيضًا فارقين نسبيين: نتيجة أعلى بنسبة 13,5 في المئة من Claude Fable 5.1 بتكلفة أقل بنسبة 6,1 في المئة، ونتيجة أعلى بنسبة 27,0 في المئة من Opus 5 بتكلفة أكبر بنسبة 3,3 في المئة. لكن ثمة تحفظان ضروريان. فـWANDR معيار مملوك لا تُنشر منهجيته التفصيلية، كما أن Perplexity عميلة للنماذج التي تصنّفها. ولم تُعلن أي قيمة مطلقة تخص Opus 5.
ثلاثة إصلاحات لـCodex CLI تستكمل عملية الدمج
على صعيد سطر الأوامر، أعقب الإصدار 0.153.0، المنشور ليلة 3 سبتمبر، ثلاثة إصلاحات خلال أقل من يومين، خُصصت جميعها لـAstra. يتيح الإصدار 0.153.1 ضبط النموذج عبر API من دون تغيير النموذج الافتراضي أو إظهاره في أداة الاختيار. ويصحح الإصدار 0.153.2 تسميةً: إذ يوصف مستوى Fast بأنه يوفر سرعة مضاعفة مرتين بدلًا من 1,5 مرة، من دون تغيير طريقة معالجة الطلبات. أما الإصدار 0.153.3، المنشور في 4 سبتمبر عند الساعة 21:01، فيضيف Astra إلى أداة اختيار نماذج Amazon Bedrock لمساري Mantle وRuntime، ويصحح التعليمات المقدمة إلى النموذج بشأن أسئلة الاستيضاح غير المتزامنة.
واختتمت OpenAI اليوم بثلاث تجارب عملية: تدوينتان في مدونة المطورين، تتناول إحداهما لعبة استكشاف فضائي إجرائية بُنيت في Codex، وتتناول الأخرى تصميم منزل يمكن استكشافه باستخدام Blender وUnreal Engine 5، إضافة إلى مقال لـDominik Kundel حول خمسة تغييرات طرأت على طريقته في استخدام Codex.
🔗 ملاحظات إصدار Codex CLI 0.153.3 · 🔗 بناء لعبة باستخدام Astra
يقدّم Claude أول برهان رسمي لمبرهنة فيرما الأخيرة
4 سبتمبر — تنشر Anthropic أول برهان لمبرهنة فيرما الأخيرة جرى التحقق منه بالكامل بواسطة الحاسوب. عمل Claude أحد عشر يومًا، بصورة مستقلة إلى حد كبير، لكتابته بلغة Lean. وتصفه الشركة بأنه أكبر برهان بُني بلغة Lean على الإطلاق.
| المقياس | القيمة المسجلة |
|---|---|
| مدة عمل Claude | 11 يومًا |
| أسطر Lean المكتوبة | 13 مليونًا |
| المبرهنات الوسيطة المُثبتة | 29 500 |
| أول برهان بشري، أعدّه Wiles | 1995، 129 صفحة |
| الفاصل بين وضع الحدسية وإثباتها | أكثر من 350 عامًا |
تنص المبرهنة على أنه لا توجد أي ثلاثية من الأعداد الصحيحة الموجبة تحقق معادلة فيرما عندما يكون الأس أكبر من اثنين. وكان Pierre de Fermat قد دوّنها نحو عام 1637 في هامش نسخته من كتاب «الحساب» لـDiophantus. أما أول برهان صحيح فيعود إلى Sir Andrew Wiles عام 1995: 129 صفحة، وأشهر من التحقق البشري، ونسخة أولى عُرضت عام 1993 كشف أحد مراجعيها عن ثغرة خطيرة بعد شهرين.
فشلت المحاولات الأولى، إذ حقق الوكلاء نجاحات سريعة قبل أن يفقدوا مسار العمل. وجاء الاختراق بفضل Prove2Me، وهي منصة تعاونية مفتوحة للصياغة الرسمية، مقترنة بإطار متعدد الوكلاء قائم على Claude Code. تحتفظ المنصة برسم بياني موجّه غير دوري للعبارات، يستخدمه الوكلاء لاختيار البرهان التالي الذي سيحاولون إنجازه، وتفصل العبارات عن البراهين في ملفات مستقلة لتسريع ترجمة Lean، كما تحفظ وصفًا باللغة الطبيعية لكل عبارة لإتاحة البحث وإعادة الاستخدام. ويتبع البرهان الناتج العرض المبسط لعمل Wiles الذي وضعه Henri Darmon وFred Diamond وRichard Taylor.
This extraordinary autoformalization achievement, which Anthropic researchers say only took 11 days, proves Fermat’s Last Theorem with no assumptions other than the axioms of mathematics.
🇸🇦 يُثبت هذا الإنجاز الاستثنائي في الصياغة الرسمية الذاتية، الذي لم يتطلب سوى أحد عشر يومًا وفقًا لباحثي Anthropic، مبرهنة فيرما الأخيرة من دون أي افتراض سوى مسلّمات الرياضيات. — Kevin Buzzard، مراجع النتيجة، كما ورد على صفحة أبحاث Anthropic
تعرض Anthropic أهمية الإنجاز باعتبارها مرتبطة بالتحقق لا بالاكتشاف، بخلاف الأعمال الحديثة التي أجراها الذكاء الاصطناعي حول فرضية Riemann، والتي أنتجت رياضيات جديدة. ومع تزايد حجم البراهين، تصبح مراجعة الأقران عنق زجاجة يستغرق سنوات.
في Project HydraFusion، يجعل GitHub الأداة تختار النموذج بدلًا من المطور
4 سبتمبر — يفتح GitHub للمعاينة البحثية مشروع Project HydraFusion، وهو وضع لم يعد يحدد نموذجًا بل سير عمل. ففي حين كانت أداة الاختيار في Copilot تطلب المفاضلة بين أكثر من عشرين نموذجًا، يقرر HydraFusion بنفسه، لكل طلب، أي نموذج سيعالج المهمة ووفق أي مخطط تنفيذ. ويُختار مثل أي نموذج آخر، لكنه ينسق عدة نماذج خلف هذا الاختيار الواحد.
تتوفر حاليًا ثلاثة مخططات. يسند وضع Single المهمة إلى نموذج واحد. وفي وضع Cascade، يكتب نموذج فعّال حلًا أوليًا، ثم تقرر بوابة جودة قبوله أو تصعيده إلى نموذج أكثر قدرة. أما وضع Critique، فيُخضع المسودة لمراجعة ناقد مستقل بصلاحية القراءة فقط، ينتمي إلى عائلة نماذج أخرى.
| معيار الأداء المُقيَّم | فارق التكلفة مقارنة بـOpus 5 | فارق الجودة مقارنة بـOpus 5 |
|---|---|---|
| TerminalBench 2.1 | أقل بنسبة 67 في المئة | أعلى بـ4,9 نقاط |
| DeepSWE | أقل بنسبة 36 في المئة | أقل بـ1,5 نقطة |
| CheckpointBench | أقل بنسبة 65 في المئة | أقل بـ0,1 نقطة |
تحكم التنفيذ خمسة مبادئ هندسية: احتساب إجمالي لتكلفة كل خطوة، ومهلة انتهاء وإلغاء صريحان، ومراجعة في سياق معزول ومن دون أدوات، وتطبيق قائم على الأمان لا يطبق أي تصحيح إذا فشل سير العمل، والتحقق من التوجيه قبل التنفيذ. ويقر GitHub بوجود مفاضلة في الواجهة، إذ يعرض الخطوات لكنه يحجب المسودات الوسيطة حتى ظهور النتيجة النهائية، ويعترف بأن الانتظار من دون رؤية كافية يمثل عيبًا حقيقيًا.
يتسم توثيق عملية التطوير بصراحة غير معتادة: يعتمد GitHub على TerminalBench 2.1 بوصفه التسلسل الأكثر اكتمالًا من عمليات التشغيل، ويوضح أن التقدم لم يكن خطيًا، ويقر بأن إخفاقين تشغيليين في إطار التقييم أنتجا عمليات تشغيل غير صالحة بين 11 و25 أغسطس. وقد استُبعدت هذه العمليات من الاتجاه العام ثم صُححت، وتحدد الشركة يوم 25 أغسطس موعدًا لأفضل نقاط التشغيل في السلسلة المسجلة. ويتاح الوصول عبر Copilot CLI في جميع الخطط، بالسعر القياسي القائم على إجمالي tokens في سير العمل، بعد /update ثم /experimental on.
يصل Lyria 3.5 إلى تطبيق Gemini وإلى API
4 سبتمبر — تنشر Google نموذج Lyria 3.5، الذي تقدمه بوصفه نموذجها لتوليد الموسيقى صاحب أفضل إخراج صوتي، مع أصوات غنائية أكثر تعبيرًا وتوزيعات موسيقية أكثر ثراءً.
في تطبيق Gemini، يصاحب التحديث ثلاثة تغييرات في الواجهة. يمكن للمستخدم تحديد نوعه الموسيقي أو وصفه، والاختيار بين أداء غنائي أو آلي. وتوفر قوالب جديدة جاهزة للاستخدام (templates) نقطة انطلاق، سواء لإنشاء موسيقى خلفية أو مقطوعة مخصصة لعيد ميلاد. كما تصبح مدة المقطوعة قابلة للضبط بين صيغة قصيرة وصيغة طويلة.
| نوع المنصة | إتاحة Lyria 3.5 |
|---|---|
| عامة المستخدمين | تطبيق Gemini على الويب والهاتف، عالميًا |
| الإنشاء الاحترافي | Google Flow Music |
| المطورون | API الخاصة بـGemini، وGoogle AI Studio، وGoogle Vids |
تضع Google الاستخدام المتوقع في نطاق الاحتياجات اليومية بدلًا من الإنتاج الاحترافي: مقطوعة مصاحبة لفيديو، أو شارة موسيقية لعلامة تجارية، أو نغمة رنين مخصصة. والإتاحة واسعة، من دون ذكر أي قيود مرتبطة بالاشتراك. لكن التدوينة لا تقدم أي أرقام لجودة الصوت، ولا أي مقارنة مع الإصدار السابق من Lyria، ولا أي سعر للوصول عبر API.
تضع SpaceXAI نموذج Grok في خدمة الشركات وتنشر prompt النظام الخاص بوكيل مشترياتها
3 و4 سبتمبر — تتيح SpaceXAI منتج Grok Bot للشركات. وبعد إطلاقه في 12 أغسطس، ينتقل المنتج من عرض مخصص للمشتركين الأفراد وفرق Cursor إلى إصدار مزود بضوابط للوصول والشبكة والتدقيق. يُنفذ عمل كل مستخدم في بيئة معزولة، ولا يمتلك أي Bot وصولًا افتراضيًا: فلا يصل إلا إلى الحسابات التي يُربط بها صراحةً. ويحصل عليه عملاء Grok Enterprise وCursor Enterprise مجانًا لمدة أسبوعين، ويمكنهم دعوة مؤسستهم بأكملها، بما في ذلك الأشخاص الذين لا يملكون ترخيصًا حاليًا. وتذكر SpaceXAI شركات Legora وSupermicro وServiceTitan، وتؤكد أن آلاف المؤسسات تبنت المنتج منذ إطلاقه.
أكثر ما يلفت الانتباه في الإعلان أن الاستخدام الأعلى كثافة يقع خارج مجال الهندسة: التنقيب الليلي وبطاقات التقييم في التوظيف، ومسودات البريد الإلكتروني وتحديث العروض التقديمية في المبيعات، واستخراج الأسئلة والأجوبة من ندوة عبر الويب في التسويق.
وفي اليوم التالي، تنشر الشركة دراسة حالة عن Bot أُطلق للعمل على مشترياتها الخاصة. ويحمل اسم Haggle Bot، وهو متصل بـSlack وNotion وDrive وGmail وHex وRamp، ويعلن عن وفورات مباشرة تتجاوز 100,000 دولار.
| ما اكتشفه الوكيل | المبلغ المحدد |
|---|---|
| إجمالي الوفورات المباشرة | أكثر من 100,000 دولار |
| التراخيص غير النشطة خلال 90 يومًا، المنتج الأول | 43 ترخيصًا، 14,220 دولارًا |
| الأرصدة غير المستخدمة، منتج شهري | 85,662 دولارًا سنويًا |
تتجاوز القيمة التحريرية للتدوينة هذه الأرقام: إذ تنشر SpaceXAI قالب prompt النظام الخاص بالوكيل، وتقدمه بوصفه نموذجًا يُملأ بما يناسب كل مؤسسة، مع وضع القيم النموذجية بين قوسين زاويين. ويميز قسم الصلاحيات فيه بين ثلاثة أنظمة دائمة. الأول لا يطلب الموافقة مطلقًا، ومن أمثلته قراءة بيانات الإنفاق وإرسال الرسائل إلى الزملاء. والثاني يتطلب موافقة صريحة من المشغّل في كل مرة، والمثال المذكور عليه هو أي إرسال إلى مورّد. أما الثالث فيظل محظورًا في جميع الظروف، وتشمل أمثلته المذكورة التوقيع والشراء والاشتراك والموافقة على النفقات وأي التزام مُلزم. وتوضح التدوينة نثرًا أن الفريق سمح للوكيل بإجراء البحث الداخلي والتنسيق بمفرده، لكنه اشترط موافقة صريحة للإنفاق أو قبول الشروط أو الكتابة إلى مورّد.
🔗 Grok Bot للشركات · 🔗 إطلاق Haggle Bot للعمل على المشتريات
يتصل Grok بالحسابات المصرفية الأمريكية عبر Plaid
4 سبتمبر — بات بإمكان Grok الآن الاتصال بالحسابات المالية لمستخدميه. يتم الاتصال عبر Plaid، الوسيط التقني الذي يربط التطبيقات والمؤسسات المصرفية في الولايات المتحدة، والميزة متاحة فورًا في هذا البلد وحده.
ترسم الأمثلة الثلاثة التي اختارتها SpaceXAI النطاق المستهدف: معرفة أين ذهبت أموال الشهر المنصرم، ومتابعة أداء الاستثمارات، والتحقق مما إذا كان المرء يستطيع حقًا شراء ما في سلته. بعبارة أخرى، تحليل النفقات السابقة، ومتابعة المحفظة، والمساعدة في اتخاذ قرار الشراء لحظة الحاجة إليه. يظل الإعلان مقتضبًا ولا يذكر شيئًا عن معالجة البيانات أو المؤسسات المشمولة، باستثناء الإشارة إلى اتصال آمن.
ويأتي ذلك امتدادًا لسلسلة من عمليات التكامل المالي بدأت بالتقارب مع Interactive Brokers في 25 يونيو، لكن طبيعتها تغيّرت: فبينما كان Interactive Brokers يستهدف المستثمرين النشطين، يفتح Plaid المساعد أمام الحسابات الجارية لعامة الناس.
Claude Code 2.1.260 و2.1.261: لوحة فروق، وتدقيق للمهارات، وتشديد للأذونات
4 سبتمبر — يصدر إصداران من Claude Code في اليوم نفسه، ويكمل أحدهما الآخر: يوفر الأول رؤية أوضح للعمل الجاري، والثاني لما تستهلكه الجلسة.
| الإصدار المنشور | وقت الإصدار | أبرز الإضافات |
|---|---|---|
| 2.1.260 | 4 سبتمبر 01h48 | لوحة /diff، وتشخيص ذاكرة التخزين المؤقت في /cost، وإصلاحات للأذونات |
| 2.1.261 | 4 سبتمبر 21h58 | /skill-doctor، ومخرجات تصل إلى 128 000 محرف، وموجّه الوكيل الفرعي في ملف |
يفتح الإصدار 2.1.260 لوحة فروق إلى جانب المحادثة في وضع ملء الشاشة، تعرض التعديلات غير الملتزم بها تباعًا أثناء عمليات التحرير. ويصلح خصوصًا عدة ثغرات في تقييم الأذونات: كانت قواعد Edit وWrite وRead التي يحتوي مسارها على أقواس تُرفض باعتبارها غير صالحة أو يتجاهلها صندوق Bash المعزول، ما كان يترك مجلدات يُفترض أنها للقراءة فقط قابلة للكتابة، كما كانت أوامر zsh التي تخفي استبدال أمر داخل إسناد REPORTTIME تحظى بالموافقة تلقائيًا.
يضيف الإصدار 2.1.261 الأمر /skill-doctor، الذي يسرد المهارات المحمّلة التي ظلت غير مستخدمة وتكلفة كل منها من السياق. وبات وضعه التلقائي يعامل الرابط الذي يضمّن محتوى في عنوان URL لمولّد رسوم تخطيطية عام على أنه إرسال إلى موقع تابع لطرف ثالث.
🔗 ملاحظات إصدار 2.1.260 · 🔗 ملاحظات إصدار 2.1.261
يضع الأمر ant apply الوكلاء المُدارين في ملفات خاضعة للتحكم في الإصدارات
4 سبتمبر — تضيف Anthropic الأمر ant apply إلى واجهة سطر الأوامر ant الخاصة بها. يطبّق الأمر على الوكلاء المُدارين النموذج التصريحي المألوف لدى فرق البنية التحتية: تُوصف الحالة المطلوبة في ملفات المستودع، ثم يوفّق الأمر موارد واجهة API مع هذا الوصف.
يشمل ذلك خمسة أنواع من الموارد: بيئات الوكلاء المُدارين، والوكلاء أنفسهم، والمهارات، ومخازن الذاكرة (memory stores)، وعمليات النشر. حتى الآن، كانت هذه الكائنات تُنشأ عبر استدعاءات API أو من خلال وحدة التحكم، من دون أثر لها في المستودع. ويؤدي وصفها في ملفات إلى إدخالها في نطاق مراجعة الشيفرة، والتحكم في الإصدارات، ومسارات التكامل المستمر. وتكمن الفائدة العملية في قابلية إعادة الإنتاج: إذ يمكن إعادة إنشاء بيئة وكيل موصوفة في ملف بصورة مطابقة، أو مقارنتها من فرع إلى آخر، أو نشرها من مسار آلي دون تدخل يدوي.
دفعة NVIDIA: ذاكرة دائمة للوكلاء، واستدلال على Jetson، وهوية اتحادية
3 و4 سبتمبر — ثلاث منشورات في مدونة NVIDIA التقنية في اليوم نفسه، تتناول ثلاث طبقات مختلفة من المكدس.
الأول وصفة مفتوحة مبنية على NemoClaw: وكيل مدير مكتب يحتفظ بذاكرة دائمة لعمل مستخدمه. وتتلخص الفكرة في جملة واحدة: تحتاج ذاكرة الوكيل المفيدة إلى بنية، واسترجاع انتقائي، وحوكمة، لا إلى التخزين وحده. يعتمد النظام على نموذج للذات (self model)، وطبقة معرفة قابلة للقراءة البشرية مكتوبة في صفحات Markdown منظّمة، إلى جانب سجل SQLite يحفظ الالتزامات، والتصنيفات، والتصحيحات، وأحداث التدقيق. يجري التنفيذ عبر NVIDIA OpenShell، الذي يطبّق داخل صندوق معزول سياسات الوصول إلى نظام الملفات والعمليات والشبكة، مع بقاء بيانات الاعتماد خارج الصندوق المعزول.
| المقياس المقاس | خط أساس RAG وكيلي | نموذج الذات | الفارق المرصود |
|---|---|---|---|
| الدقة الإجمالية، على 186 سؤالًا | 82,8 في المئة | 90,9 في المئة | زائد 8,1 نقاط |
| الأسئلة الصعبة، على 31 سؤالًا | 67,7 في المئة | 87,1 في المئة | زائد 19,4 نقاط |
| تتبع الحقائق المتغيرة، على 5 | 60,0 في المئة | 100,0 في المئة | زائد 40,0 نقاط |
| الالتزام بالمادة المرجعية، على 13 سؤالًا | 100,0 في المئة | 92,3 في المئة | ناقص 7,7 نقاط |
Context can inform an action, but it cannot authorize one.
🇸🇦 يمكن للسياق أن يوضّح إجراءً، لكنه لا يستطيع الإذن به. — تدوينة NVIDIA عن ذاكرة الوكلاء
المنشور الثاني دليل نشر يكرّس تحولًا في الذكاء الاصطناعي المضمّن: يحقق تكميم NVFP4 المقترن بفك الترميز التخميني ما يصل إلى 6,28 أضعاف إنتاجية فك الترميز مقارنةً بـBF16 على Jetson AGX Thor وOrin. يختلف الإعداد الفائز باختلاف النموذج، وتشدد NVIDIA على هذه النقطة بدل تعيين فائز عام: يحقق Nemotron 3.5 Lightning أفضل نتيجة له مع DSpark، بين 123 و138 رمز إخراج في الثانية، بينما يحقق Qwen3.8-27B أفضل نتيجة مع DFlash2، بين 27,7 و34,4 رمزًا في الثانية. والتحذير الأخير منهجي: تختلف الإنتاجية باختلاف عبء العمل، لذا ينبغي التحقق من الإعداد باستخدام موجّهات تمثّل التطبيق المستهدف. أما المنشور الثالث، وهو أكثر تواضعًا، فيصف تمرير هوية المستخدم بين منصات Kubernetes الاتحادية ومنصات الذكاء الاصطناعي.
🔗 الاستدلال الطرفي على Jetson · 🔗 الهوية بين المنصات الاتحادية
أدوات Google لسطر الأوامر: ينتقل Gemini CLI إلى سلسلة 0.60.0، ويفتح Antigravity نماذج Flash للمؤسسات
3 و4 سبتمبر — تغادر القناة الليلية من Gemini CLI سلسلة 0.59.0 إلى 0.60.0، في إصدار يغلب عليه الطابع الأمني. يزيل أبرز إصلاح مفتاح API خاصًا بـGoogle CrUX كان مضمّنًا مباشرةً في مكوّن chrome-devtools-mcp. ويعزز تغييران آخران العزل: يحصل صندوق macOS Seatbelt المعزول على دليل مؤقت معزول، ويطبّق محمّل الامتدادات تحليلًا معززًا للمسارات مصحوبًا بالتحقق من الحدود. ويفرض التغيير الرابع في تدفق OAuth لخوادم MCP تعريف الجهة المُصدرة وفقًا لـRFC 9207، للحماية من هجمات استبدال السلطة.
لا يتضمن Antigravity 2.12.2، المنشور في اليوم السابق، سوى تحسين واحد ولا يحتوي على أي إصلاحات: يمكن لمستخدمي المؤسسات الوصول إلى نماذج الاستدلال Gemini 3.8 Flash عبر المصادقة باستخدام بيانات الاعتماد الافتراضية للتطبيق (Application Default Credentials). وتتمثل الفائدة العملية في ربط النموذج بأسلوب المصادقة القياسي لعمليات نشر Google Cloud، من دون مفتاح API فردي.
🔗 الإصدار الليلي Gemini CLI v0.60.0 · 🔗 سجل تغييرات Antigravity
الذكاء الاصطناعي في خدمة العلم: محاكي مناخي مقترن وشبكة عصبية كاملة لذبابة فاكهة ذكر
3 و4 سبتمبر — يطبّق منشوران التعلم الآلي على كيانات علمية ضخمة، في مجالين لا صلة بينهما.
تنشر Ai2 نموذج SamudrACE-E3SMv3 بموجب ترخيص Apache 2.0 على Hub Hugging Face، وهو محاكي مناخي مقترن بالكامل بين الغلاف الجوي والمحيط. يهدف العمل إلى إعادة إنتاج سلوك E3SM، النموذج المناخي المرجعي لوزارة الطاقة الأمريكية، بتكلفة حوسبة أقل بكثير: تصفية الفرضيات قبل تشغيل E3SM نفسه، وإنتاج مجموعات كبيرة تأخذ عينات منخفضة التكلفة من التباين المناخي. يُدرّب محاكيا الغلاف الجوي (ACE) والمحيط (Samudra) مسبقًا كلٌ على حدة قبل اقترانهما، ثم يُقيّمان على 400 سنة من بيانات E3SM لم يسبق لهما رؤيتها، ويحافظان فيها على متوسط المناخ. وتشير Ai2 إلى قيد صريح: يلتقط المحاكي الهطول اليومي حتى المئين 99,99 لكنه يقلل من تقديره بعد ذلك.
ينشر HHMI Janelia Research Campus وGoogle Research والمتعاونون معهما، من جهتهم، أول خريطة كاملة لدماغ وجهاز عصبي مركزي لذبابة فاكهة ذكر بالغة: أكثر من 166 000 خلية عصبية، وهو رقم قياسي، موزعة على 11 691 نوعًا خلويًا صُنفت بمساعدة الذكاء الاصطناعي وتحقق منها خبراء بشريون. تعتمد الطريقة على تصوير مقاطع رقيقة ثم إعادة تركيب ملايين الصور الثنائية الأبعاد حاسوبيًا في أشكال عصبية ثلاثية الأبعاد. وتكمن الفائدة في المقارنة مع خريطة الأنثى المنشورة سابقًا: غالبية الخلايا العصبية متطابقة لدى الجنسين، وأقلية منها خاصة بجنس واحد، وهناك فئة ثالثة تُسمى ثنائية الشكل توجد لدى كليهما لكنها تتصل بجيران مختلفين. وتطبّق ثلاث دراسات مرافقة الخريطة على الرؤية والتذوق والسلوك الاجتماعي.
🔗 SamudrACE-E3SMv3 على X · 🔗 خريطة دماغ ذبابة الفاكهة الذكر
تفتح Meta للجمهور مستوى الاستدلال الأقصى في Muse Spark 1.3
4 سبتمبر — تتيح Meta للجمهور مستوى الاستدلال max في Muse Spark 1.3، بعد يومين من الإعلان عن النموذج نفسه. يتوفر المستوى في Muse Code وفي Meta Model API.
إذًا، لا يتعلق التغيير بالنموذج بل بالإتاحة الفعلية لمستوى الاستدلال الأعلى تكلفة فيه. يوضح Alexandr Wang، كبير مسؤولي الذكاء الاصطناعي في Meta، أن التحسن يطال البرمجة والمهام الوكيلية، ويوصي بإعادة تجربة النموذج حتى لمن سبق لهم اختبار المستويين high وxhigh. ويضيف أن الإطلاق جاء بعد إتمام اختبارات السلامة. ويتطلب التفعيل اختيار Muse Spark 1.3 ثم ضبط مستوى الاستدلال على max.
لا ترافق هذه الإتاحة أي أرقام لمقاييس الأداء: فالمنشور لا يقدم نتيجة ولا مقارنة، بل تقييمًا نوعيًا من صاحبه فحسب.
Percept-Lens، بروتوكول Sakana AI لتقييم اكتشاف الصور المولّدة
3 سبتمبر — تقدم Sakana AI إطار Percept-Lens، وهو إطار تقييم خارج التوزيع لاكتشاف الصور المولّدة بالذكاء الاصطناعي، قُبل في ECCV 2026. تنطلق الدراسة من ملاحظة أن كواشف الصور الاصطناعية تفشل بمجرد تغيّر عدة عوامل في الوقت نفسه: المولّد، أو الأسلوب أو الموجّه، والمجال المصدر. يوحّد Percept-Lens التقييم على 39 مجموعة بيانات عامة، بإجمالي 7,1 ملايين صورة.
تطرح دراسة التمثيل سؤالًا مباشرًا: هل ما زال تدريب رأس تصنيف يضيف شيئًا يتجاوز ما تفصله المشفّرات الحديثة بالفعل؟ يبني المؤلفون سُلّمًا من المميّزات الغاوسية المشروطة بالاحتمال القبلي، أي رؤوسًا ذات صيغة مغلقة مبنية على إحصاءات الرتبتين الأولى والثانية للسمات. وغالبًا ما تنافس أفضل درجة في هذا السُلّم رؤوس الاكتشاف المنشورة، بل تتفوق عليها أحيانًا، بشرط المقارنة عند استخدام الاحتمال القبلي والمشفّر نفسيهما. ويدعو المؤلفون إلى إعداد التقارير على مستوى الثلاثي: الاحتمال القبلي، والمشفّر، والرأس.
🔗 تدوينة Sakana AI · 🔗 ورقة arXiv
TAOT، توزيع نُسخ الخبراء مع مراعاة طوبولوجيا الشبكة
4 سبتمبر — يشرح فريق Baige في Baidu بالتفصيل TAOT، وهي طريقة لتوزيع نُسخ الخبراء لتدريب نماذج mixture-of-experts، متاحة ضمن إطار العمل مفتوح المصدر LoongForge.
المشكلة ملموسة. عندما يتباطأ تدريب MoE، نادرًا ما تكون قدرة وحدات GPU هي السبب، بل العجز عن إعادة موازنة الحمل في الوقت المناسب: يتحول عدد قليل من الخبراء إلى نقاط ساخنة وتنتظر جميع الرتب الأخرى. ويتمثل العلاج التقليدي في نسخ أوزان خبير ساخن مؤقتًا إلى رتبة خاملة، لكن ما إن يتجاوز نطاق التوازي عقدة واحدة، حتى لا تعود جميع وحدات GPU الخاملة متساوية: تمر الاتصالات داخل العقدة عبر NVLink، وعبر العقد بين InfiniBand، وقد تختلف التكلفة بمرتبة قدرية كاملة.
| المقياس المقاس | القيمة المسجلة |
|---|---|
| الزمن لكل تكرار، قبل ثم بعد | 155,4 ms ثم 108,8 ms، أي 1,43x |
| التسريع من EP4 إلى EP16 | حتى 1,79x |
| تكلفة الاتصال مقارنةً بـLPLB | أقل بما يصل إلى 74 في المئة عند EP32 |
| التكلفة الإضافية للتخطيط عبر الإنترنت | أقل من 1 في المئة من زمن التمرير الأمامي |
تُقدَّم TAOT بوصفها أول طريقة تُدخل في دالة هدف واحدة فائدة خفض الذروات وتكلفة نقل الأوزان بين العقد. ففي حين يقيّد LPLB من DeepSeek المسارات برسوم بيانية محددة مسبقًا، تستخدم TAOT مصفوفة مستمرة لتكلفة الاتصال مع تفضيل طوبولوجي مرن: تُفضَّل الاتصالات داخل العقدة، بينما تظل الاتصالات عبر العقد مسموحة لكنها أعلى تكلفة. ويؤدي الانتقال من المطابقة بحسب الصفوف إلى المطابقة بحسب الأعمدة إلى خفض الاختلال المتبقي من 7 إلى 10 في المئة إلى 1 إلى 2 في المئة.
Open Yap 1K، ألف ساعة من المحادثات ثنائية الاتجاه بالكامل ومتاحة للاستخدام التجاري
3 سبتمبر — تنشر The Agentic Data Company مجموعة Open Yap 1K، وهي مادة محادثات إنجليزية في قناتين منفصلتين، مصممة للنماذج الصوتية ثنائية الاتجاه بالكامل.
| عنصر مجموعة البيانات | العينة العامة | مجموعة البيانات الكاملة |
|---|---|---|
| المدة الإجمالية | 8,9 ساعات | 1 000 ساعة |
| المحادثات | 16 | 1 602 |
| الترخيص المطبق | CC BY 4.0 | Open Yap، استخدام تجاري حر |
| أسلوب الوصول | Hub Hugging Face | عند الطلب |
يضع المؤلفون مجموعة البيانات صراحةً بوصفها بديلًا لمجموعات الكلام الحالية مثل Fisher وSwitchboard وCANDOR، بحجة تقنية في المقام الأول: تقارن التدوينة بين مقتطف من Fisher English مأخوذ بمعدل 8 kHz عبر النطاق الهاتفي، ومقتطف من Open Yap 1K، لتوضيح فارق جودة الصوت. كما توثّق طريقة الجمع، والتركيبة الديموغرافية للمتحدثين، وضمان الجودة، والموافقة، والخصوصية.
إتاحة Daily Brief مجانًا لمزيد من مستخدمي Gemini الأمريكيين
4 سبتمبر — توسّع Google مجانًا نطاق الوصول إلى Daily Brief ليشمل عددًا أكبر من مستخدمي تطبيق Gemini في الولايات المتحدة. وكانت الميزة قد أُطلقت في 21 مايو.
يعمل Daily Brief في الخلفية ويربط بين تطبيقات Google الخاصة بالمستخدم: إذ تُختصر رسائل البريد الإلكتروني والتقويم والمحادثات والاهتمامات في قائمة واحدة قابلة للتصفح تضم المهام والأولويات، وتُقدَّم كنقطة انطلاق لليوم. ويظل الإعلان مقتصرًا على الولايات المتحدة، ولا يحدد نسبة المستخدمين المعنيين ولا الجدول الزمني للتوسع دوليًا.
Runway تطرح Team، باقة ذاتية الخدمة للفرق التي تضم مقعدين إلى تسعة مقاعد
4 سبتمبر — تطلق Runway باقة Team، التي تسد الفجوة بين الباقات الفردية وعرض Enterprise المخصص للحسابات الكبرى. ويمثل هذا التحول إعادة هيكلة للكتالوج: إذ تصبح Standard وPro وMax باقات فردية صراحةً، وينضم أي عضو جديد الآن عبر Team، بينما تحتفظ مساحات العمل الحالية بإمكانية الوصول وأسعارها.
| ميزة الباقة | القيمة المعلنة |
|---|---|
| السعر الشهري لكل مقعد | 69 دولارًا |
| السعر السنوي لكل مقعد | 55 دولارًا، أي بخصم 20 بالمئة |
| عدد المقاعد المسموح به | 2 إلى 9 |
| الأرصدة الشهرية لكل مقعد | 6 900، تُودع في رصيد مشترك |
| المشاريع المشتركة والتخزين | حتى 100 مشروع، و1 تيرابايت |
تتمحور الباقة حول مشاريع مشتركة تضم الأصول والمراجع وBrand Kits والجلسات وworkflows. وتدافع Runway عن هذا النهج من زاوية اتساق المخرجات: فعندما ينشئ الفريق بأكمله المحتوى انطلاقًا من المراجع نفسها، يشبه الفيديو العاشر الفيديو الأول. وتُرحّل الأرصدة غير المستخدمة لمدة شهر واحد، ويمكن للفريق مشاركة ما يصل إلى 20 مهارة للوكيل، فيما تربط Agent Connectors خدمات Figma وDropbox وNotion بالوكيل الإبداعي.
ElevenLabs توسّع مبادرتها 1 Million Voices إلى البرازيل
4 سبتمبر — توسّع ElevenLabs برنامجها المجتمعي إلى البرازيل، وتعرض قصته البرازيلية الأولى. فقدت Eliane صوتها منذ طفولتها، وأصبح Alberto كفيفًا في سن 46 عامًا؛ ومنحت الشركة Eliane صوتًا يشبه أصوات أفراد عائلتها، ما يتيح لها للمرة الأولى التواصل مع الرجل الذي تحبه بصوت يجسّد هويتها.
يرافق الإعلان شراكتان محليتان. تتيح Associação Brasileira de Esclerose Lateral Amiotrófica، التي تخدم ما يصل إلى 10 000 شخص مصاب بالتصلب الجانبي الضموري في البلاد، لهؤلاء المرضى وصولًا مجانيًا لاستنساخ أصواتهم. ومن جهتها، ستدرّب Sociedade Brasileira de Fonoaudiologia اختصاصيي النطق واللغة البرازيليين على استنساخ الصوت، إذ تراهن الشركة على تمكّن الممارسين من التقنية لتوسيع عدد المرضى المستفيدين. وتمثل مبادرة 1 Million Voices التزامًا عينيًا بقيمة مليار دولار، وقد وصلت إلى أكثر من 11 000 شخص حول العالم منذ إطلاقها.
Kimi Code 0.41.0 يضيف وضعًا متعدد الوكلاء ويلغي إجراءً وقائيًا لم يتجاوز عمره يومين
4 سبتمبر — تصدر Moonshot AI الإصدار Kimi Code 0.41.0. والميزة الأبرز هي tower، وهو وضع تجريبي للتعاون متعدد الوكلاء في واجهة الويب، يُشغَّل بالأمر /tower أو عبر قائمة علامة الجمع في أداة الإنشاء، ويقبل فرعًا أساسيًا كوسيط. وتتلقى إدارة السياق تعديلين: يُبلَّغ النموذج بميزانية السياق المتاحة له قبل إجراء الضغط التلقائي، ثم يُوجَّه إلى سجل أحداث الجلسة لاستعادة التفاصيل الدقيقة. كما يصبح سجل الملفات على مستوى دورة التفاعل دائمًا.
أما النقطة الأبرز فهي التراجع عن قرار سابق. كان الإصدار 0.40.0، المنشور في 2 سبتمبر، قد أضاف حظر الأوامر المدمرة مثل shutdown وreboot وrm -rf في وضع الأذونات التلقائية. لكن الإصدار 0.41.0 يعكس هذا الخيار ويتوقف عن حظر الأوامر الخطرة، وكذلك الأوامر التي يتعذر تحليلها ساكنًا، في الوضع نفسه. وهكذا لم يصمد الإجراء الوقائي سوى يومين. ولا توضّح الملاحظات السبب، لكن التحليل الساكن لأوامر shell يولّد بسهولة نتائج إيجابية كاذبة تعرقل العمل المشروع.
🔗 ملاحظات إصدار Kimi Code 0.41.0
Perplexity تكشف تفاصيل Ivy وTulip وROSE، وهي بنيتها الداخلية لخدمة embeddings
4 سبتمبر — تنشر Perplexity تدوينة هندسية تكشف ما وراء كواليس البنية التحتية التي تخدم نماذج embeddings والتصنيف (ranking) لديها. وتدرّب الشركة نماذجها الخاصة وتشغّلها، ومنها pplx-embed، وتصف فهرس البحث الخاص بها بأنه يعمل على نطاق الإكسابايت.
| مكوّن البنية | اللغة المستخدمة | الدور في الخدمة |
|---|---|---|
| Ivy | Rust | بوابة HTTP، وتقسيم النص إلى رموز، وتجزئة الدُفعات وتوزيعها |
| Tulip | Rust, tokio, tonic | خادم استدلال gRPC، والجدولة والتجميع في دُفعات |
| ROSE | Python | تشغيل النماذج ونوى CUDA ورسومها البيانية |
تتمثل الفكرة الأساسية في إعادة استخدام شيفرة استدلال LLM. وتلاحظ Perplexity أن إنشاء embeddings على دفعات يشبه مرحلة الملء المسبق (prefill) المقيدة بقدرة الحوسبة، بينما يشبه إنشاء embedding عبر الإنترنت لاستعلام قصير مرحلة فك الترميز (decode) المقيدة بالذاكرة. ولذلك تخدم النوى نفسها (kernels) كلًا من pplx-embed وفك ترميز Qwen3.5، من دون إنشاء ذاكرة تخزين مؤقت للمفاتيح والقيم من أجل embeddings، ومع تنويعات للانتباه تقبل مدخلات غير منتظمة (ragged) تتجنب الحشو غير الضروري. وفي نوى الانتباه، يحافظ الفريق على FlashInfer 2 وFlashInfer 3 وFlashAttention 4 بالتوازي بدل اختيار واحد منها فقط، ويُتخذ القرار لكل حالة على حدة وفق عدد الرؤوس وأبعادها. وتُقارن القياسات مع vLLM v0.22.0، لكن نتائجها الرقمية لا تظهر إلا في الرسوم البيانية.
Zed وReplit تعلنان على X من دون تدوينة أو ملاحظات إصدار
4 سبتمبر — وصل إعلانان عن أداتين خارجيتين للبرمجة في اليوم نفسه، وكلاهما يستند إلى منشور واحد فقط على X، من دون تدوينة أو ملاحظات إصدار تدعمه.
تشير Zed إلى أن Delta متاحة الآن للمسجلين في النسخة التجريبية على Windows، ردًا على طلب مستخدم بتاريخ 2 سبتمبر. وهذا التمييز مهم: فـDelta هي بيئة البرمجة الجماعية متعددة المستخدمين والمدعومة بالوكلاء، التي أُطلقت في 12 أغسطس وتتيح لعدة أعضاء في الفريق العمل مع الوكلاء على مشروع مشترك. أما محرر Zed نفسه، فهو متاح بالفعل على macOS وLinux وWindows. لذلك لا يتعلق الإعلان بالمحرر، بل بـDelta التي ظل توفرها على Windows معلقًا منذ أغسطس. ولا يزال النطاق الدقيق لهذه النسخة التجريبية وآلية التسجيل فيها مجهولين.
ومن جانبها، بثت Replit جلسة مباشرة مدتها ساعة و58 دقيقة بعنوان «Replit MCP: وجّه وكيلك من أي مكان». ويشير العنوان إلى خادم MCP يتيح وكيل المنصة للعملاء المتوافقين مع البروتوكول، مع استهداف استخدام يتمثل في بدء مهمة ومتابعة تقدمها من محرر أو طرفية أو مساعد خارجي، من دون المرور بواجهة الويب. ولا تتضمن الرسالة أي نص آخر غير هذا العنوان، ولا رابطًا إلى تدوينة، ولا صياغة صريحة تفيد بالإطلاق.
🔗 Delta على Windows · 🔗 بث Replit MCP المباشر
موجز الأخبار
- نقطة نهاية API تعرض سجل النجوم من دون كشف المستخدمين — تعيد REST API الخاصة بـGitHub أعداد النجوم مع طوابعها الزمنية من دون تحديد الحسابات التي منحتها، لتحل محل نقاط نهاية عرض القوائم التي اقتُصرت على المسؤولين في وقت سابق من العام. 🔗 سجل التغييرات
- npm تقبل عدة إعدادات للنشر الموثوق لكل حزمة — ثلاثة تطورات أصبحت متاحة عمومًا: إعدادات OIDC متعددة وتراكمية لكل حزمة، وتعليق الموافقة ما دام فحص البرمجيات الخبيثة جاريًا، وإتاحة سجل ما قبل الإنتاج في علامة تبويب الإصدارات. 🔗 سجل التغييرات
- GitHub Actions تضيف API لإيقاف دعم runners تدريجيًا — تتيح REST API تواريخ انتهاء دعم إصدار runner، ويفتح إذن
vulnerability-alertsتنبيهات Dependabot للقراءة فقط، وتمنح أربع خصائص ضمن سياقjobالـworkflows القابلة لإعادة الاستخدام هويتها الأصلية. 🔗 سجل التغييرات - إصدار الوثائقي The Story of VS Code في 4 سبتمبر — تروّج GitHub لبث الوثائقي الرسمي عن Visual Studio Code على قناة الناشر في YouTube، بعد نشر إعلان تشويقي في 1 سبتمبر. 🔗 الإعلان
- Replit تسلط الضوء على تطبيق بُني في أسبوع واحد — يُقال إن Pep AI، الذي بناه Cédric Roberge على المنصة خلال أسبوع تقريبًا، يدر نحو 130 000 دولار شهريًا وفقًا لـReplit، ضمن سلسلة منشورات ترويجية أعقبتها نصائح بشأن التسعير. 🔗 سلسلة Replit
- Zed تنشر إعلانًا مرئيًا تعذر التحقق من محتواه — رسالة من أربع كلمات مرفقة بصورة واحدة، نُشرت في 4 سبتمبر عند الساعة 22:14. لم تُحمَّل الصورة أثناء الفحص، ولم ترافق المنشور أي تدوينة أو ملاحظات إصدار، لذلك لا شيء يتيح تحديد ما يعلنه. 🔗 الرسالة
- منظومة LLM مفتوحة ومتكاملة للغة الأرمنية — تجمع تشكيلة على Hugging Face متن الويب ArmWeb، ومجموعة البيانات العلمية الموثّقة ArmSTEM، والنموذج arm-gemma-e4b، مع الإعلان عن مقال سيصدر لاحقًا. 🔗 التدوينة
- VLM Run Gateway تجمع نماذج OCR والرؤية مفتوحة الأوزان خلف API واحدة — تتيح البوابة، عبر نقطة دخول واحدة، نماذج التعرف البصري والرؤية واللغة والرؤية مفتوحة الأوزان، ومنها PaddleOCR-VL-1.6. 🔗 التدوينة
- Sakana AI تفتح أبواب فريقها الهندسي في 5 أكتوبر — تُقام فعالية Engineer Open House مجددًا يوم الاثنين 5 أكتوبر 2026 من الساعة 18 إلى 21، في Toranomon أو عبر الإنترنت، مع التسجيل على connpass. 🔗 الإعلان
- Google تفصّل دورات العمل المكثفة في برنامج تجربة مطوري Gemini Enterprise — تدوينة منهجية من دون إطلاق: تتناول دورة العمل الموصوفة حوكمة الذكاء الاصطناعي في المؤسسات، وتقدم وثائق محدّثة وأمثلة شيفرة موحّدة لـAgent Gateway وSemantic Governance. 🔗 التدوينة
- Suno تطلق اسم عائلة v6 على جيل نماذجها المقبل — في رد على أحد المستخدمين، يصف الحساب الرسمي هذه العائلة بأنها أفضل أعماله حتى الآن، من دون تاريخ أو تفاصيل تقنية، بعد يوم من دخول حدود التنزيل الجديدة حيز التنفيذ. 🔗 الرد
- MiniMax وTogether AI تنظمان أمسية في لندن حول اقتصاد النماذج المفتوحة — تُقام الفعالية المشتركة Open by Design: The Economics of AI in Production في 16 سبتمبر، وهي المنشور الوحيد لـMiniMax خلال الفترة. 🔗 الإعلان
- Mistral تعيد مؤتمر AI Engineer إلى باريس يومي 23 و24 سبتمبر — تجمع العودة إلى Station F نائب رئيس الهندسة Lélio Renard-Lavaud إلى جانب Black Forest Labs وCognition وHugging Face، بعد نفاد تذاكر النسخة السابقة. 🔗 الإعلان
- WebMCP Challenge يغلق باب التقديم — جاء الإغلاق بعد تأجيل مدته اثنتا عشرة ساعة بسبب انقطاع الخدمة في 3 سبتمبر؛ والمشاريع قيد المراجعة حاليًا، وسيُعلن الفائزون قريبًا. 🔗 الإعلان
ما الذي يعنيه ذلك
أصبحت سرعة استيعاب المنظومة لنموذج حدودي هي المؤشر الحقيقي. أُعلن GPT-6 Astra في 3 سبتمبر؛ وفي الرابع منه أصبح متاحًا بلا تحفظ عبر API، ومتاحًا عمومًا على عشر واجهات Copilot، وخضع لقياس جهة خارجية تستخدمه في الإنتاج، ودُمج عبر ثلاثة تصحيحات متتالية في Codex CLI. لم تكن مهلة الأربع والعشرين ساعة هذه موجودة قبل عام. وهي تنقل سؤال الإطلاق إلى التسعير: تطبق GitHub على Astra السعر العام للمزوّد من دون فترة ترويجية، بينما يستفيد Gemini 3.8 Flash من تسعير تمهيدي حتى نهاية العام. وعندما تصل جميع النماذج في اليوم التالي لإعلانها، يعود السعر ليصبح العامل الوحيد الظاهر الذي يميز بينها بالنسبة إلى المستخدم النهائي.
تعالج HydraFusion المشكلة من الطرف الآخر، وهي الخبر الأكثر تأثيرًا في بنية الأدوات خلال اليوم. فالاختيار بين عشرين نموذجًا مهمة لا يؤديها سوى عدد قليل من المطورين بجدية، وتقترح GitHub التوقف عن أدائها تمامًا: يختار المستخدم workflow، وتتولى الأداة تحديد النموذج عند كل طلب. أما الأرقام، أي زيادة قدرها 4.9 نقاط في الجودة مع خفض التكلفة بنسبة 67 بالمئة مقارنةً بـOpus 5 على TerminalBench، فتكتسب أهميتها أساسًا مما توحي به: المكسب يأتي من التنسيق، لا من نموذج متفوق. وإذا صمدت هذه النتيجة خارج ظروف الاختبار المعياري، فلن يعود النموذج هو المنتج، بل يصبح مكوّنًا قابلًا للاستبدال خلف بوابة للجودة.
بدأ وكلاء المؤسسات يخرجون من نطاق الهندسة، والحوكمة تلحق بهم. تؤكد SpaceXAI ذلك صراحةً؛ فأكثر استخدامات Grok Bot كثافة تقع خارج البرمجة، والرقم الأكثر دلالة خلال اليوم ناتج عن تدقيق لمقاعد البرمجيات: 43 اشتراكًا مدفوعًا بلا أي نشاط منذ 90 يومًا. لكن المحتوى الحقيقي لهذه الإعلانات يكمن في آلية الأذونات. يميّز قالب موجه النظام الذي نشرته SpaceXAI بين ثلاثة أنظمة: مسموح دائمًا، ومسموح حسب كل حالة، وغير مسموح مطلقًا. وتصوغ NVIDIA المبدأ نفسه في تدوينتها عن ذاكرة الوكلاء: يمكن للسياق أن يوضّح الإجراء، لكنه لا يستطيع الإذن به. وهكذا يصل طرفان لا علاقة بينهما، في اليوم نفسه، إلى خلاصة مفادها أن تعريف الوكيل المفيد يبدأ أولًا بما يُحظر عليه فعله.
في أدوات سطر الأوامر، يتقدم الأمان بخط متعرج بدلًا من خط مستقيم. تزيل Gemini CLI مفتاح API مضمّنًا في الشيفرة وتعزز عزلها، وتصحح Claude Code قواعد أذونات كانت تتيح الكتابة في مجلدات يُفترض أنها للقراءة فقط، فيما تلغي Kimi Code حظر الأوامر المدمرة بعد يومين من إضافته. والحالة الأخيرة هي الأكثر إفادة: فالتحليل الساكن لأوامر shell يولّد عددًا كافيًا من النتائج الإيجابية الكاذبة لجعل إجراء وقائي سليم نظريًا غير محتمل في الاستخدام. ولا يتحدد أمان هذه الأدوات عند الإعلان عن وسيلة حماية، بل بقدرتها على الصمود عند احتكاكها بالمستخدمين.
وتبقى أخبار اليوم في الرياضيات والعلوم، وهي الأصعب تقييمًا في حينها. فالبرهان المصاغ رسميًا لنظرية Fermat خلال أحد عشر يومًا لا ينتج أي رياضيات جديدة، بل يتحقق من نتيجة عمرها ثلاثون عامًا. وهذا تحديدًا ما يجعله مثيرًا للاهتمام، لأن مراجعة الأقران هي عنق الزجاجة الذي يُقاس بالسنوات، ولأن Kevin Buzzard يشير إلى أن هذه المصنوعات أصبحت الآن متينة بما يكفي لتشكّل أساسًا لأعمال أخرى. ويندرج محاكي المناخ من Ai2 والـconnectome الخاص بذباب الفاكهة ضمن المنطق نفسه: لا يحقق أي منهما اكتشافًا، لكن كليهما يجعل عملًا كانت تكلفته تحول دون تنفيذه على نطاق واسع قابلًا للتطبيق. وهذا استخدام أقل إثارة من الاكتشاف المستقل، لكنه على الأرجح أقرب إلى ما يغيّره الذكاء الاصطناعي فعلًا في الممارسة العلمية.
المصادر
- GPT-6 Astra متاح لخطط Pro وEnterprise وBusiness Premium
- GPT-6 Astra متاح بشكل عام في GitHub Copilot
- Perplexity تقيّم GPT-6 Astra على WANDR
- Codex CLI 0.153.3
- بناء لعبة باستخدام Astra
- إضفاء الصيغة الرسمية على مبرهنة فيرما الأخيرة
- برهان مبرهنة فيرما الأخيرة على GitHub
- مشروع HydraFusion
- Lyria 3.5 في تطبيق Gemini
- Grok Bot للمؤسسات
- Haggle Bot، وكيل المشتريات لدى SpaceXAI
- Grok يتصل بالحسابات المالية عبر Plaid
- Claude Code 2.1.260
- Claude Code 2.1.261
- الأمر ant apply
- وكيل موجّه بالذاكرة باستخدام NVIDIA NemoClaw
- الاستدلال الحدّي يصل إلى Jetson
- نقل هوية المستخدم بين منصات Kubernetes الموحدة
- الإصدار الليلي Gemini CLI v0.60.0
- سجل تغييرات Antigravity
- SamudrACE-E3SMv3 من Ai2
- الخريطة العصبية الكاملة لذبابة فاكهة ذكر
- Muse Spark 1.3 max متاح للعامة
- Percept-Lens من Sakana AI
- بحث Percept-Lens على arXiv
- TAOT في LoongForge
- Open Yap 1K
- توسيع Daily Brief في الولايات المتحدة
- Runway تطلق خطة Team
- 1 Million Voices يصل إلى البرازيل
- Kimi Code 0.41.0
- تضمينات سريعة على GPU لدى Perplexity
- Delta متاح على Windows في إصدار تجريبي
- Replit MCP متاح مباشرة
- نقطة نهاية تراعي الخصوصية لسجل النجوم
- إعدادات متعددة للنشر الموثوق في npm
- تحديثات GitHub Actions في مطلع سبتمبر
- قصة VS Code
- Pep AI المطوّرة على Replit
- إعلان مرئي نشرته Zed
- منظومة LLM مفتوحة للغة الأرمنية
- VLM Run Gateway
- اليوم المفتوح للمهندسين لدى Sakana AI
- سباقات برنامج DevEx في Gemini Enterprise
- Suno تلمّح إلى عائلة v6
- Open by Design في لندن
- AI Engineer يعود إلى باريس
- اختتام تحدي WebMCP