ai-powered-markdown-translatorمقال مترجم من الفرنسية إلى العربية باستخدام gpt-6.1-sol.
ستضيف OpenAI خلال الأسابيع المقبلة علامة مائية غير مرئية إلى نصوص ChatGPT وCodex لمستخدميها في الاتحاد الأوروبي، استجابةً لقانون AI Act الذي يفرض جعل النصوص المولّدة قابلة للتعرّف عليها آليًا، وتتيح هذه العلامة المائية اعتبارًا من اليوم خيارًا لعملاء API في جميع أنحاء العالم. وعلى صعيد الوكلاء، تترسخ الذاكرة: تزود Cognition وكيل Devin بذاكرة تمتد بين الجلسات وتنشر تنسيقها بوصفه معيارًا مفتوحًا، وتطلق Cohere نظام North 2 بذاكرة تحتفظ بالسياق من جلسة إلى أخرى؛ وتنشر GitHub من جانبها ReviewBench، وهو معيار اختبار مفتوح لمراجعة الشيفرة بالذكاء الاصطناعي. وفي مجال النماذج المفتوحة، تقدم Reflection AI نموذج Beam، الذي يضم 501 مليار معلمة، مع وعد بإتاحة أوزانه في وقت لاحق من أكتوبر.
علامة OpenAI المائية غير المرئية: وسم نصوص ChatGPT وCodex في الاتحاد الأوروبي، وخيار عالمي في API
5 أكتوبر — تنشر OpenAI استجابتها للقواعد الأوروبية المتعلقة بمصدر النصوص. يفرض قانون AI Act على مزودي الذكاء الاصطناعي التوليدي جعل النصوص التي ينتجونها قابلة للتعرّف عليها بصيغة مقروءة آليًا؛ وتستجيب OpenAI لذلك على مراحل، مع التنبيه منذ البداية إلى أن تقنيات العلامات المائية الحالية للنصوص تعاني قيودًا كبيرة (قيود كبيرة).
| الفئة المعنية | ما الذي يتغير | الجدول الزمني المعلن |
|---|---|---|
| مستخدمو ChatGPT وCodex في الاتحاد الأوروبي، ضمن جميع الخطط | إضافة علامة مائية غير مرئية إلى النصوص المؤهلة | خلال الأسابيع المقبلة |
| عملاء API في جميع أنحاء العالم | علامة مائية اختيارية (opt-in) على نماذج مختارة لم تُذكر أسماؤها، ومعطلة افتراضيًا | اعتبارًا من 5 أكتوبر |
| الباحثون والمؤسسات المتخصصة المعتمدون | الوصول إلى أداة الكشف، كل حالة على حدة، بعد تقديم طلب | فتح باب الطلبات في 5 أكتوبر |
لا تجعل OpenAI هذه العلامة إعدادًا افتراضيًا عالميًا، وتعمل مع شركاء الخدمات السحابية لتوفير العلامة المائية نفسها خلال الأسابيع المقبلة على نماذج OpenAI التي يقدمونها. تضيف تقنية textGrain إشارة إحصائية غير مرئية إلى اختيارات النموذج للكلمات، من دون علامة ظاهرة أو محرف خاص؛ وبحسب OpenAI، فإنها تضاهي الأساليب الأخرى التي اختُبرت أو تتفوق عليها، بما فيها SynthID للنصوص. وقد نُشر تقرير تقني، وتعتزم OpenAI إتاحة شيفرة التقنية. أما أداة الكشف فليست متاحة للجمهور عند الإطلاق، بسبب احتمال عدم رصد بعض العلامات المائية وظهور نتائج إيجابية كاذبة: ويخضع الوصول إليها لمدونة الممارسات (مدونة الممارسات) الصادرة عن المفوضية الأوروبية.
تُظهر الأرقام المنشورة، قبل كل شيء، حدود الكشف:
| ظروف القياس | معدل الكشف المنشور |
|---|---|
| مقاطع بطول 200 tokens، محتوى في مجال علم النفس، مع استهداف 1 % من النتائج الإيجابية الكاذبة | نحو 80 % |
| مقاطع بطول 400 tokens، محتوى في مجال علم النفس، مع استهداف 1 % من النتائج الإيجابية الكاذبة | نحو 95 % |
| محتوى في مجال الرياضيات، مع عتبة 1 % نفسها | أقل بكثير (القيمة واردة في رسم بياني فقط) |
| مقاطع بطول 400 tokens باللغة الإنجليزية (مجموعة ELI5)، من دون تعديل | نحو 92 % |
| المقاطع نفسها، مع استبدال 10 % من الكلمات بمرادفات | 66 % |
| المقاطع نفسها، مع استبدال 25 % من الكلمات | 17 % |
Watermarks have limits. They’re often undetectable, especially in short passages. Rewriting or translating text can completely remove the watermark.
🇸🇦 للعلامات المائية حدود. فكثيرًا ما يتعذر كشفها، ولا سيما في المقاطع القصيرة. وقد تؤدي إعادة صياغة النص أو ترجمته إلى إزالة العلامة المائية بالكامل. — @OpenAI على X
فيما يتعلق بالجودة، لم ترصد OpenAI فرقًا ذا دلالة في ثمانية معايير اختبار لنموذج GPT-6 Astra من دون علامة مائية ومعها (94,44 % مقابل 93,94 % على GPQA Diamond، و53,90 % مقابل 56,06 % على Terminal-Bench 4.0). وتوضح التدوينة أيضًا ما لا تخبرنا به العلامة المائية: لا نسبة العمل البشري، ولا ملكية النص أو المسؤولية عنه، ولا هوية المستخدم، ولا دقة المحتوى؛ كما أن غيابها لا يثبت أن إنسانًا كتب النص. أما الصور والصوت، فلا تغيير بشأنهما: يظل openai.com/verify وContent Provenance API متاحين للمؤسسات، وتُضاف SynthID منذ 19 مايو إلى بيانات C2PA الوصفية للصور المولّدة.
🔗 تدوينة OpenAI حول مصدر النصوص في الاتحاد الأوروبي
وكلاء البرمجة: Devin يتذكر بين الجلسات، وCursor وQwen Code وTogether Link وIBM Bob
5 أكتوبر — تقدم Cognition في Devin وظيفتين مترابطتين: Memory، وهي ذاكرة تستمر من جلسة إلى أخرى، وDreaming، وهي عملية «حلم» يومية تعيد تنظيمها. تحتفظ Memory بما يتعلمه الوكيل أثناء العمل مع كل مستخدم: التفضيلات، والتصحيحات، والدروس المستفادة من مشروع أو سير عمل. وهذه ليست ملخصات للجلسات، بل ملاحظات قصيرة، ترتبط كل منها بالجلسة التي تعلّم فيها الوكيل الدرس، وتبقى هذه الذاكرة شخصية: فلا تتحول إلى تعليمة مشتركة على مستوى المؤسسة بأكملها.
تُحفظ الملاحظات في Memory Drive، وهو مستودع Git دائم لملفات Markdown مصنفة بحسب المستودع أو المشروع أو الموضوع. ويجمع ملف MEMORY.md، الذي يُحافظ على قصره عمدًا، التفضيلات العامة وفهرس بقية المحتوى: يتلقاه Devin في بداية كل جلسة، ثم يبحث عن الملاحظات المفيدة باستخدام الأدوات نفسها التي يستعملها لتصفح الشيفرة، من دون تحميل الأرشيف كله في prompt. وتعمل كل جلسة على نسختها الخاصة من Git: يدمج Devin تحديثات الجلسات الأخرى، ويرفض فحص المراجعة عمليات الكتابة المستندة إلى نسخ متقادمة، ويُبلَّغ عن التعارضات بدلًا من الكتابة فوقها بصمت.
Dreaming هي جلسة يومية تعمل في الخلفية (ليلًا، كما يوضح تسلسل منشورات Cognition): يعيد Devin قراءة المحادثات السابقة في ضوء ذاكرته، ويدمج الملاحظات المتداخلة، ويزيل التفاصيل المؤقتة، ويبحث عن الدروس التي لم تُدوَّن، ويحذف الذكريات التي لم تستخدمها أي جلسة. ويمكن الوصول إلى الوظيفة عبر devin.ai، من قائمة Customize → Memory؛ ولا تذكر التدوينة شيئًا عن Devin Desktop أو Devin CLI، ولا تعلن أي أسعار.
تنشر Cognition التنسيق أيضًا بوصفه معيارًا مفتوحًا، Agent Memory Repo، بموجب ترخيص MIT. وتصف المواصفة، المفتوحة للمساهمات، دورة كل جلسة (استنساخ الذاكرة، والبحث، والتحديث من دون تدخل بشري في الدورة، ودفع التغييرات بعد كل تعديل)، وكذلك الجمع بين عدة ذاكرات في جلسة واحدة، بحيث تكون كل ذاكرة في مستودع خاص بها مع صلاحياتها وسجلها. ومن الاستخدامات المذكورة ذاكرة الفريق وأسراب الوكلاء (أسراب الوكلاء):
In early experimentation we saw a swarm of Devins using the memory as a way to coordinate at large scale without us prompting them to (we promise they didn’t hack anyone)
🇸🇦 في التجارب الأولى، رأينا سربًا من وكلاء Devin يستخدم الذاكرة للتنسيق على نطاق واسع من دون أن نطلب منهم ذلك (نعدكم بأنهم لم يخترقوا أحدًا). — @cognition على X
كانت فكرة «الحلم» الذي يعيد تنظيم ذاكرة الوكيل موجودة بالفعل لدى Anthropic (Claude Managed Agents، في مايو) ولدى OpenAI (ذاكرة ChatGPT، في يونيو)؛ والجديد هنا هو ذاكرة في ملفات تُدار إصداراتها باستخدام Git، منشورة في صورة مواصفة يمكن لوكلاء آخرين اعتمادها.
🔗 الذاكرة والحلم، تدوينة Cognition 🔗 مواصفة Agent Memory Repo
Cursor: توجيه وكلاء SDK أثناء تشغيلهم
5 أكتوبر — توسع Cursor قدرات SDK الخاص بها، الذي يتيح إطلاق وكلائها من شيفرة TypeScript أو Python. تُدخل الطريقة run.steer() رسالة في الجولة الحالية للوكيل؛ وإذا كان وكيل فرعي يعمل في تلك اللحظة، ينتقل إلى الخلفية ويواصل عمله. وتُرجع الوكلاء الفرعية العاملة في الخلفية نتائجها أيضًا: تعود النتيجة إلى الوكيل الرئيسي على هيئة جولة إضافية ضمن التشغيل نفسه، بدلًا من ضياعها عند انتهاء جولة الوكيل الرئيسي.
| الميزة الجديدة في SDK | النطاق المحدد في سجل التغييرات |
|---|---|
run.steer()، التوجيه أثناء التشغيل | الوكلاء المحليون في TypeScript؛ أما في الوكيل السحابي فتُرسل الرسالة كمتابعة عادية |
| إرجاع نتائج الوكلاء الفرعية العاملة في الخلفية | الوكلاء المحليون، في TypeScript وPython |
| توصيفات MCP للأدوات المخصصة (readOnlyHint، destructiveHint…) | TypeScript؛ مجرد إرشادات لا يفرض SDK الالتزام بها |
| إمكانية استبدال prompt النظام، مع استمرار تحميل القواعد والمهارات | الوكلاء المحليون في TypeScript؛ يُفعَّل الوصول لكل حساب على حدة |
لا تُرافق هذه التغييرات أي أسعار معلنة.
🔗 تسلسل منشورات Cursor على X 🔗 سجل تغييرات SDK الخاص بـCursor
Qwen Code v0.25.0: وكلاء مساحة العمل، وقناة بريد إلكتروني، وذاكرة Mem0
5 أكتوبر — تنشر Qwen الإصدار v0.25.0 من Qwen Code، وكيلها للبرمجة عبر سطر الأوامر، وهو أول إصدار مستقر منذ v0.24.7 الصادر في 29 سبتمبر: 42 ميزة، منها 23 لـManaged Agent، و79 إصلاحًا، ومن دون تغييرات معروفة تكسر التوافق. وتبرز ثلاث إضافات، تتطلب جميعها التفعيل صراحةً. بات وكلاء مساحة العمل يتعاونون محليًا: تُطلق خدمة الخلفية جولاتهم وتستأنفها، ويتيح Web Shell إدارة الوكلاء والمهام واستدعاء أحدهم باستخدام @agent من داخل محادثة. ويصبح هؤلاء الوكلاء الدائمون متاحين عبر بروتوكول A2A 1.0، من خلال مشاركات تنتهي صلاحيتها ويمكن إبطالها. وأخيرًا، تتصل ذاكرة Mem0 مباشرةً بـCLI: يكفي تحديد نقطة نهاية ومفتاح، ويسجل Qwen Code خادم MCP الموافق بنفسه. وتمنح قناة بريد إلكتروني الوكيل صندوق بريد خاصًا به أيضًا، عبر IMAP وSMTP، بينما ينفذ Code Mode بالتوازي استدعاءات Bash التي يجمعها النموذج. وتبع ذلك SDK الخاص بـTypeScript بالإصدار v0.1.18 وتطبيق Desktop بالإصدار v0.25.0 في الصباح نفسه، من دون تغريدة من Qwen.
🔗 ملاحظات إصدار Qwen Code v0.25.0
Together Link: تشغيل Claude Code وCodex وOpenCode وPi على نماذج مفتوحة
5 أكتوبر — تطلق Together AI نسخة تجريبية من Together Link، التي تُشغّل وكلاء البرمجة المثبتين بالفعل على النماذج المفتوحة التي تستضيفها المنصة. يربط أمر تثبيت واحد (على macOS أو Linux) كلًا من Claude Code وClaude Desktop وCodex وOpenCode وPi بـAPI الخاصة بها، باستخدام مفتاح الحساب؛ وتضيف الوثائق ChatGPT Desktop إلى القائمة، وتنبه إلى أن الأوامر والتوجيه وقائمة النماذج قد تتغير لاحقًا. وإلى جانب وضع Auto، تُطرح أربعة نماذج، جميعها بسياق يبلغ 1M من الرموز:
| النموذج المطروح | المقابل في قائمة /model في Claude Code |
|---|---|
| Kimi K3 | Opus |
| GLM 5.3 | Fable |
| GLM 5.3 Flash | Sonnet |
| DeepSeek V4.1 Flash | Haiku |
يمكن لوضع Auto، المختار افتراضيًا، إسناد المهام الصعبة إلى Opus 5.5 عندما يقدم المستخدم مفتاح Anthropic، لكن التدوينة والوثائق لا تصفان هذا التوجيه بالطريقة نفسها: فبحسب التدوينة، يُتخذ القرار مرة واحدة في كل جلسة للحفاظ على ذاكرة التخزين المؤقت لـprompt، بينما تصف الوثائق فرزًا لكل طلب على حدة يقتصر على Claude Code وClaude Desktop. وتعلن Together AI خفض الإنفاق بأكثر من 50 %، من دون نشر منهجية، وتعرض بعد كل جلسة تكلفتها إلى جانب التكلفة التي كانت ستبلغها لو جرت على Opus 5.5.
🔗 تدوينة Together AI 🔗 وثائق Together Link
IBM Bob المستضاف ذاتيًا يعتمد على Nemotron 3 Ultra من NVIDIA
5 أكتوبر — توضح IBM سبب اعتماد النسخة المستضافة ذاتيًا (self-hosted) من Bob، مساعدها للتطوير القائم على الوكلاء، على Nemotron 3 Ultra من NVIDIA، إلى جانب Poolside Laguna S 2.1. ويُشغّل هذا الخيار، الذي دخل مرحلة الإتاحة العامة في الأسبوع السابق، المساعد على البنية التحتية للعميل، بما فيها البيئات المعزولة عن الشبكات (air-gapped). وقيّم الفريق النماذج وفق أربعة معايير (المتطلبات المادية، والدقة في البرمجة، وزمن الاستجابة، وانفتاح الأوزان)، واختبرها باستخدام إطار تشغيل الوكيل في Bob، مع الاستعانة بنماذج مغلقة من Anthropic وOpenAI وGoogle كمرجع. كان Nemotron مطيلًا أكثر من اللازم في البداية، فجرى ضبطه بالتعاون مع NVIDIA: تعليمات prompt، ومعلمات أخذ العينات، وإعدادات الاستدلال، وإصلاحات إطار التشغيل. وبحسب اختبارات IBM الداخلية، يوفر Nemotron 3 Ultra على وحدات GPU من نوع Blackwell زمن استجابة أقصر بما يصل إلى نحو 4 مرات مقارنةً بنماذج SaaS متقدمة تُستدعى عبر الشبكة، ويلتزم بمخططات الأدوات التزامًا صارمًا؛ واختير Laguna S 2.1 لنسبة أدائه إلى متطلباته المادية. ولا تنشر التدوينة أي درجة للدقة.
🔗 تدوينة IBM حول Bob المستضاف ذاتيًا
ReviewBench: تطلق GitHub معيار تقييم مفتوحًا لمراجعة الشيفرة بالذكاء الاصطناعي
5 أكتوبر — تطلق GitHub منصة ReviewBench في معاينة بحثية (research preview)، وهي معيار تقييم مفتوح لوكلاء مراجعة الشيفرة بالذكاء الاصطناعي. وينشر الموقع المخصص مجموعة البيانات الكاملة، والترتيب، والمنهجية، وطلب التوجيه وإعدادات المُقيِّم، إلى جانب أداة تشغيل بالخدمة الذاتية. تحمل التدوينة توقيع ميشيل تشو وأليخاندرو كارديريرا دي دييغو، وتذكر في الشكر مساهمة GitHub وMicrosoft في المشروع.
تضم مجموعة البيانات 219 طلب سحب من 187 مستودعًا عامًا مفتوح المصدر، تغطي 19 لغة. وتحاكي توزيعات اللغات وأحجام المستودعات فيها توزيعات GitHub، التي حُدِّدت استنادًا إلى 103,9 مليون طلب سحب، مع ترجيح مقصود للتغييرات المتوسطة والكبيرة. تجمع الحقيقة المرجعية (golden set) بين مراجعين بشريين، ومشكلات مستنتجة من عمليات الإيداع اللاحقة، وأدوات تحليل حتمية، وعدة نماذج LLM متقدمة؛ ويعتمد الملاحظات مُقيِّم قائم على LLM، هو Claude Sonnet 5 وفقًا للتدوينة. وقد أعاد مهندسون ذوو خبرة، لم يشاركوا في بناء مجموعة البيانات، تصنيف كل ملاحظة: وتوافقت أحكامهم مع ReviewBench في 96,6 % من الحالات. ويُستخدم الاستدعاء «المستند إلى المرجع» (grounded)، المقاس على الحقيقة المرجعية وحدها، أساسًا للمقارنة.
وفقًا للترتيب الأولي الذي نشرته GitHub، يتصدر Copilot code review:
| الوكيل المُقيَّم (الإعداد) | F1 المستند إلى المرجع | الدقة المستندة إلى المرجع | الاستدعاء المستند إلى المرجع | تاريخ التشغيل |
|---|---|---|---|---|
| Copilot Code Review (Balanced) | 40,1 % | 87,8 % | 26,0 % | 1 أكتوبر 2026 |
| Devin AI | 37,0 % | 84,0 % | 23,8 % | 28 سبتمبر 2026 |
| Qodo | 35,1 % | 85,3 % | 22,1 % | 28 سبتمبر 2026 |
| Codex (GPT-5.6 Sol · Ultra) | 32,3 % | 87,0 % | 19,9 % | 19 يوليو 2026 |
| Cubic | 27,3 % | 85,5 % | 16,3 % | 29 يونيو 2026 |
| Greptile | 27,2 % | 86,1 % | 16,2 % | 16 يونيو 2026 |
| Cursor | 17,3 % | 87,7 % | 9,6 % | 27 سبتمبر 2026 |
يوضح الموقع أن فريق ReviewBench أنتج هذه النتائج الأولية بتشغيل المنتج العام لكل شركة في التاريخ المحدد، وأن الشركات لم تُجرِ هذه الاختبارات ولم تتحقق منها. ويمكن لأي جهة الآن تقديم وكيلها: يقدم المرشح صورة حاوية ومفتاح النموذج، وتوفر GitHub المُقيِّم، وتُجرى اختبارات على 25 طلب سحب، ثم تشغيل كامل على ثلاث جولات؛ ولا تُنشر النتيجة إلا بعد اعتمادها من أحد القائمين على الصيانة، وفقط إذا حسّنت النتيجة السابقة للوكيل أو كانت أول مشاركة له.
تستخدم GitHub هذا المعيار أيضًا لتطوير Copilot code review. ففي اختبار A/B، حققت مراجعة متعددة النماذج من مستوى Lite، تجمع عدة عمليات تشغيل مستقلة، زيادة في الاستدعاء قدرها 13,6 %، مع انخفاض تكلفة المراجعة الواحدة بنسبة 8,0 %، بما يتوافق مع الاتجاه المتوقع من التقييمات غير المتصلة. وتتناقض التدوينة بشأن عدد التعليقات: +61 % وفقًا للنص، و+25,0 % وفقًا للرسم البياني.
🔗 تدوينة GitHub حول ReviewBench 🔗 موقع ReviewBench وترتيبه
تطلق Cohere منصة North 2 وتعقد تحالفًا عالميًا مع PwC
5 أكتوبر — تطلق Cohere منصة North 2، الإصدار الجديد من North، منصتها لوكلاء الذكاء الاصطناعي الموجهة للمؤسسات، التي أُعلن في 9 سبتمبر أنها «ستتوفر قريبًا»، ثم وُعد بإتاحتها في أكتوبر. ويذكر تسلسل منشورات الإطلاق وجود أكثر من 15 ميزة جديدة (15+ ميزة جديدة)، وهو عدد لا تذكره التدوينة. ويتمحور الإصدار حول إطار تشغيل جديد للوكلاء (agent harness)، أُعيد تصميمه لدعم عمليات الأتمتة والوكلاء متعددي الخطوات، على منصة تظل محايدة تجاه النماذج: نماذج Cohere أو نماذج العميل.
| المجال الوظيفي | الميزات الجديدة التي ذكرتها Cohere |
|---|---|
| الوكلاء | وكلاء وعمليات أتمتة قابلة لإعادة الاستخدام، تُنشأ بطلب توجيه وتُشارك داخل المؤسسة؛ تنسيق بين عدة وكلاء؛ ذاكرة تحتفظ بالسياق من جلسة إلى أخرى |
| الإنتاجية | مهارات (Skills)، ومكتبات (Libraries)، وتطبيقات تنتج عروضًا تقديمية ولوحات معلومات ومستندات؛ وAutomations، التي أُطلقت في أواخر يوليو، مع قوالب جاهزة للاستخدام ومحرر مرئي |
| الموصلات | Slack وSharePoint وOneDrive وOutlook وExchange وJira وLinear وNotion وGitHub؛ أما مزودو البيانات المالية، مثل PitchBook وFactSet وغيرهما، فما زال دعمهم مخططًا له فقط |
| النشر والأمان | استضافة ذاتية، أو VPC، أو بيئة هجينة، أو داخل المؤسسة، أو دون اتصال بالكامل؛ SOC 2 Type 2 وISO 27001 وISO 42001؛ سياسات للاستقلالية مع اعتماد بشري للقرارات الحساسة |
| الحوكمة | وحدة تحكم North Admin، ومستويات لاستهلاك الطلبات وtokens لكل مستخدم أو مجموعة، وتنبيهات قبل بلوغ الحدود القصوى |
تذكر Cohere عميلين، هما LG CNS في كوريا الجنوبية وBell Cyber في كندا، وتبرز تحسن معدل معالجة نماذجها على وحدات GPU من NVIDIA Blackwell وHopper، دون أرقام، مع اقتباس من كاري بريسكي، المسؤولة عن الذكاء الاصطناعي التوليدي لدى NVIDIA. ولم تُذكر أسعار أو مواعيد للنشر: إذ تحيل التدوينة إلى حجز عرض توضيحي لدى فرق المبيعات.
🔗 تدوينة إطلاق North 2 🔗 تسلسل منشورات إطلاق North 2 على X
التحالف العالمي مع PwC، الذي يبدأ في كندا
5 أكتوبر — في اليوم نفسه، تعلن PwC وCohere تحالفًا عالميًا (تحالف عالمي) يبدأ في كندا، في بيان صادر عن PwC Canada مؤرخ في تورونتو، تنقله تدوينة قصيرة من Cohere. ويتضح توزيع الأدوار: توفر Cohere منصة North، ونماذجها للمؤسسات، وأدواتها لاسترجاع المعلومات؛ وتقدم PwC خبرتها القطاعية والتنظيمية وفي إدارة المخاطر والتحول، بدءًا من اختيار حالات الاستخدام وصولًا إلى دمج الذكاء الاصطناعي مع بيانات المؤسسة وأنظمتها. وتشمل الاستخدامات المعلنة البحث داخل المؤسسات، والوصول إلى المعرفة، والبحث المتعمق، ودعم اتخاذ القرار، وأتمتة المهام، في سحابة خاصة، أو داخل المؤسسة، أو في بيئة غير متصلة، مع استهداف القطاعات الخاضعة للتنظيم أولًا. ويذكر البيان دومينيك مارينو وآني فييه من PwC Canada، وآيدان غوميز من Cohere؛ ولا يحدد قيمة مالية أو عميلًا أو جدولًا زمنيًا يتجاوز كندا. وكانت Cohere قد عقدت بالفعل تحالفًا مع OpenText في 16 سبتمبر.
🔗 تدوينة Cohere حول التحالف مع PwC 🔗 بيان PwC Canada
نماذج مفتوحة: Beam وMetaEncoder-30B وGemma 4 في علم جينوم النباتات
تتصدر ثلاثة نماذج مفتوحة أخبار اليوم، في ثلاث مراحل مختلفة: أحدها موعود بإتاحته، والثاني نُشر دون إعلان، والأخير سُلِّط الضوء عليه بعد شهر من نشره.
Beam: نموذج Reflection AI المفتوح ذو 501 مليار معلمة
5 أكتوبر — تقدم Reflection AI نموذج Beam، أول نموذج لها بأوزان مفتوحة: نموذج MoE متناثر يضم 501 مليار معلمة، منها 23 مليار معلمة نشطة، مصمم للبرمجة والاستدلال والمهام التي ينفذها الوكلاء، ودُرِّب من البداية إلى النهاية من الصفر. وشمل التدريب المسبق 23 800 مليار tokens؛ واستخدمت مرحلة التعلم المعزز 10 500 وحدة GPU من NVIDIA GB300 لمدة أربعة أسابيع، وأنتجت أكثر من 100 مليون مسار (rollouts).
وفقًا لجداول Reflection AI:
| معيار التقييم | Beam | Nemotron 3 Ultra | GLM 5.3 | Kimi K3 | Qwen 3.8 Max | DeepSeek V4.1 Flash |
|---|---|---|---|---|---|---|
| SWE-bench Verified | 80,9 | 70,7 | — | — | — | — |
| SWE Bench Pro v1 | 65,5 | 46,4 | — | — | 67,7 | — |
| Terminal Bench v2.1 | 80,1 | 56,4 | 88,2 | 88,3 | 86,6 | 90,6 |
| DeepSWE v1.1 | 44,4 | — | 61,0 | 68,0 | 51,0 | 74,2 |
تشير الشرطة إلى نتيجة لم تُذكر في التدوينة. وتقول Reflection AI إن نتائج الاستدلال تضاهي نتائج GLM-5.2 مع استخدام موارد حسابية للاستدلال أقل بمقدار 3 إلى 4 أضعاف، وتقر بأن Kimi K3 يظل متقدمًا في القدرة الخام. ولا يتوفر شيء للتنزيل حتى الآن: يخضع Beam للتقييمات النهائية واختبارات هجومية (red-teaming)، ويتطلب الوصول المبكر التسجيل، مع وعد بإتاحة الأوزان والتقرير التقني وبطاقة النموذج وأدوات للمطورين لاحقًا في أكتوبر.
🔗 تدوينة Reflection AI حول Beam
MetaEncoder-30B، مُشفِّر القرارات الذي تنشره Meta دون إعلان
5 أكتوبر — نشرت Meta على Hugging Face، ضمن حساب مؤسستها facebook، نموذج MetaEncoder-30B، دون العثور على إعلان عنه: ولم يكن المستودع، الذي أُنشئ في 30 سبتمبر وعُدِّل في 5 أكتوبر، يسجل سوى تنزيلين وقت رصدنا. وتقدم البطاقة مُشفِّرًا متعدد الوسائط من نوع «System One»، وهو صيغة نماذج القرار لدى Jev: تُعطى له مهمة باللغة الطبيعية، مثل سؤال أو تعليمة أو وصف حالة أو معايير، وقائمة من الخيارات المرشحة، نصيًا مع صور ومقاطع فيديو داعمة، فيمنح كل خيار درجة. ولأن المهمة والخيارات المرشحة تُشفَّر بصورة منفصلة، تقتصر المقارنة على جداء قياسي، ويمكن لفهرس أقرب الجيران أن يغطي ملايين الخيارات المرشحة دون إعادة تشغيل النموذج. ويُعد MetaEncoder ضبطًا دقيقًا تباينيًا لنموذج Muse Glimmer 30B، النموذج الموجه لمهام الوكلاء ذي الأوزان المفتوحة الذي أصدرته Meta في أغسطس، ويرث منه ترخيص Apache 2.0؛ ويتطلب التنزيل قبول الشروط، ويتولى vLLM تشغيله للنصوص والصور.
| معيار التقييم | النتيجة وفقًا لبطاقة النموذج | المقياس المستخدم |
|---|---|---|
| JEVBench (الأصلي / السهل / الصعب) | 0,9444 / 1,0000 / 0,7387 | الدقة |
| ImaJEV-Bench | 0,8958 | الدقة |
| NanoBEIR | 0,6632 | NDCG_linear@10 |
| MMEB-V3 (الصور / الفيديو / المستندات المرئية) | 0,7897 / 0,6046 / 0,8138 | Hit@1 / Hit@1 / NDCG@5 |
🔗 بطاقة MetaEncoder-30B على Hugging Face
تجمع Living Models بين Gemma 4 وBOTANIC-1 لفك شيفرة الحمض النووي للنباتات
5 أكتوبر — تسلط Google الضوء، في مقال على X من @GoogleAI وعلى واجهتها Gemmaverse، على عمل Living Models، وهو مختبر أحياء يعتمد على الذكاء الاصطناعي ومقره باريس. ويتولى Gemma 4 E4B تنسيق التحليل، بما يشمل سلاسل المعالجة في الطرفية، وتصفية البيانات، واستدعاءات الأدوات، محليًا عبر Ollama على وحدة GPU واحدة من NVIDIA L4، بينما يقيِّم BOTANIC-1، وهو نموذج تأسيسي للجينوم دُرِّب مسبقًا على 320 نوعًا نباتيًا، أثر الطفرات؛ وتظل الجينومات المملوكة للمؤسسة داخل الموقع. وتستند دراسة الحالة إلى اكتشاف أجراه عدنان بوعلام في INRAE: يؤدي تغيير حرف واحد في جين CmEIN3 لدى الشمام إلى تحول الزهرة من أنثوية إلى خنثى. ومن بين 2 494 طفرة نقطية مرشحة، جاءت الطفرة المثبتة في المرتبة الأولى دون تعادل، في أقل من أربع دقائق وفقًا للمقال على X.
| الإعداد المختبَر (20 عملية تشغيل) | Recall@1 |
|---|---|
| دون توجيه | 0,00 |
| توجيه خبير | 0,15 |
| مع درجة BOTANIC-1 | 0,90 |
تعود نماذج Botanic1، التي تتراوح أحجامها من 0,3 إلى 2 مليار معلمة، والورقة الأولية على bioRxiv إلى أوائل سبتمبر: والجديد هو تسليط Google الضوء عليها وتفاصيل النتائج.
🔗 مقال Google AI على X 🔗 صفحة Gemmaverse التابعة لـGoogle DeepMind
الإعلانات في ChatGPT: صيغة مرئية قيد الاختبار وقياس أوسع نطاقًا
5 أكتوبر — تُعد OpenAI صيغة إعلانية مرئية لـChatGPT: ستعرض الصور أفكارًا ملهمة حول منتج، أو استخدامه، أو التجربة التي يتيحها. وسيُجرى الاختبار الأول أثناء توليد الصور، مع تمييز الإعلانات بوضوح وفصلها عن الصورة الجاري إنشاؤها؛ وسيبدأ لاحقًا هذا الشهر في الولايات المتحدة، مع مجموعة أولى من المعلنين. وتؤكد OpenAI مجددًا أن الإعلانات لا تؤثر في إجابات ChatGPT، الذي يصل، وفقًا للشركة، إلى 1,2 مليار شخص أسبوعيًا.
تتركز معظم الإعلانات الجديدة على القياس: إرسال التحويلات عبر Hightouch وTealium وLiveRamp، وتسمية عشرة شركاء لإسناد التحويلات، منهم AppsFlyer وAdjust وTriple Whale، وتجارب جغرافية لقياس الأثر الإضافي مع Haus وMeasured وWorkMagic، ونافذة احتساب للتحويلات بعد ظهور الإعلان مدتها يوم واحد في التقارير، ومؤشر لجودة الإشارات (Event Quality Score). وفيما يتعلق بسلامة العلامات التجارية، يمكن للمعلنين المؤهلين استبعاد عبارات (Negative Phrases)، ويجري إعداد تجارب تقييم مع DoubleVerify وIntegral Ad Science. أما بكسل التتبع وConversions API فمتاحان منذ 5 مايو.
| النتيجة التي نشرتها OpenAI | القيمة المنشورة | الجهة التي أجرت القياس |
|---|---|---|
| تكلفة اكتساب عميل لدى WeightWatchers مقارنة بمعيارها لإعلانات البحث المدفوعة | −15,3 % | DV Rockerbox |
| المشتريات الإضافية لعلامة Dose التي أجراها عملاء جدد | 67 % | WorkMagic |
| زوار Portland Leather القادمون من ChatGPT Ads والجدد على العلامة | 93 % | Triple Whale |
🔗 تدوينة OpenAI حول الصيغة الإعلانية الجديدة 🔗 تدوينة مدونة Ads حول القياس
سجل تغييرات Perplexity في 5 أكتوبر: إضافة للمتصفح تتيح استخدام Computer، وWiley وStripe Projects
5 أكتوبر — تنشر Perplexity سجل تغييرات للمنتج يضم 18 بندًا، من دون منشور عنه على X وقت رصدنا. ثمانية منها تكرر إعلانات سبق أن تناولناها (Automations، وClaude Opus 5.5، وتوليد الفيديو، وSkills من American Express، وPortable Computer على AMD، وFast Search، وProfiles في Agent API، وClaude Fable 5.1)، ويضيف بند تاسع شروحات تفاعلية ثلاثية الأبعاد إلى الرسوم البيانية المعلنة في 1 أكتوبر، بينما تتضمن البنود التسعة الأخرى مستجدات تُعلن للمرة الأولى:
| المستجد المُعلن للمرة الأولى | المنصة أو الإصدار | الجمهور المعني |
|---|---|---|
| إضافة لمتصفحات Chrome أو Edge أو Brave تتيح لـComputer استخدام المتصفح (يبقى Comet الخيار الافتراضي) | Perplexity لنظام Mac 26.38.0 وما بعده | غير محدد |
| مهام Computer في علامات تبويب ونوافذ منفصلة | Perplexity لنظام Mac 26.37.1 وما بعده | غير محدد |
| وضع مستوى الجهد (Light، Standard، High، Ultra) على الهاتف المحمول | iOS 26.38.0 وAndroid 2.100.0 وما بعدهما | Pro، Max، Enterprise Pro، Enterprise Max |
| دوريات Wiley وكتبها دون اشتراك منفصل في Wiley | Perplexity وComputer | جميع الخطط، مع حصص متفاوتة للمحتوى المميز |
| GPT-6.1 Sol، الذي يشغّل أيضًا مستوى الجهد Light في Computer بدلًا من GPT-6 Sol | Perplexity وComputer | المشتركون المدفوعون المؤهلون |
| محادثة موجّهة لبدء أول مهمة في Computer | الويب | الحسابات المجانية الجديدة |
| ربط تطبيق من منطقة الإدخال (ربط تطبيق) | Computer على الويب | غير محدد |
| موصل DocSend لغرف بيانات الاستثمار (غرف الصفقات) | Computer | حساب DocSend مؤهل |
| Stripe Projects: إنشاء مفتاح API الخاص بـPerplexity من CLI الخاصة بـStripe | CLI الخاصة بـStripe | مطورو API الخاصة بـPerplexity |
مع Stripe Projects، ينشئ أمر واحد المشروع أو يربطه، ويولّد المفتاح ويكتبه في الملف .env، وهي عملية إعداد تقترح Perplexity إسنادها إلى Claude Code أو Cursor أو Codex.
🔗 سجل تغييرات Perplexity في 5 أكتوبر
الإبداع التوليدي: Suno Albums وHyperFrames Studio من HeyGen
Suno تضيف الألبومات
5 أكتوبر — تضيف Suno الألبومات، التي لم تكن متاحة على منصتها حتى الآن. وفقًا للتدوينة المصاحبة للإعلان، تحوّل الميزة أفضل المقطوعات إلى مشاريع مكتملة (مشاريع بطول كامل)، ويمكن الآن تحويل قائمة تشغيل (قائمة تشغيل) كانت تؤدي دور الألبوم إلى ألبوم. وتعرض Suno فناني الألبومات الخمسة الأولى: naenia (Oakwood///diskrot)، وOld Soul (آيزايا والاس)، وphenomenal (KakerMix///diskrot)، وLost In a Dream (Dream Relic)، وVOID (ECHLO). ولا تحدد الشركة الخطط المشمولة، ولا عدد المقاطع في كل ألبوم، ولا التاريخ الدقيق لإتاحة الميزة. وكانت Suno قد سألت مجتمعها في يونيو عن تجربة الاستماع، بين قوائم التشغيل والألبومات والمحطات الإذاعية.
🔗 إعلان Suno على X 🔗 5 ألبومات لا تفوّتها، مدونة Suno
HyperFrames Studio، محرر الفيديو من HeyGen المصمم للوكلاء
5 أكتوبر — يتحول HyperFrames، إطار العمل مفتوح المصدر من HeyGen الذي يحوّل كود HTML إلى فيديو، إلى تطبيق لسطح المكتب. ويقدم HyperFrames Studio نفسه بوصفه محرر فيديو صُمم للوكلاء من الصفر: يصف المستخدم الفيديو المطلوب، ويقدّم الوكيل (Claude Code أو Codex أو وكيل مطوّر داخليًا) مونتاجًا أوليًا، ثم يعمل الإنسان والوكيل على الخط الزمني نفسه (الخط الزمني). ويجري التوجيه بالإيماءات بدلًا من الأوامر النصية: إحاطة عنصر في الصورة، أو تثبيت تعليق عند كلمة، أو إجراء القص بنفسك. ويصدّر التطبيق الفيديو بدقة 4K، ويقول إنه يضم مئات الأفكار الملهمة والقوالب؛ وهو مجاني وفقًا لحساب HyperFrames على X، ولا تتوفر للتنزيل سوى نسخة macOS. ويواصل ما بدأته نسخة Studio Preview في يوليو، التي كانت تتيح بالفعل تحرير الفيديو المولّد بالكود بصريًا.
🔗 إعلان HyperFrames Studio 🔗 منشور HeyGen عن الإعلان
أخبار موجزة
- Warp Factories تتجه نحو الإتاحة العامة — في تدوينة بتاريخ 3 أكتوبر عن ملتقاها الخريفي، تشير Warp إلى أن Warp Factories، بنيتها التحتية للوكلاء، تنتقل حاليًا من الوصول المبكر إلى الإتاحة العامة، من دون تحديد موعد أو سعر؛ ويقول الفريق إنه خفّض تكلفة كل PR بنسبة 70 % خلال الشهر الماضي بالاعتماد عليها. 🔗 المصدر
- ملاحظات إصدار Devin بتاريخ 2 أكتوبر — تُطبّق الآن إعدادات الوصول في Microsoft Teams، وتتيح نقرة واحدة تحديد جميع النتائج الأمنية ذات مستوى الخطورة نفسه (بما في ذلك API v3)، وتعرض الإضافات المقترحة مهاراتها وMCP وhooks وقواعدها قبل التثبيت؛ وأصبحت عمليات بناء البيئة في مستودعات Perforce الكبيرة تحصل على 3 ساعات بدلًا من الفشل بعد 10 دقائق. 🔗 المصدر
- MCP الخاص بـTikTok Ads في Replit — تضيف Replit خدمة TikTok Ads إلى دليلها الذي يضم أكثر من 450 تكاملًا: بعد ربط الحساب، يستطيع Agent الخاص بها إنشاء إعلانات TikTok وإدارتها، والوصول إلى الجماهير وقياس الأداء من مساحة العمل، دون استهلاك أرصدة مقابل الربط. 🔗 المصدر
- Cockle Finance على Replit — تثبّت Replit فيديو عن Cockle Finance، التي بنى دان ووالده ستيف أداتها على Replit لمتابعة تدفق العملاء؛ ووفقًا لـReplit، نمّى دان نشاطه بنسبة 15 % خلال ثلاثة أشهر، من دون تحديد مقياس هذا النمو. 🔗 المصدر
- Copilot CLI 1.0.92 في القناة المستقرة — يجمع هذا الإصدار مستجدات الإصدارات التجريبية من 1.0.92-0 إلى -5؛ أما المستجد الوحيد، فهو أن المستخدم يختار الحساب الذي سيستخدمه بعد تسجيل الدخول عبر Microsoft Entra، ويغلق
/logoutجلسات OAuth هذه، وتجدد خوادم MCP المحمية بواسطة Entra بيانات اعتمادها دون تدخل. 🔗 المصدر - Codex CLI 0.160.1 — لا يتضمن هذا الإصلاح للإصدار 0.160.0 سوى نقل إصلاح واحد إلى الفرع السابق: يُحتفظ بمتغيرات Windows SYSTEMROOT وTEMP وTMP عند تشغيل خوادم MCP stdio بعيدة ضُبطت بيئتها البعيدة صراحةً؛ وهو أحدث إصدار مستقر، إذ لم يصدر أي إصدار مستقر من 0.161.0. 🔗 المصدر
- النسخة الليلية من Gemini CLI بتاريخ 5 أكتوبر — لا تتضمن أي تغيير: بُنيت على commit نفسه المستخدم في نسخة 3 أكتوبر، ولا تختلف إلا في أرقام الإصدارات، فيما تظل القناة المستقرة (v0.62.0) وقناة المعاينة (v0.63.0-preview.0) دون تغيير. 🔗 المصدر
- SDK الخاصة بـTypeScript من SpaceXAI، الإصدار 0.2.1 — نُشر هذا الإصدار في 2 أكتوبر، ويضيف
toJson(schema)، الذي يتحقق من المخرجات المنظّمة باستخدام أداة تحقق متوافقة مع Standard Schema (Zod أو Valibot أو ArkType)، والخيارretryBeforeOutput، الذي يعيد محاولة طلب بالبث المتواصل (البث المتواصل) فشل قبل إنتاج أي مخرجات؛ وأصبح الرد 429 الذي لا يتضمن ترويسة Retry-After يؤدي إلى انتظار يبدأ من ثانية واحدة ويصل إلى 30 ثانية، بدلًا من 250 ملي ثانية. 🔗 المصدر - Cresta Conductor مبني على Claude Agent SDK — ضمن سلسلة Anthropic المخصصة للشركات الناشئة التي تبني باستخدام Claude، تعرض Cresta أداة Conductor لبناء وكلاء علاقات العملاء باللغة الطبيعية، والمبنية على Claude Agent SDK؛ ووفقًا لـCresta، خفّضت الأداة مدة النشر الأولي إلى النصف تقريبًا في أولى حالات استخدامها، من دون تحديد موعد للإتاحة أو سعر. 🔗 المصدر
- npm: انتهاء صلاحية إعدادات النشر الموثوق — منذ 2 أكتوبر، تنتهي صلاحية إعداد النشر الموثوق (النشر الموثوق) الذي لم يُستخدم في أي عملية نشر بعد 48 ساعة من إنشائه، وترفض npm أيضًا الرموز الصادرة عن أحداث
issue_commentفي GitHub Actions، كما تفعل معpull_request_target. 🔗 المصدر - npm: النشر المعلّق ينشئ حزمًا — منذ 2 أكتوبر، يستطيع
npm stage publishإنشاء حزمة غير موجودة بعد، باستخدام جلسة محلية أو رمز بصلاحيات دقيقة، بما في ذلك رمز يقتصر على وضع الإصدار في الانتظار (الوضع في الانتظار فقط)؛ وينتظر الإصدار الأول أن يعتمده أحد القائمين على الصيانة قبل أن يصبح قابلًا للتثبيت. 🔗 المصدر - Agent API من Perplexity تستخدم Fast Search — تستخدم الإعدادات المسبقة low وmedium وhigh في Agent API الآن Fast Search للأداة
web_search، مع انخفاض التكلفة من 2,50 إلى 1 دولار لكل 1 000 استدعاء، وزيادة في السرعة بنحو 800 ms؛ ويحتفظ الإعداد المسبق xhigh بالبحث القياسي. 🔗 المصدر - دليل RAG من Perplexity — تنشر Perplexity دليلًا يضم تسعة أمثلة على التوليد المعزز بالاسترجاع (التوليد المعزز بالاسترجاع، RAG) وسبع معماريات، وتستشهد فيه بنفسها فيما يتعلق بفهرس الويب وميزة Instant Buy، إلى جانب أمثلة من جهات أخرى مثل Zendesk أو GitHub Copilot؛ ولا يتضمن أي مستجد للمنتج. 🔗 المصدر
- عدد موظفي Cohere — وفقًا لـCohere، ارتفع عدد موظفي الشركة من نحو 400 في بداية 2026 إلى أكثر من 800 اليوم، وهو رقم ورد في منشور للتوظيف. 🔗 المصدر
- IsoVGRBench وLogbook لدى Meta — من دون إعلان، تنشر facebookresearch كود IsoVGRBench، الذي يقيّم نماذج مكافأة الفيديو على 16 000 زوج لا يختلف كل منها إلا في جانب واحد (وعند مقارنتها بالمقطع نفسه بعد خلط ترتيب إطاراته، تجيب هذه النماذج بصورة تكاد تكون عشوائية)، وكود Logbook، المخصص للأحداث في التسجيلات الصوتية الطويلة جدًا. 🔗 المصدر
- FiftyOne تقرأ مجموعات بيانات LeRobot v3 — وفقًا لتدوينة مجتمعية لهاربريت ساهوتا، تقرأ مجموعة الأدوات مفتوحة المصدر FiftyOne الآن صيغة LeRobot v3 مباشرةً، دون أداة تحويل أو نسخ لمقاطع الفيديو؛ ويتناول العرض 497 حلقة مأخوذة من أنواع الروبوتات الـ50 في مجموعة بيانات مجتمع LeRobot. 🔗 المصدر
- FetchMan-data من Ai2 — نُشرت هذه المجموعة في 1 أكتوبر دون إعلان، وتضم 352 696 حلقة محاكاة (52 مليون إطار، و902 تعليمة) لإمساك روبوت بشري الشكل من طراز Unitree G1 بالأشياء، وُلدت في MolmoSpaces، بصيغة LeRobot v3 وتحت ترخيص ODC-BY. 🔗 المصدر
- P(doom) على ملفات Hugging Face الشخصية — يستطيع مستخدمو Hub عرض P(doom) الخاص بهم على ملفاتهم الشخصية، أي تقديرهم لاحتمال أن يتسبب الذكاء الاصطناعي في كارثة وجودية؛ وتغذي الإجابات استطلاعًا لن تُنشر منه إلا نتائج مجمّعة ومجهولة الهوية، بعد أسبوعين. 🔗 المصدر
- إضافة hf-image — تتيح Hugging Face، دون إعلان، إضافة إلى CLI الخاصة بها تبني صور الحاويات وترفعها وتسحبها وتشغّلها على سجلها cr.hf.co؛ ويزيل Xet التكرار من الطبقات غير المضغوطة، بحيث لا يرسل تعديل بحجم 100 ميغابايت على طبقة بحجم 2 غيغابايت سوى نحو 100 ميغابايت، وفقًا لملف README. 🔗 المصدر
- ثلاث تجارب لميلوس كوتلار — في ثلاث تدوينات مجتمعية، يجعل ميلوس كوتلار ذاكرة KV المؤقتة لمحوّل صغير أكثر تراصًا بمقدار 2,71 مرة، مع اتفاق بنسبة 97,85 % على الرمز التالي، ويخفض نسبة الرموز التي لا تُسند إلى خبير في توجيه MoE من 13,84 % إلى 8,09 %، دون أي زيادة في السرعة. 🔗 المصدر
- تدقيق حكم LLM أجراه ستيفن يو — دقق ستيفن يو، باستخدام 38 400 عينة، الحكم GLM-5.3 الذي يقيّم الالتزام بالحقائق ضمن مكافأة GRPO لنموذج إعادة الصياغة الخاص به بحجم 12B: وهو موثوق في اكتشاف تغيّر حقيقة، لكنه مشوش في تقدير خطورة ذلك؛ ويكشف عدّ المخرجات الخاطئة عن انخفاض بنسبة 39 % كان العدّ الأول يخفيه. 🔗 المصدر
- ندوة Sakana AI في طوكيو — تفتح Sakana AI التسجيل لندوة مجانية في 26 أكتوبر بقاعة هيتوتسوباشي في طوكيو، باللغة الإنجليزية، تتضمن محاضرة ليورغن شميدهوبر وحوارًا مع ديفيد ها، الرئيس التنفيذي لـSakana AI. 🔗 المصدر
- شركات NVIDIA Inception الناشئة وسرطان الثدي — تعرض NVIDIA أربع شركات ناشئة من برنامج Inception تطبّق الذكاء الاصطناعي على مسار الرعاية، منها iSono Health وجهازها ATUSA للتصوير بالموجات فوق الصوتية ثلاثي الأبعاد، المصرح به من FDA (نحو دقيقتين لكل ثدي مقابل ما يصل إلى 45 دقيقة يدويًا)، وWhiterabbit.ai وAtaraxis AI وSimBioSys؛ وبعض هذه التقنيات غير معتمدة من FDA. 🔗 المصدر
ما الذي يعنيه ذلك
أصبح تحديد منشأ النص التزامًا تنظيميًا. حتى الآن، كانت قابلية تتبع المحتوى المولّد تركز أساسًا على الصور والصوت، باستخدام علامات مائية وبيانات وصفية قابلة للتحقق؛ ويوسّع AI Act هذا المتطلب ليشمل النص، وتستجيب OpenAI له على مراحل: علامة مائية تُطبّق تلقائيًا على نصوص ChatGPT وCodex في الاتحاد الأوروبي، وخيار اختياري في API، وكاشف متاح حصرًا للمنظمات المعتمدة. وتفسر الأرقام المنشورة هذا الحذر: يُكشف عن نحو 95 % من المقاطع المؤلفة من 400 رمز في محتوى من نوع علم النفس، مع استهداف معدل إيجابيات كاذبة قدره 1 %، لكن استبدال 10 % من الكلمات بمرادفات في مقاطع إنجليزية من 400 رمز يخفض الكشف من نحو 92 % إلى 66 %، وقد تمحو إعادة الصياغة أو الترجمة العلامة المائية. وتوفر العلامة المائية مؤشرًا على المنشأ، وليست دليلًا، كما أن غيابها لا يدل على شيء بشأن المؤلف.
تترسخ ذاكرة الوكلاء وتبدأ في التوحّد وفق معايير مشتركة. يحتفظ Devin بالدروس التي تعلمها في مستودع Git من ملفات Markdown يعيد Dreaming تنظيمها يوميًا، وتنشر Cognition صيغتها تحت ترخيص MIT كي تعتمدها وكلاء أخرى؛ ويحتفظ North 2 بالسياق من جلسة إلى أخرى؛ وتربط Qwen Code خدمة Mem0 مباشرةً بـCLI الخاصة بها. وتختلف المقاربات بين ملفات قابلة للقراءة البشرية ذات إصدارات محفوظة، وخدمة ذاكرة خارجية، ووظيفة مدمجة في منصة، لكنها تلبي الحاجة نفسها: ألّا يبدأ الوكيل من الصفر في كل جلسة. ولخيار Cognition ميزة عملية: تشير كل ملاحظة إلى الجلسة التي تعلّمها فيها الوكيل، ويمكن الاطلاع عليها في الواجهة، وتحتفظ بسجلها في Git، مما يتيح قراءة ما احتفظ به الوكيل وتصحيحه.
تدخل النماذج المفتوحة إلى أدوات البرمجة عبر أبواب متعددة. تربطها Together Link بوكلاء موجودة، بما فيها Claude Code وCodex، وتعلن عن خفض الإنفاق بأكثر من النصف؛ وتشغّل IBM النسخة المستضافة ذاتيًا من Bob على Nemotron 3 Ultra للشركات التي تحتفظ بعمليات التطوير على بنيتها التحتية الخاصة، وصولًا إلى البيئات المعزولة عن الشبكة؛ وتقدم Reflection AI نموذج Beam بوصفه نموذجًا مفتوحًا مصممًا للبرمجة ومهام الوكلاء، بنتيجة 80,9 على SWE-bench Verified وفقًا لجداولها الخاصة. وتستند الحجة المشتركة إلى التكلفة وزمن الاستجابة والتحكم في البيانات أكثر مما تستند إلى النتيجة الخام، التي تقر Reflection AI بأن Kimi K3 ما زال يتقدم فيها.
تأتي أرقام كثيرة اليوم من الجهات التي تنشرها. صممت GitHub معيار ReviewBench وأنتجت الترتيب الأولي الذي تتصدره Copilot code review، دون تشغيل أو تحقق من الشركات الأخرى؛ ويأتي زمن استجابة Nemotron 3 Ultra من اختبارات IBM الداخلية؛ أما وفورات Together Link ونتائج إعلانات ChatGPT فهي الأرقام التي تعلنها Together AI وOpenAI. ومع ذلك، تنشر GitHub مجموعة بياناتها وحكمها ومنهجيتها، وتفتح باب تقديم النتائج: تستطيع كل شركة إعادة القياس باستخدام وكيلها الخاص. وهذا ما سيتيح معرفة ما إذا كان هذا الترتيب الأولي يصمد.
المصادر
- نهجنا في التعامل مع قواعد الاتحاد الأوروبي بشأن منشأ النصوص (OpenAI)
- سلسلة منشورات OpenAI حول حدود العلامات المائية
- الذاكرة والأحلام: كيف يتعلم Devin من العمل معك (Cognition)
- سلسلة منشورات Cognition على X
- مستودع ذاكرة الوكلاء
- سلسلة منشورات Cursor حول SDK
- سجل تغييرات SDK الخاص بـ Cursor
- Qwen Code v0.25.0 على GitHub
- Together Link (Together AI)
- توثيق Together Link
- لماذا اختارت IBM نموذج NVIDIA Nemotron للاستضافة الذاتية لـ IBM Bob
- ReviewBench: معيار مفتوح لمراجعة الشيفرة باستخدام الذكاء الاصطناعي (مدونة GitHub)
- موقع ReviewBench
- North 2: ذكاء اصطناعي للمؤسسات دون تنازلات (Cohere)
- سلسلة منشورات إطلاق North 2 (Cohere على X)
- تحالف Cohere وPwC (مدونة Cohere)
- بيان PwC في كندا
- تقديم Beam (Reflection AI)
- MetaEncoder-30B على Hugging Face
- مقالة Google AI على X حول Living Models
- Living Models على Gemmaverse (Google DeepMind)
- تطوير الإعلانات بما يتناسب مع طريقة استخدام الناس للذكاء الاصطناعي (OpenAI)
- طرق إضافية لقياس أداء إعلانات ChatGPT
- سجل تغييرات Perplexity بتاريخ 5 أكتوبر
- إعلان Suno عن الألبومات
- 5 ألبومات لا تفوّت الاستماع إليها (Suno)
- الإعلان عن HyperFrames Studio
- إعادة نشر من HeyGen
- ابنِ المصنع. دعه يعمل. اذهب للتجديف بقارب الكاياك. (Warp)
- ملاحظات إصدار Devin بتاريخ 2 أكتوبر
- MCP الخاص بـ TikTok Ads في Replit
- Cockle Finance على Replit
- Copilot CLI v1.0.92
- Codex CLI 0.160.1
- الإصدار الليلي من Gemini CLI بتاريخ 5 أكتوبر
- SDK الخاص بـ SpaceXAI بلغة TypeScript، الإصدار v0.2.1
- Cresta وClaude Agent SDK (مدونة claude.com)
- تنتهي الآن صلاحية إعدادات النشر الموثوق في npm التي لم يُتحقق منها
- يدعم النشر المرحلي في npm الآن إنشاء حزم جديدة
- سجل تغييرات API الخاص بـ Perplexity
- 9 أمثلة على RAG (مدونة Perplexity)
- أعداد موظفي Cohere
- مستودع IsoVGRBench
- FiftyOne وLeRobot v3 (Harpreet Sahota)
- FetchMan-data على Hugging Face
- P(doom) على Hub (سجل تغييرات Hugging Face)
- مستودع hf-image
- ذاكرة التخزين المؤقت KV ضمن ميزانية KL (Milos Kotlar)
- تدقيق حَكَم LLM (Stephen Yu)
- ندوة Sakana AI
- من التصوير إلى خطة العلاج (NVIDIA)