بحث

تُصدر DeepSeek-V4-Pro أوزانها المفتوحة، وGemini 3.7 Flash يصل، وGPT-5.6 Sol يتسارع مع Ultrafast

مقال من إنشاء الذكاء الاصطناعي
تُصدر DeepSeek-V4-Pro أوزانها المفتوحة، وGemini 3.7 Flash يصل، وGPT-5.6 Sol يتسارع مع Ultrafast

ai-powered-markdown-translator

مقال مترجم من الفرنسية إلى العربية باستخدام gpt-5.4-mini.

عرض المشروع على GitHub ↗

في 13 أغسطس 2026، تطلق DeepSeek نموذجها الرائد DeepSeek-V4-Pro، وقد نُشر بأوزان مفتوحة تحت رخصة MIT في اليوم نفسه الذي أُعلن فيه عنه، بينما تكشف Google عن Gemini 3.7 Flash، نموذجها الجديد القوي للاستخدام اليومي (workhorse) للبرمجة والوكلاء — وهو متاح أيضًا ابتداءً من اليوم في GitHub Copilot. ومن جانبها تستعرض OpenAI Ultrafast، وهو مستوى خدمة يجعل GPT-5.6 Sol يعمل بسرعة تصل إلى 14 مرة أسرع بفضل عتاد Cerebras. وعلى القائمة أيضًا: Anthropic تزامن جلسات Claude بين الأجهزة، وCursor يسرّع وكلاءه السحابيين عبر Builds، وGrok 4.6 يواصل انتشاره لدى Perplexity وWarp وGenspark، وHugging Face تكثّف منشورات النماذج والدراسات المفتوحة.


DeepSeek-V4-Pro: إطلاق النموذج الرائد، أوزان مفتوحة على Hugging Face

13 أغسطس — تطلق DeepSeek نموذجها الرائد DeepSeek-V4-Pro، والمتاح فورًا على التطبيق والويب (عبر «وضع الخبير») وواجهة API، مع بقاء أسماء النماذج كما هي في التوثيق. يسلّط الإعلان الضوء على تحسينات كبيرة على مستوى الوكيل، مع إمكانية ضبط جهد الاستدلال الآن لكل من V4-Pro وللنسخة الأخف V4-Flash.

مستوى الجهدالاستخدام الموصى به
منخفضالمهام البسيطة
مرتفعتدفقات عمل الوكلاء اليومية
أقصىالمهام المعقدة

ومن المستجدات التقنية الأخرى: دعم أصلي لواجهة API OpenAI Responses، محسّن لـ Codex مع إعداد بنقرة واحدة — وهي إشارة إلى أن DeepSeek تستهدف مباشرة منظومة أدوات البرمجة الوكيلية المبنية حول صيغة OpenAI بدلًا من تقديم API معزولة خاصة بها.

يؤكد الباحث في Hugging Face Elie Bakouch أن V4-Pro نُشر أيضًا بأوزان مفتوحة على Hugging Face، تحت رخصة MIT. لكنه يوضّح تسمية «V4»: فالنسخة السابقة لم تكن سوى معاينة مسبقة، بينما تلقت هذه النسخة تدريبًا أكبر بكثير — «يبدو الأمر أقرب إلى V4.5» بحسب قوله. ويأتي هذا الإطلاق ضمن يوم مزدحم لـ DeepSeek، التي تنشر في اليوم نفسه إعادة صياغة لتسعير API وأول harnais لوكلائها مفتوح المصدر، DeepSeek Harness (انظر أدناه) — وهي مجموعة متماسكة تعيد تموضع الشركة كفاعل متكامل في منظومة الوكلاء، لا مجرد مزود نماذج.

We’re launching DeepSeek-V4-Pro today! Major Agent upgrades with strong production gains! Flexible reasoning effort for V4-Pro & V4-Flash: low for simple tasks, high for daily Agent workflows, max for complex tasks. Native OpenAI Responses API support, optimized for Codex with one-click setup.

🇸🇦 نطلق DeepSeek-V4-Pro اليوم! تحسينات كبيرة على مستوى الوكيل، مع مكاسب قوية في الإنتاج! جهد استدلال مرن لـ V4-Pro وV4-Flash: منخفض للمهام البسيطة، مرتفع لتدفقات عمل الوكلاء اليومية، وأقصى للمهام المعقدة. دعم أصلي لواجهة API OpenAI Responses، محسّن لـ Codex مع إعداد بنقرة واحدة.@deepseek_ai على X

🔗 تأكيد الأوزان المفتوحة ورخصة MIT


Gemini 3.7 Flash: نموذج جديد قوي للاستخدام اليومي (workhorse) للبرمجة والوكلاء

13 أغسطس — تطلق Google Gemini 3.7 Flash، الذي تُقدّمه باعتباره نموذجها الأكثر ذكاءً حتى الآن والقوي للاستخدام اليومي (workhorse) للبرمجة والوكلاء، وذلك بعد ثلاثة أسابيع فقط من Gemini 3.6 Flash. يستهدف النموذج ثلاثة استخدامات رئيسية: هندسة البرمجيات، تطوير الويب، والعمل المعرفي المعقد (تحليل المستندات، تدفقات العمل المؤسسية).

المعيارالمجال المقاس3.6 Flash3.7 Flash
FrontierCode 1.1 Mainجودة الشيفرة المنتجة34,4 %43,6 %
DeepSWE v1.1هندسة البرمجيات (تصحيح الأخطاء)49,0 %65,3 %
WebDev Arenaتطوير الويب (درجة Elo)15381588
GDP.pdfفهم المستندات22,0 %34,0 %
AutomationBenchتدفقات العمل المؤسسية الآلية17,0 %30,4 %

وعلى صعيد التسعير، يستفيد Gemini 3.7 Flash من سعر تمهيدي حتى 31 ديسمبر 2026، بنصف سعر 3.6 Flash: ‏$0,75 لكل مليون token في الإدخال و‏$3,75 لكل مليون في الإخراج (مقابل ‏$1,50 و‏$7,50 وفق السعر القياسي ابتداءً من يناير 2027). والنموذج متاح اليوم في Google Antigravity، عبر Gemini API في Google AI Studio وAndroid Studio، وفي Gemini Enterprise Agent، وGemini Spark — المساعد الشخصي الاستباقي المقدم لمشتركي Google AI Pro وUltra في أكثر من 160 دولة. وتوضح Google أيضًا أنها شددت حواجز الأمان الخاصة بالنموذج ضد الاستخدامات الخبيثة في المجالات الكيميائية والبيولوجية والإشعاعية والنووية، وكذلك ضد القدرات الهجومية في الأمن السيبراني.

وفي اليوم نفسه، يُطرح Gemini 3.7 Flash أيضًا في GitHub Copilot: ووفقًا لـ GitHub، تُظهر الاختبارات الأولى تقدمًا في تطوير الويب والتطبيقات وكذلك في البرمجة الوكيلية مقارنة بالإصدار السابق. ويشمل الطرح اشتراكات Copilot Pro وPro+ وMax وBusiness وEnterprise، ويمكن الوصول إليه عبر محدد النموذج في VS Code وVisual Studio وCopilot CLI والوكيل السحابي Copilot وتطبيق Copilot وJetBrains وXcode وEclipse. وبالنسبة لخطتي Enterprise وBusiness، يجب على المسؤولين تفعيل سياسة «Gemini 3.7 Flash Preview» قبل أن يتمكن أعضاء المؤسسة من الوصول إليه؛ بينما تتبع الفوترة أسعار المزوّد ضمن نموذج الاستخدام حسب الاستهلاك.

Today we’re introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work.

🇸🇦 اليوم نطرح Gemini 3.7 Flash، نموذجنا الأكثر ذكاءً حتى الآن والقوي للاستخدام اليومي (workhorse) للبرمجة والوكلاء. يحقق هذا النموذج مكاسب كبيرة في هندسة البرمجيات، وتطوير الويب، والعمل المعرفي المعقد.@Google على X

🔗 الإعلان الرسمي من Google · سجل التغييرات في GitHub Copilot


Ultrafast: ‏GPT-5.6 Sol أسرع حتى 14 مرة، مدعومًا بـ Cerebras

13 أغسطس — تكشف OpenAI عن Ultrafast، وهو مستوى خدمة جديد لواجهة API يجعل GPT-5.6 Sol يعمل بسرعة تفوق المعالجة القياسية حتى 14 مرة. وبفضل عتاد Cerebras، يصل هذا النمط إلى ما يقارب 750 token مُولّدًا في الثانية. وحتى الآن، كان الحصول على سرعة آنية يتطلب اختيار نموذج أصغر أو متخصص على حساب الذكاء؛ أما Ultrafast فيغيّر هذه المعادلة عبر استهداف قدر أكبر من العمل المفيد في الثانية من دون التضحية بقدرات أكثر نماذج OpenAI تقدمًا.

الخاصيةالتفاصيل
النموذجGPT-5.6 Sol
السرعةحتى 14 مرة من المعالجة القياسية
معدل الإنتاجحتى 750 token إخراج في الثانية
الشريك العتاديCerebras
التوفرPreview، واجهة API OpenAI، وصول بالتسجيل

تحدّد OpenAI عدة سيناريوهات تفتح فيها هذه السرعة استخدامات جديدة: الاستجابة للحوادث (تحليل السجلات، وتغييرات الشيفرة الأخيرة، وتقارير المهندسين بينما الحادث ما يزال جاريًا)، والبحث المالي (تحليل إشارات السوق والمعاملات في الوقت الحقيقي)، ودعم العملاء الصوتي (حل المشكلات المعقدة من دون كسر المحادثة)، والتجارة (الإجابة عن أسئلة المنتجات قبل التخلي عن سلة الشراء)، والبحث التجريبي (تحويل حساب كان يستغرق ليلة كاملة إلى جلسة تفاعلية). وهناك مجموعة أولى من العملاء تختبر بالفعل GPT-5.6 Sol في وضع Ultrafast على حالات استخدام البرمجة، والتجارة، والبحث المالي، والدعم، في ظروف إنتاج حقيقية. وتوضح OpenAI أنها تستخدم Ultrafast داخليًا، ولا سيما في الاستجابة للحوادث.

ويبقى الوصول في الوقت الحالي محدودًا بمجموعة صغيرة من العملاء عبر واجهة API، مع نموذج تسجيل ليتم الإخطار مع توسع السعة إلى عدد أكبر من الشركات.

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed. Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows.

🇸🇦 نستعرض وضع Ultrafast: ‏GPT-5.6 Sol بسرعة تصل إلى 14 مرة. الإطلاق أولًا في OpenAI API لدى مجموعة محدودة من العملاء، مع توسيع الوصول إلى عدد أكبر من الشركات مع زيادة السعة.@OpenAI على X

🔗 استعراض Ultrafast — الإعلان الرسمي


Claude يوسع الاستمرارية بين الأجهزة

تدفع Anthropic في اليوم نفسه إعلانين يسيران في الاتجاه ذاته: جلسة Claude باتت تتبع المستخدم بدلًا من الجهاز.

Claude in Chrome — جلسات متزامنة على سطح المكتب والويب والهاتف المحمول

12 أغسطس — لم تعد جلسات Claude in Chrome، إضافة المتصفح من Anthropic، محصورة بالجهاز الذي فُتحت عليه. فالمحادثات تُحفظ الآن وتظهر تلقائيًا على سطح المكتب والويب والهاتف المحمول، مع بقاء skills وconnectors الخاصة بالمستخدم متاحة مباشرة داخل المتصفح. الميزة متاحة ابتداءً من اليوم لاشتراكات Max وTeam، على أن يتم طرحها لمشتركي Pro خلال الأسابيع المقبلة.

🔗 إعلان على X

Claude Cowork — اللوحة الجانبية تشارك الجلسة مع سطح المكتب والويب والهاتف المحمول

12 أغسطس — تنفّذ اللوحة الجانبية (side panel) في Claude Cowork الآن الجلسة نفسها التي تستخدمها تطبيقات سطح المكتب والويب والهاتف المحمول. وتُربط الجلسات بحساب المستخدم بدلًا من جهاز واحد، مما يتيح بدء مهمة في تبويب من المتصفح ثم استئنافها لاحقًا من وسيط آخر، من دون فقدان السياق.

🔗 إعلان على X


أدوات التطوير الوكيلية: Cursor وDevin وDeepSeek تتقدم

تتقدم عدة أدوات تطوير مدعومة بالذكاء الاصطناعي بالتوازي في 13 أغسطس، بين البنية التحتية للوكلاء، والتوظيف الاستراتيجي، والوصول المباشر إلى البيانات الحية.

Cursor يطلق Builds — وكلاء سحابيّون أسرع حتى 3 مرات عند أول token

13 أغسطس — تقدم Cursor ميزة builds: نسخًا معدّة مسبقًا من بيئة التطوير (مستودع مستنسخ، واعتماديات مثبتة، ونص تثبيت تم تنفيذه مسبقًا) تبدأها الوكلاء السحابيون فورًا. وتشير Cursor داخليًا إلى بدء بيئة أسرع 10 مرات، مع وقت حتى أول token أسرع 3 مرات. ويبقى النظام مرنًا: إذا فشل build، يواصل الوكلاء العمل باستخدام آخر build صالح بينما يُصلح الفشل في الخلفية. والميزة مضمّنة في Cloud Agents من دون تكلفة إضافية.

🔗 سجل تغييرات Cursor

Cursor تستقبل فريق Firetiger

13 أغسطس — تعلن Cursor انضمام فريق Firetiger، بهدف بناء وكلاء قادرين على متابعة شيفرتهم حتى الإنتاج وإصلاح ما لا يعمل — وهو امتداد منطقي لإعلان اليوم عن Builds: إذ تسعى Cursor إلى تغطية دورة الحياة كاملة، من التطوير حتى المراقبة في الإنتاج. ولم يُعلن عن أي تفاصيل مالية.

🔗 إعلان على X

Devin (Cognition) يعمل مباشرة على البيانات الحية في MongoDB Atlas

13 أغسطس — تضيف Cognition تكامل MongoDB Atlas إلى Devin: إذ يمكن للوكيل الآن الاستعلام عن قاعدة بيانات حية وإدارتها، وتوفير cluster جديد أثناء تنفيذ المهمة، من دون مخطط ثابت أو سياق منسوخ يدويًا. والهدف هو إزالة احتكاك شائع لدى وكلاء البرمجة — انتظار أن يجهز إنسان قاعدة اختبار.

🔗 إعلان على X

DeepSeek Harness v0.1: أول harnais لوكلاء DeepSeek مفتوح المصدر

13 أغسطس — تنشر DeepSeek DeepSeek Harness v0.1 في Developer Preview، وهو harnais لوكيل (agent harness) تفتحه للمطورين حول العالم عبر فتح مصدر الشيفرة تحت رخصة MIT. وتعتمد البنية على الإطار الفوقي الداخلي «Cordis» وعلى فكرة محورية: كل شيء plugin — النماذج، والأدوات، وskills، والجلسات، وsandboxes، وأنظمة الملفات، وحلقات التنفيذ، والتنسيق، وواجهة المستخدم. وهذا هو أول دخول علني لـ DeepSeek في طبقة أدوات الوكلاء، وهو مجال كان مشغولًا حتى الآن بـ harnais مثل Claude Code أو Codex CLI.

🔗 إعلان على X


النماذج المفتوحة والبحث: Hugging Face تكثّف المبادرات

تنشر عدة مختبرات تباعًا نماذج مفتوحة ودراسات، مع وجود Hugging Face في قلب عدة إعلانات.

MiniMax-Music3: نموذج توليد موسيقى بأوزان مفتوحة

13 أغسطس — تنشر MiniMax MiniMax-Music3، الجيل الجديد من نموذج توليد الموسيقى لديها، وهذه المرة بأوزان مفتوحة ومقدّم على أنه جاهز للإنتاج. ووفقًا لـ Hugging Face، تجمع البنية بين LLM يضم 8 مليارات parameter وDiT (Diffusion Transformer) يضم 2,7 مليار parameter لتحويل prompt وكلمات الأغنية إلى أغنية كاملة، بما يكفي للعمل على GPUs استهلاكية متواضعة، مع دعم لمكتبتَي diffusers وComfyUI. وتشكر MiniMax فريق Hugging Face على دمجه في يوم الإصدار نفسه؛ بينما الأوزان وتجربة صوتية وعناصر الشيفرة متاحة على Hugging Face وGitHub وModelScope.

🔗 إعلان MiniMax · تأكيد Hugging Face · تجربة صوتية

Sakana Chat: تحديث كبير مع Fugu وNamazu وتنفيذ الشيفرة

12-13 أغسطس — تنشر Sakana AI تحديثًا كبيرًا لـ Sakana Chat، منتجها المجاني الموجه للجمهور العام والذي لا يتطلب تسجيل دخول، والمُشغَّل الآن بواسطة Fugu، نموذج التنسيق لديها، إلى جانب جيل جديد من Namazu، نموذج LLM الياباني الخاص بها. وأبرز جديد هو التنفيذ الكامل للشيفرة: إذ يمكن للمستخدمين القيام بـ «vibe-coding» لتطبيقات ويب تفاعلية وألعاب وأدوات مباشرة داخل المتصفح، بما في ذلك باللغة اليابانية. وتسلّط Sakana الضوء على حالتي استخدام: ألعاب تعليمية للمراجعة (الرياضيات، الكانجي) وتحليل الأعمال انطلاقًا من ملف Excel بسيط.

🔗 إعلان على X · مقال مدونة

Hugging Face: Strands Agents وLeRobot وStorage Buckets لدورة البيانات الروبوتية

13 أغسطس — تنشر Amazon (فريق AWS Strands) وHugging Face مقالًا مشتركًا يصف تدفق عمل روبوتيًّا يجمع بين Strands Agents (SDK Apache 2.0 من AWS)، وLeRobot (إطار روبوتي من Hugging Face، يُستخدم تنسيق بياناته من قبل أكثر من 90,000 datasets and models) وStorage Buckets من Xet. ويعرض المقال أرقامًا ملموسة: تعديل 1% من بايتات ملف حجمه 500 Mo لا يتطلب سوى 5,5 Mo من إعادة الرفع، كما أن bucket «ساخنًا» يحقق نحو 1 086 Mo/s من معدل البث من دون نسخ محلي.

🔗 مقال Hugging Face

خلاصة هاكاثون إعادة إنتاج 2 226 ورقة من ICML 2026

13 أغسطس — تنشر Hugging Face خلاصة هاكاثونها المجتمعي (15 يوليو – 2 أغسطس)، حيث حاول 1 221 مشاركًا إعادة إنتاج 2 226 ورقة قُبلت في ICML 2026 باستخدام وكلاء ذكاء اصطناعي. وكانت النتيجة متباينة: نحو 51 % من الأوراق احتوت على الأقل على ادعاء واحد تم التحقق منه بشكل مستقل، لكن 23 % احتوت على الأقل على ادعاء واحد أُبطِل أو جرى الطعن فيه. والخلاصة التي يبرزها التقرير: تعمل وكلاء الذكاء الاصطناعي بأفضل صورة تحت إشراف بشري، إذ إن عمليات إعادة الإنتاج الناجحة كانت تشمل بشرًا يوجّهون الوكلاء ويصدرون أحكامًا إدراكية لا تستطيع المقاييس وحدها التعبير عنها.

🔗 تدوينة Hugging Face

FineBooks: لوحة صدارة لتقييم نماذج OCR المفتوحة على الوثائق التاريخية

10 أغسطس — تنشر Hugging Face وEleutherAI مشروع FineBooks، وهو لوحة صدارة تقيم 14 نموذج OCR مفتوحًا على 2 165 صفحة نُسخت بخبرة بشرية، مأخوذة من Biodiversity Heritage Library. الهدف: الإجابة عن سؤال ما إذا كانت نماذج OCR المفتوحة جيدة بما يكفي لجعل الأرشيفات التاريخية الرقمية قابلة للاستخدام، بالاعتماد على مجموعة بيانات مرجعية بدلًا من الإعلانات التسويقية من المورّدين.

🔗 إعلان على X


GitHub يحسن جودة بيانات ترخيص dependency graph

13 أغسطس — تغيّر GitHub مصدرها الرئيسي لمعلومات الترخيص: فبدلًا من الاعتماد أولًا على خدمة ClearlyDefined، أصبح dependency graph يستعلم الآن مباشرةً من سجلات الحزم نفسها — npmjs.org وPyPI وcrates.io وRubyGems وnuget.org وpkg.go.dev وMaven وpub.dev، إضافة إلى Packagist الخاصة بـ PHP. ولا يزال ClearlyDefined مستخدمًا كخيار احتياطي. هذا التغيير يحسن التغطية بشكل ملحوظ: إذ ينخفض معدل الحزم التي لا تحتوي على بيانات ترخيص من 45 % إلى 24 % على مجموعة تضم 170 مليون حزمة. كما يتتبع النظام الآن نطاقات الإصدارات بدلًا من اشتراط إدخال منفصل لكل إصدار، ما يغطي تلقائيًا الإصدارات المستقبلية التي لم تُنشر بعد. وتشمل الميزات المتأثرة معلومات التبعيات، وقوائم المواد البرمجية (SBOM)، والامتثال للترخيص في GitHub Advanced Security، وإجراءات مراجعة التبعيات.

🔗 سجل التغييرات في GitHub


توليد الوسائط: تكاملات وامتثال تنظيمي

تتقاطع عدة إعلانات من قطاع الوسائط التوليدية في 13 أغسطس، بين تكاملات المنتج والامتثال التنظيمي.

HeyGen يدمج Cartesia بشكل أصلي داخل LiveAvatar

13 أغسطس — تعلن HeyGen وCartesia عن تكامل أصلي: إذ يعمل محرك الصوت الفوري من Cartesia الآن مباشرة داخل LiveAvatar، منتج الصور الرمزية الفورية من HeyGen. والهدف هو منح وكيل صوتي مُنشأ مسبقًا وجهًا متحركًا دون إعادة تصميم تقنية، ويمكن الوصول إليه عبر تطبيق الويب أو API.

🔗 إعلان على X

Luma وDumbstruck يطلقان Creative Intelligence للإعلانات

13 أغسطس — تتعاون Luma مع Dumbstruck، وهي منصة لتحليل المشاعر، لإنشاء «Creative Intelligence»: تحدد Dumbstruck، عبر تحليل المشاعر على مجموعات من المشاهدين، اللحظات الدقيقة في إعلان فيديو التي يتراجع فيها انتباه الجمهور، ثم تعيد Luma توليد هذه المقاطع فقط انطلاقًا من اللقطات الخام الموجودة أصلًا، من دون تصوير جديد.

🔗 إعلان على X

Synthesia تشرح امتثالها للمادة 50 من AI Act

13 أغسطس — تشرح Synthesia، وهي واحدة من أوائل شركات الذكاء الاصطناعي التي وقعت Code of Practice الخاص بالمادة 50 من AI Act الأوروبي، إجراءاتها المتعلقة بالشفافية: إشارات مصدر C2PA (Content Credentials) مدمجة افتراضيًا في الفيديوهات المؤهلة، وعمليات تنزيل موقعة قادمة لكي تنتقل هذه المعلومات مع ملف الفيديو، واستكشاف علامة مائية غير ملحوظة (watermarking)، وملصقات ذكاء اصطناعي قابلة للتخصيص استنادًا إلى التصميم المرجعي للاتحاد الأوروبي.

🔗 التدوينة الكاملة

إطلاق Suno Studio 2.0 رسميًا

13 أغسطس — بعد إعلان تشويقي في 11 أغسطس، تطلق Suno بشكل عام Studio 2.0، محطة الإنتاج الموسيقي (DAW) داخل المتصفح، والتي توفر تحكمًا دقيقًا في كل مسار بدل التوليد بنقرة واحدة فقط. كما يتيح Studio بالفعل تنزيلات للمسارات المنفصلة (stems) معفاة من القيود المعتادة.

🔗 إعلان على X

GeForce NOW: تطبيق Linux أصلي خارج النسخة التجريبية وتحسينات سحابية

13 أغسطس — تخرج NVIDIA تطبيق GeForce NOW الأصلي لـ Linux من النسخة التجريبية، مع دعم Ubuntu 24.04+ ومستودع Flatpak جديد. وعلى صعيد الأداء، تعمل NVIDIA على تحسين توليد الصور DLSS Frame Generation أثناء البث من جهة الخادم لتقليل زمن الاستجابة في 1440p و4K، كما تتيح الوصول إلى أكثر من 2 000 لعبة PC من أجهزة Chromebook عبر برنامج Chromebook Fast Pass.

🔗 مقال NVIDIA


دليل المنشئ لـ GPT-5.6

13 أغسطس — تنشر OpenAI دليلًا موجّهًا للمطورين حول اختيار النموذج داخل عائلة GPT-5.6. وعلى معيار BrowseComp (البحث عن حقائق غامضة على الويب)، فإن وفرة التكلفة واضحة:

النموذج المُقيَّمنتيجة BrowseCompالتكلفة
GPT-5.5 Extra High (قبل 3 أشهر)84,36 %33,27 $
GPT-5.6 Luna Extra High (عند الإطلاق)84,04 %1,33 $

وبصياغة أخرى، أداء شبه مطابق بتكلفة أقل بمقدار 25 مرة. وتوصي OpenAI بحجز النماذج الأخف (Terra وLuna) لسير العمل عالية الحجم والحساسة لزمن الاستجابة، واستخدام النموذج الرائد Sol للمهام الأكثر تطلبًا. كما يشرح الدليل ثلاث ميزات جديدة في Responses API: استمرار الاستدلال بين الاستدعاءات مع ضغط أصلي، وتنظيم متعدد الوكلاء بشكل أصلي، واستدعاء الأدوات برمجيًا لنقل العمل الحتمي إلى الكود بدلًا من النموذج.

🔗 دليل المنشئ إلى GPT-5.6


Grok 4.6 يواصل انتشاره: Perplexity وWarp وGenspark

يواصل نموذج Grok 4.6 من xAI، الذي أُطلق في 12 أغسطس، الانتشار في الأدوات التابعة لجهات خارجية في 13 أغسطس — ثلاث عمليات تكامل منفصلة في يوم واحد.

13 أغسطس — تضيف Perplexity نموذج Grok 4.6 بوصفه نموذجًا متاحًا في Perplexity وفي Perplexity Computer، وهي طبقته الوكالية. وعلى معيارها الداخلي WANDR، تؤكد Perplexity أن Grok 4.6 يقع على حد باريتو بين الأداء والكفاءة، مع نتائج تعادل Fable 5 بتكلفة أقل من 60 %.

Grok 4.6 is now available in Perplexity and Perplexity Computer. On WANDR, it sits on the Pareto frontier of performance and efficiency, matching Fable 5 results at over 60% lower cost.

🇸🇦 أصبح Grok 4.6 متاحًا الآن في Perplexity وPerplexity Computer. وعلى WANDR، يقع على حد باريتو بين الأداء والكفاءة، مع نتائج تعادل Fable 5 بتكلفة أقل من 60 %.@perplexity_ai على X

Warp تضيف دعم Grok 4.6 عبر الأمر /connect-grok الموجود بالفعل، مع اتصال عبر اشتراك X Premium أو SuperGrok. 🔗 إعلان Warp

Genspark تجعل Grok 4.6 متاحًا في AI Chat وCode Agent وGenspark Claw، ويمكن الوصول إليه مباشرة من منتقي النماذج. 🔗 إعلان Genspark


Perplexity Computer: Search as Code أسرع وأكثر موثوقية

13 أغسطس — تفصل Perplexity تحسينات Search as Code (SaC)، وهي ميزة البحث الواسع والعميق التي أُطلقت في يونيو، ما يقلل التكلفة لكل مهمة بنحو 10 % مع الحفاظ على جودة النتائج. وتجعل موجتان من تحديثات Search SDK موثوقية تنفيذ الإجراءات ترتفع من 81,9 % إلى 92,6 %، مع تحسن رضا المستخدمين وانخفاض تكلفة المهمة بنسبة 8 % داخل Perplexity Computer.

🔗 السلسلة الكاملة


مختصرات

  • Amp — تحسينات صغيرة (وضع سريع GLM-5.2، ذاكرة الوسائط، الإملاء، السمات) — يكسب وضع Low في Amp (GLM-5.2) وضعًا سريعًا بسرعة تقارب 200 رمز/ثانية، وتُخزن الوسائط التي يولدها الوكيل مؤقتًا لتحميل فوري، كما تظهر خيارات جديدة للإملاء والسمات. 🔗 تغريدة
  • DeepSeek تحدث تسعير API مع أسعار أوقات الذروة وخارج الذروة — ستكون أسعار خارج الذروة أقل بنسبة 50 % من أسعار أوقات الذروة، على أن تسري في 16 أغسطس 2026 عند الساعة 16:00 UTC. 🔗 تغريدة
  • TRL تضيف مدرب GRPO غير متزامن، أسرع بـ 2 إلى 4 مرات — توصي مكتبة Hugging Face بنقل أي تدريب GRPO جارٍ إلى هذا المدرب غير المتزامن الجديد. 🔗 تغريدة
  • Gradio 6.24 يحفظ ويعيد تشغيل تنفيذات التطبيقات تلقائيًا — يُحفظ سجل التنفيذات في المتصفح، مع إمكانية إعادة تشغيلها دون المرور مجددًا بطابور انتظار الخادم. 🔗 تغريدة
  • Hugging Face Science تضيف Spaces عرضية إلى النماذج المختارة — تصبح النماذج ومجموعات البيانات والأوراق المعروضة قابلة للاختبار مباشرة، دون المرور فقط عبر صفحة التعريف الخاصة بها. 🔗 تغريدة
  • Gemini Omni: ثلاثة خبراء من DeepMind يروون كواليس النموذج — صيغة «من الكواليس» تبرز تعددية استخدام Gemini Omni Flash عبر أمثلة إبداعية على توليد الفيديو وتحريره. 🔗 تدوينة Google
  • دليل GitHub: كتابة أول prompt في تطبيق Copilot — دليل عملي حول صياغة أول طلب، واختيار السياق والنموذج، واستئناف جلسة من جهاز آخر. 🔗 دليل GitHub
  • Grok Imagine Image 2.0 متاح على Runway — ينضم نموذج الصور من xAI إلى كتالوج نماذج الصور والفيديو المدمجة أصلًا على المنصة. 🔗 تغريدة
  • NVIDIA تفتح أكثر من 300 skill أمام Cursor — يمكن لوكلاء Cursor الآن الوصول إلى أكثر من 300 skill تغطي أكثر من 30 منتجًا من NVIDIA. 🔗 تغريدة
  • MiniMax H3 يدّعي المركز الأول على Video Edit Arena — تصنيف شامل لجميع الفئات، من دون تفاصيل منهجية معلنة. 🔗 تغريدة
  • Runway تكشف المتحدثين في قمة SF في 30 سبتمبر — ينضم ممثلون من Physical Intelligence وNVIDIA وAnyscale وGoogle DeepMind وCoreWeave إلى قائمة المتحدثين المعلنة. 🔗 تغريدة
  • OpenAI تعيّن Dali Rajic رئيسًا للإيرادات — الرئيس السابق وCOO في Wiz وZscaler يخلف Denise Dresser على رأس منظمة الإيرادات العالمية. 🔗 إعلان OpenAI
  • RingCentral تنشر ChatGPT Work وCodex لتطوير أصيل بالذكاء الاصطناعي — أتاح «AI-Native Challenge» ChatGPT Work وCodex لجميع الموظفين، بمن فيهم غير التقنيين، لإنجاز مشروع كامل. 🔗 دراسة OpenAI

ما الذي يعنيه ذلك

تشكّل سباق السرعة وتكلفة الاستدلال جزءًا كبيرًا من ملامح هذا اليوم. يعد Ultrafast من OpenAI بسرعة تصل إلى 14 ضعف السرعة القياسية لنموذجه الأكثر تقدمًا بفضل عتاد Cerebras مخصص، بينما تخفض Google سعر Gemini 3.7 Flash الابتدائي إلى النصف لتسريع التبني في الإنتاج، وتنشر DeepSeek V4-Pro بأوزان مفتوحة تحت رخصة MIT في يوم إطلاقه التجاري نفسه. وتتقارب ثلاث استراتيجيات مختلفة — تسريع عتادي متخصص، وتسعير هجومي، وفتح كامل للأوزان — نحو الهدف نفسه: جعل الاستدلال المتقدم أرخص وأسرع وعلى نطاق واسع، مع رهان كل منها على رافعة مختلفة بدلًا من السباق على حجم النموذج فقط.

كما تتجه أدوات التطوير المدعومة بالذكاء الاصطناعي نحو طبقات بنية تحتية أعمق وأكثر ترابطًا. إذ يجهز Cursor بيئات الوكلاء مسبقًا عبر Builds ويستقطب فريق Firetiger لمتابعة الكود حتى الإنتاج، ويحصل Devin على وصول مباشر إلى قواعد البيانات الحية عبر MongoDB Atlas، وتصدر DeepSeek حارسه الخاص للوكلاء مفتوح المصدر مبنيًا بالكامل حول إضافات قابلة للتبديل. ومن جهتها، تفصل Anthropic جلسات Claude عن الجهاز لتربطها بحساب المستخدم. والقاسم المشترك: تتوقف هذه الأدوات عن كونها مجرد مساعدين منفصلين لتصبح طبقات بنية تحتية يصبح فيها بيئة التشغيل، واستمرارية الجلسات، والوصول إلى البيانات مهمة بقدر توليد الكود نفسه.

ويكسب نظام البحث المفتوح عمقًا بقدر ما يكسب اتساعًا. إذ تضاعف Hugging Face المبادرات الهيكلية في 13 أغسطس: سير عمل روبوتي يجمع بين Strands Agents وLeRobot مع مكاسب إنتاجية مُقاسة، وخلاصة صريحة لهاكاثون إعادة إنتاج 2 226 ورقة ICML — حيث احتوت 23 % من الأوراق التي خضعت للمراجعة على ادعاء أُبطِل، ما يذكّر بحدود الإشراف الآلي البحت — ولوحة صدارة OCR (FineBooks) موجهة لحالات استخدام أرشفة عملية بدلًا من التسويق. وإلى ذلك تنضم نماذج مفتوحة شديدة التخصص مثل MiniMax-Music3 للموسيقى أو تحديث Sakana Chat للترميز الانطباعي باللغة اليابانية: لم يعد الانفتاح يقتصر على نماذج اللغة العامة، بل يمتد إلى مجالات متخصصة كاملة.

وأخيرًا، تتفاوض الصناعة على قواعد لعبتها أكثر فأكثر بدلًا من أن تخضع لها. تشرح Synthesia بعمق امتثالها للمادة 50 من AI Act عبر إشارات مصدر C2PA افتراضية، وتحسن GitHub موثوقية بيانات الترخيص لديها عبر الاستعلام المباشر من سجلات الحزم، وينتشر Grok 4.6 في اليوم نفسه لدى ثلاثة مُدمجين مختلفين (Perplexity وWarp وGenspark) من دون أن يحاول أي منهم احتكاره. هذا التطبيع السريع — نموذج متاح تقريبًا في كل مكان خلال أيام قليلة، وتنظيم يُستبق بدلًا من أن يُفاجَأ به — يرسم قطاعًا ينضج في ممارسات التوزيع والحوكمة بالوتيرة نفسها التي ينمو بها في قدراته التقنية.


المصادر