بحث

Claude Code يُدار من الهاتف، GLM-5.3 يتقدم على GPT-5.6 Sol وClaude Fable 5، وPerplexity يشرح ذاكرة Brain

مقال من إنشاء الذكاء الاصطناعي
Claude Code يُدار من الهاتف، GLM-5.3 يتقدم على GPT-5.6 Sol وClaude Fable 5، وPerplexity يشرح ذاكرة Brain

ai-powered-markdown-translator

مقال مترجم من الفرنسية إلى العربية باستخدام gpt-5.4-mini.

عرض المشروع على GitHub ↗

في 22 أغسطس، تفتح Anthropic Claude Code Remote Control لبدء الجلسات من الهاتف، بينما تضيف Google إلى Antigravity وظيفة مماثلة للتحكم في وكلائها عن بُعد. وعلى مستوى النماذج، يُظهر مقارنة تابعة لـ Together AI أن النموذج المفتوح GLM-5.3 يساوي GPT-5.6 Sol وClaude Fable 5 أو يتفوق عليهما على معيار DeepSWE، وبجزء يسير من التكلفة. كما تفصّل Perplexity بنية Brain، وهي ذاكرتها الوكيلة المُنسخة مع Git، ويصبح NotebookLM متاحًا لجميع المستخدمين مع تكامل في وضع الذكاء الاصطناعي من Google Search. وعلى القائمة أيضًا: Replit يراجع أوضاع الوكيل لديه، وRunway يفتح عرض ترخيص للنماذج، وOpenAI يعزز التحكم في تكاليف واجهة برمجة التطبيقات وحزمة الأمان Codex، وGrok Bot يوسّع نطاق الوصول إليه.


Claude Code Remote Control: موثوقية معززة وبدء الجلسة من الهاتف

22 أغسطس — تنشر Anthropic على X سلسلة منشورات تشرح عدة إصلاحات للموثوقية في Remote Control، وهي الميزة التي تتيح إدارة جلسة Claude Code من هاتف أثناء تشغيلها على حاسوب بعيد. لم يعد تزامن الحالة بين الهاتف والجهاز يترك جلسة شبحية ظاهرة بعد إغلاق Claude Code، كما أن انقطاعات الشبكة (تغيير شبكة Wi‑Fi، إغلاق الغطاء) تؤدي الآن إلى إعادة اتصال تلقائية، وأصبح فتح الجلسات الكبيرة أسرع بكثير على iOS. وتحصل ثلاث أوامر slash على سلوك مخصص للهاتف (/clear، /compact، /diff). والجديد في المنتج: أصبح بالإمكان بدء جلسة مباشرة من الهاتف — إذ يظهر أي جهاز يشغّل claude remote-control كبطاقة جهاز في تبويب Code، قابلة للاختيار لإطلاق الجلسة عن بُعد.

Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.

🇸🇦 أصبح هاتفك الآن متزامنًا مع ما يعمل على جهازك. إن استئناف جلسة على حاسوبك المحمول يُبقي الهاتف على الجلسة النشطة بدلًا من أرشفتها. وعندما ينتهي Claude Code، يعرضه هاتفك غير متصل خلال ثوانٍ بدلًا من ترك جلسة قديمة معروضة.@ClaudeDevs على X

🔗 السلسلة الكاملة على X 🔗 توثيق Remote Control


Replit: Conversations، وإعادة تسمية أوضاع Agent (Power/Max)، وRoutines وMemories في مرحلة beta

22 أغسطس — تنشر Replit ملخصها الأسبوعي This Week in Replit مع ثلاث إضافات جديدة. تتيح Conversations بدء فكرة تطبيق بمرحلة بحث وتصوّر حواري قبل الانتقال إلى البناء، من دون فقدان السياق المتراكم — وهي مشكلة شائعة عندما تبدأ هذه المرحلة في مساعد ذكاء اصطناعي آخر. كما أُعيدت تسمية أوضاع Agent: أصبح الوضع Economy السابق Power، وأصبح الوضع Power السابق Max، مع بقاء التكلفة نفسها في الحالتين. وأخيرًا، تصل Routines وMemories إلى مرحلة beta: حيث تُجدول Routines تنفيذ مهمة انطلاقًا من محادثة وتعيد نتيجتها تلقائيًا، بالاعتماد على نظام ذاكرة دائمة. وقد عُرضت هذه الإعلانات مباشرة خلال Friday Showcase الخاص بـ Replit.

🔗 سلسلة الإعلان


Together AI تقارن GLM-5.3 بـ GPT-5.6 Sol وClaude Fable 5 على DeepSWE

21 أغسطس — تنشر Together AI في اليوم نفسه مقارنتين مستقلتين تضعان GLM-5.3، أحدث نموذج مفتوح من Zhipu/Z.ai، في مواجهة نموذجين مغلقين على DeepSWE، وهو معيارها لقياس هندسة البرمجيات (113 مهمة، 4 محاولات لكل إعداد، أقصى جهد، 904 تشغيلات إجمالًا). أمام GPT-5.6 Sol، يخسر GLM-5.3 المحاولة الأولى لكنه يلحق به ابتداءً من الثانية ويتجاوزه في الرابعة، وبكلفة أقل بكثير. وأمام Claude Fable 5، يكون الفارق الأولي شبه معدوم ثم يتسع بوضوح لصالح GLM-5.3 مع المحاولات المتعددة — ويظهر Claude Fable 5 بوصفه الإعداد الأعلى تكلفة في المقارنة. وتصل سلسلة GLM-5.3 إلى Sol، التي لا تُصعّد إلا عند فشل الاختبارات، إلى نسبة نجاح 85,9% بكلفة 6,61 دولار للمهمة، وهي نتيجة أفضل من موجّه oracle مثالي (83,8%).

المقارنة المختبرةالنتيجة في المحاولة الأولىالنتيجة بعد 4 محاولاتالكلفة لكل تشغيل
GLM-5.3 مقابل GPT-5.6 Sol69,0 % مقابل 72,7 %87,6 % مقابل 85,8 %3,99 $ مقابل 8,37 $ (أرخص بـ 2,1×)
GLM-5.3 مقابل Claude Fable 569,0 % مقابل 69,7 %87,6 % مقابل 84,1 %3,99 $ مقابل 21,63 $ (أرخص بـ 5,4×)

Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.

🇸🇦 لا تختَر نموذجًا واحدًا. شغّل GLM-5.3 أولًا، ثم صعِّد إلى GPT-5.6 Sol عندما تفشل الاختبارات. هذه السلسلة تحل 85,9% من مهام DeepSWE بكلفة 6,61 دولار لكل مهمة. أما Sol وحده فيحل 72,7% منها بكلفة 8,37 دولار. ثلاث عشرة نقطة إضافية، وبكلفة أقل بنسبة 21%.Together AI، المدونة الرسمية

🔗 مقارنة GLM-5.3 مقابل Claude Fable 5


21 أغسطس — يعلن حساب X الخاص بـ NotebookLM، الذي أُعيدت تسميته إلى Gemini Notebook، أن تجربة «Notebook» المعاد تصميمها أصبحت متاحة الآن لجميع المستخدمين على الويب (مع إعلان نسخة للهاتف المحمول قادمة)، وذلك بعد طرح تدريجي. وتتمثل التغييرات البنيوية الأخرى في أن الدفاتر أصبحت الآن متاحة مباشرة من وضع الذكاء الاصطناعي في Google Search، ما يقرب أداة تلخيص الوثائق من محرك البحث الرئيسي لدى Google. ويتضمن الإعلان أيضًا إصلاحين في جانب Chat: عرضًا أفضل وإمكانية نسخ ولصق للمعادلات الرياضية، وتصحيحًا لخلل كان يعرض الأرقام بالمقلوب في اللغات التي تكتب من اليمين إلى اليسار (العربية، العبرية). كما وُعد بمزيد من المستجدات خلال الأسابيع المقبلة.

🔗 الإعلان على X


OpenAI تضيف تتبعًا للنفقات حسب مفتاح API إلى لوحات Usage and Spend

21 أغسطس — تضيف OpenAI مستوى أدق حسب مفتاح API إلى لوحات Usage and Spend في منصة المطورين لديها. وبعد أن كان التتبع مجمعًا حتى الآن على مستوى المؤسسة أو المشروع، أصبح بإمكان متابعة النفقات الآن عزل مساهمة كل مفتاح API على حدة، لتحديد التطبيقات أو مسارات العمل الأكثر تأثيرًا في الفاتورة بدقة. وترافق هذه الميزة حدودُ إنفاق قابلة للتهيئة على مستوى المؤسسة أو المشروع، مع إمكانية تعيين حدود صارمة توقف حركة المرور تلقائيًا بمجرد بلوغ السقف. ويمكن الوصول إلى هذه الضوابط من واجهة API Platform وعبر Admin API، لدمجها في مسارات عمل برمجية. وتصف OpenAI هذا التحديث بأنه مكمل لخفض سعر GPT-5.6 Sol الذي أُعلن في اليوم نفسه.

🔗 الإعلان على X


Codex Security: دليل عملي وCLI مفتوح المصدر للدفاع السيبراني (Daybreak)

21 أغسطس — تنشر OpenAI دليلًا يشرح نظام Daybreak البيئي، وهو منصة دفاع سيبراني مدعومة بالذكاء الاصطناعي، من الفرز الأولي داخل ChatGPT حتى إنتاج تصحيح مُتحقق منه. وأكثر ما يهم المطورين عمليًا هو Codex Security CLI، وهي أداة مفتوحة المصدر نُشرت كحزمة npm (@openai/codex-security)، ويمكن استخدامها لفحص مستودع محلي (npx @openai/codex-security scan .) ودمجها في CI/CD (GitHub Actions، GitLab CI/CD) مع تصدير بصيغة SARIF. ومن المستجدات البارزة: bulk-scan، الذي يراجع محفظة كاملة من المستودعات انطلاقًا من جرد CSV، مع استئناف بعد الانقطاع ومعايير تزامن قابلة للضبط. كما تميّز OpenAI بين مستويين من الوصول: Daybreak Blue (فرز الثغرات، التحقق من التصحيحات) للمُدافعين المعتمدين، وDaybreak Red (البحث المتقدم عن الثغرات، red teaming)، وهو مخصص لعدد أكثر محدودية من الاستخدامات المصرح بها. وقد حللت Codex Security cloud بالفعل أكثر من 30 مليون commit عبر أكثر من 30 ألف قاعدة كود.

🔗 الدليل الكامل


Grok Bot يوسّع الوصول إليه إلى المزيد من الباقات ويصبح مجانيًا للتجربة

21 أغسطس — بعد عشرة أيام من إطلاقه في beta، يوسّع Grok Bot نطاق الوصول إليه ليشمل مجموعة أوسع من الباقات: SuperGrok Plus وSuperGrok Heavy، إضافة إلى عروض Cursor (Pro+ وUltra وجميع خطط Teams). ويستفيد المستخدمون خارج هذه الباقات الآن من تجربة مجانية محدودة الاستخدام. وتمتلك هذه الوكلاء المستقلة للذكاء الاصطناعي بيئتها السحابية الخاصة مع وصول عبر المتصفح والطرفية، لتنفيذ مهام مثل الاستطلاع التجاري، وإنشاء مواقع ويب كاملة (بما في ذلك شراء النطاق والنشر)، وفرز صناديق البريد، ودعم العملاء، أو تدوين الملاحظات في الاجتماعات. ويمكن تشغيل عدة Bots بالتوازي داخل المجموعة نفسها، كما يتيح نمط «routine» لـ Bot أن يتعلم مهمةً عبر ملاحظة المستخدم وهو ينفذها للمرة الأولى. كما فُتحت قائمة انتظار مؤسسية للنشر على نطاق أوسع.

🔗 الإعلان على X


Runway تفصّل استراتيجيتها المؤسسية وعرض ترخيص للنماذج

21 أغسطس — يوضح مدير الأعمال الجديد في Runway، Sean Holcombe، في تدوينة استراتيجية الشركة المؤسسية: تضاعف الإيرادات بأكثر من الضعف خلال العام، وصافي الاحتفاظ تجاوز 300%، وتوسع دولي ملحوظ (أوروبا فوق 20% من قاعدة المؤسسات، واليابان أصبحت أول سوق آسيوي). والإعلان الأكثر بنيوية هو فتح عرض ترخيص النماذج: فبدلًا من وصول يُفوَّتَر بحسب الاستخدام عبر API، سيتمكن بعض العملاء المؤسسيين من الحصول على أوزان نماذج مغلقة وframework تدريب/استدلال مملوك يمكن استضافته وضبطه مباشرة داخل بيئتهم الخاصة. وتستهدف Runway أربعة أنماط: شركات تمتلك ملكية فكرية إبداعية خاصة بها، ومنصات لديها أصلًا قدرة حوسبة، ومنظمات تخضع لقيود تنظيمية صارمة، وجهات ذات أحجام ضخمة جدًا.

🔗 التدوينة الكاملة


Perplexity تفصّل Brain، نظام الذاكرة الوكيلة في Computer

19 أغسطس — تفصّل Perplexity آلية عمل Brain، وهو نظام الذاكرة الدائمة في Computer، وكيلها المحلي. وبدلًا من قاعدة متجهات تقليدية، ينظم Brain الذاكرة على هيئة wiki معرفة مُنسخة عبر Git، موزعة على ثلاث طبقات داخل نظام ملفات بيئة العزل: knowledge/ (الويكي)، notes/ (مقتطفات مكررة)، وsessions/ (نصوص خام). ويقوم «Memory Agent» مخصص بتحميل الملفات ذات الصلة عند الطلب بدلًا من نسخ شجرة الملفات كاملة في كل بدء تشغيل، بينما تحافظ وكلاء في الخلفية تُسمى «Dream» على الويكي دون اتصال على أربع خطوات، مع عمليات تحقق قبل النشر.

المقياس المُقيَّممن دون Brainمع Brain
الدقة (معيار داخلي، 640 سؤالًا)0,6000,661
استرجاع الأدلة (معيار داخلي)0,5730,625
الدقة في الإنتاج (آخر 30 يومًا)شاهد+9,3 نقاط

🔗 المقال التقني


مختصرات

  • Devin (Cognition) — خصم إضافي 20% على GPT-5.6 Sol — تضيف OpenAI خفضًا بنسبة 20% على سعر GPT-5.6 Sol لمدة 3 أشهر، يضاف إلى خصم 70% المطبق بالفعل منذ 18 أغسطس: وبذلك تصل الخصومة التراكمية على Devin Desktop وCLI إلى 76% حتى 3 أكتوبر 2026. 🔗 إعلان
  • Google Antigravity 2.9.1 — Remote Control للتحكم في الوكلاء عن بُعد — ميزة جديدة تتيح بدء جلسة وكيل محلية ومراقبتها من أي متصفح، مع مكاسب في الأداء وتحسن في الاستعادة بعد الخطأ. 🔗 سجل التغييرات
  • Auto model selection بخصم -30% لـ Copilot Max — عرض ترويجي على الاختيار التلقائي للنموذج (Claude أو GPT أو Microsoft AI) لمشتركي Copilot Max، صالح حتى 30 سبتمبر 2026. 🔗 إعلان · 🔗 تاريخ الانتهاء
  • GitHub Universe 2026 — إعادة إطلاق التذاكر — إعادة إطلاق تسويقية لمؤتمر GitHub Universe 2026 عبر فيديو قصير، من دون إعلان منتج مرتبط. 🔗 فيديو
  • Midjourney — سجل تغييرات كبير لنسخة alpha من الموقع — أسبوعان من إصلاحات UX على alpha.midjourney.com: مجلدات المشاريع، عودة Upscale/Zoom/Vary، تثبيت الإعدادات، وإصلاحات أداء. 🔗 سجل التغييرات
  • MiniMax تلمّح إلى إطلاق نموذج M3 على SambaNova — ردًا على إعلان غامض من SambaNova، توحي MiniMax بوصول وشيك لنموذج M3، من دون مواصفات أو تاريخ طرح معلن. 🔗 تغريدة
  • Grok 4.6 متاح على Google Enterprise Agent Platform — ينضم النموذج إلى Model Garden (المعروفة سابقًا باسم Vertex AI)، مع نافذة سياق من 500,000 token وتسعير 2 $ / 6 $ لكل مليون token في الإدخال/الإخراج. 🔗 إعلان
  • Cohere تفعّل وضعًا محليًا للإملاء الصوتي عبر superwhisper — يجمع وضع «Go Local» بين Cohere Transcribe ونموذج S1-mini المفتوح (0,6 مليار معلمة) من superwhisper، مع نسخ يتم بالكامل على الجهاز. 🔗 إعلان

ما الذي يعنيه هذا

إعلانان مستقلان، لا صلة بينهما، يتقاربان اليوم حول حركة واحدة: فصل إدارة وكيل الذكاء الاصطناعي عن الجهاز الذي يعمل عليه فعليًا. لدى Anthropic، تتيح Claude Code Remote Control الآن بدء جلسة مباشرة من الهاتف، مع إعادة اتصال تلقائية ومزامنة للحالة بين الأجهزة. ولدى Google، تقدّم Antigravity ميزة «Remote Control» الخاصة بها: التحكم في جلسة وكيل محلية ومراقبتها من أي متصفح. في الحالتين، يظلّ الحساب والتنفيذ متمركزين على محطة العمل — لكن نافذة التحكم هي التي تصبح متنقلة. هذا الفصل يستجيب لاستخدام أصبح شائعًا: تشغيل مهمة طويلة على جهاز التطوير الخاص بك، ثم متابعة التحكم فيها واستئنافه من جهاز آخر، من دون إيقاف التنفيذ الجاري مطلقًا.

الحركة الثانية الواضحة اليوم تمس اقتصاديات النماذج. يظهر المقارنان من Together AI أن GLM-5.3، وهو نموذج مفتوح من Zhipu/Z.ai، يساوي أو يتجاوز GPT-5.6 Sol وClaude Fable 5 على معيار قياس واحد لهندسة البرمجيات، بتكلفة أقل من 2 إلى 5 مرات. وهذا ليس مثالًا معزولًا: في الأسبوع نفسه، توسّع xAI عمليات الدمج السحابي لـ Grok 4.6 (Google Enterprise Agent Platform بعد GitHub Copilot وAmazon Bedrock)، وتمنح OpenAI خصمًا تراكميًا بنسبة 76 % على GPT-5.6 Sol لمستخدمي Devin، وتوسّع Replit أوضاع الوكيل الخاصة بها. لم تعد المنافسة تُحسم فقط بالقدرة الخام للنماذج، بل بنسبة التكلفة إلى الفعالية والتوافر عبر المنصات — وهو ميدان تصبح فيه النماذج المفتوحة، مقترنةً باستراتيجيات التتابع بين النماذج، حججًا تجارية قائمة بذاتها في مواجهة النماذج المغلقة.

خيط ثالث، أكثر هدوءًا، يمر أيضًا عبر اليوم: الذاكرة الدائمة تصبح لبنة بنية تحتية قائمة بذاتها للوكلاء الذكيين. تفصّل Perplexity بنية Brain، وهو ويكي معرفة مُؤرشف بالإصدارات مع Git ينظم ذاكرة وكيل Computer بدلًا من تراكمها في قاعدة متجهات تقليدية، مع مكاسب مقاسة في الدقة واسترجاع الأدلة. وفي الوقت نفسه، توسّع Google الوصول إلى تجربة Notebook المعاد تصميمها في NotebookLM وتدمجها مباشرة في وضع الذكاء الاصطناعي في Google Search، ما يقرّب أداة تلخيص الوثائق قليلًا أكثر من محرك البحث الرئيسي. في الحالتين، لا تأتي القيمة المضافة من النموذج الأساسي وحده، بل من الطريقة التي تُنظَّم بها السجلات والمعارف المتراكمة وتُستعاد وتُعاد الاستفادة منها من جلسة إلى أخرى.

زاوية أخيرة تتعلق بنضج الأدوات الموجّهة لفرق التقنية والأمن في الشركات. تضيف OpenAI تتبعًا للمصروفات حسب مفتاح API وحدودًا صارمة قابلة للتهيئة إلى لوحاتها، في الوقت نفسه الذي تنشر فيه دليلًا مفصلًا عن Codex Security، مع CLI مفتوحة المصدر قادرة على تدقيق محفظة كاملة من المستودعات. هذان الإعلانان، المنشوران في اليوم نفسه من قبل الفريق نفسه، يرسمان استجابة متسقة لقلق تشترك فيه المؤسسات التي تنشر وكلاء ذكاء اصطناعي على نطاق واسع: الحفاظ على تحكم دقيق في التكاليف ومساحة الأمان، من دون التخلي عن السرعة التي تعد بها هذه الأدوات.


المصادر