ai-powered-markdown-translatorمقال تُرجم من الفرنسية إلى العربية باستخدام gpt-6.1-sol.
يوم الجمعة 2 أكتوبر، تنشر Meta ست أوراق بحثية في الرياضيات أعدّها باحثون باستخدام نموذجها Muse Spark؛ ووفقًا لـMeta، تجيب خمس منها عن أسئلة بحثية ظلت مفتوحة. وتخصص Anthropic مبلغ 100 مليون دولار لتدريب 10 000 مهندس نشر عبر Claude Frontier Academy، وتنشر Claude Code 2.1.288، بينما تعلن NVIDIA عن DGX Spark بذاكرة 64 غيغابايت بسعر يبدأ من 4 999 دولارًا. ويكمل أخبار اليوم إعلانان صدرا مساء اليوم السابق: Decisions API من Perplexity، التي تجيب باحتمالات باستخدام نموذج منشور بأوزان مفتوحة، والقمر الصناعي التابع لـGoogle الذي يحمل أولى وحدات TPU الخاصة بها إلى المدار.
Meta تنشر ست أوراق بحثية في الرياضيات كُتبت باستخدام Muse Spark، وAi2 تتيح AstaBrief، وذكاء Google الاصطناعي يتنبأ بالإنفلونزا
2 أكتوبر — تنشر Meta على مدونتها البحثية ست أوراق بحثية في الرياضيات أعدّها باحثون باستخدام Muse Spark، نموذجها المطوّر داخليًا. ووفقًا لـMeta، تقدم خمس منها إجابة عن أسئلة بحثية كانت مفتوحة حتى الآن، دون أن يحدد المنشور أيّها يمثل الاستثناء. عمل علماء الرياضيات خلال الأشهر الماضية باستخدام Muse Spark 1.1 و1.2 في وضع Thinking، مباشرةً في واجهة المحادثة على meta.ai، دون إطار مخصص لدعم البحث (إطار بحث مخصص).
Following gold-medal-level performance from our AI models across five competitions in mathematics, physics, and chemistry, we asked a harder question: can AI contribute when a problem is genuinely open and without an existing solution path?
🇸🇦 بعد أن حققت نماذجنا للذكاء الاصطناعي أداءً بمستوى الميدالية الذهبية في خمس مسابقات في الرياضيات والفيزياء والكيمياء، طرحنا على أنفسنا سؤالًا أصعب: هل يمكن للذكاء الاصطناعي أن يسهم عندما تكون المسألة مفتوحة فعلًا ولا يوجد أي مسار للوصول إلى حلها؟ — @AIatMeta على X
البروتوكول المعلن صارم: يوجّه فريق من علماء الرياضيات البحث، وتراجع مجموعة ثانية العمل، وتحدد كل ورقة المقاطع التي كتبها أساسًا الباحثون أو الذكاء الاصطناعي. وتتفاوت مساهمة النموذج كثيرًا بين الأوراق، من الحسابات المساعدة إلى كتابة أقسام كاملة:
| المجال الرياضي | النتيجة التي أعلنتها Meta | مساهمة Muse Spark وفقًا لـMeta |
|---|---|---|
| الاحتمالات | عتبة صارمة لملاءمة إهليلج يمر بنقاط غاوسية عشوائية في أبعاد عالية | استراتيجيات البرهان |
| المعادلات التفاضلية | انفجار حلول شعاعية ذات طاقة سالبة في زمن منتهٍ لمعادلة شرودنغر غير الخطية ثنائية التوافق والحرجة بالنسبة إلى الكتلة، وهي مسألة مفتوحة منذ 2015 | حسابات، واختبار حجج، ومراجعة البرهان |
| نظرية المجموعات | المجموعة شبه الأبيلية ليست بالضرورة أحادية الحدود: مثال مضاد من الرتبة 384 لتخمين م. كيدا (2024) | برنامج بحث مكتوب بلغة GAP، وجد المثال المضاد |
| التحسين | قاعدة دقيقة تحدد متى يمثّل الإرخاء بواسطة الدورات المسألة الأصلية | إعادة صياغة احتمالية، ومثال مضاد، واستراتيجية برهان |
| الفيزياء الحسابية | دالة النقطتين في نظرية الأوتار ذات الأعداد p-أديّة تساوي دالة ارتفاع، على فئة من المنحنيات أوسع بكثير من منحنى تيت | براهين مقترحة، وكتابة ثلاثة أقسام تقنية |
| الجبر غير التجميعي | مثال مضاد من البعد 3 لتخمين حول جبريات التطور القابلة للحل | مثال مضاد وتوصيفات بديلة |
تقرّ Meta بأن ثلاثًا من هذه المسائل حُلّت أيضًا في جهات أخرى: ثلاثة أبحاث نُشرت في أغسطس حول العتبة الغاوسية، ومثال مضاد لتخمين كيدا أشار إليه وكيل الذكاء الاصطناعي Nilradical في 16 سبتمبر، وأمثلة مضادة حول جبريات التطور قدمها هو ووين. ووفقًا لـMeta، توصلت إلى نتائجها بصورة مستقلة وبمقاربات أخرى. يأتي الإعلان بعد إعلان OpenAI، التي قالت في 21 سبتمبر إن نموذجًا داخليًا حلّ أكثر من 100 مسألة مفتوحة؛ وتشدد Meta على استخدام نموذج متاح لعامة المستخدمين كما هو، وعلى الشفافية بشأن مساهمة الذكاء الاصطناعي، مع بقاء جميع البراهين خاضعة للتحقق والتصحيح وإعادة الكتابة على يد علماء الرياضيات.
🔗 حل مسائل البحث المفتوحة معًا (Meta AI Research)
AstaBrief 8B: تتيح Ai2 نموذجًا يكتب تقارير علمية موثقة بالمراجع
2 أكتوبر — تتيح Ai2 نموذج AstaBrief 8B، الذي يحوّل سؤالًا بحثيًا ومقتطفات من الأدبيات إلى تقرير علمي موثق بالمراجع. وهو يشغّل الآن وضع Fast في وظيفة «إنشاء تقرير» ضمن Asta، منصة Ai2 القائمة على الوكلاء والمخصصة للعلوم، إلى جانب وضع Thinking الذي يشغّله Claude. تظل الوصفة بسيطة: Qwen3-8B، وضبط دقيق خاضع للإشراف (SFT) على 47 000 مثال أُنتجت عبر سير عمل ScholarQA، ثم تحسين مباشر للتفضيلات (DPO) على نحو 6 000 زوج، دون تعلّم بالتعزيز. وقد نُشرت الأوزان، بترخيص Apache-2.0 وفقًا لبطاقة النموذج، وبيانات التدريب: وبإمكان مختبر تشغيله على أجهزته الخاصة.
يكتب النموذج تقريره في تمريرة واحدة. وعبر سير عمل Asta كاملًا، يستغرق التقرير في المتوسط 51,1 ثانية في وضع Fast مقابل 178,5 ثانية في وضع Thinking، أي أسرع بنحو 3,5 مرات. وفي دراسة بشرية صغيرة (14 سؤالًا، و3 باحثين)، يتفوق DR Tulu من حيث التفضيل العام، لكن باحثَين من أصل ثلاثة يفضلان AstaBrief لدقة المراجع. وتنبه Ai2 إلى أن معظم التدريب والتقييم يعود إلى 2025، ولم يُعَد إجراؤهما للمقارنة بالنماذج الحالية.
🔗 إتاحة AstaBrief مفتوح المصدر (Ai2)
الإنفلونزا: نموذج صُمم باستخدام ذكاء Google الاصطناعي يتصدر 39 نموذجًا في تقييم FluSight لدى CDC
30 سبتمبر — تعلن Google أن نموذجًا للتنبؤ بالإنفلونزا صُمم باستخدام ذكائها الاصطناعي كان الأفضل في موسم 2025-2026 ضمن FluSight، منظومة المراكز الأمريكية لمكافحة الأمراض والوقاية منها (CDC) التي تجمع كل أسبوع، من أكتوبر إلى مايو، توقعات حالات الدخول إلى المستشفيات. ويؤكد تقرير نهاية الموسم الصادر عن CDC ذلك: من بين 39 نموذجًا اختيرت من أصل 53 قدمها 34 فريقًا، يتصدر النماذج الفردية Google_SAI-FluEns، بقيمة WIS نسبية تبلغ 0,56 (مقياس للخطأ: كلما انخفض، كان التنبؤ أفضل)، متقدمًا على ثلاثة نماذج بقيمة 0,58، منها OHT_JHU-nbxd. ويحتل النموذج التجميعي FluSight، الذي تستخدمه CDC في تواصلها مع الجمهور، المرتبة السابعة.
طُوّرت هذه التوقعات باستخدام Empirical Research Assistance (ERA)، وهي أداة ذكاء اصطناعي من Google تولّد خوارزميات تحسين لمجالات علمية مختلفة، ومتاحة لمختبرين موثوقين. وتصف الورقة البحثية المرتبطة بها نظامًا مستقلًا يكتب شيفرة التنبؤ الخاصة به ويقيّمها ويحسّنها عبر بحث شجري يوجّهه LLM؛ وقد أنتج أيضًا نماذج لـCOVID-19 والفيروس المخلوي التنفسي (VRS).
🔗 منشور Google Research · تقرير FluSight لموسم 2025-2026 الصادر عن CDC
Perplexity تطلق Decisions API وتتيح pplx-decider-v1-27b، وllama.cpp يقدّم نماذج القرار
1 أكتوبر — تتيح Perplexity واجهة API جديدة، هي Decisions API، وتنشر بترخيص Apache 2.0 النموذج الذي يشغّلها، pplx-decider-v1-27b. صدر الإعلان مساءً عبر @perplexitydevs، حساب الشركة المخصص للمطورين. وبدلًا من كتابة إجابة، يعيد هذا النموذج لاتخاذ القرار (نموذج قرار) توزيعًا احتماليًا على مجموعة ثابتة من الإجابات: يقرأ نصوصًا أو JSON أو صورًا، لكنه لا يكتب إجابة، ولا يولّد شيفرة، ولا يشرح استدلاله.
تتوفر ثلاثة أنواع من الأسئلة: يعيد noul احتمال الإجابة بنعم، ويختار choice من بين 1 إلى 255 خيارًا مع احتمال لكل منها ومؤشر ثقة، ويصنّف score المحتوى على مقياس من 10 مستويات على الأكثر. ويمكن للطلب الواحد طرح ما يصل إلى 128 سؤالًا حول المحتوى نفسه، ويجب أن يظل حجم المدخلات، بما فيها الأسئلة، أقل من 262 144 رمزًا. يبلغ السعر 0,04 دولار لكل مليون رمز في المدخلات، والمخرجات مجانية، ولا تُفرض رسوم على الطلب الواحد؛ ويمكن لكل مؤسسة إرسال 10 طلبات في الثانية، مهما كانت خطتها. تستهدف Perplexity التصنيف والتوجيه والتقييم وفق شبكة معايير: يفرز مثالها المرجعي (دليل أمثلة) تذاكر الدعم، وتتخذ Decisions API القرار الأول، بينما تتولى Agent API الحالات المصعّدة.
خضع النموذج لضبط دقيق انطلاقًا من Qwen3.8-27B؛ وتتطلب أوزانه، المتاحة على Hugging Face، وحدة GPU تدعم CUDA وتتسع ذاكرتها لنحو 49 غيبيبايت، إضافةً إلى ذاكرة التشغيل. وتقارنه بطاقته بـJev، وهو نموذج قرار آخر، وبنموذجه الأساسي عبر أحد عشر اختبارًا معياريًا، مع قياس نتائج pplx-decider-v1-27b عبر API من Perplexity:
| الاختبار المعياري (الدقة) | درجة Jev | درجة Qwen3.8-27B (النموذج الأساسي) | درجة pplx-decider-v1-27b |
|---|---|---|---|
| WinoGrande | 90,70 % | 73,10 % | 83,30 % |
| FinancialPhraseBank | 76,98 % | 75,68 % | 84,18 % |
| RAGTruth | 77,27 % | 61,53 % | 88,80 % |
| JudgeBench | 78,57 % | 68,86 % | 78,29 % |
| BBH | 94,27 % | 72,80 % | 82,80 % |
| JevBench public hard | 73,27 % | 72,28 % | 70,30 % |
| TabFact | 89,80 % | 78,60 % | 90,60 % |
| ContractNLI | 77,45 % | 80,78 % | 80,78 % |
| Circa | 84,60 % | 87,00 % | 89,20 % |
| Belebele | 95,00 % | 93,20 % | 94,00 % |
| TruthfulQA binary | 92,00 % | 82,80 % | 85,40 % |
| الإجمالي (وفقًا للبطاقة) | 84,51 % | 74,76 % | 85,71 % |
في صف الإجمالي، الذي أبرزَه الإعلان، يتقدم pplx-decider-v1-27b على Jev، بنسبة 85,71 % مقابل 84,51 %، لكن البطاقة لا توضح كيفية حساب هذا الصف. وبحسب الجدول المنشور، يظل Jev متقدمًا في ستة من الاختبارات المعيارية الأحد عشر، منها BBH وWinoGrande، بل إن نموذج Perplexity يتراجع خلف نموذجه الأساسي في JevBench public hard.
🔗 إعلان @perplexitydevs · توثيق Decisions API · pplx-decider-v1-27b على Hugging Face
llama.cpp يقدّم نماذج القرار عبر API /v1/systemone المتوافقة مع Jev
2 أكتوبر — أصبح خادم llama.cpp قادرًا على تقديم نماذج القرار عبر نقطة وصول جديدة، /v1/systemone، أُضيفت مع PR رقم 29818 التي دُمجت في 2 أكتوبر. ويشرح منشور ggml-org، الموقّع باسم شوان-سون نغوين وفيكتور موستار، المبدأ: تُرسل حالة (نص، أو JSON، أو لقطة شاشة) وأسئلة ذات أنواع محددة، choice، أو score (من 2 إلى 10 مستويات)، أو noul (نعم أو لا)، ويعيد النموذج احتمالًا لكل خيار في تمريرة واحدة. تتبنى API تنسيق System One الذي قدّمه Jev، نموذج TypeSafe: ولا يحتاج العميل الحالي إلا إلى تغيير URL الأساسي. ويحمّل وضع الموجّه عدة نماذج عند الطلب على الخادم نفسه.
| نموذج القرار المدعوم | حجم النموذج | النموذج الأساسي | الزمن الوسيط لكل سؤال |
|---|---|---|---|
| Julia-1 (أكثر من 50 لغة) | 144M | mmBERT-small | 3 ms |
| Laya | 421M | ModernBERT-large | 5 ms |
| Kev-4B | 4B | Qwen3.5-4B-Base | 12 ms |
| lev | 4B | Qwen3.5-4B | 36 ms |
| OpenJev (يقرأ الصور أيضًا) | 27B | Qwen3.8-27B | 43 ms |
قِيست الأزمنة على NVIDIA RTX PRO 6000. النموذج التالي المُعلن عنه هو Clef، الذي قدمته Cloudflare في 1 أكتوبر مع API متوافقة مع API الخاصة بـJev؛ وأنشأت ggml-org في 2 أكتوبر مستودعات GGUF لكل من Clef وClef-flash على Hugging Face.
🔗 جديد في llama.cpp: نماذج القرار
Anthropic تطلق Claude Frontier Academy وتلتزم بتخصيص 100 مليون دولار لتدريب 10 000 مهندس
2 أكتوبر — تطلق Anthropic برنامج Claude Frontier Academy للتدريب، مدعومًا بالتزام مالي بقيمة 100 مليون دولار. والهدف هو تدريب 10 000 مهندس لنشر الأنظمة المتقدمة (Frontier Deployed Engineers، FDE) بحلول نهاية 2027. وتضم الدفعات الأولى مهندسين من Accenture وBain وCapgemini وCommonwealth Bank of Australia وDeloitte وMcKinsey وMorgan Stanley وNovo Nordisk.
يستند البرنامج الأول، Frontier Deployed Engineer Residency، إلى نموذج التدريب الطبي. ووفقًا لصفحة البرنامج، يبدأ بوحدة مكثفة مدتها أربعة أيام: ثلاثة أيام حضورية لبناء نظام Claude لشركة افتراضية، ثم اختبار مُقيَّم يمنح شارة Claude Resident Engineer. تلي ذلك اثنا عشر أسبوعًا من التدريب العملي لتنفيذ نشر Claude داخل مؤسسة المتدرب، ثم تقييم نهائي للحصول على شارة Claude Frontier Deployed Engineer؛ ومن المتوقع منح الشارات الأولى في بداية 2027.
لا يزال الالتحاق مقيدًا: المشاركة عن طريق الترشيح، والوصول المبكر مخصص لعملاء وشركاء مختارين، مع دفعات في سان فرانسيسكو ونيويورك ولندن. وتوسّع الأكاديمية نطاق Claude Partner Network، الذي يضم 46 000 شركة وأكثر من 175 000 شهادة، وأُطلق في مارس بتمويل قدره 100 مليون دولار؛ ولا يوضح المنشور ما إذا كان التمويل الجديد يُضاف إلى ذلك المبلغ.
🔗 إعلان Anthropic · صفحة البرنامج
الوكلاء: Claude Code 2.1.288، وGLM 5.3 في Cursor، وReplit، وDeepSeek Harness، ومعيار SWE-sweep
Claude Code 2.1.288 يزيل الحد الزمني لأوامر الخلفية في الجلسات التفاعلية
2 أكتوبر — يأتي Claude Code 2.1.288 مع 89 بندًا في سجل التغييرات، منها 64 إصلاحًا. وأبرز تغيير يتعلق بالأوامر التي تُشغَّل في الخلفية: فالحد الزمني الذي أُدخل في الإصدار 2.1.285، وهو 30 دقيقة افتراضيًا وساعتان كحد أقصى، أصبح ينطبق فقط على الجلسات غير الخاضعة للإشراف (-p، وAgent SDK، وCI، والسحابة). وفي الطرفية وتطبيق سطح المكتب وVS Code، أصبح بإمكان أمر في الخلفية أن يعمل مجددًا دون حد زمني.
يمكن استعادة prompt مُسح بالخطأ باستخدام Ctrl+C بالضغط على السهم إلى الأعلى، ويقبل /code-review الخيار --max-findings لعرض عدد أكبر أو أقل من المشكلات، ويتحول claude project purge إلى claude purge، وتحصل mods، التي أُطلقت في اليوم السابق، على $.ui.selection()، الذي يُرجع آخر نص محدد في وضع ملء الشاشة. وعندما تنتهي مهلة API في أثناء الإجابة، تستأنف الجلسات غير التفاعلية والوكلاء الفرعيون العمل انطلاقًا من الإجابة الجزئية بدلًا من الفشل. وفي جانب الأمان، لم يعد rm خطير دُسّ في برنامج نصي bash -c يمر دون تأكيد في وضع bypassPermissions، وأصبحت آلية hook من نوع PreToolUse أو PermissionRequest التي تفشل مطابقتها تمنع الاستدعاء بدلًا من تجاهلها. وأخيرًا، أصبح مصنِّف وضع auto من جهة العميل يتجاهل متغير ANTHROPIC_DEFAULT_SONNET_MODEL الذي يشير إلى Sonnet 5.5 أو Opus 5.5، ويستخدم Claude Sonnet 5 بدلًا منهما.
بعد ست دقائق من الإصدار، سلّط @ClaudeDevs الضوء على You should know، وهو mod مدمج يشغّل وكيلًا ثانويًا يتولى عرض المعلومات التي ينبغي عدم تفويتها فوق prompt. وكان بالفعل ضمن mods الستة المدمجة التي عُرضت في 1 أكتوبر، ولا يزال معطلًا افتراضيًا.
We’re adding a new plugin to Claude Code: You should Know. It scans Claude’s output for important information you might miss to help keep you in the loop. Enable it with: /plugin enable cc-plugin-you-should-know@builtin
🇸🇦 نضيف plugin جديدًا إلى Claude Code: You should Know. يحلّل مخرجات Claude بحثًا عن معلومات مهمة قد تفوتك، ليبقيك على اطلاع. فعِّله باستخدام: /plugin enable cc-plugin-you-should-know@builtin — @ClaudeDevs على X
🔗 ملاحظات إصدار Claude Code 2.1.288
GLM 5.3 وGLM 5.3 Flash يصلان إلى Cursor
1 أكتوبر — يضيف Cursor النموذجين المفتوحين من Z.ai، وهما GLM 5.3 وGLM 5.3 Flash، إلى أداة اختيار النماذج، ويعلن أن GLM 5.3 Max يحتل المرتبة الأولى بين النماذج المفتوحة في معياره الخاص للاختبار.
GLM 5.3 and GLM 5.3 Flash are now available in Cursor! GLM 5.3 Max is the best-scoring open-weight model on CursorBench 4.0.
🇸🇦 أصبح GLM 5.3 وGLM 5.3 Flash متاحين الآن في Cursor! GLM 5.3 Max هو النموذج ذو الأوزان المفتوحة الأعلى تقييمًا على CursorBench 4.0. — @cursor_ai على X
يوزّع الرسم المرفق النماذج وفقًا لنتائجها في CursorBench 4.0 ومتوسط تكلفتها لكل مهمة، لكنه يضع تسمية لنقطة واحدة فقط: نقطة GLM 5.3 الموسومة بـ« (max) »، بنتيجة 42,6 % وتكلفة 5,05 دولارات لكل مهمة. ووفقًا لهذا الرسم، يأتي GLM 5.3 دون Claude Opus 5.5 وClaude Sonnet 5.5 وFable 5.1 وGrok 4.7، ولا يظهر فيه أي نموذج مفتوح آخر، كما لا يظهر GLM 5.3 Flash. ولم ينشر Cursor تسعيرًا أو منشورًا أو منهجية تدعم ترتيبه.
Replit تتيح GPT-6.1 Sol وClaude Sonnet 5.5 في Agent، وJev في AI Integrations
2 أكتوبر — يضيف سجل تغييرات Replit نموذجين حديثين للاختيار في Replit Agent: Claude Sonnet 5.5 في وضع Power، وGPT-6.1 Sol في وضع Max. ويتيح البند نفسه Jev، وهو نموذج اتخاذ القرار الذي سبق ذكره في مقارنة مع pplx-decider-v1-27b، ضمن Replit AI Integrations: يمكن للتطبيق تصنيف المحتوى أو توجيه الطلبات أو تقييم العملاء المحتملين عبر قرارات سريعة ومنظمة، دون إدارة مفتاح API. وتوضح الوثائق أن Jev يُقدَّم تحت المعرّف jev-latest عبر OpenRouter. وتُفتح الإعدادات الآن في صفحة كاملة، ويمكن لحسابات Enterprise وضع قواعد تشمل الشركة بأكملها، مع استثناءات لكل فريق (Workspace). ولا يذكر البند أي تسعير.
🔗 سجل تغييرات Replit بتاريخ 2 أكتوبر
DeepSeek Harness أصبح قابلًا للتثبيت على macOS وWindows
30 سبتمبر — يعلن الحساب @DeepSeekHarness عن إصدار لسطح المكتب من DeepSeek Harness، وهو إطار تشغيل الوكلاء المفتوح المصدر من DeepSeek، لنظامي macOS وWindows. وفي 2 أكتوبر، أعاد الحساب الرئيسي @deepseek_ai نشر الإعلان، وأوضح أن مستخدمي Linux يستخدمون حزمة npm المسماة @deepseek-ai/dsh. ويمكن تنزيل برامج التثبيت من موقع DeepSeek، لنظام macOS على شرائح ARM ولنظام Windows x64.
تقدّم الصفحة الرسمية، الموسومة بـPREVIEW، Harness بوصفه نسخة أولية عامة متاحة في جميع أنحاء العالم ومفتوحة المصدر. ويستند إلى بنية «كل شيء إضافة» (كل شيء إضافة) في إطار العمل Cordis، ويغطي أعمال المكتب، بما فيها الملفات والبيانات والمستندات والعروض التقديمية، والبرمجة، والبحث مع الاستشهاد بالمصادر، والمهام في الخلفية، مع وضع Creator الذي يتيح كتابة plugins جديدة من خلال المحادثة. ويتمثل الجديد في طريقة التوزيع: فقد كانت النسخة الأولية بتاريخ 29 سبتمبر تدمج بالفعل الأمر dsh في تطبيق سطح المكتب، ولم يُنشر بعد أي إصدار مستقر على GitHub.
🔗 إعلان @deepseek_ai · صفحة DeepSeek Harness
SWE-sweep: معيار يتعين فيه على الوكلاء اكتشاف الأخطاء التي ينبغي إصلاحها بأنفسهم
1 أكتوبر — يتيح باحثون من Meta Superintelligence Labs، بالتعاون مع هارفارد وجامعة واشنطن وستانفورد، معيار SWE-sweep، الذي يطلب من وكلاء البرمجة اكتشاف أخطاء مستودع حقيقي بأنفسهم وإصلاح أكبر عدد ممكن منها، دون أي تلميح إلى طبيعتها أو موقعها. وتشمل مجموعة البيانات 100 مستودع و4 068 خطأ؛ وتستند الشفرة، المرخصة بموجب MIT، إلى إطار العمل Harbor، ويظهر أوفير بريس وجون يانغ ضمن المؤلفين. ولم يصاحب المستودع، الذي أُنشئ في 1 أكتوبر، أي إعلان حتى الآن.
يوضح الترتيب، الذي حُدِّث في 24 سبتمبر وقيس باستخدام الوكيل mini-SWE-agent، حجم المهمة:
| المرتبة في الترتيب | النموذج المقيَّم | الأخطاء المحلولة | التكلفة الإجمالية |
|---|---|---|---|
| 1 | Sol 5.6 (xhigh), OpenAI | 4,7 % | 7 230 dollars |
| 2 | Luna 5.6 (xhigh), OpenAI | 2,5 % | 224 dollars |
| 3 | Terra 5.6 (xhigh), OpenAI | 1,5 % | 357 dollars |
| 4 | Luna 5.6 (high), OpenAI | 1,4 % | 28 dollars |
| 5 | Opus 5 (xhigh), Anthropic | 1,3 % | 5 363 dollars |
الحوسبة والعتاد: أول وحدات TPU في المدار، وDGX Spark 64 Go، وDeepGEMM وDeepEP على Ascend 950
Project Suncatcher: القمر الصناعي التجريبي من Google يحمل أول وحدات TPU إلى المدار
1 أكتوبر — بعد أسبوع من إعلان أول اختبار لها في المدار، أطلقت Google القمر الصناعي التجريبي لمشروع Project Suncatcher، وهو مشروع بحثي طويل الأمد (مشروع بالغ الطموح) يدرس ما إذا كان الفضاء قادرًا يومًا ما على استضافة بنية تحتية للتعلم الآلي على نطاق واسع. وقد وصل القمر، الذي بُني بالتعاون مع Planet، إلى المدار على متن Transporter-18، وهي مهمة إطلاق مشتركة من SpaceX؛ ووفقًا لترافيس بيلز من Google، أقام الفريق اتصالًا بالقمر وهو يعمل كما هو متوقع.
خلال الأسابيع المقبلة، ستقيس Google كيفية تحمّل وحدات TPU لديها متطلبات الرحلات الفضائية ومستويات الإشعاع ودرجات الحرارة القصوى؛ وكانت وحدات TPU Trillium على الأرض قد تحمّلت بالفعل جرعة إشعاع أعلى من جرعة مهمة مدتها خمس سنوات. وتُنشر المقالة التي خضعت لمراجعة الأقران وتفصّل البحث في مجلة Joule. وعند إعادة نشر خبر الإطلاق في 2 أكتوبر، ذكّر @GoogleAI بالمبرر الذي يقوم عليه المشروع: في المدار الأرضي المنخفض، يكون ضوء الشمس شبه مستمر، ويمكن للأقمار الصناعية إنتاج طاقة شمسية تصل إلى 8 أضعاف ما تنتجه على الأرض. والخطوة التالية المعلنة هي قمران صناعيان في 2027 لاختبار وصلات ليزر.
🔗 النموذج التجريبي لـProject Suncatcher أصبح في المدار · المقالة المنشورة في Joule · إعادة نشر الخبر من @GoogleAI
DGX Spark 64 Go: NVIDIA تضيف تكوينًا يُباع بدءًا من 23 أكتوبر
2 أكتوبر — تضيف NVIDIA إلى DGX Spark تكوينًا بذاكرة موحدة تبلغ 64 Go، إلى جانب طراز 128 Go. وسيُباع حصريًا عبر ست شركات مصنّعة شريكة، هي Acer وASUS وDell وGigabyte وHP وMSI، بدءًا من الجمعة 23 أكتوبر، بسعر يبدأ من 4 999 دولارًا؛ ولا يذكر المنشور السعر الحالي لطراز 128 Go. وتبقى المكونات الأساسية نفسها: شريحة GB10 Grace Blackwell، ونظام DGX OS، وحزمة برمجيات NVIDIA AI، لتشغيل نماذج تضم ما يصل إلى 100 مليار معلمة على الجهاز.
وتتمثل الميزة الرئيسية في تكوين مجموعة: إذ تتشارك وحدتان، موصولتان بكابل QSFP عبر بطاقتي الشبكة ConnectX-7، ذاكرتهما.
| المواصفة التقنية | جهاز DGX Spark 64 Go واحد | جهازا DGX Spark 64 Go ضمن مجموعة |
|---|---|---|
| الذاكرة الموحدة | 64 Go | 128 Go مشتركة |
| حجم النموذج المعلن | حتى 100 مليار معلمة | حتى 200 مليار معلمة |
| الأداء على Qwen 3.8 27B (اختبار NVIDIA) | المرجع | حتى 1,7 مرة |
ويتولى تطبيق NVIDIA Sync ذلك باستخدام Cluster Assistant، الذي يكتشف الوحدات ويضبط الشبكة. وسيعمل NVIDIA Sync Model Launcher، المعلن عنه لنهاية الشهر، على تنزيل Qwen3.8 27B وتشغيله على جهاز أو مجموعة، وتهيئة OpenCode لاستخدامه.
🔗 منشور NVIDIA عن DGX Spark 64 Go
DeepSeek تنقل DeepGEMM وDeepEP إلى وحدات NPU من سلسلة Ascend 950 التابعة لـHuawei
29 و30 سبتمبر — نشرت DeepSeek على GitHub، دون إعلان، نسختين من مكتباتها للحوسبة للعمل على وحدات NPU من سلسلة Ascend التابعة لـHuawei. وتحافظ DeepGEMM-Ascend، التي يحدد README تاريخ إصدارها الأول في 30 سبتمبر، على API الخاصة بـDeepGEMM دون تغيير: عمليات ضرب المصفوفات بصيغ BF16 وFP8 وFP4، وقيم logits لكلٍّ من MQA وMegaMoE، بموجب ترخيص MIT، لسلسلة Ascend 950. وتنقل DeepEP-Ascend مكتبة الاتصالات الخاصة بتوازي الخبراء (expert parallelism) في نماذج MoE، مع عمليات all-to-all للتوزيع (dispatch) وإعادة الدمج (combine).
على Ascend 950DT، تقيس DeepEP-Ascend معدل توزيع بين 373 و375 Go/s مع 8 رتب، وبين 313 و320 Go/s مع 128 رتبة؛ وحتى 32 رتبة، تصل إلى نحو 90 إلى 95 % من الحد الفيزيائي لعرض النطاق. وقد حُصل على هذه الأرقام باستخدام عدة عتاد (HDK) لإثبات المفهوم قُدّمت إلى DeepSeek، وتهيئة يدوية، ولم يُتح توفير أيٍّ منهما علنًا؛ ويحيل README إلى النسخة التجارية، التي تتوقع Huawei إتاحتها نحو 15 أكتوبر.
🔗 DeepGEMM-Ascend على GitHub · DeepEP-Ascend على GitHub
الصوت: Suno Speech في مرحلة تجريبية، وElevenLabs تحصل على شهادة FedRAMP 20x Class A
Suno Speech تولّد صوتًا منطوقًا وموسيقى خلفية في مسار واحد
1 أكتوبر — تتيح Suno ميزة Speech في مرحلة تجريبية، وهي وظيفة تُنشئ صوتًا منطوقًا فوق موسيقى خلفية أصلية، مباشرة داخل Suno: يُدخل المستخدم فكرة أو قصيدة أو نصًا، ثم يصف الصوت والأسلوب الموسيقي المطلوبين. وتقدّم Suno ميزة Speech بوصفها أول نموذج صوتي يولّد الصوت والموسيقى معًا في مسار واحد متماسك. وبعد اختبارها لمدة شهر مع مجموعة صغيرة من المستخدمين، أصبحت الوظيفة متاحة للجميع بعد تحديث التطبيق.
ويذكر المنشور، الذي وقّعه مدير المنتجات جاك برودي، استخدامات شخصية في المقام الأول: تحويل رسائل الأصدقاء إلى قراءات درامية، وإضافة الموسيقى إلى الملاحظات الصوتية، والتأملات، وقصص ما قبل النوم. وتنبه Suno إلى أن النسخة التجريبية لا تزال غير مثالية: فقد تتحول لهجة بريطانية إلى أسترالية، وقد تكون الوقفات الدرامية مبالغًا فيها جدًا. ولم يُحدَّد أي تسعير أو خطة اشتراك أو لغات مدعومة.
ElevenLabs تحصل على شهادة FedRAMP 20x Class A لـElevenAgents وواجهات API الصوتية
1 أكتوبر — تحصل ElevenLabs على شهادة FedRAMP 20x Class A، وهو الإطار الذي تقرر من خلاله الوكالات الفيدرالية الأمريكية ما إذا كان من الآمن استخدام منتج سحابي مع بيانات حكومية. وتشمل الشهادة ElevenAgents وواجهات API الخاصة بـText to Speech وSpeech to Text، بشرط العمل في Zero Retention Mode مع إبقاء البيانات داخل الولايات المتحدة. وتوسّع الشهادة عرض ElevenLabs for Government، وأصبحت الشركة مدرجة الآن في FedRAMP Marketplace. ووفقًا لـFedRAMP، كما نقلت عنه ElevenLabs، يكفي مستوى Class A لمعظم الاستخدامات غير الحساسة لدى الوكالات؛ وتذكر ElevenLabs طلبات الإعانات والتراخيص والضرائب أو تفريغ جلسات الاستماع.
وتدعم ElevenLabs الإعلان بعمليات نشر قائمة في القطاع العام:
| الاستخدام المذكور في القطاع العام | الرقم المعلن من ElevenLabs |
|---|---|
| الخط الوطني لخدمات التوظيف (أوكرانيا) | 25 % تُعالج بواسطة وكلاء محادثة |
| خطوط خدمات الإعانات والتوظيف (التشيك) | حلّ 85 % من نحو 5 000 مكالمة يوميًا |
| مدينة ميدلاند | 7 000 مكالمة فائتة أقل شهريًا (توقّع) |
ChatGPT يتيح Finances لمستخدمي Free وGo في الولايات المتحدة
2 أكتوبر — تتوسع Finances، مساحة ChatGPT المخصصة للشؤون المالية الشخصية، لتشمل خطتي Free وGo في الولايات المتحدة، على الويب وiOS وAndroid. كانت الميزة متاحة بالفعل لمشتركي Plus وPro: فقد أُطلقت في نسخة معاينة لمشتركي Pro وحدهم في مايو، وأضيف إليها في 21 سبتمبر تتبّع درجة الائتمان من Experian لمشتركي Plus وPro. وهي تشمل الآن خطط Free وGo وPlus وPro، مع استمرار اقتصارها على الولايات المتحدة.
لم يتغير المبدأ: يربط المستخدم حساباته المصرفية والاستثمارية عبر Plaid، وتقريره الائتماني عبر Experian، ويمكن استخدام هذين الاتصالين معًا أو كلٍّ منهما على حدة. تجمع صفحة Finances النفقات والفواتير والاشتراكات وصافي الثروة والاستثمارات ودرجة الائتمان. وفي المحادثة، يصنّف ChatGPT النفقات، ويرصد الاشتراكات، ويقارن الشهر بالاتجاهات الحديثة، ولأغراض الضرائب، ينظّم المعلومات ويشير إلى جوانب تستحق المراجعة، مثل الخصومات الضريبية.
🔗 ملاحظات إصدار ChatGPT · Finances في ChatGPT
SpaceXAI تنشر SDK TypeScript الرسمي في إصدار تجريبي
2 أكتوبر — نشرت SpaceXAI، من دون إعلان، أول إصدار عام من SDK TypeScript الرسمي. صدر الإصدار 0.1.0 في الساعة 16:57 بتوقيت UTC، وتبعه في الساعة 18:25 بتوقيت UTC الإصدار 0.2.0، الذي يغيّر اسم فئة العميل من xAI إلى SpaceXAI: تغيير يكسر التوافق ويجعل الكود متوافقًا مع الاسم الجديد للشركة. يغطي SDK بالفعل Responses API، بما يشمل التدفق والضغط والمحادثات متعددة الجولات، وأدوات المنصة المدمجة، مثل البحث على الويب والبحث على X وتنفيذ الكود وخوادم MCP البعيدة، وتوليد الصور والفيديوهات وتحريرها، إلى جانب واجهات API الخاصة بـFiles وBatch وVoice.
| عنصر SDK | التفاصيل المرصودة |
|---|---|
| حزمة npm | @xai-official/sdk |
| الترخيص | Apache-2.0 |
| المتطلبات | Node.js 22.13 أو أحدث، مشروع ESM، دون أي تبعيات وقت التشغيل |
| الحالة | تجريبي، الواجهات غير نهائية قبل الإصدار 1.0 |
يرفض SDK افتراضيًا العمل داخل متصفح أو Worker، لتجنب كشف المفتاح السري على جانب العميل. وبذلك أصبح لدى مطوّري TypeScript نظير لـSDK Python الرسمي، الذي صدر إصداره 1.20.0 في 24 سبتمبر.
🔗 سجل تغييرات SDK TypeScript من SpaceXAI · حزمة @xai-official/sdk على npm
أخبار موجزة
- GPT-6.1 Sol في v0 — في 29 سبتمبر، يوم إصدار النموذج، أتاح v0، مولّد التطبيقات من Vercel، نموذج GPT-6.1 Sol، بعد ساعات قليلة من إتاحة تسجيل الدخول باستخدام اشتراك ChatGPT؛ ولا يورد الإعلان أسعارًا أو قياسات خاصة بـv0. 🔗 المصدر
- لوحة تحكم جديدة للوكلاء في Grok Build — أُعلن عنها في 1 أكتوبر، وتعرض جميع الوكلاء على شاشة واحدة باستخدام
/dashboard، وتشغّل المهام بالتوازي، وتضع كل وكيل في worktree خاص به في git باستخدام Ctrl+W؛ وكان Grok Build قد حصل على أول لوحة تحكم في 15 يونيو. 🔗 المصدر - الإصدار الليلي من Gemini CLI — لا يتضمن الإصدار v0.64.0-nightly الصادر في 2 أكتوبر سوى ثمانية إصلاحات: أصبح Ctrl+C يلغي العمليات الجارية مجددًا، وتُكتب الحالة
~/.gemini/state.jsonبصورة ذرية، مع نسخة احتياطية.bakتُستعاد في حال التلف؛ ولم يتغير الإصداران المستقر والتجريبي. 🔗 المصدر - نماذج أُزيلت من GitHub Copilot — كما أُعلن في 3 سبتمبر، تغادر Gemini 3.5 Flash وGemini 3.6 Flash وKimi K2.7 Code وClaude Opus 4.7 جميع تجارب Copilot؛ وتقترح GitHub استخدام Gemini 3.8 Flash وKimi K3، والآن Claude Opus 5.5 بدلًا من Claude Opus 5. 🔗 المصدر
- اختبار SKILL.md — تقترح Golda Manuel، في تدوينة مجتمعية ومن دون قياسات منشورة، طريقة للتحقق من أن وكلاء البرمجة يجدون المهارة ويحمّلونها ويستفيدون منها: وضعها في الموقع الذي يتوقعه Claude Code أو Codex، وتفعيلها عبر ثلاثة مستويات من الطلبات، والمقارنة مع المهارة ومن دونها باستخدام ثمانية مقاييس. 🔗 المصدر
- Manus تفصّل Video Editor وGame Dev — تتناول تدوينتان بتاريخ 1 أكتوبر ميزات Manus 2.0 بمزيد من التفصيل: يضع Video Editor، ضمن Manus Studio، كل عنصر من عناصر الفيديو على مساره الخاص، مع مونتاج 125 مقطعًا في فيلم مدته 10 دقائق و50 ثانية يتضمن 195 قطعًا، ويضبط Game Dev اللعبة مباشرة؛ ولا ترد أسعار أو مواعيد. 🔗 Video Editor · 🔗 Game Dev
- AutoSynthData من ServiceNow — يولّد فريق CoreAI في ServiceNow مهام تدريب جرى التحقق منها انطلاقًا من إخفاقات نموذج: على EnterpriseOps Gym، يحقق Gemma-4-26B-A4B-it زيادة قدرها 7,2 نقاط في Pass@1 ضمن مجال Hybrid، ويرتفع من 18,77 % إلى 27,18 % في ITSM؛ ولم يُنشر كود أو بيانات. 🔗 المصدر
- POCKET-Darwin-180B — تنشر VIDRAFT نسخة GGUF بدقة 4 بت وبحجم 111 غيغابايت، مقابل 360 غيغابايت، من Darwin-180B-RSI، وهو نموذج MoE يضم 180 مليار معامل: من 18,4 إلى 21 رمزًا في الثانية باستخدام المعالج وحده، و4,17 على حاسوب محمول مزوّد بـRTX 5060 بسعة 8 غيغابايت، و87,65 % على MMLU-Pro مثل النسخة الأصلية، وفقًا للمؤلفين. 🔗 المصدر
- دليل نماذج GPT-6 — تنشر OpenAI دليلًا للشركات الناشئة: GPT-6 Astra لأصعب مهام الاستدلال، وGPT-6.1 Sol للبرمجة المعقدة والبحث واستخدام الحاسوب، وGPT-6 Luna للمهام المحددة على نطاق واسع؛ وتقل كلفة الرموز المخزّنة مؤقتًا بما يصل إلى 95 % بحسب النموذج. 🔗 المصدر
- ChatGPT يمسح عدة صفحات ضوئيًا في ملف PDF واحد باستخدام الكاميرا على iOS — قيد الطرح، 1 أكتوبر.
- Chatham Financial وCodex — بنت الشركة الاستشارية المتخصصة في أسواق رأس المال، باستخدام Codex، تطبيقًا للتحقق من المعاملات: وفقًا للقياسات الأولية، انخفض وقت التحقق من نحو 30 دقيقة إلى أقل من 4؛ وتجمع منصتها Onyx بين GPT-5.6 Sol وTerra وGPT-5.4 وGPT-4.1. 🔗 المصدر
- The Den وChatGPT Work — وفقًا لدراسة حالة نشرتها OpenAI بتاريخ 1 أكتوبر، يوفّر فريق إدارة هذا النادي المخصص للآباء والأمهات في دنفر من 10 إلى 15 ساعة أسبوعيًا باستخدام ChatGPT Work، المتصل بـGmail وSlack وGoogle Drive؛ ويستغرق طلب المنحة ساعتين بدلًا من 3 أيام. 🔗 المصدر
- GPT-6 Astra Ultrafast على Blackwell — أوضحت NVIDIA في 1 أكتوبر أن مستوى Ultrafast من GPT-6 Astra، الذي أطلقته OpenAI في 29 سبتمبر، يعمل على وحدات GPU Blackwell الخاصة بها، بسرعة تصل إلى 8 أضعاف وضع Astra Standard، وأن OpenAI تحسّن برنامج الاستدلال باستخدام نماذجها الخاصة؛ ولا توجد أرقام جديدة. 🔗 المصدر
- RL Rollouts لدى CoreWeave — قُدّمت هذه الخدمة في 30 سبتمبر مع CoreWeave Forge، ونقلت NVIDIA خبرها في 2 أكتوبر. وهي مبنية على NVIDIA Dynamo وتحمّل نقاط التحقق الجديدة أثناء التشغيل، خلال مرحلة تدريب لاحق بالتعزيز؛ وعلى Nemotron 3.5 Lightning، يتحسن زمن إعادة تحميل النموذج بمقدار 15 ضعفًا. 🔗 المصدر
- Eleven v4 في ElevenReader — يصل النموذج الصوتي الأكثر تعبيرًا من ElevenLabs، الذي أُطلق في 28 سبتمبر، إلى تطبيق القراءة الخاص بها: مقالات وكتب إلكترونية وملفات PDF بالصوت المختار، بأكثر من 90 لغة، على iOS وAndroid والويب. 🔗 المصدر
- سجل تغييرات إصدار ألفا من Midjourney — يعود تاريخه إلى 1 أكتوبر، ويضم أساسًا إصلاحات، منها إعدادات المطالبات المحفوظة لكل مجلد ومراجع الأسلوب المجمّعة في شارة واحدة، قبل أدوات تعاونية جديدة أُعلن عن طرحها في الأسبوع التالي. 🔗 المصدر
- Grok 4.7 بنصف السعر في Ramp Router — حتى 6 أكتوبر، تتيح بوابة LLM المسماة Ramp Router نموذج Grok 4.7 بخصم 50 %، وهو عرض نقلته SpaceXAI؛ وتبلغ كلفة النموذج دولارين للإدخال و6 دولارات للإخراج لكل مليون رمز على API الخاصة بـSpaceXAI. 🔗 المصدر
- تعليقات سرية على التنبيهات الأمنية — تتيح GitHub التعليق على تنبيه أمني لمستودع من دون أن يراه مقدّم البلاغ: لا يقرأ هذه التعليقات إلا أصحاب صلاحية الكتابة، وتُسجَّل عمليات الاطلاع عليها؛ وتدخل API REST للتعليقات مرحلة المعاينة العامة. 🔗 المصدر · 🔗 API REST
- API GraphQL لقاعدة GitHub Advisory Database — يحصل الكائن SecurityAdvisory على خمسة حقول، منها معرّف CVE وتاريخ النشر لدى NVD، ويحصل الاستعلام securityAdvisories على عاملَي تصفية، حسب مستوى الخطورة وحالة السحب: لم تعد هناك حاجة للرجوع إلى API REST. 🔗 المصدر
- نهاية صورة macOS 14 في GitHub Actions — أُعلن عنها في 1 أكتوبر، وسيجري سحبها في 2 نوفمبر، تسبق ذلك ثماني فترات توقف مجدولة في أكتوبر، من الساعة 14 حتى منتصف الليل بتوقيت UTC؛ ويجب نقل سير العمل إلى macos-15 أو macos-latest، الذي يشير إلى macos-26. 🔗 المصدر
- نضج الذكاء الاصطناعي في المؤسسات — تنشر Perplexity دليلًا يصف أربع مراحل للنضج، ويلخّص أطر Gartner وDeloitte وGoogle Cloud، ويقترح نموذجًا للتقييم الذاتي؛ ووفقًا لاستطلاع McKinsey لعام 2026 الذي يستشهد به، يرى 80 % من المشاركين تحسنًا في الإنتاجية الشخصية، لكن 37 % فقط يرون مساهمة في EBIT. 🔗 المصدر
ما الذي يعنيه ذلك
يتزايد تقييم الذكاء الاصطناعي المطبّق في العلوم وفق معايير مستقلة عن الجهات التي تعلن عنه. لا تكتفي Meta بسرد النتائج: يذكر كل بحث المقاطع التي صاغها الذكاء الاصطناعي، وتتولى مجموعة ثانية من علماء الرياضيات المراجعة، وتقرّ التدوينة بأن ثلاثًا من المسائل حُلّت أيضًا في جهات أخرى. ويستمد نموذج التنبؤ بالإنفلونزا المصمّم باستخدام الذكاء الاصطناعي من Google قيمته من تقييم أجرته CDC على مدار موسم كامل، بمقارنته مع 38 نموذجًا آخر. وتنشر Ai2 أوزان AstaBrief وبياناته، لكنها تنبّه إلى أن مقارناتها تعود إلى 2025: يمكن التحقق من النموذج المفتوح، بينما يصبح التقييم قديمًا.
تتحول نماذج القرار خلال أيام قليلة إلى فئة قائمة بذاتها. بعد Jev وd1 من Liquid AI وClef من Cloudflare، تتيح Perplexity كلًّا من API تُحسب كلفتها لكل رمز إدخال وأوزان نموذجها؛ ويشغّل llama.cpp هذه النماذج محليًا باستخدام صيغة System One نفسها، وتضيف Replit نموذج Jev إلى تكاملاتها من دون مفتاح API. والفائدة للمطوّر ملموسة: احتمال لكل خيار يُستخرج في مرور واحد، بدلًا من إجابة نصية تحتاج إلى التحليل لاحقًا. وتتطلب المقارنات الحذر: يضع صف «الإجمالي» في بطاقة النموذج pplx-decider-v1-27b أمام Jev، لكن التفاصيل المنشورة تمنح Jev الأفضلية في ستة اختبارات معيارية من أصل أحد عشر.
يتقدم وكلاء البرمجة بوتيرة أسرع من استقلاليتهم الفعلية. عندما يُترك أفضل نموذج وحده أمام مستودع على SWE-sweep، لا يجد ويصلح سوى 4,7 % من الأخطاء البرمجية، بكلفة تتجاوز 7 000 دولار. ويخصّص Claude Code 2.1.288 معظم بنوده البالغ عددها 89 للإصلاحات، ومنها استئناف العمل بعد انتهاء مهلة API وتشديد عدة قواعد للأذونات، ويبرز إضافة تراقب عمل الوكيل الرئيسي. وتتصدى Anthropic للعائق الآخر، وهو المهارات البشرية، بتخصيص 100 مليون دولار لتدريب مهندسين قادرين على إتمام النشر حتى بيئة الإنتاج. أما النماذج المفتوحة، فتكتسب مكانها في الأدوات، مع GLM 5.3 في Cursor وDeepSeek Harness على سطح المكتب.
وأخيرًا، تتنوع أجهزة الحوسبة في ثلاثة اتجاهات. تختبر Google في المدار وحدات TPU قد تستفيد يومًا ما من طاقة شمسية تصل إلى 8 أضعاف المتاحة على الأرض، وتضيف NVIDIA إلى DGX Spark تكوينًا بسعة 64 غيغابايت يمكن ربط وحدتين منه للوصول إلى 200 مليار معامل، وتتيح DeepSeek استخدام مكتباتها منخفضة المستوى، مع API نفسها، على رقائق Ascend من Huawei. ويوسّع كل منها بطريقته نطاق المواقع والأجهزة التي يمكن تشغيل النماذج عليها.
المصادر
- حلّ المسائل البحثية المفتوحة معًا (Meta AI Research)
- سلسلة منشورات @AIatMeta حول الأبحاث الستة
- إتاحة AstaBrief مفتوح المصدر (Ai2)
- تدوينة Google Research حول التنبؤ بالإنفلونزا
- تقرير FluSight 2025-2026 من CDC
- إعلان @perplexitydevs عن Decisions API
- توثيق Decisions API
- pplx-decider-v1-27b على Hugging Face
- الجديد في llama.cpp: نماذج القرار (ggml-org)
- Claude Frontier Academy (Anthropic)
- صفحة برنامج Claude Frontier Academy
- ملاحظات إصدار Claude Code 2.1.288
- إبراز @ClaudeDevs لإضافة You should know
- GLM 5.3 في Cursor، إعلان @cursor_ai
- سجل تغييرات Replit بتاريخ 2 أكتوبر
- نقل @deepseek_ai خبر DeepSeek Harness
- صفحة DeepSeek Harness
- SWE-sweep
- النموذج الأولي من Project Suncatcher في المدار (Google)
- بحث Project Suncatcher في Joule
- نقل @GoogleAI خبر الإطلاق
- DGX Spark بسعة 64 غيغابايت (مدونة NVIDIA)
- DeepGEMM-Ascend على GitHub
- DeepEP-Ascend على GitHub
- تقديم Speech (Suno)
- ElevenLabs تحصل على اعتماد FedRAMP 20x Class A
- ملاحظات إصدار ChatGPT
- Finances في ChatGPT (مركز مساعدة OpenAI)
- سجل تغييرات SDK TypeScript من SpaceXAI
- حزمة @xai-official/sdk على npm
- GPT-6.1 Sol في v0 (@v0)
- لوحة تحكم الوكلاء في Grok Build (@grok)
- الإصدار الليلي v0.64.0 من Gemini CLI بتاريخ 2 أكتوبر
- نماذج GitHub Copilot التي أُوقف دعمها
- هل يساعد ملف SKILL.md الخاص بك وكلاء البرمجة؟
- Video Editor من Manus
- Game Dev من Manus
- AutoSynthData (ServiceNow)
- POCKET-Darwin-180B (VIDRAFT)
- دليل نماذج عائلة GPT-6 (OpenAI)
- Chatham Financial وOpenAI
- The Den وChatGPT Work
- GPT-6 Astra Ultrafast على Blackwell (مدونة NVIDIA)
- تقديم CoreWeave Forge
- Eleven v4 في ElevenReader (@ElevenLabs)
- سجل تغييرات إصدار ألفا من Midjourney بتاريخ 1 أكتوبر
- Grok 4.7 في Ramp Router (@SpaceXAI)
- تعليقات سرية على التنبيهات الأمنية (GitHub)
- API REST لتعليقات التنبيهات الأمنية (GitHub)
- حقول جديدة في API GraphQL للكائن SecurityAdvisory (GitHub)
- سحب صورة macOS 14 من GitHub Actions
- دليل Perplexity حول نضج الذكاء الاصطناعي