بحث

بوريس تشيرني لم يعد يكتب الشيفرة يدويًا منذ نوفمبر 2025، وGemini 3.7 Flash يصل إلى Google Search، وGemma يتجاوز مليار تنزيل

مقال من إنشاء الذكاء الاصطناعي
بوريس تشيرني لم يعد يكتب الشيفرة يدويًا منذ نوفمبر 2025، وGemini 3.7 Flash يصل إلى Google Search، وGemma يتجاوز مليار تنزيل

ai-powered-markdown-translator

مقالة مترجمة من الفرنسية إلى العربية باستخدام gpt-5.4-mini.

عرض المشروع على GitHub ↗

في 23 أغسطس، يتحدث اليوم أقل عن قدرات جديدة وأكثر عن الاستخدام الحقيقي. يشرح بوريس تشيرني، مبتكر Claude Code، أنه لم يعد يكتب الشيفرة يدويًا منذ نوفمبر 2025 ويضع Claude على ثلاثة مستويات من القدرة؛ كما يعترف في السياق نفسه بأن إفراط Opus في الإطناب أولوية تصحيح بالنسبة إلى Anthropic. لدى Google، يصبح Gemini 3.7 Flash، الذي صدر في 13 أغسطس، أسرع نموذج Gemini اعتمادًا ويدخل Google Search، بينما تتجاوز عائلة Gemma المفتوحة مليار تنزيل. وتمنح Amp أسماء نطاقات مقروءة للتطبيقات المستضافة على orbs الخاصة بها، وينشر benchmark مفتوح للتنبؤ بخصائص الأدوية أرضية الضجيج إلى جانب كل نتيجة.


بوريس تشيرني يضع Claude على ثلاثة مستويات ولم يعد يكتب الشيفرة يدويًا منذ نوفمبر 2025

23 أغسطس — يفكك مبتكر Claude Code تقدم النماذج إلى ثلاثة مستويات: أن يكتب الشيفرة أفضل منه؛ أن يؤدي أفضل منه أعمال الهندسة المحيطة بالشيفرة، من التصحيح إلى تصميم النظام؛ ثم أن يتفوق على معظم الناس في معظم المهام الممكن تنفيذها على الحاسوب. ويضع Claude في المستوى الأول وفي جزء من المستوى الثاني، ويشير إلى Opus 4.8 بوصفه أول نموذج شعر أنه أفضل منه. والتوضيح الذي يضيفه هو أن Anders Hejlsberg، مصمم TypeScript، قد يرى أن المستوى الأول لم يُتجاوز بعد.

Back in Nov 2025 I fully stopped writing code by hand, though I continue to code (using agents) every day. […] But engineering is more than coding.

🇸🇦 في نوفمبر 2025، توقفتُ تمامًا عن كتابة الشيفرة يدويًا، مع أنني واصلت البرمجة (باستخدام الوكلاء) كل يوم. […] لكن الهندسة أوسع من مجرد البرمجة.@bcherny على X


تعترف Anthropic بإطناب Opus بوصفه أولوية وتقدم حلاً مؤقتًا

23 أغسطس — عند سؤاله عن عيوب Opus، يرد بوريس تشيرني باعتراف علني مباشر: الإطناب مشكلة معروفة، وهي أولوية للفريق. وفي الانتظار، يفعّل الأمر claude /config outputStyle=concise نمط Concise الذي أُعلن عنه في 20 أغسطس. وهذه هي المعلومة الحقيقية: Concise ليس خيار راحة، بل الرد المؤقت على سلوك يسعى الفريق إلى إصلاحه من الأصل.

ويحتوي الحوار نفسه على نصيحة استخدام صيغت في اليوم السابق، 22 أغسطس: يبدو أن Opus لا يُستغل بما يكفي في التحسين التكراري — استهلاك CPU والذاكرة، زمن CI، الكمون، معدل الإطارات — وفق نمط قابل للتكرار، أي التكرار على X باستخدام ملف مُحلِّل ومجموعة بيانات حتى الوصول إلى Y.

We know Opus is not perfect, and it is a big priority for the team to fix it.

🇸🇦 نعلم أن Opus ليس مثاليًا، وإصلاحه أولوية كبيرة للفريق.@bcherny على X

🔗 Opus والتحسين التكراري


Gemini 3.7 Flash يدخل Google Search بعد تبنٍ قياسي

22 أغسطس — لا يعلن Sundar Pichai عن نموذج جديد: فقد صدر Gemini 3.7 Flash في 13 أغسطس. إنه يعلن عن تبنٍ، وهو الأسرع في عائلة Gemini، وعن نشر: إذ يعمل النموذج الآن داخل Google Search، بالإضافة إلى تطبيق Gemini. وعند الإطلاق، لم يكن متاحًا إلا لمشتركي Pro وUltra عبر Spark، ولـ Gemini Enterprise Agent Platform، ولواجهة API — أما دخوله إلى Search فيغيّر حجم التعرض بشكل كبير.

المعيار المُقَيَّمالنتيجة المُحققةالتكلفة لكل مهمة (USD)
ARC-AGI-195,5 %0,12
ARC-AGI-284,6 %0,25

Gemini 3.7 Flash smashed previous Gemini growth records in its first week, making it our fastest growing model yet.

🇸🇦 حطم Gemini 3.7 Flash الأرقام القياسية السابقة لنمو Gemini منذ أسبوعه الأول، مما يجعله أسرع نماذجنا نموًا حتى الآن.@sundarpichai على X

🔗 نتائج ARC-AGI المنشورة في 20 أغسطس بواسطة ARC Prize


يتجاوز Gemma مليار تنزيل وتنشر Google مستودع Awesome Gemma

20 أغسطس — يعلن Clement Farabet وOlivier Lacombe، من Google DeepMind، أن عائلة النماذج المفتوحة Gemma تجاوزت مليار تنزيل تراكمي، مع أكثر من 100 000 نسخة منشورة من المجتمع خلال عامين. وتوضح عمليات النشر المذكورة مدى الاتساع: تشغّل NASA وSatlyt وStarcloud Gemma على متن الأقمار الصناعية لتحليل الصور المدمجة؛ وفي الهند، دمجت National Health Authority ‏Gemma 4 في Aarogya Setu 2.0 لتوحيد التقارير الطبية. وعلى صعيد البحث، حدّد C2S-Scale، المبني على Gemma من Yale وGoogle، مسارًا علاجيًا مضادًا للسرطان جرى التحقق منه لاحقًا على خلايا حية. وترافق Google هذا الإنجاز بمخرَج للمطورين: مستودع GitHub Awesome Gemma، وهو الدليل الرسمي للمشروعات والدروس التعليمية في هذا النظام البيئي.

المؤشر المقاسالقيمة المعلنة
التنزيلات التراكمية لـ Gemmaأكثر من 1 مليار
النسخ المنشورة من المجتمعأكثر من 100 000
المشروعات المقدمة إلى Gemma Challengeأكثر من 1 600

🔗 منشور Google DeepMind


تمنح Amp أسماء نطاقات مقروءة لـ portals الخاصة بـ orbs

23 أغسطس — orb هي الآلة البعيدة والقابلة للرمي التي تشغّل عليها Amp وكيلاً؛ أما portal فهو بوابة HTTP التي تتيح فتح التطبيق الجاري بناؤه داخل هذا orb في المتصفح. كان كل portal يتلقى عنوانًا مُولّدًا تلقائيًا وغير مقروء، من نوع t-01a0095e-9568-whatever-p1234.onamp.dev — يصلح للمعاينة السريعة، لكنه أقل فائدة كثيرًا كرابط يُرسل إلى فريق. وتحل ثلاثة خيارات محله: بادئة مخصصة، أو نطاق شخصي، أو نطاق مساحة عمل (workspace). وتضرب Amp مثالًا بـ park.mixfox.org، وهو عنوان عادي يخدم تطبيقًا مستضافًا على orb. ويجري الضبط من تبويب Portal أو بطلبه من الوكيل. وتستحق الدوافع المعلنة ذكرًا بقدر ما تستحقها الوظيفة: فـ portals باتت أقل فأقل كمعاينات عابرة وأكثر فأكثر كتطبيقات دائمة. ويبقى هناك حد مؤكد من Quinn Slack: المشاركة لا تعبر حدود مساحة العمل.

🔗 إعلان Amp


ينشر LEADBOARD أرضية الضجيج في benchmarks الخاصة به للتنبؤ بخصائص الأدوية

22 أغسطس — أطلق تجمع FINAL-Bench على Hugging Face benchmark مفتوحًا للتنبؤ بخصائص الأدوية: 21 جدولًا، 7 تخصصات، 212 670 مركبًا للتدريب و18 382 للاختبار. والمقال أقل كونه إطلاقًا وأكثر كونه عرضًا منهجيًا. ففي جدول hERG، يؤدي استبدال التقسيم الزمني بتقسيم عشوائي إلى رفع AUROC من 0,606 إلى 0,818، مع بقاء الجزيئات والبصمات والخوارزمية والفرط-معلمات نفسها: فالسحب العشوائي يوزع السلسلة الكيميائية نفسها على جانبي مجموعة الاختبار. والاستنتاج الثاني يتعلق بجودة الوسوم: تستقر أرضية ضجيج hERG عند 0,421، وعلى الجداول التسعة عشر الخاصة بالانحدار، يحقق التنبؤ بالمتوسط فقط أفضل خطأ مطلق على سبعة منها.

تقسيم بيانات hERGAUROC المُحققةMAE للنموذجMAE للثابت
زمني، قطع في 20220,6060,5990,589
عشوائي، متوسط 5 بذور0,8180,4570,671

🔗 مقال FINAL-Bench على Hugging Face


مختصرات

  • لماذا استغرق بدء الجلسة من الهاتف كل هذا الوقت — في اليوم التالي للإعلان الذي تناولناه أمس، يشرح بوريس تشيرني في 22 أغسطس أن الأمان الافتراضي هو ما حدد الجدول الزمني: الثقة والتحقق من الجهاز، والحماية من إدخال الـ prompt. وستتبع ذلك تحديثات أخرى. 🔗 سلسلة @bcherny
  • GitHub يعيد إبراز فترة التبريد الخاصة بـ Dependabot — الترقيات التي لا تنطوي على مخاطرة أمنية تنتظر ثلاثة أيام، وهو الوقت الذي تحتاجه أدوات الفحص لاكتشاف نسخة مسمومة؛ أما الإصلاحات الأمنية فتبقى فورية. ويمكن ضبط المهلة عبر cooldown. منشور 23 يوليو أُعيد إبرازه في 23 أغسطس. 🔗 تغريدة @github
  • Stable Audio 3.0 في Music Technology Hackathon في مونتريال — هاكاثون لمدة 48 ساعة في 22 و23 أغسطس مع Music Hackspace وMUTEK، حول أدوات لمنتجي الموسيقى. تدافع Stability AI هناك عن الأوزان المفتوحة: الشفافية، والتحكم الفني، وحق إبداء الرأي في استخدام التكنولوجيا. 🔗 فيديو الختام
  • DOOM تعمل على معالج صممه GPT-5.6 Sol — قام النموذج بتجميع معالج RV32IM في لعبة Turing Complete، أُطلق عليه اسم Codex-R32، ويجري عليه تشغيل porting PureDOOM المترجم إلى شيفرة آلة أصلية. عرض أعيد تداوله في 23 أغسطس بواسطة @OpenAIDevs. 🔗 سلسلة @Angaisb_

ما الذي يعنيه هذا

لم يُصدر أي نموذج هذا الأسبوع، وهذا ما يجعل اليوم مقروءًا. ما يتحرك هو نشر النماذج الموجودة، وعدد الأيدي التي تستخدمها، وتصحيح ما يسبب إزعاجًا أثناء الاستخدام. يعمل اللاعبون على التبني، لا على الإعلان.

وعلى مستوى أدوات التطوير، تكمن قيمة شهادة بوريس تشيرني أساسًا في الحد الذي يضعه في الجملة نفسها: فبالنسبة إليه، يبدو أن البرمجة حُلَّت لدى بعض الممارسين، بينما الهندسة لم تُحل، وهو يتعمد الإشارة إلى خبير يرى أن المستوى الأول لم يُبلغ أصلًا. ويتجه الاعتراف بإطناب Opus في الاتجاه نفسه: فالسلوك الافتراضي للنموذج يصبح موضوعًا منتجيًا قائمًا بذاته. إن حلاً مؤقتًا على مستوى الإعداد مثل outputStyle=concise ينقل العبء إلى المستخدم، وهو ما تقر Anthropic به صراحة عندما تصفه بأنه تصحيح مؤقت.

ويأخذ النشر على نطاق واسع ثلاث صور مختلفة هذا الأسبوع. يخرج Gemini 3.7 Flash من نطاق المشتركين والمطورين ليدخل إلى Search، وهو ما يجعل تكلفة 0,25 USD لكل مهمة على ARC-AGI-2 مع نتيجة 84,6 % مقبولة اقتصاديًا. أما Gemma، فيقيس تبنيه بالتنزيلات والنسخ المجتمعية، مع عمليات نشر في المدار والصحة العامة لا تشبه أي حالة استخدام استعراضية. وأخيرًا، تستخلص Amp نتيجة استخدام لم تكن تتوقعه: عندما تتحول المعاينات القابلة للرمي إلى تطبيقات دائمة، فلا بد من منحها عنوانًا ثابتًا.

وتبقى مسألة القياس، وLEADBOARD يصل في التوقيت المناسب. إن فارقًا قدره 0,21 نقطة AUROC تم الحصول عليه دون تغيير سطر واحد في النموذج، أو تنبؤًا ثابتًا يتفوق على النماذج في سبعة جداول انحدار من أصل تسعة عشر: فالنتيجة المنشورة من دون تقسيمها وأرضية الضجيج والمراجع البديهية ليست قابلة للتفسير. وهذا بالضبط ما يمنح أرقام ARC-AGI التي أبرزتها Google في الأسبوع نفسه وزنًا أكبر — قياسات من طرف ثالث، في نمط مُتحقق منه، لا نتائج داخلية.


المصادر