# التحسين الذاتي المتكرر، تحت الغطاء

Published: 2026-09-18

نشرت Google DeepMind ورقة بحثية بعنوان "Dream-RSI: التحسين الذاتي المتكرر من خلال عوالم متطورة" — ولم يتغير نموذج البرمجة داخلها أبدًا. تحت الغطاء: ماذا تعني العبارة منذ 60 عامًا، وما الذي يتكرر بالفعل في Dream-RSI (سياسة استكشاف بايثون "تحلم" عبر أشجار بحث مسجلة)، ولماذا 317 استدعاءً للوكيل بدلاً من 550 يمثل خصمًا، وليس انطلاقًا. الحكم: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/ar/video/2026-09-18-self-improving-ai/

## ما يغطيه هذا الفيديو

- 1965 ← 2008: "انفجار الذكاء" لـ I. J. Good، الذكاء الاصطناعي الأولي ليودكوفسكي — آلة تعيد كتابة أوزانها الخاصة
- 2025: AlphaEvolve — ضرب مصفوفة 4×4 بـ 48 عملية ضرب، استعادة 0.7% من قوة حوسبة Google، نواة Gemini أسرع بنسبة 23%
- 2026: Dream-RSI — تتحسن السياسة، المبرمج والقاضي ومعيد الكتابة جميعهم مجمدون؛ يطلب التوجيه "لا تحل المهمة العلمية"
- X: "جوجل حلت للتو التحسين الذاتي المتكرر" (819 إعجابًا) مقابل HN: "تسمية هذا RSI تبدو مضللة"
- الأرقام المستخدمة: §4.1 Lasso 550 ← 317 استدعاء وكيل، 3587 ← 2931 ميلي ثانية؛ الجدول 1 حزمة الدوائر 2.635983 = AlphaEvolveV2؛ §4.3 KernelBench 2.43× / 1.79× عدد أقل من الأجيال، أسرع حتى 2.09×؛ الملحق ب.2 التوجيه (جميعها من ملف PDF أعلاه)

## النص المترجم

مترجم من السرد الإنجليزي الأصلي. يتم التحكم في الصوت والتعليقات التوضيحية المتاحة بواسطة YouTube.

0:00 التحسين الذاتي المتكرر هو فكرة أن الذكاء الاصطناعي يجعل نفسه أكثر ذكاءً، ثم يستخدم الذات الأكثر ذكاءً للقيام بذلك مرة أخرى، وفي هذا الأسبوع نشرت Google ورقة بحثية تحمل هاتين الكلمتين في العنوان، والتي لا تتغير فيها أوزان النموذج أبدًا. ثلاثة أرقام. يقول الرئيس التنفيذي لشركة Anthropic إن هذه الحلقة تعمل منذ الصيف، وهو سبب إبطائه للصناعة بأكملها. جمعت التغريدة التي أعلنت أن جوجل حلت الأمر للتو ثمانمائة إعجاب في يوم واحد.

0:24 والنتيجة الرئيسية للورقة نفسها هي 317 استدعاء للنموذج بدلاً من 550، وهو خصم، وليس انطلاقًا. في ثلاث دقائق: من أين جاءت العبارة، وما الذي يتكرر بالفعل داخل Dream-RSI، وكيفية قراءة الورقة التالية التي تحمل RSI على الغلاف. هذا هو The Daily Diff، تحت الغطاء. 1965. I. J. جود، إحصائي من Bletchley Park عمل بجوار تورينج، يكتب أن آلة فائقة الذكاء يمكنها تصميم آلات أفضل،

0:52 يسميها انفجارًا للذكاء وآخر اختراع يحتاج الإنسان إلى صنعه على الإطلاق، بشرط أن تكون الآلة مطيعة بما يكفي لتخبرنا كيف نتحكم فيها، وهو ما يتوقف عنه الناس عن القراءة بعد الفاصلة. لمدة أربعين عامًا كانت العبارة تعني ذلك بالضبط: نظام يعدل نفسه المصدر أو الأوزان ويخرج أكثر ذكاءً في كل مرة. مقال إيليزر يودكوفسكي عام 2008 جعله الكلمة الأساسية لسلامة الذكاء الاصطناعي، ولم يكن لدى أحد آلة لاختبارها عليها، وهو الشرط المثالي لـ تعريف. ثم في مايو 2025، أطلقت DeepMind AlphaEvolve،

1:23 وكيل Gemini يقترح رمزًا، يحصل على درجة، يحتفظ بالفائزين ويُطفر مرة أخرى. ضرب مصفوفات معقدة بأربعة في أربعة في 48 خطوة، محطمًا رقمًا قياسيًا سجله ستراسن في عام 1969، ويستعيد حوالي صفر فاصلة سبعة في المائة من قوة حوسبة جوجل العالمية، وهو ما يعادل على نطاق جوجل مركز بيانات وُجد تحت الأريكة. كان Gemini الآن يساعد في تدريب Gemini، وانتقلت العبارة بهدوء من مدونات السلامة إلى البيانات الصحفية. Dream-RSI يربط وحدة تحكم فوق تلك الحلقة.

1:52 سياسة، برنامج بايثون حقيقي، يقرر أي فروع من شجرة البحث توسيعها، وكم عددها بالتوازي، ومتى يجب الاستسلام. يكتب Gemini الكود المرشح، ويقوم مقيّم ثابت بتقييمه. كل تشغيل يترك وراءه شجرة لما تم تجربته وما حصل عليه من نقاط. تصبح تلك الشجرة محاكي إعادة تشغيل: تقوم نسخة ثانية، مجمدة بنفس القدر من Gemini، بإعادة كتابة السياسة، ويتم اختبار السياسة الجديدة مقابل النتائج المسجلة بدلاً من اختبارها على وحدات معالجة الرسوميات الحقيقية.

2:16 تسمي الورقة هذا الحلم، ويدفع تشغيل حقيقي واحد مقابل الآلاف من الأحلام دون تكلفة تنفيذ. يعود الفائز إلى العمل، وتنمو مجموعة العوالم المسجلة، كرر. ويخبر التوجيه في الملحق ب.2 الذكاء الاصطناعي الذي يقوم بالتحسين الذاتي، كتابة: عدّل هذا الملف فقط، ولا تحل المهمة العلمية. تم قياسه. في مهمة Lasso solver، استغرقت الاستكشاف الثابت 550 استدعاءً لـ Gemini للوصول إلى ثلاث فاصلة ست ثوانٍ، استغرق Dream-RSI 317 استدعاءً للوصول إلى اثنتين فاصلة تسع، وكلاهما تفوق على scikit-learn.

2:46 في KernelBench وصلت إلى نفس سرعة النواة بحوالي اثنتين فاصلة أربع مرات أقل من الأجيال. وفي حزمة الدوائر سجلت اثنتين فاصلة ستة ثلاثة خمسة تسعة ثمانية ثلاثة، وهو بالضبط، لستة منازل عشرية، ما سجلته AlphaEvolve الإصدار الثاني في العام الماضي. لذا قرأت X العنوان: جوجل حلت للتو التحسين الذاتي المتكرر. قرأت Hacker News ملف PDF: تسمية هذا RSI تبدو مضللة. وفي نفس الأسبوع قال الرئيس التنفيذي لشركة منافسة إن الحلقة كانت تعمل منذ الصيف ويجب على الجميع أن يتباطأوا.

3:13 ثلاث جمل، نفس الكلمتين، ثلاث آلات مختلفة. لذا، يوم الاثنين، كيف نقرأ ورقة RSI التالية. أولاً: اسأل ما هو الكائن الذي يتغير، الأوزان، الكود، أو إعدادات البحث؛ Dream-RSI يغير الثالث. ثانيًا: اسأل من هو المجمد؛ هنا هو المبرمج، والقاضي، ومعيد الكتابة، كل الثلاثة. ثالثًا: اسأل ما هي وحدة الرقم الرئيسي. الحوسبة المحفوظة هي تحسين؛ معيار لم يتمكن النموذج من الوصول إليه من قبل هو الانطلاق، ولم ينشر أحد ذلك بعد.

3:40 الحكم، تحت الغطاء: يحتاج إلى مراجعة. الحلقة حقيقية، والوفورات مقاسة، والكلمتان على الغلاف تصف آلة غير موجودة في الورقة. إذا كنت تفضل قراءة هذا بدلاً من سماعي أقوله، فإن التحديث يصل إلى صندوق بريدك كل صباح، مجانًا على daily diff dot dev، الرابط أدناه. أخبرني ماذا أفتح بعد ذلك في التعليقات. وهذا هو الاختلاف لهذا اليوم. أنا نيكو من Axrisi.

4:00 ادمج بمسؤولية.

## المصادر

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
