# পুনৰাবৃত্তিমূলক স্ব-উন্নতি, আৱৰণৰ তলত

Published: 2026-09-18

Google DeepMind-এ "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" প্ৰকাশ কৰিছে — আৰু ইয়াৰ ভিতৰৰ কোডিং মডেল কেতিয়াও সলনি নহয়। আৱৰণৰ তলত: ৬০ বছৰ ধৰি এই বাক্যশাৰীৰ অৰ্থ কি আছিল, Dream-RSI-ত প্ৰকৃততে কি লুপ হয় (এটা Python অন্বেষণ নীতি যি ৰেকৰ্ড কৰা সন্ধান ট্ৰিৰ ওপৰত "সোঁৱৰণী দেখে"), আৰু কিয় ৫৫০-ৰ পৰিৱৰ্তে ৩১৭ এজেন্ট কল ৰেহাই হয়, উৰণ নহয়। ৰায়: NEEDS REVIEW।

Canonical: https://thedailydiff.dev/as/video/2026-09-18-self-improving-ai/

## এই ভিডিঅ’টোত কি আছে

- ১৯৬৫ → ২০০৮: আই. জে. গুডৰ "বুদ্ধিমত্তা বিস্ফোৰণ", ইউডকোস্কিৰ বীজ এআই — এখন মেচিন যিয়ে নিজৰ ওজন পুনৰ লিখে
- ২০২৫: আলফাইভল্ভ — ৪৮-গুণন ৪×৪ মেট্ৰিক্স গুণন, Google-ৰ ০.৭% গণনা পুনৰুদ্ধাৰ কৰা হৈছে, জেমিনি কাৰ্ণেল ২৩% দ্ৰুততৰ
- ২০২৬: Dream-RSI — নীতি উন্নত হয়, কোডাৰ, বিচাৰক আৰু পুনৰ লিখোঁতা সকলো হিমায়িত; প্ৰম্পটত কোৱা হৈছে "বৈজ্ঞানিক কামটো সমাধান নকৰিবা"
- X: "Google-এ এতিয়াই পুনৰাবৃত্তিমূলক স্ব-উন্নতি ফাট মাৰিছে" (৮১৯ লাইক) বনাম HN: "ইয়াক RSI বোলাটো বিভ্ৰান্তিকৰ যেন লাগে"
- ব্যৱহৃত সংখ্যা: ধাৰা ৪.১ লাচো ৫৫০ → ৩১৭ এজেন্ট কল, ৩৫৮৭ → ২৯৩১ মিছেকেন্ড; তালিকা ১ বৃত্ত পেকিং ২.৬৩৫৯৮৩ = AlphaEvolveV2; ধাৰা ৪.৩ কাৰ্ণেলবেঞ্চ ২.৪৩× / ১.৭৯× কম প্ৰজন্ম, ২.০৯×লৈকে দ্ৰুততৰ; পৰিশিষ্ট বি.২ প্ৰম্পট (ওপৰৰ PDF-ৰ পৰা লোৱা সকলো)

## অনূদিত ট্ৰান্সক্ৰিপ্ট

মূল ইংৰাজী বৰ্ণনাৰ পৰা অনুবাদ কৰা হৈছে। উপলব্ধ অডিঅ’ আৰু কেপচন ইউটিউবে নিয়ন্ত্ৰণ কৰে।

0:00 পুনৰাবৃত্তিমূলক স্ব-উন্নতি হৈছে এই ধাৰণা যে এটা এআইয়ে নিজকে অধিক স্মাৰ্ট কৰে, তাৰ পিছত অধিক স্মাৰ্ট স্বটোক পুনৰ কৰিবলৈ ব্যৱহাৰ কৰে, আৰু এই সপ্তাহত Google-এ এটা কাগজ প্ৰকাশ কৰিলে সেই দুটা শব্দৰে শিৰোনামাত, য'ত মডেলৰ ওজন কেতিয়াও নোহোৱা হয়। তিনিটা সংখ্যা। এন্থ্ৰোপিকৰ চিইঅ'ই কয় যে এই লুপ গ্ৰীষ্মকালৰ পৰা চলি আছে, যিটো সমগ্ৰ উদ্যোগটোক লেহেমীয়া কৰাৰ তেওঁৰ কাৰণ। গুগলে এইমাত্ৰ ইয়াক ফাট মাৰিছে বুলি ঘোষণা কৰা টুইটটোৱে এদিনতে আঠশ লাইক সংগ্ৰহ কৰিলে। এদিনতে।

0:24 আৰু কাগজখনৰ নিজা মূল ফলাফল হৈছে ৫৫০-ৰ সলনি ৩১৭ টা মডেল কল, যিটো ৰেহাই, উৰণ নহয়। তিনি মিনিটত: এই বাক্যশাৰী ক'ৰ পৰা আহিছিল, Dream-RSI-ৰ ভিতৰত প্ৰকৃততে কি লুপ হয়, আৰু RSI ক'ভাৰত থকা পৰৱৰ্তী কাগজখন কেনেকৈ পঢ়িব লাগে। এয়া দ্য ডেইলী ডিফ, আৱৰণৰ তলত। ১৯৬৫। আই. জে. গুড, ব্লেটচলী পাৰ্কৰ এজন পৰিসংখ্যাবিদ যি ট্যুৰিঙৰ কাষত কাম কৰিছিল, লিখিছে যে এখন অতি-বুদ্ধিমান মেচিনে আৰু ভাল মেচিন ডিজাইন কৰিব পাৰে,

0:52 ইয়াক এক বুদ্ধিমত্তা বিস্ফোৰণ আৰু মানুহে কেতিয়াও কৰিব লগা শেষ উদ্ভাৱন বুলি কয়, যদিহে মেচিনটো আমাক নিয়ন্ত্ৰণ কৰিবলৈ কেনেকৈ লাগে তাক ক'বলৈ যথেষ্ট বশৱৰ্তী হয়, যিটো হৈছে কমাৰ পিছত পঢ়া বন্ধ কৰা লোকসকলে "যদিহে" বুলি ধৰি লয়। চল্লিশ বছৰ ধৰি এই বাক্যশাৰীৰ অৰ্থ আছিল ঠিক তেনেকুৱাই: এটা প্ৰণালী যিয়ে নিজৰ উৎস বা ওজন সম্পাদন কৰে আৰু প্ৰতিবাৰেই অধিক স্মাৰ্ট হৈ ওলাই আহে। এলিয়াজৰ ইউডকোস্কিৰ ২০০৮ চনৰ প্ৰবন্ধই ইয়াক এআইৰ বোজা-বহনকাৰী শব্দ কৰি তুলিছিল। নিৰাপত্তা, আৰু কাৰোৰে ইয়াক পৰীক্ষা কৰিবলৈ মেচিন নাছিল, যিটো এক আদৰ্শ পৰিস্থিতি এটা সংজ্ঞাৰ বাবে। তাৰ পিছত মে' ২০২৫-ত ডিপমাইণ্ড-এ আলফাইভল্ভ মুকলি কৰিলে,

1:23 এটা জেমিনি এজেন্ট যিয়ে ক'ড প্ৰস্তাৱ কৰে, ইয়াক নম্বৰ দিয়া হয়, বিজয়ীসকলক ৰাখে আৰু পুনৰ তেওঁলোকক সলনি কৰে। ই ৪৮টা খোজত চাৰি বাই চাৰি জটিল মেট্ৰিক্স গুণন কৰিলে, ১৯৬৯ চনত ষ্ট্ৰাচেন-এ স্থাপন কৰা এটা ৰেকৰ্ড ভংগ কৰিলে, আৰু ই Google-ৰ বিশ্বজুৰি গণনাৰ প্ৰায় শূন্য পইন্ট সাত শতাংশ পুনৰুদ্ধাৰ কৰে, যিটো Google-ৰ স্কেলত ছোফাৰ তলত পোৱা এটা ডেটা চেণ্টাৰ। জেমিনি-এ এতিয়া জেমিনি-ক প্ৰশিক্ষণ দিয়াত সহায় কৰিছিল, আৰু এই বাক্যশাৰী নিৰাপত্তা ব্ল'গৰ পৰা প্ৰেছ ৰিলিজলৈ নীৰৱে স্থানান্তৰিত হৈছিল। Dream-RSI-এ সেই লুপটোৰ ওপৰত এটা নিয়ন্ত্ৰক সংযোজন কৰে।

1:52 এটা নীতি, এটা প্ৰকৃত পাইথন প্ৰগ্ৰাম, সিদ্ধান্ত লয় সন্ধান ট্ৰিৰ কোনবোৰ শাখা প্ৰসাৰিত কৰিব, সমান্তৰালভাৱে কেইটা, আৰু কেতিয়া এৰি দিব। জেমিনি-এ প্ৰাৰ্থী ক'ড লিখে, আৰু এটা স্থিৰ মূল্যায়নকাৰীয়ে ইয়াক নম্বৰ দিয়ে। প্ৰতিটো ৰানে কি চেষ্টা কৰা হৈছিল আৰু ই কি নম্বৰ পাইছিল তাৰ এটা ট্ৰি এৰি দিয়ে। সেই ট্ৰি এটা ৰিপ্লে ছিমুলেটৰ হৈ পৰে: দ্বিতীয়, সমানে হিমায়িত জেমিনি-এ নীতিক পুনৰ লিখে, আৰু নতুন নীতিটো বাস্তৱ GPU-ত পৰিৱৰ্তে ৰেকৰ্ড কৰা ফলাফলৰ বিৰুদ্ধে পৰীক্ষা কৰা হয়। বাস্তৱ GPU-ত পৰিৱৰ্তে।

2:16 কাগজখনে ইয়াক সপোন দেখা বুলি কয়, আৰু এটা বাস্তৱ ৰানে হাজাৰ হাজাৰ সপোন দেখা এটাৰ বাবে শূন্য এক্সিকিউচন খৰচত পৰিশোধ কৰে। বিজয়ীজন পুনৰ অনলাইন হয়, ৰেকৰ্ড কৰা জগতসমূহৰ পুল বৃদ্ধি পায়, পুনৰাবৃত্তি। আৰু পৰিশিষ্ট B.2-ৰ প্ৰম্পটত স্ব-উন্নত এআইক কয়, লিখি: কেৱল এই ফাইলটো সম্পাদন কৰা, আৰু বৈজ্ঞানিক কামটো সমাধান নকৰিবা। মাপ কৰা হৈছে। লাচো চাল্ভাৰ কাৰ্যত, নিৰ্দিষ্ট অন্বেষণে ৫৫০ জেমিনি কল ব্যয় কৰিলে ৩.৬ ছেকেণ্ডত উপনীত হ'বলৈ, Dream-RSI-এ ৩১৭ ব্যয় কৰিলে ২.৯-ত উপনীত হ'বলৈ, আৰু দুয়োটাই scikit-learn-ক হৰুৱালে।

2:46 কাৰ্ণেলবেঞ্চত ই প্ৰায় ২.৪ গুণ কম প্ৰজন্মৰ সৈতে একেটা কাৰ্ণেল গতি লাভ কৰিলে। আৰু বৃত্ত পেকিংত ই ২.৬৩৫৯৮৩ নম্বৰ লাভ কৰিলে, যিটো ঠিক, ছয় দশমিকলৈকে, AlphaEvolve সংস্কৰণ দুয়ে আৰু বৃত্ত পেকিংত ই ২.৬৩৫৯৮৩ নম্বৰ লাভ কৰিলে, যিটো ঠিক, ছয় দশমিকলৈকে, AlphaEvolve সংস্কৰণ দুয়ে যোৱা বছৰ লাভ কৰা নম্বৰ। গতিকে X-এ শিৰোনামা পঢ়িলে: গুগল-এ এতিয়াই পুনৰাবৃত্তিমূলক স্ব-উন্নতি ফাট মাৰিছে। হেকাৰ নিউজে PDF পঢ়িলে: ইয়াক RSI বোলাটো বিভ্ৰান্তিকৰ যেন লাগে। আৰু একে সপ্তাহতে এজন প্ৰতিদ্বন্দ্বীৰ চিইঅ'ই ক'লে যে লুপটো গ্ৰীষ্মকালৰ পৰা চলি আছে আৰু সকলোৱে লেহেমীয়া হ'ব লাগে।

3:13 তিনিটা বাক্য, একেটা দুটা শব্দ, তিনিটা ভিন্ন মেচিন। গতিকে, সোমবাৰে, পৰৱৰ্তী RSI কাগজখন কেনেকৈ পঢ়িব। এক: সুধিব কি বস্তু সলনি হয়, ওজন, ক'ড, নে সন্ধান ছেটিংছ; Dream-RSI-এ তৃতীয়টো সলনি কৰে। দুই: সুধিব কোনে হিমায়িত হয়; ইয়াত ই হৈছে কোডাৰ, বিচাৰক আৰু পুনৰ লিখোঁতা, তিনিওটা। তিনি: সুধিব মূল সংখ্যাটো কি এককৰ। সংৰক্ষিত গণনা হৈছে অপ্টিমাইজেচন; এটা বেঞ্চমাৰ্ক যিটো মডেলে আগতে পাব পৰা নাছিল উৰণ, আৰু কোনেও সেইটো এতিয়ালৈকে প্ৰকাশ কৰা নাই।

3:40 ৰায়, আৱৰণৰ তলত: NEEDS REVIEW। লুপটো বাস্তৱ, সঞ্চয়বোৰ মাপ কৰা হৈছে, আৰু ক'ভাৰত থকা দুটা শব্দই কাগজখনত নথকা এটা মেচিন বৰ্ণনা কৰে। যদি আপুনি মোৰ কথা শুনাৰ পৰিৱৰ্তে এইটো পঢ়িব বিচাৰে, তেন্তে প্ৰতিদিনে পুৱা আপোনাৰ ইনবক্সত diff আহে, daily diff dot dev-ত বিনামূলীয়া, লিংক তলত আছে। কমেন্টত কি খুলিব লাগে মোক কওক। আৰু এয়া আজিৰ diff। মই Axrisi-ৰ Niko।

4:00 দায়িত্বশীলভাৱে একত্ৰিত কৰক।

## উৎসসমূহ

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
