# පුනරාවර්තන ස්වයං-වැඩිදියුණු කිරීම, තිරය යටින්

Published: 2026-09-18

Google DeepMind විසින් "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" ප්‍රකාශයට පත් කරන ලදී — එහි කේතීකරණ ආකෘතිය කිසි විටෙකත් වෙනස් නොවේ. තිරය යටින්: එම වාක්‍ය ඛණ්ඩයේ වසර 60ක් තිස්සේ අදහස් වූයේ කුමක්ද, Dream-RSI (වාර්තාගත සෙවුම් වෘක්ෂ හරහා "සිහින දකින" Python ගවේෂණ ප්‍රතිපත්තියක්) තුළ සැබවින්ම පුනරාවර්තනය වන්නේ කුමක්ද, සහ 550 වෙනුවට නියෝජිත ඇමතුම් 317ක් ගුවන්ගතවීමක් නොව වට්ටමක් වන්නේ ඇයි. තීන්දුව: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/si/video/2026-09-18-self-improving-ai/

## මෙම වීඩියෝවෙන් ආවරණය වන දේ

- 1965 → 2008: I. J. Good ගේ "බුද්ධි පිපිරීම", Yudkowsky ගේ seed AI — තමන්ගේම බර නැවත ලියන යන්ත්‍රයක්
- 2025: AlphaEvolve — 48-ගුණිත 4×4 අනුකෘති ගුණ කිරීම, Google ගේ ගණනයෙන් 0.7%ක් නැවත ලබා ගැනීම, Gemini කර්නල් 23%ක් වේගවත්
- 2026: Dream-RSI — ප්‍රතිපත්තිය වැඩිදියුණු වේ, කෝඩරය, විනිසුරුවරයා සහ නැවත ලියන්නා සියල්ලෝම ශීත කර ඇත; විමසුම පවසන්නේ "විද්‍යාත්මක කාර්යය විසඳන්න එපා"
- X: "ගූගල් Recursive Self-Improvement සාර්ථක කර ගත්තා" (ලයික් 819) එදිරිව HN: "මෙය RSI ලෙස හැඳින්වීම නොමඟ යවන සුළුයි"
- භාවිතා කරන ලද සංඛ්‍යා: §4.1 Lasso 550 → 317 නියෝජිත ඇමතුම්, 3587 → 2931 ms; වගුව 1 වෘත්ත ඇසිරීම 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× අඩු පරම්පරා, 2.09× දක්වා වේගවත්; උපග්‍රන්ථය B.2 විමසුම (ඉහත PDF වෙතින් සියල්ල)

## පරිවර්තනය කරන ලද පිටපත

මුල් ඉංග්‍රීසි නිරූපණයෙන් පරිවර්තනය කරන ලදී. පවතින ශ්‍රව්‍ය සහ ශීර්ෂ පාඨ YouTube මගින් පාලනය වේ.

0:00 පුනරාවර්තන ස්වයං-වැඩිදියුණු කිරීම යනු AI එකක් තමන්වම බුද්ධිමත් කරගන්නා අදහසයි, ඉන්පසු එම බුද්ධිමත් ස්වයංභාවය නැවතත් එය කිරීමට භාවිතා කරයි, මේ සතියේ ගූගල් එම වචන දෙකම මාතෘකාවේ ඇති පත්‍රිකාවක් ප්‍රකාශයට පත් කළේය, එහිදී ආකෘතියේ බර කිසි විටෙකත් චලනය නොවේ. අංක තුනක්. Anthropic හි CEO පවසන්නේ මෙම ලූපය ගිම්හානයේ සිට ක්‍රියාත්මක වන බවයි, එය සමස්ත කර්මාන්තයම මන්දගාමී කිරීමට ඔහුගේ හේතුවයි. ගූගල් එය සාර්ථක කර ගත් බව නිවේදනය කරන ට්වීට් එක දිනකින් ලයික් අටසියයක් එකතු කළේය.

0:24 සහ පත්‍රිකාවේම ප්‍රධාන ප්‍රතිඵලය වන්නේ 550 වෙනුවට 317 ආකෘති ඇමතුම්, එය වට්ටමක් මිස ගුවන්ගතවීමක් නොවේ. මිනිත්තු තුනකින්: එම වාක්‍ය ඛණ්ඩය පැමිණියේ කොහෙන්ද, Dream-RSI තුළ සැබවින්ම පුනරාවර්තනය වන්නේ කුමක්ද, සහ RSI ආවරණය සහිත ඊළඟ පත්‍රිකාව කියවන්නේ කෙසේද. මෙය The Daily Diff, තිරය යටින්. 1965. I. J. Good, ටියුරින්ග් අසල සේවය කළ Bletchley Park සංඛ්‍යානඥයෙක්, අති-බුද්ධිමත් යන්ත්‍රයකට ඊටත් වඩා හොඳ යන්ත්‍ර සැලසුම් කළ හැකි බව ලියයි,

0:52 එය බුද්ධි පිපිරීමක් සහ මිනිසා මෙතෙක් කළ යුතු අවසාන සොයාගැනීම ලෙස හඳුන්වයි, යන්ත්‍රය අපට එය පාලනය කරන්නේ කෙසේදැයි පැවසීමට තරම් මෘදු නම්, එය provided-that ජනතාව කොමාවෙන් පසු කියවීම නවත්වයි. වසර හතළිහක් තිස්සේ එම වාක්‍ය ඛණ්ඩය හරියටම එයම අදහස් කළේය: තමන්ගේම මූලාශ්‍රය හෝ බර සංස්කරණය කර සෑම වටයකදීම බුද්ධිමත් වන පද්ධතියක්. Eliezer Yudkowsky ගේ 2008 රචනාව එය AI ආරක්ෂාවේ බර දරන වචනය බවට පත් කළේය, කිසිවෙකුට එය පරීක්ෂා කිරීමට යන්ත්‍රයක් නොතිබුණි, එය අර්ථ දැක්වීමක් සඳහා කදිම තත්ත්වයයි. ඉන්පසු 2025 මැයි මාසයේදී DeepMind විසින් AlphaEvolve නිකුත් කරන ලදී,

1:23 කේතය යෝජනා කරන, ලකුණු ලබා ගන්නා, ජයග්‍රාහකයන් තබා ගන්නා සහ ඒවා නැවත විකෘති කරන Gemini නියෝජිතයෙක්. එය පියවර 48කින් හතරෙන්-හතර සංකීර්ණ මාත්‍රිකා ගුණ කළේය, Strassen 1969 දී පිහිටවූ වාර්තාවක් පරාජය කරමින්, එය Google හි ලොව පුරා ගණනයෙන් ශුන්‍ය දශම හතක් පමණ නැවත ලබා ගනී, එය Google හි පරිමාණයෙන්, සෝෆා යටින් හමු වූ දත්ත මධ්‍යස්ථානයකි. Gemini දැන් Gemini පුහුණු කිරීමට උදව් කරමින් සිටියේය, සහ වාක්‍ය ඛණ්ඩය නිහඬව ආරක්ෂක බ්ලොග් වලින් පුවත්පත් නිවේදන වලට ගමන් කළේය. Dream-RSI එම ලූපය මත පාලකයක් සවි කරයි.

1:52 ප්‍රතිපත්තියක්, සැබෑ Python වැඩසටහනක්, තීරණය කරයි සෙවුම් වෘක්ෂයේ කුමන ශාඛා පුළුල් කළ යුතුද, සමාන්තරව කීයක් සහ කවදා අත්හැරිය යුතුද. Gemini අපේක්ෂක කේතය ලියයි, සහ ස්ථාවර ඇගයීම්කරුවෙක් එයට ලකුණු ලබා දෙයි. සෑම ධාවනයකින්ම උත්සාහ කළ දේ සහ එය ලකුණු කළ දේ පිළිබඳ වෘක්ෂයක් ඉතිරි වේ. එම වෘක්ෂය ප්‍රති-ක්‍රීඩා සිමියුලේටරයක් බවට පත් වේ: දෙවන, ඒ හා සමානව ශීත කළ Gemini ප්‍රතිපත්තිය නැවත ලියයි, සහ නව ප්‍රතිපත්තිය සැබෑ GPUs මත නොව වාර්තාගත ප්‍රතිඵල වලට එරෙහිව පරීක්ෂා කරනු ලැබේ. සහ සැබෑ GPUs මත නොවේ.

2:16 පත්‍රිකාව මෙය සිහින දැකීම ලෙස හඳුන්වයි, එක් සැබෑ ධාවනයක් ක්‍රියාත්මක කිරීමේ පිරිවැය ශුන්‍ය වන සිහින දකින දහස් ගණනක් සඳහා ගෙවයි. ජයග්‍රාහකයා නැවත අන්තර්ජාලයට යයි, වාර්තාගත ලෝක සමූහය වර්ධනය වේ, නැවත කරන්න. සහ උපග්‍රන්ථය B.2 හි විමසුම ස්වයං-වැඩිදියුණු වන AI ට පවසයි, ලිඛිතව: මෙම එක් ගොනුව පමණක් සංස්කරණය කරන්න, සහ විද්‍යාත්මක කාර්යය විසඳන්න එපා. මනිනු ලැබේ. Lasso විසඳීමේ කාර්යයේදී, ස්ථාවර ගවේෂණය Gemini ඇමතුම් 550 ක් වැය කළේය තත්පර තුනයි දශම හයක් වෙත ළඟා වීමට, Dream-RSI 317 ක් වැය කළේය දශම නවයක් වෙත ළඟා වීමට, සහ දෙකම scikit-learn පරාජය කළේය.

2:46 KernelBench මත එය පරම්පරා දෙකයි දශම හතරක් පමණ අඩු පරම්පරා වලින් එකම කර්නල් වේගය කරා ළඟා විය. සහ වෘත්ත ඇසිරීම මත එය දශම හය තුන පහ නවය අට තුනක් ලකුණු කළේය, එය පසුගිය වසරේ AlphaEvolve සංස්කරණය දෙක ලකුණු කළ දේට හරියටම දශම හයකට සමාන වේ. එබැවින් X මාතෘකාව කියෙව්වේය: ගූගල් Recursive Self-Improvement සාර්ථක කර ගත්තා. Hacker News PDF කියෙව්වේය: මෙය RSI ලෙස හැඳින්වීම නොමඟ යවන සුළුයි. සහ එම සතියේම තරඟකරුවෙකුගේ CEO පැවසුවේ ලූපය ගිම්හානයේ සිට ක්‍රියාත්මක වන බව සහ සෑම කෙනෙකුම මන්දගාමී විය යුතු බවයි.

3:13 වාක්‍ය තුනක්, එකම වචන දෙක, විවිධ යන්ත්‍ර තුනක්. එබැවින්, සඳුදා, ඊළඟ RSI පත්‍රිකාව කියවන්නේ කෙසේද. එක: කුමන වස්තුව වෙනස් වේදැයි අසන්න, බර, කේතය, හෝ සෙවුම් සැකසුම්; Dream-RSI තෙවැන්න වෙනස් කරයි. දෙක: කවුරුන් ශීත කර ඇත්දැයි අසන්න; මෙහි එය කෝඩරය, විනිසුරුවරයා සහ නැවත ලියන්නා, තුන් දෙනාම. තුන: ප්‍රධාන අංකය කුමන ඒකකයකින්දැයි අසන්න. ඉතිරි කළ ගණනය ප්‍රශස්තකරණයකි; ආකෘතියට පෙර ළඟා විය නොහැකි මිණුම් ලකුණක් ගුවන්ගතවීමයි, සහ කිසිවෙකු තවමත් එය ප්‍රකාශයට පත් කර නැත.

3:40 තීන්දුව, තිරය යටින්: NEEDS REVIEW. ලූපය සත්‍යයකි, ඉතිරිකිරීම් මනිනු ලැබේ, සහ කවරයේ ඇති වචන දෙක පත්‍රිකාවේ නොමැති යන්ත්‍රයක් විස්තර කරයි. මා කියනවාට වඩා ඔබ මෙය කියවීමට කැමති නම්, සෑම උදෑසනකම diff ඔබගේ එන ලිපි පෙට්ටියට පැමිණේ, daily diff dot dev හි නොමිලේ, පහත සබැඳිය. අදහස් දැක්වීම්වල ඊළඟට කුමක් විවෘත කළ යුතුදැයි මට කියන්න. අදට diff එක එපමණයි. මම Axrisi වෙතින් Niko.

4:00 වගකීමෙන් යුතුව ඒකාබ්‍රහනය කරන්න.

## මූලාශ්‍ර

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
