# Ռեկուրսիվ ինքնակատարելագործում, ներսից

Published: 2026-09-18

Google DeepMind-ը հրապարակել է «Dream-RSI: Ռեկուրսիվ ինքնակատարելագործում զարգացող աշխարհների միջոցով» աշխատությունը, և դրա ներսում կոդավորող մոդելը երբեք չի փոխվում։ Ներսից. ինչ է նշանակել արտահայտությունը 60 տարի, ինչն է իրականում շրջանաձև կրկնվում Dream-RSI-ում (Python-ի հետազոտական քաղաքականություն, որը «երազում է» ձայնագրված որոնման ծառերի վրա), և ինչու է 317 գործակալի կանչը 550-ի փոխարեն զեղչ, ոչ թե թռիչք։ Դատավճիռ՝ NEEDS REVIEW։

Canonical: https://thedailydiff.dev/hy/video/2026-09-18-self-improving-ai/

## Ինչ է ընդգրկում այս տեսանյութը

- 1965 → 2008: Ի. Ջ. Գուդի «ինտելեկտի պայթյունը», Յուդկովսկու սերմնային AI – մեքենա, որը վերաշարադրում է իր սեփական կշիռները
- 2025: AlphaEvolve – 48 բազմապատկման 4×4 մատրիցային բազմապատկում, Google-ի հաշվարկների 0.7% վերականգնված, Gemini միջուկները 23% ավելի արագ
- 2026: Dream-RSI – քաղաքականությունը բարելավվում է, կոդավորողը, դատավորը և վերաշարադրողը բոլորը սառեցված են; հուշումն ասում է «Մի լուծեք գիտական խնդիրը»
- X: «Google-ը հենց նոր ճեղքեց ռեկուրսիվ ինքնակատարելագործումը» (819 հավանում) ընդդեմ HN: «սա RSI անվանելը թյուրիմացության տեղիք է տալիս»
- Օգտագործված թվեր՝ §4.1 Lasso 550 → 317 գործակալի կանչեր, 3587 → 2931 մվ; Աղյուսակ 1 շրջանների փաթեթավորում 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× ավելի քիչ սերունդներ, մինչև 2.09× ավելի արագ; Հավելված B.2 հուշում (բոլորը վերոհիշյալ PDF-ից)

## Թարգմանված արձանագրություն

Թարգմանվել է բնօրինակ անգլերեն պատմությունից։ Հասանելի աուդիո և ենթագրերը վերահսկվում են YouTube-ի կողմից։

0:00 Ռեկուրսիվ ինքնակատարելագործումը այն գաղափարն է, որ AI-ն իրեն ավելի խելացի է դարձնում, այնուհետև օգտագործում է ավելի խելացի ինքնությունը դա նորից անելու համար, և այս շաբաթ Google-ը հրապարակել է աշխատություն՝ այդ երկու բառերով վերնագրում, որում մոդելի կշիռները երբեք չեն շարժվում։ Երեք թիվ։ Anthropic-ի գործադիր տնօրենն ասում է, որ այս օղակը գործում է ամառվանից, ինչը նրա պատճառն է՝ դանդաղեցնելու ամբողջ արդյունաբերությունը։ Google-ի կողմից դրա հայտարարության մասին թվիթը հավաքել է ութ հարյուր հավանում մեկ օրում։

0:24 Եվ աշխատության սեփական գլխավոր արդյունքը 317 մոդելի կանչերն են՝ 550-ի փոխարեն, ինչը զեղչ է, ոչ թե թռիչք։ Երեք րոպեում՝ որտեղից է առաջացել արտահայտությունը, ինչն է իրականում շրջանաձև կրկնվում Dream-RSI-ի ներսում, և ինչպես կարդալ հաջորդ աշխատությունը՝ RSI-ով շապիկի վրա։ Սա The Daily Diff-ն է, ներսից։ 1965 թ. Ի. Ջ. Գուդը, Բլեչլի Պարկի վիճակագիրը, ով աշխատում էր Թյուրինգի կողքին, գրում է, որ գերխելացի մեքենան կարող է նախագծել նույնիսկ ավելի լավ մեքենաներ,

0:52 դա անվանում է ինտելեկտի պայթյուն և վերջին գյուտը, որը մարդուն երբևէ պետք կլինի, պայմանով, որ մեքենան բավականաչափ հնազանդ լինի՝ մեզ ասելու, թե ինչպես վերահսկել այն, ինչը այն «պայմանով, որ»-ն է, որը մարդիկ դադարում են կարդալ ստորակետից հետո։ Քառասուն տարի արտահայտությունը նշանակում էր հենց դա՝ համակարգ, որը խմբագրում է իր սեփականը աղբյուրը կամ կշիռները և յուրաքանչյուր անցումից հետո ավելի խելացի է դուրս գալիս։ Էլիեզեր Յուդկովսկու 2008 թվականի էսսեն այն դարձրեց AI-ի բեռ կրող բառը անվտանգության համար, և ոչ ոք մեքենա չուներ դրա վրա փորձարկելու համար, ինչը իդեալական պայման է սահմանման համար։ Այնուհետև 2025 թվականի մայիսին DeepMind-ը թողարկեց AlphaEvolve,

1:23 Gemini գործակալ, որն առաջարկում է կոդ, ստանում է գնահատական, պահպանում է հաղթողներին և մուտացնում նրանց նորից։ Այն բազմապատկել է չորսը չորսի վրա բարդ մատրիցներ 48 քայլով, գերազանցելով 1969 թվականին Ստրասենի սահմանած ռեկորդը, և այն վերականգնում է Google-ի համաշխարհային հաշվարկների մոտ զրո ամբողջ յոթ տոկոսը, ինչը Google-ի մասշտաբով բազմոցի տակ գտնված տվյալների կենտրոն է։ Gemini-ն այժմ օգնում էր մարզել Gemini-ին, և արտահայտությունը հանգիստ տեղափոխվեց անվտանգության բլոգերից մամուլի հաղորդագրություններ։ Dream-RSI-ը կարգավորիչ է ամրացնում այդ օղակի վրա։

1:52 Քաղաքականություն, իրական Python ծրագիր, որոշում է, որ որոնման ծառի ճյուղերը ընդլայնել, քանիսը զուգահեռ, և երբ հանձնվել։ Gemini-ն գրում է թեկնածու կոդը, և ֆիքսված գնահատողը գնահատում է այն։ Յուրաքանչյուր գործարկում թողնում է ծառ, թե ինչ է փորձվել և ինչ է գնահատվել։ Այդ ծառը դառնում է վերարտադրման սիմուլյատոր։ Երկրորդ, նույնքան սառեցված Gemini-ն վերաշարադրում է քաղաքականությունը, և նոր քաղաքականությունը փորձարկվում է արձանագրված արդյունքների դեմ՝ իրական GPU-ների փոխարեն։

2:16 Աշխատությունն դա անվանում է երազել, և մեկ իրական գործարկումը վճարում է հազարավոր երազվածների համար զրոյական կատարման ծախսերով։ Հաղթողը նորից անցնում է առցանց, ձայնագրված աշխարհների լողավազանը մեծանում է, կրկնել։ Եվ Հավելված B.2-ի հուշումը ինքնակատարելագործվող AI-ին ասում է, գրավոր՝ խմբագրել միայն այս մեկ ֆայլը, և մի լուծել գիտական խնդիրը։ Չափված։ Lasso լուծողի խնդրի վրա ֆիքսված հետազոտությունը ծախսել է 550 Gemini կանչեր՝ հասնելու համար երեք ամբողջ վեց վայրկյանի, Dream-RSI-ը ծախսել է 317՝ հասնելու երկու ամբողջ ինըի, և երկուսն էլ գերազանցել են scikit-learn-ին։

2:46 KernelBench-ի վրա այն հասել է նույն միջուկի արագությանը մոտ երկու ամբողջ չորս անգամ ավելի քիչ սերունդներով։ Եվ շրջանների փաթեթավորման վրա այն գնահատվել է երկու ամբողջ վեց երեք հինգ ինը ութ երեք, ինչը ճշգրիտ, մինչև վեց տասնորդական, այն է, ինչ AlphaEvolve տարբերակ երկուսը գնահատվել է անցյալ տարի։ Այսպիսով X-ը կարդաց վերնագիրը. Google-ը հենց նոր ճեղքեց ռեկուրսիվ ինքնակատարելագործումը։ Hacker News-ը կարդաց PDF-ը. սա RSI անվանելը թյուրիմացության տեղիք է տալիս։ Եվ նույն շաբաթ մրցակցի գործադիր տնօրենն ասաց, որ օղակը գործում է ամառվանից և բոլորը պետք է դանդաղեն։

3:13 Երեք նախադասություն, նույն երկու բառերը, երեք տարբեր մեքենաներ։ Այսպիսով, երկուշաբթի, ինչպես կարդալ հաջորդ RSI աշխատությունը։ Մեկ. հարցրեք, թե որ օբյեկտն է փոխվում՝ կշիռները, կոդը կամ որոնման կարգավորումները. Dream-RSI-ը փոխում է երրորդը։ Երկու. հարցրեք, թե ով է սառեցված. այստեղ դա կոդավորողն է, դատավորը և վերաշարադրողը, բոլոր երեքը։ Երեք. հարցրեք, թե ինչի միավորն է գլխավոր թիվը։ Խնայված հաշվարկը օպտիմիզացում է. չափանիշը, որին մոդելը նախկինում չէր կարող հասնել, թռիչքն է, և դա դեռ ոչ ոք չի հրապարակել։

3:40 Դատավճիռ, ներսից՝ NEEDS REVIEW։ Օղակը իրական է, խնայողությունները չափված են, և շապիկի վրա գրված երկու բառերը նկարագրում են մեքենա, որը ներկայացված չէ աշխատության մեջ։ Եթե նախընտրում եք սա կարդալ, քան լսել, թե ինչպես եմ ես ասում դա, ապա diff-ը հայտնվում է ձեր մուտքի արկղում ամեն առավոտ, անվճար daily diff dot dev կայքում, հղումը ներքևում։ Մեկնաբանություններում ասեք, թե ինչ բացեմ հաջորդը։ Եվ սա այսօրվա տարբերությունն է։ Ես Նիկոն եմ Axrisi-ից։

4:00 Միավորել պատասխանատվությամբ։

## Աղբյուրներ

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
