# Rekursīva pašpilnveidošanās, zem pārsega

Published: 2026-09-18

Google DeepMind publicēja "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" — un kodēšanas modelis tajā nekad nemainās. Zem pārsega: ko šī frāze nozīmēja 60 gadus, kas patiesībā atkārtojas Dream-RSI (Python izpētes politika, kas "sapņo" par ierakstītajiem meklēšanas kokiem) un kāpēc 317 aģentu izsaukumi, nevis 550, ir atlaide, nevis pacelšanās. Spriedums: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/lv/video/2026-09-18-self-improving-ai/

## Ko aptver šis video

- 1965 → 2008: I. J. Good "inteliģences eksplozija", Yudkowsky sākuma AI — mašīna, kas pārraksta savus svarus
- 2025: AlphaEvolve — 48 reizinājumu 4×4 matricas reizināšana, atgūts 0,7% no Google skaitļošanas jaudas, Gemini kodoli par 23% ātrāk
- 2026: Dream-RSI — politika uzlabojas, kodētājs, vērtētājs un pārrakstītājs ir iesaldēti; uzvedne saka "Nesrisiniet zinātnisko uzdevumu"
- X: "Google tikko uzlauza rekursīvo pašpilnveidošanos" (819 atzīmes Patīk) pret HN: "šo saukt par RSI šķiet maldinoši"
- Izmantotie skaitļi: §4.1 Lasso 550 → 317 aģentu izsaukumi, 3587 → 2931 ms; 1. tabula apļa iepakošana 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× mazāk paaudžu, līdz 2.09× ātrāk; B.2. pielikuma uzvedne (visi no iepriekš minētā PDF)

## Tulkotais transkripts

Tulkojums no oriģinālā angļu stāstījuma. Pieejamais audio un subtitri tiek kontrolēti no YouTube.

0:00 Rekursīvā pašpilnveidošanās ir ideja, ka AI padara sevi gudrāku, pēc tam izmanto gudrāko sevi, lai to izdarītu vēlreiz, un šonedēļ Google publicēja rakstu ar šiem diviem vārdiem nosaukumā, kurā modeļa svari nekad nekustas. Trīs skaitļi. Anthropic izpilddirektors saka, ka šī cilpa darbojas kopš vasaras, kas ir viņa iemesls palēnināt visu nozari. Tvīts, kurā tika paziņots, ka Google to tikko uzlauza, savāca astoņsimt atzīmes Patīk dienā.

0:24 Un raksta galvenais rezultāts ir 317 modeļa izsaukumi, nevis 550, kas ir atlaide, nevis pacelšanās. Trīs minūtēs: no kurienes radās frāze, kas patiesībā atkārtojas iekšpusē Dream-RSI un kā lasīt nākamo rakstu ar RSI uz vāka. Šis ir The Daily Diff, zem pārsega. 1965. gads. I. J. Good, Bletchley Park statistiķis, kurš strādāja blakus Tjūringam, raksta, ka ultra-inteliģenta mašīna varētu projektēt vēl labākas mašīnas,

0:52 to sauc par inteliģences eksploziju un pēdējo izgudrojumu, kas cilvēkam jebkad būs jāveic, ar nosacījumu, ka mašīna ir pietiekami paklausīga, lai pateiktu mums, kā to kontrolēt, kas ir tas 'ar nosacījumu, ka' cilvēki pārtrauc lasīt pēc komata. Četrdesmit gadus šī frāze nozīmēja tieši to: sistēma, kas rediģē savu avotu vai svarus un katrā reizē kļūst gudrāka. Eliezer Yudkowsky 2008. gada eseja padarīja to par AI atslēgas vārdu drošībai, un nevienam nebija mašīnas, uz kuras to testēt, kas ir ideāls nosacījums definīcijai. Tad 2025. gada maijā DeepMind izlaida AlphaEvolve,

1:23 Gemini aģents, kas ierosina kodu, saņem novērtējumu, patur uzvarētājus un mutē tos vēlreiz. Tas reizināja četras reiz četras sarežģītas matricas 48 soļos, pārspējot Strasena rekordu, kas uzstādīts 1969. gadā, un tas atgūst apmēram nulli komats septiņi procenti no Google globālās skaitļošanas jaudas, kas Google mērogā ir datu centrs, kas atrasts zem dīvāna. Gemini tagad palīdzēja apmācīt Gemini, un frāze klusi pārgāja no drošības blogiem preses relīzēs. Dream-RSI piestiprina kontrolieri virs šīs cilpas.

1:52 Politika, faktiskā Python programma, lemj, kuras meklēšanas koka zarus paplašināt, cik daudz paralēli un kad padoties. Gemini raksta kandidātkodu, un fiksēts vērtētājs to novērtē. Katrs skrējiens atstāj aiz sevis koku ar to, kas tika izmēģināts un kāds bija rezultāts. Šis koks kļūst par atkārtošanas simulatoru: otrais, tikpat iesaldētais Gemini pārraksta politiku, un jaunā politika tiek testēta pret ierakstītajiem rezultātiem, nevis uz reāliem GPU.

2:16 Dokuments to sauc par sapņošanu, un viens reāls skrējiens atmaksā tūkstošiem sapņotu skrējienu ar nulles izpildes izmaksām. Uzvarētājs atgriežas tiešsaistē, ierakstīto pasauļu kopa aug, atkārtojiet. Un B.2. pielikuma uzvedne stāsta pašpilnveidojošajai AI, rakstiski: rediģējiet tikai šo vienu failu un neatrisiniet zinātnisko uzdevumu. Izmērīts. Lasso risinātāja uzdevumā fiksētā izpēte iztērēja 550 Gemini izsaukumus, lai sasniegtu trīs komats sešas sekundes, Dream-RSI iztērēja 317, lai sasniegtu divi komats deviņi, un abi pārspēja scikit-learn.

2:46 KernelBench tas sasniedza tādu pašu kodola ātrumu ar apmēram divi komats četras reizes mazāk paaudžu. Un apļu iepakošanā tas ieguva divi komats seši trīs pieci deviņi astoņi trīs, kas ir precīzi, līdz sešām decimāldaļām, tas, ko AlphaEvolve versija divi ieguva pagājušajā gadā. Tātad X lasīja virsrakstu: Google tikko uzlauza rekursīvo pašpilnveidošanos. Hacker News lasīja PDF: šo saukt par RSI šķiet maldinoši. Un tajā pašā nedēļā konkurenta izpilddirektors teica, ka cilpa darbojas kopš vasaras un visiem vajadzētu palēnināties.

3:13 Trīs teikumi, tie paši divi vārdi, trīs dažādas mašīnas. Tātad, pirmdien, kā lasīt nākamo RSI dokumentu. Viens: jautājiet, kas mainās, svari, kods vai meklēšanas iestatījumi; Dream-RSI maina trešo. Divi: jautājiet, kurš ir iesaldēts; šeit tas ir kodētājs, tiesnesis un pārrakstītājs, visi trīs. Trīs: jautājiet, kāda vienība ir galvenais skaitlis. Ietaupītā skaitļošana ir optimizācija; etalons, ko modelis iepriekš nevarēja sasniegt, ir pacelšanās, un to vēl neviens nav publicējis.

3:40 Spriedums, zem pārsega: NEEDS REVIEW. Cilpa ir reāla, ietaupījumi ir izmērīti, un divi vārdi uz vāka apraksta mašīnu, kas nav dokumentā. Ja vēlaties to lasīt, nevis dzirdēt, kā es to saku, The Daily Diff katru rītu nonāk jūsu iesūtnē bez maksas vietnē thedailydiff.dev, saite zemāk. Pastāstiet man, ko atvērt nākamajā komentāros. Un tas ir šodienas The Daily Diff. Esmu Niko no Axrisi.

4:00 Apvienojiet atbildīgi.

## Avoti

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
