# Rekursiivne enesetäiendamine, kapoti all

Published: 2026-09-18

Google DeepMind avaldas "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" — ja selle sees olev kodeerimismudel ei muutu kunagi. Kapoti all: mida see fraas tähendas 60 aastat, mis tegelikult Dream-RSI-s kordub (Pythoni uurimispoliitika, mis "unistab" salvestatud otsingupuude kohal) ja miks 317 agendikutset 550 asemel on soodustus, mitte tõus. Otsus: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/et/video/2026-09-18-self-improving-ai/

## Mida see video hõlmab

- 1965 → 2008: I. J. Goodi "intelligentsuse plahvatus", Yudkowsky seemne-AI – masin, mis kirjutab ümber oma kaalud
- 2025: AlphaEvolve – 48-korrutusega 4×4 maatrikskorrutus, 0,7% Google'i arvutusvõimsusest taastatud, Gemini tuumad 23% kiiremad
- 2026: Dream-RSI – poliitika paraneb, kodeerija, kohtunik ja ümberkirjutaja on kõik külmutatud; viip ütleb "Ära lahenda teaduslikku ülesannet"
- X: "Google just lõi rekursiivse enesetäiendamise" (819 meeldimist) vs HN: "selle RSI-ks nimetamine tundub eksitav"
- Kasutatud numbrid: §4.1 Lasso 550 → 317 agendikutset, 3587 → 2931 ms; Tabel 1 ringipakkimine 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× vähem generatsioone, kuni 2.09× kiiremini; Lisa B.2 viip (kõik ülaltoodud PDF-ist)

## Tõlgitud transkriptsioon

Tõlgitud ingliskeelsest originaaljutustusest. Saadaolevat heli ja subtiitreid kontrollib YouTube.

0:00 Rekursiivne enesetäiendamine on idee, et tehisintellekt muudab end targemaks, seejärel kasutab targemat iseennast selleks uuesti, ja sel nädalal avaldas Google artikli nende kahe sõnaga pealkirjas, milles mudeli kaalud ei liigu kunagi. Kolm numbrit. Anthropicu tegevjuht ütleb, et see tsükkel on kestnud alates suvest, mis on tema põhjus kogu tööstuse aeglustamiseks. Säuts, mis teatas, et Google selle just lõi, kogus kaheksasada meeldimist ühe päevaga.

0:24 Ja artikli enda peamine tulemus on 317 mudeli kutset 550 asemel, mis on soodustus, mitte tõus. Kolme minutiga: kust fraas tuli, mis tegelikult Dream-RSI sees kordub, ja kuidas lugeda järgmist artiklit, mille kaanel on RSI. See on The Daily Diff, kapoti all. 1965. I. J. Good, Bletchley Parki statistik, kes töötas Turingi kõrval, kirjutab, et ülimalt intelligentne masin võiks disainida veelgi paremaid masinaid,

0:52 nimetab seda intelligentsuse plahvatuseks ja viimaseks leiutiseks, mida inimene üldse vajab, eeldusel, et masin on piisavalt kuulekas, et öelda meile, kuidas seda kontrollida, mis on see eeldus, mida inimesed pärast koma lugemise lõpetavad. Neljakümne aasta jooksul tähendas see fraas just seda: süsteem, mis muudab oma lähtekoodi või kaalu ja muutub iga läbimisel targemaks. Eliezer Yudkowsky 2008. aasta essee tegi sellest AI ohutuse kandva sõna, ja kellelgi polnud masinat, millel seda testida, mis on ideaalne tingimus definitsiooni jaoks. Siis 2025. aasta mais saatis DeepMind välja AlphaEvolve'i,

1:23 Gemini agendi, mis pakub välja koodi, laseb selle hinnata, hoiab võitjad ja muteerib neid uuesti. See korrutas nelja-nelja kompleksseid maatrikseid 48 sammuga, ületades rekordi, mille Strassen püstitas 1969. aastal, ja see taastab umbes null punkt seitse protsenti Google'i ülemaailmsest arvutusvõimsusest, mis Google'i skaalal on diivani alt leitud andmekeskus. Gemini aitas nüüd treenida Geminit ja fraas liikus vaikselt ohutusblogidest pressiteadetesse. Dream-RSI paigutab selle tsükli peale kontrolleri.

1:52 Poliitika, tegelik Pythoni programm, otsustab, milliseid otsingupuu harusid laiendada, kui palju paralleelselt ja millal alla anda. Gemini kirjutab kandidaatkoodi ja fikseeritud hindaja hindab seda. Iga käivitamine jätab maha puu sellest, mida prooviti ja mida see hindas. Sellest puust saab kordussimulaator: teine, samamoodi külmutatud Gemini kirjutab poliitika ümber ja uut poliitikat testitakse salvestatud tulemuste alusel, mitte reaalsetel GPU-del.

2:16 Artikkel nimetab seda unistamiseks ja üks reaalne käivitus tasub tuhandete unistatud käivituste eest nullilähedaste täitmiskuludega. Võitja läheb tagasi veebi, salvestatud maailmade hulk kasvab, kordub. Ja B.2 lisa viip ütleb ennasttäiendavale AI-le, kirjalikult: muutke ainult seda ühte faili ja ärge lahendage teaduslikku ülesannet. Mõõdetud. Lasso lahendaja ülesandel kulutas fikseeritud uurimine 550 Gemini kutset, et jõuda kolme koma kuue sekundini, Dream-RSI kulutas 317, et jõuda kahe koma üheksani, ja mõlemad edestasid scikit-learni.

2:46 KernelBenchil saavutas see sama tuumakiiruse umbes kahe koma neli korda vähemate generatsioonidega. Ja ringipakkimisel sai see tulemuseks kaks koma kuus kolm viis üheksa kaheksa kolm, mis on täpselt, kuue kümnendkohani, see, mille AlphaEvolve versioon kaks eelmisel aastal saavutas. Nii et X luges pealkirja: Google just lõi rekursiivse enesetäiendamise. Hacker News luges PDF-i: selle RSI-ks nimetamine tundub eksitav. Ja samal nädalal ütles konkurendi tegevjuht, et tsükkel on kestnud alates suvest ja kõik peaksid aeglustama.

3:13 Kolm lauset, samad kaks sõna, kolm erinevat masinat. Niisiis, esmaspäeval, kuidas lugeda järgmist RSI artiklit. Üks: küsige, milline objekt muutub, kas kaalud, kood või otsinguseaded; Dream-RSI muudab kolmandat. Kaks: küsige, kes on külmutatud; siin on see kodeerija, kohtunik ja ümberkirjutaja, kõik kolm. Kolm: küsige, mille ühik on peamine number. Salvestatud arvutus on optimeerimine; võrdlusalus, mida mudel varem ei suutnud saavutada, on tõus, ja seda pole keegi veel avaldanud.

3:40 Otsus, kapoti all: NEEDS REVIEW. Tsükkel on reaalne, säästud on mõõdetud ja kaanel olevad kaks sõna kirjeldavad masinat, mida artiklis ei ole. Kui soovite seda pigem lugeda kui mind kuulda, saab see erinevus teie postkasti igal hommikul, tasuta saidil the daily diff dot dev, link allpool. Öelge mulle kommentaarides, mida järgmiseks avada. Ja see ongi tänane erinevus. Mina olen Niko Axrisist.

4:00 Ühendage vastutustundlikult.

## Allikad

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
