Rekurzív önfejlesztés, a motorháztető alatt
A Google DeepMind közzétette a „Dream-RSI: Rekurzív önfejlesztés fejlődő világokon keresztül” című tanulmányt – és a benne lévő kódolási modell sosem változik.
A Google DeepMind közzétette a „Dream-RSI: Rekurzív önfejlesztés fejlődő világokon keresztül” című tanulmányt – és a benne lévő kódolási modell sosem változik. A motorháztető alatt: mit jelentett a kifejezés 60 évig, mi ismétlődik valójában a Dream-RSI-ben (egy Python feltárási irányelv, amely rögzített keresési fákon „álmodik”), és miért jelent kedvezményt, nem pedig felemelkedést a 317 ügynök hívás 550 helyett. Ítélet: NEEDS REVIEW.
Olvassa el az írott kiadást (angolul) ↗
Amit ez a videó tartalmaz
- 1965 → 2008: I. J. Good „intelligenciarobbanása”, Yudkowsky mag-AI-ja – egy gép, amely átírja saját súlyait
- 2025: AlphaEvolve – 48-szoros 4×4-es mátrixszorzás, a Google számítási kapacitásának 0,7%-a visszanyerve, Gemini kernelek 23%-kal gyorsabban
- 2026: Dream-RSI – az irányelv fejlődik, a kódoló, bíró és újraíró mind lefagyott; a prompt azt mondja: „Ne oldd meg a tudományos feladatot”
- X: „A Google most feltörte a rekurzív önfejlesztést” (819 lájk) vs HN: „ezt RSI-nek nevezni félrevezetőnek tűnik”
- Felhasznált számok: §4.1 Lasso 550 → 317 ügynök hívás, 3587 → 2931 ms; 1. táblázat körpakolás 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× kevesebb generáció, akár 2.09× gyorsabb; B.2. függelék prompt (mind a fenti PDF-ből)
Lefordított átirat
Az eredeti angol narrációból fordítva. A rendelkezésre álló hangot és feliratokat a YouTube vezérli.
0:00 A rekurzív önfejlesztés az az elképzelés, hogy egy AI okosabbá teszi önmagát, majd az okosabb énjét használja arra, hogy újra megtegye, és ezen a héten a Google kiadott egy tanulmányt, amelynek címében szerepel ez a két szó, melyben a modell súlyai sosem mozdulnak. Három szám. Az Anthropic vezérigazgatója szerint ez a kör tavaly nyár óta fut, ami az oka annak, hogy lelassítja az egész iparágat. Az a tweet, amely bejelentette, hogy a Google most feltörte, nyolcszáz lájkot gyűjtött egy nap alatt.
0:24 És a tanulmány saját fő eredménye 317 modellhívás 550 helyett, ami kedvezmény, nem pedig fellendülés. Három percben: honnan ered a kifejezés, mi ismétlődik valójában a Dream-RSI-ben, és hogyan olvassuk el a következő, RSI-t a borítón feltüntető tanulmányt. Ez a The Daily Diff, a motorháztető alatt. 1965. I. J. Good, egy Bletchley Park-i statisztikus, aki Turing mellett dolgozott, azt írja, hogy egy ultraintelligens gép még jobb gépeket is tervezhet,
0:52 intelligenciarobbanásnak és az utolsó találmánynak nevezi, amit az ember valaha is létrehozhat, feltéve, hogy a gép elég engedelmes ahhoz, hogy elmondja nekünk, hogyan irányítsuk, ami az a feltétel, amit az emberek a vessző után már nem olvasnak el. Negyven évig a kifejezés pontosan azt jelentette: egy rendszer, amely szerkeszti saját forráskódját vagy súlyait, és minden körben okosabb lesz. Eliezer Yudkowsky 2008-as esszéje tette az AI biztonság teherhordó szavává, és senkinek nem volt gépe, amin tesztelhette volna, ami ideális körülmény egy definícióhoz. Aztán 2025 májusában a DeepMind kiadta az AlphaEvolve-ot,
1:23 egy Gemini ügynököt, amely kódot javasol, azt pontozzák, megtartja a nyerteseket és újra mutálja őket. Négy-négyes komplex mátrixokat szorzott meg 48 lépésben, megdöntve egy 1969-ben Strassen által felállított rekordot, és visszanyeri a Google világméretű számítási kapacitásának körülbelül nulla pont hét százalékát, ami a Google méreténél egy kanapé alatt talált adatközpont. A Gemini most segített a Gemini képzésében, és a kifejezés csendesen átkerült a biztonsági blogokból a sajtóközleményekbe. A Dream-RSI egy vezérlőt csavar erre a hurkára.
1:52 Egy irányelv, egy tényleges Python program dönt el, hogy a keresési fa mely ágait bővítse, mennyit párhuzamosan, és mikor adja fel. A Gemini írja a jelölt kódot, és egy rögzített értékelő pontozza azt. Minden futtatás mögött marad egy fa arról, hogy mit próbáltak ki és mit ért el. Ez a fa egy visszajátszási szimulátorrá válik: egy második, szintén lefagyasztott Gemini újraírja az irányelvet, és az új irányelvet a rögzített eredmények alapján tesztelik, nem pedig valódi GPU-kon.
2:16 A tanulmány ezt álmodásnak nevezi, és egy valódi futtatás ezreket fizet az álmodott futtatásokért, nulla végrehajtási költséggel. A nyertes visszakerül online, a rögzített világok halmaza nő, ismétlés. A B.2. függelékben lévő prompt pedig az önfejlesztő AI-nak mondja, írásban: csak ezt az egy fájlt szerkeszd, és ne oldd meg a tudományos feladatot. Mérve. A Lasso megoldó feladaton a fix feltárás 550 Gemini hívást használt fel, hogy elérje a 3,6 másodpercet, a Dream-RSI 317-et használt fel, hogy elérje a 2,9-et, és mindkettő felülmúlta a scikit-learn-t.
2:46 A KernelBench-en ugyanazt a kernel sebességet érte el körülbelül 2,4-szer kevesebb generációval. A körpakoláson pedig 2,635983-at ért el, ami pontosan, hat tizedesjegyre, annyi, amennyit az AlphaEvolve kettes verziója ért el tavaly. Szóval az X elolvasta a címet: A Google most feltörte a rekurzív önfejlesztést. A Hacker News elolvasta a PDF-et: ezt RSI-nek nevezni félrevezetőnek tűnik. Ugyanezen a héten egy versenytárs vezérigazgatója azt mondta, hogy a ciklus nyár óta fut és mindenkinek lassítania kellene.
3:13 Három mondat, ugyanaz a két szó, három különböző gép. Szóval, hétfőn, hogyan olvassuk el a következő RSI tanulmányt. Egy: kérdezzük meg, mi változik, a súlyok, a kód vagy a keresési beállítások; A Dream-RSI a harmadikat változtatja meg. Kettő: kérdezzük meg, ki van lefagyasztva; itt a kódoló, a bíró és az újraíró, mindhárom. Három: kérdezzük meg, minek az egysége a fő szám. A megtakarított számítás optimalizálás; egy benchmark, amit a modell korábban nem ért el, az a felemelkedés, és azt még senki sem publikálta.
3:40 Ítélet, a motorháztető alatt: NEEDS REVIEW. A ciklus valódi, a megtakarítások mértek, és a borítón lévő két szó egy olyan gépet ír le, ami nincs a tanulmányban. Ha inkább elolvasnád ezt, mint hallanád tőlem, a diff minden reggel megérkezik a beérkező leveleid közé, ingyenesen a the daily diff dot dev oldalon, link alább. Mondd el a hozzászólásokban, mit nyissak ki legközelebb. És ennyi a mai diff. Niko vagyok az Axrisi-től.
4:00 Összevonás felelősen.
Források
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



