# Sjálfbætandi endurtekning, undir yfirborðinu

Published: 2026-09-18

Google DeepMind gaf út "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" — og kóðunarlíkanið í því breytist aldrei. Undir yfirborðinu: hvað setningin þýddi í 60 ár, hvað raunverulega lykkjast í Dream-RSI (Python könnunarstefna sem "dreymir" yfir skráðum leitarþáttum), og hvers vegna 317 umboðsmiðlaköll í stað 550 er afsláttur, ekki upphaf. Niðurstaða: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/is/video/2026-09-18-self-improving-ai/

## Það sem þetta myndband fjallar um

- 1965 → 2008: "Greindarsprenging" I. J. Good, fræ-gervigreind Yudkowsky – vél sem endurskrifar eigin vægi
- 2025: AlphaEvolve – 48 margföldunar 4×4 fylkis margföldun, 0,7% af reikniafli Google endurheimt, Gemini kjarnar 23% hraðari
- 2026: Dream-RSI – stefnan batnar, kóðarinn, dómarinn og endurskrifarinn eru allir frystir; skilaboðin segja "Ekki leysa vísindalega verkefnið"
- X: "Google hefur nýlega brotið niður endurtekin sjálfsbætingu" (819 líkar) vs HN: "að kalla þetta RSI virðist villandi"
- Númer notuð: §4.1 Lasso 550 → 317 umboðsmiðlaköll, 3587 → 2931 ms; Tafla 1 hringpakka 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× færri kynslóðir, allt að 2.09× hraðar; Viðauki B.2 skilaboð (allt úr PDF-skjalinu hér að ofan)

## Þýtt afrit

Þýtt úr upprunalegri enskri frásögn. Tiltækt hljóð og textar eru stjórnaðir af YouTube.

0:00 Sjálfbætandi endurtekning er hugmyndin um að gervigreind geri sjálfa sig gáfaðri, notar síðan gáfaðra sjálf til að gera það aftur, og í þessari viku gaf Google út grein með þessum tveimur orðum í titlinum, þar sem vægi líkansins hreyfast aldrei. Þrjár tölur. Forstjóri Anthropic segir að þessi lykkja hafi verið í gangi frá því í sumar, sem er ástæða hans til að hægja á allri iðnaðinum. Tístið sem tilkynnti að Google hefði nýlega brotið niður það safnaði átta hundruðum líka á einum degi.

0:24 Og aðalniðurstaða greinarinnar er 317 líkanaköll í stað 550, sem er afsláttur, ekki upphaf. Á þremur mínútum: hvaðan setningin kom, hvað raunverulega lykkjast innan Dream-RSI, og hvernig á að lesa næstu grein með RSI á forsíðunni. Þetta er The Daily Diff, undir yfirborðinu. 1965. I. J. Good, tölfræðingur frá Bletchley Park sem vann við hlið Turing, skrifar að ofurgáfað vél gæti hannað enn betri vélar,

0:52 kallar það greindarsprengingu og síðustu uppfinningu sem maðurinn þarf nokkurn tíma að gera, að því gefnu að vélin sé nægilega auðmjúk til að segja okkur hvernig á að stjórna henni, sem er skilyrðið sem fólk hættir að lesa eftir kommu. Í fjörutíu ár þýddi setningin nákvæmlega það: kerfi sem breytir eigin frumkóða eða vægi og verður gáfaðra í hvert skipti. Ritgerð Eliezer Yudkowsky frá 2008 gerði það að burðarorði gervigreindar öryggis, og enginn hafði vél til að prófa það á, sem er kjöraðstæða fyrir skilgreiningu. Síðan í maí 2025 sendi DeepMind frá sér AlphaEvolve,

1:23 Gemini umboðsmiðil sem leggur fram kóða, fær hann metinn, heldur sigurvegarunum og stökkbreytir þeim aftur. Hann margfaldaði fjórum-með-fjórum flókin fylki í 48 skrefum, sló met Strassen sem sett var árið 1969, og hann endurheimtir um það bil núll komma sjö prósent af heildarreikniafli Google á heimsvísu, sem á stærðargráðu Google er gagnamiðstöð fundin undir sófanum. Gemini var nú að hjálpa til við að þjálfa Gemini, og setningin færðist hljóðlega frá öryggis- bloggum yfir í fréttatilkynningar. Dream-RSI festir stjórnandi ofan á þessa lykkju.

1:52 Stefna, raunverulegt Python forrit, ákveður hvaða greinar leitarþáttarins á að stækka, hversu margar samhliða, og hvenær á að gefast upp. Gemini skrifar frambjóðandakóðann og fastur matsaðili metur hann. Hver keyrsla skilur eftir tré af því sem var reynt og hvað það skoraði. Þetta tré verður endurspilunarlíkir: annar, jafn frosinn Gemini endurskrifar stefnuna, og nýja stefnan er prófuð gegn skráðum niðurstöðum í stað á raunverulegum GPUum.

2:16 Greinin kallar þetta að dreyma, og ein raunveruleg keyrsla borgar fyrir þúsundir draumakenndra án framkvæmdarkostnaðar. Sigurvegarinn fer aftur á netið, laug skráðra heima vex, endurtekið. Og skilaboðin í viðauka B.2 segja sjálfsbætandi gervigreindinni, skriflega: breyttu aðeins þessari einu skrá, og leystu ekki vísindalega verkefnið. Mælt. Á Lasso lausnarverkefninu eyddi föst könnun 550 Gemini köllum til að ná 3,6 sekúndum, Dream-RSI eyddi 317 til að ná 2,9, og báðir slógu scikit-learn.

2:46 Á KernelBench náði það sama kjarnahraða með um það bil 2,4 sinnum færri kynslóðum. Og á hringpökkun skoraði það 2,6359 83, sem er nákvæmlega, að sex aukastöfum, það sem AlphaEvolve útgáfa tvö skoraði í fyrra. Svo X las titilinn: Google hefur nýlega brotið niður endurtekin sjálfsbætingu. Hacker News las PDF-skjalið: að kalla þetta RSI virðist villandi. Og sömu viku sagði forstjóri keppinautar að lykkjan hefði verið í gangi frá því í sumar og allir ættu að hægja á sér.

3:13 Þrjár setningar, sömu tvö orðin, þrjár mismunandi vélar. Svo, mánudag, hvernig á að lesa næstu RSI grein. Eitt: spyrja hvaða hlutur breytist, vægin, kóðinn, eða leitarstillingarnar; Dream-RSI breytir því þriðja. Tvö: spyrja hver er frosinn; hér er það kóðarinn, dómarinn og endurskrifarinn, allir þrír. Þrjú: spyrja hvað aðaltalan er eining af. Reikniafl sparað er fínstilling; viðmið sem líkanið gat ekki náð áður er upphafið, og enginn hefur birt það ennþá.

3:40 Niðurstaða, undir yfirborðinu: NEEDS REVIEW. Lykkjan er raunveruleg, sparnaðurinn er mældur, og orðin tvö á forsíðunni lýsa vél sem er ekki í greininni. Ef þú vilt frekar lesa þetta en heyra mig segja það, þá lendir munurinn í pósthólfinu þínu á hverjum morgni, ókeypis á the daily diff dot dev, hlekkur hér að neðan. Segðu mér hvað ég á að opna næst í athugasemdunum. Og það er munurinn í dag. Ég er Niko frá Axrisi.

4:00 Sameinaðu á ábyrgan hátt.

## Heimildir

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
