Sjálfbætandi endurtekning, undir yfirborðinu
Google DeepMind gaf út "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" — og kóðunarlíkanið í því breytist aldrei.
Google DeepMind gaf út "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" — og kóðunarlíkanið í því breytist aldrei. Undir yfirborðinu: hvað setningin þýddi í 60 ár, hvað raunverulega lykkjast í Dream-RSI (Python könnunarstefna sem "dreymir" yfir skráðum leitarþáttum), og hvers vegna 317 umboðsmiðlaköll í stað 550 er afsláttur, ekki upphaf. Niðurstaða: NEEDS REVIEW.
Lestu skriflegu útgáfuna (enska) ↗
Það sem þetta myndband fjallar um
- 1965 → 2008: "Greindarsprenging" I. J. Good, fræ-gervigreind Yudkowsky – vél sem endurskrifar eigin vægi
- 2025: AlphaEvolve – 48 margföldunar 4×4 fylkis margföldun, 0,7% af reikniafli Google endurheimt, Gemini kjarnar 23% hraðari
- 2026: Dream-RSI – stefnan batnar, kóðarinn, dómarinn og endurskrifarinn eru allir frystir; skilaboðin segja "Ekki leysa vísindalega verkefnið"
- X: "Google hefur nýlega brotið niður endurtekin sjálfsbætingu" (819 líkar) vs HN: "að kalla þetta RSI virðist villandi"
- Númer notuð: §4.1 Lasso 550 → 317 umboðsmiðlaköll, 3587 → 2931 ms; Tafla 1 hringpakka 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× færri kynslóðir, allt að 2.09× hraðar; Viðauki B.2 skilaboð (allt úr PDF-skjalinu hér að ofan)
Þýtt afrit
Þýtt úr upprunalegri enskri frásögn. Tiltækt hljóð og textar eru stjórnaðir af YouTube.
0:00 Sjálfbætandi endurtekning er hugmyndin um að gervigreind geri sjálfa sig gáfaðri, notar síðan gáfaðra sjálf til að gera það aftur, og í þessari viku gaf Google út grein með þessum tveimur orðum í titlinum, þar sem vægi líkansins hreyfast aldrei. Þrjár tölur. Forstjóri Anthropic segir að þessi lykkja hafi verið í gangi frá því í sumar, sem er ástæða hans til að hægja á allri iðnaðinum. Tístið sem tilkynnti að Google hefði nýlega brotið niður það safnaði átta hundruðum líka á einum degi.
0:24 Og aðalniðurstaða greinarinnar er 317 líkanaköll í stað 550, sem er afsláttur, ekki upphaf. Á þremur mínútum: hvaðan setningin kom, hvað raunverulega lykkjast innan Dream-RSI, og hvernig á að lesa næstu grein með RSI á forsíðunni. Þetta er The Daily Diff, undir yfirborðinu. 1965. I. J. Good, tölfræðingur frá Bletchley Park sem vann við hlið Turing, skrifar að ofurgáfað vél gæti hannað enn betri vélar,
0:52 kallar það greindarsprengingu og síðustu uppfinningu sem maðurinn þarf nokkurn tíma að gera, að því gefnu að vélin sé nægilega auðmjúk til að segja okkur hvernig á að stjórna henni, sem er skilyrðið sem fólk hættir að lesa eftir kommu. Í fjörutíu ár þýddi setningin nákvæmlega það: kerfi sem breytir eigin frumkóða eða vægi og verður gáfaðra í hvert skipti. Ritgerð Eliezer Yudkowsky frá 2008 gerði það að burðarorði gervigreindar öryggis, og enginn hafði vél til að prófa það á, sem er kjöraðstæða fyrir skilgreiningu. Síðan í maí 2025 sendi DeepMind frá sér AlphaEvolve,
1:23 Gemini umboðsmiðil sem leggur fram kóða, fær hann metinn, heldur sigurvegarunum og stökkbreytir þeim aftur. Hann margfaldaði fjórum-með-fjórum flókin fylki í 48 skrefum, sló met Strassen sem sett var árið 1969, og hann endurheimtir um það bil núll komma sjö prósent af heildarreikniafli Google á heimsvísu, sem á stærðargráðu Google er gagnamiðstöð fundin undir sófanum. Gemini var nú að hjálpa til við að þjálfa Gemini, og setningin færðist hljóðlega frá öryggis- bloggum yfir í fréttatilkynningar. Dream-RSI festir stjórnandi ofan á þessa lykkju.
1:52 Stefna, raunverulegt Python forrit, ákveður hvaða greinar leitarþáttarins á að stækka, hversu margar samhliða, og hvenær á að gefast upp. Gemini skrifar frambjóðandakóðann og fastur matsaðili metur hann. Hver keyrsla skilur eftir tré af því sem var reynt og hvað það skoraði. Þetta tré verður endurspilunarlíkir: annar, jafn frosinn Gemini endurskrifar stefnuna, og nýja stefnan er prófuð gegn skráðum niðurstöðum í stað á raunverulegum GPUum.
2:16 Greinin kallar þetta að dreyma, og ein raunveruleg keyrsla borgar fyrir þúsundir draumakenndra án framkvæmdarkostnaðar. Sigurvegarinn fer aftur á netið, laug skráðra heima vex, endurtekið. Og skilaboðin í viðauka B.2 segja sjálfsbætandi gervigreindinni, skriflega: breyttu aðeins þessari einu skrá, og leystu ekki vísindalega verkefnið. Mælt. Á Lasso lausnarverkefninu eyddi föst könnun 550 Gemini köllum til að ná 3,6 sekúndum, Dream-RSI eyddi 317 til að ná 2,9, og báðir slógu scikit-learn.
2:46 Á KernelBench náði það sama kjarnahraða með um það bil 2,4 sinnum færri kynslóðum. Og á hringpökkun skoraði það 2,6359 83, sem er nákvæmlega, að sex aukastöfum, það sem AlphaEvolve útgáfa tvö skoraði í fyrra. Svo X las titilinn: Google hefur nýlega brotið niður endurtekin sjálfsbætingu. Hacker News las PDF-skjalið: að kalla þetta RSI virðist villandi. Og sömu viku sagði forstjóri keppinautar að lykkjan hefði verið í gangi frá því í sumar og allir ættu að hægja á sér.
3:13 Þrjár setningar, sömu tvö orðin, þrjár mismunandi vélar. Svo, mánudag, hvernig á að lesa næstu RSI grein. Eitt: spyrja hvaða hlutur breytist, vægin, kóðinn, eða leitarstillingarnar; Dream-RSI breytir því þriðja. Tvö: spyrja hver er frosinn; hér er það kóðarinn, dómarinn og endurskrifarinn, allir þrír. Þrjú: spyrja hvað aðaltalan er eining af. Reikniafl sparað er fínstilling; viðmið sem líkanið gat ekki náð áður er upphafið, og enginn hefur birt það ennþá.
3:40 Niðurstaða, undir yfirborðinu: NEEDS REVIEW. Lykkjan er raunveruleg, sparnaðurinn er mældur, og orðin tvö á forsíðunni lýsa vél sem er ekki í greininni. Ef þú vilt frekar lesa þetta en heyra mig segja það, þá lendir munurinn í pósthólfinu þínu á hverjum morgni, ókeypis á the daily diff dot dev, hlekkur hér að neðan. Segðu mér hvað ég á að opna næst í athugasemdunum. Og það er munurinn í dag. Ég er Niko frá Axrisi.
4:00 Sameinaðu á ábyrgan hátt.
Heimildir
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



