+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Rekursiivinen itsensä kehittäminen, konepellin alla

Google DeepMind julkaisi ”Dream-RSI: Recursive Self-Improvement through Evolving Worlds” – ja sen sisällä oleva koodausmalli ei koskaan muutu.

Google DeepMind julkaisi ”Dream-RSI: Recursive Self-Improvement through Evolving Worlds” – ja sen sisällä oleva koodausmalli ei koskaan muutu. Konepellin alla: mitä ilmaus on tarkoittanut 60 vuotta, mikä oikeasti toistuu Dream-RSI:ssä (Python-tutkimuskäytäntö, joka "unelmoi" tallennettujen hakupuiden yli), ja miksi 317 agenttikutsua 550:n sijaan on alennus, ei nousu. Tuomio: TARVITSEE TARKASTUKSEN.

Lue kirjoitettu versio (englanniksi) ↗

Mitä tämä video käsittelee

  • 1965 → 2008: I. J. Goodin "älykkyysräjähdys", Yudkowskyn siemen-tekoäly – kone, joka uudelleenkirjoittaa omat painoarvonsa
  • 2025: AlphaEvolve – 48-kertaisesti 4×4-matriisimultiplikaatio, 0,7 % Googlen laskentatehosta palautettu, Gemini-ytimet 23 % nopeampia
  • 2026: Dream-RSI – käytäntö paranee, koodaaja, tuomari ja uudelleenkirjoittaja ovat kaikki jäädytettyjä; kehotus sanoo "Älä ratkaise tieteellistä tehtävää"
  • X: "Google juuri keksi rekursiivisen itsensä kehittämisen" (819 tykkäystä) vs HN: "tämän kutsuminen RSI:ksi tuntuu harhaanjohtavalta"
  • Käytetyt numerot: §4.1 Lasso 550 → 317 agenttikutsua, 3587 → 2931 ms; Taulukko 1 ympyräpakkaus 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× vähemmän sukupolvia, jopa 2.09× nopeammin; Liite B.2 kehotus (kaikki yllä olevasta PDF:stä)

Käännetty transkriptio

Käännetty alkuperäisestä englanninkielisestä selostuksesta. Käytettävissä olevan äänen ja tekstitysten hallinta tapahtuu YouTuben kautta.

0:00 Rekursiivinen itsensä kehittäminen on ajatus, että tekoäly tekee itsestään älykkäämmän, sitten käyttää älykkäämpää itseään tehdäkseen sen uudelleen, ja tällä viikolla Google julkaisi julkaisun, jonka otsikossa on nämä kaksi sanaa, ja jossa mallin painoarvot eivät koskaan liiku. Kolme numeroa. Anthropicin toimitusjohtaja sanoo, että tämä silmukka on ollut käynnissä kesästä lähtien, mikä on hänen syynsä koko teollisuuden hidastamiseen. Twiitti, jossa ilmoitettiin Googlen juuri ratkaisseen sen, keräsi kahdeksansataa tykkäystä päivässä.

0:24 Ja paperin oma otsikkotulos on 317 mallikutsua 550:n sijasta, mikä on alennus, ei nousu. Kolmessa minuutissa: mistä ilmaus tuli, mikä todella toistuu sisällä Dream-RSI:ssä ja miten lukea seuraava paperi, jonka kannessa on RSI. Tämä on The Daily Diff, konepellin alla. 1965. I. J. Good, Bletchley Parkin tilastotieteilijä, joka työskenteli Turingin vieressä, kirjoittaa, että ultraälykäs kone voisi suunnitella vielä parempia koneita,

0:52 kutsuu sitä älykkyysräjähdykseksi ja viimeiseksi keksinnöksi, jonka ihminen koskaan tarvitsee tehdä, edellyttäen, että kone on tarpeeksi nöyrä kertoakseen meille, miten sitä hallitaan, mikä on se 'edellyttäen että', jonka ihmiset lopettavat lukemasta pilkun jälkeen. Neljäkymmentä vuotta lause tarkoitti juuri sitä: järjestelmää, joka muokkaa omaa lähdekoodiaan tai painoarvojaan ja tulee älykkäämmäksi joka kierroksella. Eliezer Yudkowskyn vuoden 2008 essee teki siitä tekoälyn kantavan sanan turvallisuuden osalta, eikä kenelläkään ollut konetta, jolla sitä testata, mikä on ihanteellinen tila määritelmälle. Sitten toukokuussa 2025 DeepMind julkaisi AlphaEvolven,

1:23 Gemini-agentin, joka ehdottaa koodia, saa sen arvioitua, pitää voittajat ja mutatoi ne uudelleen. Se kertoi neljä-kertaa-neljä kompleksimatriiseja 48 vaiheessa, voittaen Strassenin vuonna 1969 asettaman ennätyksen, ja se palauttaa noin nolla pistettä seitsemän prosenttia Googlen maailmanlaajuisesta laskentatehosta, mikä Googlen mittakaavassa on sohvan alta löytynyt datakeskus. Gemini auttoi nyt kouluttamaan Geminiä, ja ilmaus siirtyi hiljaisesti turvallisuusblogeista lehdistötiedotteisiin. Dream-RSI ruuvaa ohjaimen sen silmukan päälle.

1:52 Käytäntö, todellinen Python-ohjelma, päättää mitä hakupuun haaroja laajentaa, kuinka monta rinnakkain, ja milloin luovuttaa. Gemini kirjoittaa ehdokaskoodin, ja kiinteä arvioija arvostelee sen. Jokainen ajo jättää jälkeensä puun siitä, mitä yritettiin ja miten se arvioitiin. Tästä puusta tulee toistosimulaattori: toinen, yhtä jäädytetty Gemini uudelleenkirjoittaa käytännön, ja uusi käytäntö testataan tallennettuja tuloksia vastaan eikä oikeilla GPU:illa.

2:16 Paperi kutsuu tätä unelmoinniksi, ja yksi todellinen ajo maksaa tuhansia unelmoituja ajoja nollalla suorituskustannuksella. Voittaja palaa verkkoon, tallennettujen maailmojen pooli kasvaa, toista. Ja Liite B.2:n kehotus käskee itseään kehittävää tekoälyä, kirjallisesti: muokkaa vain tätä yhtä tiedostoa, äläkä ratkaise tieteellistä tehtävää. Mitattu. Lasso-ratkaisutehtävässä kiinteä tutkimus käytti 550 Gemini-kutsua saavuttaakseen 3,6 sekuntia, Dream-RSI käytti 317 kutsua saavuttaakseen 2,9 sekuntia, ja molemmat voittivat scikit-learnin.

2:46 KernelBenchissä se saavutti saman ytimen nopeuden noin 2,4 kertaa vähemmän sukupolvia. Ja ympyrän pakkauksessa se sai pisteet 2,6359 83, mikä on tarkalleen, kuuden desimaalin tarkkuudella, mitä AlphaEvolve versio kaksi teki viime vuonna. Joten X luki otsikon: Google juuri ratkaisi rekursiivisen itsensä kehittämisen. Hacker News luki PDF:n: tämän kutsuminen RSI:ksi tuntuu harhaanjohtavalta. Ja samalla viikolla kilpailijan toimitusjohtaja sanoi, että silmukka oli ollut käynnissä kesästä lähtien ja kaikkien pitäisi hidastaa.

3:13 Kolme lausetta, samat kaksi sanaa, kolme eri konetta. Joten, maanantaina, miten lukea seuraava RSI-paperi. Yksi: kysy mikä objekti muuttuu, painot, koodi vai hakuasetukset; Dream-RSI muuttaa kolmannen. Kaksi: kysy kuka on jäädytetty; tässä se on koodaaja, tuomari ja uudelleenkirjoittaja, kaikki kolme. Kolme: kysy mitä otsikkonumero on yksikkö. Säästetty laskentateho on optimointia; vertailuarvo, jota malli ei voinut saavuttaa ennen, on nousu, eikä kukaan ole vielä julkaissut sitä.

3:40 Tuomio, konepellin alla: tarvitsee tarkastuksen. Silmukka on todellinen, säästöt on mitattu, ja kaksi sanaa kannessa kuvaavat konetta, joka ei ole paperissa. Jos haluat mieluummin lukea tämän kuin kuulla minun sanovan sen, tiedot ilmestyvät sähköpostiisi joka aamu, ilmaiseksi osoitteessa the daily diff dot dev, linkki alla. Kerro kommenteissa, mitä seuraavaksi avataan. Ja se on päivän tiedote. Olen Niko Axrisista.

4:00 Yhdistä vastuullisesti.

Lähteet

  1. Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
  2. Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
  3. Hacker News thread (169 points)news.ycombinator.com
  4. Hugging Face papers (278 upvotes)huggingface.co
  5. I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
  6. Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
  7. Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
  8. Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
  9. Tweetx.com

Aiheeseen liittyvät videot