+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Kujiboresha kwa kujirudia, chini ya ukurugenzi

Google DeepMind ilichapisha "Dream-RSI: Kujiboresha kwa Kujirudia Kupitia Ulimwengu Unaoendelea" — na mfumo wa usimbaji ndani yake haubadiliki kamwe.

Google DeepMind ilichapisha "Dream-RSI: Kujiboresha kwa Kujirudia Kupitia Ulimwengu Unaoendelea" — na mfumo wa usimbaji ndani yake haubadiliki kamwe. Chini ya ukurugenzi: kile ambacho kifungu hicho kilimaanisha kwa miaka 60, kile kinachojirudia kwa kweli katika Dream-RSI (sera ya ugunduzi ya Python ambayo "huota" juu ya miti ya utafutaji iliyorekodiwa), na kwa nini simu za wakala 317 badala ya 550 ni punguzo, si kuongezeka. Hukumu: INAHITAJI KUPITIWA UPya.

Soma toleo lililoandikwa (Kiingereza) ↗

Nini video hii inashughulikia

  • 1965 → 2008: 'Mlipuko wa akili' wa I. J. Good, AI ya mbegu ya Yudkowsky — mashine inayobadilisha uzito wake yenyewe
  • 2025: AlphaEvolve — kuzidisha matrisi 4×4 mara 48, 0.7% ya kompyuta ya Google imerejeshwa, kerneli za Gemini kwa 23% haraka zaidi
  • 2026: Dream-RSI — sera inaboresha, msimbaji, hakimu na mwandishi upya wote wamegandishwa; kidokezo kinasema "Usitatue kazi ya kisayansi"
  • X: "Google imeweza kujiboresha kwa kujirudia" (likes 819) dhidi ya HN: "kuita hii RSI inaonekana kupotosha"
  • Nambari zilizotumika: §4.1 Lasso 550 → 317 simu za wakala, 3587 → 2931 ms; Jedwali 1 mduara wa kupakia 2.635983 = AlphaEvolveV2; §4.3 KernelBench mara 2.43 / mara 1.79 vizazi vichache, hadi mara 2.09 haraka zaidi; Kiambatisho B.2 kidokezo (yote kutoka PDF hapo juu)

Nakala iliyotafsiriwa

Imetafsiriwa kutoka simulizi asili ya Kiingereza. Sauti na manukuu yanayopatikana yanadhibitiwa na YouTube.

0:00 Kujiboresha kwa kujirudia ni wazo kwamba AI inajifanya kuwa nadhifu, kisha inatumia ubinafsi nadhifu kufanya hivyo tena, na wiki hii Google ilichapisha karatasi yenye maneno hayo mawili kwenye kichwa, ambayo uzito wa mfumo haubadiliki kamwe. Nambari tatu. Mkurugenzi Mtendaji wa Anthropic anasema kitanzi hiki kimekuwa kikiendelea tangu majira ya joto, ambayo ndiyo sababu yake ya kupunguza kasi ya tasnia nzima. Tweet iliyotangaza kwamba Google imeweza ilikusanya likes mia nane kwa siku moja.

0:24 Na matokeo makuu ya karatasi hiyo ni simu 317 za mfumo badala ya 550, ambayo ni punguzo, si kuongezeka. Katika dakika tatu: kifungu hicho kilitoka wapi, kile kinachojirudia kwa kweli ndani ya Dream-RSI, na jinsi ya kusoma karatasi inayofuata yenye RSI kwenye jalada. Hii ni The Daily Diff, chini ya ukurugenzi. 1965. I. J. Good, mtaalam wa takwimu wa Bletchley Park aliyefanya kazi karibu na Turing, anaandika kwamba mashine yenye akili sana inaweza kubuni mashine bora zaidi,

0:52 anaita mlipuko wa akili na uvumbuzi wa mwisho ambao mwanadamu atawahi kuhitaji kuufanya, mradi mashine hiyo ni tulivu vya kutosha kutuambia jinsi ya kuidhibiti, ambayo ndio watu wa 'mradi' huacha kusoma baada ya koma. Kwa miaka arobaini kifungu hicho kilimaanisha hivyo hivyo: mfumo unaobadilisha yake chanzo au uzito na kutoka nje ukiwa nadhifu zaidi kila pasi. Insha ya Eliezer Yudkowsky ya 2008 iliifanya kuwa neno muhimu la usalama wa AI, na hakuna mtu aliyekuwa na mashine ya kuijaribu, ambayo ni hali bora kwa ufafanuzi. Kisha mnamo Mei 2025 DeepMind ilitoa AlphaEvolve,

1:23 wakala wa Gemini anayependekeza msimbo, anapata alama, huweka washindi na kuwaboresha tena. Ilizidisha matrisi tata za nne kwa nne kwa hatua 48, ikivunja rekodi iliyowekwa na Strassen mnamo 1969, na inarejesha takriban sifuri pointi saba asilimia ya kompyuta ya Google duniani kote, ambayo kwa kiwango cha Google ni kituo cha data kinachopatikana chini ya sofa. Gemini sasa ilisaidia kutoa mafunzo kwa Gemini, na kifungu hicho kilihamia kimya kimya kutoka kwa blogu za usalama kwenye matoleo ya habari. Dream-RSI inafunga kidhibiti juu ya kitanzi hicho.

1:52 Sera, mpango halisi wa Python, huamua matawi gani ya mti wa utafutaji kupanua, mangapi kwa sambamba, na lini kukata tamaa. Gemini huandika msimbo unaowezekana, na mkadiriaji maalum huupa alama. Kila mwendeshao huacha nyuma mti wa kile kilichojaribiwa na kile kilichopata alama. Mti huo unakuwa kiigaji cha kurudia: Gemini ya pili, iliyegandishwa vile vile, inaandika upya sera, na sera mpya inajaribiwa dhidi ya matokeo yaliyorekodiwa badala ya kwenye GPU halisi.

2:16 Karatasi inaita hii kuota, na mwendeshao mmoja halisi hulipia maelfu ya zile zilizootwa bila gharama ya utekelezaji. Mshindi hurudi mtandaoni, bwawa la ulimwengu uliorekodiwa hukua, rudia. Na kidokezo katika Kiambatisho B.2 kinaambia AI inayojiboresha, kwa maandishi: hariri faili hii moja tu, na usitatue kazi ya kisayansi. Kupimwa. Kwenye kazi ya Lasso solver, utafutaji maalum ulitumia simu 550 za Gemini kufikia sekunde tatu nukta sita, Dream-RSI ilitumia 317 kufikia mbili nukta tisa, na zote ziliishinda scikit-learn.

2:46 Kwenye KernelBench ilifikia kasi sawa ya kernel na takriban mara mbili nukta nne vizazi vichache. Na kwenye upakiaji wa duara ilipata alama mbili nukta sita tatu tano tisa nane tatu, ambayo ni kwa usahihi, kwa desimali sita, kile ambacho AlphaEvolve toleo la pili ilipata mwaka jana. Hivyo X ilisoma kichwa: Google imeweza kujiboresha kwa kujirudia. Hacker News ilisoma PDF: kuita hii RSI inaonekana kupotosha. Na wiki hiyohiyo Mkurugenzi Mtendaji wa mshindani alisema kitanzi hicho kimekuwa kikiendelea tangu majira ya joto na kila mtu anapaswa kupunguza kasi.

3:13 Sentensi tatu, maneno mawili yale yale, mashine tatu tofauti. Hivyo, Jumatatu, jinsi ya kusoma karatasi inayofuata ya RSI. Moja: uliza ni kitu gani kinachobadilika, uzito, msimbo, au mipangilio ya utafutaji; Dream-RSI inabadilisha ya tatu. Mbili: uliza ni nani amegandishwa; hapa ni msimbaji, hakimu na mwandishi upya, wote watatu. Tatu: uliza nini nambari kuu ni kitengo cha. Kompyuta iliyohifadhiwa ni uboreshaji; kiwango ambacho mfumo haukuweza kufikia hapo awali ni kuongezeka, na hakuna mtu aliyechapisha hicho bado.

3:40 Hukumu, chini ya ukurugenzi: inahitaji kupitiwa upya. Kitanzi ni halisi, akiba zimepimwa, na maneno mawili kwenye jalada yanaelezea mashine ambayo haipo kwenye karatasi. Ikiwa ungependa kusoma hii badala ya kunisikia nikisema, diff inatua kwenye kikasha chako kila asubuhi, bure kwa thedaily diff dot dev, kiungo hapa chini. Niambie nifungue nini kinachofuata kwenye maoni. Na hiyo ndio diff kwa leo. Mimi ni Niko kutoka Axrisi.

4:00 Unganisha kwa uwajibikaji.

Vyanzo

  1. Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
  2. Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
  3. Hacker News thread (169 points)news.ycombinator.com
  4. Hugging Face papers (278 upvotes)huggingface.co
  5. I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
  6. Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
  7. Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
  8. Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
  9. Tweetx.com

Video zinazohusiana