Rekursiv o'z-o'zini takomillashtirish, ichki mexanizm
Google DeepMind "Dream-RSI: Evolving Worlds orqali rekursiv o'z-o'zini takomillashtirish" nomli maqolani chop etdi — va undagi kodlash modeli hech qachon o'zgarmaydi.
Google DeepMind "Dream-RSI: Evolving Worlds orqali rekursiv o'z-o'zini takomillashtirish" nomli maqolani chop etdi — va undagi kodlash modeli hech qachon o'zgarmaydi. Ichki mexanizm: bu ibora 60 yil davomida nimani anglatgan, Dream-RSI'da aslida nima takrorlanadi (yozib olingan qidiruv daraxtlari ustida "tush ko'radigan" Python tadqiqot siyosati) va nima uchun 550 o'rniga 317 agent chaqiruvi chegirma, parvoz emas. Xulosa: NEEDS REVIEW.
Yozma nashrini oʻqing (inglizcha) ↗
Bu video nimani qamrab oladi
- 1965 → 2008: I. J. Goodning "aqliy portlash", Yudkowskining "urug' AI"si — o'z vaznlarini qayta yozadigan mashina
- 2025: AlphaEvolve — 48 martalik ko'paytirish 4x4 matritsa ko'paytmasi, Google hisoblash quvvatining 0,7%i qaytarildi, Gemini kernellari 23% tezroq
- 2026: Dream-RSI — siyosat yaxshilanadi, kodlovchi, baholovchi va qayta yozuvchi barchasi muzlatilgan; buyruq "Ilmiy vazifani hal qilmang" deydi
- X: "Google hozirgina rekursiv o'z-o'zini takomillashtirishni yengdi" (819 layk) vs HN: "buni RSI deb atash chalkash ko'rinadi"
- Ishlatilgan raqamlar: §4.1 Lasso 550 → 317 agent chaqiruvi, 3587 → 2931 ms; 1-jadval doira joylashtirish 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× kamroq avlodlar, 2.09× gacha tezroq; Ilova B.2 buyrug'i (yuqoridagi PDFdan)
Tarjima qilingan transkript
Asl inglizcha hikoyadan tarjima qilingan. Mavjud audio va subtitrlar YouTube tomonidan boshqariladi.
0:00 Rekursiv o'z-o'zini takomillashtirish – bu sun'iy intellekt o'zini aqlliroq qilish g'oyasi, keyin aqlliroq o'zini yana shu ishni qilish uchun ishlatadi va shu hafta Google sarlavhasida shu ikki so'z bo'lgan maqola chop etdi, unda modelning vaznlari hech qachon o'zgarmaydi. Uchta raqam. Anthropic bosh direktori bu sikl yozdan beri davom etayotganini aytdi, bu uning butun sanoatni sekinlashtirish sababidir. Google buni hozirgina yengganini e'lon qilgan tvit sakkiz yuzta layk yig'di bir kunda.
0:24 Va maqolaning o'zida sarlavhadagi natija 550 emas, 317 model chaqiruvi bo'lib, bu chegirma, parvoz emas. Uch daqiqada: bu ibora qayerdan kelgan, Dream-RSI ichida aslida nima takrorlanadi va muqovasida RSI yozilgan keyingi maqolani qanday o'qish kerak. Bu The Daily Diff, ichki mexanizm. 1965. I. J. Good, Bletchley Park statistiki, Tyuring yonida ishlagan, o'ta aqlli mashina yanada yaxshi mashinalarni loyihalashtirishi mumkinligini yozadi,
0:52 buni aql portlashi va inson hech qachon yaratishi kerak bo'lmagan so'nggi ixtiro deb ataydi, agar mashina uni qanday boshqarishni aytish uchun yetarlicha itoatkor bo'lsa, bu esa odamlar verguldan keyin o'qishni to'xtatadigan "agar" shartidir. Qirq yil davomida bu ibora aynan shuni anglatardi: o'zining manbasini yoki vaznlarini tahrirlovchi va har o'tishda aqlliroq bo'lib chiqadigan tizim. Eliezer Yudkowskining 2008 yilgi essesi uni AI xavfsizligining asosiy so'ziga aylantirdi, va hech kimda uni sinash uchun mashina yo'q edi, bu esa ta'rif uchun ideal sharoitdir. Keyin 2025 yil may oyida DeepMind AlphaEvolve'ni chiqardi,
1:23 kodni taklif qiluvchi, uni baholatuvchi, g'oliblarni saqlab qoluvchi va ularni yana o'zgartiruvchi Gemini agenti. U to'rtga to'rt murakkab matritsalarni 48 qadamda ko'paytirdi, Strassening 1969 yilda o'rnatgan rekordini yangiladi va Google'ning butun dunyo bo'ylab hisoblash quvvatining nol nuqta yetti foizini qaytaradi, bu Google miqyosida divan ostidan topilgan ma'lumotlar markazi demakdir. divan ostidan topilgan ma'lumotlar markazi demakdir. Gemini endi Gemini'ni o'rgatishga yordam berayotgan edi va bu ibora jimlik bilan xavfsizlik bloglaridan press-relizlarga o'tdi. Dream-RSI shu siklning ustiga boshqaruvchini o'rnatadi.
1:52 Siyosat, haqiqiy Python dasturi, qidiruv daraxtining qaysi shoxlarini kengaytirishni, qanchasini parallel ravishda va qachon voz kechishni hal qiladi. kengaytirishni, qanchasini parallel ravishda va qachon voz kechishni hal qiladi. Gemini nomzod kodni yozadi va belgilangan baholovchi uni baholaydi. Har bir ishga tushirish nima sinab ko'rilganligi va u qanday baholanganligi haqidagi daraxtni qoldiradi. Bu daraxt qayta ijro etish simulyatoriga aylanadi: ikkinchi, bir xil muzlatilgan Gemini siyosatni qayta yozadi va yangi siyosat haqiqiy GPUlar o'rniga yozib olingan natijalar bo'yicha sinovdan o'tkaziladi. siyosatni qayta yozadi va yangi siyosat haqiqiy GPUlar o'rniga yozib olingan natijalar bo'yicha sinovdan o'tkaziladi.
2:16 Maqolada bu tush ko'rish deb ataladi va bitta haqiqiy ishga tushirish minglab tush ko'rilganlarni nol ijro etish xarajatida qoplaydi. G'olib yana onlayn rejimga qaytadi, yozib olingan dunyolar to'plami o'sadi, takrorlang. Va Ilova B.2 dagi buyruq o'z-o'zini takomillashtiruvchi AIga yozma ravishda aytadi: faqat shu bir faylni tahrirlang va ilmiy vazifani hal qilmang. O'lchangan. Lasso yechuvchi vazifasida, qat'iy tadqiqot 550 Gemini chaqiruvini sarflab, uch nuqta olti soniyaga erishdi, Dream-RSI 317 ni sarflab ikki nuqta to'qqizga erishdi, va ikkalasi ham scikit-learn'ni yengdi.
2:46 KernelBench'da u bir xil kernel tezligiga taxminan ikki nuqta to'rt marta kamroq avlodlar bilan erishdi. Va doira joylashtirishda u ikki nuqta olti uch besh to'qqiz sakkiz uch ball oldi, bu aniq, oltita o'nlik kasrga, AlphaEvolve ikkinchi versiyasi o'tgan yili olgan ballidir. sakkiz uch ball oldi, bu aniq, oltita o'nlik kasrga, AlphaEvolve ikkinchi versiyasi o'tgan yili olgan ballidir. Shunday qilib, X sarlavhani o'qidi: Google hozirgina rekursiv o'z-o'zini takomillashtirishni yengdi. Hacker News PDFni o'qidi: buni RSI deb atash chalkash ko'rinadi. Va shu haftada raqib kompaniyaning bosh direktori sikl yozdan beri davom etayotganini va hamma sekinlashishi kerakligini aytdi.
3:13 Uchta gap, bir xil ikkita so'z, uchta turli mashina. Shunday qilib, Dushanba, keyingi RSI maqolasini qanday o'qish kerak. Bir: qaysi ob'ekt o'zgaradi, vaznlar, kod yoki qidiruv sozlamalari deb so'rang; Dream-RSI uchinchi o'zgaradi. Ikki: kim muzlatilgan deb so'rang; bu yerda kodlovchi, baholovchi va qayta yozuvchi, uchalasi ham. Uch: sarlavhadagi raqam nimaning birligi deb so'rang. Tejalgan hisoblash — optimallashtirish; model ilgari erisha olmagan benchmark — bu parvoz va buni hali hech kim chop etmadi.
3:40 Hukm, ichki mexanizm: needs review. Sikl haqiqiy, tejash o'lchangan va muqovadagi ikkita so'z maqolada bo'lmagan mashinani tasvirlaydi. Agar buni men aytganimdan ko'ra o'qishni afzal ko'rsangiz, diff har kuni ertalab sizning pochta qutingizga bepul keladi, dailydiff.dev saytida, havola pastda. Izohlarda keyingi nimani ochishim kerakligini ayting. Va bugungi diff shu. Men Axrisi'dan Niko.
4:00 Mas'uliyat bilan birlashtiring.
Manbalar
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



