# Rekursiv özünütəkmilləşdirmə, pərdə arxasında

Published: 2026-09-18

Google DeepMind "Dream-RSI: Təkamül Edən Dünyalar Vasitəsilə Rekursiv Özünütəkmilləşdirmə" nəşr etdi — və onun içərisindəki kodlaşdırma modeli heç vaxt dəyişmir. Pərdə arxasında: bu ifadənin 60 il ərzində nə demək olduğu, Dream-RSI-də həqiqətən nəyin dövrə vurduğu (yazılmış axtarış ağacları üzərində "xəyal quran" Python tədqiqat siyasəti) və 550 əvəzinə 317 agent zənginin niyə endirim, yox, bir sıçrayış olmadığı. Hökm: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/az/video/2026-09-18-self-improving-ai/

## Bu videoda nələr əhatə olunur

- 1965 → 2008: I. J. Good'un "intellekt partlayışı", Yudkowsky'nin "seed AI" — öz çəkilərini yenidən yazan maşın
- 2025: AlphaEvolve — 48 vurma 4×4 matris vurması, Google'ın hesablama gücünün 0.7%-i bərpa edildi, Gemini nüvələri 23% daha sürətli
- 2026: Dream-RSI — siyasət təkmilləşir, kodlayıcı, hakim və yenidən yazan hamısı dondurulub; göstərişdə "Elmi tapşırığı həll etməyin" deyilir
- X: "Google yenicə rekursiv özünütəkmilləşdirməni "sındırdı" (819 bəyənmə) vs HN: "buna RSI demək yanıltıcı görünür"
- İstifadə olunan rəqəmlər: §4.1 Lasso 550 → 317 agent zəngi, 3587 → 2931 ms; Cədvəl 1 dairə yığımı 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× az nəsillər, 2.09× qədər sürətli; Əlavə B.2 göstəriş (hamısı yuxarıdakı PDF-dən)

## Tərcümə olunmuş transkript

Orijinal ingilis dilindəki nəqldən tərcümə edilmişdir. Mövcud audio və subtitrlər YouTube tərəfindən idarə olunur.

0:00 Rekursiv özünütəkmilləşdirmə, süni intellektin özünü daha ağıllı etməsi ideyasıdır, sonra daha ağıllı özünü yenidən bunu etmək üçün istifadə edir və bu həftə Google, başlığında bu iki söz olan bir məqalə nəşr etdi ki, orada modelin çəkiləri heç vaxt hərəkət etmir. Üç rəqəm. Anthropic-in CEO-su bu dövrənin yaydan bəri işlədiyini deyir, bu da bütün sənayeni yavaşlatmaq üçün onun səbəbidir. Google-un yenicə onu sındırdığını elan edən tvit bir gündə səkkiz yüz bəyənmə topladı. bir gündə.

0:24 Və məqalənin öz başlıq nəticəsi 550 əvəzinə 317 model zəngidir, bu endirimdir, sıçrayış deyil. Üç dəqiqə ərzində: ifadə haradan gəldi, Dream-RSI-nin içərisində həqiqətən nə dövrə vurur, və qapağında RSI olan növbəti məqaləni necə oxumalı. Bu, The Daily Diff, pərdə arxasında. 1965. I. J. Good, Türingin yanında işləyən Bletchley Park statistiki, yazır ki, ultra-ağıllı maşın daha yaxşı maşınlar dizayn edə bilər,

0:52 bunu intellekt partlayışı və insanın indiyə qədər etməli olduğu son ixtira adlandırır, maşının onu necə idarə edəcəyimizi bizə söyləyəcək qədər itaətkar olması şərtilə, bu da insanların vergüldən sonra oxumağı dayandırdığı 'şərtilə' hissəsidir. Qırx il ərzində bu ifadə məhz bunu ifadə edirdi: öz mənbəyini və ya çəkilərini redaktə edən və hər keçid zamanı daha ağıllı çıxan bir sistem. mənbəyini və ya çəkilərini redaktə edən və hər keçid zamanı daha ağıllı çıxan bir sistem. Eliezer Yudkowsky'nin 2008-ci ildə yazdığı esse onu AI təhlükəsizliyinin əsas sözü etdi, və heç kimin onu sınaqdan keçirəcək bir maşını yox idi, bu da tərif üçün ideal şərtdir. tərif üçün ideal şərtdir. Sonra 2025-ci ilin mayında DeepMind AlphaEvolve-u göndərdi,

1:23 kod təklif edən, qiymətləndirilən, qalibləri saxlayan və onları yenidən mutasiya edən bir Gemini agenti. Dördə-dörd mürəkkəb matrisləri 48 addımda vurdu, Strassenin 1969-cu ildə qoyduğu rekordu qırdı və Google-un dünya miqyasında hesablama gücünün təxminən sıfır nöqtə yeddi faizini bərpa edir, bu da Google-un miqyasında divanın altında tapılan bir data mərkəzidir. mərkəzidir. Gemini indi Geminini öyrətməyə kömək edirdi və ifadə səssizcə təhlükəsizlik bloqlarından mətbuat relizlərinə keçdi. bloqlarından mətbuat relizlərinə keçdi. Dream-RSI həmin dövrənin üzərinə bir nəzarətçi quraşdırır.

1:52 Bir siyasət, həqiqi bir Python proqramı, qərar verir axtarış ağacının hansı budaqlarını genişləndirməli, neçəsini paralel şəkildə və nə vaxt imtina etməli. Gemini namizəd kodu yazır və sabit bir qiymətləndirici onu qiymətləndirir. Hər işləmə cəhd olunanların və nəticələrinin bir ağacını geridə qoyur. Bu ağac bir təkrar simulyatoruna çevrilir: ikinci, eyni dərəcədə dondurulmuş Gemini siyasəti yenidən yazır, və yeni siyasət real GPU-lar üzərində deyil, qeydə alınmış nəticələrə qarşı sınaqdan keçirilir. real GPU-lar üzərində deyil.

2:16 Məqalə bunu yuxugörmə adlandırır və bir real işləmə minlərlə xəyal edilmiş işləmənin dəyərini sıfır icra xərci ilə ödəyir. minlərlə xəyal edilmiş işləmənin dəyərini sıfır icra xərci ilə ödəyir. Qalib yenidən onlayn olur, qeydə alınmış dünyalar hovuzu böyüyür, təkrarla. Və Əlavə B.2-dəki göstəriş özünü təkmilləşdirən süni intellektə yazılı şəkildə deyir: yazılı şəkildə: yalnız bu bir faylı redaktə et və elmi tapşırığı həll etmə. Ölçülüb. Lasso həll edici tapşırığında, sabit tədqiqat 3.6 saniyəyə çatmaq üçün 550 Gemini zəngi sərf etdi, Dream-RSI 2.9-a çatmaq üçün 317 sərf etdi və hər ikisi scikit-learn-i üstələdi. scikit-learn-i üstələdi.

2:46 KernelBench-də təxminən iki nöqtə dörd dəfə az nəsil ilə eyni nüvə sürətinə çatdı. az nəsil ilə eyni nüvə sürətinə çatdı. Və dairə yığımında iki nöqtə altı üç beş doqquz səkkiz üç bal topladı, bu da, altı onluğa qədər dəqiqliklə, AlphaEvolve ikinci versiyasının keçən il topladığı baldır. keçən il topladığı baldır. Beləliklə, X başlığı oxudu: Google yenicə rekursiv özünütəkmilləşdirməni sındırdı. Hacker News PDF-i oxudu: buna RSI demək yanıltıcı görünür. Və eyni həftə bir rəqibin CEO-su dövrənin yaydan bəri işlədiyini və hər kəsin yavaşlamalı olduğunu söylədi. və hər kəsin yavaşlamalı olduğunu söylədi.

3:13 Üç cümlə, eyni iki söz, üç fərqli maşın. Beləliklə, bazar ertəsi, növbəti RSI məqaləsini necə oxumalı. Bir: hansı obyektin dəyişdiyini soruşun, çəkilər, kod, yoxsa axtarış parametrləri; Dream-RSI üçüncünü dəyişir. İki: kimin dondurulduğunu soruşun; burada kodlayıcı, hakim və yenidən yazan var, hər üçü. Üç: başlıq rəqəminin nəyin vahidi olduğunu soruşun. Qənaət edilən hesablama optimallaşdırmadır; modelin əvvəllər çata bilmədiyi bir benchmark sıçrayışdır və hələ heç kim bunu nəşr etməyib.

3:40 Hökm, pərdə arxasında: NEEDS REVIEW. Dövrə gerçəkdir, qənaətlər ölçülüb və qapaqdakı iki söz məqalədə olmayan bir maşını təsvir edir. Əgər bunu məndən eşitməkdənsə oxumağa üstünlük verirsinizsə, "diff" hər səhər qutunuza gəlir, daily diff dot dev-də pulsuz, link aşağıdadır. Şərhlərdə növbəti nəyi açacağımı söyləyin. Və bugünkü "diff" budur. Mən Niko Axrisi-dənəm.

4:00 Məsuliyyətlə birləşdirin.

## Mənbələr

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
