# Özyinelemeli kendini geliştirme, perde arkası

Published: 2026-09-18

Google DeepMind "Dream-RSI: Gelişen Dünyalar Aracılığıyla Özyinelemeli Kendi Kendini İyileştirme" başlıklı makaleyi yayınladı – ve içindeki kodlama modeli asla değişmiyor. Perde arkası: bu ifadenin 60 yıldır ne anlama geldiği, Dream-RSI'de (kaydedilmiş arama ağaçları üzerinde "rüya gören" bir Python keşif politikası) gerçekten neyin döngüye girdiği ve 550 yerine 317 ajan çağrısının neden bir indirim, bir kalkış değil. Karar: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/tr/video/2026-09-18-self-improving-ai/

## Bu video neleri kapsar

- 1965 → 2008: I. J. Good'un "zeka patlaması", Yudkowsky'nin çekirdek yapay zekası — kendi ağırlıklarını yeniden yazan bir makine
- 2025: AlphaEvolve — 48 çarpmalı 4×4 matris çarpımı, Google'ın hesaplama gücünün %0,7'si geri kazanıldı, Gemini çekirdekleri %23 daha hızlı
- 2026: Dream-RSI — politika gelişiyor, kodlayıcı, yargıç ve yeniden yazıcı hepsi dondurulmuş; istem "Bilimsel görevi çözmeyin" diyor
- X: "Google az önce özyinelemeli kendi kendini geliştirmeyi çözdü" (819 beğeni) vs HN: "buna RSI demek yanıltıcı görünüyor"
- Kullanılan sayılar: §4.1 Lasso 550 → 317 ajan çağrısı, 3587 → 2931 ms; Tablo 1 çember paketleme 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× daha az nesil, 2.09×'a kadar daha hızlı; Ek B.2 istemi (hepsi yukarıdaki PDF'den)

## Çevrilmiş deşifre

Orijinal İngilizce anlatımdan çevrilmiştir. Mevcut ses ve altyazılar YouTube tarafından kontrol edilir.

0:00 Özyinelemeli kendini geliştirme, bir yapay zekanın kendini daha akıllı hale getirmesi fikridir, sonra bu daha akıllı kendini tekrar yapmak için kullanması, ve bu hafta Google, başlığında bu iki kelimeyi içeren bir makale yayınladı, ve modelin ağırlıkları asla hareket etmedi. Üç sayı. Anthropic'in CEO'su bu döngünün yazdan beri çalıştığını söylüyor, ki bu, tüm endüstriyi yavaşlatmasının nedeni. Google'ın az önce bunu çözdüğünü duyuran tweet, bir günde sekiz yüz beğeni topladı. bir günde.

0:24 Ve makalenin kendi ana sonucu 550 yerine 317 model çağrısıdır, ki bu bir indirimdir, bir kalkış değil. Üç dakikada: bu ifade nereden geldi, Dream-RSI içinde gerçekten ne döngüye giriyor, ve kapakta RSI olan bir sonraki makaleyi nasıl okumalısınız. Bu The Daily Diff, perde arkası. 1965. I. J. Turing'in yanında çalışan Bletchley Park istatistikçisi Good, çok akıllı bir makinenin daha iyi makineler tasarlayabileceğini yazar,

0:52 buna bir zeka patlaması ve insanın yapması gereken son icat adını verir, makine bize onu nasıl kontrol edeceğimizi söyleyecek kadar uysal olursa, ki bu, virgül sonrası okumayı bırakan "provided-that" insanlarıdır. Kırk yıl boyunca bu ifade tam olarak şunu anlattı: kendi kaynağını veya ağırlıklarını düzenleyen ve her geçişte daha akıllı çıkan bir sistem. Eliezer Yudkowsky'nin 2008 tarihli makalesi bunu yapay zeka güvenliğinin yük taşıyan kelimesi haline getirdi, ve kimsenin üzerinde test edecek bir makinesi yoktu, ki bu bir tanım için ideal koşuldur. Daha sonra Mayıs 2025'te DeepMind AlphaEvolve'u piyasaya sürdü,

1:23 kod öneren, puanlanan, kazananları tutan ve onları tekrar mutasyona uğratan bir Gemini ajanı. Dört çarpı dört karmaşık matrisleri 48 adımda çarptı, Strassen'in 1969'da kırdığı bir rekoru geride bıraktı ve Google'ın dünya çapındaki hesaplama gücünün yaklaşık yüzde sıfır nokta yedisini kurtardı, ki Google'ın ölçeğinde bu, kanepenin altında bulunan bir veri merkezidir. bir veri merkezi. Gemini artık Gemini'yi eğitmeye yardımcı oluyordu ve bu ifade sessizce güvenlik bloglarından basın bültenlerine geçti. Dream-RSI, bu döngünün üzerine bir denetleyici cıvatalar.

1:52 Bir politika, gerçek bir Python programı, arama ağacının hangi dallarını genişleteceğine, genişleteceğine, kaç tanesini paralel yapacağına ve ne zaman vazgeçeceğine karar verir. paralel olarak kaç tane ve ne zaman vazgeçileceği. Gemini aday kodu yazar ve sabit bir değerlendirici puanlar. Her çalıştırma, neyin denendiğini ve ne puan aldığını gösteren bir ağaç bırakır. Bu ağaç bir tekrar simülatörü haline gelir: ikinci, eşit derecede dondurulmuş bir Gemini politikayı yeniden yazar, ve yeni politika gerçek GPU'lar üzerinde değil, kaydedilmiş sonuçlara karşı test edilir.

2:16 Makale buna "rüya görme" diyor ve bir gerçek çalıştırma, binlerce rüya görülmüş çalıştırmanın maliyetini sıfır yürütme maliyetiyle karşılar. Kazanan tekrar çevrimiçi olur, kaydedilmiş dünyaların havuzu büyür, tekrar eder. Ve Ek B.2'deki istem, kendi kendini geliştiren yapay zekaya, yazılı olarak: yalnızca bu bir dosyayı düzenle ve bilimsel görevi çözme der. Ölçülen. Lasso çözücü görevinde, sabit keşif 550 Gemini çağrısı harcayarak üç nokta altı saniyeye ulaştı, Dream-RSI 317 harcayarak iki nokta dokuza ulaştı, ve ikisi de scikit-learn'i yendi.

2:46 KernelBench'te aynı çekirdek hızına yaklaşık iki nokta dört kat daha az nesille ulaştı. daha az nesil. Ve çember paketlemede iki nokta altı üç beş dokuz sekiz üç puan aldı, ki bu tam olarak, altı ondalık basamağa kadar, AlphaEvolve sürüm ikinin geçen yıl aldığı puandı. Yani X başlığı okudu: Google az önce özyinelemeli kendi kendini geliştirmeyi çözdü. Hacker News PDF'yi okudu: buna RSI demek yanıltıcı görünüyor. Ve aynı hafta bir rakip CEO'su, döngünün yazdan beri çalıştığını ve herkesin yavaşlaması gerektiğini söyledi.

3:13 Üç cümle, aynı iki kelime, üç farklı makine. Peki, Pazartesi, bir sonraki RSI makalesini nasıl okumalı. Bir: hangi nesnenin değiştiğini sorun, ağırlıklar mı, kod mu, yoksa arama ayarları mı; Dream-RSI üçüncüyü değiştirir. İki: kimin dondurulduğunu sorun; burada kodlayıcı, yargıç ve yeniden yazıcı, hepsi üçü. Üç: ana başlık numarasının neyin birimi olduğunu sorun. Kurtarılan hesaplama optimizasyondur; modelin daha önce ulaşamadığı bir kıyaslama kalkıştır ve kimse bunu henüz yayınlamadı.

3:40 Karar, perde arkası: incelenmesi gerekiyor. Döngü gerçek, tasarruflar ölçülmüş ve kapaktaki iki kelime makalede olmayan bir makineyi tanımlıyor. Bunu benden duymak yerine okumak isterseniz, fark her sabah e-postanıza ücretsiz olarak thedaily-diff.dev adresinden gelir, bağlantı aşağıda. Yorumlarda bir sonraki neyi açacağımı söyleyin. Ve bugünkü fark bu. Ben Axrisi'den Niko.

4:00 Sorumlu bir şekilde birleştirin.

## Kaynaklar

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
