தன்னிலை மேம்பாடு, மூடிய கதவுகளுக்குப் பின்னால்
Google DeepMind "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" என்ற தலைப்பில் ஒரு கட்டுரையை வெளியிட்டது — மேலும் அதன் உள்ளே உள்ள கோடிங் மாதிரி ஒருபோதும் மாறாது.
Google DeepMind "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" என்ற தலைப்பில் ஒரு கட்டுரையை வெளியிட்டது — மேலும் அதன் உள்ளே உள்ள கோடிங் மாதிரி ஒருபோதும் மாறாது. மூடிய கதவுகளுக்குப் பின்னால்: அந்த சொற்றொடர் 60 ஆண்டுகளாக என்ன அர்த்தப்படுத்தியது, Dream-RSI இல் உண்மையில் என்ன சுழல்கிறது (பதிவுசெய்யப்பட்ட தேடல் மரங்களில் "கனவு காணும்" ஒரு பைதான் ஆய்வு கொள்கை), மற்றும் ஏன் 550 க்கு பதிலாக 317 முகவர் அழைப்புகள் ஒரு தள்ளுபடி, ஒரு டேக்-ஆஃப் அல்ல. தீர்ப்பு: NEEDS REVIEW.
எழுத்துப்பூர்வ பதிப்பைப் படிக்கவும் (ஆங்கிலம்) ↗
இந்த வீடியோ எதைப் பற்றி விவாதிக்கிறது
- 1965 → 2008: I. J. Good இன் "புத்திசாலித்தனமான வெடிப்பு", Yudkowsky இன் விதை AI — அதன் சொந்த எடைகளை மீண்டும் எழுதும் ஒரு இயந்திரம்
- 2025: AlphaEvolve — 48-பெருக்கல் 4×4 அணி பெருக்கல், Google இன் கணினியின் 0.7% மீட்டெடுக்கப்பட்டது, Gemini கெர்னல்கள் 23% வேகமாக
- 2026: Dream-RSI — கொள்கை மேம்படுகிறது, குறியீட்டாளர், நீதிபதி மற்றும் மீண்டும் எழுதுபவர் அனைவரும் உறைந்துள்ளனர்; "அறிவியல் பணியை தீர்க்க வேண்டாம்" என்று வரியில் கூறப்பட்டுள்ளது.
- X: "கூகிள் இப்போதுதான் மறுசுழற்சி தன்னிலை மேம்பாட்டை கண்டறிந்துள்ளது" (819 விருப்பங்கள்) vs HN: "இதை RSI என்று அழைப்பது தவறானது"
- பயன்படுத்தப்பட்ட எண்கள்: §4.1 Lasso 550 → 317 முகவர் அழைப்புகள், 3587 → 2931 ms; அட்டவணை 1 வட்ட நிரப்புதல் 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× குறைவான தலைமுறைகள், 2.09× வரை வேகமாக; பிற்சேர்க்கை B.2 வரி (மேலே உள்ள PDF இலிருந்து அனைத்தும்)
மொழிபெயர்க்கப்பட்ட டிரான்ஸ்கிரிப்ட்
அசல் ஆங்கில விளக்கத்திலிருந்து மொழிபெயர்க்கப்பட்டது. கிடைக்கும் ஆடியோ மற்றும் தலைப்புகள் YouTube ஆல் கட்டுப்படுத்தப்படுகின்றன.
0:00 தன்னிலை மேம்பாடு என்பது ஒரு AI தன்னை புத்திசாலித்தனமாக மாற்றிக்கொள்ளும் யோசனையாகும், பின்னர் புத்திசாலித்தனமான தன்னையே மீண்டும் செய்யப் பயன்படுத்துகிறது, இந்த வாரம் கூகிள் ஒரு கட்டுரையை வெளியிட்டது அந்த இரண்டு வார்த்தைகளுடன் தலைப்பில், அதில் மாதிரியின் எடைகள் ஒருபோதும் நகரவில்லை. மூன்று எண்கள். அந்த்ரோபிக் நிறுவனத்தின் CEO இந்த சுழற்சி கோடைகாலத்திலிருந்தே நடந்து வருகிறது என்கிறார், இது முழுத் தொழிலையும் மெதுவாக்குவதற்கு அவரது காரணம். கூகிள் அதை உடைத்துவிட்டது என்று அறிவித்த ட்வீட் ஒரு நாளில் எண்ணூறு விருப்பங்களைப் பெற்றது. ஒரு நாளில்.
0:24 மேலும் கட்டுரையின் முக்கிய முடிவு 550 க்கு பதிலாக 317 மாதிரி அழைப்புகள் ஆகும், இது ஒரு தள்ளுபடி, ஒரு டேக்-ஆஃப் அல்ல. மூன்று நிமிடங்களில்: அந்த சொற்றொடர் எங்கிருந்து வந்தது, Dream-RSI க்குள் உண்மையில் என்ன சுழல்கிறது, மற்றும் அட்டைப்படத்தில் RSI உடன் அடுத்த கட்டுரையை எப்படிப் படிப்பது. இது The Daily Diff, மூடிய கதவுகளுக்குப் பின்னால். 1965. I. J. Good, டூரிங்கிற்கு அடுத்ததாக பணிபுரிந்த ஒரு Bletchley Park புள்ளிவிவர நிபுணர், அல்ட்ரா-புத்திசாலித்தனமான இயந்திரம் இன்னும் சிறந்த இயந்திரங்களை வடிவமைக்க முடியும் என்று எழுதுகிறார்,
0:52 அதை ஒரு நுண்ணறிவு வெடிப்பு என்றும் மனிதன் செய்ய வேண்டிய கடைசி கண்டுபிடிப்பு என்றும் அழைக்கிறார், அந்த இயந்திரம் அதைக் கட்டுப்படுத்துவது எப்படி என்று நமக்குச் சொல்லும் அளவுக்கு கீழ்ப்படிவானதாக இருந்தால், இது 'provided-that' மக்கள் காற்புள்ளிக்குப் பிறகு படிப்பதை நிறுத்துகிறார்கள். நாற்பது ஆண்டுகளாக இந்த சொற்றொடர் சரியாக அதையே குறித்தது: அதன் சொந்த மூலத்தை அல்லது எடைகளைத் திருத்தி ஒவ்வொரு சுழற்சியிலும் புத்திசாலித்தனமாக வெளிவரும் ஒரு அமைப்பு. மூலத்தை அல்லது எடைகளை திருத்தி ஒவ்வொரு சுழற்சியிலும் புத்திசாலித்தனமாக வெளிவரும் ஒரு அமைப்பு. எலிஸர் யூட்கோவ்ஸ்கியின் 2008 கட்டுரை அதை AI பாதுகாப்பின் முக்கிய வார்த்தையாக மாற்றியது, மற்றும் அதை சோதிக்க யாரிடமும் ஒரு இயந்திரம் இல்லை, இது ஒரு வரையறைக்கு ஏற்ற சிறந்த நிலை. பின்னர் மே 2025 இல் DeepMind AlphaEvolve ஐ அனுப்பியது,
1:23 குறியீட்டை முன்மொழியும் ஒரு ஜெமினி முகவர், அதை மதிப்பெண் பெற்று, வெற்றியாளர்களை வைத்து மீண்டும் மாற்றியமைக்கிறது. இது 48 படிகளில் நான்கு-க்கு-நான்கு சிக்கலான அணி பெருக்கங்களைச் செய்தது, ஸ்ட்ராசென் 1969 இல் அமைத்த சாதனையை முறியடித்தது, மேலும் இது கூகிளின் உலகளாவிய கணினியின் சுமார் பூஜ்ஜியம் புள்ளி ஏழு சதவீதத்தை மீட்டெடுக்கிறது, இது கூகிளின் அளவில் ஒரு புள்ளி ஏழு சதவீதத்தை மீட்டெடுக்கிறது, இது கூகிளின் அளவில் ஒரு சோபாவின் அடியில் கண்டெடுக்கப்பட்ட தரவு மையம். ஜெமினி இப்போது ஜெமினிக்கு பயிற்சி அளிக்க உதவியது, மேலும் இந்த சொற்றொடர் பாதுகாப்பு வலைப்பதிவுகளிலிருந்து பத்திரிகை வெளியீடுகளுக்கு அமைதியாக நகர்ந்தது. வலைப்பதிவுகளிலிருந்து பத்திரிகை வெளியீடுகளுக்கு நகர்ந்தது. Dream-RSI அந்த சுழற்சியின் மேல் ஒரு கட்டுப்பாட்டாளரை இணைக்கிறது.
1:52 ஒரு கொள்கை, ஒரு உண்மையான பைதான் நிரல், தேடல் மரத்தின் எந்தக் கிளைகளை விரிவுபடுத்துவது, எந்தக் கிளைகளை விரிவுபடுத்துவது, எத்தனை இணையாக, மற்றும் எப்போது கைவிட வேண்டும் என்று முடிவு செய்கிறது. ஜெமினி வேட்பாளர் குறியீட்டை எழுதுகிறது, மற்றும் ஒரு நிலையான மதிப்பீட்டாளர் அதை மதிப்பெண் இடுகிறார். ஒவ்வொரு ஓட்டமும் என்ன முயற்சிக்கப்பட்டது மற்றும் அதற்கு என்ன மதிப்பெண் கிடைத்தது என்பதற்கான ஒரு மரத்தை விட்டுச்செல்கிறது. அந்த மரம் ஒரு மறுபயன்பாட்டு சிமுலேட்டராக மாறுகிறது: ஒரு இரண்டாவது, சமமாக உறைந்த ஜெமினி கொள்கையை மீண்டும் எழுதுகிறது, மற்றும் புதிய கொள்கை உண்மையான GPU களுக்குப் பதிலாக பதிவுசெய்யப்பட்ட முடிவுகளுக்கு எதிராக சோதிக்கப்படுகிறது. உண்மையான GPU களுக்குப் பதிலாக பதிவுசெய்யப்பட்ட முடிவுகளுக்கு எதிராக சோதிக்கப்படுகிறது.
2:16 கட்டுரை இதை கனவு காண்பது என்று அழைக்கிறது, மேலும் ஒரு உண்மையான ஓட்டம் ஆயிரக்கணக்கான கனவு கண்டவற்றுக்கு பூஜ்ஜிய செயல்படுத்தல் செலவில் ஈடுசெய்கிறது. ஒன்றுகளுக்கு பூஜ்ஜிய செயல்படுத்தல் செலவில் ஈடுசெய்கிறது. வெற்றியாளர் மீண்டும் ஆன்லைனில் செல்கிறார், பதிவுசெய்யப்பட்ட உலகங்களின் குளம் வளர்கிறது, மீண்டும் மீண்டும். மீண்டும் மீண்டும். மற்றும் பிற்சேர்க்கை B.2 இல் உள்ள வரி தன்னிலை மேம்படுத்தும் AI க்கு எழுதப்பட்டுள்ளது: இந்த ஒரு கோப்பை மட்டும் திருத்தவும், மற்றும் அறிவியல் பணியை தீர்க்க வேண்டாம். அளவிடப்பட்டது. Lasso தீர்வு பணிக்கு, நிலையான ஆய்வு 550 Gemini அழைப்புகளைப் பயன்படுத்தி மூன்று புள்ளி ஆறு வினாடிகளை அடைய செலவிட்டது, Dream-RSI 317 ஐப் பயன்படுத்தி இரண்டு புள்ளி ஒன்பது வினாடிகளை அடைய செலவிட்டது, அடைய செலவிட்டது, Dream-RSI 317 ஐப் பயன்படுத்தி இரண்டு புள்ளி ஒன்பது வினாடிகளை அடைய செலவிட்டது, மற்றும் இரண்டும் scikit-learn ஐ வென்றது.
2:46 KernelBench இல் இது அதே கர்னல் வேகத்தை அடைந்தது, சுமார் இரண்டு புள்ளி நான்கு மடங்கு குறைவான தலைமுறைகளுடன். குறைவான தலைமுறைகளுடன். மற்றும் வட்ட நிரப்புதலில் இது இரண்டு புள்ளி ஆறு மூன்று ஐந்து ஒன்பது எட்டு மூன்று மதிப்பெண் பெற்றது, இது துல்லியமாக, ஆறு தசமங்களுக்கு, AlphaEvolve பதிப்பு இரண்டின் எட்டு மூன்று மதிப்பெண் பெற்றது, இது துல்லியமாக, ஆறு தசமங்களுக்கு, AlphaEvolve பதிப்பு இரண்டின் கடந்த ஆண்டு மதிப்பெண். எனவே X தலைப்பை வாசித்தது: கூகிள் இப்போதுதான் மறுசுழற்சி தன்னிலை மேம்பாட்டை கண்டறிந்துள்ளது. ஹேக்கர் நியூஸ் PDF ஐ வாசித்தது: இதை RSI என்று அழைப்பது தவறானது. அதே வாரத்தில் ஒரு போட்டியாளரின் CEO கோடைகாலத்திலிருந்தே சுழற்சி நடந்து வருகிறது என்றும் அனைவரும் மெதுவாக செல்ல வேண்டும் என்றும் கூறினார். அனைவரும் மெதுவாக செல்ல வேண்டும் என்றும் கூறினார்.
3:13 மூன்று வாக்கியங்கள், அதே இரண்டு வார்த்தைகள், மூன்று வெவ்வேறு இயந்திரங்கள். எனவே, திங்கட்கிழமை, அடுத்த RSI கட்டுரையை எப்படிப் படிப்பது. ஒன்று: என்ன பொருள் மாறுகிறது, எடைகள், குறியீடு அல்லது தேடல் அமைப்புகள் என்று கேளுங்கள்; Dream-RSI மூன்றாவதை மாற்றுகிறது. இரண்டு: யார் உறைந்துள்ளனர் என்று கேளுங்கள்; இங்கே அது குறியீட்டாளர், நீதிபதி மற்றும் மீண்டும் எழுதுபவர், மூவரும். மூன்று: முக்கிய எண் எதன் அலகு என்று கேளுங்கள். சேமிக்கப்பட்ட கணினி உகந்ததாக்குதல்; இதற்கு முன் மாதிரி அடைய முடியாத ஒரு பெஞ்ச்மார்க் என்பது டேக்-ஆஃப், மற்றும் இதுவரை யாரும் அதை வெளியிடவில்லை.
3:40 தீர்ப்பு, மூடிய கதவுகளுக்குப் பின்னால்: NEEDS REVIEW. சுழற்சி உண்மையானது, சேமிப்புகள் அளவிடப்பட்டுள்ளன, மற்றும் அட்டைப்படத்தில் உள்ள இரண்டு வார்த்தைகள் கட்டுரையில் இல்லாத ஒரு இயந்திரத்தை விவரிக்கின்றன. நான் சொல்வதைக் கேட்பதை விட இதைப் படிக்க விரும்பினால், டிஃப் ஒவ்வொரு காலையிலும் உங்கள் இன்பாக்ஸில் இலவசமாக daily diff dot dev இல் வந்து சேரும், இணைப்பு கீழே உள்ளது. ஒவ்வொரு காலையிலும் உங்கள் இன்பாக்ஸில் இலவசமாக daily diff dot dev இல் வந்து சேரும், இணைப்பு கீழே உள்ளது. அடுத்து எதை திறக்க வேண்டும் என்று கருத்துகளில் சொல்லுங்கள். அது இன்றைய டிஃப். நான் Axrisi இலிருந்து நிகோ.
4:00 பொறுப்புடன் இணைக்கவும்.
ஆதாரங்கள்
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



