+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

ተደጋጋሚ ራስን ማሻሻል, የውስጥ አሰራሩ

Google DeepMind "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" የተሰኘውን ጥናት አሳተመ—እና በውስጡ ያለው የኮዲንግ ሞዴል በፍጹም አይቀየርም። የውስጥ አሰራሩ፡ ሐረጉ ለ60 ዓመታት ምን ማለት እንደነበረ፣ በ Dream-RSI ውስጥ በትክክል ምን እንደሚሽከረከር (በተመዘገቡ የፍለጋ ዛፎች ላይ "የሚያልም" የፓይዘን ፍለጋ ፖሊሲ) እና 317 ወኪል ጥሪዎች ከ 550 ይልቅ ቅናሽ እንጂ የመነሳት ምልክት ያልሆኑት ለምንድን ነው?

Google DeepMind "Dream-RSI: Recursive Self-Improvement through Evolving Worlds" የተሰኘውን ጥናት አሳተመ—እና በውስጡ ያለው የኮዲንግ ሞዴል በፍጹም አይቀየርም። የውስጥ አሰራሩ፡ ሐረጉ ለ60 ዓመታት ምን ማለት እንደነበረ፣ በ Dream-RSI ውስጥ በትክክል ምን እንደሚሽከረከር (በተመዘገቡ የፍለጋ ዛፎች ላይ "የሚያልም" የፓይዘን ፍለጋ ፖሊሲ) እና 317 ወኪል ጥሪዎች ከ 550 ይልቅ ቅናሽ እንጂ የመነሳት ምልክት ያልሆኑት ለምንድን ነው? ፍርድ: NEEDS REVIEW.

የጽሑፍ እትሙን ያንብቡ (እንግሊዝኛ) ↗

ይህ ቪዲዮ ምን ይሸፍናል

  • 1965 → 2008: I. J. Good's "የብልህነት ፍንዳታ", Yudkowsky's seed AI — የራሱን ክብደት የሚጽፍ ማሽን
  • 2025: AlphaEvolve — 48-ማባዣ 4×4 ማትሪክስ ማባዛት፣ 0.7% የጉግል የኮምፒውተር ሀብት ተመልሷል፣ Gemini ከርነሎች 23% ፈጣን
  • 2026: Dream-RSI — ፖሊሲው ይሻሻላል፣ ኮድ አውጪው፣ ዳኛው እና እንደገና ጸሐፊው ሁሉም አልተለወጡም፤ ትዕዛዙ "ሳይንሳዊውን ተግባር አይፍቱ" ይላል።
  • X: "Google አሁን ተደጋጋሚ ራስን ማሻሻልን አገኘው" (819 መውደዶች) ከ HN: "ይህን RSI ብሎ መጥራት አሳሳች ይመስላል"
  • ጥቅም ላይ የዋሉ ቁጥሮች: §4.1 Lasso 550 → 317 ወኪል ጥሪዎች፣ 3587 → 2931 ሚሊሰከንድ፤ ሰንጠረዥ 1 ክብ ማሸግ 2.635983 = AlphaEvolveV2፤ §4.3 KernelBench 2.43× / 1.79× ያነሰ ትውልዶች፣ እስከ 2.09× ፈጣን፤ አባሪ B.2 ትዕዛዝ (ሁሉም ከላይ ከተጠቀሰው ፒዲኤፍ)

የተተረጎመ ግልባጭ

ከዋናው የእንግሊዝኛ ትረካ የተተረጎመ። የሚገኙ ኦዲዮ እና መግለጫ ጽሑፎች በYouTube ቁጥጥር ስር ናቸው።

0:00 ተደጋጋሚ ራስን ማሻሻል ማለት አንድ አርቴፊሻል ኢንተለጀንስ እራሱን ብልህ የማድረግ ሀሳብ ነው፣ ከዚያም ይበልጥ ብልህ የሆነውን ራሱን እንደገና ያንን ለማድረግ ይጠቀማል፣ እና በዚህ ሳምንት ጎግል ርዕሱ ውስጥ እነዚህ ሁለት ቃላት ያለበትን ጥናት አሳተመ፣ በዚህም የሞዴሉ ክብደት በፍጹም አይቀየርም። ሶስት ቁጥሮች። የአንትሮፒክ ዋና ሥራ አስፈፃሚ ይህ ሽክርክሪት ከበጋው ወዲህ እየሰራ መሆኑን ገልጸዋል፣ ይህም መላውን ኢንዱስትሪ ለማዘግየት የእሱ ምክንያት ነው። ጎግል አሁን እንዳገኘው የሚያስታውቀው ትዊት በአንድ ቀን ስምንት መቶ መውደዶችን አገኘ። በአንድ ቀን።

0:24 እና የጥናቱ ዋና ውጤት ከ 550 ይልቅ 317 የሞዴል ጥሪዎች ነው፣ ይህም ቅናሽ እንጂ የመነሳት ምልክት አይደለም። በሶስት ደቂቃዎች ውስጥ፡ ሐረጉ የመጣው ከየት ነው፣ በ Dream-RSI ውስጥ በትክክል ምን ይሽከረከራል፣ እና ሽፋን ላይ RSI ያለበትን ቀጣይ ጥናት እንዴት ማንበብ እንደሚቻል። ይህ The Daily Diff ነው, የውስጥ አሰራሩ። 1965። I. J. ጉድ፣ ከቱሪንግ አጠገብ የሰራ የብሌችሊ ፓርክ ስታትስቲሽያን፣ አንድ እጅግ ብልህ ማሽን የተሻሉ ማሽኖችን መንደፍ እንደሚችል ይጽፋል፣

0:52 የብልህነት ፍንዳታ እና ሰው ሊያደርገው የሚገባ የመጨረሻው ፈጠራ ብሎ ይጠራዋል፣ ማሽኑ እሱን እንዴት መቆጣጠር እንደምንችል ሊነግረን በቂ ታዛዥ እስከሆነ ድረስ፣ ይህም ሰዎች ከነጠላ ሰረዙ በኋላ ማንበብ የሚያቆሙት "እስከሆነ ድረስ" ነው። ለአርባ ዓመታት ሐረጉ በትክክል ይህንን ማለት ነው፡ የራሱን ምንጭ ወይም ክብደት የሚያስተካክል እና በእያንዳንዱ ማለፊያ ይበልጥ ብልህ የሚወጣ ስርዓት። የኤሊዘር ዩድኮቭስኪ የ2008 ድርሰት የ AI ደህንነትን መሠረታዊ ቃል አደረገው፣ እና ማንም ለመሞከር ማሽን አልነበረውም፣ ይህም ለአንድ ፍቺ ተስማሚ ሁኔታ ነው ከዚያም በግንቦት 2025 ዲፕማይንድ AlphaEvolveን አወጣ፣

1:23 ኮድ የሚያቀርብ፣ ነጥብ የሚሰጠው፣ አሸናፊዎችን የሚይዝ እና እንደገና የሚያሻሽል Gemini ወኪል። አራት በ አራት ውስብስብ ማትሪክሶችን በ 48 ደረጃዎች አባዝቷል፣ ስትራሰን በ1969 ያዘጋጀውን ሪከርድ በማሸነፍ፣ እና ከጉግል አለም አቀፍ የኮምፒውተር ሀብት ወደ ዜሮ ነጥብ ሰባት በመቶ ያህል ይመልሳል፣ ይህም በጉግል ደረጃ በሶፋ ስር የተገኘ የመረጃ ማዕከል ነው። በሶፋ ስር የተገኘ የመረጃ ማዕከል ነው። ጀሚኒ አሁን ጀሚኒን ለማሰልጠን እየረዳ ነበር፣ እና ሐረጉ በጸጥታ ከደህንነት ብሎጎች ወደ ጋዜጣዊ መግለጫዎች ተንቀሳቀሰ። ብሎጎች ወደ ጋዜጣዊ መግለጫዎች። Dream-RSI በዚያ ሽክርክሪት ላይ መቆጣጠሪያን ይጭናል።

1:52 አንድ ፖሊሲ፣ ትክክለኛ የፓይዘን ፕሮግራም፣ የፍለጋ ዛፉ የትኞቹን ቅርንጫፎች ማስፋፋት እንዳለበት፣ ስንት በአንድ ጊዜ፣ እና መቼ ተስፋ መቁረጥ እንዳለበት ይወስናል። ማስፋፋት እንዳለበት፣ ስንት በአንድ ጊዜ፣ እና መቼ ተስፋ መቁረጥ እንዳለበት ይወስናል። ጀሚኒ የእጩውን ኮድ ይጽፋል፣ እና አንድ ቋሚ ገምጋሚ ​​ነጥብ ይሰጠዋል። እያንዳንዱ ሩጫ ምን እንደተሞከረ እና ምን ያህል እንደተገመገመ የሚያሳይ ዛፍ ይተዋል። ያ ዛፍ የመልሶ ማጫወት አስመሳይ ይሆናል፡ ሁለተኛ፣ እንዲሁ የቀዘቀዘ ጀሚኒ ፖሊሲውን እንደገና ይጽፋል፣ እና አዲሱ ፖሊሲ በእውነተኛ ጂፒዩዎች ላይ ከመሞከር ይልቅ በተመዘገቡት ውጤቶች ላይ ይሞከራል። ከእውነተኛ ጂፒዩዎች ይልቅ።

2:16 ጥናቱ ይህንን ህልም ይለዋል፣ እና አንድ እውነተኛ ሩጫ በዜሮ የማስፈጸሚያ ወጪ በሺዎች የሚቆጠሩ ህልሞችን ይከፍላል። ዜሮ የማስፈጸሚያ ወጪ። አሸናፊው ተመልሶ መስመር ላይ ይገባል፣ የተመዘገቡት ዓለማት ክምችት ያድጋል፣ ይደግማል። እና በአባሪ B.2 ውስጥ ያለው ትዕዛዝ ራስን አሻሽል AI ን ይነግረዋል፣ በጽሑፍ፡ ይህን አንድ ፋይል ብቻ አርትዕ፣ እና ሳይንሳዊውን ተግባር አትፍታ። የተለካ። በላሶ መፍቻ ተግባር ላይ፣ ቋሚ ፍለጋ 550 Gemini ጥሪዎችን ተጠቅሞ ሶስት ነጥብ ስድስት ሰከንድ ለመድረስ፣ Dream-RSI 317 ተጠቅሞ ሁለት ነጥብ ዘጠኝ ለመድረስ፣ እና ሁለቱም scikit-learn ን አሸነፉ።

2:46 በ KernelBench ላይ ተመሳሳይ የሆነ የከርነል ፍጥነትን ወደ ሁለት ነጥብ አራት እጥፍ ያነሱ ትውልዶች ጋር ደርሷል። እና ክብ ማሸግ ላይ ሁለት ነጥብ ስድስት ሶስት አምስት ዘጠኝ ስምንት ሶስት አስመዘገበ፣ ይህም በትክክል፣ እስከ ስድስት አስርዮሽ ቦታዎች፣ AlphaEvolve ስሪት ሁለት ባለፈው ዓመት ያስመዘገበው ነው። ስለዚህ X ርዕሱን አነበበ፡ ጉግል አሁን ተደጋጋሚ ራስን ማሻሻልን አገኘው። Hacker News ፒዲኤፉን አነበበ፡ ይህን RSI ብሎ መጥራት አሳሳች ይመስላል። እና በዚያው ሳምንት የአንድ ተወዳዳሪ ዋና ሥራ አስፈፃሚ ሽክርክሪቱ ከበጋው ወዲህ እየሰራ ነበር እና ሁሉም ሰው ማዘግየት አለበት አሉ።

3:13 ሶስት ዓረፍተ ነገሮች፣ ተመሳሳይ ሁለት ቃላት፣ ሶስት የተለያዩ ማሽኖች። ስለዚህ፣ ሰኞ፣ የሚቀጥለውን RSI ጥናት እንዴት ማንበብ እንደሚቻል። አንድ፡ የትኛው ነገር ይለወጣል ብሎ መጠየቅ፣ ክብደቶች፣ ኮድ፣ ወይስ የፍለጋ ቅንብሮች፤ Dream-RSI ሦስተኛውን ይለውጣል። ሁለት፡ ማን ቀዘቀዘ ብሎ መጠየቅ፤ እዚህ ኮድ አውጪው፣ ዳኛው እና እንደገና ጸሐፊው ናቸው፣ ሦስቱም። ሦስት፡ ዋናው ቁጥር የማን ክፍል ነው ብሎ መጠየቅ። የተቀመጠ ኮምፒዩት ማመቻቸት ነው፤ ሞዴሉ ከዚህ በፊት ሊደርስበት ያልቻለው መስፈርት መነሻው ነው፣ እና እስካሁን ማንም ያንን አላሳተመም።

3:40 ፍርድ፣ የውስጥ አሰራሩ፡ NEEDS REVIEW። ሽክርክሪቱ እውነት ነው፣ ቁጠባዎቹ ተለክተዋል፣ እና በሽፋኑ ላይ ያሉት ሁለቱ ቃላት በጥናቱ ውስጥ የሌለ ማሽን ይገልጻሉ። ይህን እኔ ስናገረው ከመስማት ይልቅ ማንበብ ከፈለጉ፣ ልዩነቱ በየማለዳው ወደ ገቢ መልዕክት ሳጥንዎ ይገባል፣ በ daily diff dot dev ላይ በነጻ፣ አገናኙ ከታች አለ። በአስተያየቶቹ ውስጥ ቀጥሎ ምን እንደምከፍት ንገሩኝ። እና የዛሬው ልዩነት ይኸው ነው። እኔ ኒኮ ከ Axrisi ነኝ።

4:00 በኃላፊነት ያዋህዱ።

ምንጮች

  1. Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
  2. Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
  3. Hacker News thread (169 points)news.ycombinator.com
  4. Hugging Face papers (278 upvotes)huggingface.co
  5. I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
  6. Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
  7. Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
  8. Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
  9. Tweetx.com

ተዛማጅ ቪዲዮዎች

under-the-hood · am · 24 ሴፕቴ 2026

SAML፣ ከሽፋኑ ስር፡ ደብዳቤው ውስጥ ያለው ፊርማ

SAML እርስዎን ወደ እያንዳንዱ የስራ መተግበሪያ ያስገባዎታል፣ እና ፊርማው በሚፈርመው XML ውስጥ ይኖራል። ከሽፋኑ ስር፡ በመተግበሪያው፣ በአሳሹ እና በየማንነት አቅራቢው መካከል ያለው የመግቢያ ዳንስ፣ አንድ ማረጋገጫ ምን እንደሚመስል፣ የካኖኒካላይዜሽን ሂደት በእያንዳንዱ ባይት ላይ መስማማት ያለበት ለምንድን ነ

3:02 ↗
under-the-hood · am · 23 ሴፕቴ 2026

አንድ ሞዴል ከጀርባ ሲሞት

የኤአይ ሞዴል አይሞትም — የመዝጊያ ቀን ይሰጠዋል፣ እና በማግስቱ ጠዋት የእርስዎ ኤፒአይ ጥሪ 404ን ይመልሳል፡- "ሞዴሉ ጊዜ ያለፈበት ሆኗል፣ እዚህ የበለጠ ይረዱ።" ከጀርባው፡- የአራት-ግዛት ቧንቧ (አክቲቭ → ሌጋሲ → ጊዜ ያለፈበት → ጡረታ የወጣ)፣ የማሳወቂያ መስኮቶች (OpenAI ≥ 6 ወራት / 3 ወራት

3:15 ↗
under-the-hood · am · 21 ሴፕቴ 2026

ክሎድ RSA-896ን ከፈለ። RSA በእርግጥ እንዴት እንደሚሰበር እነሆ

በሴፕቴምበር 19፣ የአንትሮፒክ መሐንዲስ RSA-896ን — ባለ 270 አሃዝ ፈተና ቁጥር — በክሎድ፣ ክፍት ምንጭ CADO-NFS ወንፊት በጂፒዩ ወደብ እና ለ10 ቀናት በ2,048 ስራ የሌላቸው ጂፒዩዎች ላይ ~30 ጂፒዩ-ዓመታት በመጠቀም ከፈለ። ይህ የተደረገው ኮግኒሽን ዲቪን RSA-260ን ከፈተ ከ16 ቀናት በኋላ

3:39 ↗
under-the-hood · am · 19 ሴፕቴ 2026

የይለፍ ቁልፎች፣ ከውስጥ ያለው

የይለፍ ቁልፍ መሳሪያዎ የሚፈጥረው፣ በፍጹም የማያሳይዎት እና ለማንም — እርስዎን ጨምሮ — ለመስጠት ፈቃደኛ ያልሆነ የይለፍ ቃል ነው። ከውስጥ ያለው: የWebAuthn ሥነ ሥርዓት (በጣቢያው ቁልፍ ጥንድ፣ ፈተና፣ ፊርማ)፣ አሳሹ የአሳ ማጥመድን የሚያስወግድ አንድ መስክ (መነሻ)፣ በመሣሪያ የተገደቡ vs የተመሳሰሉ

3:12 ↗