# ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ, ਪਰਦੇ ਦੇ ਪਿੱਛੇ

Published: 2026-09-18

ਗੂਗਲ ਡੀਪਮਾਈਂਡ ਨੇ "ਡ੍ਰੀਮ-ਆਰਐਸਆਈ: ਵਿਕਸਤ ਹੋ ਰਹੇ ਸੰਸਾਰਾਂ ਰਾਹੀਂ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ" ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ — ਅਤੇ ਇਸਦੇ ਅੰਦਰ ਦਾ ਕੋਡਿੰਗ ਮਾਡਲ ਕਦੇ ਨਹੀਂ ਬਦਲਦਾ। ਪਰਦੇ ਦੇ ਪਿੱਛੇ: ਇਸ ਵਾਕ ਦਾ 60 ਸਾਲਾਂ ਤੋਂ ਕੀ ਮਤਲਬ ਸੀ, ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਵਿੱਚ ਅਸਲ ਵਿੱਚ ਕੀ ਲੂਪ ਹੁੰਦਾ ਹੈ (ਇੱਕ ਪਾਈਥਨ ਐਕਸਪਲੋਰੇਸ਼ਨ ਨੀਤੀ ਜੋ ਰਿਕਾਰਡ ਕੀਤੇ ਖੋਜ ਰੁੱਖਾਂ ਉੱਤੇ "ਸੁਪਨੇ" ਲੈਂਦੀ ਹੈ), ਅਤੇ 550 ਦੀ ਬਜਾਏ 317 ਏਜੰਟ ਕਾਲਾਂ ਛੋਟ ਕਿਉਂ ਹਨ, ਨਾ ਕਿ ਇੱਕ ਟੇਕਆਫ। ਫੈਸਲਾ: NEEDS REVIEW।

Canonical: https://thedailydiff.dev/pa/video/2026-09-18-self-improving-ai/

## ਇਹ ਵੀਡੀਓ ਕੀ ਕਵਰ ਕਰਦਾ ਹੈ

- 1965 → 2008: ਆਈ. ਜੇ. ਗੁੱਡ ਦਾ "ਇੰਟੈਲੀਜੈਂਸ ਐਕਸਪਲੋਜ਼ਨ", ਯੁਡਕੋਵਸਕੀ ਦਾ ਸੀਡ ਏਆਈ — ਇੱਕ ਮਸ਼ੀਨ ਜੋ ਆਪਣੇ ਖੁਦ ਦੇ ਵਜ਼ਨਾਂ ਨੂੰ ਦੁਬਾਰਾ ਲਿਖਦੀ ਹੈ
- 2025: ਅਲਫ਼ਾ ਇਵੋਲਵ — 48-ਗੁਣਾ 4×4 ਮੈਟ੍ਰਿਕਸ ਗੁਣਾ, ਗੂਗਲ ਦੀ 0.7% ਕੰਪਿਊਟ ਬਰਾਮਦ ਕੀਤੀ ਗਈ, ਜੈਮਿਨੀ ਕਰਨਲ 23% ਤੇਜ਼
- 2026: ਡ੍ਰੀਮ-ਆਰਐਸਆਈ — ਨੀਤੀ ਸੁਧਾਰਦੀ ਹੈ, ਕੋਡਰ, ਜੱਜ ਅਤੇ ਦੁਬਾਰਾ ਲਿਖਣ ਵਾਲੇ ਸਾਰੇ ਫ੍ਰੀਜ਼ ਕੀਤੇ ਜਾਂਦੇ ਹਨ; ਪ੍ਰੋਂਪਟ ਕਹਿੰਦਾ ਹੈ "ਵਿਗਿਆਨਕ ਕੰਮ ਨੂੰ ਹੱਲ ਨਾ ਕਰੋ"
- X: "ਗੂਗਲ ਨੇ ਹੁਣੇ ਹੀ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ ਨੂੰ ਕਰੈਕ ਕੀਤਾ" (819 ਲਾਈਕ) ਬਨਾਮ HN: "ਇਸਨੂੰ RSI ਕਹਿਣਾ ਗੁੰਮਰਾਹਕੁੰਨ ਲੱਗਦਾ ਹੈ"
- ਵਰਤੇ ਗਏ ਨੰਬਰ: §4.1 ਲਾਸੋ 550 → 317 ਏਜੰਟ ਕਾਲ, 3587 → 2931 ਮਿਲੀਸਕਿੰਟ; ਸਾਰਣੀ 1 ਸਰਕਲ ਪੈਕਿੰਗ 2.635983 = ਅਲਫ਼ਾ ਇਵੋਲਵ V2; §4.3 ਕਰਨਲਬੈਂਚ 2.43× / 1.79× ਘੱਟ ਪੀੜ੍ਹੀਆਂ, 2.09× ਤੱਕ ਤੇਜ਼; ਅੰਤਿਕਾ B.2 ਪ੍ਰੋਂਪਟ (ਸਾਰੇ ਉਪਰੋਕਤ PDF ਤੋਂ)

## ਅਨੁਵਾਦਿਤ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ

ਮੂਲ ਅੰਗਰੇਜ਼ੀ ਬਿਰਤਾਂਤ ਤੋਂ ਅਨੁਵਾਦ ਕੀਤਾ ਗਿਆ। ਉਪਲਬਧ ਆਡੀਓ ਅਤੇ ਕੈਪਸ਼ਨ YouTube ਦੁਆਰਾ ਨਿਯੰਤਰਿਤ ਕੀਤੇ ਜਾਂਦੇ ਹਨ।

0:00 ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ ਇਹ ਵਿਚਾਰ ਹੈ ਕਿ ਇੱਕ ਏਆਈ ਆਪਣੇ ਆਪ ਨੂੰ ਹੋਰ ਸਮਾਰਟ ਬਣਾਉਂਦਾ ਹੈ, ਫਿਰ ਉਸ ਸਮਾਰਟ ਸਵੈ ਦੀ ਵਰਤੋਂ ਦੁਬਾਰਾ ਕਰਨ ਲਈ ਕਰਦਾ ਹੈ, ਅਤੇ ਇਸ ਹਫ਼ਤੇ ਗੂਗਲ ਨੇ ਇੱਕ ਪੇਪਰ ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ ਜਿਸਦੇ ਸਿਰਲੇਖ ਵਿੱਚ ਇਹ ਦੋ ਸ਼ਬਦ ਹਨ, ਜਿਸ ਵਿੱਚ ਮਾਡਲ ਦੇ ਵਜ਼ਨ ਕਦੇ ਨਹੀਂ ਬਦਲਦੇ। ਤਿੰਨ ਨੰਬਰ। ਐਂਥ੍ਰੋਪਿਕ ਦਾ ਸੀਈਓ ਕਹਿੰਦਾ ਹੈ ਕਿ ਇਹ ਲੂਪ ਗਰਮੀਆਂ ਤੋਂ ਚੱਲ ਰਿਹਾ ਹੈ, ਜੋ ਕਿ ਉਸਦੇ ਪੂਰੇ ਉਦਯੋਗ ਨੂੰ ਹੌਲੀ ਕਰਨ ਦਾ ਕਾਰਨ ਹੈ। ਉਸ ਟਵੀਟ ਵਿੱਚ ਜਿਸ ਵਿੱਚ ਗੂਗਲ ਨੇ ਹੁਣੇ ਹੀ ਇਸਨੂੰ ਕਰੈਕ ਕਰਨ ਦਾ ਐਲਾਨ ਕੀਤਾ ਸੀ, ਅੱਠ ਸੌ ਲਾਈਕ ਇੱਕ ਦਿਨ ਵਿੱਚ ਇਕੱਠੇ ਕੀਤੇ ਗਏ।

0:24 ਅਤੇ ਪੇਪਰ ਦਾ ਆਪਣਾ ਮੁੱਖ ਨਤੀਜਾ 550 ਦੀ ਬਜਾਏ 317 ਮਾਡਲ ਕਾਲਾਂ ਹੈ, ਜੋ ਕਿ ਇੱਕ ਛੋਟ ਹੈ, ਨਾ ਕਿ ਇੱਕ ਟੇਕਆਫ। ਤਿੰਨ ਮਿੰਟਾਂ ਵਿੱਚ: ਇਹ ਵਾਕ ਕਿੱਥੋਂ ਆਇਆ, ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਦੇ ਅੰਦਰ ਅਸਲ ਵਿੱਚ ਕੀ ਲੂਪ ਹੁੰਦਾ ਹੈ, ਅਤੇ ਕਵਰ 'ਤੇ RSI ਵਾਲੇ ਅਗਲੇ ਪੇਪਰ ਨੂੰ ਕਿਵੇਂ ਪੜ੍ਹਨਾ ਹੈ। ਇਹ The Daily Diff ਹੈ, ਪਰਦੇ ਦੇ ਪਿੱਛੇ। 1965। ਆਈ. ਜੇ. ਗੁੱਡ, ਇੱਕ ਬਲੇਚਲੇ ਪਾਰਕ ਅੰਕੜਾ ਵਿਗਿਆਨੀ ਜਿਸਨੇ ਟਿਊਰਿੰਗ ਦੇ ਨਾਲ ਕੰਮ ਕੀਤਾ ਸੀ, ਲਿਖਦਾ ਹੈ ਕਿ ਇੱਕ ਅਤਿ-ਬੁੱਧੀਮਾਨ ਮਸ਼ੀਨ ਹੋਰ ਵੀ ਵਧੀਆ ਮਸ਼ੀਨਾਂ ਡਿਜ਼ਾਈਨ ਕਰ ਸਕਦੀ ਹੈ,

0:52 ਇਸਨੂੰ ਇੱਕ ਇੰਟੈਲੀਜੈਂਸ ਐਕਸਪਲੋਜ਼ਨ ਅਤੇ ਆਖਰੀ ਕਾਢ ਕਹਿੰਦਾ ਹੈ ਜੋ ਮਨੁੱਖ ਨੂੰ ਕਦੇ ਬਣਾਉਣ ਦੀ ਲੋੜ ਪਵੇਗੀ, ਬਸ਼ਰਤੇ ਮਸ਼ੀਨ ਇੰਨੀ ਨਰਮ ਹੋਵੇ ਕਿ ਸਾਨੂੰ ਇਹ ਦੱਸ ਸਕੇ ਕਿ ਇਸਨੂੰ ਕਿਵੇਂ ਨਿਯੰਤਰਿਤ ਕਰਨਾ ਹੈ, ਜੋ ਕਿ ਕਾਮੇ ਤੋਂ ਬਾਅਦ ਲੋਕ ਪੜ੍ਹਨਾ ਬੰਦ ਕਰ ਦਿੰਦੇ ਹਨ। ਚਾਲੀ ਸਾਲਾਂ ਤੱਕ ਇਸ ਵਾਕ ਦਾ ਬਿਲਕੁਲ ਉਹੀ ਮਤਲਬ ਸੀ: ਇੱਕ ਸਿਸਟਮ ਜੋ ਆਪਣੇ ਖੁਦ ਦੇ ਸਰੋਤ ਜਾਂ ਵਜ਼ਨ ਨੂੰ ਸੰਪਾਦਿਤ ਕਰਦਾ ਹੈ ਅਤੇ ਹਰ ਪਾਸੇ ਤੇਜ਼ੀ ਨਾਲ ਸਮਾਰਟ ਹੋ ਜਾਂਦਾ ਹੈ। ਏਲੀਜ਼ਰ ਯੁਡਕੋਵਸਕੀ ਦੇ 2008 ਦੇ ਲੇਖ ਨੇ ਇਸਨੂੰ ਏਆਈ ਦੀ ਲੋਡ-ਬੀਅਰਿੰਗ ਸ਼ਬਦ ਬਣਾ ਦਿੱਤਾ ਸੁਰੱਖਿਆ, ਅਤੇ ਕਿਸੇ ਕੋਲ ਇਸਦੀ ਜਾਂਚ ਕਰਨ ਲਈ ਕੋਈ ਮਸ਼ੀਨ ਨਹੀਂ ਸੀ, ਜੋ ਕਿ ਇਸ ਲਈ ਆਦਰਸ਼ ਸਥਿਤੀ ਹੈ ਇੱਕ ਪਰਿਭਾਸ਼ਾ। ਫਿਰ ਮਈ 2025 ਵਿੱਚ ਡੀਪਮਾਈਂਡ ਨੇ ਅਲਫ਼ਾ ਇਵੋਲਵ ਨੂੰ ਜਾਰੀ ਕੀਤਾ,

1:23 ਇੱਕ ਜੈਮਿਨੀ ਏਜੰਟ ਜੋ ਕੋਡ ਦਾ ਪ੍ਰਸਤਾਵ ਕਰਦਾ ਹੈ, ਇਸਨੂੰ ਸਕੋਰ ਕਰਦਾ ਹੈ, ਜੇਤੂਆਂ ਨੂੰ ਰੱਖਦਾ ਹੈ ਅਤੇ ਉਹਨਾਂ ਨੂੰ ਦੁਬਾਰਾ ਬਦਲਦਾ ਹੈ। ਇਸਨੇ 48 ਕਦਮਾਂ ਵਿੱਚ ਚਾਰ-ਗੁਣਾ-ਚਾਰ ਕੰਪਲੈਕਸ ਮੈਟ੍ਰਿਕਸ ਗੁਣਾ ਕੀਤੇ, 1969 ਵਿੱਚ ਸਟ੍ਰਾਸਨ ਦੁਆਰਾ ਸਥਾਪਤ ਇੱਕ ਰਿਕਾਰਡ ਨੂੰ ਤੋੜਿਆ, ਅਤੇ ਇਹ ਗੂਗਲ ਦੇ ਵਿਸ਼ਵਵਿਆਪੀ ਕੰਪਿਊਟ ਦਾ ਲਗਭਗ ਜ਼ੀਰੋ ਦਸ਼ਮਲਵ ਸੱਤ ਪ੍ਰਤੀਸ਼ਤ ਮੁੜ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਗੂਗਲ ਦੇ ਪੈਮਾਨੇ 'ਤੇ ਇੱਕ ਸੋਫੇ ਦੇ ਹੇਠਾਂ ਲੱਭਿਆ ਗਿਆ ਡਾਟਾ ਸੈਂਟਰ ਹੈ। ਜੈਮਿਨੀ ਹੁਣ ਜੈਮਿਨੀ ਨੂੰ ਸਿਖਲਾਈ ਦੇਣ ਵਿੱਚ ਮਦਦ ਕਰ ਰਿਹਾ ਸੀ, ਅਤੇ ਇਹ ਵਾਕ ਚੁੱਪਚਾਪ ਸੁਰੱਖਿਆ ਬਲੌਗ ਤੋਂ ਪ੍ਰੈਸ ਰਿਲੀਜ਼ਾਂ ਵਿੱਚ ਚਲਾ ਗਿਆ। ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਉਸ ਲੂਪ ਦੇ ਸਿਖਰ 'ਤੇ ਇੱਕ ਕੰਟਰੋਲਰ ਬੋਲਟ ਕਰਦਾ ਹੈ।

1:52 ਇੱਕ ਨੀਤੀ, ਇੱਕ ਅਸਲ ਪਾਈਥਨ ਪ੍ਰੋਗਰਾਮ, ਫੈਸਲਾ ਕਰਦਾ ਹੈ ਕਿ ਖੋਜ ਰੁੱਖ ਦੀਆਂ ਕਿਹੜੀਆਂ ਸ਼ਾਖਾਵਾਂ ਨੂੰ ਵਿਸਤਾਰ ਕਰਨਾ ਹੈ, ਕਿੰਨੀਆਂ ਸਮਾਂਤਰ ਵਿੱਚ, ਅਤੇ ਕਦੋਂ ਛੱਡ ਦੇਣਾ ਹੈ। ਜੈਮਿਨੀ ਉਮੀਦਵਾਰ ਕੋਡ ਲਿਖਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਨਿਰਧਾਰਤ ਮੁਲਾਂਕਣਕਰਤਾ ਇਸਨੂੰ ਸਕੋਰ ਕਰਦਾ ਹੈ। ਹਰ ਰਨ ਕੀ ਕੋਸ਼ਿਸ਼ ਕੀਤੀ ਗਈ ਅਤੇ ਇਸਨੇ ਕੀ ਸਕੋਰ ਕੀਤਾ, ਦਾ ਇੱਕ ਰੁੱਖ ਛੱਡ ਜਾਂਦਾ ਹੈ। ਉਹ ਰੁੱਖ ਇੱਕ ਰੀਪਲੇਅ ਸਿਮੂਲੇਟਰ ਬਣ ਜਾਂਦਾ ਹੈ: ਇੱਕ ਦੂਜਾ, ਬਰਾਬਰ ਫ੍ਰੀਜ਼ ਕੀਤਾ ਗਿਆ ਜੈਮਿਨੀ ਨੀਤੀ ਨੂੰ ਦੁਬਾਰਾ ਲਿਖਦਾ ਹੈ, ਅਤੇ ਨਵੀਂ ਨੀਤੀ ਦੀ ਜਾਂਚ ਰਿਕਾਰਡ ਕੀਤੇ ਨਤੀਜਿਆਂ ਦੇ ਵਿਰੁੱਧ ਕੀਤੀ ਜਾਂਦੀ ਹੈ ਨਾ ਕਿ ਅਸਲ GPUs 'ਤੇ।

2:16 ਪੇਪਰ ਇਸਨੂੰ ਸੁਪਨੇ ਲੈਣਾ ਕਹਿੰਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਅਸਲ ਰਨ ਹਜ਼ਾਰਾਂ ਸੁਪਨੇ ਵਾਲੀਆਂ ਜ਼ੀਰੋ ਐਗਜ਼ੀਕਿਊਸ਼ਨ ਲਾਗਤ 'ਤੇ ਇੱਕ ਲਈ ਭੁਗਤਾਨ ਕਰਦਾ ਹੈ। ਜੇਤੂ ਵਾਪਸ ਔਨਲਾਈਨ ਚਲਾ ਜਾਂਦਾ ਹੈ, ਰਿਕਾਰਡ ਕੀਤੇ ਸੰਸਾਰਾਂ ਦਾ ਪੂਲ ਵਧਦਾ ਹੈ, ਦੁਹਰਾਓ। ਅਤੇ ਅੰਤਿਕਾ B.2 ਵਿੱਚ ਪ੍ਰੋਂਪਟ ਸਵੈ-ਸੁਧਾਰ ਕਰਨ ਵਾਲੀ ਏਆਈ ਨੂੰ ਲਿਖਤ ਵਿੱਚ ਕਹਿੰਦਾ ਹੈ: ਸਿਰਫ਼ ਇਸ ਇੱਕ ਫਾਈਲ ਨੂੰ ਸੰਪਾਦਿਤ ਕਰੋ, ਅਤੇ ਵਿਗਿਆਨਕ ਕੰਮ ਨੂੰ ਹੱਲ ਨਾ ਕਰੋ। ਮਾਪਿਆ ਗਿਆ। ਲਾਸੋ ਸੌਲਵਰ ਕੰਮ 'ਤੇ, ਨਿਰਧਾਰਤ ਖੋਜ ਨੇ 3.6 ਸਕਿੰਟ ਤੱਕ ਪਹੁੰਚਣ ਲਈ 550 ਜੈਮਿਨੀ ਕਾਲਾਂ ਖਰਚ ਕੀਤੀਆਂ, ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਨੇ 2.9 ਤੱਕ ਪਹੁੰਚਣ ਲਈ 317 ਖਰਚ ਕੀਤੇ, ਅਤੇ ਦੋਵਾਂ ਨੇ scikit-learn ਨੂੰ ਹਰਾਇਆ। ਅਤੇ ਦੋਵਾਂ ਨੇ scikit-learn ਨੂੰ ਹਰਾਇਆ।

2:46 ਕਰਨਲਬੈਂਚ 'ਤੇ ਇਸਨੇ ਲਗਭਗ 2.4 ਗੁਣਾ ਘੱਟ ਪੀੜ੍ਹੀਆਂ ਦੇ ਨਾਲ ਉਹੀ ਕਰਨਲ ਸਪੀਡ ਪ੍ਰਾਪਤ ਕੀਤੀ। ਅਤੇ ਸਰਕਲ ਪੈਕਿੰਗ 'ਤੇ ਇਸਨੇ 2.635983 ਸਕੋਰ ਕੀਤਾ, ਜੋ ਕਿ ਬਿਲਕੁਲ, ਛੇ ਦਸ਼ਮਲਵ ਤੱਕ, ਉਹੀ ਹੈ ਜੋ ਅਲਫ਼ਾ ਇਵੋਲਵ ਵਰਜ਼ਨ ਦੋ ਨੇ ਪਿਛਲੇ ਸਾਲ ਸਕੋਰ ਕੀਤਾ ਸੀ। ਪਿਛਲੇ ਸਾਲ ਸਕੋਰ ਕੀਤਾ ਸੀ। ਇਸ ਲਈ X ਨੇ ਸਿਰਲੇਖ ਪੜ੍ਹਿਆ: ਗੂਗਲ ਨੇ ਹੁਣੇ ਹੀ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ ਨੂੰ ਕਰੈਕ ਕੀਤਾ। ਹੈਕਰ ਨਿਊਜ਼ ਨੇ PDF ਪੜ੍ਹਿਆ: ਇਸਨੂੰ RSI ਕਹਿਣਾ ਗੁੰਮਰਾਹਕੁੰਨ ਲੱਗਦਾ ਹੈ। ਅਤੇ ਉਸੇ ਹਫ਼ਤੇ ਇੱਕ ਪ੍ਰਤੀਯੋਗੀ ਦੇ ਸੀਈਓ ਨੇ ਕਿਹਾ ਕਿ ਲੂਪ ਗਰਮੀਆਂ ਤੋਂ ਚੱਲ ਰਿਹਾ ਸੀ ਅਤੇ ਸਾਰਿਆਂ ਨੂੰ ਹੌਲੀ ਹੋ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ।

3:13 ਤਿੰਨ ਵਾਕ, ਉਹੀ ਦੋ ਸ਼ਬਦ, ਤਿੰਨ ਵੱਖਰੀਆਂ ਮਸ਼ੀਨਾਂ। ਇਸ ਲਈ, ਸੋਮਵਾਰ, ਅਗਲੇ RSI ਪੇਪਰ ਨੂੰ ਕਿਵੇਂ ਪੜ੍ਹਨਾ ਹੈ। ਇੱਕ: ਪੁੱਛੋ ਕਿ ਕਿਹੜੀ ਵਸਤੂ ਬਦਲਦੀ ਹੈ, ਵਜ਼ਨ, ਕੋਡ, ਜਾਂ ਖੋਜ ਸੈਟਿੰਗਾਂ; ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਤੀਜੇ ਨੂੰ ਬਦਲਦਾ ਹੈ। ਦੋ: ਪੁੱਛੋ ਕਿ ਕੌਣ ਫ੍ਰੀਜ਼ ਹੈ; ਇੱਥੇ ਇਹ ਕੋਡਰ, ਜੱਜ ਅਤੇ ਦੁਬਾਰਾ ਲਿਖਣ ਵਾਲਾ ਹੈ, ਸਾਰੇ ਤਿੰਨ। ਤਿੰਨ: ਪੁੱਛੋ ਕਿ ਮੁੱਖ ਨੰਬਰ ਕਿਸਦੀ ਇਕਾਈ ਹੈ। ਸੰਭਾਲੀ ਗਈ ਕੰਪਿਊਟ ਅਨੁਕੂਲਨ ਹੈ; ਇੱਕ ਬੈਂਚਮਾਰਕ ਜੋ ਮਾਡਲ ਪਹਿਲਾਂ ਨਹੀਂ ਪਹੁੰਚ ਸਕਿਆ ਉਹ ਇੱਕ ਟੇਕਆਫ ਹੈ, ਅਤੇ ਕਿਸੇ ਨੇ ਵੀ ਅਜੇ ਤੱਕ ਉਹ ਪ੍ਰਕਾਸ਼ਿਤ ਨਹੀਂ ਕੀਤਾ ਹੈ।

3:40 ਫੈਸਲਾ, ਪਰਦੇ ਦੇ ਪਿੱਛੇ: NEEDS REVIEW। ਲੂਪ ਅਸਲੀ ਹੈ, ਬਚਤ ਮਾਪੀ ਗਈ ਹੈ, ਅਤੇ ਕਵਰ 'ਤੇ ਦੋ ਸ਼ਬਦ ਇੱਕ ਮਸ਼ੀਨ ਦਾ ਵਰਣਨ ਕਰਦੇ ਹਨ ਜੋ ਪੇਪਰ ਵਿੱਚ ਨਹੀਂ ਹੈ। ਜੇ ਤੁਸੀਂ ਮੈਨੂੰ ਇਹ ਸੁਣਨ ਦੀ ਬਜਾਏ ਪੜ੍ਹਨਾ ਚਾਹੁੰਦੇ ਹੋ, ਤਾਂ diff ਤੁਹਾਡੇ ਇਨਬਾਕਸ ਵਿੱਚ ਹਰ ਸਵੇਰ ਆਉਂਦਾ ਹੈ, daily diff dot dev 'ਤੇ ਮੁਫ਼ਤ, ਲਿੰਕ ਹੇਠਾਂ ਹੈ। ਮੈਨੂੰ ਟਿੱਪਣੀਆਂ ਵਿੱਚ ਦੱਸੋ ਕਿ ਅੱਗੇ ਕੀ ਖੋਲ੍ਹਣਾ ਹੈ। ਅਤੇ ਅੱਜ ਲਈ ਇਹ diff ਹੈ। ਮੈਂ Axrisi ਤੋਂ ਨਿਕੋ ਹਾਂ।

4:00 ਜ਼ਿੰਮੇਵਾਰੀ ਨਾਲ ਮਿਲਾਓ।

## ਸਰੋਤ

- [Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)](https://arxiv.org/abs/2609.14858) — arxiv.org
- [Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project page](https://dream-rsi.com/) — dream-rsi.com
- [Hacker News thread (169 points)](https://news.ycombinator.com/item?id=49726955) — news.ycombinator.com
- [Hugging Face papers (278 upvotes)](https://huggingface.co/papers/2609.14858) — huggingface.co
- [I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"](https://en.wikipedia.org/wiki/I._J._Good) — en.wikipedia.org
- [Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008](https://www.lesswrong.com/posts/JBadX7rwdcRFzGuju/recursive-self-improvement) — www.lesswrong.com
- [Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-up](https://deepmind.google/discover/blog/alphaevolve-a-gemini-powered-coding-agent-for-designing-advanced-algorithms/) — deepmind.google
- [Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)](https://darioamodei.com/post/we-must-pace-the-frontier) — darioamodei.com
- [Tweet](https://x.com/thesupermannx/status/2100153430849499395) — x.com
