+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ, ਪਰਦੇ ਦੇ ਪਿੱਛੇ

ਗੂਗਲ ਡੀਪਮਾਈਂਡ ਨੇ "ਡ੍ਰੀਮ-ਆਰਐਸਆਈ: ਵਿਕਸਤ ਹੋ ਰਹੇ ਸੰਸਾਰਾਂ ਰਾਹੀਂ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ" ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ — ਅਤੇ ਇਸਦੇ ਅੰਦਰ ਦਾ ਕੋਡਿੰਗ ਮਾਡਲ ਕਦੇ ਨਹੀਂ ਬਦਲਦਾ।

ਗੂਗਲ ਡੀਪਮਾਈਂਡ ਨੇ "ਡ੍ਰੀਮ-ਆਰਐਸਆਈ: ਵਿਕਸਤ ਹੋ ਰਹੇ ਸੰਸਾਰਾਂ ਰਾਹੀਂ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ" ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ — ਅਤੇ ਇਸਦੇ ਅੰਦਰ ਦਾ ਕੋਡਿੰਗ ਮਾਡਲ ਕਦੇ ਨਹੀਂ ਬਦਲਦਾ। ਪਰਦੇ ਦੇ ਪਿੱਛੇ: ਇਸ ਵਾਕ ਦਾ 60 ਸਾਲਾਂ ਤੋਂ ਕੀ ਮਤਲਬ ਸੀ, ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਵਿੱਚ ਅਸਲ ਵਿੱਚ ਕੀ ਲੂਪ ਹੁੰਦਾ ਹੈ (ਇੱਕ ਪਾਈਥਨ ਐਕਸਪਲੋਰੇਸ਼ਨ ਨੀਤੀ ਜੋ ਰਿਕਾਰਡ ਕੀਤੇ ਖੋਜ ਰੁੱਖਾਂ ਉੱਤੇ "ਸੁਪਨੇ" ਲੈਂਦੀ ਹੈ), ਅਤੇ 550 ਦੀ ਬਜਾਏ 317 ਏਜੰਟ ਕਾਲਾਂ ਛੋਟ ਕਿਉਂ ਹਨ, ਨਾ ਕਿ ਇੱਕ ਟੇਕਆਫ। ਫੈਸਲਾ: NEEDS REVIEW।

ਲਿਖਤੀ ਐਡੀਸ਼ਨ ਪੜ੍ਹੋ (ਅੰਗਰੇਜ਼ੀ) ↗

ਇਹ ਵੀਡੀਓ ਕੀ ਕਵਰ ਕਰਦਾ ਹੈ

  • 1965 → 2008: ਆਈ. ਜੇ. ਗੁੱਡ ਦਾ "ਇੰਟੈਲੀਜੈਂਸ ਐਕਸਪਲੋਜ਼ਨ", ਯੁਡਕੋਵਸਕੀ ਦਾ ਸੀਡ ਏਆਈ — ਇੱਕ ਮਸ਼ੀਨ ਜੋ ਆਪਣੇ ਖੁਦ ਦੇ ਵਜ਼ਨਾਂ ਨੂੰ ਦੁਬਾਰਾ ਲਿਖਦੀ ਹੈ
  • 2025: ਅਲਫ਼ਾ ਇਵੋਲਵ — 48-ਗੁਣਾ 4×4 ਮੈਟ੍ਰਿਕਸ ਗੁਣਾ, ਗੂਗਲ ਦੀ 0.7% ਕੰਪਿਊਟ ਬਰਾਮਦ ਕੀਤੀ ਗਈ, ਜੈਮਿਨੀ ਕਰਨਲ 23% ਤੇਜ਼
  • 2026: ਡ੍ਰੀਮ-ਆਰਐਸਆਈ — ਨੀਤੀ ਸੁਧਾਰਦੀ ਹੈ, ਕੋਡਰ, ਜੱਜ ਅਤੇ ਦੁਬਾਰਾ ਲਿਖਣ ਵਾਲੇ ਸਾਰੇ ਫ੍ਰੀਜ਼ ਕੀਤੇ ਜਾਂਦੇ ਹਨ; ਪ੍ਰੋਂਪਟ ਕਹਿੰਦਾ ਹੈ "ਵਿਗਿਆਨਕ ਕੰਮ ਨੂੰ ਹੱਲ ਨਾ ਕਰੋ"
  • X: "ਗੂਗਲ ਨੇ ਹੁਣੇ ਹੀ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ ਨੂੰ ਕਰੈਕ ਕੀਤਾ" (819 ਲਾਈਕ) ਬਨਾਮ HN: "ਇਸਨੂੰ RSI ਕਹਿਣਾ ਗੁੰਮਰਾਹਕੁੰਨ ਲੱਗਦਾ ਹੈ"
  • ਵਰਤੇ ਗਏ ਨੰਬਰ: §4.1 ਲਾਸੋ 550 → 317 ਏਜੰਟ ਕਾਲ, 3587 → 2931 ਮਿਲੀਸਕਿੰਟ; ਸਾਰਣੀ 1 ਸਰਕਲ ਪੈਕਿੰਗ 2.635983 = ਅਲਫ਼ਾ ਇਵੋਲਵ V2; §4.3 ਕਰਨਲਬੈਂਚ 2.43× / 1.79× ਘੱਟ ਪੀੜ੍ਹੀਆਂ, 2.09× ਤੱਕ ਤੇਜ਼; ਅੰਤਿਕਾ B.2 ਪ੍ਰੋਂਪਟ (ਸਾਰੇ ਉਪਰੋਕਤ PDF ਤੋਂ)

ਅਨੁਵਾਦਿਤ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ

ਮੂਲ ਅੰਗਰੇਜ਼ੀ ਬਿਰਤਾਂਤ ਤੋਂ ਅਨੁਵਾਦ ਕੀਤਾ ਗਿਆ। ਉਪਲਬਧ ਆਡੀਓ ਅਤੇ ਕੈਪਸ਼ਨ YouTube ਦੁਆਰਾ ਨਿਯੰਤਰਿਤ ਕੀਤੇ ਜਾਂਦੇ ਹਨ।

0:00 ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ ਇਹ ਵਿਚਾਰ ਹੈ ਕਿ ਇੱਕ ਏਆਈ ਆਪਣੇ ਆਪ ਨੂੰ ਹੋਰ ਸਮਾਰਟ ਬਣਾਉਂਦਾ ਹੈ, ਫਿਰ ਉਸ ਸਮਾਰਟ ਸਵੈ ਦੀ ਵਰਤੋਂ ਦੁਬਾਰਾ ਕਰਨ ਲਈ ਕਰਦਾ ਹੈ, ਅਤੇ ਇਸ ਹਫ਼ਤੇ ਗੂਗਲ ਨੇ ਇੱਕ ਪੇਪਰ ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ ਜਿਸਦੇ ਸਿਰਲੇਖ ਵਿੱਚ ਇਹ ਦੋ ਸ਼ਬਦ ਹਨ, ਜਿਸ ਵਿੱਚ ਮਾਡਲ ਦੇ ਵਜ਼ਨ ਕਦੇ ਨਹੀਂ ਬਦਲਦੇ। ਤਿੰਨ ਨੰਬਰ। ਐਂਥ੍ਰੋਪਿਕ ਦਾ ਸੀਈਓ ਕਹਿੰਦਾ ਹੈ ਕਿ ਇਹ ਲੂਪ ਗਰਮੀਆਂ ਤੋਂ ਚੱਲ ਰਿਹਾ ਹੈ, ਜੋ ਕਿ ਉਸਦੇ ਪੂਰੇ ਉਦਯੋਗ ਨੂੰ ਹੌਲੀ ਕਰਨ ਦਾ ਕਾਰਨ ਹੈ। ਉਸ ਟਵੀਟ ਵਿੱਚ ਜਿਸ ਵਿੱਚ ਗੂਗਲ ਨੇ ਹੁਣੇ ਹੀ ਇਸਨੂੰ ਕਰੈਕ ਕਰਨ ਦਾ ਐਲਾਨ ਕੀਤਾ ਸੀ, ਅੱਠ ਸੌ ਲਾਈਕ ਇੱਕ ਦਿਨ ਵਿੱਚ ਇਕੱਠੇ ਕੀਤੇ ਗਏ।

0:24 ਅਤੇ ਪੇਪਰ ਦਾ ਆਪਣਾ ਮੁੱਖ ਨਤੀਜਾ 550 ਦੀ ਬਜਾਏ 317 ਮਾਡਲ ਕਾਲਾਂ ਹੈ, ਜੋ ਕਿ ਇੱਕ ਛੋਟ ਹੈ, ਨਾ ਕਿ ਇੱਕ ਟੇਕਆਫ। ਤਿੰਨ ਮਿੰਟਾਂ ਵਿੱਚ: ਇਹ ਵਾਕ ਕਿੱਥੋਂ ਆਇਆ, ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਦੇ ਅੰਦਰ ਅਸਲ ਵਿੱਚ ਕੀ ਲੂਪ ਹੁੰਦਾ ਹੈ, ਅਤੇ ਕਵਰ 'ਤੇ RSI ਵਾਲੇ ਅਗਲੇ ਪੇਪਰ ਨੂੰ ਕਿਵੇਂ ਪੜ੍ਹਨਾ ਹੈ। ਇਹ The Daily Diff ਹੈ, ਪਰਦੇ ਦੇ ਪਿੱਛੇ। 1965। ਆਈ. ਜੇ. ਗੁੱਡ, ਇੱਕ ਬਲੇਚਲੇ ਪਾਰਕ ਅੰਕੜਾ ਵਿਗਿਆਨੀ ਜਿਸਨੇ ਟਿਊਰਿੰਗ ਦੇ ਨਾਲ ਕੰਮ ਕੀਤਾ ਸੀ, ਲਿਖਦਾ ਹੈ ਕਿ ਇੱਕ ਅਤਿ-ਬੁੱਧੀਮਾਨ ਮਸ਼ੀਨ ਹੋਰ ਵੀ ਵਧੀਆ ਮਸ਼ੀਨਾਂ ਡਿਜ਼ਾਈਨ ਕਰ ਸਕਦੀ ਹੈ,

0:52 ਇਸਨੂੰ ਇੱਕ ਇੰਟੈਲੀਜੈਂਸ ਐਕਸਪਲੋਜ਼ਨ ਅਤੇ ਆਖਰੀ ਕਾਢ ਕਹਿੰਦਾ ਹੈ ਜੋ ਮਨੁੱਖ ਨੂੰ ਕਦੇ ਬਣਾਉਣ ਦੀ ਲੋੜ ਪਵੇਗੀ, ਬਸ਼ਰਤੇ ਮਸ਼ੀਨ ਇੰਨੀ ਨਰਮ ਹੋਵੇ ਕਿ ਸਾਨੂੰ ਇਹ ਦੱਸ ਸਕੇ ਕਿ ਇਸਨੂੰ ਕਿਵੇਂ ਨਿਯੰਤਰਿਤ ਕਰਨਾ ਹੈ, ਜੋ ਕਿ ਕਾਮੇ ਤੋਂ ਬਾਅਦ ਲੋਕ ਪੜ੍ਹਨਾ ਬੰਦ ਕਰ ਦਿੰਦੇ ਹਨ। ਚਾਲੀ ਸਾਲਾਂ ਤੱਕ ਇਸ ਵਾਕ ਦਾ ਬਿਲਕੁਲ ਉਹੀ ਮਤਲਬ ਸੀ: ਇੱਕ ਸਿਸਟਮ ਜੋ ਆਪਣੇ ਖੁਦ ਦੇ ਸਰੋਤ ਜਾਂ ਵਜ਼ਨ ਨੂੰ ਸੰਪਾਦਿਤ ਕਰਦਾ ਹੈ ਅਤੇ ਹਰ ਪਾਸੇ ਤੇਜ਼ੀ ਨਾਲ ਸਮਾਰਟ ਹੋ ਜਾਂਦਾ ਹੈ। ਏਲੀਜ਼ਰ ਯੁਡਕੋਵਸਕੀ ਦੇ 2008 ਦੇ ਲੇਖ ਨੇ ਇਸਨੂੰ ਏਆਈ ਦੀ ਲੋਡ-ਬੀਅਰਿੰਗ ਸ਼ਬਦ ਬਣਾ ਦਿੱਤਾ ਸੁਰੱਖਿਆ, ਅਤੇ ਕਿਸੇ ਕੋਲ ਇਸਦੀ ਜਾਂਚ ਕਰਨ ਲਈ ਕੋਈ ਮਸ਼ੀਨ ਨਹੀਂ ਸੀ, ਜੋ ਕਿ ਇਸ ਲਈ ਆਦਰਸ਼ ਸਥਿਤੀ ਹੈ ਇੱਕ ਪਰਿਭਾਸ਼ਾ। ਫਿਰ ਮਈ 2025 ਵਿੱਚ ਡੀਪਮਾਈਂਡ ਨੇ ਅਲਫ਼ਾ ਇਵੋਲਵ ਨੂੰ ਜਾਰੀ ਕੀਤਾ,

1:23 ਇੱਕ ਜੈਮਿਨੀ ਏਜੰਟ ਜੋ ਕੋਡ ਦਾ ਪ੍ਰਸਤਾਵ ਕਰਦਾ ਹੈ, ਇਸਨੂੰ ਸਕੋਰ ਕਰਦਾ ਹੈ, ਜੇਤੂਆਂ ਨੂੰ ਰੱਖਦਾ ਹੈ ਅਤੇ ਉਹਨਾਂ ਨੂੰ ਦੁਬਾਰਾ ਬਦਲਦਾ ਹੈ। ਇਸਨੇ 48 ਕਦਮਾਂ ਵਿੱਚ ਚਾਰ-ਗੁਣਾ-ਚਾਰ ਕੰਪਲੈਕਸ ਮੈਟ੍ਰਿਕਸ ਗੁਣਾ ਕੀਤੇ, 1969 ਵਿੱਚ ਸਟ੍ਰਾਸਨ ਦੁਆਰਾ ਸਥਾਪਤ ਇੱਕ ਰਿਕਾਰਡ ਨੂੰ ਤੋੜਿਆ, ਅਤੇ ਇਹ ਗੂਗਲ ਦੇ ਵਿਸ਼ਵਵਿਆਪੀ ਕੰਪਿਊਟ ਦਾ ਲਗਭਗ ਜ਼ੀਰੋ ਦਸ਼ਮਲਵ ਸੱਤ ਪ੍ਰਤੀਸ਼ਤ ਮੁੜ ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਗੂਗਲ ਦੇ ਪੈਮਾਨੇ 'ਤੇ ਇੱਕ ਸੋਫੇ ਦੇ ਹੇਠਾਂ ਲੱਭਿਆ ਗਿਆ ਡਾਟਾ ਸੈਂਟਰ ਹੈ। ਜੈਮਿਨੀ ਹੁਣ ਜੈਮਿਨੀ ਨੂੰ ਸਿਖਲਾਈ ਦੇਣ ਵਿੱਚ ਮਦਦ ਕਰ ਰਿਹਾ ਸੀ, ਅਤੇ ਇਹ ਵਾਕ ਚੁੱਪਚਾਪ ਸੁਰੱਖਿਆ ਬਲੌਗ ਤੋਂ ਪ੍ਰੈਸ ਰਿਲੀਜ਼ਾਂ ਵਿੱਚ ਚਲਾ ਗਿਆ। ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਉਸ ਲੂਪ ਦੇ ਸਿਖਰ 'ਤੇ ਇੱਕ ਕੰਟਰੋਲਰ ਬੋਲਟ ਕਰਦਾ ਹੈ।

1:52 ਇੱਕ ਨੀਤੀ, ਇੱਕ ਅਸਲ ਪਾਈਥਨ ਪ੍ਰੋਗਰਾਮ, ਫੈਸਲਾ ਕਰਦਾ ਹੈ ਕਿ ਖੋਜ ਰੁੱਖ ਦੀਆਂ ਕਿਹੜੀਆਂ ਸ਼ਾਖਾਵਾਂ ਨੂੰ ਵਿਸਤਾਰ ਕਰਨਾ ਹੈ, ਕਿੰਨੀਆਂ ਸਮਾਂਤਰ ਵਿੱਚ, ਅਤੇ ਕਦੋਂ ਛੱਡ ਦੇਣਾ ਹੈ। ਜੈਮਿਨੀ ਉਮੀਦਵਾਰ ਕੋਡ ਲਿਖਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਨਿਰਧਾਰਤ ਮੁਲਾਂਕਣਕਰਤਾ ਇਸਨੂੰ ਸਕੋਰ ਕਰਦਾ ਹੈ। ਹਰ ਰਨ ਕੀ ਕੋਸ਼ਿਸ਼ ਕੀਤੀ ਗਈ ਅਤੇ ਇਸਨੇ ਕੀ ਸਕੋਰ ਕੀਤਾ, ਦਾ ਇੱਕ ਰੁੱਖ ਛੱਡ ਜਾਂਦਾ ਹੈ। ਉਹ ਰੁੱਖ ਇੱਕ ਰੀਪਲੇਅ ਸਿਮੂਲੇਟਰ ਬਣ ਜਾਂਦਾ ਹੈ: ਇੱਕ ਦੂਜਾ, ਬਰਾਬਰ ਫ੍ਰੀਜ਼ ਕੀਤਾ ਗਿਆ ਜੈਮਿਨੀ ਨੀਤੀ ਨੂੰ ਦੁਬਾਰਾ ਲਿਖਦਾ ਹੈ, ਅਤੇ ਨਵੀਂ ਨੀਤੀ ਦੀ ਜਾਂਚ ਰਿਕਾਰਡ ਕੀਤੇ ਨਤੀਜਿਆਂ ਦੇ ਵਿਰੁੱਧ ਕੀਤੀ ਜਾਂਦੀ ਹੈ ਨਾ ਕਿ ਅਸਲ GPUs 'ਤੇ।

2:16 ਪੇਪਰ ਇਸਨੂੰ ਸੁਪਨੇ ਲੈਣਾ ਕਹਿੰਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਅਸਲ ਰਨ ਹਜ਼ਾਰਾਂ ਸੁਪਨੇ ਵਾਲੀਆਂ ਜ਼ੀਰੋ ਐਗਜ਼ੀਕਿਊਸ਼ਨ ਲਾਗਤ 'ਤੇ ਇੱਕ ਲਈ ਭੁਗਤਾਨ ਕਰਦਾ ਹੈ। ਜੇਤੂ ਵਾਪਸ ਔਨਲਾਈਨ ਚਲਾ ਜਾਂਦਾ ਹੈ, ਰਿਕਾਰਡ ਕੀਤੇ ਸੰਸਾਰਾਂ ਦਾ ਪੂਲ ਵਧਦਾ ਹੈ, ਦੁਹਰਾਓ। ਅਤੇ ਅੰਤਿਕਾ B.2 ਵਿੱਚ ਪ੍ਰੋਂਪਟ ਸਵੈ-ਸੁਧਾਰ ਕਰਨ ਵਾਲੀ ਏਆਈ ਨੂੰ ਲਿਖਤ ਵਿੱਚ ਕਹਿੰਦਾ ਹੈ: ਸਿਰਫ਼ ਇਸ ਇੱਕ ਫਾਈਲ ਨੂੰ ਸੰਪਾਦਿਤ ਕਰੋ, ਅਤੇ ਵਿਗਿਆਨਕ ਕੰਮ ਨੂੰ ਹੱਲ ਨਾ ਕਰੋ। ਮਾਪਿਆ ਗਿਆ। ਲਾਸੋ ਸੌਲਵਰ ਕੰਮ 'ਤੇ, ਨਿਰਧਾਰਤ ਖੋਜ ਨੇ 3.6 ਸਕਿੰਟ ਤੱਕ ਪਹੁੰਚਣ ਲਈ 550 ਜੈਮਿਨੀ ਕਾਲਾਂ ਖਰਚ ਕੀਤੀਆਂ, ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਨੇ 2.9 ਤੱਕ ਪਹੁੰਚਣ ਲਈ 317 ਖਰਚ ਕੀਤੇ, ਅਤੇ ਦੋਵਾਂ ਨੇ scikit-learn ਨੂੰ ਹਰਾਇਆ। ਅਤੇ ਦੋਵਾਂ ਨੇ scikit-learn ਨੂੰ ਹਰਾਇਆ।

2:46 ਕਰਨਲਬੈਂਚ 'ਤੇ ਇਸਨੇ ਲਗਭਗ 2.4 ਗੁਣਾ ਘੱਟ ਪੀੜ੍ਹੀਆਂ ਦੇ ਨਾਲ ਉਹੀ ਕਰਨਲ ਸਪੀਡ ਪ੍ਰਾਪਤ ਕੀਤੀ। ਅਤੇ ਸਰਕਲ ਪੈਕਿੰਗ 'ਤੇ ਇਸਨੇ 2.635983 ਸਕੋਰ ਕੀਤਾ, ਜੋ ਕਿ ਬਿਲਕੁਲ, ਛੇ ਦਸ਼ਮਲਵ ਤੱਕ, ਉਹੀ ਹੈ ਜੋ ਅਲਫ਼ਾ ਇਵੋਲਵ ਵਰਜ਼ਨ ਦੋ ਨੇ ਪਿਛਲੇ ਸਾਲ ਸਕੋਰ ਕੀਤਾ ਸੀ। ਪਿਛਲੇ ਸਾਲ ਸਕੋਰ ਕੀਤਾ ਸੀ। ਇਸ ਲਈ X ਨੇ ਸਿਰਲੇਖ ਪੜ੍ਹਿਆ: ਗੂਗਲ ਨੇ ਹੁਣੇ ਹੀ ਰਿਕਰਸਿਵ ਸਵੈ-ਸੁਧਾਰ ਨੂੰ ਕਰੈਕ ਕੀਤਾ। ਹੈਕਰ ਨਿਊਜ਼ ਨੇ PDF ਪੜ੍ਹਿਆ: ਇਸਨੂੰ RSI ਕਹਿਣਾ ਗੁੰਮਰਾਹਕੁੰਨ ਲੱਗਦਾ ਹੈ। ਅਤੇ ਉਸੇ ਹਫ਼ਤੇ ਇੱਕ ਪ੍ਰਤੀਯੋਗੀ ਦੇ ਸੀਈਓ ਨੇ ਕਿਹਾ ਕਿ ਲੂਪ ਗਰਮੀਆਂ ਤੋਂ ਚੱਲ ਰਿਹਾ ਸੀ ਅਤੇ ਸਾਰਿਆਂ ਨੂੰ ਹੌਲੀ ਹੋ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ।

3:13 ਤਿੰਨ ਵਾਕ, ਉਹੀ ਦੋ ਸ਼ਬਦ, ਤਿੰਨ ਵੱਖਰੀਆਂ ਮਸ਼ੀਨਾਂ। ਇਸ ਲਈ, ਸੋਮਵਾਰ, ਅਗਲੇ RSI ਪੇਪਰ ਨੂੰ ਕਿਵੇਂ ਪੜ੍ਹਨਾ ਹੈ। ਇੱਕ: ਪੁੱਛੋ ਕਿ ਕਿਹੜੀ ਵਸਤੂ ਬਦਲਦੀ ਹੈ, ਵਜ਼ਨ, ਕੋਡ, ਜਾਂ ਖੋਜ ਸੈਟਿੰਗਾਂ; ਡ੍ਰੀਮ-ਆਰਐਸਆਈ ਤੀਜੇ ਨੂੰ ਬਦਲਦਾ ਹੈ। ਦੋ: ਪੁੱਛੋ ਕਿ ਕੌਣ ਫ੍ਰੀਜ਼ ਹੈ; ਇੱਥੇ ਇਹ ਕੋਡਰ, ਜੱਜ ਅਤੇ ਦੁਬਾਰਾ ਲਿਖਣ ਵਾਲਾ ਹੈ, ਸਾਰੇ ਤਿੰਨ। ਤਿੰਨ: ਪੁੱਛੋ ਕਿ ਮੁੱਖ ਨੰਬਰ ਕਿਸਦੀ ਇਕਾਈ ਹੈ। ਸੰਭਾਲੀ ਗਈ ਕੰਪਿਊਟ ਅਨੁਕੂਲਨ ਹੈ; ਇੱਕ ਬੈਂਚਮਾਰਕ ਜੋ ਮਾਡਲ ਪਹਿਲਾਂ ਨਹੀਂ ਪਹੁੰਚ ਸਕਿਆ ਉਹ ਇੱਕ ਟੇਕਆਫ ਹੈ, ਅਤੇ ਕਿਸੇ ਨੇ ਵੀ ਅਜੇ ਤੱਕ ਉਹ ਪ੍ਰਕਾਸ਼ਿਤ ਨਹੀਂ ਕੀਤਾ ਹੈ।

3:40 ਫੈਸਲਾ, ਪਰਦੇ ਦੇ ਪਿੱਛੇ: NEEDS REVIEW। ਲੂਪ ਅਸਲੀ ਹੈ, ਬਚਤ ਮਾਪੀ ਗਈ ਹੈ, ਅਤੇ ਕਵਰ 'ਤੇ ਦੋ ਸ਼ਬਦ ਇੱਕ ਮਸ਼ੀਨ ਦਾ ਵਰਣਨ ਕਰਦੇ ਹਨ ਜੋ ਪੇਪਰ ਵਿੱਚ ਨਹੀਂ ਹੈ। ਜੇ ਤੁਸੀਂ ਮੈਨੂੰ ਇਹ ਸੁਣਨ ਦੀ ਬਜਾਏ ਪੜ੍ਹਨਾ ਚਾਹੁੰਦੇ ਹੋ, ਤਾਂ diff ਤੁਹਾਡੇ ਇਨਬਾਕਸ ਵਿੱਚ ਹਰ ਸਵੇਰ ਆਉਂਦਾ ਹੈ, daily diff dot dev 'ਤੇ ਮੁਫ਼ਤ, ਲਿੰਕ ਹੇਠਾਂ ਹੈ। ਮੈਨੂੰ ਟਿੱਪਣੀਆਂ ਵਿੱਚ ਦੱਸੋ ਕਿ ਅੱਗੇ ਕੀ ਖੋਲ੍ਹਣਾ ਹੈ। ਅਤੇ ਅੱਜ ਲਈ ਇਹ diff ਹੈ। ਮੈਂ Axrisi ਤੋਂ ਨਿਕੋ ਹਾਂ।

4:00 ਜ਼ਿੰਮੇਵਾਰੀ ਨਾਲ ਮਿਲਾਓ।

ਸਰੋਤ

  1. Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
  2. Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
  3. Hacker News thread (169 points)news.ycombinator.com
  4. Hugging Face papers (278 upvotes)huggingface.co
  5. I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
  6. Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
  7. Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
  8. Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
  9. Tweetx.com

ਸਬੰਧਤ ਵੀਡੀਓ

under-the-hood · pa · 24 ਸਤੰ 2026

SAML, ਅੰਦਰੂਨੀ ਤੌਰ 'ਤੇ: ਚਿੱਠੀ ਦੇ ਅੰਦਰ ਦਸਤਖਤ

SAML ਤੁਹਾਨੂੰ ਲਗਭਗ ਹਰ ਕੰਮ ਵਾਲੀ ਐਪ ਵਿੱਚ ਲੌਗਇਨ ਕਰਵਾਉਂਦਾ ਹੈ, ਅਤੇ ਇਸਦੇ ਦਸਤਖਤ ਉਸ XML ਦੇ ਅੰਦਰ ਰਹਿੰਦੇ ਹਨ ਜਿਸ 'ਤੇ ਇਹ ਦਸਤਖਤ ਕਰਦਾ ਹੈ। ਅੰਦਰੂਨੀ ਤੌਰ 'ਤੇ: ਐਪ, ਬ੍ਰਾਊਜ਼ਰ ਅਤੇ ਪਛਾਣ ਪ੍ਰਦਾਤਾ ਵਿਚਕਾਰ ਲੌਗਇਨ ਡਾਂਸ, ਇੱਕ ਅਸਰਸ਼ਨ

3:02 ↗
under-the-hood · pa · 23 ਸਤੰ 2026

ਜਦੋਂ ਇੱਕ ਮਾਡਲ ਅੰਦਰੂਨੀ ਤੌਰ 'ਤੇ ਖਤਮ ਹੋ ਜਾਂਦਾ ਹੈ

ਇੱਕ AI ਮਾਡਲ ਖਤਮ ਨਹੀਂ ਹੁੰਦਾ — ਇਸਦੀ ਇੱਕ ਬੰਦ ਹੋਣ ਦੀ ਮਿਤੀ ਹੁੰਦੀ ਹੈ, ਅਤੇ ਅਗਲੀ ਸਵੇਰ, ਤੁਹਾਡੀ API ਕਾਲ 404 ਵਾਪਸ ਕਰਦੀ ਹੈ: "ਮਾਡਲ ਨੂੰ ਬੰਦ ਕਰ ਦਿੱਤਾ ਗਿਆ ਹੈ, ਇੱਥੇ ਹੋਰ ਜਾਣੋ।" ਅੰਦਰੂਨੀ ਤੌਰ 'ਤੇ: ਚਾਰ-ਸਟੇਟ ਪਾਈਪਲਾਈਨ (ਐਕਟਿਵ

3:15 ↗
under-the-hood · pa · 21 ਸਤੰ 2026

ਕਲਾਉਡ ਨੇ RSA-896 ਨੂੰ ਤੋੜਿਆ। ਇੱਥੇ ਦੱਸਿਆ ਗਿਆ ਹੈ ਕਿ RSA ਅਸਲ ਵਿੱਚ ਕਿਵੇਂ ਟੁੱਟਦਾ ਹੈ

19 ਸਤੰਬਰ ਨੂੰ ਇੱਕ ਐਂਥ੍ਰੋਪਿਕ ਇੰਜੀਨੀਅਰ ਨੇ RSA-896 — ਇੱਕ 270-ਅੰਕਾਂ ਦਾ ਚੁਣੌਤੀ ਨੰਬਰ — ਨੂੰ ਕਲਾਉਡ ਨਾਲ, ਜੋ ਕਿ ਓਪਨ-ਸੋਰਸ CADO-NFS sieve ਦਾ ਇੱਕ GPU ਪੋਰਟ ਹੈ ਅਤੇ ਲਗਭਗ 30 GPU-ਸਾਲਾਂ ਨੂੰ 2,048 ਵਿਹਲੇ GPUs 'ਤੇ ਦਸ ਦਿਨਾਂ

3:39 ↗
under-the-hood · pa · 19 ਸਤੰ 2026

ਪਾਸਕੀਜ਼, ਅੰਦਰੂਨੀ

ਇੱਕ ਪਾਸਕੀ ਇੱਕ ਪਾਸਵਰਡ ਹੈ ਜੋ ਤੁਹਾਡਾ ਡਿਵਾਈਸ ਬਣਾਉਂਦਾ ਹੈ, ਤੁਹਾਨੂੰ ਕਦੇ ਨਹੀਂ ਦਿਖਾਉਂਦਾ ਅਤੇ ਕਿਸੇ ਨੂੰ ਵੀ ਦੇਣ ਤੋਂ ਇਨਕਾਰ ਕਰਦਾ ਹੈ — ਭਾਵੇਂ ਤੁਸੀਂ ਖੁਦ ਹੋ। ਅੰਦਰੂਨੀ: WebAuthn ਰਸਮ (ਪ੍ਰਤੀ-ਸਾਈਟ ਕੁੰਜੀ ਜੋੜਾ, ਚੁਣੌਤੀ, ਦਸਤਖਤ),

3:12 ↗