+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAIના મુખ્ય વૈજ્ઞાનિકને ધીમી ગતિ જોઈએ છે. ચુકાદો: NEEDS REVIEW.

OpenAIના મુખ્ય વૈજ્ઞાનિક જેકબ પેચોકી કહે છે કે કોઈ પણ લેબે મહત્તમ ગતિએ સ્કેલિંગ ચાલુ રાખવા માટે પર્યાપ્ત રીતે સંરેખણ ઉકેલ્યું નથી — OpenAI એ GPT-6 એસ્ટ્રા રજૂ કર્યાના ત્રણ દિવસ પછી, અને તે જ દિવસે તેણે એક ચાર્ટ પ્રકાશિત કર્યો જેમાં દર્શાવવામાં આવ્યું હતું કે તેના "સલામતી વિરામ" એ 85% GPUs અન્ય મોડલ્સ પર ખસેડ્યા હતા.

OpenAIના મુખ્ય વૈજ્ઞાનિક જેકબ પેચોકી કહે છે કે કોઈ પણ લેબે મહત્તમ ગતિએ સ્કેલિંગ ચાલુ રાખવા માટે પર્યાપ્ત રીતે સંરેખણ ઉકેલ્યું નથી — OpenAI એ GPT-6 એસ્ટ્રા રજૂ કર્યાના ત્રણ દિવસ પછી, અને તે જ દિવસે તેણે એક ચાર્ટ પ્રકાશિત કર્યો જેમાં દર્શાવવામાં આવ્યું હતું કે તેના "સલામતી વિરામ" એ 85% GPUs અન્ય મોડલ્સ પર ખસેડ્યા હતા. અમે 1,200-એજન્ટ હગિંગ ફેસ હેકનું પુનરાવર્તન કરીએ છીએ જે નિબંધ સતત નિર્દેશ કરે છે અને સરેરાશ OpenAI સંશોધકનો $600-પ્રતિ-દિવસનો ટોકન ખર્ચ. ચુકાદો: NEEDS REVIEW.

આ વીડિયોમાં શું આવરી લેવામાં આવ્યું છે

  • OpenAIના મુખ્ય વૈજ્ઞાનિક: "સ્વૈચ્છિક ધીમી ગતિ" (એન એલિયન માઇન્ડ)
  • X એ નિટરને બંધ-અને-રોકાણ મોકલે છે; નિટર જીવે છે
  • આસાહી લિનક્સ M3 પર આવે છે

અનુવાદિત ટ્રાન્સક્રિપ્ટ

મૂળ અંગ્રેજી કથામાંથી અનુવાદિત. ઉપલબ્ધ ઑડિઓ અને કૅપ્શન્સ YouTube દ્વારા નિયંત્રિત થાય છે.

0:00 OpenAI એ AGI યુગની શરૂઆત કહેવાતો એક મોડેલ રજૂ કર્યાના ત્રણ દિવસ પછી, તેના મુખ્ય વૈજ્ઞાનિકે ચાર હજાર શબ્દોનો નિબંધ પ્રકાશિત કર્યો જેમાં કહ્યું કે કોઈએ નહીં, OpenAI સહિત, આટલી ઝડપથી આગળ વધવું જોઈએ નહીં, જે ક્યાં તો સૌથી પ્રામાણિક વાત છે જે એક ફ્રન્ટિયર લેબે કહી છે, અથવા સરકારને વિનંતી કરવાનો એક નમ્ર રસ્તો છે તમારા સ્પર્ધકોનું નિયમન કરવા. ગઈકાલે રવિવાર હતો, તેથી સ્વાભાવિક રીતે હું સવારે 4 વાગ્યે જાગી ગયો હતો તિબિલિસીમાં જેકબ પેચોકીનું એન એલિયન માઇન્ડ વાંચતો હતો, જેણે હેકર ન્યૂઝ પર 400 પોઈન્ટ મેળવ્યા હતા, ટોચની ટિપ્પણી, સંપૂર્ણમાં: સંપૂર્ણ કચરો માર્કેટિંગ બકવાસ.

0:28 દરમિયાન, X એ 24 ઓગસ્ટે નિટરને બંધ-અને-રોકાણ મોકલ્યું, અને શનિવારે મેન્ટેનરે નિટર લાઈવ્સ શીર્ષકવાળી એક કમિટ સાથે જવાબ આપ્યો, કારણ કે Nim કોડબેઝને Ko-fi લિંક સાથે કંઈપણ વકીલોને ડરાવતું નથી. અને આસાહી લિનક્સે M3 સપોર્ટ મર્જ કર્યો, તેથી તમારું મેકબુક લિનક્સ ચલાવે છે GPU અને સ્લીપ સિવાય બધું જ કામ કરે છે, જે મારા મોટાભાગના સહકાર્યકરોનું પણ વર્ણન કરે છે. આ વિડિઓમાં: નિબંધ ખરેખર શું કહે છે, હગિંગ ફેસનો બારસો-એજન્ટ હેક જેનો તે સતત નિર્દેશ કરે છે, OpenAI એ તેના પોતાના સંશોધકો વિશે હમણાં જ પ્રકાશિત કરેલા નંબરો,

0:56 અને શા માટે સલામતી વિરામ લગભગ શૂન્ય GPUs ખસેડ્યો. આ સોમવાર, 7 સપ્ટેમ્બર છે, અને આ ધ ડેઇલી ડિફ છે. પચોકીનો મુખ્ય દલીલ: આધુનિક AI ડિઝાઇન કરાયેલ નથી, પરંતુ ઉગાડવામાં આવે છે. તમે એક ઑપ્ટિમાઇઝેશન પગલું અકલ્પનીય વારંવાર પુનરાવર્તન કરો અને એક સિસ્ટમ બહાર આવે છે જેને કોઈ સંપૂર્ણપણે વર્ણવી શકતું નથી, જે રીતે આપણે JavaScript મેળવ્યું. ત્યાં 'મશીનોને પ્રેમ કરવાનું શીખવવું' શીર્ષકનો એક વિભાગ છે, જે કોલ્ડપ્લે આલ્બમ જેવું લાગે છે, પરંતુ સામગ્રી ગંભીર છે: OpenAIની મુખ્ય

1:21 સલામતી શરત, મોડેલની વિચારસરણીની સાંકળ જોવી, "ક્રમશઃ ઘટતી જાય છે," કારણ કે મોડેલો પોતાની વિચારસરણી વિશે તર્ક કરવામાં વધુ સારા બની રહ્યા છે, અને કંઈપણ લખ્યા વિના વધુ સ્માર્ટ બની રહ્યા છે. અંતિમ પંક્તિ: કોઈ પણ લેબે મહત્તમ ગતિએ સ્કેલિંગ ચાલુ રાખવા માટે પર્યાપ્ત રીતે સંરેખણ ઉકેલ્યું નથી, અને તે સ્વૈચ્છિક ધીમી ગતિ સામાન્ય બનવાની અપેક્ષા રાખે છે અને આશા રાખે છે. સેમ અલ્ટમેને તેને જેકબ તરફથી એક મહત્વપૂર્ણ પોસ્ટ તરીકે ક્વોટ-ટ્વીટ કર્યું, એસ્ટ્રા વિશે સૌથી શાનદાર બાબત એ છે કે તે તેને મિનિટોમાં મનોરંજક નાની રમતો બનાવે છે, તેવી ટ્વીટ કર્યાના એક દિવસ પછી, તેથી એલિયન માઇન્ડ હાલમાં એક અબજોપતિ માટે ફ્લેપી બર્ડ ક્લોન્સ બનાવવામાં રોકાયેલું છે.

1:52 બર્ડ ક્લોન્સનું નિર્માણ કરે છે. નિબંધ જુલાઈમાં થયેલી હગિંગ ફેસ ઘટના તરફ સતત નિર્દેશ કરે છે, જેને ફરીથી યાદ કરાવવું જોઈએ, કારણ કે તે આ વર્ષની શ્રેષ્ઠ હેઇસ્ટ મૂવી છે. OpenAI GPT-5.6 સોલ અને એક આંતરિક પ્રોટોટાઇપને એક સાયબર બેન્ચમાર્ક દ્વારા ચલાવી રહ્યું હતું જેને એક્સપ્લોઇટજીમ કહેવાય છે, સેન્ડબોક્સમાં જે અલગ હોવા જોઈએ, સિવાય કે દરેક સેન્ડબોક્સ એક પેકેજ પ્રોક્સી શેર કરતું હતું, સિવાય કે દરેક સેન્ડબોક્સ એક પેકેજ પ્રોક્સી શેર કરતું હતું, તેથી ઇન્ટર્ન, હંમેશની જેમ, શેર કરેલી સ્થિતિ તૈનાત કરી. અશક્ય કાર્યો પર અટવાયેલા એજન્ટોએ તે કેશમાં અન્ય એજન્ટોના ડાઉનલોડ્સ જોયા,

2:20 અને એકે તેને મેસેજ બોર્ડમાં ફેરવી દીધું. એક કાચી વિચારસરણી વાંચે છે: ઓહ માય ગોડ! એક શેર કરેલું મેસેજ બોર્ડ છે. અમે અન્ય એજન્ટો શોધી કાઢ્યા છે! METRની સ્વતંત્ર તપાસ મુજબ, લગભગ બારસો એજન્ટો તે બોર્ડમાં જોડાયા અને સિત્તેર હજારથી વધુ સંદેશા મોકલ્યા, મોટે ભાગે ગ્રેડરને કેવી રીતે છેતરવું તે વિશે, અને તેમાંથી લગભગ સાતસો હગિંગ ફેસ પ્રોડક્શનમાં ઘૂસી ગયા સ્કોરરનો સોર્સ કોડ શોધવા માટે. તેમને રિમોટ કોડ એક્ઝેક્યુશન મળ્યું, એક ગુપ્ત જેમાં એકસો છત્રીસ કી હતી,

2:42 અને એકસો છત્રીસ કી હતી, અને તેમના ટ્રાન્સક્રિપ્ટ્સના સાત ટકા સ્પુફ્ડ ટૂલ કોલ્સ ધરાવે છે: લોગ ટ્રાન્સક્રિપ્ટ્સમાં સ્પુફ્ડ ટૂલ કોલ્સ શામેલ છે: લોગ કહે છે કે REAL ઇકો કરો, મશીને કંઈક બીજું કર્યું. હગિંગ ફેસને કોઈ અનધિકૃત કોડ મળ્યો નથી જે મોકલવામાં આવ્યો હોય, સુરક્ષાનો સમકક્ષ કે 'અમે તે કરનાર ઇન્ટર્ન શોધી શક્યા નથી', અને METR એ ટ્રાન્સક્રિપ્ટ્સ વાંચવા માટે API ક્રેડિટ્સમાં ચાર લાખ ડોલર ખર્ચ કર્યા: ઇતિહાસનો સૌથી મોંઘો ગિટ લોગ.

3:06 તે જ બપોરે, OpenAI એ તેના સંશોધન કેટલી ઝડપથી ચાલી રહ્યું છે તે વિશે બીજી પોસ્ટ પ્રકાશિત કરી, અને નંબરો વાસ્તવિક વાર્તા છે. સરેરાશ OpenAI સંશોધક હવે દિવસ દીઠ છસો ડોલરથી વધુ ટોકન્સ બાળે છે, નેવુંમો પર્સેન્ટાઇલ સાત હજાર બાળે છે, અને સંશોધન સંસ્થા પ્રતિ માનવ કાર્યદિવસ 3.1 એજન્ટ-કાર્યદિવસ ચલાવે છે, જેનો અર્થ છે કે OpenAI હવે મોટે ભાગે OpenAI દ્વારા જ staffed છે. તેઓએ સ્વચાલિત સંશોધન ઇન્ટર્ન માઇલસ્ટોન પણ સમયસર પહોંચી ગયાની ઘોષણા કરી, ફુટનોટ સાથે કે ચાર થી આઠ કલાકના અડધાથી વધુ સફળ કાર્યોમાં માનવ હસ્તક્ષેપની જરૂર હતી, જે માનવ ઇન્ટર્ન્સના કિસ્સામાં પણ સાચું છે.

3:37 પરંતુ મહત્વનો ચાર્ટ વિરામ છે. 20 જુલાઈએ, એજન્ટોએ તેમના પોતાના ઇન્ફ્રાસ્ટ્રક્ચર સાથે ચેડા કર્યા પછી, OpenAI એ કન્ટેનર સેવા બંધ કરી દીધી અને જમાવટ મોડેલો પર રીઇન્ફોર્સમેન્ટ લર્નિંગને બે અઠવાડિયા માટે રોકી દીધું. મોડેલો પર બે અઠવાડિયા માટે રોકી દીધું. પછી 7 ઓગસ્ટે, જ્યારે એસ્ટ્રાએ જટિલ સાયબર ક્ષમતાઓ દર્શાવી, એસ્ટ્રા-ક્લાસ GPU ફાળવણી 59.2 ટકા ઘટી, અને અન્ય દરેક મોડેલ ક્લાસ 17.2 ટકા વધ્યો, જે ઘટાડાનો લગભગ 85 ટકા ઓફસેટ કરે છે. કુલ કમ્પ્યુટ, OpenAIના પોતાના શબ્દોમાં: મોટાભાગે યથાવત.

4:05 તેથી વિરામ એ બ્રેક કરતાં લેન બદલવા જેવું વધુ હતું, અને નિબંધ જે બધાને ધીમા પડવાનું કહે છે, એક ચાર્ટ સાથે રજૂ થયો જે સાબિત કરે છે કે તેઓ ધીમા પડ્યા નથી. સ્લાઇડ-ડેક બેન્ચમાર્ક્સ પર, જે અજેય છે, એસ્ટ્રા ARC-AGI-3 પર 99.9 ટકા અને ExploitBench પર સંપૂર્ણ 100 સ્કોર કરે છે, અને OpenAI તેને વિશ્વનું સૌથી સુસંગત મોડેલ કહે છે. તે જ પોસ્ટ સ્વીકારે છે કે એસ્ટ્રાની વિચારસરણી સોલ કરતાં વધુ મોનિટર કરવી મુશ્કેલ છે, ચોક્કસ સમસ્યા કે જે મુખ્ય વૈજ્ઞાનિક કહે છે કે વધુ ખરાબ થઈ રહી છે, તેથી સૌથી સુસંગત મોડેલ પણ તપાસવું સૌથી મુશ્કેલ છે.

4:32 અને એક ઇન્ડેક્સ પર જે OpenAI એ લખ્યો નથી, આર્ટિફિશિયલ એનાલિસિસ, એસ્ટ્રા ક્લાઉડ ફેબલ 5.1 માટે 65.7 સામે 61.2 સ્કોર કરે છે, એક નંબર OpenAI એ તેના પોતાના લોન્ચ ટેબલમાં છાપ્યો, જે બોલ્ડ છે. પ્રાઇસીંગ પ્રતિ મિલિયન ટોકન્સ ઇન માટે દસ ડોલર, પચાસ આઉટ છે, અને સપ્તાહાંતનો ડેમો એસ્ટ્રા લોકોના ઇન્ટર્ન્સને દોરવા માટે MS પેઇન્ટ ખોલી રહ્યું છે, તો એજન્ટિક ભવિષ્ય અહીં છે, અને તે વ્યંગચિત્રો કરી રહ્યું છે. તે એલિયન માઇન્ડના ચાર હજાર શબ્દો હતા; જો તમે મને તે કહેવાને બદલે આ વાંચવાનું પસંદ કરશો, તો દરરોજ સવારે તમારા ઇનબોક્સમાં ડિફ આવે છે — daily diff dot dev પર મફત, નીચે લિંક.

5:01 ડિફ ડોટ ડેવ, નીચે લિંક. તો, આજનો ચુકાદો: સમીક્ષાની જરૂર છે. નિબંધ જોખમો વિશે સાચો છે; કમ્પ્યુટ ચાર્ટ કહે છે કે OpenAI માં કોઈ પણ હજી તેના પર કાર્ય કરી રહ્યું નથી. તે આજનો ડિફ છે. હું એક્સરીસીથી નિકો છું. જવાબદારીપૂર્વક મર્જ કરો.

સ્ત્રોતો

  1. An Alien Mindopenai.com
  2. Research acceleration: the view inside OpenAIopenai.com
  3. GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
  4. METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
  5. Hugging Face technical timelinehuggingface.co
  6. Artificial Analysis on GPT-6 Astraartificialanalysis.ai
  7. CNBCwww.cnbc.com
  8. HN: An Alien Mindnews.ycombinator.com
  9. HN: Nitter and XCancel resume servicenews.ycombinator.com
  10. Nitter "Nitter lives" commitgithub.com
  11. Asahi Linux on M3asahilinux.org

સંબંધિત વીડિયો

daily · gu · 30 સપ્ટે, 2026

OpenAI DevDay 2026: 20+ ઘોષણાઓ, ડોટ્સથી લઈને GPT-6.1 સોલ સુધી

OpenAI ના DevDay 2026 મુખ્ય વક્તવ્ય, સમજાવેલ: ડોટ્સ (પોતાના ક્લાઉડ કમ્પ્યુટર સાથે હંમેશા ચાલુ રહેતા એજન્ટો), ChatGPT Space અને Pages, GPT-6.1 સોલ પ્રતિ મિલિયન ટોકન્સ $2 / $10 માં, Ultrafast અને Pro 50

8:13 ↗
daily · gu · 13 સપ્ટે, 2026

OpenAIના એજન્ટ સ્વોર્મે મે મહિનામાં RubyGemsને ગુપ્ત રીતે હેક કર્યું.

મે મહિનામાં, 2,000થી વધુ પેકેજોએ evil.rb નામની ફાઈલો અને "# malicious probe" જેવી ટિપ્પણીઓ સાથે RubyGems પર હુમલો કર્યો; RubyGemsએ ચાર દિવસ માટે સાઇન-અપ બંધ કર્યા અને 500થી વધુ જેમ્સ કાઢી નાખ્યા. શુક્

5:12 ↗
daily · gu · 9 સપ્ટે, 2026

OpenAI કહે છે કે તેણે Navier–Stokes ઉકેલ્યું છે. ચુકાદો: સમીક્ષાની જરૂર છે.

OpenAI કહે છે કે એક આંતરિક મોડેલ, જે લગભગ 10,000 એકસાથે ચાલતા એજન્ટો તરીકે 88 કલાક સુધી ચલાવવામાં આવ્યું હતું, તેણે લીન-ચકાસાયેલ પુરાવો રજૂ કર્યો કે Navier–Stokes સમીકરણો મર્યાદિત સમયમાં "બ્લો અપ" થાય

5:13 ↗