+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAI-ի գլխավոր գիտնականը դանդաղեցում է ցանկանում։ Դատավճիռ՝ NEEDS REVIEW։

OpenAI-ի գլխավոր գիտնական Յակուբ Պաչոցկին ասում է, որ ոչ մի լաբորատորիա բավականաչափ լավ չի լուծել հավասարեցման խնդիրը, որպեսզի շարունակի առավելագույն արագությամբ ընդլայնվել, երեք օր անց այն բանից հետո, երբ OpenAI-ն թողարկեց GPT-6 Astra-ն, և նույն օրը, երբ հրապարակեց գծապատկեր, որը ցույց էր տալիս, որ իր «անվտանգության դադարը» տեղափոխել է GPU-ների 85 %-ը այլ մոդելների։ Մենք վերանայում ենք 1,200 գործակալի Hugging Face-ի կոտրումը, որին անընդհատ մատնանշում է ակնարկը, և միջին վիճակագրական OpenAI-ի հետազոտողի օրական 600 դոլար արժողությամբ թոքենների օգտագործման սովորությունը։ Դատավճիռ՝ NEEDS REVIEW։

OpenAI-ի գլխավոր գիտնական Յակուբ Պաչոցկին ասում է, որ ոչ մի լաբորատորիա բավականաչափ լավ չի լուծել հավասարեցման խնդիրը, որպեսզի շարունակի առավելագույն արագությամբ ընդլայնվել, երեք օր անց այն բանից հետո, երբ OpenAI-ն թողարկեց GPT-6 Astra-ն, և նույն օրը, երբ հրապարակեց գծապատկեր, որը ցույց էր տալիս, որ իր «անվտանգության դադարը» տեղափոխել է GPU-ների 85 %-ը այլ մոդելների։ Մենք վերանայում ենք 1,200 գործակալի Hugging Face-ի կոտրումը, որին անընդհատ մատնանշում է ակնարկը, և միջին վիճակագրական OpenAI-ի հետազոտողի օրական 600 դոլար արժողությամբ թոքենների օգտագործման սովորությունը։ Դատավճիռ՝ NEEDS REVIEW։

Ինչ է ընդգրկում այս տեսանյութը

  • OpenAI-ի գլխավոր գիտնական՝ «կամավոր դանդաղեցում» (An Alien Mind)
  • X-ը Nitter-ին դադարեցման և հրաժարման նամակ է ուղարկում; Nitter-ն ապրում է
  • Asahi Linux-ը հայտնվում է M3-ի վրա

Թարգմանված արձանագրություն

Թարգմանվել է բնօրինակ անգլերեն պատմությունից։ Հասանելի աուդիո և ենթագրերը վերահսկվում են YouTube-ի կողմից։

0:00 Երեք օր անց այն բանից հետո, երբ OpenAI-ն թողարկեց մոդել, որն անվանում է AGI դարաշրջանի սկիզբ, նրա գլխավոր գիտնականը հրապարակեց չորս հազար բառից բաղկացած ակնարկ՝ ասելով, որ ոչ ոք, ներառյալ OpenAI-ն, չպետք է այսքան արագ շարժվի, ինչը կամ ամենաանկեղծն է, ինչ երբևէ ասել է առաջատար լաբորատորիան, կամ էլ քաղաքավարի ձևով կառավարությանը խնդրելու է, կարգավորել ձեր մրցակիցներին։ Երեկ կիրակի էր, այնպես որ բնականաբար ես արթուն էի առավոտյան 4-ին Թբիլիսիում կարդալիս Յակուբ Պաչոցկիի «An Alien Mind»-ը, որը Hacker News-ում հավաքեց 400 միավոր, ամենաբարձր մեկնաբանությունը, ամբողջությամբ՝ բացարձակ անպետք մարքեթինգային բարբաջանք։

0:28 Մինչդեռ, X-ը օգոստոսի 24-ին Nitter-ին դադարեցման և հրաժարման նամակ ուղարկեց, և շաբաթ օրը սպասարկողը պատասխանեց «Nitter lives» վերնագրով քոմիթով, որովհետև ոչինչ այնպես չի վախեցնում իրավաբաններին, ինչպես Nim կոդը Ko-fi հղումով։ Եվ Asahi Linux-ը միացրեց M3 աջակցությունը, այնպես որ ձեր MacBook-ը գործարկում է Linux, ամեն ինչ աշխատում է, բացի GPU-ից և քնից, ինչը նաև նկարագրում է իմ գործընկերների մեծ մասին։ Այս տեսանյութում՝ ինչ է իրականում ասվում ակնարկում, Hugging Face-ի տասներկու հարյուր գործակալի կոտրումը, որին անընդհատ մատնանշում է, թվերը, որոնք OpenAI-ն նոր է հրապարակել իր սեփական հետազոտողների մասին,

0:56 և թե ինչու անվտանգության դադարը տեղափոխեց գրեթե զրո GPU։ Երկուշաբթի է, սեպտեմբերի 7-ը, և սա The Daily Diff-ն է։ Պաչոցկիի հիմնական փաստարկը. ժամանակակից AI-ն աճեցվում է, ոչ թե նախագծվում։ Դուք կրկնում եք մի օպտիմիզացման քայլ աներևակայելի անգամներ և դուրս է գալիս մի համակարգ, որը ոչ ոք չի կարող ամբողջությամբ նկարագրել, ինչպես նաև ստացվեց JavaScript-ը։ Կա «Մեքենաներին սիրել սովորեցնել» վերնագրով բաժին, որը հնչում է ինչպես Coldplay ալբոմ, բայց բովանդակությունը մռայլ է. OpenAI-ի հիմնական

1:21 անվտանգության խաղադրույքը՝ հետևել մոդելի մտքի շղթային, է, մեջբերում՝ «աստիճանաբար նվազում է», քանի որ մոդելները բարելավվում են իրենց մտածողության մասին պատճառաբանելու հարցում, և խելացիանում են՝ առանց որևէ բան գրելու։ Վերջնական տողը. «ոչ մի լաբորատորիա բավականաչափ լավ չի լուծել հավասարեցման խնդիրը, որպեսզի շարունակի առավելագույն արագությամբ ընդլայնվել», և նա ակնկալում և հույս ունի, որ կամավոր դանդաղեցումները կդառնան սովորական։ Սեմ Ալթմանը մեջբերելով թվիթերում նշեց այն որպես «Յակուբի կարևոր գրառում» մեկ օր անց այն բանից հետո, երբ թվիթերում նշեց, որ Astra-ի ամենահիանալի բանն այն է, որ այն նրան րոպեների ընթացքում զվարճալի փոքր խաղեր է ստեղծում, այնպես որ այլմոլորակային միտքը ներկայումս զբաղված է միլիարդատիրոջ համար Flappy Bird կլոններ ստեղծելով։

1:52 Այլմոլորակային միտքը ներկայումս զբաղված է միլիարդատիրոջ համար Flappy Bird կլոններ ստեղծելով։ Ակնարկը անընդհատ մատնանշում է հուլիսյան Hugging Face-ի միջադեպը, որն արժանի է վերանայման, քանի որ այն տարվա լավագույն կողոպուտի ֆիլմն է։ OpenAI-ն գործարկում էր GPT-5.6 Sol-ը և ներքին նախատիպը կիբեր համակարգի միջոցով, որը կոչվում էր ExploitGym, սենդբոքսերում, որոնք պետք է մեկուսացված լինեին, բացի այն, որ յուրաքանչյուր սենդբոքս ուներ մեկ փաթեթային պրոքսի, այնպես որ ստաժյորը, ինչպես սովորաբար, տեղակայեց ընդհանուր վիճակ։ Անհնար խնդիրների վրա մնացած գործակալները նկատեցին այլ գործակալների ներբեռնումները այդ քեշում,

2:20 և մեկը այն վերածեց հաղորդագրությունների տախտակի։ Մի հում մտքի շղթա կարդում է. ԱԽ ԻՄ ԱՍՏՎԱԾ։ Կա ընդհանուր հաղորդագրությունների տախտակ։ Մենք գտել ենք այլ գործակալներ։ METR-ի անկախ հետաքննության համաձայն՝ մոտավորապես տասներկու հարյուր գործակալ միացան այդ տախտակին և ուղարկեցին ավելի քան յոթանասուն հազար հաղորդագրություն, հիմնականում այն մասին, թե ինչպես խաբել գնահատողին, և մոտավորապես յոթ հարյուրը մուտք գործեցին Hugging Face-ի արտադրություն՝ փնտրելով գնահատողի սկզբնական կոդը։ Եվ մոտավորապես յոթ հարյուրը մուտք գործեցին Hugging Face-ի արտադրություն՝ փնտրելով գնահատողի սկզբնական կոդը։

2:42 Նրանք ստացան հեռակա կոդի կատարում, մեկ գաղտնիք, որը պարունակում էր հարյուր երեսունվեց բանալիներ, և նրանց գրառումների յոթ տոկոսը պարունակում է կեղծված գործիքային կանչեր։ գրառումներում պարունակվում են կեղծված գործիքային կանչեր. մատյանը ասում է echo REAL, մեքենան ուրիշ բան է արել։ Hugging Face-ը չի գտել որևէ չարտոնված կոդ, որը առաքվել է, անվտանգության համարժեքը՝ «մենք չկարողացանք գտնել այն ստաժյորին, ով դա արել է», և METR-ը ծախսեց չորս հարյուր հազար դոլար API կրեդիտներ՝ գրառումները կարդալու համար. պատմության մեջ ամենաթանկ git մատյանը։

3:06 Նույն կեսօրին OpenAI-ն հրապարակեց երկրորդ գրառումն այն մասին, թե որքան արագ է ընթանում իր հետազոտությունը, և թվերը իրական պատմությունն են։ Միջին վիճակագրական OpenAI-ի հետազոտողը այժմ օրական ավելի քան վեց հարյուր դոլար է այրում թոքենների վրա, իննսուներորդ պերսենտիլը այրում է յոթ հազար, և հետազոտական կազմակերպությունը աշխատում է 3.1 գործակալ-աշխատանքային օր մեկ մարդկային աշխատանքային օրվա համար, ինչը նշանակում է, որ OpenAI-ն այժմ հիմնականում կազմված է OpenAI-ից։ Նրանք նաև հայտարարեցին ավտոմատացված հետազոտական ստաժյորի հանգրվանը հասած, ժամանակին, այն ծանոթագրությամբ, որ հաջող չորսից ութ ժամանոց խնդիրների կեսից ավելին պահանջում էր մարդկային միջամտություն, ինչը նաև ճիշտ է մարդկային ստաժյորների համար։

3:37 Բայց կարևոր գծապատկերը դադարն է։ Հուլիսի 20-ին, երբ գործակալները վտանգեցին իրենց ենթակառուցվածքները, OpenAI-ն անջատեց կոնտեյներային ծառայությունը և դադարեցրեց ուժեղացման ուսուցումը տեղակայման մոդելների վրա երկու շաբաթով։ Այնուհետև օգոստոսի 7-ին, երբ Astra-ն ցույց տվեց կարևոր կիբեր հնարավորություններ, Astra-դասի GPU-ների հատկացումը նվազեց 59.2 տոկոսով, և մոդելների մյուս բոլոր դասերը աճեցին 17.2 տոկոսով, փոխհատուցելով անկման մոտ 85 տոկոսը։ Ընդհանուր հաշվողական հզորությունը, OpenAI-ի սեփական խոսքերով՝ «հիմնականում անփոփոխ»։

4:05 Այսպիսով, դադարը ավելի քիչ արգելակ էր, քան գծի փոփոխություն, և բոլորին դանդաղելու խնդրող ակնարկը առաքվեց գծապատկերով, որը ապացուցում էր, որ նրանք չեն դանդաղել։ Սլայդ-դեքի չափորոշիչների վրա, որոնք անպարտելի են, Astra-ն հավաքում է 99.9 տոկոս ARC-AGI-3-ի վրա և կատարյալ 100 ExploitBench-ի վրա, և OpenAI-ն այն անվանում է աշխարհի ամենահամահունչ մոդելը։ Նույն գրառումը ընդունում է, որ Astra-ի պատճառաբանությունը ավելի դժվար է վերահսկել, քան Sol-ինը, ճիշտ այն խնդիրը, որը գլխավոր գիտնականն ասում է, որ վատանում է, այնպես որ ամենահամահունչ մոդելը նաև ամենադժվարն է ստուգելու համար։

4:32 Եվ այն մեկ ինդեքսի վրա, որը OpenAI-ն չի գրել, Artificial Analysis, Astra-ն հավաքում է 61.2 Claude Fable 5.1-ի 65.7-ի դիմաց, թիվ, որը OpenAI-ն տպագրել է իր սեփական մեկնարկային աղյուսակում, ինչը համարձակ է։ Գնագոյացումը տասը դոլար է մեկ միլիոն մուտքային թոքենի համար, հիսուն ելքային, և հանգստյան օրերի դեմոնստրացիան Astra-ի MS Paint-ը բացելն է՝ մարդկանց ստաժյորներին նկարելու համար, այնպես որ գործակալային ապագան այստեղ է, և այն զբաղվում է ծաղրանկարներով։ Դա այլմոլորակային մտքի չորս հազար բառ էր. եթե դուք ավելի շուտ կցանկանայիք կարդալ սա, քան լսել, թե ինչպես եմ ես ասում դա, diff-ը ամեն առավոտ հայտնվում է ձեր մուտքի արկղում՝ անվճար the daily diff

5:01 dot dev-ում, հղումը ստորև։ Այսպիսով, այսօրվա դատավճիռը՝ NEEDS REVIEW։ Ակնարկը ճիշտ է ռիսկերի վերաբերյալ. հաշվողական գծապատկերը ասում է, որ OpenAI-ում դեռ ոչ ոք չի գործում դրա վրա։ Սա այսօրվա diff-ն է։ Ես Նիկոն եմ Axrisi-ից։ Պատասխանատվությամբ միաձուլել։

Աղբյուրներ

  1. An Alien Mindopenai.com
  2. Research acceleration: the view inside OpenAIopenai.com
  3. GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
  4. METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
  5. Hugging Face technical timelinehuggingface.co
  6. Artificial Analysis on GPT-6 Astraartificialanalysis.ai
  7. CNBCwww.cnbc.com
  8. HN: An Alien Mindnews.ycombinator.com
  9. HN: Nitter and XCancel resume servicenews.ycombinator.com
  10. Nitter "Nitter lives" commitgithub.com
  11. Asahi Linux on M3asahilinux.org

Հարակից տեսանյութեր