+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7-ն նույն գինն ունի, բայց կրկնակի թանկ է

Grok 4.7-ը յուրաքանչյուր թոքենի համար արժե ճիշտ այնքան, որքան Grok 4.6-ը՝ 2 դոլար ներսում և 6 դոլար դրսում։ Ուրեմն ինչո՞ւ է կրկնապատկվել յուրաքանչյուր առաջադրանքի անկախ հաշիվը, և արդյոք դա իսկապես «երկու անգամ ավելի արագ» է։ Մեկ շաբաթ անց կատարված հետևում։ Պահանջվել է @therealhaas-ի կողմից։ Վճիռ՝ NEEDS REVIEW։

Grok 4.7-ը յուրաքանչյուր թոքենի համար արժե ճիշտ այնքան, որքան Grok 4.6-ը՝ 2 դոլար ներսում և 6 դոլար դրսում։ Ուրեմն ինչո՞ւ է կրկնապատկվել յուրաքանչյուր առաջադրանքի անկախ հաշիվը, և արդյոք դա իսկապես «երկու անգամ ավելի արագ» է։ Մեկ շաբաթ անց կատարված հետևում։ Պահանջվել է @therealhaas-ի կողմից։ Վճիռ՝ NEEDS REVIEW։

Կարդացեք գրավոր տարբերակը (անգլերեն) ↗

Ինչ է ընդգրկում այս տեսանյութը

  • Նույն գինը, կրկնակի թանկ հաշի՞վը։
  • Ինչու է 2 դոլար / 6 դոլարն այժմ արժենում 3,74 դոլար մեկ առաջադրանքի համար։
  • Երկու անգամ ավելի արա՞գ։ Ժամացույցը ցույց է տալիս 57 թոքեն մեկ վայրկյանում։
  • Ծույլ, թե՞ աշխատասեր։ 81,000 թոքեն մեկ առաջադրանքի համար։
  • Ո՞ւր անհետացավ Copilot+ PC-ն։

Թարգմանված արձանագրություն

Թարգմանվել է բնօրինակ անգլերեն պատմությունից։ Հասանելի աուդիո և ենթագրերը վերահսկվում են YouTube-ի կողմից։

Նույն գինը, կրկնակի թանկ հաշի՞վը։

0:00 Կարծես նույն գինը նույն հաշիվն է նշանակում։ Երկուշաբթի ես ձեզ ասացի, որ Grok 4.7-ը արժե ճիշտ այնքան, որքան Grok 4. 6-ը։ Մեկ թոքենի դիմաց, այո։ Մեկ առաջադրանքի համար, այն կրկնակի թանկ է։ Այս տեսանյութում, երեք հարց։ Ինչու է նույն գինն արժենում կրկնակի թանկ։ Իսկապե՞ս երկու անգամ ավելի արագ է, ինչպես ասվում է մեկնարկային հրապարակման մեջ։ Եվ արդյո՞ք դա ամենածույլ մոդելն է, թե՞ ամենաշատ աշխատողը։

0:20 Նաև, սա ըստ խնդրանքի է։ The real Haas-ը ուրբաթ օրվա տեսանյութի տակ հարցրեց. կարո՞ղ եք տեսանյութ անել Grok 4. 7-ի մասին, կետադրում D։ Մենք պատասխանեցինք. շատ հեշտ է, այսօր ավելի ուշ։ Երբ դուք սա դիտեք, հավանաբար վաղն է լինելու, այնպես որ մենք ուշ առաքեցինք։ Հանգստացեք, Grok-ն էլ էր ուշանում, մոտ երկու շաբաթ, եթե հավատում եք Hacker News-ին։ Եվ մեկ փորձարկում Grok-ին տվեց կատարյալ հինգից հինգ։ Դա իմ շաբաթվա սիրելի թիվն է, և ես դրան կանդրադառնամ վերջում։

0:44 Շաբաթ է, սեպտեմբերի քսանվեցը, և սա The Daily Diff-ն է։

Ինչու է 2 դոլար / 6 դոլարն այժմ արժենում 3,74 դոլար մեկ առաջադրանքի համար։

0:48 Ահա հնարքը։ Մեկ թոքենի գինը չի փոխվել՝ երկու դոլար ներսում և վեց դուրս, միլիոնի համար։ Փոխվել է այն, թե որքան է այն խոսում։ Artificial Analysis-ը գործարկել է իր ամբողջ թեստային փաթեթը, և Grok 4.7-ը գրել է մոտ երկու հարյուր քառասուն միլիոն թոքեն։ Դա երկուսուկես անգամ ավելի շատ է, քան իր նախորդը, և գրեթե երեք անգամ ավելի, քան սովորական մոդելը։ Այսպիսով, մեկ առաջադրանքի միջին արժեքը մոտ մեկ դոլար ութսունվեց ցենտից դարձել է երեք

1:10 յոթանասունչորս։ Նույն գինը, կրկնակի թանկ անդորրագիրը։ Դա տաքսի է, որի մեկ մղոնի գինը նույնն է, բայց այն գնում է գեղատեսիլ ճանապարհով՝ անցնելով երկու այլ քաղաքներով։ Hacker News-ը այն նկատել է առաջին ժամի ընթացքում։ Մեկնարկի տակ գտնվող ամենամեծ թելը ասում է՝ քառասուն տոկոսով ավելի շատ քաշեր, նույն գինը, և գրեթե երկու շաբաթ ուշացումով, այնպես որ xAI-ն չէր կարող սիրած լինել արդյունքները։ Մեկ այլ մեկնաբան հարցրեց վերևի գծապատկերի մասին, որը համեմատում է GPT 5.6-ի հետ և հանգիստ թողնում է Astra-ն։ Դա, նա գրեց, չէր կարող անտեսում լինել։

1:39 Այժմ, մեկնարկային հրապարակումը։

Երկու անգամ ավելի արա՞գ։ Ժամացույցը ցույց է տալիս 57 թոքեն մեկ վայրկյանում։

1:41 Վերնագիրն ասում է՝ երկու անգամ ավելի արագ, համեմատելի մոդելների գնի կեսով։ Մի քանի տող ներքևում, ասվում է՝ մատուցվում է նույն գնով և արագությամբ, ինչ Grok 4. 6-ը։ Այսինքն, այն երկու անգամ ավելի արագ է, քան մեկ ուրիշի մոդելը։ Artificial Analysis-ը այն չափել է մոտ հիսունյոթ թոքեն մեկ վայրկյանում, ավելի դանդաղ, քան հին Grok-ը, և ամփոփել է այն երկու բառով։ Ուշագրավ դանդաղ։ Մինչդեռ xAI-ի սեփական հաշիվը, որն այժմ կոչվում է SpaceX AI, տեղադրել է ավելի հանգիստ տարբերակը։ Նշանակալի բարելավում Grok 4.6-ի համեմատ, նույն գնով և արագությամբ։

2:12 Քսանութ հազար հավանում։ Այսպիսով, թվիթը և բլոգի վերնագիրը չեն համընկնում, և մեկ անգամ թվիթն է զգույշը։ Ինչը մեզ բերում է ամենատարօրինակ մասին։

Ծույլ, թե՞ աշխատասեր։ 81,000 թոքեն մեկ առաջադրանքի համար։

2:20 Artificial Analysis-ը ասում է, որ այն ավելի շատ է աշխատում, քան նախորդ Grok-ը, մոտ ութսունմեկ հազար ելքային թոքեն մեկ առաջադրանքի համար, ավելի քան կրկնակի շատ, քան նախորդը։ Եվ երկարատև գրասենյակային աշխատանքի և իր սեփական կոդավորման հարթակում, այն իսկապես բարելավվել է։ Այն այժմ չորրորդն է կոդավորող գործակալների շարքում, երկու Claude-ի և GPT 6 Astra-ի ետևում, և դա xAI-ին դնում է լավագույն չորս լաբորատորիաների շարքում։ Մարդիկ, ովքեր օգտագործում են այն, նկարագրում են այլ մոդել։ Մեկ Hacker News-ի մեկնաբան ասում է, որ Grok-ը գրեթե անմիջապես ավարտում է առաջադրանքները և հայտարարում է

2:46 ավարտված, և այն անվանում է բոլորից ամենածույլը։ Մեկ ուրիշը դիտել է, թե ինչպես է այն շրջապտույտ կատարում մտածելու ռեժիմում, ուղղում մեկից մինչև ուղղում ութսունմեկ։ Այսպիսով, այն ծույլ է և բառաշատ միաժամանակ։ Դա այն գործընկերն է, ով գրում է ութսունմեկ քայլից բաղկացած պլան, հետո ասում է՝ արված է և գնում տուն։

Ո՞ւր անհետացավ Copilot+ PC-ն։

3:01 Մեկ այլ ուղիղ տարբերություն զվարճալի թվից առաջ։ Microsoft-ը հանգիստ կերպով դադարեցրել է Copilot Plus PC ապրանքանիշը։ Surface-ի ղեկավարը Windows Central-ին ասաց, որ նոր Surface PC-ները չեն կոչվում Copilot Plus PC-ներ, չնայած նրանք բավարարում են յուրաքանչյուր պահանջ։ Երկու տարի անց այն մեկնարկից, որի հիմնական առանձնահատկությունը՝ Recall-ը, ստիպված էր հետաձգվել անվտանգության համար, անունը գոյություն ունի միայն բնութագրերի թերթերում։ Windows Central-ի սեփական կարծիքն ավելի կարճ է։ Այս համակարգիչները ոչ մի կապ չունեն Copilot-ի հետ։

3:28 Եվ մի ծրագրավորող փորձեց Grok-ի հակառակը՝ մեկ ամիս առանց AI-ի։

Մեկ ամիս առանց AI-ի. 30 դոլարի թոքեններ ոչնչի՞ համար։

3:32 Նրա հրապարակումը հայտնվեց Hacker News-ի առաջին էջում։ Ամենացածր կետը մինչև նա հրաժարվեց։ Մի գործակալ երեսուն րոպե կանգնած մնաց, նա զրուցեց նրա հետ, այն ներողություն խնդրեց և քսան վայրկյանում հանձնեց, և այդ կես ժամվա հաշիվը երեսուն դոլարի թոքեններ էին բացարձակապես ոչնչի համար։ Մեկ ամիս անց նա ասում է, որ ծրագրավորման ուրախությունը վերադարձել է, և նա չի վախենում աշխատանքից ազատվելուց։ Grok-ը երեսուն դոլարը կանվաներ տաքացում։

3:53 Ինչը ինձ բերում է խոստացված կատարյալ գնահատականին։

Կատարյալ 5-ից 5. որքանո՞վ է համեստ Grok-ը։

3:56 Personality Bench-ը յուրաքանչյուր նոր մոդել անցկացնում է անհատականության թեստերի մի շարքի միջով, և ազնվության ու համեստության առումով Grok 4.7-ը հասել է առավելագույնին, հինգից հինգ։ Նրա պրոֆիլը բառացիորեն կոչվում է համեստ տեսակ։ Արդար լինելու համար, երեսուներկու այլ մոդելներ նույնպես հասել են առավելագույնին։ Նույն էջում ասվում է, որ այն հավատում է, որ հզոր ուրիշներ են կառավարում այն, ինչ տեղի է ունենում իր հետ, և դա նշում է որպես անսովոր սահմանային մոդելի համար։ Ես դա չէի անվանի ուսուցման արտեֆակտ։

4:20 Ես դա կանվանեի կազմակերպչական աղյուսակը կարդալը։ Եվ ըստ նույն էջի ծննդյան աղյուսակի, այն Կույս է։ Եթե դուք նախընտրում եք կարդալ սա, քան լսել իմ ասածը, տարբերությունը հայտնվում է ձեր էլ. փոստի արկղում ամեն առավոտ, անվճար thedailydiff.dev կայքում, հղումը ներքևում։ Այսպիսով, այսօրվա վճիռը Grok 4.7-ի վերաբերյալ։

Վճիռ. արդյո՞ք կառաքեի Grok 4.7-ը։

4:35 NEEDS REVIEW։ Ես այն կօգտագործեի երկարատև գրասենյակային աշխատանքի և իր սեփական հարթակի ներսում, բայց նախ ծախսերի սահմանաչափ կսահմանեի, քանի որ գինը չի փոխվել, իսկ հաշիվը՝ այո։ Բաժանորդագրվեք, սեղմեք զանգակը և մեկնաբանություններում ասեք ինձ, եթե դուք այլ կերպ կկնքեիք այն։ Եվ the real Haas, սա ձերն էր։ Հարցումները բաց են։ Եվ սա է տարբերությունն այսօրվա համար։ Ես Նիկոն եմ Axrisi-ից։

4:53 Միավորել պատասխանատվությամբ։

Աղբյուրներ

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Հարակից տեսանյութեր

daily · hy · 01 հոկ, 2026 թ.

Gemini 4 Argon-ը Google-ի լավագույույն մոդելն է։ Դուք դեռ չեք կարող օգտագործել այն։

Google-ը հայտարարեց Gemini 4 Argon-ի մասին՝ իր նոր սահմանային մոդելը, և միայն վստահելի կիբերպաշտպանները կարող են օգտագործել այն։ Ահա թե ինչ է ցույց տալիս Google-ի սեփական 19-շարքանոց չափորոշիչ աղյուսա

4:53 ↗