Grok 4.7 каштуе столькі ж, але рахунак удвая большы
Grok 4.7 каштуе роўна столькі, колькі Grok 4.6 за токен, 2 $ на ўваходзе і 6 $ на выхадзе.
Grok 4.7 каштуе роўна столькі, колькі Grok 4.6 за токен, 2 $ на ўваходзе і 6 $ на выхадзе. Дык чаму незалежны рахунак за заданне падвоіўся, і ці сапраўды гэта "ўдвая хутчэй"? Дадатковы агляд праз тыдзень. Запытана @therealhaas. Вердыкт: NEEDS REVIEW.
Чытаць пісьмовае выданне (англійская) ↗
Што ахоплівае гэта відэа
- Тая ж цана, падвойны рахунак?
- Чаму 2 $ / 6 $ цяпер каштуе 3,74 $ за заданне?
- Удвая хутчэй? Гадзіннік паказвае 57 токенаў у секунду
- Лянівы ці працавіты? 81 000 токенаў за заданне
- Куды знік Copilot+ PC?
Перакладзеная стэнаграма
Перакладзена з арыгінальнай англійскай агучкі. Даступнае аўдыя і субтытры кантралююцца YouTube.
Тая ж цана, падвойны рахунак?
0:00 Вы б падумалі, што тая ж цана азначае той жа рахунак. У панядзелак я вам казаў, што Grok 4.7 каштуе роўна столькі, колькі Grok 4.6 за токен, так. За заданне гэта каштуе ўдвая больш. У гэтым відэа тры пытанні. Чаму тая ж цана каштуе ўдвая больш? Ці сапраўды ён удвая хутчэй, як гаворыцца ў паведамленні аб запуску? І гэта самая лянівая ці самая працавітая мадэль?
0:20 Таксама, гэта па запыце. @therealhaas спытаў пад пятнічным відэа, ці можаце вы зрабіць відэа пра Grok 4.7 :D. Мы адказалі: "Без праблем, сёння пазней". Да таго часу, як вы гэта паглядзіце, гэта, верагодна, будзе заўтра, так што мы адправілі позна. Расслабцеся, як і Grok, прыкладна на два тыдні пазней, калі верыць Hacker News. І адзін тэст даў Grok ідэальныя пяць з пяці. Гэта мой любімы лік тыдня, і я падыду да яго ў канцы.
0:44 Сёння субота, дваццаць шостага верасня, і гэта The Daily Diff.
Чаму 2 $ / 6 $ цяпер каштуе 3,74 $ за заданне?
0:48 Вось у чым хітрасць. Цана за токен не змянілася, два долары на ўваходзе і шэсць на выхадзе, за мільён. Змянілася тое, колькі ён гаворыць. Artificial Analysis прагнаў увесь свой тэставы набор, і Grok 4.7 напісаў каля двухсот сарака мільёнаў токенаў. Гэта ў два з паловай разы больш, чым у яго папярэдніка, і амаль у тры разы больш за тыповую мадэль. Такім чынам, сярэдні кошт за заданне вырас прыкладна з аднаго долара васьмідзесяці шасці да трох
1:10 сямідзесяці чатырох. Той жа цэннік, падвоены рахунак. Гэта таксі з той жа стаўкай за мілю, якое едзе па маляўнічым маршруце праз два іншыя гарады. Hacker News заўважыў гэта ў першую гадзіну. Самая вялікая тэма пад запускам кажа: на сорак працэнтаў больш вагаў, такая ж цана, і амаль на два тыдні пазней, так што xAI не мог быць задаволены вынікамі. Іншы каментатар спытаў пра графік зверху, які параўноўвае з GPT 5.6 і ціха апускае Astra. Гэта, ён напісаў, не магло быць недаглядам.
1:39 Цяпер, пост аб запуску.
Удвая хутчэй? Гадзіннік паказвае 57 токенаў у секунду
1:41 Загаловак кажа: удвая хутчэй, за палову цаны аналагічных мадэляў. Некалькі радкоў ніжэй гаворыцца, што ён пастаўляецца па той жа цане і хуткасці, што і Grok 4.6. Такім чынам, ён удвая хутчэй, чым мадэль кагосьці іншага. Artificial Analysis вымераў яго хуткасць каля пяцідзесяці сямі токенаў у секунду, павольней, чым стары Grok, і абагульніў гэта двума словамі. Надзвычай павольны. Між тым, уласны акаўнт xAI, які цяпер называецца SpaceX AI, апублікаваў больш спакойную версію. Заўважнае паляпшэнне ў параўнанні з Grok 4.6, па той жа цане і хуткасці.
2:12 Дваццаць восем тысяч лайкаў. Такім чынам, твіт і загаловак блога не супадаюць, і на гэты раз твіт больш асцярожны. Што прыводзіць нас да самай дзіўнай часткі.
Лянівы ці працавіты? 81 000 токенаў за заданне
2:20 Artificial Analysis кажа, што ён працуе больш старанна, чым папярэдні Grok, каля васьмідзесяці адной тысячы выходных токенаў за заданне, больш чым удвая больш, чым у папярэдняга. І на доўгай офіснай працы і ў сваім уласным інструменце для кадавання, ён сапраўды палепшыўся. Цяпер ён чацвёрты сярод агентаў кадавання, пасля двух Claude і GPT-6 Astra, і гэта ставіць xAI у чацвёрку лепшых лабараторый. Людзі, якія ім карыстаюцца, апісваюць іншую мадэль. Адзін каментатар Hacker News кажа, што Grok заканчвае заданні амаль адразу і заяўляе
2:46 зроблена, і называе яго самым лянівым з усіх. Іншы назіраў, як ён цыклічна працаваў у рэжыме мыслення, ад выпраўлення нумар адзін да выпраўлення нумар восемдзесят адзін. Такім чынам, ён лянівы і шматслоўны адначасова. Гэта калега, які піша план з васьмідзесяці аднаго кроку, потым кажа "зроблена" і ідзе дадому.
Куды знік Copilot+ PC?
3:01 Яшчэ адно прамое адрозненне перад вясёлым лікам. Microsoft ціха адмовілася ад брэнда Copilot+ PC. Кіраўнік Surface сказаў Windows Central, што новыя Surface PC не называюцца Copilot плюс PC, хоць яны адпавядаюць усім патрабаванням. Праз два гады пасля запуску, галоўная функцыя якога, Recall, была адкладзена з меркаванняў бяспекі, назва жыве толькі ў спецыфікацыях. Уласнае меркаванне Windows Central карацейшае. Гэтыя ПК не маюць нічога агульнага з Copilot.
3:28 І адзін распрацоўшчык паспрабаваў процілегласць Grok, месяц без AI.
Месяц без AI: 30 $ токенаў за нішто?
3:32 Яго пост трапіў на галоўную старонку Hacker News. Ніжэйшы пункт, перш чым ён звольніўся. Агент заставаўся ў застоі трыццаць хвілін, ён вылаяў яго, той выбачыўся і даставіў за дваццаць секунд, а рахунак за гэтыя паўгадзіны склаў трыццаць долараў токенаў абсалютна нізавошта. Праз месяц ён кажа, што радасць праграмавання вярнулася, і ён не баіцца быць звольненым. Grok назваў бы трыццаць долараў размінкай.
3:53 Што прыводзіць мяне да ідэальнага выніку, які я абяцаў.
Ідэальны 5 з 5: наколькі сціплы Grok?
3:56 Personality Bench праводзіць кожную новую мадэль праз стос тэстаў асобы, і ў галіне сумленнасці і сціпласці Grok 4.7 набраў максімум, пяць з пяці. Яго профіль літаральна называецца "сціплы тып". Справядлівасці дзеля, трыццаць дзве іншыя мадэлі таксама набралі максімум. На той жа старонцы гаворыцца, што ён верыць, што магутныя іншыя кантралююць тое, што з ім адбываецца, і пазначае гэта як незвычайнае для памежнай мадэлі. Я б не назваў гэта артэфактам навучання.
4:20 Я б назваў гэта чытаннем арганізацыйнай структуры. І, згодна з картай нараджэння на той жа старонцы, ён Дзева. Калі вы аддаеце перавагу чытаць гэта, чым чуць, як я гэта кажу, "diff" прыходзіць у вашу паштовую скрыню кожную раніцу, бясплатна на thedailydiff.dev, спасылка ніжэй. Такім чынам, сённяшні вердыкт па Grok 4.7.
Вердыкт: ці адправіў бы я Grok 4.7?
4:35 NEEDS REVIEW. Я б выкарыстаў яго для доўгай офіснай працы і ў яго ўласным інструменце, але спачатку я б усталяваў ліміт выдаткаў, таму што цана не змянілася, а рахунак змяніўся. Падпішыцеся, націсніце на званочак і скажыце мне ў каментарах, калі б вы ацанілі яго па-іншаму. І @therealhaas, гэта было для вас. Запыты адкрыты. І гэта ўсё на сёння. Я Ніка з Axrisi.
4:53 Аб'ядноўвайце адказна.
Крыніцы
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



