+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 струва същото, но сметките са двойни

Grok 4.7 струва точно толкова, колкото Grok 4.6 на токен, $2 входящи и $6 изходящи.

Grok 4.7 струва точно толкова, колкото Grok 4.6 на токен, $2 входящи и $6 изходящи. И така, защо независимата сметка на задача се удвои и наистина ли е „два пъти по-бърз“? Последваща проверка седмица по-късно. Поискана от @therealhaas. Присъда: НЕОБХОДИМ ПРЕГЛЕД.

Прочетете писменото издание (английски) ↗

Какво обхваща този видеоклип

  • Същата цена, двойна сметка?
  • Защо $2 / $6 сега струва $3.74 на задача?
  • Два пъти по-бързо? Часовникът показва 57 токена в секунда
  • Мързелив или трудолюбив? 81 000 токена на задача
  • Къде отиде Copilot+ PC?

Преведен препис

Преведено от оригиналния английски разказ. Наличните аудио и субтитри се контролират от YouTube.

Същата цена, двойна сметка?

0:00 Бихте си помислили, че същата цена означава същата сметка. В понеделник ви казах, че Grok четири точка седем струва точно толкова, колкото Grok четири точка шест. На токен, да. На задача струва двойно. В това видео, три въпроса. Защо същата цена струва двойно? Наистина ли е два пъти по-бързо, както пише в публикацията за стартиране? И това ли е най-мързеливият модел наоколо, или най-трудолюбивият?

0:20 Също така, този е по заявка. Истинският Хаас попита под видеото от петък, можеш ли да направиш видео за Grok четири точка седем, двоеточие Д. Отговорихме: лесно, по-късно днес. Докато гледате това, вероятно е утре, така че SHIP IT късно. Отпуснете се, както и Grok, с около две седмици закъснение, ако вярвате на Hacker News. И един тест даде на Grok перфектни пет от пет. Това е любимото ми число за седмицата и ще стигна до него накрая.

0:44 Днес е събота, двадесет и шести септември, и това е The Daily Diff.

Защо $2 / $6 сега струва $3.74 на задача?

0:48 Ето хитростта. Цената на токен не се промени, два долара входящи и шест изходящи, на милион. Това, което се промени, е колко много говори. Artificial Analysis проведе целия си набор от тестове, а Grok четири точка седем написа около двеста и четиридесет милиона токена. Това е два и половина пъти повече от своя предшественик, и почти три пъти повече от типичен модел. Така че средната цена на задача се промени от около долар осемдесет и шест на три

1:10 седемдесет и четири. Същата цена, двойна разписка. Това е такси със същата тарифа на миля, което поема живописния маршрут през два други града. Hacker News го забеляза в първия час. Най-голямата тема под старта казва четиридесет процента повече тежести, същата цена и почти две седмици закъснение, така че xAI не може да е харесал резултатите. Друг коментатор попита за графиката отгоре, която сравнява с GPT пет точка шест и тихо пропуска Astra. Това, писа той, не може да е било пропуск.

1:39 Сега, публикацията за стартиране.

Два пъти по-бързо? Часовникът показва 57 токена в секунда

1:41 Заглавието гласи два пъти по-бързо, на половин цена от сравними модели. Няколко реда по-надолу пише, че се предлага на същата цена и скорост като Grok четири точка шест. Значи е два пъти по-бързо от модел на някой друг. Artificial Analysis го е измерил на около петдесет и седем токена в секунда, по-бавно от стария Grok, и го обобщи с две думи. Забележително бавно. Междувременно, собственият акаунт на xAI, който вече се нарича SpaceX AI, публикува по-спокойната версия. Забележително подобрение спрямо Grok четири точка шест, на същата цена и скорост.

2:12 Двадесет и осем хиляди харесвания. Така че туитът и заглавието на блога не съвпадат, и за пръв път туитът е предпазливият. Което ни води до най-странната част.

Мързелив или трудолюбив? 81 000 токена на задача

2:20 Artificial Analysis казва, че работи по-усилено от предишния Grok, около осемдесет и една хиляди изходни токена на задача, повече от два пъти повече от предишния. И при дълга офис работа и в собствения си кодиращ хамут, наистина се подобри. Сега е четвърти сред кодиращите агенти, след два Claude и GPT шест Astra, и това поставя xAI сред четирите най-добри лаборатории. Хората, които го използват, описват различен модел. Един коментатор в Hacker News казва, че Grok завършва задачи почти веднага и твърди,

2:46 че е готов, и го нарича най-мързеливия от всички тях. Друг го е гледал как цикли в режим на мислене, от поправка едно чак до поправка осемдесет и едно. Така че е мързелив и многословен едновременно. Това е колегата, който пише план от осемдесет и една стъпки, след това казва готово и си тръгва.

Къде отиде Copilot+ PC?

3:01 Още една пряка разлика преди забавното число. Microsoft тихо прекрати марката Copilot plus PC. Шефът на Surface каза на Windows Central, че новите Surface PC не се наричат Copilot плюс PC, въпреки че отговарят на всяко изискване. Две години след стартиране, чиято основна функция, Recall, трябваше да бъде отложена от съображения за сигурност, името живее само в спецификационни листове. Собственото мнение на Windows Central е по-кратко. Тези компютри нямат нищо общо с Copilot.

3:28 И един разработчик опита обратното на Grok, месец с нулев AI.

Месец с нулев AI: $30 токена за нищо?

3:32 Неговата публикация стигна до първа страница на Hacker News. Най-ниската точка, преди да напусне. Агент седял спрял тридесет минути, той му се скарал, той се извинил и доставил за двадесет секунди, а сметката за този половин час била тридесет долара токени за абсолютно нищо. Месец по-късно той казва, че радостта от програмирането се е върнала, и не се страхува да бъде уволнен. Grok би нарекъл тридесет долара загрявка.

3:53 Което ме води до перфектния резултат, който обещах.

Перфектните 5 от 5: колко скромен е Grok?

3:56 Personality Bench провежда всеки нов модел през набор от личностни тестове, и по отношение на честност и скромност, Grok четири точка седем достигна максимума, пет от пет. Неговият профил буквално се нарича смиреният тип. За да бъдем честни, тридесет и два други модела също го достигнаха максимума. Същата страница казва, че той вярва, че могъщи други контролират какво се случва с него, и отбелязва това като необичайно за пограничен модел. Не бих нарекъл това артефакт от обучение.

4:20 Бих го нарекъл четене на организационната схема. И според рождената карта на същата страница, той е Дева. Ако предпочитате да прочетете това, вместо да ме чуете да го казвам, разликата пристига във входящата ви кутия всяка сутрин, безплатно на daily diff dot dev, линк по-долу. И така, днешната присъда за Grok четири точка седем.

Присъда: бих ли SHIP IT Grok 4.7?

4:35 НЕОБХОДИМ ПРЕГЛЕД. Бих го използвал за дълга офис работа и в собствения му хамут, но първо бих му поставил таван на разходите, защото цената не се промени, а сметката се промени. Абонирайте се, натиснете камбанката и ми кажете в коментарите дали бихте го подпечатали по различен начин. И истинският Хаас, този беше ваш. Заявките са отворени. И това е разликата за днес. Аз съм Нико от Axrisi.

4:53 Сливайте отговорно.

Източници

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Свързани видеоклипове

daily · bg · 1.10.2026 г.

Gemini 4 Argon е най-добрият модел на Google. Все още не можете да го използвате.

Google обяви Gemini 4 Argon, своя нов граничен модел, и само доверени киберзащитници могат да го използват. Ето какво показва собствената 19-редова бенчмарк таблица на Google, какво измери независимат

4:53 ↗