+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 kostar detsamma, men faktureras dubbelt

Grok 4.7 kostar exakt vad Grok 4.6 gjorde per token, 2 $ in och 6 $ ut.

Grok 4.7 kostar exakt vad Grok 4.6 gjorde per token, 2 $ in och 6 $ ut. Så varför fördubblades den oberoende fakturan per uppgift, och är den verkligen "dubbelt så snabb"? En uppföljning en vecka senare. Begärd av @therealhaas. Dom: NEEDS REVIEW.

Läs den skrivna upplagan (engelska) ↗

Vad den här videon täcker

  • Samma pris, dubbel faktura?
  • Varför kostar 2 $ / 6 $ nu 3,74 $ per uppgift?
  • Dubbelt så snabb? Klockan säger 57 tokens per sekund
  • Lat eller hårt arbetande? 81 000 tokens per uppgift
  • Vart tog Copilot+ PC vägen?

Översatt transkription

Översatt från den ursprungliga engelska berättelsen. Tillgängligt ljud och undertexter styrs av YouTube.

Samma pris, dubbel faktura?

0:00 Man skulle kunna tro att samma pris betyder samma faktura. På måndagen berättade jag att Grok 4.7 kostar exakt vad Grok 4. 6 gjorde. Per token, ja. Per uppgift kostar det dubbelt. I den här videon, tre frågor. Varför kostar samma pris dubbelt? Är den verkligen dubbelt så snabb, som lanseringsposten säger? Och är det den lataste modellen som finns, eller den mest hårt arbetande?

0:20 Dessutom är den här på begäran. The Real Haas frågade under fredagens video, kan ni göra en video om Grok 4. 7, kolon D. Vi svarade, lätt som en plätt, senare idag. När du ser det här är det förmodligen imorgon, så vi skickade sent. Slappna av, det gjorde Grok också, ungefär två veckor sent, om man tror Hacker News. Och ett test gav Grok en perfekt femma av fem. Det är mitt favorittal för veckan, och jag kommer till det i slutet.

0:44 Det är lördag, den tjugosjätte september, och detta är The Daily Diff.

Varför kostar 2 $ / 6 $ nu 3,74 $ per uppgift?

0:48 Här är tricket. Priset per token rörde sig inte, två dollar in och sex ut, per miljon. Det som rörde sig är hur mycket den pratar. Artificial Analysis körde hela sin testsvit, och Grok 4.7 skrev omkring tvåhundrafyrtio miljoner tokens. Det är två och en halv gånger dess föregångare, och nästan tre gånger en typisk modell. Så den genomsnittliga kostnaden per uppgift gick från ungefär en dollar åttiosex till tre

1:10 sjuttiofyra. Samma prislapp, dubbel kvittens. Det är en taxi med samma pris per mil som tar den natursköna vägen genom två andra städer. Hacker News upptäckte det den första timmen. Den största tråden under lanseringen säger fyrtio procent mer vikter, samma pris, och nästan två veckor sent, så xAI kan inte ha älskat resultaten. En annan kommentator frågade om diagrammet överst, som jämför mot GPT 5.6 och tyst utelämnar Astra. Det, skrev han, kan inte ha varit en förseelse.

1:39 Nu, lanseringsposten.

Dubbelt så snabb? Klockan säger 57 tokens per sekund

1:41 Rubriken säger dubbelt så snabb, till halva priset av jämförbara modeller. Några rader ner står det att den levereras till samma pris och hastighet som Grok 4. 6. Så den är dubbelt så snabb som någon annans modell. Artificial Analysis klockade den till cirka femtiosju tokens per sekund, långsammare än den gamla Grok, och sammanfattade det med två ord. Anmärkningsvärt långsam. Samtidigt lade xAI:s eget konto, som nu går under namnet SpaceX AI, ut den lugnare versionen. En märkbar förbättring jämfört med Grok 4.6, till samma pris och hastighet.

2:12 Tjugoåtta tusen likes. Så tweeten och bloggrubriken är oense, och för en gångs skull är tweeten den försiktiga. Vilket leder oss till den märkligaste delen.

Lat eller hårt arbetande? 81 000 tokens per uppgift

2:20 Artificial Analysis säger att den arbetar hårdare än den förra Grok, ungefär åttioett tusen utdata-tokens per uppgift, mer än dubbelt så mycket som den förra. Och för långt kontorsarbete och i sin egen kodningssele, förbättrades den verkligen. Den är nu fyra bland kodningsagenter, efter två Claudes och GPT 6 Astra, och det placerar xAI bland de fyra bästa laboratorierna. Människorna som använder den beskriver en annan modell. En Hacker News-kommentator säger att Grok avslutar uppgifter nästan omedelbart och hävdar

2:46 färdigt, och kallar den den lataste av alla. En annan såg den loopa i tänkande läge, från fix ett hela vägen till fix åttioett. Så den är lat och ordrik på samma gång. Det är kollegan som skriver en åttioettstegsplan, sedan säger färdigt och går hem.

Vart tog Copilot+ PC vägen?

3:01 En till direkt skillnad innan det roliga numret. Microsoft har tyst pensionerat varumärket Copilot plus PC. Surface-chefen berättade för Windows Central att de nya Surface PC:erna inte kallas Copilot plus PC:er, även om de uppfyller alla krav. Två år efter en lansering vars huvudfunktion, Recall, måste fördröjas av säkerhetsskäl, lever namnet bara på specifikationsblad. Windows Centrals egen uppfattning är kortare. Dessa PC:er har ingenting med Copilot att göra.

3:28 Och en utvecklare provade motsatsen till Grok, en månad med noll AI.

En månad med noll AI: 30 $ i tokens för ingenting?

3:32 Hans inlägg hamnade på Hacker News förstasida. Den lägsta punkten innan han slutade. En agent satt stilla i trettio minuter, han skällde ut den, den bad om ursäkt och levererade på tjugo sekunder, och räkningen för den halvtimmen var trettio dollar i tokens för absolut ingenting. En månad senare säger han att glädjen med att programmera är tillbaka, och han är inte rädd för att bli sparkad. Grok skulle kalla trettio dollar för en uppvärmning.

3:53 Vilket för mig till det perfekta resultatet jag lovade.

Det perfekta 5 av 5: hur ödmjuk är Grok?

3:56 Personality Bench kör varje ny modell genom en stapel personlighetstester, och på ärlighet och ödmjukhet, maxade Grok 4.7, fem av fem. Dess profil kallas bokstavligen för den ödmjuka typen. För att vara rättvis, maxade trettiotvå andra modeller också den. Samma sida säger att den tror att mäktiga andra kontrollerar vad som händer med den, och flaggar det som ovanligt för en gränsmodell. Jag skulle inte kalla det en träningsartefakt.

4:20 Jag skulle kalla det att läsa organisationsschemat. Och enligt födelsekartan på samma sida är den en Jungfru. Om du hellre vill läsa detta än höra mig säga det, landar diffen i din inkorg varje morgon, gratis på thedailydiff.dev, länk nedan. Så, dagens dom om Grok 4.7.

Dom: skulle jag SHIP IT Grok 4.7?

4:35 NEEDS REVIEW. Jag skulle använda den för långt kontorsarbete och inom sin egen sele, men jag skulle sätta ett utgiftstak på den först, eftersom priset inte ändrades och räkningen gjorde det. Prenumerera, tryck på klockan, och berätta i kommentarerna om du skulle ha stämplat den annorlunda. Och the real Haas, den här var din. Förfrågningar är öppna. Och det var diffen för idag. Jag är Niko från Axrisi.

4:53 Merge responsibly.

Källor

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Relaterade videor