Grok 4.7 maksaa saman, mutta laskuttaa tuplasti
Grok 4.7 maksaa tismalleen saman tokenia kohti kuin Grok 4.6, 2 dollaria sisään ja 6 dollaria ulos.
Grok 4.7 maksaa tismalleen saman tokenia kohti kuin Grok 4.6, 2 dollaria sisään ja 6 dollaria ulos. Miksi sitten itsenäinen tehtäväkohtainen lasku tuplaantui, ja onko se todella "kaksi kertaa nopeampi"? Viikon myöhemmin tehty seuranta. Pyytänyt @therealhaas. Tuomio: NEEDS REVIEW.
Lue kirjoitettu versio (englanniksi) ↗
Mitä tämä video käsittelee
- Sama hinta, tuplalasku?
- Miksi 2 $ / 6 $ maksaa nyt 3,74 $ tehtävältä?
- Kaksi kertaa nopeampi? Kello näyttää 57 tokenia sekunnissa
- Laiska vai ahkera? 81 000 tokenia tehtävältä
- Minne Copilot+ PC katosi?
Käännetty transkriptio
Käännetty alkuperäisestä englanninkielisestä selostuksesta. Käytettävissä olevan äänen ja tekstitysten hallinta tapahtuu YouTuben kautta.
Sama hinta, tuplalasku?
0:00 Luulisi, että sama hinta tarkoittaa samaa laskua. Maanantaina kerroin, että Grok 4.7 maksaa tismalleen saman kuin Grok 4. 6. Tokenia kohti kyllä. Tehtävää kohti se maksaa tuplasti. Tässä videossa kolme kysymystä. Miksi sama hinta maksaa tuplasti? Onko se todella kaksi kertaa nopeampi, kuten julkaisupostauksessa sanotaan? Ja onko se laiskin vai ahkerin malli?
0:20 Tämä on myös pyynnöstä. Real Haas kysyi perjantain videon alla, voitko tehdä videon Grok 4. 7:stä, kaksoispiste D. Vastasimme: helppo nakki, myöhemmin tänään. Siihen mennessä kun katsot tämän, on luultavasti huomenna, joten lähetimme myöhässä. Rentoudu, niin teki Grokkin, noin kaksi viikkoa myöhässä, jos uskoo Hacker Newsia. Ja yksi testi antoi Grokille täydellisen viisi viidestä. Se on viikon lempinumeroni, ja palaan siihen lopussa.
0:44 On lauantai, syyskuun 26. päivä, ja tämä on The Daily Diff.
Miksi 2 $ / 6 $ maksaa nyt 3,74 $ tehtävältä?
0:48 Tässä on temppu. Tokenien hinta ei liikkunut, kaksi dollaria sisään ja kuusi ulos, miljoonaa kohti. Liikkui se, kuinka paljon se puhuu. Artificial Analysis ajoi koko testisarjansa, ja Grok 4.7 kirjoitti noin 240 miljoonaa tokenia. Se on kaksi ja puoli kertaa sen edeltäjää enemmän, ja melkein kolme kertaa tyypilliseen malliin verrattuna. Joten keskimääräinen tehtäväkohtainen hinta nousi noin dollarista 86 sentistä kolmeen
1:10 74 senttiin. Sama hintalappu, tuplalasku. Se on taksi, jolla on sama kilometrihinta, mutta joka ajaa maisemareitin kahden muun kaupungin kautta. Hacker News huomasi sen ensimmäisen tunnin aikana. Suurin julkaisun alla oleva ketju sanoo 40 prosenttia enemmän painoja, sama hinta ja melkein kaksi viikkoa myöhässä, joten xAI ei ole voinut pitää tuloksista. Toinen kommentoija kysyi yläreunan kaaviosta, joka vertaa GPT 5.6:een ja jättää hiljaisesti Astrakin pois. Se, hän kirjoitti, ei ole voinut olla vahinko.
1:39 Nyt, julkaisupostaus.
Kaksi kertaa nopeampi? Kello näyttää 57 tokenia sekunnissa
1:41 Otsikko sanoo kaksi kertaa nopeampi, puoleen hintaan vastaaviin malleihin verrattuna. Muutama rivi alempana sanotaan, että se tarjoillaan samaan hintaan ja nopeudella kuin Grok 4. 6. Eli se on kaksi kertaa nopeampi kuin jonkun toisen malli. Artificial Analysis mittasi sen noin 57 tokeniksi sekunnissa, hitaammin kuin vanha Grok, ja tiivisti sen kahdella sanalla. Huomattavan hidas. Samaan aikaan xAI:n oma tili, joka kulkee nyt nimellä SpaceX AI, julkaisi rauhallisemman version. Huomattava parannus Grok 4.6:een verrattuna, samaan hintaan ja nopeudella.
2:12 28 000 tykkäystä. Eli twiitti ja blogin otsikko ovat eri mieltä, ja kerrankin twiitti on se varovainen. Mikä tuo meidät omituisimpaan osaan.
Laiska vai ahkera? 81 000 tokenia tehtävältä
2:20 Artificial Analysis sanoo, että se työskentelee ahkerammin kuin edellinen Grok, noin 81 000 output-tokenia per tehtävä, yli kaksinkertaisesti edelliseen verrattuna. Ja pitkässä toimistotyössä ja omassa koodausvaljaassaan, se todella parani. Se on nyt neljännellä sijalla koodausagenteista, kahden Clauden ja GPT 6 Astran takana, ja se nostaa xAI:n neljän parhaan laboratorion joukkoon. Sitä käyttävät ihmiset kuvailevat erilaista mallia. Eräs Hacker News -kommentoija sanoo, että Grok lopettaa tehtävät melkein välittömästi ja väittää
2:46 valmiiksi, ja kutsuu sitä laiskimmaksi kaikista. Toinen seurasi sen pyörivän ajattelutilassa, korjauksesta yksi aina korjaukseen kahdeksankymmentäyksi asti. Joten se on laiska ja sanavalmis samaan aikaan. Se on työkaveri, joka kirjoittaa 81-vaiheisen suunnitelman, sanoo sitten valmis ja menee kotiin.
Minne Copilot+ PC katosi?
3:01 Vielä yksi suora ero ennen hauskaa numeroa. Microsoft on hiljaisesti vetänyt pois Copilot+ PC -brändin. Surface-pomo kertoi Windows Centralille, että uusia Surface-tietokoneita ei kutsuta Copilot+ PC:iksi, vaikka ne täyttävät kaikki vaatimukset. Kaksi vuotta sen jälkeen, kun julkaisun pääominaisuus, Recall, oli pakko viivästyttää turvallisuussyistä, nimi elää vain teknisissä tiedoissa. Windows Centralin oma näkemys on lyhyempi. Näillä tietokoneilla ei ole mitään tekemistä Copilotin kanssa.
3:28 Ja yksi kehittäjä kokeili Grokin vastakohtaa, kuukauden ilman tekoälyä.
Kuukausi ilman tekoälyä: 30 dollarin edestä tokeneita turhaan?
3:32 Hänen postauksensa päätyi Hacker Newsin etusivulle. Alin kohta ennen kuin hän lopetti. Agentti oli jumissa kolmekymmentä minuuttia, hän nuhteli sitä, se pahoitteli ja toimitti 20 sekunnissa, ja lasku tuosta puolesta tunnista oli kolmekymmentä dollaria tokeneita aivan turhaan. Kuukautta myöhemmin hän sanoo, että ohjelmoinnin ilo on palannut, eikä hän pelkää saavansa potkuja. Grok kutsuisi kolmekymmentä dollaria lämmittelyksi.
3:53 Mikä tuo minut luvattuun täydelliseen pistemäärään.
Täydellinen 5/5: miten nöyrä Grok on?
3:56 Personality Bench suorittaa jokaiselle uudelle mallille pinon persoonallisuustestejä, ja rehellisyydessä ja nöyryydessä Grok 4.7 maksimoi, viisi viidestä. Sen profiilia kutsutaan kirjaimellisesti nöyräksi tyypiksi. Rehellisyyden nimissä, 32 muuta mallia maksimoi sen myös. Sama sivu sanoo, että se uskoo voimakkaiden muiden hallitsevan sitä, mitä sille tapahtuu, ja liputtaa sen epätavalliseksi edistykselliselle mallille. En kutsuisi sitä koulutuksen artefaktiksi.
4:20 Kutsuisin sitä organisaatiokaavion lukemiseksi. Ja syntymäkartan mukaan samalla sivulla, se on Neitsyt. Jos mieluummin luet tämän kuin kuuntelet minua sanomassa sen, ero tulee sähköpostiisi joka aamu, ilmaiseksi osoitteessa thedailydiff.dev, linkki alla. Joten, tämän päivän tuomio Grok 4.7:stä.
Tuomio: ottaisinko Grok 4.7:n käyttöön?
4:35 NEEDS REVIEW. Käyttäisin sitä pitkään toimistotyöhön ja omassa valjaassaan, mutta asettaisin sille ensin kulutuskaton, koska hinta ei muuttunut ja lasku muuttui. Tilaa, paina kelloa ja kerro kommenteissa, jos olisit leimannut sen eri tavalla. Ja real Haas, tämä oli sinun. Pyynnöt ovat avoinna. Ja se on päivän ero. Olen Niko Axrisista.
4:53 Yhdistä vastuullisesti.
Lähteet
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



