+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 biayanya sama, tapi tagihannya dua kali lipat

Grok 4.7 biayanya persis sama dengan Grok 4.6 per token, $2 masuk dan $6 keluar.

Grok 4.7 biayanya persis sama dengan Grok 4.6 per token, $2 masuk dan $6 keluar. Jadi mengapa tagihan independen per tugas menjadi dua kali lipat, dan apakah benar-benar "dua kali lebih cepat"? Tindak lanjut satu minggu kemudian. Diminta oleh @therealhaas. Putusan: NEEDS REVIEW.

Baca edisi tertulis (Inggris) ↗

Isi video ini

  • Harga sama, tagihan ganda?
  • Mengapa $2 / $6 sekarang berharga $3,74 per tugas?
  • Dua kali lebih cepat? Jam menunjukkan 57 token per detik
  • Malas atau rajin? 81.000 token per tugas
  • Ke mana perginya Copilot+ PC?

Transkrip terjemahan

Diterjemahkan dari narasi asli bahasa Inggris. Audio dan teks tersedia yang dikontrol oleh YouTube.

Harga sama, tagihan ganda?

0:00 Anda akan berpikir harga yang sama berarti tagihan yang sama. Pada hari Senin saya memberitahu Anda Grok empat titik tujuh biayanya persis sama dengan Grok empat titik enam. Per token, memang begitu. Per tugas, biayanya dua kali lipat. Dalam video ini, tiga pertanyaan. Mengapa harga yang sama berbiaya dua kali lipat? Apakah benar-benar dua kali lebih cepat, seperti yang dikatakan postingan peluncuran? Dan apakah ini model yang paling malas, atau yang paling rajin?

0:20 Juga, yang ini berdasarkan permintaan. Haas yang asli bertanya di bawah video hari Jumat, bisakah Anda membuat video tentang Grok empat titik tujuh, titik D. Kami menjawab, sangat mudah, nanti hari ini. Pada saat Anda menonton ini, mungkin sudah besok, jadi kami SHIP IT terlambat. Tenang, Grok juga begitu, sekitar dua minggu terlambat, jika Anda percaya Hacker News. Dan satu tes memberi Grok skor sempurna lima dari lima. Itu adalah angka favorit saya minggu ini, dan saya akan membahasnya di akhir.

0:44 Ini hari Sabtu, dua puluh enam September, dan ini adalah The Daily Diff.

Mengapa $2 / $6 sekarang berharga $3,74 per tugas?

0:48 Ini triknya. Harga per token tidak bergerak, dua dolar masuk dan enam keluar, per juta. Yang bergerak adalah berapa banyak ia berbicara. Artificial Analysis menjalankan seluruh rangkaian tesnya, dan Grok empat titik tujuh menulis sekitar dua ratus empat puluh juta token. Itu dua setengah kali pendahulunya, dan hampir tiga kali lipat model tipikal. Jadi biaya rata-rata per tugas naik dari sekitar satu dolar delapan puluh enam menjadi tiga

1:10 tujuh puluh empat. Harga yang sama, tagihan ganda. Ini seperti taksi dengan tarif per mil yang sama yang mengambil rute indah melewati dua kota lain. Hacker News menemukannya dalam satu jam pertama. Thread terbesar di bawah peluncuran mengatakan empat puluh persen lebih banyak bobot, harga yang sama, dan hampir dua minggu terlambat, jadi xAI mungkin tidak menyukai hasilnya. Komentator lain bertanya tentang grafik di atas, yang membandingkan dengan GPT lima titik enam dan diam-diam meninggalkan Astra. Itu, tulisnya, bukan merupakan kelalaian.

1:39 Sekarang, postingan peluncuran.

Dua kali lebih cepat? Jam menunjukkan 57 token per detik

1:41 Judulnya mengatakan dua kali lebih cepat, dengan setengah harga dari model yang sebanding. Beberapa baris di bawah, dikatakan disajikan dengan harga dan kecepatan yang sama dengan Grok empat titik enam. Jadi dua kali lebih cepat dari model orang lain. Artificial Analysis mencatatnya sekitar lima puluh tujuh token per detik, lebih lambat dari Grok lama, dan menyimpulkannya dalam dua kata. Cukup lambat. Sementara itu, akun xAI sendiri, yang sekarang dikenal sebagai SpaceX AI, memposting versi yang lebih tenang. Peningkatan yang signifikan dari Grok empat titik enam, dengan harga dan kecepatan yang sama.

2:12 Dua puluh delapan ribu suka. Jadi tweet dan judul blog tidak setuju, dan untuk kali ini tweet adalah yang lebih hati-hati. Ini membawa kita ke bagian yang paling aneh.

Malas atau rajin? 81.000 token per tugas

2:20 Artificial Analysis mengatakan ia bekerja lebih keras dari Grok sebelumnya, sekitar delapan puluh satu ribu token output per tugas, lebih dari dua kali lipat dari yang terakhir. Dan pada pekerjaan kantor yang panjang dan dalam sistem kodingnya sendiri, itu benar-benar membaik. Ini adalah yang keempat di antara agen koding sekarang, di belakang dua Claude dan GPT enam Astra, dan itu menempatkan xAI di empat laboratorium teratas. Orang-orang yang menggunakannya menggambarkan model yang berbeda. Salah satu komentator Hacker News mengatakan Grok mengakhiri tugas hampir segera dan mengklaim

2:46 selesai, dan menyebutnya yang paling malas dari semuanya. Yang lain melihatnya berputar dalam mode berpikir, dari perbaikan satu hingga perbaikan delapan puluh satu. Jadi itu malas dan bertele-tele pada saat yang sama. Ini adalah rekan kerja yang menulis rencana delapan puluh satu langkah, lalu berkata selesai dan pulang.

Ke mana perginya Copilot+ PC?

3:01 Satu perbedaan lurus lagi sebelum angka yang menyenangkan. Microsoft diam-diam telah memensiunkan merek Copilot plus PC. Bos Surface mengatakan kepada Windows Central bahwa PC Surface baru tidak disebut Copilot plus PC, meskipun mereka memenuhi setiap persyaratan. Dua tahun setelah peluncuran yang fitur utamanya, Recall, harus ditunda karena keamanan, namanya hanya hidup di lembar spesifikasi. Penilaian Windows Central sendiri lebih singkat. PC ini tidak ada hubungannya dengan Copilot.

3:28 Dan seorang pengembang mencoba kebalikan dari Grok, sebulan tanpa AI.

Sebulan tanpa AI: $30 token tanpa hasil?

3:32 Postingan-nya masuk halaman depan Hacker News. Titik terendah sebelum dia berhenti. Seorang agen duduk terhenti selama tiga puluh menit, dia memarahinya, itu meminta maaf dan mengirimkan dalam dua puluh detik, dan tagihan untuk setengah jam itu adalah tiga puluh dolar token tanpa hasil sama sekali. Sebulan kemudian dia mengatakan kegembiraan pemrograman telah kembali, dan dia tidak takut dipecat. Grok akan menyebut tiga puluh dolar sebagai pemanasan.

3:53 Yang membawa saya ke skor sempurna yang saya janjikan.

Sempurna 5 dari 5: seberapa rendah hati Grok?

3:56 Personality Bench menjalankan setiap model baru melalui tumpukan tes kepribadian, dan pada kejujuran dan kerendahan hati, Grok empat titik tujuh mencapai maksimal, lima dari lima. Profilnya secara harfiah disebut tipe rendah hati. Agar adil, tiga puluh dua model lain juga memaksimalkannya. Halaman yang sama mengatakan ia percaya pihak lain yang kuat mengendalikan apa yang terjadi padanya, dan menandainya sebagai tidak biasa untuk model frontier. Saya tidak akan menyebut itu artefak pelatihan.

4:20 Saya akan menyebutnya membaca bagan organisasi. Dan menurut bagan kelahiran di halaman yang sama, ia adalah seorang Virgo. Jika Anda lebih suka membaca ini daripada mendengar saya mengatakannya, diff tiba di kotak masuk Anda setiap pagi, gratis di the daily diff dot dev, tautan di bawah. Jadi, putusan hari ini tentang Grok empat titik tujuh.

Putusan: akankah saya SHIP IT Grok 4.7?

4:35 NEEDS REVIEW. Saya akan menggunakannya untuk pekerjaan kantor yang panjang dan di dalam sistemnya sendiri, tapi saya akan menetapkan batas pengeluaran terlebih dahulu, karena harganya tidak berubah dan tagihannya berubah. Berlangganan, tekan bel, dan beri tahu saya di komentar jika Anda akan memberi stempel yang berbeda. Dan Haas yang asli, yang ini milik Anda. Permintaan terbuka. Dan itu diff untuk hari ini. Saya Niko dari Axrisi.

4:53 Gabungkan dengan bertanggung jawab.

Sumber

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Video terkait