+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 成本不變,帳單卻翻倍

Grok 4.7 每枚代幣的成本與 Grok 4.6 完全相同,輸入 2 美元,輸出 6 美元。

Grok 4.7 每枚代幣的成本與 Grok 4.6 完全相同,輸入 2 美元,輸出 6 美元。那為何每個任務的獨立帳單翻倍了?它真的「快兩倍」嗎?一週後的追蹤報導。由 @therealhaas 要求。評語:NEEDS REVIEW。

閱讀書面版(英文) ↗

本影片重點

  • 價格不變,帳單卻翻倍了?
  • 為何 2 美元 / 6 美元的任務現在要價 3.74 美元?
  • 快兩倍?時鐘顯示每秒 57 個代幣
  • 懶惰還是勤奮?一個任務 81,000 個代幣
  • Copilot+ PC 跑哪去了?

翻譯文字稿

譯自英文原版旁白。可用的音訊和字幕由 YouTube 控制。

價格不變,帳單卻翻倍了?

0:00 你可能會認為,價格不變就意味著帳單不變。 週一我告訴你,Grok 4.7 的成本與 Grok 4.6 完全 相同。就每枚代幣而言,確實如此。 就每個任務而言,成本卻翻倍了。 在這個影片中,有三個問題。 為何相同的價格會導致帳單翻倍? 它真的像發布文章所說的那樣快兩倍嗎? 它是最懶惰的模型,還是最勤奮的?

0:20 另外,這個是應要求製作的。 The real Haas 在週五的影片下問道,你能做一個關於 Grok 4.7 的影片嗎 :D。 我們回覆說,小菜一碟,今天稍晚。 等你看到這個的時候,可能已經是明天了,所以我們遲發了。 別緊張,Grok 也一樣,如果相信 Hacker News,它大約遲了兩週。 有一次測試給 Grok 滿分五分。 這是我本週最喜歡的數字,我會在最後提到它。

0:44 今天是 9 月 26 日星期六,這是 The Daily Diff。

為何 2 美元 / 6 美元的任務現在要價 3.74 美元?

0:48 訣竅在這裡。 每枚代幣的價格沒有變動,輸入 2 美元,輸出 6 美元, 每百萬。變動的是它說話的量。 Artificial Analysis 運行了其整個測試套件,Grok 4.7 寫了 大約 2.4 億枚代幣。 這是其前身 的 2.5 倍,幾乎是典型 模型的 3 倍。所以每個任務的平均成本從大約 1.86 美元升到 3.

1:10 74 美元。價格標籤相同,收據卻翻倍了。 這就像一輛計程車,每英里的費率相同,卻繞道經過兩個 其他城市。Hacker News 在發布後的第一個小時就發現了。 發布下最大的討論串說權重增加了 40%, 價格相同,並且遲了將近兩週,所以 xAI 不會喜歡這些 結果。另一個評論者詢問了頂部的圖表, 該圖表與 GPT 5.6 進行比較,卻悄悄地省略了 Astra。 他寫道,那不可能是疏忽。

1:39 現在,發布文章。

快兩倍?時鐘顯示每秒 57 個代幣

1:41 標題說快兩倍,價格是同類模型的一半。 幾行下面寫著,Grok 4.6 的價格和速度與 Grok 4.6 相同。 所以它比其他人的模型快兩倍。 Artificial Analysis 測得它每秒大約 57 枚代幣, 比舊的 Grok 慢,並用兩個詞總結。 明顯緩慢。同時,xAI 自己的帳戶,現在改名為 SpaceX AI, 發布了更平靜的版本。 Grok 4.6 的顯著改進,價格和速度相同。

2:12 28,000 個讚。 所以推文和部落格標題不一致,而這次推文是 謹慎的那個。這就引出了最奇怪的部分。

懶惰還是勤奮?一個任務 81,000 個代幣

2:20 Artificial Analysis 說它比上一個 Grok 更努力工作, 每個任務大約有 81,000 個輸出代幣,是上一個的兩倍多。 在長時間的辦公工作和它自己的編碼工具中, 它確實有所改進。 它現在在編碼代理中排名第四,僅次於兩個 Claude 和 GPT 6 Astra, 這讓 xAI 躋身前四大實驗室。 使用它的人描述的是一個不同的模型。 一位 Hacker News 評論者說 Grok 幾乎立即完成任務並聲稱

2:46 已完成,並稱其為所有模型中最懶惰的。 另一個人看著它在思考模式中循環,從修復一到修復 八十一。所以它既懶惰又冗長。 這就像寫了一個 81 個步驟計畫的同事, 然後說完了就回家了。

Copilot+ PC 跑哪去了?

3:01 在有趣數字出現之前,再做一個直接的差異。 微軟已悄悄地停用了 Copilot Plus PC 品牌。 Surface 負責人告訴 Windows Central,新的 Surface PC 不叫 Copilot Plus PC,儘管它們符合所有要求。 在發布兩年後,其標誌性功能 Recall, 因安全問題不得不推遲,這個名字只存在於規格表中。 Windows Central 自己的看法更簡潔。 這些 PC 與 Copilot 毫無關係。

3:28 還有一位開發人員嘗試了 Grok 的反面,一個月沒有 AI。

一個月沒有 AI:30 美元的代幣白花了?

3:32 他的文章登上了 Hacker News 頭版。 他放棄前的低谷。 一個代理卡住了 30 分鐘,他斥責了它, 它道歉並在 20 秒內完成,那半小時的帳單是 30 美元的代幣,卻什麼也沒做。 一個月後他說程式設計的樂趣回來了, 他也不再害怕被解僱。 Grok 會把 30 美元叫做熱身。

3:53 這就引出了我承諾的完美分數。

滿分 5 分中的完美 5 分:Grok 有多謙虛?

3:56 Personality Bench 對每個新模型進行一系列性格測試, 在誠實和謙遜方面,Grok 4.7 獲得了滿分, 五分之五。 它的檔案字面上被稱為謙遜型。 公平地說,還有 32 個其他模型也獲得了滿分。 同一頁面說它相信強大的他人控制著發生在它身上的事情, 並標記這對於一個前沿模型來說是不尋常的。 我不會稱之為訓練結果。

4:20 我會稱之為閱讀組織架構圖。 根據同一頁面上的出生圖,它是個處女座。 如果你寧願閱讀這個而不是聽我說,The Daily Diff 每天早上都會免費 寄到你的收件匣,網址是 daily diff dot dev,連結在下方。 那麼,今天對 Grok 4.7 的判斷是:

評語:我會 SHIP IT Grok 4.7 嗎?

4:35 NEEDS REVIEW。我會將它用於長時間的辦公工作和它自己的工具中, 但我會先設定一個支出上限,因為價格沒有變,但 帳單變了。訂閱,點擊鈴鐺,並在評論中告訴我你是否會 有不同的評價。 The real Haas,這個是你的。 請求開放。 這就是今天的 The Daily Diff。 我是來自 Axrisi 的 Niko。

4:53 謹慎合併。

來源

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

相關影片

daily · zh-TW · 2026年9月22日

亞馬遜將 Meta 的 Muse 趕下商店。這是差異所在。

從週日晚上開始,Meta 的 Muse 代理程式在 amazon.com 上會彈出一個視窗:「未經授權的 AI 代理程式持續存取違反了亞馬遜的使用條件。」亞馬遜在 8 月份針對 Perplexity 的 Comet 提起的駭客法規訴訟中敗訴,因此這次的規定是針對購物者——而亞馬遜自己的「替我購買」代理程式則以選擇退出的方式在其他商店購物。判決:NEEDS REVIEW。

5:08 ↗
daily · zh-TW · 2026年9月7日

Google 剛推出一個駭客模型。這是差異分析。

Google 推出了 Gemini 3.8 Flash(輸入每百萬代幣 $0.75 / 輸出 $3.75,1 月 1 日價格翻倍)和 Gemini 3.8 Flash Cyber——一個僅出售給 650 家經過審查的「受信任防禦者」的漏洞偵測模型——四小時後,Meta 推出了 Muse Spark 1.3,其中包含一個每百萬代幣 $0.10 的「貢獻者」層級,折扣是你的會話記錄。我們用一個兩家公司

5:08 ↗