+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 費用相同,但帳單翻倍

Grok 4.7 每代幣的成本與 Grok 4.6 完全相同,入賬 2 美元,出賬 6 美元。

Grok 4.7 每代幣的成本與 Grok 4.6 完全相同,入賬 2 美元,出賬 6 美元。那麼,為什麼每個任務的獨立帳單翻倍了,而且它真的「快兩倍」嗎?一週後的跟進報道。由 @therealhaas 要求。判決:需要審查。

閱讀書面版本(英文) ↗

本影片涵蓋的內容

  • 價格一樣,帳單卻翻倍?
  • 為什麼現在每個任務的 2 美元/6 美元會變成 3.74 美元?
  • 快兩倍?時鐘顯示每秒 57 個代幣
  • 懶惰還是勤奮?每個任務 81,000 個代幣
  • Copilot+ PC 去了哪裡?

翻譯的文字記錄

從英文原文旁白翻譯。可用的音頻和字幕由 YouTube 控制。

價格一樣,帳單卻翻倍?

0:00 你會認為相同的價格意味著相同的帳單。 星期一我告訴過你,Grok 4.7 的成本與 Grok 4. 6 完全相同。按代幣計算,確實如此。 但按任務計算,成本翻倍了。 在這段影片中,有三個問題。 為什麼相同的價格卻要花費雙倍? 它真的像發布貼文說的那樣快兩倍嗎? 它是最懶的模型,還是最勤奮的模型?

0:20 此外,這是應要求製作的。 The real Haas 在星期五的影片下方問道,你能做一個關於 Grok 4. 7 的影片嗎? 我們回答說,輕而易舉,今天稍後。 等你看到這個時,可能已經是明天了,所以我們遲發了。 放鬆點,Grok 也一樣,如果相信 Hacker News,它遲了大約兩週。 一項測試給了 Grok 完美的五分滿分。 這是我本週最喜歡的數字,我會在影片結尾時談到它。

0:44 今天是 9 月 26 日星期六,這是 The Daily Diff。

為什麼現在每個任務的 2 美元/6 美元會變成 3.74 美元?

0:48 這是竅門。 每個代幣的價格沒有變動,入賬兩美元,出賬六美元, 每百萬個。變動的是它說了多少。 Artificial Analysis 運行了它的整個測試套件,Grok 4.7 寫了 大約兩億四千萬個代幣。 這是其前身 的兩倍半,幾乎是典型模型的三倍。 所以每個任務的平均成本從大約一美元八十六美分上升到三

1:10 美元七十四美分。相同的價格標籤,卻是雙倍的收據。 這就像一輛計程車,每英里的費率相同,卻繞道穿過兩 個其他城市。Hacker News 在第一小時就發現了。 發布下方最大的討論串說增加了百分之四十的權重, 價格不變,而且遲了將近兩週,所以 xAI 不會喜歡這些 結果。另一位評論者問及頂部的圖表, 該圖表與 GPT 5.6 進行比較,卻悄悄地省略了 Astra。 他寫道,這不可能是疏忽。

1:39 現在,發布貼文。

快兩倍?時鐘顯示每秒 57 個代幣

1:41 標題說速度快兩倍,價格是同類模型的一半。 幾行下面寫著,以與 Grok 4. 6 相同的價格和速度提供。所以它比其他人的模型快兩倍。 Artificial Analysis 測得它每秒大約 57 個代幣, 比舊的 Grok 慢,並用兩個詞總結了它。 顯著地慢。同時,xAI 自己的帳號,現在改名為 SpaceX AI, 發布了更平靜的版本。 與 Grok 4.6 相比有顯著改進,價格和速度相同。

2:12 二十八萬個讚。 所以推文和部落格標題有分歧,這次推文是 謹慎的那個。這就帶我們來到最奇怪的部分。

懶惰還是勤奮?每個任務 81,000 個代幣

2:20 Artificial Analysis 說它比上一個 Grok 更努力工作, 每個任務大約 81,000 個輸出代幣,是上一個的兩倍多。 而在長篇辦公室工作和它自己的編碼工具中, 它確實有所改進。 它現在在編碼代理中排名第四,僅次於兩個 Claudes 和 GPT 6 Astra, 這使得 xAI 位列前四大實驗室。 使用它的人描述了一個不同的模型。 一位 Hacker News 評論者說 Grok 幾乎立即完成任務並聲稱

2:46 已完成,並稱其為所有模型中最懶的。 另一位看著它在思考模式中循環,從修復一一直到修復 八十一。所以它既懶惰又冗長。 它就是那種寫了八十一項計劃的同事, 然後說完成就回家了。

Copilot+ PC 去了哪裡?

3:01 在講有趣的數字之前,還有一個直接的差異。 微軟已悄悄地淘汰了 Copilot Plus PC 品牌。 Surface 負責人告訴 Windows Central,新的 Surface PC 不稱為 Copilot Plus PC,儘管它們符合所有要求。 在一個推出時的重點功能 Recall, 因安全問題不得不推遲兩年後,這個名稱只存在於規格表中。 Windows Central 自己的看法更簡潔。 這些 PC 與 Copilot 毫無關係。

3:28 一位開發人員嘗試了 Grok 的反面,一個月沒有 AI。

一個月沒有 AI:30 美元的代幣白花了?

3:32 他的貼文登上了 Hacker News 的首頁。 在他辭職之前的低谷。 一個代理卡了三十分鐘,他斥責了它, 它道歉並在二十秒內完成任務,而那半小時的帳單 是三十美元的代幣,完全白費了。 一個月後他說程式設計的樂趣又回來了, 他也不再害怕被解僱。 Grok 會稱三十美元為熱身。

3:53 這就帶我來到我承諾的滿分。

完美的 5 分滿分:Grok 有多謙虛?

3:56 Personality Bench 讓每個新模型都經過一堆性格測試, 在誠實和謙遜方面,Grok 4.7 獲得滿分, 五分滿分。 它的檔案實際上稱為謙虛型。 公平地說,還有三十二個其他模型也獲得滿分。 同一頁面說它相信強大的他人控制著發生在它身上的事情, 並將其標記為前沿模型中不尋常的。 我不會稱之為訓練結果。

4:20 我會稱之為讀取組織結構圖。 根據同一頁面上的出生圖,它是處女座。 如果你寧願閱讀而不是聽我說,這篇文章每天早上都會發送到你的收件箱, 免費在 thedailydiff.dev,連結在下方。 那麼,今天對 Grok 4.7 的判決。

判決:我會推出 Grok 4.7 嗎?

4:35 需要審查。我會用它來處理長篇辦公室工作和它自己的工具中, 但我會先設定一個支出上限,因為價格沒有變,但 帳單變了。訂閱,點擊小鈴鐺,並在評論中告訴我,如果你會 有不同的評價。 The real Haas,這個是你的要求。 請求開放。 這就是今天的文章。 我是來自 Axrisi 的 Niko。

4:53 負責任地合併。

來源

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

相關影片

daily · zh-HK · 2026年9月22日

亞馬遜將Meta的Muse踢出商店。這是差異所在。

自星期日晚起,Meta的Muse代理程式在amazon.com上收到彈出視窗:「未經授權的AI代理程式持續存取違反亞馬遜的使用條款。」亞馬遜在八月份對Perplexity的Comet的駭客法律途徑中敗訴,因此這次的規則是針對購物者——而亞馬遜自己的「代我購買」代理程式則在選擇退出的基礎上購物其他商店。判決:NEEDS REVIEW。

5:08 ↗
daily · zh-HK · 2026年9月7日

Google 剛剛發佈了一個黑客模型。以下是其差異。

Google 發佈了 Gemini 3.8 Flash(輸入每百萬代幣 $0.75,輸出每百萬代幣 $3.75,1 月 1 日價格翻倍)和 Gemini 3.8 Flash Cyber — 一個漏洞搜尋模型,它只售予 650 家經審查的「受信任防禦者」— 四小時後,Meta 發佈了 Muse Spark 1.3,其中設有每百萬代幣 $0.10 的「貢獻者」層級,折扣是您的會話記錄。我們將兩者與兩家

5:08 ↗