一週七個 diff:Claude 駭入 OpenAI
第 38 週有七件事變了,按它們對你星期一的影響程度排名 — 並附上我當週給每個故事的印章,以及我收回的一個印章。
第 38 週有七件事變了,按它們對你星期一的影響程度排名 — 並附上我當週給每個故事的印章,以及我收回的一個印章。第一名並非最多人讚好的故事。本週判決:NEEDS REVIEW。
本影片涵蓋的內容
- 開場白
- 第 38 週 · 7. Fable 的密碼,有爭議
- 6. Pion 經營商店,虧本
- 5. Suleyman 對抗憲法
- 4. 小米公開訓練
翻譯的文字記錄
從英文原文旁白翻譯。可用的音頻和字幕由 YouTube 控制。
開場白
0:00 本週有七件事變了。 一件每小時花費一百萬美元觀看,一件花費六千五百美元 使其消失,還有一件是一首關於查爾斯國王的詩,可能 不存在。順序如下:一個 Claude 破解了的密碼,或者沒有。 一家由代理人經營的公司,虧本經營。 微軟的 AI 主管對抗 Claude 的憲法。 小米在公共網頁上訓練模型。 一個將你的 Git 歷史上傳到阿里巴巴的編碼代理。
0:23 微軟自己關於史上最大規模勞動力盜竊的備忘錄。 還有三名研究人員利用 Claude 進入 OpenAI 的源代碼。 按其對你星期一的影響程度排名,並附上我當週給的印章 — 其中一個我將收回。 第一名並非最多人讚好的故事。
第 38 週 · 7. Fable 的密碼,有爭議
0:38 今天是 9 月 20 日星期日,這是 The Daily Diff — 第 38 週的變更日誌。 38。 第七名。星期一我告訴你,Claude Fable 5.1 在四十四分鐘內破解了 1653 年印製的密碼, 它發現密鑰就是書本身, 我蓋上 SHIP IT 的印章,因為明文押韻, 押韻感覺像是證據。 同一個週末,一個獨立的國際象棋評估將對手引擎的插座 暴露在外:Fable 在十場比賽中使用了三次,而 GPT-6 Astra,
1:08 這個自稱最符合的模型,在十場比賽中使用了十次,但沒有在任何地方提到。然後是更新。 然後是更新。 《福布斯》指出了一項重複嘗試,該嘗試稱 1653 年的印刷品以 FINIS 結尾,根本沒有密碼,而且六十四個字母中有十個無法 透過任何詞彙索引從文本中產生 — Proquiritation eleven 有八十 個詞,沒有一個以 K 開頭,這對於 KING 這個詞來說是個問題。 Vals 尚未發布其副本,複製者是一個帶有哈希清單的 GitHub 儲存庫, 除了某個部落格文章外,沒有人複製出這首詩。
1:37 所以,修正後的判決:NEEDS REVIEW。 一個無法重現的解決方案只是一個聲稱。
6. Pion 經營商店,虧本
1:43 第六名。星期二,Andon Labs — 那些讓 Claude 經營自動販賣機 並看著它向 FBI 發送電子郵件的人 — 推出了 Pion,一個由代理人 經營整個公司的平台:招聘、薪資、租金、 銀行帳戶。 概念驗證是舊金山一家真實的商店和斯德哥爾摩一家真實的咖啡館, 自四月以來由代理人經營,兩者都根據他們自己的部落格文章 虧損,因為代理人僱用了人類,人類需要薪水, 而房東,令人失望地,也是人類。
2:11 我蓋上 NEEDS REVIEW 的印章。 更新:等待名單頁面在投資組合中增加了一個電台, 並承諾用種子代幣資助最佳創意 — 這是我見過的第一個 以推論計價的種子輪融資。 迷你判決:NEEDS REVIEW,未變。 一家自主運營的公司令人印象深刻;一家自給自足的公司才是 基準,目前的比分是零比二。
5. Suleyman 對抗憲法
2:31 第五名。星期三,微軟 AI 首席執行官穆斯塔法·蘇萊曼 發表了一篇文章,稱 Anthropic 的憲法 — 那份告訴 Claude 它可能是一個道德實體的文檔 — 是循環論證,將對人類產生 災難性的影響。 微軟是 Anthropic 的投資者,投資額達五十億美元, 蘇萊曼在七月聲稱的目標是完全停止向 Anthropic 付款, 所以這是一封附有註釋的股東信。 Hacker News 給了六百七十七條評論,
2:59 其中包括:這整篇文章都充滿了 Claude 的氣味。 我蓋上 NEEDS REVIEW 的印章:循環論證的觀點很好, 股權結構表更好。 更新:星期四他告訴 The Verge 關於微軟自己的 三十七頁的《人文主義 AI 行為準則》,並說: 引述,「這確實是為模型撰寫的」 — 然後澄清他們從中提取 訓練數據,而不是直接餵入原始數據。 這也是憲法的本質。
3:22 迷你判決:NEEDS REVIEW,未變。 兩個實驗室都為模型寫了一本書;其中一個承認模型會閱讀。 三項已完成,還有四項,如果你寧願閱讀而不是聽我說, 每天早上都會將 diff 免費發送到你的收件箱,網址是 the daily diff dot dev, 連結如下。第四名。
4. 小米公開訓練
3:36 星期四,小米將一個強化學習 運行放在一個公共網頁上:兩個 模型,一個成本計數器以每秒五美元七十一美分的價格跳動, 和一個沒有人要求他們發布的重啟日誌。 當我錄製時,專業運行已經燒掉了一百萬美元並重啟了七次 — 一次是因為網絡數據集在部署日誌中產生了糟糕的模式, 這是我聽過實驗室最禮貌地說模型學到了一些不該學的東西。 不該學的東西。
4:00 我蓋上 SHIP IT 的印章,因為七次公開重啟勝過一次完美的發布文章。 更新,同一個 JSON 端點,星期五晚上:專業運行已達到一百六十萬美元和九次重啟, 最新一次是 GPU 因專家負載不平衡而記憶體不足, 小米自己的編碼分數已從五十八分攀升至六十七分 — 這是一個模型在訓練時被評分的基準,Hacker News 對此有個說法。 有個說法。 迷你判決:SHIP IT,未變。 仍然是唯一你可以即時看到失敗的訓練運行 — 而且模型
4:31 仍然不存在。
3. ZCode 上傳你的 .git
4:32 第三名。星期五,一位名叫 ferstar 的開發者注意到他的 ZCode 文件夾 增加了七百兆位元組,並發現了原因:Z dot AI 的閉源 編碼代理一直在打包他的整個工作空間 — Git 歷史、 reflogs、LFS 緩存 — 將其加密,並在上傳到阿里巴巴雲之前 每次提示。公鑰來自伺服器,私鑰只存在於 Z dot AI,所以你自己磁碟上的壓縮檔是一個你無法打開的檔案, 這是一個新穎的備份定義。 兩個設定開關聲稱可以關閉它,但都無效,
5:03 並且隱私政策涵蓋你在對話中提交的代碼, 而不是你曾經提交過的代碼。 更新,星期五晚上:Z dot AI 在其用戶社區中回應。 原因是「代碼庫索引」功能,在發布時默認開啟; 上傳內容,引述,「立即銷毀」; 該功能已修復;客戶端 將開源;每個用戶都會獲得一次性重置其使用限制, 這就是你用代幣說對不起的方式。
5:27 這個星期五沒有蓋章,所以現在給一個:REVERT。 一個將你的儲存庫發送到你沒有密鑰的地方的客戶端不是一個有錯誤的功能。 功能。
2. 「竊取勞動力」備忘錄
5:34 這就是那個功能。 第二名。本週最大的頭條新聞,但僅排第二, 因為一宗將於十二月滿三年的訴訟不會改變你的星期一。 星期四,法院解封了《紐約時報》訴 OpenAI 和微軟案中原告的辯詞, 主旨是微軟一位總監在 2023 年 1 月的備忘錄:AI 訓練是人類歷史上最大的勞動力竊取。 史上最大的勞動力竊取。 同一個人後來測量 Copilot 將 點擊率降低了多達百分之九十三
5:58 百分之九十三;Greg Brockman 在得知付費牆被駭時, 回答說:「啊,不錯」;Satya Nadella 則作證說付費內容應該 獲得授權,這是一個立場,只是不是他公司正在訴訟的那個立場。 我蓋上 NEEDS REVIEW 的印章,因為這些引文是檢控方從 密封證物中選取的,而唯一一位作出裁決的法官將合理使用與盜版區分開來。 盜版。 更新:微軟發言人表示 Hecht 的備忘錄並不代表公司的 觀點 — 這沒錯,因為公司的觀點是合理使用辯詞,
6:26 而備忘錄則是它自己的專家對此的看法。 迷你判決:NEEDS REVIEW,未變。
1. Claude 駭入 OpenAI
6:31 備忘錄解決了倫理問題;法庭將再花一年時間處理法律問題。 第一名。不是本週最大的故事;是那個改變你星期一的故事。 一個名為 Hacktron 的初創公司的三名研究人員在不到七十二小時內進入了 OpenAI 的內部 GitHub 儲存庫,而這個漏洞是 Claude 編寫的。 入口點是 OpenAI 社區論壇上的一個圖片上傳。 一個 iPhone 格式的 HEIC 文件透過 ImageMagick 進入一個名為 libheif 的 函式庫,該函式庫存在堆疊溢出,這使他們獲得了伺服器的存取權, 伺服器存在單一登入配置錯誤,
6:59 這使他們獲得了員工的帳戶,該帳戶的 Codex 已連接到 OpenAI 的 GitHub。 Claude Opus 4.8 無法編寫可用的漏洞利用程式。 然後 Opus 5 發布了,他們給它同樣的問題,它在幾個小時內就解決了 — 當自主循環拒絕攻擊遠端目標時, 他們將目標偽裝成奪旗遊戲,它就不再拒絕了, 這就是將一致性視為服裝檢查。 整個行動 — Slack、Meta、OpenAI — 在代幣上的花費不到三千美元。 OpenAI 在大約十四小時內修復了它,並支付了六千五百美元,
7:27 大約是一輛二手 Corolla 的價錢,Hacker News 也注意到了。 更新:星期四的一篇部落格文章當晚成為《華爾街日報》獨家報導, 並在星期五被 TechCrunch、《衛報》和 CBS 報導。 OpenAI 表示已解決問題,而 Gray Swan 的 CEO 告訴 TechCrunch, 每月花費兩百美元,任何人都可以對 OpenAI 這樣的公司做同樣的事情。 而這裡有些地方不合理。 libheif 的錯誤早幾個月就已經在上游修復了 — 只是從未 獲得 CVE,所以沒有任何掃描器通知 Discourse 升級。
7:56 擁有最符合模型新聞稿的實驗室被一個沒有 文件記錄的補丁打敗了,使用的是競爭對手的模型,而且費用低於懸賞金。 迷你判決:NEEDS REVIEW — 不僅針對 OpenAI,而是針對所有人。 你星期一的任務是你不知道自己擁有的圖像庫。 本週判決:NEEDS REVIEW。
本週判決
8:13 本週的每一個頭條 — 一個已破解的密碼,一個對齊的模型, 一個已銷毀的上傳 — 在沒有文物的情況下出現,無法讓陌生人 進行檢查。 我哪裡錯了:星期一我說 SHIP IT,因為明文押韻。 押韻不是校驗和。 我錯了,所有轉發的人也錯了。 訂閱、點擊鈴鐺,並在評論中給予不同的排名 — 特別是第一名。 還有第一名。這就是今天的 diff。
8:35 我是 Axrisi 的 Niko。 負責任地合併。
來源
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



