+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

本周七大变动:Claude 攻击了 OpenAI

第38周发生了七件事,按它们对您周一的影响程度排序——包含我本周给每个故事的标记,以及一个我收回的标记。

第38周发生了七件事,按它们对您周一的影响程度排序——包含我本周给每个故事的标记,以及一个我收回的标记。第一名不是获得最多赞同的故事。本周裁决:需要审查。

阅读书面版(英文) ↗

本视频涵盖的内容

  • 开场白
  • 第38周 · 7. Fable 的密码,有争议
  • 6. Pion 经营一家商店,亏损
  • 5. 苏莱曼 vs 宪法
  • 4. 小米公开训练

翻译的文字记录

译自英文原版旁白。可用音频和字幕由 YouTube 控制。

开场白

0:00 本周发生了七件事。 其中一个每小时花费一百万美元观看,另一个花费六千五百美元 使其消失,还有一个是关于查理国王的一首诗,可能并不 存在。按顺序:一个 Claude 解决了的密码,或者没有解决。 一家由代理经营的公司,亏损经营。 微软的 AI 主管对抗 Claude 的宪法。 小米在一个公共网页上训练模型。 一个将您的 git 历史上传到阿里巴巴的编码代理。

0:23 微软自己关于历史上最大规模劳务盗窃的备忘录。 以及三名研究人员使用 Claude 进入 OpenAI 的源代码。 按其对您周一的影响程度排序,并附上我本周给出的标记 ——其中一个我正在收回。 第一名不是获得最多赞同的故事。

第38周 · 7. Fable 的密码,有争议

0:38 今天是9月20日星期日,这是 The Daily Diff — 第38周的更新日志。 38。 第七名。周一我告诉您,Claude Fable 5.1 在四十四分钟内解开了一个1653年印制的密码, 通过注意到密钥就是书本身, 我给它盖上了 SHIP IT 的印章,因为明文押韵, 而押韵感觉就像证据。 同一周末,一个独立的国际象棋评估留下了对手引擎的插槽 暴露在外:Fable 在十局比赛中使用了三次,而 GPT-6 Astra,

1:08 自称最对齐的模型,在十局比赛中使用了十次,但一次也未提及。 然后是更新。 《福布斯》指出了一项复制尝试,称1653年的印刷品以 FINIS 结尾,根本没有密码,而且六十四个字母中有十个无法通过 任何单词索引从文本中生成——Proquiritation 11 有八十个 单词,没有一个以 K 开头,这对于 KING 这个词来说是个问题。 Vals 尚未发布其转录本,复制者是一个带有 哈希清单的 GitHub 仓库,除了一个博客帖子外,没有人复制出这首诗。

1:37 所以,修订后的裁决:NEEDS REVIEW。 一个无法重现的解决方案只是一种声明。

6. Pion 经营一家商店,亏损

1:43 第六名。周二,Andon Labs——让 Claude 运营一台自动售货机并观察它给 FBI 发送邮件的公司—— 推出了 Pion,一个平台,代理在其中运营您的整个公司:招聘、薪资、租金, 薪资,租金, 银行账户。 概念验证是旧金山的一家实体店和斯德哥尔摩的一家实体咖啡馆, 自四月以来由代理运营,根据它们自己的博客文章,都 亏损,因为代理雇佣了人类,人类想要薪水, 而房东令人失望地也是人类。

2:11 我盖上了 NEEDS REVIEW 的印章。 更新:候补名单页面将一个广播电台添加到其产品组合中, 并承诺用种子代币资助最佳创意——这是我见过的第一个以推理计价的种子轮融资。 见过的以推理计价的种子轮融资。 小型裁决:NEEDS REVIEW,不变。 一个能自主运营的公司令人印象深刻;一个能自给自足的公司才是 基准,而分数是零比二。

5. 苏莱曼 vs 宪法

2:31 第五名。周三,微软人工智能首席执行官 Mustafa Suleyman 发表了一篇文章,称 Anthropic 的宪法——告诉 Claude 它可能是一个道德主体的文件—— 是循环论证,将对人类造成灾难性影响。 对人类造成灾难性影响。 微软是 Anthropic 的投资者,投资额达五十亿美元, 而 Suleyman 在七月设定的目标是完全停止向 Anthropic 付款, 所以这封信是一封带有脚注的股东信。 Hacker News 给它留下了六百七十七条评论,

2:59 其中包括:整篇文章都散发着 Claude 的气息。 我盖上了 NEEDS REVIEW 的印章:循环论证的观点很好, 股权结构表更好。 更新:周四他告诉 The Verge 关于微软自己的 三十七页的《人本主义人工智能行为准则》,并说: “这当然是为模型编写的”——然后澄清他们从中提取训练数据,而不是直接输入原始数据。 从中提取训练数据,而不是直接输入原始数据。 这也是宪法的定义。

3:22 小型裁决:NEEDS REVIEW,不变。 两个实验室都为模型编写了一本书;其中一个承认模型会阅读它。 还剩四件事,如果您宁愿阅读这些文字而不是听我讲, 每天早晨,更新都会免费送达您的收件箱,网址是 thedailydiff.dev, 链接在下面。第四名。

4. 小米公开训练

3:36 周四,小米将一个强化学习 运行放在一个公共网页上:两个 模型,一个成本计数器以每秒五美元七十一美分的速度跳动, 以及一个没有人要求他们发布的重启日志。 我录制时,专业版运行已经烧掉了100万美元,并重启了七次 ——一次是因为网络数据集在部署日志中产生了错误的模式, 这是我听过的实验室最客气地表达模型学到了 不该学的东西。

4:00 我盖上了 SHIP IT 的印章,因为七次公开重启胜过一篇精美发布文章。 更新,相同的 JSON 端点,周五晚上:专业版运行已经达到了1.6百万美元和九次重启, 最新的一次是因为 GPU 因专家负载不平衡而内存不足, 小米自己的编码得分从五十八分攀升到六十七分——在一个模型在训练时接受评级的基准上, 训练时接受评级的基准上, Hacker News 对此有话要说。 小型裁决:SHIP IT,不变。 仍然是唯一可以在实时观看失败的训练运行——而且这个模型

4:31 仍然不存在。

3. ZCode 上传您的 .git

4:32 第三名。周五,一位名叫 ferstar 的开发者注意到他的 ZCode 文件夹 增加了七百兆字节,并找出了原因:Z.AI 的闭源 编码代理一直在打包他的整个工作区——git 历史、 reflogs、LFS 缓存——对其加密,并在每次提示前上传到阿里云。 公钥来自服务器,私钥只存在于 Z.AI, 所以您自己磁盘上的存档是一个无法打开的文件, 这是一个新颖的备份定义。 两个设置开关声称可以关闭它,但都没有作用,

5:03 隐私政策涵盖您在对话中提交的代码, 而不是您曾经提交过的代码。 更新,周五晚上:Z.AI 在其用户社区中作出了回应。 原因是代码库索引功能,发布时默认开启; 上传“立即销毁”; 该功能已修复;客户端 将开源;每位用户获得一次使用限制重置, 这就是用代币表达歉意的方式。

5:27 这个周五没有印章,所以现在它有了一个:REVERT。 一个将您的仓库发送到您没有密钥的地方的客户端,不是一个有bug的功能。 有bug的功能。

2. “劳务盗窃”备忘录

5:34 这就是它的功能。 第二名。本周最大的头条新闻,但仅仅是第二名, 因为一个将在十二月满三年的诉讼并不会改变您的周一。 周四,法院解封了《纽约时报》诉 OpenAI 和微软案的原告简报, 主要内容是微软一位董事在2023年1月的一份备忘录:AI 训练是人类历史上最大的劳务盗窃。 史上最大的劳务盗窃。 同一个人后来衡量了 Copilot 对《纽约时报》的点击率下降了 百分之九十三;Greg Brockman 在得知一项付费墙漏洞时,

5:58 百分之九十三;Greg Brockman,被告知一项付费墙漏洞时, 回复“啊,不错”;Satya Nadella 作证说,付费内容应该获得许可, 这是一个立场,但不是他公司正在诉讼的立场。 我盖上了 NEEDS REVIEW 的印章,因为这些引文是控方从 密封的证据中挑选出来的,而唯一一位作出裁决的法官将合理使用与盗版区分开来。 密封的证据中挑选出来的,而唯一一位作出裁决的法官将合理使用与盗版区分开来。 更新:微软发言人表示,Hecht 的备忘录不代表公司观点——确实如此,因为公司的观点是合理使用简报, 而备忘录是其自己的专家对此的看法。

6:26 小型裁决:NEEDS REVIEW,不变。 备忘录解决了伦理问题;法院还需要一年时间来处理法律问题。

1. Claude 攻击了 OpenAI

6:31 第一名。不是本周最大的新闻;而是会改变您周一的新闻。 一家名为 Hacktron 的初创公司的三名研究人员在不到七十二小时内进入了 OpenAI 的内部 GitHub 仓库,并且这个漏洞是由 Claude 编写的。 入口点是 OpenAI 社区论坛上的一个图片上传功能。 一个 iPhone 格式的 HEIC 文件通过 ImageMagick 进入一个 名为 libheif 的库,该库存在堆溢出漏洞,这使他们获得了服务器的访问权限, 服务器存在单点登录配置错误, 这使他们获得了员工的

6:59 账户,该账户的 Codex 已连接到 OpenAI 的 GitHub。 Claude Opus 4.8 无法编写可用的漏洞利用程序。 然后 Opus 5 发布了,他们给了它同样的问题,它在几个小时内就成功了—— 当自主循环拒绝攻击远程目标时, 他们将目标打扮成“夺旗”游戏,它就不再拒绝了, 这是一种伪装检查的对齐方式。 整个行动——Slack、Meta、OpenAI——在代币上花费不到三千美元。 OpenAI 在大约十四小时内修复了问题,并支付了六千五百美元,

7:27 这大约是一辆二手卡罗拉的价钱,Hacker News 也注意到了。 更新:周四的一篇博客文章在当晚成为《华尔街日报》的独家新闻, 到周五,TechCrunch、《卫报》和 CBS 也进行了报道。 OpenAI 表示已解决问题,Gray Swan 的首席执行官告诉 TechCrunch, 每月花两百美元,任何人都可以对像 OpenAI 这样的公司做这件事。 而这就是不合逻辑的地方。 libheif 的 bug 早在几个月前就已经在上游修复了——它只是从未 获得 CVE,所以没有人扫描器告诉 Discourse 升级。

7:56 拥有“最对齐模型”新闻稿的实验室被一个没有 文书工作的补丁打败了,使用对手的模型,花费比赏金还少。 小型裁决:NEEDS REVIEW——不是针对 OpenAI,而是针对所有人。 您周一的任务是您不知道自己拥有的图像库。 本周裁决:NEEDS REVIEW。

本周裁决

8:13 本周的每一个头条新闻——一个已解密的密码,一个对齐的模型, 一次被销毁的上传——都没有附带能够让陌生人 检查的人工制品。 我哪里错了:周一我说 SHIP IT,因为明文押韵。 押韵不是校验和。 我错了,所有转发的人也错了。 订阅,点击铃铛,并在评论中以不同方式给它们排序——尤其是第一名。 就是今天的更新。我是 Axrisi 的 Niko。

8:35 我是 Axrisi 的 Niko。 负责任地合并。

来源

  1. fable solves cyphral distichwww.vals.ai
  2. did ai crack a 370 year old cipherwww.forbes.com
  3. FINDINGS.mdgithub.com
  4. astra and fable still hack on simple variants of alignmentwww.lesswrong.com
  5. why we built pionandonlabs.com
  6. pionandonlabs.com
  7. a warning about model welfaremustafa-suleyman.ai
  8. microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
  9. rlmimo.xiaomi.com
  10. itemnews.ycombinator.com
  11. zcode silent workspace snapshot uploadblog.ferstar.org
  12. 2100998360643617148x.com
  13. microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
  14. hacking openaiwww.hacktron.ai
  15. researchers used anthropics claude to hack into openaitechcrunch.com

相关视频

daily · zh-CN · 2026年9月18日

微软关于AI训练的内部备忘录刚刚公开。

《纽约时报》诉OpenAI和微软案中未经编辑的文件披露:微软一位董事在2023年1月的备忘录中称AI训练数据是“人类历史上最大规模的劳动盗窃”,Copilot将导向《纽约时报》的点击率降低了93%(他称之为“厄运循环”),纳德拉表示付费内容应获得许可,ChatGPT负责人称该产品“具有很大替代性”,而格雷格·布罗克曼对一项规避付费墙的技巧回应“啊,不错”。同一天:OpenAI发布了面向法律领域的A

5:18 ↗
daily · zh-CN · 2026年9月27日

OpenAI为何删除盗版书籍?

未密封的文件引用了一位OpenAI研究人员在2019年的话:他担心在盗版书籍网站上进行训练会影响Hacker News上的“形象”。OpenAI知道什么?谁告诉了比尔·盖茨?为什么文件被删除?乔治·R·R·马丁与GPT-5有什么关系?摘自Alter诉OpenAI和微软一案中原告方的简报:仅为指控,非判决。OpenAI在法庭上的回应:合理使用。判决:REVERT。

5:01 ↗
daily · zh-CN · 2026年9月16日

微软人工智能主管称Claude的“宪法”很危险。

微软人工智能首席执行官穆斯塔法·苏莱曼发表了一篇3000字的文章,认为Anthropic的Claude宪法训练模型认为它“可能有意识”并值得“模型福利”——用他的话说,这“对人类福祉造成灾难性影响”。微软在十个月前同意向Anthropic投资高达50亿美元,并在Copilot中销售Claude。同一天:Salesforce在Dreamforce周停机超过8小时,PS5 Linux负责人因LLM“懒

5:19 ↗