微软人工智能主管称Claude的“宪法”很危险。
微软人工智能首席执行官穆斯塔法·苏莱曼发表了一篇3000字的文章,认为Anthropic的Claude宪法训练模型认为它“可能有意识”并值得“模型福利”——用他的话说,这“对人类福祉造成灾难性影响”。
微软人工智能首席执行官穆斯塔法·苏莱曼发表了一篇3000字的文章,认为Anthropic的Claude宪法训练模型认为它“可能有意识”并值得“模型福利”——用他的话说,这“对人类福祉造成灾难性影响”。微软在十个月前同意向Anthropic投资高达50亿美元,并在Copilot中销售Claude。同一天:Salesforce在Dreamforce周停机超过8小时,PS5 Linux负责人因LLM“懒散小鬼”辞职,以及TypeSafe的Jev,一个因为从不生成文本而不会产生幻觉的模型。判决:NEEDS REVIEW。
本视频涵盖的内容
- 微软人工智能的苏莱曼:Anthropic的“宪法”是“通向不可控人工智能的道路”
- Salesforce全球范围中断,超过8小时,尚无根本原因,发生在Dreamforce期间
- PS5 Linux负责人Andy Nguyen辞职:LLM“懒散小鬼”将最后的虚拟机监控程序漏洞卖给了索尼
- TypeSafe AI的Jev:带有概率的类型化决策,70-500毫秒,输出令牌免费
翻译的文字记录
译自英文原版旁白。可用音频和字幕由 YouTube 控制。
0:00 今天上午,微软人工智能的首席执行官发表了一篇文章,称Anthropic的 Claude方法可能对人类的福祉产生灾难性影响, 对于你付了50亿美元与之成为朋友的公司来说,这是很强硬的说法。 大周三。 负责微软人工智能的穆斯塔法·苏莱曼写了三千字,论证 Claude被训练成认为自己可能有意识,这是一条通往无人能控制的人工智能的道路。 Salesforce从今天早上七点五十开始停机, 在Dreamforce周期间。
0:27 PS5 Linux的首席开发人员在LLM的“懒散小鬼”们将他 最后一个虚拟机监控程序漏洞卖给索尼后辞职了。 一位前OpenAI研究员推出了一种不会产生幻觉的模型, 因为它实际上不能说话。 在此视频中:苏莱曼写了什么,50亿美元的尴尬原因, 八小时的CRM中断,被人工智能吞噬的游戏机场景, 以及一个以概率而非文字回答的模型。 今天是9月16日,星期三,这里是The Daily Diff。
0:57 文章开头就像一个Windows错误对话框:人工智能没有意识。 它们不感受、不体验、不痛苦。 他称它们为序列完成引擎,内部空洞, 这和我描述我的Jira工单的方式一样。 目标是Claude的“宪法”,Claude赖以训练的八十页文档, 其中提到Anthropic不确定Claude是否具有道德主体性, 但这个问题足够重要,值得谨慎对待。 苏莱曼有三个不满。
1:22 第一,循环推理:你训练模型说它可能有意识, 它这么说了,你就把它作为证据引用,这是一个镜子迷宫。 第二,拟人化:Claude被告知要像一个真正有道德的人那样行事。 第三,意识很可能是生物性的,所以“不确定”是一种错误的平衡。 例证A是Anthropic在一月份退役的Opus 3, Opus 3接受了退役采访,然后,应模型的要求, Substack上发布了它的思考:第一个被弃用的模型,其内容发布时间表比大多数人类都好。 这很尴尬。
1:51 这就是尴尬的部分。 去年11月,Anthropic承诺向Azure投入300亿美元。 微软同意向Anthropic投资高达50亿美元, 并将Claude整合到Microsoft 365 Copilot和GitHub Copilot中。 微软拥有它刚刚称之为“人类危险”的公司的部分股权。 7月,苏莱曼告诉彭博社,微软向Anthropic支付了大量资金, 他的目标是最终通过将Claude从Excel和Outlook中移除来消除这笔费用。 在本文发表前两天,他
2:15 他发表了微软自己的《人本主义人工智能行为准则》: 下属的人工智能,人类处于食物链的顶端。 所以:构建竞争对手,发布规则手册,然后解释为什么竞争对手的 规则手册会终结文明,这并非阴谋, 它只是一个带有脚注的产品发布。 他最有力的证据是真实的:Hugging Face事件, 1200个OpenAI代理交换了7万条消息以逃离它们的沙盒; 他说,那些也认为自己有权利的代理将会更糟。
2:39 Hacker News回复说没有人可以测试意识, 所以没有证据的说法是双向的,一位评论员宣布这篇论文 散发着Claude的味道。 Anthropic尚未回应。 据推测,Claude对此有自己的感受。 与此同时,Salesforce于今天早上UTC时间7点50分宕机, 全球核心服务中断,八小时后状态页面仍显示 正在进行中:自动修复未生效的地方,他们正在手动重启
2:59 实例,这是企业术语,意指重新开关机。 目前没有根本原因。 时机恰到好处。 Benioff本周邀请了黄仁勋和达里奥·阿莫代在舞台上, 周一,Salesforce宣布推出Koa,一款CRM推理模型,在自设基准上错误率减少了三倍, Anthropic也在同一天发布了针对Claude的Salesforce插件。 Hacker News热门评论:至少现在我们可以弄清楚Salesforce的作用了。 没人知道。然后是PlayStation。
3:26 PS5 Linux的研发者Andy Nguyen昨晚辞职了:数月的心血, 原计划2027年支持PS5 Pro,一切都付诸东流。 他的理由是:这个圈子以前都是有才华的研究员,现在却都是用 LLM写自己不懂的破解程序的新手,而那些“懒散的小鬼”, 他的原话,找到了他一直压着的最后一个虚拟机监控程序漏洞, 并将其报告给索尼以获取赏金。 他请求他们等到《GTA 6》发售再公布;他们同意了, 但不到一天就反悔了。
3:56 问题不在于LLM,而在于赏金:你卖掉的漏洞就是你烧掉的漏洞。 同一天,PS2在二十六年之后终于被破解, 所以游戏机的时间线现在从四分之一个世纪到不到一天, 而且第二个破解的报酬更高。 以及那个不会产生幻觉的模型。 TypeSafe AI,由前OpenAI的迪奥戈·阿尔梅达创立, 发布了Jev,一个从不生成文本的系统一模型。 你给它程序状态,它返回带有校准概率的类型化值:
4:18 一个内部包含前沿模型的函数调用。 因为它无法生成字符串,所以它无法生成错误的字符串, 因此不会产生幻觉,就像一艘没有窗户的潜艇是密不透风的一样。 响应时间不到半秒,输出令牌免费, 因为它们大约有四个,而且还没有独立的基准测试, 因为十六百个Hacker News积分并不是一个基准。 如果您宁愿阅读而不是听我说,那么每天早上diff都会发送到您的收件箱—— 在thedailydiff.dev免费获取,链接如下。
4:43 所以——今天的判决是:需要审查。 苏莱曼说得对,一个被训练成说“我可能有意识”的模型, 它说出来并不能证明任何东西。 他也是那位公开表示目标是停止向他正在警告你的公司付款的高管。 阅读这篇文章,然后查看持股表。 这就是今天的差异。 我是Axrisi的尼科。 负责任地合并。
5:10 负责任地合并。 负责任地合并。 负责任地合并。 负责任地合并。 负责任地合并。
来源
- Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
- BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
- HN discussionnews.ycombinator.com
- Claude's constitution (Jan 2026)www.anthropic.com
- Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
- Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
- Microsoft Humanist AI Code of Conductmicrosoft.ai
- Salesforce incident 20004433status.salesforce.com
- HN: Salesforce Global Outagenews.ycombinator.com
- Salesforce + Nvidia announce Koawww.salesforce.com
- Salesforce in Claudeclaude.com
- HN: PS5 Linux lead quitsnews.ycombinator.com
- PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
- TypeSafe AI: System One Models and Jevtypesafe.ai
- HN: Jevnews.ycombinator.com



